Sitcom-Crafter:动画师失业警告!AI黑科技自动生成3D角色动作,剧情脚本秒变动画

简介: Sitcom-Crafter 是一款基于剧情驱动的 3D 动作生成系统,通过多模块协同工作,支持人类行走、场景交互和多人交互,适用于动画、游戏及虚拟现实等领域。

❤️ 如果你也关注 AI 的发展现状,且对 AI 应用开发感兴趣,我会每日分享大模型与 AI 领域的开源项目和应用,提供运行实例和实用教程,帮助你快速上手AI技术!

🥦 AI 在线答疑 -> 智能检索历史文章和开源项目 -> 尽在微信公众号 -> 搜一搜:蚝油菜花 🥦


🚀 「当LLM遇见3D物理引擎:开源框架实现剧本→动画全自动生成」
大家好,我是蚝油菜花。在SIGGRAPH 2024引爆讨论的Sitcom-Crafter,正在重新定义3D内容创作:

三大技术革命:

  • 1️⃣ 场景感知SDF:无需数据采集即可模拟真实物理交互
  • 2️⃣ 多智能体协同:20+角色同步生成无碰撞动作
  • 3️⃣ 跨平台重定向:5分钟适配Maya/Blender/Unity工作流

从独立游戏到影视级动画,这套系统已帮助团队将动作制作效率提升300%。接下来我们将深度解析其八大模块如何协作——你的动画师可能要转型AI教练了!

🚀 快速阅读

Sitcom-Crafter 是一个基于剧情驱动的 3D 动作生成系统,能够高效生成符合物理逻辑的动作。

  1. 核心功能:支持人类行走、场景交互和多人交互,并通过增强模块优化动作流畅性和自然性。
  2. 技术原理:结合自监督 SDF 策略和扩散模型,解决碰撞问题并生成多样化的动作。

Sitcom-Crafter 是什么

Sitcom-Crafter-Teaser-detail

Sitcom-Crafter 是一套综合性的 3D 场景中人类动作生成系统,旨在通过剧情指导生成多样化且物理真实的动作。它由八大部分组成,其中三大模块专注于运动生成,其余五个模块则用于动作优化和增强。

该系统的核心创新点在于其 3D 场景感知技术和自监督 SDF 策略,无需额外数据采集即可生成符合物理逻辑的动作。这种设计显著提升了创作效率,为动画制作、游戏开发以及虚拟现实等领域的设计师提供了高效的智能化解决方案。

此外,Sitcom-Crafter 支持多种动作类型,包括人类行走、人与场景交互以及人与人之间的交互。这使得它在复杂剧情驱动的任务中表现尤为突出。

Sitcom-Crafter 的主要功能

  • 人类行走:角色在 3D 场景中自然行走,支持动态路径规划。
  • 人类与场景交互:角色与环境物体进行符合物理逻辑的交互,例如开门或拾取物品。
  • 人类之间交互:角色之间协调动作,减少碰撞并优化同步性。
  • 剧情解析:通过大型语言模型解析剧本,转化为具体的角色动作指令。
  • 运动同步:确保不同模块生成的运动在时间上保持一致。
  • 手部姿态增强:检索数据库中的手部姿态以增强运动的自然性。
  • 碰撞修正:自动检测并修正人物之间的碰撞。
  • 3D 重定向:将生成的运动映射到现有的 3D 数字人物模型,提升视觉效果。

Sitcom-Crafter 的技术原理

Sitcom-Crafter-framework

  • 运动生成模块
    • 人类行走生成:基于 GAMMA 等方法,通过深度学习模型生成行走运动。
    • 人与场景交互生成:结合 DIMOS 方法,利用场景信息生成交互动作。
    • 人与人交互生成:使用自监督场景感知方法,通过 SDF 点模拟周围环境,避免碰撞并生成多人交互动作。
  • 场景感知技术
    • SDF 点合成:随机生成周围物体的 SDF 点,模拟障碍物。
    • 碰撞检测与修正:通过 SDF 点调整运动轨迹或速度,避免碰撞。
  • 剧情理解与命令生成:使用大型语言模型(如 Gemini 1.5)解析剧情文本,转化为具体运动指令。
  • 增强模块
    • 运动同步:通过插值技术确保不同模块生成的运动平滑过渡。
    • 手部姿态检索:利用 CLIP 模型检索最相似的手部姿态。
    • 碰撞修正:调整运动速度或路径,避免人物之间的碰撞。
    • 3D 重定向:将生成的运动映射到高质量的 3D 数字人物模型。

如何运行 Sitcom-Crafter

1. 环境配置

Sitcom-Crafter 需要以下硬件和软件环境:

  • 硬件要求
    • GPU:建议使用多块 GPU 进行训练;单块 GPU 至少需要 12GB 显存。
  • 软件要求
    • Python:3.10 或更高版本。
    • CUDA:11.8 或更高版本。
    • cuDNN:8.4.1 或更高版本。

安装依赖项:

pip install -r requirements.txt

注意:部分依赖包(如 pointnet2_opspytorch3d)可能需要手动编译,请参考官方文档完成安装。

2. 数据准备

InterHuman 数据集

下载 InterHuman 数据集并将其转换为标记点格式:

cd HHInter
python rearrange_dataset.py

Inter-X 数据集

下载 Inter-X 数据集并进行类似处理:

cd HHInter
python rearrange_dataset_interX.py

3. 运行示例

执行以下命令以生成基于剧情驱动的动作序列:

cd HSInter
python synthesize/demo_hsi_auto.py

需确保已正确配置预训练模型路径,并根据需求修改 save_path_name 参数。

资源


❤️ 如果你也关注 AI 的发展现状,且对 AI 应用开发感兴趣,我会每日分享大模型与 AI 领域的开源项目和应用,提供运行实例和实用教程,帮助你快速上手AI技术!

🥦 AI 在线答疑 -> 智能检索历史文章和开源项目 -> 尽在微信公众号 -> 搜一搜:蚝油菜花 🥦

相关文章
|
人工智能 自然语言处理 搜索推荐
PhotoDoodle:设计师必备!AI一键生成装饰元素,30+样本复刻风格+无缝融合的开源艺术编辑框架
PhotoDoodle 是由字节跳动、新加坡国立大学等联合推出的艺术化图像编辑框架,能够通过少量样本学习艺术家的独特风格,实现照片涂鸦和装饰性元素生成。
723 1
PhotoDoodle:设计师必备!AI一键生成装饰元素,30+样本复刻风格+无缝融合的开源艺术编辑框架
|
机器学习/深度学习 人工智能 自然语言处理
Reve Image:设计师失业警告!AI秒出海报级神图,排版自动搞定
Reve Image 是 Reve 推出的全新 AI 图像生成模型,专注于提升美学表现、精确的提示遵循能力以及出色的排版设计,能生成高质量的视觉作品。
846 29
Reve Image:设计师失业警告!AI秒出海报级神图,排版自动搞定
|
人工智能
🎨 设计师必备!AI Stable Diffusion 提示词神器,让你秒变创意大师!
AI绘图新时代来临,设计师必备工具——**白盒子AI绘图提示词生成器**助你轻松跨越提示词难题。该工具操作简便,支持中英文切换,涵盖近1000个精选提示词,适用于各种风格创作。无论是新手还是专业设计师,都能大幅提升工作效率,快速实现创意构想。网址:[https://www.baihezi.com/ai-painting-prompt](https://www.baihezi.com/ai-painting-prompt)
1299 19
🎨  设计师必备!AI Stable Diffusion 提示词神器,让你秒变创意大师!
|
机器学习/深度学习 人工智能 算法
Stable Virtual Camera:2D秒变3D电影!Stability AI黑科技解锁无限运镜,自定义轨迹一键生成
Stable Virtual Camera 是 Stability AI 推出的 AI 模型,能够将 2D 图像转换为具有真实深度和透视感的 3D 视频,支持自定义相机轨迹和多种动态路径,生成高质量且时间平滑的视频。
1218 0
Stable Virtual Camera:2D秒变3D电影!Stability AI黑科技解锁无限运镜,自定义轨迹一键生成
|
机器学习/深度学习 人工智能 PyTorch
模型手动绑骨3天,AI花3分钟搞定!UniRig:清华开源通用骨骼自动绑定框架,助力3D动画制作
UniRig是清华大学与VAST联合研发的自动骨骼绑定框架,基于自回归模型与交叉注意力机制,支持多样化3D模型的骨骼生成与蒙皮权重预测,其创新的骨骼树标记化技术显著提升动画制作效率。
2753 27
模型手动绑骨3天,AI花3分钟搞定!UniRig:清华开源通用骨骼自动绑定框架,助力3D动画制作
|
机器学习/深度学习 TensorFlow 算法框架/工具
|
数据采集 机器学习/深度学习 人工智能
SkyReels-V1:短剧AI革命来了!昆仑开源视频生成AI秒出影视级短剧,比Sora更懂表演!
SkyReels-V1是昆仑万维开源的首个面向AI短剧创作的视频生成模型,支持高质量影视级视频生成、33种细腻表情和400多种自然动作组合。
2360 92
SkyReels-V1:短剧AI革命来了!昆仑开源视频生成AI秒出影视级短剧,比Sora更懂表演!
|
10月前
|
人工智能 编解码 搜索推荐
AI智能换背景,助力电商图片营销升级
电商产品图换背景是提升销量与品牌形象的关键。传统抠图耗时费力,AI技术则实现一键智能换背景,高效精准。本文详解燕雀光年AI全能设计、Canva、Remove.bg等十大AI工具,涵盖功能特点与选型建议,助力商家快速打造高质量、高吸引力的商品图,提升转化率与品牌价值。(238字)
897 0
|
机器学习/深度学习 人工智能 vr&ar
LHM:单图生成3D动画人!阿里开源建模核弹,高斯点云重构服装纹理
阿里巴巴通义实验室开源的LHM模型,能够从单张图像快速重建高质量可动画化的3D人体模型,支持实时渲染和姿态控制,适用于AR/VR、游戏开发等多种场景。
4305 0
LHM:单图生成3D动画人!阿里开源建模核弹,高斯点云重构服装纹理
|
人工智能 计算机视觉
漫画师福音!开源AI神器让线稿着色快如闪电!MagicColor:港科大开源多实例线稿着色框架,一键生成动画级彩图
MagicColor是香港科技大学推出的多实例线稿着色框架,基于扩散模型和自监督训练策略,实现单次前向传播完成多实例精准着色,大幅提升动画制作和数字艺术创作效率。
1413 20
漫画师福音!开源AI神器让线稿着色快如闪电!MagicColor:港科大开源多实例线稿着色框架,一键生成动画级彩图

热门文章

最新文章