做视频AI导航网
做视频AI导航网
AI导航
  • 热门工具
  • Agent智能体
  • Skills技能
  • AI大模型
  • AI创作
  • AI工具集
视频Video
  • 素材下载
  • 创作灵感
Github神器
  • 导航
  • 资讯
  • 视频素材
  • 视频模版
  • 音乐音效
  • Luts调色预设
  • 整合包
首页/
打开 MD 链接

Kimodo - NVIDIA可控文本生成三维动作的研究模型

4
以700小时动作捕捉数据训练,结合文字、关键姿态和路径约束生成角色与类人机器人动作
评分
产品类型:可控三维动作生成研究模型研究团队:NVIDIA Research训练数据:约700小时光学动作捕捉数据输入方式:文本提示与可选运动学约束输出类型:全身三维动作序列;格式取决于模型骨架和工具注意事项:独立研究项目能力不等同于Animcraft集成范围
Kimodo是NVIDIA Research的运动学动作扩散模型,基于约700小时光学动作捕捉数据训练,可根据…
3D设计|AI动画·Kimodo·动作重定向

研究定位

Kimodo是NVIDIA Research提出的运动学动作扩散模型。它学习约700小时光学动作捕捉数据,根据文本描述和可选运动学约束生成完整的三维人类或类人机器人动作。

可控生成

  • 文字描述:用动作语义描述走路、转身、跳跃、手势或组合动作。
  • 关键姿态:给出某些帧的全身姿态,控制动作必须经过的状态。
  • 局部约束:可加入关节位置或旋转等约束。
  • 路径控制:支持二维路点或连续路径,让根部运动沿指定路线推进。

使用方法

  1. 阅读NVIDIA官方文档与模型许可,选择适合目标骨架的模型变体。
  2. 按官方说明创建虚拟环境或Docker环境并获取检查点。
  3. 从一条短文本提示开始生成多个候选动作,再逐步加入关键姿态或路径约束。
  4. 检查脚底接触、平衡、根运动和循环连续性,必要时在动画工具中修正。
  5. 导出到目标格式时核对骨架、Rest Pose、坐标系、比例和帧率。

与Animcraft的关系

Animcraft 6.0宣布集成Kimodo用于文本生成动作,但没有公布使用的具体模型变体、全部约束控件和完整导出格式。NVIDIA独立版文档中的命令行和NPZ/BVH等示例不能直接当作Animcraft界面说明。

限制

生成动作是可继续编辑的素材,不会自动解决角色表演、手脚接触、镜头节奏、游戏循环和不同骨架之间的变形问题。研究模型、数据集、权重和下游工具的许可也应分别核对。

常见问题(FAQ)

Kimodo是什么?
它是NVIDIA Research开发的运动学动作扩散模型,可根据文本和可选约束生成三维人类与类人机器人动作。
Kimodo用什么数据训练?
官方说明使用约700小时光学动作捕捉数据训练。
Kimodo能用哪些约束控制动作?
独立研究版支持文本、全身关键姿态、稀疏关节位置和旋转、二维路点与连续二维路径等。
Kimodo生成的动作能直接用于所有角色吗?
不能保证。需要核对骨架、Rest Pose、坐标系、比例、根运动、脚底接触和目标项目的动作要求。
Animcraft 6.0包含Kimodo的全部功能吗?
公开资料只确认Kimodo集成和文本生成动作,未说明独立研究版全部约束、模型变体及导出格式均已开放。
0 讨论
热门最新
总结
暂无总结
0 / 600
细中粗

相关网站

热门最新

LingBot-VA – 把视频理解、动作建模和机器人控制连到一起的具身智能大模型

面向通用机器人控制的因果视频-动作世界模型页面,聚焦具身智能、世界模型与机器人学习方向

聚焦具身智能、机器人控制与视频动作世界模型方向的前沿大模型页面。

0

MAVIN – 按剧本生成多镜头音视频的叙事控制模型

让AI沿着叙事时间线安排镜头、对白、动作与角色身份

MAVIN是ECCV 2026 Oral多镜头音视频生成研究,通过边界感知注意力、身份感知传播和多智能体脚本流…

0

MoWorld – 高帧率实时交互世界模型

面向 NPU 的高帧率实时交互世界模型,适合关注世界模型和视频生成的用户。

面向 NPU 的实时交互世界模型,强调高帧率、低成本和连续控制的视频世界生成能力。

0

Tripo AI – 从文字或图片快速生成可编辑3D模型

先生成角色与生物资产,再导入Blender细修、绑定和制作动画

Tripo AI是一款文字与图片生成3D模型平台,支持高细节模型、AI贴图、智能分割和自动绑定,可把生成结果导…

0

World Labs Atlas|相机可控生成、3D重建与机器人仿真的多模态世界模型

李飞飞团队World Labs推出的多模态世界模型,可进行像素级相机控制、最长1分钟1440p视频、稀疏视角3…

0

Orca – 值得关注的世界模型研究页,适合看 AI 往哪儿走的人

北京智源团队的世界模型研究页面,围绕观察、推理、认知和行动展开。

Orca 是北京智源人工智能研究院团队发布的世界模型研究页,重点讨论 next state predictio…

0

Animcraft – 动画资产库、动作重定向与AI角色工作流平台

统一管理角色动作,跨Maya、3ds Max、Blender与游戏引擎复用;6.0新增自动权重和Kimodo文生动作

Animcraft是Basefount的动画库与动作重定向平台,可接收多种DCC、FBX、BVH和glTF动作…

0

Zing-0.5 – 开源实时交互式视频世界模型

一边探索空间,一边用自然语言改写正在生成的世界

Zing-0.5是开源实时交互式视频世界模型,支持键盘动作与文本提示联合控制、中途改写、因果KV Cache和…

0

Kimi – 从百万上下文对话进化到300个Agent协作办事的全能助手

推荐!从百万上下文深度研究到300个Agent并行办事,一站完成PPT、表格、代码与专业报告

推荐!K3用百万上下文和原生视觉处理复杂资料,Kimi Work还能调度300个Agent、操作浏览器并交付P…

0

Boogu – 开源图像生成与编辑基础模型

开源统一图像生成与编辑基础模型,适合关注多模态生成能力的开发者。

面向图像生成与编辑场景的开源基础模型,适合关注多模态生成能力的开发者和研究者。

0
所有的成功,都源自一个勇敢的开始
不辜负每一个勇敢的开始
做视频AI导航网 © 2026闽ICP备16009488号-1