研究定位
Kimodo是NVIDIA Research提出的运动学动作扩散模型。它学习约700小时光学动作捕捉数据,根据文本描述和可选运动学约束生成完整的三维人类或类人机器人动作。
可控生成
- 文字描述:用动作语义描述走路、转身、跳跃、手势或组合动作。
- 关键姿态:给出某些帧的全身姿态,控制动作必须经过的状态。
- 局部约束:可加入关节位置或旋转等约束。
- 路径控制:支持二维路点或连续路径,让根部运动沿指定路线推进。
使用方法
- 阅读NVIDIA官方文档与模型许可,选择适合目标骨架的模型变体。
- 按官方说明创建虚拟环境或Docker环境并获取检查点。
- 从一条短文本提示开始生成多个候选动作,再逐步加入关键姿态或路径约束。
- 检查脚底接触、平衡、根运动和循环连续性,必要时在动画工具中修正。
- 导出到目标格式时核对骨架、Rest Pose、坐标系、比例和帧率。
与Animcraft的关系
Animcraft 6.0宣布集成Kimodo用于文本生成动作,但没有公布使用的具体模型变体、全部约束控件和完整导出格式。NVIDIA独立版文档中的命令行和NPZ/BVH等示例不能直接当作Animcraft界面说明。
限制
生成动作是可继续编辑的素材,不会自动解决角色表演、手脚接触、镜头节奏、游戏循环和不同骨架之间的变形问题。研究模型、数据集、权重和下游工具的许可也应分别核对。





