MDM 从文字描述生成三维人体运动序列,适合先做动画动作草案。它输出骨架运动,与“把真人视频变成同款视频”是不同任务。下面以走路后抬手为例,说明数据、模型与方向检查;未运行生成,也不保证动作可直接进入角色动画。
先区分文本生成与完整训练数据
官方 motion-diffusion-model 项目区分仅做文本生成的简化数据路径,与用于训练和评估的完整动作捕捉数据。选择 HumanML3D 对应模型,按 README 准备文本与检查点;不要混用 HumanAct12 动作类别模型。示例路径只是官方目录结构,权重应由项目说明获取。

用一条短动作指令开始
python -m sample.generate --model_path ./save/humanml_trans_enc_512/model000200000.pt --text_prompt "a person walks forward, then raises one hand."
第一次只描述一个人和短动作顺序,不加入“镜头环绕、高清皮肤”等视频渲染词。模型路径、数据集与项目版本一起记录。官方还支持 –input_text 指向文本文件;先完成单条描述再做批量,便于定位缺少资源或文本加载问题。
骨架预览需要检查哪些内容
先看起始姿势与时间长度,再看“走路”和“抬手”的先后。脚底是否滑动、手臂是否穿过躯干、根节点是否连续移动,比画面好不好看更关键。骨架关节顺序与坐标系来自训练数据约定,导入角色前要确认朝向、单位及映射,不能把渲染中的右侧直接当成角色自身右侧。输出预览只能证明生成了动作,不能证明已经正确绑定角色。
给动画师留下可复核交付
保存描述、检查点路径、生成文件与正侧面预览;在记录里标出脚滑、方向反转或重复动作的时间段。若文字生成能运行但角色导入扭曲,先检查骨架映射,不要盲目重生成。长篇复杂指令没有可靠兑现时,改成一个动作并检查,而不是宣称模型可理解所有连贯故事。模型与数据许可需分别核对;这里不提供商业授权结论。
参考资料
依据 2026-10-03 读取的官方资料整理:官方文档 1。
Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/33071.html