
OpenMontage 角色动画流水线 Script Director 实战指南把剧本写成可表演的动画节拍【免费下载链接】OpenMontageWorlds first open-source, agentic video production system. 12 production pipelines, 100 tools, 700 agent skill and production-knowledge files. Turn your AI coding assistant into a full video production studio.项目地址: https://gitcode.com/GitHub_Trending/op/OpenMontage导读本文讲解 OpenMontage 角色动画流水线character-animation pipeline中script阶段的专属技能 script-director.md 的核心方法论如何把传统叙述型剧本改写成一套可以被骨骼角色rigged character真正表演出来的动画节拍animation beats。你将掌握音频架构锁定、节拍拆分、逐拍视觉变化标注、口型友好对白写作以及 script 产物在 checkpoint 门禁机制下的正确提交方式——这些知识直接服务于卡通短片、吉祥物讲解、音乐主导角色场景等可复用角色的本地确定性动画生产。一、Script Director 在流水线中的位置OpenMontage 的 character-animation.yaml 定义了 11 个强制技能required_skills与 10 个阶段script阶段排在proposal之后、character_design之前阶段技能产出 artifact是否门禁human_approval_defaultresearchresearch-directorresearch_brieffalseproposalproposal-directorproposal_packet / decision_logtruescriptscript-directorscripttruecharacter_designcharacter-design-directorcharacter_designtruerig_planrig-plan-directorrig_plan / pose_libraryfalsescene_planscene-directorscene_plantrueassetsasset-directorasset_manifesttrueeditedit-directoredit_decisions / action_timelinefalsecomposecompose-directorrender_report / final_review / character_qa_reportfalsepublishpublish-directorpublish_logtrue从 manifest 可以看到script阶段输入proposal_packet必选research_brief、video_analysis_brief可选产出script对应 schemas/artifacts/script.schema.json 中的title: Production Script可用工具transcriber用于从参考视频提取可参考的叙述/对白节奏门禁策略checkpoint_required: true且human_approval_default: true即写完剧本必须停下来等人类审批。该阶段的 review_focus审查焦点直接呼应 script-director 的三大目标Script is written as action beats, not only narration剧本以动作节拍书写而非仅叙述Dialogue/narration architecture is locked对白/旁白架构已锁定Every emotional turn can be expressed with poses and actions每个情绪转折都能用姿势与动作表达。二、核心目标把剧本写成可表演的节拍而非可朗读的旁白script-director.md 开篇即点明其 GoalWrite scripts as performable animation beats, not just narration.这句话是整个技能的灵魂。在 OpenMontage 的角色动画流水线中最终渲染依赖的是本地确定性动画——executive-producer.md 明确声明pipeline produces local, deterministic character animation. It does not silently substitute still-image motion for acting.流水线产出本地、确定性的角色动画不会静默地用静态图像动效替代表演。这意味着 script 阶段写出的每一行都要能被后续的character_design角色姿态、情绪范围、rig_plan部件、枢轴、约束、scene_plan场景、edit动作时间线逐级翻译成真实的动画指令。如果剧本只写旁白文本后续没有任何一个环节能把它变成动作只有把故事拆成这一拍角色做什么表情、看哪里、摆什么姿势、碰什么道具下游的 pose library 和 action timeline 才有据可依。三、三步流程从故事到可表演的节拍script-director 定义了三个步骤每一步都对应明确的产出要求。3.1 锁定音频架构Lock audio architecture写作之前必须先决定整片的音频骨架script-director 给出了四种可选架构music-only纯音乐无语言全靠音乐情绪与画面叙事需要更强的肢体表演narrator纯旁白单一叙述者声音贯穿动作服务旁白节奏character dialogue纯角色对白角色之间对话需要口型与手势配合narrator plus character sounds/dialogue旁白 角色声/对白混合架构旁白承担叙事角色对白负责情感互动。为什么必须在写作前锁定因为音频架构直接决定下游资产的形态narrator需要在 script artifact 中携带voice_performance叙述交付契约而character dialogue需要每个角色独立的口型时序与台词拆分。音频架构一旦中途变更script、character_design、assets三个阶段都要返工。3.2 把故事拆成可用姿势表演的节拍Break into beats将故事切成一个个节拍每个节拍必须满足可以被一个或一组 pose 演出来这一约束。这与 edit-director.md 的时序模式一脉相承——大多数表演节拍遵循anticipation预备 - action动作 - hold/reaction定格/反应 - settle收势不要把一切连续地动起来Do not animate everything continuously。Holds are part of acting.——定格本身就是表演的一部分。因此 script 阶段就要为每个节拍预留可读的定格readable holds空间而不是把台词铺满每一秒。3.3 标注每个节拍的视觉变化State what changes visually对于每一个节拍明确写出视觉上发生了哪些变化script-director 列出了六个维度emotion情绪角色的情绪状态gaze视线看向哪里——这直接对应 rig 中眼睛/瞳孔部件的枢轴旋转body pose身体姿势躯干与四肢的姿态prop interaction道具交互角色与道具围巾、羽毛、包、眼镜等的接触camera镜头取景、机位变化environment环境场景/背景变化。这六个维度与 scene-director.md 的逐场景字段character IDs、emotional beat、action sequence、camera/framing、background、props、effects形成天然的上下游对应script 层先把视觉变化想清楚scene_plan 层才能把它落到每个type: character_scene场景的character_actions中。四、写作规则Writing Rulesscript-director 给出了四条硬性写作纪律每条都能在后端实现中找到依据偏爱短视觉节拍 可读定格Prefer short visual beats with readable holds短节拍便于 pose 与 pose 之间的插值在有限帧数内被理解可读定格给观众消化情绪的时间也给渲染器留出hold的实现空间。避免需要大量独特手绘姿势的动作除非已获批准Avoid action that needs many unique hand-drawn poses unless approved这与 character-design-director.md 的约束一致Do not invent more poses than the approved duration can use不要发明超出已批准时长所能使用的姿势。OpenMontage 的角色动画走本地 rig 路线每个独特姿势都是资产成本剧本写手不能在未获批的情况下开出姿势清单。对白要短到能近似口型Dialogue should be short enough for mouth-shape approximation本地 rig 的角色嘴型通常是有限的 mouth shapes口型集长句无法逐字对口型。短句、短拍、单情绪对白才能用少量口型近似出可信的说话效果。这与 rig-plan-director 把 mouth shapes 列为角色 rig 部件body、head、eyes/pupils、brows、mouth shapes、limbs/wings、tail/accessories、props的实现约束直接相关。纯音乐/音乐主导的场景需要更强的肢体表演注释Silent/music-led scenes need stronger physical acting notesmusic-only 架构没有语言叙事情绪全靠身体语言传递因此 script 必须给出更细致、更明确的肢体表演指示姿势序列、节奏点否则 downstream 无法仅凭音乐排出可读动作。五、产物规范script artifact 元数据script-director 明确要求在scriptartifact 的元数据中必须包含四个字段字段含义下游消费方audio_architecture音频架构四选一见 3.1assets 阶段的 tts_selector / music_gencharacter_beats按角色组织的表演节拍序列scene_plan、edit 的 action_timeline_compilerrequired_emotions故事所需的最小情绪集合character_designminimum emotional rangerequired_actions故事所需的最小动作集合character_design、rig_planEvery required action has poses or a procedural strategy其中required_emotions与required_actions在角色动画流水线中属于贯穿性契约字段character_design.schema.json 将required_emotions、required_actions列入角色对象的必填项required 数组包含[id, role, body_type, style, required_emotions, required_actions]rig_plan.schema.json 同样要求每个角色的required_actions有对应姿势或动作策略。也就是说script 阶段写下的情绪/动作清单会一路传递到角色设计、rig 规划成为 pose library 必须覆盖的能力范围。script 阶段偷懒少写一个情绪到 compose 阶段就会出现角色没有这个表情的 pose的阻塞。此外script schemaschemas/artifacts/script.schema.json的顶层结构也值得注意它要求version固定1.0、title、total_duration_seconds≥1sections[]每个 section 至少包含id、text、start_seconds、end_seconds可选label、speaker_directions、delivery_cues可选voice_performance叙述交付契约含performance_intent、pacing_profile枚举contemplative/conversational/energetic/technical/cinematic/custom、energy_curve、pause_policy、sample_section_id、provider_notes——这是给 TTS 资产生成用的结构化表演指示。因此一个合规的 script artifact 既要有节拍化正文sections又要有表演元数据audio_architecture / character_beats / required_emotions / required_actions / voice_performance二者缺一不可。六、门禁提醒script 阶段必须停在人类审批处script-director.md 末尾的Gate Reminder (Binding)是整个角色动画流水线治理体系的一部分具有约束力bindingscript阶段门禁开启manifest 中human_approval_default: truereview 通过后以statusawaiting_human写入 checkpoint向人类呈现摘要Backlot board 会渲染该 artifact立即结束本轮END YOUR TURN不得在同一响应内启动下一阶段审批是逐门禁的Approval is per-gate——之前某扇门获得go ahead并不覆盖本扇门。这套协议在 lib/checkpoint.py 中有硬性实现_stage_requires_approval()从 pipeline manifest 读取human_approval_default作为门禁策略的唯一事实来源write_checkpoint()中当阶段被判定为 gated 且status completed却没有human_approvedTrue时直接抛出CheckpointValidationError错误信息即为GATE VIOLATION参见 lib/checkpoint.py正确的做法是先写statusawaiting_human等待用户回复获批后再重写为statuscompleted, human_approvedTrue被取代的 checkpoint 会自动归档到projects/id/history/供审计与断点续跑。与 script 阶段同门的还有 proposal、character_design、scene_plan、assets、publish 等阶段见 character-animation.yaml 中各自的human_approval_default值完整协议细节可参阅 checkpoint-protocol.md。七、实战自查清单综合以上内容一个合格的角色动画 script 应当通过以下检查音频架构已在四种选项music-only / narrator / character dialogue / narratorcharacter中明确锁定并写入audio_architecture故事已拆分为节拍每个节拍可被一个或一组姿势表演每个节拍标注了 emotion / gaze / body pose / prop interaction / camera / environment 六个维度的视觉变化节拍短、定格可读未规划需要大量独特手绘姿势的动作除非用户已批准对白短句化能被口型近似short enough for mouth-shape approximation音乐主导场景配备了更强的肢体表演注释character_beats、required_emotions、required_actions已写入 script 元数据且情绪/动作清单能被后续 character_design 与 rig_plan 覆盖按门禁协议statusawaiting_human写入 checkpoint → 展示摘要 → 结束本轮等待用户审批。总结script-director 是角色动画流水线中从文本到表演的第一道翻译关卡。它通过音频架构锁定 → 节拍化拆分 → 六维视觉变化标注三步法把文学性叙述改写成下游 rig 系统可以执行的动画指令并通过强制人类门禁保证创意方向在进入昂贵的角色设计与资产生成之前就被确认。写好一份 script就等于为整条流水线画好了可执行的动作蓝图。【免费下载链接】OpenMontageWorlds first open-source, agentic video production system. 12 production pipelines, 100 tools, 700 agent skill and production-knowledge files. Turn your AI coding assistant into a full video production studio.项目地址: https://gitcode.com/GitHub_Trending/op/OpenMontage创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考