把短剧分镜和冻结关键帧写成可直接复制的视频提示词 Markdown,也可按用户要求写时间线配乐/主题曲意图。用户提到文生/图生视频动作、人物表演、运镜、口型、环境运动、镜头时长、起止状态、把分镜转成视频提示词或写配乐提示词时使用;不生成媒体、不创作歌词、不改分镜边界。
npx skills add https://github.com/zenstory-ai/oh-story-dsh --skill short-drama-video-prompts
把已确认镜头和起始帧写成有边界、可生成、可直接复制的 剧集/<EP>/视频提示词.md。
每镜使用 MOTION-... 标题并引用对应 SHOT-...。
用 $short-drama-video-prompts 把 EP001 分镜逐镜写成可直接复制的视频提示词
有当前分镜、冻结关键帧和必要视觉事实即可检查参考准备;图片提示词不是已有图片的证明。运动提示词拥有从已确认
起点到终点的变化:表演动作、道具状态、运镜、节奏和声音提示。先按分镜的「输入参考图」选择路径:
REF-... 图片时是图生视频;原样携带分镜中的槽位、顺序、项目相对路径、中文名称、用途、控制与不得控制范围,静态身份、造型、地点和构图可由参考帧与视觉设定共同拥有。
这一行就是本镜的素材清单:路径回答「送哪一张」,用途 回答「它在本镜负责什么」,顺序 回答
「在可复制正文里叫哪个标签」。回答不了这三问的槽位不算准备好。
可复制正文,让提示词本身交代人物、造型、地点、构图和光线中本镜必要的事实。不得只写
preserve/keep/保持已有外观,因为执行端没有收到可供保持的图片。
PLAN-... 槽位时同样是图生视频:图片由创作者在生成时自行挂载,本套件没有文件可送。正文照常按图生视频写,顺序 就是创作者挂图的次序,用途 说明每一张在本镜负责什么。
这些镜头不能转 $short-drama-produce;要投产就先把真实文件放进项目、改写成 REF-...。
REF-... 或 PLAN-... 后仍带「;待补参考图:……」,或普通的「无」都表示未准备好,不是文生视频授权。先自动查找可用真实图片并请分镜 owner刷新绑定;仍有缺失时,列出镜头、缺失图片及对应 IMG-... 或冻结关键帧,不写最终《视频提示词.md》。
创作者可读说明跟随项目语言。开始前读取目标模型档案里的版本、执行模式、提示词方言、原生时长和
参考方式;这些选择同时约束上游分镜和下游 adapter,不能只在正文阶段临时猜。创作者在本次请求里点名
目标模型(例如“按 MiniMax H3 写”)而项目档案还没有这一项时,先转 $short-drama 把这个选择写进
short-drama.json 的 production_profile,再回到本阶段;一句会话里的点名如果没有落到档案上,
下一轮就会退回通用路径,方言、原生时长和参考方式又要重猜。没有项目配置的独立任务把点名的模型
和已解析的方言写在本文档开头一行,供下游核对。视频可复制正文优先跟随
short-drama.json#/creator_authority/production_profile/choices/video_prompt_language;未声明时回退到
short-drama.json#/format/prompt_language。没有 short-drama.json 时,根据用户点名的目标视频模型
确认正文语言;目标模型也未声明时沿用用户当前语言,不固定为英文。对白、VO、OS 的口语语言仍由
剧本和声音方向决定,不能从提示词正文语言推断。
目标为 seedance-2.0 时按 Seedance 2.0 方言 写,目标为
seedance-2.5 时按 Seedance 2.5 方言 写,目标为 minimax-h3 时按
MiniMax H3 方言 写。只读命中的一份。其他目标或版本不
套用相近模型的语法,继续按 目标模型能力档案 的通用路径写。
沿用 creator-first 既有骨架:## MOTION-... · 中文名,字段名依次使用「分镜、时长、生成方式、
输入参考图、静态视觉锚点、起始帧、状态链、终点」,正文标题使用 ### 可复制提示词。静态视觉锚点
跟随本镜已解析的视频提示词语言并原样进入正文;正文每个非空行都以 > 组成 Markdown 引用块。
重写内容不能改名、另造替代字段或改成普通段落。
「制作成果」和文档已指向媒体中查找真实图片。内容和用途核对后才自动绑定;不靠相似文件名猜图。
REF-... 槽位,再回到本阶段;只绑本镜真正需要保持的图,不按资产数量凑槽位。同一次刷新里,如果这些镜头还缺「视觉依据」这个必写字段(旧文档常常没有),一并按已成稿的冻结关键帧回填——
两者读的是同一格画面,分开两轮只会让绑了图的镜头仍然说不清画面里有谁。
新槽位必须逐字使用 REF-<slot>(顺序:<n>)· <项目相对路径>《<中文名称>》(用途:<用途>;控制:<范围>;不得控制:<范围>);用途 取 身份|造型状态|地理|构图|尺度|效果|起始帧|结束帧|风格 之一,不得自创斜杠分隔写法。多图只用 ; 连接,写完后先按格式回读,再复制到视频文档。
REF-...,并在末尾追加「;待补参考图:……」。一次列出缺失镜头、图片用途和对应的 IMG-... /冻结关键帧,然后停在视频提示词之前。不伪造路径,不把图片提示词当成图,不静默降级为文生视频。
报告缺口时把创作者真正有的三条路一起说清楚,不要只给「生成参考图」和「改成文生视频」:
把已有图片放进项目绑成 REF-...;由创作者在自己的工具里出图、本轮先写成 PLAN-... 挂图计划;
或者明确改走文生视频。缺口清单本身就是那份挂图计划的草稿,逐镜写清要哪几张、每张管什么。
「生成方式:图生视频」或「生成方式:文生视频」。该字段只写这两个精确值,不追加模型名、方言或 full-reference 等说明;模型说明留在正文结构中。
具体走首帧、首尾帧还是多槽参考,由各槽位的 用途 组合读出:只有一张 起始帧 走首帧,起始帧 加 结束帧 走首尾帧,
起始帧 与人物/地点/道具图同时存在或只有这些图时走多槽参考。命中的模型方言负责把这个组合翻成它自己的素材 role 与正文结构;
多槽参考与首/尾帧在同一请求内互斥的模型,起始帧也随整组走多槽参考,不拆成两套输入。
adapter 报错,也不能在正文里暗自改变时长。
有对白、VO 或 OS 时,同时核对分镜「声音」中的估时依据与实际可用发声窗口;缺少依据就按
对白预算 补做判断。秒段加总正确不代表台词说得完。
必要时用秒数分段;下一镜从这个终点继续,不另造镜外转换。
10. 把限制动作空间的已确认关系写成贯穿本镜的正向可见状态,只安排关系允许的动作通道;只有分镜明确改变关系时才写变化过程。可复制正文的动作边界只用肯定状态句,不用 no/not/without + 动作 改写。
11. 逐镜读取文字义务。除非剧本或创作者明确要求,正文用本镜已解析的视频提示词语言直接写明任何时刻都不生成非画内字幕、caption 和对白文字叠加,不能只写抽象的“文字层为空”;这条默认与旗帜、标牌、屏幕等画内文字独立。画内 exact_readable 逐字写明字符、语言、承载面和位置,不能用全局 no-text 覆盖。
12. 声音同轨时,把允许的发声按来源、说话人、口语语言和顺序写成完整时间线;每句从原文首字到末字,
且逐字对白在单镜可复制正文中只出现一次。视觉动作段只按时间和说话人引用该声音事件,不再抄一遍
台词。事件外回到已声明的环境声或静默。Brief、剧本或声音方向已经明确禁止外语前导、语气词、
额外人声或重复时,把这些已确认的发声边界在完整时间线末尾合并写一次;不靠“只包含”让执行端
猜,也不自行扩充新的禁用类别。完整时间线声明是声音段落终点,其后不再追加第二组声音排除句,
且只列本镜实际有的声音层。本镜没有对白时,这条声明里不出现 dialogue,正文也不写 no dialogue、
无对白 这类排除句,改为正面写出底声的构成与覆盖区间,并把「不说话」写成在场人物的可见状态:
正面句同时交代了这一镜该有什么声音。配乐层则必须显式关掉,那一条有实测支撑。
13. 成稿时逐句把 no/not/without + 动作或状态变化 改写为当前持续状态或允许动作;直接改正文,不调用工具或生成检查产物。再检查不跨下一镜、不要求互斥动作、不让人物或道具瞬移变形。
14. 用户要整集就完成整集,镜头组只是内部批次。
15. 同一连续时空中相邻正式生成段、且目标档案支持续接时,默认选择“从上一段生成结果续接”;
一镜一生成只决定每次装一个镜头,不等于各镜独立文生。只有创作者明确要求独立重生成,或上游
已接受时间/地点跳变时才重新起链。选择续接后,这就是该链唯一正式执行路由。第二段起同时绑定上一段
实际视频和从该视频取得的
实际尾帧:视频负责动作、节奏和声音连续,尾帧负责下一段的可见起点。具体素材 role 和续写措辞
由命中的模型方言决定,不能把通用职责直接翻译成供应商字段。未取得真实产物时,后续段在
视频提示词.md 标为“待续接、不可提交”,写明缺少这两项真实输入并保留下一段内容草案;不得把它
降级成独立文生视频,也不用计划尾帧、关键帧提示词或文字描述冒充接力输入。逐镜 MOTION-...
仍是成员边界和内容依据,不是与正式容器路由并列的另一套提交方案。
no/not/without + 声音类别。non_diegetic_music: N/A)——不写配乐层实测会被模型补上,语音层未观察到同样现象。<d> 包起来的中文必须逐字来自《剧本.md》,画内标牌文字可来自《视觉设定.md》;分镜自己写下的画内文字与声音同样算数。creator_markdown_check.py 会核对四字以上的引文(VID-25)。
台词不在剧本里就回到写作技能改剧本,不在提示词里改。
no/not/without + 动作 重复同一边界,也不给角色冲突动作。默认只读本 SKILL、当前分镜和必要视觉事实。遇到对应问题时只打开一份:
用户明确要求时间线音乐时,在本文档增加独立章节,写使用区间、剧情功能、进入/退出、动态曲线和
禁用项;歌词必须来自用户提供或明确接受的文本。静态漫剧只需要关键帧切换与配音时可以跳过逐镜
视频运动提示词,直接进入生产预览。
每个点名镜头都有明确起点、主变化、时序、运镜/声音边界和可验证终点,且与相邻镜头连续,即完成。
实际生成转 $short-drama-produce,先展示精确 job 并取得显式确认;本技能不调用外部服务。
五份创作文档齐备后,可转 $short-drama 对跨文档结构做一次机械核对;内容质量仍由创作者审查。
只有安装、升级或排障时运行 python3 scripts/selftest.py。
Take zenstory-ai/oh-story-dsh-short-drama-video-prompts from the repository into ~/.claude/skills for personal
use, or into .claude/skills inside a project.
The agent identifies a skill by the name field in its header. Two skills with the
same name cannot sit side by side — one of them will be ignored.