用 GPT Image 2 生成高质量故事板:按人物图、关键信息图、首帧图、故事板的四阶段顺序锁一致性与减少 AI 感,并提供口播故事板模板与生视频衔接。
--- name: image2-storyboard-video description: 用 GPT Image 2 生成高质量故事板:按人物图、关键信息图、首帧图、故事板的四阶段顺序锁一致性与减少 AI 感,并提供口播故事板模板与生视频衔接。 --- # Image2 故事板视频 用 GPT Image 2 把脚本转成可拍、可一致、可直接喂生视频的故事板资产。 ## 适用场景 - 用户要高质量故事板 - 用户要减少 AI 感 - 用户要长时间口播、多段转场、复杂一致性 - 用户已明确"不要直接从脚本跳故事板" ## 默认顺序 1. 人物图 2. 关键信息图 3. 首帧图 4. 故事板 除非用户明确要求快速版、跳过前置资产或只要草案,否则按这个顺序工作。 ## 参考资料 - `references/high-quality-storyboard-pipeline.md`:高质量故事板四阶段流程 - `references/oral-narration-storyboard-templates.md`:口播故事板模板 - `references/storyboard-production-template.md`:故事板生产模板 - `references/video-from-storyboard-template.md`:故事板生视频衔接
为原创小说、剧本和短剧项目建立并执行一键式AI视频资产包。用于将已确认的角色、场景、道具、首帧需求编译为资产清单,按依赖调用指定Image2文生图或图生图渠道,下载验收并登记可复用资产;不用于有原片证据的转绘项目。
--- name: ai-video-asset-production description: 为原创小说、剧本和短剧项目建立并执行一键式AI视频资产包。用于将已确认的角色、场景、道具、首帧需求编译为资产清单,按依赖调用指定Image2文生图或图生图渠道,下载验收并登记可复用资产;不用于有原片证据的转绘项目。 --- # AI视频资产生产 > 路由权限:本 Skill 属于下级候选。开始生产、下载或验收资产前,必须先获得用户对 `ai-video-asset-production` 的明确批准。 把通过故事门的剧本变成可被视频模型引用的资产包。此 Skill 管生产与验收;资产设计提示词由 `ai-video-asset-prompts` 负责,有原片的转绘仍由 `mx-shortdrama-00-router` 负责。 ## 输入与边界 只接受已确认的剧本、场次表或 `asset_requirements`。每条需求必须有 `asset_id`、`kind`、`purpose`、`required_shot_ids`、`continuity_state`、来源事实或 `creative_fill` 标记。缺字段时回到剧本/资产提示词,不凭空生成资产。 进入 `prompt_ready` 前必须完成质量门禁:用户需求、可见证据、验收项三者逐项对应;用户指定的版式和完整范围覆盖旧模板;角色提示词含身份关系、原创结构、服化道锚点、姿态/微表情、光线/镜头目的和反向限制;本轮固定变量与可变变量明确。任一项缺失时保持 `draft` 或 `blocked`,不得提交生成。 - **原创文本**:允许创作补全,但逐项标明 `creative_fill`;它不能伪装为原作事实。 - **已有原片**:立即转入 `mx-shortdrama-00-router`,不以本 Skill 重做证据链。 - **只要提示词**:停在 `prepared`,不调用渠道。 - **用户明确说“生成资产图 / 做资产图 / 一键出资产”**:先报告本次资产数量、渠道、规格和预期计费,再按本 Skill 执行;实际付费提交仍以当次用户授权和当前渠道可用性为准。 读 [资产清单合同](references/asset-manifest-contract.md) 后再建立或修改资产包。 ## 一键资产包工作流 1. **编译清单**:调用 `ai-video-asset-prompts`,将剧本资产需求去重为项目级 `asset_manifest.json`。只为主角/重复角色的服装状态、重复空间、剧情关键道具和首个视频段落需要的首帧建资产;不为一次性背景人物或不影响连续性的物品建卡。 2. **建立依赖**:角色默认先生成可直接复用的 `identity_master` 多宫格;只有存在明确下游需求时才派生 `character_sheet` 或状态卡,不把二次派生设为强制;场景母板、道具状态卡可并行;首帧只能消费已验收的角色/场景/道具;故事板只有用户明确要求时建立,不能代替首帧。 3. **选择渠道**:先使用用户明确指定的图像渠道;用户未指定时再依据当前可用且已核验的渠道选择。OpenLux / `gpt-image-2-c` 的 9:16 竖图已实测支持请求 `2304x4096`,实际返回 `2160x3840`;`quality=high` 支持,单次只能生成一张,需要多张时分开调用。不得把某个渠道写成所有项目的永久默认,也不得用文生图冒充身份继承。每个参考写清唯一职责,不将角色脸、场景几何、道具状态混作同一参考职责。 4. **执行与回读**:每项先 dry-run,再提交、轮询、下载原图。写入实际 `generation_prompt`、提示词 SHA、task ID、精确文件路径、文件 SHA、下载回执与文件检查。超时或网络断开先恢复已有 task ID,禁止盲目二次提交。 5. **验收与交接**:打开下载图做对应资产 QA。通过才写为 `accepted` 并允许下游引用;失败只重做最窄资产,保留失败原因。只把 `accepted` 资产及其 `ref_key`、状态、适用镜头和参考职责交给 `sd2.5skill`。 ## 资产职责与生成顺序 | 优先级 | 资产 | 必须锁定 | 通过后用途 | |---|---|---|---| | P0 | 角色身份母图/角色设定卡 | 单人身份、脸/发型/皮肤、当前服装、配饰;按下游需要包含上方正脸/侧脸头部和下方不含头部的完整全身正面/背面 | 通过QA后作为人物身份唯一视频参考 | | P0 | 场景空间母板 | 无人空间、地标、轴线、家具、主要机位 | 场景和首帧参考 | | P0 | 剧情道具状态卡 | 外观、材质、可读文字、初始/变化状态 | 道具和首帧参考 | | P1 | 首帧 | 当前构图、站位、视线、道具初始状态、动机光 | 本段图生视频起点 | | P2 | 故事板 | 已通过资产上的镜头序列与动作方向 | 仅在用户要求故事板时使用 | 角色母图和角色设定卡可以在下游需求明确且同一资产职责不冲突时合并为一张多宫格身份母图;若合并,必须明确各格职责并逐格验收。场景卡不放人物或人物剪影。道具卡只有在文字已被剧本逐字确认时才允许文字;其余画面文字明确禁止。首帧和故事板不是角色卡替代品。 ## 清单与生命周期 对每项资产维护一个独立对象,至少包括: ```text asset_id / kind / asset_stage / purpose / source_basis / creative_fill required_shot_ids / continuity_state / depends_on / reference_role generation_mode / generation_prompt / prompt_sha256 / negative_prompt lifecycle_state / task_id / exact_file_path / file_sha256 / download_receipt qa_status / qa_reason / ref_key / used_by_shots ``` 生命周期只能按以下状态推进:`planned -> prompt_ready -> submitted -> downloaded -> qa_pending -> accepted | rejected | blocked`。`identity_master` 或合并后的多宫格身份母图只有通过 QA 后才能作为人物视频参考;未下载原图、仅有 URL、HTTP 成功、Word 预览或旧同名文件都不能称为 `accepted`。 ## 最小 QA - **角色**:单人、身份稳定、年龄/脸型/发型/服装/配饰一致;若采用四宫格,必须逐格核对上方正脸、严格侧脸头部和下方不含头部的完整全身正面/背面;下方两格从颈部或肩线连续到脚、鞋子和服装下摆,严禁出现头部或后脑勺,避免视频模型优先采用小头部格;主角有具体骨相、固定辨识点、真实皮肤/发丝/衣料;不得复制具体真人明星脸。 - **场景**:无人、空间轴线和地标清楚,家具比例、主要机位与剧本一致;相同空间不被重新设计。 - **道具**:外观与材质可复用,当前状态可读;确认文字准确,未确认文字不存在。 - **首帧**:可直接接第一个动作,人物位置、视线、道具、光线方向和景深与视频提示词一致。 - **文件**:原图可解码,比例/分辨率符合任务,下载回执中的路径与 SHA 可回读。 失败只返回最窄原因:`identity | casting | face | hair | wardrobe | accessory | body | scene_geometry | prop_state | text | composition | artifact`。角色卡首次失败仅可基于同一通过的身份母图图生图重做一次;再次失败阻断其依赖资产,不换脸冒充通过。 ## 输出与路由 用户要“一键资产包”时输出:资产清单、每项实际提示词、实际选定渠道和规格、状态、下载/QA结果、可供视频引用的 `@资产名` 与职责。用户只要计划时输出同一清单与提示词,但所有资产标记为 `prepared`。凭据只从安全环境变量读取,不写入 Skill、清单、脚本、命令、回执或聊天。 后续路由固定为: ```text 小说/剧本 -> ai-video-asset-prompts -> ai-video-asset-production -> accepted 角色/场景/道具/首帧 -> sd2.5skill ``` 不得把清单字段、资产 ID、角色卡标签、故事板网格或 QA 标记复制进视频最终画面。
为AI视频项目编写角色、场景、道具、首帧和故事板资产图提示词与资产清单。用于原创小说/剧本的资产前置;实际一键生成、下载和验收走ai-video-asset-production,有原片证据的转绘走mx-shortdrama路由;不直接生成生视频。
--- name: ai-video-asset-prompts description: 为AI视频项目编写角色、场景、道具、首帧和故事板资产图提示词与资产清单。用于原创小说/剧本的资产前置;实际一键生成、下载和验收走ai-video-asset-production,有原片证据的转绘走mx-shortdrama路由;不直接生成生视频。 agent_created: true --- # AI视频资产图提示词 > 路由权限:本 Skill 属于下级候选。开始编译资产提示词前,必须先获得用户对 `ai-video-asset-prompts` 的明确批准。 资产图是视频连续性的输入,不是把所有剧情画进一张海报。每种资产单独定义职责,先锁身份、空间和道具状态。本 Skill 只编译资产设计和清单;实际 Image2 执行、下载回执与视觉 QA 由 `ai-video-asset-production` 或用户明确指定的图像渠道执行器负责。 ## 提示词质量门禁 编译前先建立“需求—可见证据—验收项”三列表,不得直接把用户的审美形容词扩写成一段长提示词。每个审美目标至少翻译为三类可见证据:脸部/骨相或材质结构、姿态/行为或关系、镜头/光线/服化道;没有可见证据的形容词只能保留为目标标签,不能作为完成条件。 提交给资产生产前必须逐项检查: - 资产职责唯一,明确是什么、给谁用、下游保持什么。 - 用户指定的版式、比例和主体完整范围覆盖所有旧模板字段;发现冲突时以当前用户明确要求为准,删除旧规则,不能并列保留。 - 角色提示词至少包含身份与关系、原创结构、服化道锚点、姿态/微表情、光线与镜头目的、反向限制。 - 正面要求与负面限制不互相冲突;人物多宫格下方的“完整身体”必须明确从颈部或肩线以下连续到脚、鞋子和衣服下摆,并明确是否禁止头部、脸或后脑勺进入该区域。 - 角色、场景、道具的固定变量与本轮可变变量分开;重做时先定位最早失败变量,不无差别重写整段。 - 未通过门禁时状态只能是 `draft` 或 `blocked`,不得进入生成或标记为 `prompt_ready`。 ## 资产路由 - **原创小说/剧本**:本技能编写角色、场景、道具、首帧和故事板资产提示词;无原片证据时标明哪些内容是创作设计。 - **已有视频转绘/本土化**:转入 `mx-shortdrama-00-router`;人物细节调用 `mx-shortdrama-04-character-assets`,遵守 Step02 证据、目标地区、角色卡生命周期和QA,不用本技能凭空替代原片事实。 - **一键资产执行**:用户明确要“生成资产图/做素材图/一键出资产”时,把已通过的资产清单交给 `ai-video-asset-production`;无参考图由其调用用户指定的 Image2 文生图渠道,角色卡和已验收资产驱动的首帧使用图生图。实际付费生成前必须报告渠道、模型/规格和成本门。 ## 资产类型与职责 ### 角色身份母图与角色设定卡 角色资产默认先生成一张可直接复用的完整9:16多宫格身份母图;只有当下游确实需要额外状态、表情或镜头资产时,才从已确认母图派生角色设定卡/状态卡,不把二次派生写成强制步骤。人物多宫格默认固定布局:上方约三分之一横向分为左侧正脸头部近景和右侧严格90度侧脸头部近景;下方约三分之二横向分为左侧完整全身正面和右侧完整全身背面,但下方两格均明确不包含头部,只展示从颈部/肩线以下到脚的完整服装、体型、手臂、腿部和鞋子结构;背面格保留肩线、服装后幅、双腿和鞋子,不放入后脑勺。四格均属于同一角色、同一脸、同一发型和同一服装状态。角色提示词按“身份与关系 → 原创脸部结构 → 服化道锚点 → 姿态/微表情 → 光线与镜头目的 → 反向限制”编写,具体写年龄段、脸型骨相、关键五官关系、发型/发际线、固定辨识标记、真实皮肤毛发、体型、服装版型/层次/材质、配饰位置、妆面、职业气质和当前剧情状态。四格比例、位置和身体露出范围必须明确写入提示词;尤其要写明下方全身格不含头部,避免模型将小头部格当作主要人物参考,或把下方格误生成半身图。 人物多宫格优先作为参考底图交付,不把四格标签、分隔线或排版文字复制到生视频画面;下游引用时只读取人物身份、服装、角度和连续性,不要求视频模型复刻四格版式。若平台无法稳定生成该固定布局,先保留多宫格方案作为首选,再说明降级为单人身份母图或分两张生成,不得默认为四张互不关联的角色图。 ### 场景空间母板 场景资产只管建筑、家具、地标、空间轴线、主要机位、前中后景关系、时间与基础光线,不放人物或人物剪影。重复地点复用同一空间母板,昼夜、损坏、布置变化作为状态卡,不重新发明房间结构。可复用多个必要视角或状态时,优先在同一张9:16多宫格参考图中组织:例如左上整体建立、右上主机位、左下关键动线、右下另一承接机位;各格必须属于同一空间几何,不得拼成四个互不相干的房间。 ### 剧情道具状态卡 道具提示词写形状、尺寸感、材质、颜色、磨损、文字/数字、当前状态和状态变化所需的视角;需要时展示打开/关闭、完整/破损、空/满等状态。能够在一张图内清楚展示多个必要角度或状态时,优先使用紧凑的9:16多宫格道具参考图,但每格必须仍围绕同一件道具或同一套明确状态变化,避免把无关物件拼成海报。道具上的真实文字只使用已确认原文,未列出的文字禁止出现,避免伪字。 ### 首帧与故事板资产 首帧负责当前镜头的构图、人物位置、视线、道具初始状态和光线;故事板负责镜头序列、调度、遮挡和动作方向。二者不能互相冒充。连续镜头的下一段优先使用上一段通过QA的尾帧作为开场状态,不能用中性角色卡硬切覆盖实际动作。 ## 单资产提示词结构 每项资产单独输出: ```text 资产名称与职责: 来源事实/创作补全: 主体与可见结构: 材质、皮肤、毛发、服装或空间细节: 构图、视角、画幅与背景: 文字控制:仅允许……;其他文字禁止 连续性状态:当前状态……;允许变化……;禁止变化…… 负面约束:聚焦身份漂移、伪字、错误状态、额外人物、塑料质感等已知失败 ``` ## 参考图版式与有效画面占比 将“参考图是否有利于下游一致性”作为底层资产设计指标,而不以留白或白底面积为默认安全标准。 - 人物参考图默认采用完整9:16多宫格:上方约三分之一为正脸头部与严格90度侧脸头部;下方约三分之二为不含头部的完整全身正面与完整全身背面,画面从颈部/肩线以下连续到脚、鞋子和服装下摆;下方两格不得出现头部,背面格不放后脑勺。 - 其他角色状态、场景和道具在可行时也优先一次性多宫格,集中展示后续真正需要的角度、状态和空间关系;多宫格不是无关素材拼贴,每格必须服务同一资产职责。 - 尽可能减少无意义白底、空白边距和大面积无信息背景,优先放大主体、关键材质、结构、受力关系和可复用视觉证据;白底只保留隔离主体、避免背景污染和完成QA所必需的最小范围。 - 画面有效占比应在不裁掉关键结构、不挤压多宫格分区、不破坏前中后景和不引入伪字的前提下最大化。不要为了“铺满画面”把角色、道具或场景挤成不可读的拼贴。 - 提示词与资产清单必须写明版式、各格职责、主体占比和白底/背景比例意图;下游视频只引用身份或空间信息,不复制多宫格版式。 ## 资产包编译 先把逐镜头需求去重为项目资产包,再写单项提示词。每条清单至少写:`asset_id`、`kind`、`asset_stage`、`priority`、`purpose`、`source_basis`、`creative_fill`、`required_shot_ids`、`continuity_state`、`depends_on`、`reference_role`、`generation_mode` 与 `used_by_shots`。对于角色、场景和道具,额外记录 `reference_layout`、`panel_roles`、`subject_occupancy` 与 `background_policy`,使多宫格布局和有效画面占比可审计。 - 角色按“人物 + 服装/伤妆/年龄状态”去重;同一人不同状态不重新设计脸;默认先生成一张可直接复用的完整9:16多宫格身份母图,只有存在明确下游需求时才派生状态卡。 - 场景按空间几何去重;昼夜或可逆布置变化才作为同一空间的状态卡;需要多个视角时优先在同一张多宫格中展示并锁定共同几何。 - 道具只为剧情转折、重复出现、近景或必须保持状态的物体建卡;同一物件的开合、正背面、细节或受力状态可合并为紧凑多宫格。 - 首帧仅为将实际图生视频的段落建立;故事板只在用户明确需要时建立。 - 每个资产的来源事实与创作补全分开记录,资产名称/ID不进入最终画面文字。 - 多宫格生成失败时才降级为单张或分张资产,并记录降级原因;不得因省事默认拆成互不关联的图片。 ## 资产QA 交给资产生产前确认:每项资产都有清单字段和单一职责;角色参考图默认符合9:16四宫格布局,且上1/3头部、下2/3完整全身;场景/道具多宫格在需要时各格职责清楚;有效主体占比充分,白底/留白没有挤占主要信息;四格之间的身份、服装、空间几何或道具状态一致。交给视频提示词前确认:角色脸型/识别标记/服装状态可复用;场景空间轴线和地标清楚;道具状态与剧本一致;文字没有伪字;首帧能直接承接第一个动作;故事板没有把动作、表情和道具状态混成不可读的连续堆叠;每项资产都有明确用途和后续镜头。实际图、下载回执和视觉 QA 未通过时只能是 `prepared`,不能作为视频参考。 ## 与视频提示词的交接 向 `ai-video-asset-production` 传递已编译清单和提示词;向 `sd2.5skill` 只传递其已验收的角色、场景、道具、首帧/故事板职责和状态,不把角色卡的多宫格标签复制成画面文字;视频正文仍须说明 `@图片/@视频` 参考什么、不参考什么。资产图提示词和生视频提示词分开保存、分开QA,不能用一条超长提示词替代资产前置。