Răsfoiți Sursa

docs: 解耦固定前台出场约束,出场场景改由动线规划决定

- 去掉人物固定前台出场的硬约束,出场场景改由脚本第五节【动线设计规划】确定
- 动线规划须最先确定:SKILL.md Step 4 生成物料前先行规划本片 zone/开场/走位/插画场景
- LOGO 落位由『前台必现』改为『随动线主场景墙面/可见处必现』(仍必现,不锁前台)
- script-template.md 动线规划表增『场景 zone』列,示例改为 Z02->Z05->Z04 不锁前台
- 同步 wan3-workflow.md / asset-collection.md / elements.md / README.md / docs 去『前台必现』表述
zhengqi 1 săptămână în urmă
părinte
comite
ce728ac2e5

+ 1 - 1
README.md

@@ -11,7 +11,7 @@
 
 1. **人物**必须用指定人物五视角图(固定锁定,全片不变脸)。
 2. **制服**参考指定细节图(可换款式/颜色,**胸牌样式绝对不可变**)。
-3. **门店内景**必须有指定立体 LOGO(合成进参考图,前台必现)。
+3. **门店内景**必须有指定立体 LOGO(合成进参考图,落位随动线规划主场景,不限定前台)。
 4. **音色**必须用指定文件作 `reference_audio`。
 5. 口播文案由用户内容**转口语化**适合口播。
 6. 整段视频**一个片段、≤30 秒**(超了反馈精简,循环直到满足;绝不拆片段)。

+ 5 - 2
SKILL.md

@@ -99,9 +99,11 @@ agent_created: true
 
 **产物落盘**:本步生成的三类物料保存到**本任务的 `<任务短名>/` 文件夹**——人物完整形象照、门店内景照片放根目录;插画放 `插画/` 子目录;便于后续统一引用与归档。若人物/门店沿用上次已确认物料,复制一份进本任务文件夹保持自包含。
 
+> ⚠️ **动线规划须最先确定(本步生成物料的前置)**:在生成任何物料前,先依选题/口播主题与 `references/store-spatial-index.md`(Z01–Z09 可用区)规划本片动线——列出本片**出场/经过的 zone、开场 zone、走位 zone、插画所在 zone**;**人物出场场景由动线规划决定,不再固定前台**。随后生成的门店内景照片须覆盖动线涉及的 zone,LOGO 落位于动线主场景的墙面/可见处(不限定前台)。该动线规划在 Step 8 组装时填入脚本第五节【动线设计规划】表。
+
 按 `references/asset-collection.md` 第二节,用图像生成工具基于锁定素材生成并展示,请用户确认后才作为 wan3 参考图:
 1. **人物完整形象照 — 1 张(可生成 2–3 张供选)**:以 `character_5view` 为人物参考、`uniform_detail` 为制服参考,合成「人物身穿制服的完整形象照」;胸牌样式与 `uniform_detail` 完全一致、不可变更。→ 确认后作为 **Image 1**。
-2. **门店内景照片(含怡呵美 LOGO)— 3 张位置供选**:以 `logo_3d` 为 LOGO 参考生成门店内景(位置1 面诊桌正对面 / 位置2 前台侧含 LOGO / 位置3 产品护理区),确保前台出现立体 LOGO。→ 用户确认采用哪张作为主场景,记为 `门店_内景_采用.jpg`,作为 **Image 2**。
+2. **门店内景照片(含怡呵美 LOGO)— 按动线规划 zone 生成**:以 `logo_3d` 为 LOGO 参考,按动线规划涉及的 zone(如开场 zone = 产品陈列架 Z02 / 洽谈区 Z04 / 前台 Z03…)生成对应门店内景,LOGO 落位于动线主场景墙面/可见处(不再限定前台侧)。→ 用户确认采用哪张作为主场景,记为 `门店_内景_采用.jpg`,作为 **Image 2**。
 3. **内容插入插画参考图 — 2 张**(抽象可视化风格启发,无真人皮肤/血液/文字)→ **Image 3 / Image 4**。
 
 展示后请用户**逐类挑选/确认**;若用户**未做任何选择** → 系统**自动随机指定**一组(记录"已自动随机指定")继续。确认后的物料登记进脚本「物料清单」。
@@ -176,7 +178,8 @@ agent_created: true
 - **提交的是确认后的生成物料**:wan3 实际接收 Image 1=人物完整形象照、Image 2=门店内景照片(含 LOGO)、Image 3/4=插画、Audio 1=音色;原始 4 项仅用于生成这些物料,不直接提交。
 - **风格先确认后出图**:发起任务先文字版问风格,再生成「人物完整形象照 + 门店内景(含 LOGO)+ 插画」示例图供确认。
 - **单片段 ≤30 秒**:口播超 110 字必须反馈精简、循环直到满足;不拆分片段。
-- **LOGO 必现**:在生成门店内景照片时以 `logo_3d` 为参考落位(Image 2),确保成片前台有怡呵美立体 LOGO。
+- **LOGO 必现(落位随动线主场景)**:在生成门店内景照片时以 `logo_3d` 为参考落位(Image 2),确保成片**动线规划的主场景**有怡呵美立体 LOGO(不再限定前台);人物不在前台出场时,LOGO 须在开场/主场景墙面或可见处出现。
+- **动线规划最先确定**:人物出场场景由动线规划决定,不固定前台;动线规划须于 Step 4 生成物料前先行确定(见 Step 4 前置说明),并填入脚本第五节【动线设计规划】表(含场景 zone 列),物料生成据此覆盖对应 zone 内景。
 - **原生音视频**:口播写进 prompt 作对白,音色作 reference_audio,wan3 一次性生成画面+对白+口型+环境音。
 - **插画插入点确认**:插画与口播文案都确认后,必须请用户指定插画从口播哪一句开始融入,再组装 prompt(见 Step 7);不静默默认。
 - **编导分镜(不站桩)**:单段 Prompt 必须像专业编导覆盖五块——① 人物行为动线(按内容长短设计走动/坐/起/落座,不全程正对镜头)② 运镜组合(2–3 种随机穿插)③ 插画展示方式(圆形PiP/条状PiP/侧边PiP 随机混用不固化、禁全屏)④ 门店丰富元素(前台/美容床/沙发/其他人物虚化走过随机点缀)⑤ **背景逐段锚定**(每个 Shot 绑定对应 zone 参考图元素清单,详见 `wan3-workflow.md` 坑4 与 `references/store-spatial-index.md`);详见 `wan3-workflow.md` 第四节与 `elements.md` 元素 12/25/26/27。

+ 14 - 13
assets/script-template.md

@@ -33,7 +33,7 @@
 - **人物完整形象照(Image 1)**:由 character_5view + uniform_detail 生成,`人物_完整形象照.jpg`(胸牌与 uniform_detail 一致、不可变更)。
   - 确认状态:[用户挑选 / 已自动随机指定:人物_形象_X]
 - **门店内景照片(Image 2,含怡呵美 LOGO)**:由 logo_3d 生成含 LOGO,`门店_内景_采用.jpg`(确认采用的位置)。
-  - 候选:`门店_内景_1.jpg`(面诊桌正对面)/ `_2.jpg`(前台侧含 LOGO)/ `_3.jpg`(产品/护理区)
+  - 候选:按动线规划涉及的 zone 生成(如 `_1.jpg` 开场 zone 内景 / `_2.jpg` 走位 zone 内景 / `_3.jpg` 插画所在 zone 内景),LOGO 落位于动线主场景墙面/可见处,不再限定前台侧。
   - 确认状态:[用户挑选 / 已自动随机指定:门店_内景_X]
 - **插画参考图(Image 3 / Image 4,抽象可视化风格启发)**:`插画_参考1.jpg` / `插画_参考2.jpg`,无真人皮肤/血液/文字。
   - 确认状态:[用户挑选 / 已自动随机指定:插画_参考_X]
@@ -82,7 +82,7 @@
 ```
 【总体描述】
 一位身穿[米白]美容师制服、[深栗色半扎长发 + 斜刘海]、胸牌样式与参考形象照一致的女美容师,
-在怡呵美门店内(墙面有怡呵美立体 LOGO,背景虚化,可见前台、美容床、沙发、产品陈列架,
+在怡呵美门店内(墙面有怡呵美立体 LOGO,背景虚化,可见门店场景元素——依动线规划,如前台、美容床、沙发、产品陈列架等,
 一名店员从画面边缘虚化走过)拍摄。画面中的女美容师、门店与插画均依据随附参考图生成,
 须保持人物脸型/发型/制服/胸牌一致,门店须含怡呵美立体 LOGO,插画为卡通动漫风抽象可视化(无真人、无文字)。
 
@@ -107,18 +107,19 @@
 结构说明:以下「Shot序号 + 时间戳 + 分镜内容」为本片分镜脚本;Shot序号与时间戳是给模型的
 节奏结构指令,不是台词,禁止当作语音读出;也禁止在任意空白时段补加台词或语气词。
 
-【动线设计规划】(按 Shot 拆解;下表为示例,按本片实际主题/场景替换对应行。硬约束:单段 ≤2 个动作切换且方向不反向、绝不全程正对镜头站桩、须与门店场景互动)
+【动线设计规划】(按 Shot 拆解;下表为示例,按本片实际主题替换对应行。⚠️ **人物出场场景由本规划决定,不固定前台**;硬约束:单段 ≤2 个动作切换且方向不反向、绝不全程正对镜头站桩、须与门店场景互动)
 
-| Shot | 时间 | 姿态 / 走位 | 手势 / 肢体 | 场景互动点 |
-|------|------|-------------|-------------|------------|
-| 1 | 0-4s | 端坐面诊桌前(开场) | 手持微晃、自然手势比划 | 面诊桌;背景虚化前台 |
-| 2 | 4-7.5s | 仍端坐(中近景) | 轻微点头、自然手势 | — |
-| 3 | 7.5-12.5s | 起身 → 缓步走向产品陈列架(坐→走,方向不反向) | 边走边说、自然手势 | 经主走廊 Z05 / 靠近产品陈列架 Z02 |
-| 4 | 12.5-19.5s | 站立于陈列架前 | 讲到核心点抬手 / 重音手势 | 产品陈列架 / 怡呵美发光字展柜 |
-| 5 | 19.5-26s | 保持站立、轻微侧身 | 自然手势讲解 | — |
-| 6 | 26-30s | 保持站立、抬手收束(至结尾不再落座) | 抬手手势收束 | — |
+| Shot | 时间 | 场景 zone(出场/经过) | 姿态 / 走位 | 手势 / 肢体 | 场景互动点 |
+|------|------|------------------------|-------------|-------------|------------|
+| 1 | 0-4s | Z02 产品陈列架前(开场) | 端坐于陈列架前 | 手持微晃、自然手势比划 | 怡呵美发光字展柜 / 灯带层板 |
+| 2 | 4-7.5s | Z02 产品陈列架前 | 仍端坐(中近景) | 轻微点头、自然手势 | — |
+| 3 | 7.5-12.5s | 经主走廊 Z05 → Z04 洽谈区(坐→走,方向不反向) | 起身缓步走向洽谈区 | 边走边说、自然手势 | 主走廊 Z05 / 等候洽谈区 Z04 |
+| 4 | 12.5-19.5s | Z04 洽谈区 | 落座 / 站立讲解 | 讲到核心点抬手 / 重音手势 | 洽谈区沙发 / 茶几 / 电视 |
+| 5 | 19.5-26s | Z04 洽谈区 | 保持坐姿/站立、轻微侧身 | 自然手势讲解 | — |
+| 6 | 26-30s | Z04 洽谈区 | 保持、抬手收束(至结尾不再变换) | 抬手手势收束 | — |
 
-> 动作切换计数:端坐 → 起身走动(1 次);走动后保持站立至结尾(不二次落座、不反向)。满足 ≤2 个动作切换。
+> 动作切换计数:端坐 → 起身走动(1 次);走动后落座/站立至结尾(不二次起身、不反向)。满足 ≤2 个动作切换。
+> 场景清单:本片出场/经过 zone = Z02 → Z05 → Z04(据此生成对应门店内景照片,LOGO 落位于开场 zone Z02 墙面/可见处;不限定前台)。
 
 【分镜脚本】
 Shot 1 [0-4s]:[开场中近景,女美容师端坐面诊桌前,手持微晃手机质感,镜头极轻微横摇];
@@ -142,7 +143,7 @@ Shot 6 [26-30s]:[结尾缓慢拉远收束,她保持站立、抬手手势收
 ## 六、保留分析(Retention,一致性)
 
 - **人物**:与 Image 1(确认的人物完整形象照)同脸 / 同发型 / 同年龄感 / 同制服(胸牌尤甚),全片不变。
-- **场景**:门店前台(含怡呵美 LOGO)与 Image 2 一致,光线方向一致。
+- **场景**:动线规划确定的主场景(含怡呵美 LOGO)与 Image 2 一致,光线方向一致。
 - **音色**:同一 Audio 1 音色。
 - **插画风格**:与 Image 3 / Image 4 一致(抽象可视化)。
 

+ 1 - 1
docs/暨北内部-朵朵口播视频专用技能.md

@@ -16,7 +16,7 @@
 | --- | --- | --- |
 | 人物五视角图 | 朵朵固定形象(全片不变脸) | `https://jibei-open-oss.oss-cn-hangzhou.aliyuncs.com/ai-video-assets/duoduo/duoduo-demo.jpg` |
 | 制服细节图 | 美容师制服(胸牌样式**绝对不可变**,仅可换款式/颜色) | `https://jibei-open-oss.oss-cn-hangzhou.aliyuncs.com/ai-video-assets/duoduo/zhifu-demo.png` |
-| 怡呵美立体 LOGO | 合成进门店内景,前台墙面**必现** | `https://jibei-open-oss.oss-cn-hangzhou.aliyuncs.com/ai-video-assets/duoduo/yihemei-logo.jpeg` |
+| 怡呵美立体 LOGO | 合成进门店内景,落位随动线规划主场景墙面/可见处**必现**(不限定前台) | `https://jibei-open-oss.oss-cn-hangzhou.aliyuncs.com/ai-video-assets/duoduo/yihemei-logo.jpeg` |
 | 朵朵音色 | 口播对白音色(`reference_audio`,Audio 1 引用) | `https://jibei-open-oss.oss-cn-hangzhou.aliyuncs.com/ai-video-assets/duoduo/voice-demo-sd.wav` |
 
 ### 2. 固定工程配置(百炼 wan3)

+ 3 - 3
references/asset-collection.md

@@ -10,7 +10,7 @@
 |---|---|---|---|---|
 | 人物五视角图 | `brand_assets.character_5view.url` | `character_5view.*`(png/jpg) | 生成「人物完整形象照」的输入 | 全片同一人:脸型/五官/发型/年龄感一致 |
 | 制服细节图 | `brand_assets.uniform_detail.url` | `uniform_detail.*` | 生成「人物完整形象照」的输入 | 可换款式/颜色;**胸牌样式必须完全一致、绝对不可变更** |
-| 立体 LOGO 源文件 | `brand_assets.logo_3d.url` | `logo_3d.*` | 生成「门店内景照片」的输入(LOGO 落位) | 必须出现在门店前台或某场景墙面 |
+| 立体 LOGO 源文件 | `brand_assets.logo_3d.url` | `logo_3d.*` | 生成「门店内景照片」的输入(LOGO 落位) | 必须出现在门店内景(落位随动线规划主场景)墙面/可见处,不限定前台 |
 | 音色文件 | `brand_assets.voice_ref.url` | `voice_ref.*`(mp3/wav,单段 ≤15s) | `reference_audio` = Audio 1(直接提交) | 作为口播音色参考;超 15s 先裁剪一段代表音色 |
 
 - 这 4 项**默认不直接提交 wan3**——它们是用来生成「第二节最终确认物料」的输入;只有 `voice_ref` 作为音色直接提交。
@@ -28,8 +28,8 @@
 - 这是最终提交 wan3 的 **Image 1**(不再是原始五视角图本身)。
 
 ### 2. 门店内景照片(含怡呵美 LOGO)— 3 张(多位置供选)
-- **来源**:以 `logo_3d` 作 LOGO 参考,生成门店内景,确保前台/墙面出现怡呵美立体 LOGO(单靠文字描述不可靠,必须靠 LOGO 参考落位)。
-- 位置 1:面诊桌正对面(主角主讲机位);位置 2:前台侧(LOGO 主展示);位置 3:产品陈列 / 护理区。
+- **来源**:以 `logo_3d` 作 LOGO 参考,按动线规划涉及的 zone 生成门店内景,确保动线主场景墙面/可见处出现怡呵美立体 LOGO(单靠文字描述不可靠,必须靠 LOGO 参考落位;落位随动线规划,不限定前台)。
+- 位置按动线规划 zone 生成(如开场 zone = 产品陈列架 Z02 / 洽谈区 Z04 / 前台 Z03…),LOGO 落位于开场/主场景墙面或可见处。
 - 文件名:`门店_内景_1.jpg` / `门店_内景_2.jpg` / `门店_内景_3.jpg`。
 - 用户确认采用哪张作为视频主场景 → 记为 `门店_内景_采用.jpg`,这是最终提交 wan3 的 **Image 2**。
 

+ 3 - 3
references/elements.md

@@ -54,8 +54,8 @@
 - 硬约束:单段 ≤15s;超长先裁剪一段代表音色。作为口播音色参考,wan3 原生生成对白并对口型。
 
 ## 10. 场景(Scene)
-- 默认:美容店前台 / 面诊房间(含怡呵美 LOGO)
-- 可选项:美容店前台(背景含品牌 LOGO 立体标识,虚化)|美容店面诊房间|居家梳妆台|专业护肤工作室|医美机构大厅|自定义
+- 默认:依动线规划确定(如美容店产品陈列架 / 洽谈区 / 前台 / 面诊房间,均含怡呵美 LOGO)
+- 可选项:美容店前台(背景含品牌 LOGO 立体标识,虚化)|美容店面诊房间|美容店产品陈列区|等候洽谈区|居家梳妆台|专业护肤工作室|医美机构大厅|自定义(场景由动线规划决定,不固定前台)
 - 说明:门店外观由自动生成示例图确认(见 asset-collection.md),LOGO 由 `logo_3d` 合成进选定门店图。
 
 ## 11. 机位(Camera Position)
@@ -108,7 +108,7 @@
 
 ## 21. 品牌露出(Brand Exposure)【固定素材包】
 - 默认:怡呵美 LOGO(来自素材包 `logo_3d.*`,合成进门店参考图)
-- 可选项:指定品牌 logo 立体标识(前台墙面,背景虚化)|全程无品牌词 / 店名(仅 LOGO 视觉)
+- 可选项:指定品牌 logo 立体标识(动线主场景墙面,背景虚化)|全程无品牌词 / 店名(仅 LOGO 视觉)
 - 硬约束:除用户明确指定的品牌露出外,人物、服装、场景表面不得出现任何 Logo / 文字 / 水印。
 
 ## 22. 门店 / 场景风格(Store / Scene Style)【自动生成确认用】

+ 3 - 3
references/wan3-workflow.md

@@ -28,7 +28,7 @@
 | 素材 | 来源 | media type | prompt 引用 | 约束 |
 |---|---|---|---|---|
 | 人物完整形象照 | **生成物料**:以 `character_5view` + `uniform_detail`(固定素材)为参考生成并确认(见 `asset-collection.md` 第二节) | `reference_image` | `Image 1` | 全片同脸/同发型/同年龄感/同制服;**胸牌样式与确认稿一致、不可变更** |
-| 门店内景照片(含 LOGO) | **生成物料**:以 `logo_3d`(固定素材)为 LOGO 参考生成含 LOGO 并确认(见第二节) | `reference_image` | `Image 2` | 前台墙面须出现怡呵美立体 LOGO |
+| 门店内景照片(含 LOGO) | **生成物料**:以 `logo_3d`(固定素材)为 LOGO 参考生成含 LOGO 并确认(见第二节) | `reference_image` | `Image 2` | 动线主场景墙面/可见处须出现怡呵美立体 LOGO(落位随动线规划,不限定前台) |
 | 门店空间实景图(zone 参考,技能内置) | **技能内置资源**:`assets/store-spatial-index/` 下的 `Z0X_0Y_*.png`(10 张 9:16 实景图,区域/机位/可用-禁用区见 `references/store-spatial-index.md`) | `reference_image` | 自然语言描述 | 按脚本各 Shot 所在 zone 选取对应实景图传入;与「门店内景照片」二选一、**实景优先**;U01–U03 禁用;人物真实经过的过渡空间(如走廊 Z05)必须传对应图,只靠俯瞰图+文字会脑补「幽灵硬件」 |
 | 插画参考图 1/2 | 自动生成(抽象可视化风格启发) | `reference_image` | `Image 3` / `Image 4` | 无真人皮肤/血液/文字 |
 | 音色文件 | 公网 URL `config.brand_assets.voice_ref.url`(优先)或本地 `assets/brand/voice_ref.*`(兜底) | `reference_audio` | `Audio 1` | 单段 ≤15s;超长则裁剪一段代表音色 |
@@ -47,7 +47,7 @@
 ```
 【总体描述】
 一位身穿[米白]美容师制服、[深栗色半扎长发 + 斜刘海]、胸牌样式与参考形象照一致的女美容师,
-在怡呵美门店内(墙面有怡呵美立体 LOGO,背景虚化,可见前台、美容床、沙发、产品陈列架,
+在怡呵美门店内(墙面有怡呵美立体 LOGO,背景虚化,可见门店场景元素——依动线规划,如前台、美容床、沙发、产品陈列架等,
 一名店员从画面边缘虚化走过)拍摄。画面中的女美容师、门店与插画均依据随附参考图生成,
 须保持人物脸型/发型/制服/胸牌一致,门店须含怡呵美立体 LOGO,插画为卡通动漫风抽象可视化(无真人、无文字)。
 
@@ -99,7 +99,7 @@ Shot 6 [26-30s]:[结尾缓慢拉远收束,她保持站立、抬手手势收
 
 只靠 prompt 文字描述"前台有 LOGO"不可靠,必须在**生成门店内景照片**时就把 LOGO 锚定:
 
-1. 在 `asset-collection.md` 第二节第 2 步生成门店内景照片时,把固定素材 `logo_3d.*`(立体 LOGO 源文件,来自 URL 或本地)作为**图像生成参考**,要求模型在前台/墙面生成与参考一致的怡呵美立体 LOGO。
+1. 在 `asset-collection.md` 第二节第 2 步生成门店内景照片时,把固定素材 `logo_3d.*`(立体 LOGO 源文件,来自 URL 或本地)作为**图像生成参考**,要求模型在**动线规划的主场景**墙面/可见处生成与参考一致的怡呵美立体 LOGO(落位随动线规划,不限定前台)。
 2. 若生成模型对 LOGO 还原仍不精确,可在生成后对采用稿做图像贴图精修(PIL 合成),确保 LOGO 清晰一致。
 3. 确认后的门店内景照片(含 LOGO)作为 **Image 2** 传入 wan3;原始 `logo_3d` 本身不单独提交。