elements.md 12 KB

可参数化元素与选项目录

本目录汇总「美业口播科普视频脚本」所有可参数化元素。技能在执行时:

  1. 先从用户提示词中解析已指定的元素;
  2. 未指定的元素,按下方「可选项」用交互式问答补全(批量提问,避免逐个打断);
  3. 解析到的具体值若不在可选项内,以用户给定值为准(自定义)。

每个元素的「默认」用于用户完全没有提及时自动采用。

目标工具:百炼 wan3(万相 3.0)。单条视频一个片段、≤30 秒,不支持二次创作(每次修改整段重发)。详见 references/wan3-workflow.md。


1. 视频画幅(Aspect Ratio)

  • 默认:9:16 竖屏
  • 可选项:9:16 竖屏(视频号 / 抖音 / 小红书 主流)|16:9 横屏|1:1 方形|4:5 竖方
  • 说明:wan3 ratio 参数支持 16:9 / 4:3 / 1:1 / 3:4 / 9:16 / adaptive。

2. 视频时长(Duration,单段)

  • 默认:30 秒
  • 硬约束:整段 ≤30 秒(wan3 上限)。技能在口播文案阶段按"30 秒 ≈ 90–110 字"估算(预留停顿余量、避免语速赶),超了反馈用户精简、循环直到 ≤30 秒才继续(见 SKILL.md 第 5 步)。
  • 可选项:15 秒 / 30 秒(不提供分片段;若内容过多请精简而非延长)

3. 发布平台(Platform)

  • 默认:视频号
  • 可选项:视频号 / 抖音 / 小红书 / 通用·不限

4. 人设 / 形象(Persona)

  • 默认:皮肤知识科普博主
  • 可选项:皮肤知识科普博主|医美咨询师|美容院主理人 / 老板娘|护肤达人 / 成分党|皮肤科医师(科普向,非诊疗)|自定义

5. 目标人群(Target Audience)

  • 默认:女性问题皮肤群体
  • 可选项:女性问题皮肤群体|敏感肌人群|抗初老女性(25–35 岁)|护肤新手 / 学生党|医美意向用户|自定义

6. 视频主题 / 选题(Topic)

  • 默认:无(必须由用户提供,或仅给知识点由技能生成)
  • 说明:如「泛红和红血丝是一回事吗?」「刷酸后爆皮怎么办」。

7. 口播文案(Oral Script)

  • 默认:技能生成(当用户只给选题/知识点时)
  • 可选项:
    • 用户自带完整口播(含 / 短停、// 长停 符号)
    • 技能生成(把用户给的内容转换为口语化、适合口播的文案;自然亲和、带停顿符号、科普准确)
  • 停顿符号约定(不读出):/ 短停(换口气) // 长停(段落 / 情绪切换)
  • 字数硬约束:≤150 字(对应 30 秒)。

8. 角色面部素材(Character Reference Image)【固定素材包】

  • 默认:素材包 assets/brand/character_5view.*(用户指定五视角图,固定锁定)
  • 说明:作为 wan3 reference_image = Image 1。全片同一人,脸/发型/年龄感不变。用户须把文件放入素材包;缺失则提示补充,不自动生成。

9. 音色素材(Voice Reference)【固定素材包】

  • 默认:素材包 assets/brand/voice_ref.*(用户指定音色,固定锁定,作 reference_audio)
  • 硬约束:单段 ≤15s;超长先裁剪一段代表音色。作为口播音色参考,wan3 原生生成对白并对口型。

10. 场景(Scene)

  • 默认:美容店前台 / 面诊房间(含怡呵美 LOGO)
  • 可选项:美容店前台(背景含品牌 LOGO 立体标识,虚化)|美容店面诊房间|居家梳妆台|专业护肤工作室|医美机构大厅|自定义
  • 说明:门店外观由自动生成示例图确认(见 asset-collection.md),LOGO 由 logo_3d 合成进选定门店图。

11. 机位(Camera Position)

  • 默认:主角正对面、隔桌相对
  • 可选项:正对面、隔桌相对|侧面 45°|过肩|微俯 / 微仰|自定义

12. 运镜(Camera Movement)

  • 默认:跟随拍摄 + 极轻微横摇
  • 可选项:固定机位|极轻微横摇|缓慢推近(Dolly In)|缓慢拉远(Dolly Out)|镜头横移(Pan)|跟随拍摄(跟人物走动)|手持微晃(真实手机感)|环绕微移(Orbit)|变焦(Zoom)
  • 随机组合:每条约 2–3 种运镜手法按时间轴穿插,不全程单一机位;如"开场中近景固定 → 人物走动时跟随 → 讲到核心点时缓慢推近 → 结尾拉远收束"。

13. 服装(Costume)【参考固定素材包】

  • 默认:参考素材包 uniform_detail.* 的米白美容师制服
  • 可选项(在制服细节图基础上):保持原款|换颜色(同款不同色)|换款式(胸牌不变)
  • 硬约束:胸牌样式必须完全一致、绝对不可变更;服装表面不得出现任何其他 Logo / 文字 / 水印。

14. 造型(Styling)

  • 默认:深栗色半扎长发 + 斜刘海(与人物五视角图一致)
  • 可选项:深栗色半扎长发 + 斜刘海|利落低马尾|自然披发(微卷)|自定义
  • 硬约束:不戴帽子、不戴夸张饰品;全片发型 / 年龄感保持一致(与 Image 1 一致)。

15. 画质基调(Quality)

  • 默认:真实手机拍摄画质
  • 可选项:真实手机拍摄画质|真实相机 / 电影感(浅景深)|高清写实(棚拍)|自定义

16. 表情与肢体(Expression & Body Language)

  • 默认:表情丰富但克制、嘴巴小幅自然开合、身体语言随内容延展
  • 硬约束:不夸张嘴型、不变脸、不卡通化;口型由 wan3 原生生成对齐。

17. 穿插画面(B-roll / Inserts)

  • 默认:抽象皮肤科普可视化(单段内)
  • 可选项:
    • 抽象皮肤科普可视化(透明表皮层 / 光点 / 缓慢结构变化;无真人皮肤、无血液、无文字;由自动生成的插画参考图作风格启发,呈现在单条视频内,不切分段)
    • 产品 / 成分特写
    • 无穿插
    • 自定义
  • 说明:严格"插画风独立片段"会破坏"一个片段",故默认以抽象可视化呈现(用户上一轮选定)。

18. 字幕 / 文字(Text & Subtitle)

  • 默认:绝对无字幕、无标题、无 Logo、无品牌字样、无任何可读文字
  • 可选项:绝对无文字|含口播字幕(下三分之一)|含标题卡片|自定义

19. 配乐 / 环境音(Music & Ambience)

  • 默认:无背景音乐 + 轻微环境音(由 wan3 原生生成)
  • 可选项:无背景音乐 + 轻微环境音|轻背景音乐(舒缓)|纯口播无环境音|自定义

20. 情绪基调(Tone)

  • 默认:专业可信
  • 可选项:专业可信 / 温暖亲和 / 犀利直接 / 轻松幽默 / 焦虑安抚 / 自定义

21. 品牌露出(Brand Exposure)【固定素材包】

  • 默认:怡呵美 LOGO(来自素材包 logo_3d.*,合成进门店参考图)
  • 可选项:指定品牌 logo 立体标识(前台墙面,背景虚化)|全程无品牌词 / 店名(仅 LOGO 视觉)
  • 硬约束:除用户明确指定的品牌露出外,人物、服装、场景表面不得出现任何 Logo / 文字 / 水印。

22. 门店 / 场景风格(Store / Scene Style)【自动生成确认用】

  • 默认:现代简约轻奢(干净明亮、浅木 / 白调)
  • 可选项:现代简约轻奢 / 日式原木 / 科技感冷调 / 暖白诊所风 / 法式优雅 / 自定义
  • 说明:驱动"门店内景示例图"的生成风格(含品牌 LOGO)。品牌来自元素 21。

23. 插画风格(Illustration Style)【自动生成确认用】

  • 默认:扁平插画(干净、专业)
  • 可选项:扁平插画 / 手绘水彩 / 线条极简 / 治愈系 / 科技蓝 / 噪点质感 / 自定义
  • 说明:驱动"内容插入插画参考图"的生成风格,作为单段视频内抽象可视化的风格启发。

24. 整体色调(Color Tone)【自动生成确认用】

  • 默认:暖白(品牌亲和)
  • 可选项:暖白 / 冷调(蓝灰)/ 品牌色(怡呵美色系)/ 莫兰迪 / 自定义
  • 说明:统管门店、插画的配色走向。

25. 人物行为动线(Blocking / 肢体调度,按内容长短设计)

  • 默认:技能按口播内容自动设计 ≤2 个动作切换(不全程正对镜头站桩)
  • 可选项(导演按需组合,且选定一条路径后全程不回头):
    • 缓慢走动(在门店里踱步讲解,像真人在店里拍)
    • 端坐讲解(坐于面诊桌 / 沙发,自然面对镜头)
    • 从走动到落座(走动引入后坐下,落座后全程保持坐姿)
    • 从坐姿站起走动(开场坐着,讲到重点起身走动,走动后全程保持站立走动)
  • 硬要求:
    • 30 秒单段内人物动作路线 不超过 2 个;一旦选定"走动→落座",落座后 不再起身走动;一旦选定"坐姿→起身走动",走动后 不再落座(动作方向不反向,节奏清晰)。
    • 口播讲解时不设计"整理产品 / 轻触产品 / 翻阅资料"等无意义手部摆弄动作(用户明确要求去掉),手部只用自然手势比划 / 轻微点头等微动作。
    • 每段口播都要有人物与门店场景的互动行为,避免"一直正对镜头不动"的死板站桩。
    • 手势比划 / 轻微点头等微动作不算独立动线,可全程保留,不计入 2 个上限。
  • 说明:这是导演级分镜设计,由技能在组装单段 Prompt 时按内容自动编排,不进用户风格问卷。

26. 插画展示方式(Illustration Presentation,随机使用不固化)

  • 硬性规则(用户 2026-09-17 新增):插画禁止全屏覆盖,只能以「局部」形式出现在画面中。以下两类全屏方式永久禁用:
    • ❌ 全屏铺盖(插画整屏铺开,口播人物退为背景或短暂隐去)
    • ❌ 人物画中画式全屏(插画铺满整屏,口播人物以圆形 / 正方形画中画出现在画面某区域内)
  • 默认:技能在单次内随机选用局部方式,不恒定为一种
  • 可选项(仅限局部,一场视频内可混用):
    • 圆形画中画(在口播画面的某 1–2 个区域嵌入圆形 PiP 展示插画)
    • 条状画中画(在口播画面底部 / 顶部拿一条区域展示插画 PiP)
    • 侧边画中画(画面一侧矩形 / 圆角区域嵌入插画)
  • 随机组合:同一视频里插画出现多次时,可轮换不同局部展示方式(如圆形 PiP、二次条状 PiP),不要全部按一种方式来;与第三节「插画插入点」配合。
  • 说明:抽象可视化插画(Image 3/4)以这些局部方式融入单段画面,不切分段。
  • 内容红线(与硬性禁令呼应):插画本身不得出现任何人物 / 人形轮廓 / 手势 / 人影(只画机理示意 / 物品 / 皮肤特写 / 光线氛围),否则会与口播真人并置成"两个主角"(见 wan3-workflow.md 坑7)。
  • 推荐 PIP 默认规格:220×330px 圆角矩形(圆角 24px、半透明描边),嵌于画面右上角(距右 30 / 距上 120px,约 720P 宽 30.5% / 高 25.8%);人物走位段可平移至右下角不挡脸;插画不得遮挡人物面部与底部安全区。

27. 门店丰富元素(Scene Ambience / 道具与群演,增加画面丰富性)

  • 默认:技能在门店场景里随机点缀 2–3 个丰富元素
  • 可选项:
    • 前台(与 LOGO 同框,自然出现在背景)
    • 美容床 / 护理床
    • 沙发 / 休息区座椅
    • 桌椅 / 茶几 / 产品陈列架
    • 其他人物(店员 / 顾客)从画面边缘走过、虚化处理
    • 绿植 / 灯光氛围
  • 随机点缀:除口播主角外,画面里适当出现上述道具 / 人物,增加真实门店的丰富度与景深;其他人物一律虚化、不抢主角、不出现清晰正脸文字。
  • 说明:这些元素在生成门店内景照片(Image 2)与单段 Prompt 描述中体现;与元素 10/22 场景风格一致。