怡呵美-朵朵-口播视频专用技能

zhengqi dc8cdc2f33 feat: 门店空间索引规则与 zone 实景图资源纳入技能包 1 săptămână în urmă
assets dc8cdc2f33 feat: 门店空间索引规则与 zone 实景图资源纳入技能包 1 săptămână în urmă
docs 975d875080 docs: README 增加生产视频流程图(docs/flowchart.svg) 2 săptămâni în urmă
references dc8cdc2f33 feat: 门店空间索引规则与 zone 实景图资源纳入技能包 1 săptămână în urmă
scripts 662e293479 同步 wan3 输入参数规范与合规/唇形参考文档 1 săptămână în urmă
.gitignore 2f54b7b699 初始化:暨北内部-朵朵口播视频专用技能(固定OSS素材+百炼base_url,仅配key即可用) 2 săptămâni în urmă
README.md 662e293479 同步 wan3 输入参数规范与合规/唇形参考文档 1 săptămână în urmă
SKILL.md dc8cdc2f33 feat: 门店空间索引规则与 zone 实景图资源纳入技能包 1 săptămână în urmă
_user_meta.json dc8cdc2f33 feat: 门店空间索引规则与 zone 实景图资源纳入技能包 1 săptămână în urmă

README.md

美业口播科普视频脚本技能(百炼 wan3 直出版)

把「美业口播科普短视频」从零散需求沉淀为一份带固定品牌素材、可直接调用阿里云百炼 wan3(万相 3.0)生成视频的结构化脚本。技能会像专业编导一样设计人物在门店场景里的动线、运镜、插画融入方式与门店丰富元素,确保成片真实、不站桩、不 AI 感。

适用场景

  • 用户上传/指定人物五视角图、制服细节图、品牌立体 LOGO、指定音色,或要求生成可直出 wan3 的视频脚本与物料。
  • 典型触发:「帮我做一条美业口播视频(给 wan3 / 百炼)」「出个护肤科普短视频脚本并生成」。

八大硬约束(贯穿全程)

  1. 人物必须用指定人物五视角图(固定锁定,全片不变脸)。
  2. 制服参考指定细节图(可换款式/颜色,胸牌样式绝对不可变)。
  3. 门店内景必须有指定立体 LOGO(合成进参考图,前台必现)。
  4. 音色必须用指定文件作 reference_audio。
  5. 口播文案由用户内容转口语化适合口播。
  6. 整段视频一个片段、≤30 秒(超了反馈精简,循环直到满足;绝不拆片段)。
  7. 确认后调用百炼 wan3 生成、轮询、下载本地、交付确认。
  8. 不支持二次创作:任何元素修改都重新组装完整脚本、整段重发 wan3(不用编辑/延长模式)。

首次配置(必做,只需一步)

本技能为「暨北内部 - 朵朵」专用锁定版:人物五视角图、制服细节图、怡呵美立体 LOGO、朵朵音色、百炼工作空间与 base_url 均已固定在 scripts/config.json 中,使用者无需修改。

  1. API Key(唯一需要你提供的):登录百炼 / DashScope 控制台 → 切换到 北京(cn-beijing) 地域 → 创建 API Key(sk- 开头,只显示一次)。复制 scripts/.env.example 为 scripts/.env,填入 DASHSCOPE_API_KEY=sk-... 即可。 > ⚠️ .env 含你的密钥,严禁提交 git 或随技能 zip 分发;重新打包技能前请删除本地 .env。
  2. 固定品牌素材 / 工作空间 / base_url 均已预填,无需任何改动即可直接运行。

运行

对 WorkBuddy 说:「用美业口播科普视频脚本技能,做一条关于 [选题] 的口播视频」。技能按 SKILL.md 的 11 步流程执行:

文字风格问卷 → 锁定固定素材 → 生成并确认物料(人物形象照 / 门店内景含 LOGO / 插画)→ 确认口播文案 → 敏感词/合规检测(必跑,用户按建议改或自改后复检) → 确定插画插入点 → 组装编导分镜 Prompt → 逐步确认 → 调 wan3 生成 → 成片交付。

也可手动驱动生成脚本:python scripts/generate_video.py --help。

生产视频流程图

注:GitLab / GitHub 出于安全策略不渲染 Markdown 中的 SVG 图片(SVG 可能含脚本),因此流程图改用 Mermaid 代码块——GitLab 网页端原生支持、会直接渲染为图,且是纯文本可版本化。原 SVG 文件保留在 docs/flowchart.svg 供支持 SVG 的平台使用。

graph TD
    A[用户触发<br/>选题 / 选题+素材] --> B[文字风格问卷<br/>无要求则自动生成物料]
    B --> C[锁定固定素材<br/>4项OSS URL 已写死]
    C --> D[生成并确认物料<br/>人物形象照 / 门店内景含LOGO / 插画]
    D --> E[确认口播文案<br/>转口语化 + 字数约90-110]
    E --> E2[敏感词/合规检测<br/>必跑 · 风险等级+替换建议]
    E2 --> F[确定插画插入点<br/>指定从哪句开始融入]
    F --> G[组装编导分镜 Prompt<br/>动线 + 运镜 + 插画展示 + 门店元素]
    G --> H[逐步确认]
    H --> I[调百炼 wan3 生成<br/>建任务 → 轮询 → 下载]
    I --> J[成片交付]
    J --> K{满意?}
    K -- 否,整段重发 --> G
    K -- 是 --> Z[完成]

详细分步说明见 docs/暨北内部-朵朵口播视频专用技能.md。

编导分镜要点(确保真实感)

  • 人物行为动线:30 秒单段 ≤2 个动作、方向不反向(「走动→落座」则落座后不再起身;「坐姿→起身走动」则走动后不再落座);口播时不设计整理产品等手部摆弄动作,手部只用自然手势 / 点头。
  • 运镜组合:2–3 种随机穿插(跟随 / 推近 / 拉远 / 横移 / 手持微晃)。
  • 插画展示方式:仅限局部呈现——圆形画中画 / 顶部或底部条状画中画 / 侧边画中画,禁止全屏铺盖与人物画中画式全屏(用户 2026-09-17 规则)。
  • 门店丰富元素:前台 / 美容床 / 沙发 / 桌椅 / 其他店员虚化走过,随机点缀 2–3 个增加景深。

详细元素、wan3 工程要点、物料收集流程分别见 references/elements.md、references/wan3-workflow.md、references/asset-collection.md;单段脚本骨架见 assets/script-template.md。

目录结构

beauty-talk-science-video-script/
├── SKILL.md                  # 主流程与硬约束(11 步)
├── README.md                 # 本文件(快速上手)
├── references/
│   ├── elements.md           # 全部可参数化元素与可选项
│   ├── wan3-workflow.md       # 百炼 wan3 端点/鉴权/参考映射/编导分镜 prompt 范式
│   └── asset-collection.md   # 固定 4 项素材 + 自动生成物料确认 + 物料登记
├── assets/
│   ├── script-template.md     # 单段结构化脚本骨架(交付物模板)
│   └── brand/README.md        # 固定品牌素材包说明
└── scripts/
    ├── generate_video.py      # 解析素材 → 建任务 → 轮询 → 下载
    ├── config.json            # region/workspace_id/model/分辨率/比例/品牌 URL(密钥走 .env)
    └── .env.example           # API Key 模板(复制为 .env 填入真实 key)

任务产物目录结构(每次任务独立归档)

每个任务在收集输入后即新建一个独立文件夹存全部产物,避免跨任务文件混杂,便于交付与回看。产物区与技能目录分离:

  • 基础目录:工作区内 beauty-video-materials/
  • 任务文件夹:beauty-video-materials/<任务短名>/(<任务短名> 由选题/主题派生,如 敏感肌功效型护肤品、贵产品无效,去除特殊字符与空格)
  • 自包含:本任务实际用到的参考图(人物完整形象照 / 门店内景 / 插画)也复制进该文件夹,使文件夹独立可交付、可归档(复用上次素材则复制一份进来)

    beauty-video-materials/
    ├── _shared/                       # 共享素材库(跨任务复用,可选)
    │   ├── 人物_完整形象照.png
    │   ├── 门店_内景_1.png
    │   ├── 门店_内景_2.png
    │   ├── 门店_内景_3.png
    │   └── 插画_参考1.png / 插画_参考2.png
    └── <任务短名>/                    # 单个视频任务(自包含)
    ├── 脚本_<主题>.md             # 结构化交付脚本(Step 8/9)
    ├── prompt.txt                 # 提交 wan3 的纯文本 prompt(Step 8 写出)
    ├── 成片_<主题>.mp4            # 下载的视频成片(Step 10)
    ├── 人物_完整形象照.png         # Image 1(本任务生成或复用复制)
    ├── 门店_内景_采用.png          # Image 2(含 LOGO)
    └── 插画/
        ├── 插画_参考1.png          # Image 3
        └── 插画_参考2.png          # Image 4
    
  • 后续 --media / --output 一律引用本任务文件夹内路径;生成脚本已支持自动创建输出父目录,传任务文件夹路径无需手动 mkdir。

  • 历史归档示例:两支视频 敏感肌功效型护肤品/、贵产品无效/,共享参考图归在 _shared/。