|
|
@@ -1,6 +1,6 @@
|
|
|
---
|
|
|
name: beauty-talk-science-video-script
|
|
|
-description: 生成「美业口播科普视频脚本」并直出视频的通用技能。面向阿里云百炼 wan3(万相3.0)文生/参考生视频,把选题/人设/画幅/时长/场景/服装/造型/画质/穿插/字幕/配乐等元素参数化;人物五视角图、制服细节图、音色三项固定素材来自技能素材包(assets/brand/)或公网URL(config.brand_assets)并锁定作生成输入;据其生成人物完整形象照、插画供用户确认,门店场景直接采用门店空间索引实景图(按动线 zone 选取),确认后的物料作为参考图提交 wan3;口播转为口语化;整段视频一个片段、≤30秒;确认后调用 scripts/generate_video.py 提交 wan3 异步任务、轮询、下载本地;修改即整段重发(不支持二次创作)。
|
|
|
+description: 生成「美业口播科普视频脚本」并直出视频的通用技能。面向阿里云百炼 wan3(万相3.0)文生/参考生视频,把选题/人设/画幅/时长/场景/服装/造型/画质/穿插/字幕/配乐等元素参数化;人物五视角图、制服细节图、音色三项固定素材来自技能素材包(assets/brand/)或公网URL(config.brand_assets)并锁定作生成输入;据其生成人物完整形象照、插画供用户确认,门店场景直接采用门店空间索引实景图(按动线 zone 选取),确认后的物料作为参考图提交 wan3;口播转为口语化(更白话、适当加语气词、不大幅增字,并规避违禁词);整段视频一个片段、≤30秒;确认后调用 scripts/generate_video.py 提交 wan3 异步任务、轮询、下载本地;修改即整段重发(不支持二次创作)。
|
|
|
agent_created: true
|
|
|
---
|
|
|
|
|
|
@@ -14,7 +14,7 @@ agent_created: true
|
|
|
2. **制服**必须参考指定的(素材包或 URL)制服细节图(可换款式/颜色,**胸牌绝对不变**)。
|
|
|
3. **门店场景**必须采用门店空间索引实景图(按动线规划从 `assets/store-spatial-index/` 选取对应 zone 照片作参考图),怡呵美 LOGO 随实景图(品牌墙/发光字展柜)自然呈现,不另行生成含 LOGO 的门店图。
|
|
|
4. **音色**必须用指定的(素材包或 URL)音色文件作 reference_audio。
|
|
|
-5. 口播文案由用户内容**转换为口语化适合口播**的文案。
|
|
|
+5. 口播文案由用户内容**转换为口语化适合口播**的文案(更白话、适当加语气词、不大幅增字,并规避违禁词)。
|
|
|
6. 整段视频**一个片段、≤30 秒**;超 30 秒则反馈用户精简、循环直到满足。
|
|
|
7. 确认后调用 **百炼 wan3 API** 发起生成、轮询完成、存储本地、给用户确认。
|
|
|
8. **不支持二次创作**:每次修改都重新组装完整脚本重发 wan3(不用编辑/延长模式)。
|
|
|
@@ -110,7 +110,7 @@ agent_created: true
|
|
|
|
|
|
### Step 5 — 处理口播文案(转口语化 + 时长软卡 ≤30s)
|
|
|
|
|
|
-- **用户自带内容/口播** → 转换为口语化、适合口播的文案(自然亲和、带 `/` `//` 停顿符号、科普准确)。
|
|
|
+- **用户自带内容/口播** → 先做合规转换:① 规避/修改违禁词(敏感词检测见 Step 6,先扫后改);② **优化得更口语化、白话**——把书面表达改成日常说话的样子,**适当增加语气词**(如「咱 / 姐妹们 / 其实 / 说真的 / 啊 / 吧 / 嘛 / 呢」)让口播更自然亲切;③ **不要大幅增加字数**——以原稿为底、同义改写 / 补语气词为主,不另起长句、不堆词。转换后带 `/` `//` 停顿符号、科普准确、自然亲和。(注:语气词写进「口播定本」本身;下方口播逐字红线要求 wan3 逐字读出定本、不得自行加词,二者不冲突——语气词是定本的一部分,不是生成时临加的。)
|
|
|
- **用户只给选题/知识点** → 技能生成口语化口播文案。
|
|
|
- **时长软卡循环(不固定 30 秒,但 ≤30 秒)**:按"每秒 ≈ 3–3.7 字(放慢语速 + 句间气口)"估算台词所需时长;若预计 >30 秒 → **反馈用户精简,等用户回精简版后重新估算**,循环直到预计 ≤30 秒才继续。绝不为凑时长拆分片段。最终的精确总时长 T 由 Step 8 的 Shot 台词时间分配表求和得出(见 Step 8 第 5 点)。
|
|
|
- ⚠️ **口播红线**:组装 prompt 时须内联完整「口播定本」作唯一台词依据,并显式禁止 TTS 据画面/主题自行补词(句间/句末幻觉加词,如"做好防晒"后补"干皮");prompt 其他文字(标题/表头/规格标注)一律不出声。详见 `wan3-workflow.md` 坑5。
|