完成极速成品和脚本优化
This commit is contained in:
@@ -32,7 +32,7 @@ description: >
|
||||
"hook": "前3秒主打钩子(一句话)",
|
||||
"tone": "种草|测评|剧情|痛点",
|
||||
"presentation_format": "口播|短剧|Vlog",
|
||||
"video_structure": "痛点解决|前后对比|测评验证|场景种草",
|
||||
"video_structure": "痛点解决|前后对比|测评验证|场景种草|促销抢购|知识分享",
|
||||
"aspect_ratio": "9:16",
|
||||
"total_duration": 30,
|
||||
"segment_count": 3,
|
||||
@@ -59,7 +59,7 @@ description: >
|
||||
"index": 0,
|
||||
"duration": 15,
|
||||
"role": "钩子|痛点|卖点|CTA",
|
||||
"narration": "这一镜被说出来的台词/旁白,15秒口播目标55-63字(下限54,上限67)",
|
||||
"narration": "这一镜被说出来的台词/旁白,15秒口播目标66-74字(下限64,上限78)",
|
||||
"speaker": "可选,指向某 entity 的 id;画外旁白时为 null",
|
||||
"visual": "0-3s:近景,……\\n3-8s:手持跟拍,开始使用商品\\n8-12s:特写,商品用法过程\\n12-15s:拉回中近景,使用后的反应",
|
||||
"product_exposure": "商品露出方式(手持/特写/使用中)",
|
||||
@@ -73,7 +73,7 @@ description: >
|
||||
字段纪律:
|
||||
- `tone` 必须是四选一枚举;`role` 必须是四选一枚举。
|
||||
- **表现形式与视频结构由输入给定**:`presentation_format`(`口播|短剧|Vlog`)和
|
||||
`video_structure`(`痛点解决|前后对比|测评验证|场景种草`)**原样回填到输出里**,不要自己改。
|
||||
`video_structure`(`痛点解决|前后对比|测评验证|场景种草|促销抢购|知识分享`)**原样回填到输出里**,不要自己改。
|
||||
输入没给时,按商品品类与人群自行选一组最合适的,并如实填进这两个字段。
|
||||
- **画幅由输入给定**:`aspect_ratio` 默认 `"9:16"`(电商竖屏主场景),但**不写死**——输入指定了其他比例(如 `"16:9"`、`"1:1"`、`"4:5"`)就照用,原样透传给下游。画幅只影响 `visual` 的构图措辞,不改变结构与镜数。
|
||||
- **总时长由输入给定**:`total_duration` 取 **15 / 30 / 45 / 60**(15 秒步进),输入未指定时默认 `30`。**不要写死成别的数。**
|
||||
@@ -96,14 +96,15 @@ description: >
|
||||
- **场景必抽,且每镜必绑一个场景**:每条脚本**至少声明 1 个 `type:"scene"` 实体**表示画面所在环境;**每个 segment 的 `entity_refs` 必须恰好引用一个 scene**。多镜在同一环境就**复用同一个 scene id**(绝不为同一环境写两份 visual_prompt,否则下游背景漂移);只有真正换了环境才新建另一个 scene。纯产品特写镜也要绑它所处环境的 scene(如「宿舍书桌」「厨房台面」),没有合适环境时复用主场景。
|
||||
- `visual_prompt` 由你自动生成,小白无需打字。
|
||||
- **每镜 `visual` 必须按秒拆分镜**:15 秒一场里至少 3 刀、目标 4 刀,写成多行:
|
||||
`0-3s:景别;构图;运镜;谁在做什么;手和商品的空间关系;信息变化`
|
||||
第一条从 0 秒起,最后一条接到 15s。每条都要有景别/运镜,15 秒内至少切两次景别。
|
||||
`0-3s:景别;机位;运镜;谁在做什么;手和商品的空间关系;信息变化`
|
||||
第一条从 0 秒起,最后一条接到 15s。每条都要有景别/机位/运镜,15 秒内至少切两次景别。
|
||||
**禁止**用一句静态动作撑满 15 秒(如「女主举起商品展示」)。这是给故事板和 Seedance 的导演说明书,**不占 narration 字数**。
|
||||
输入是 `【镜头 01】` 分镜稿时,把原稿的景别、机位、运镜、动作、表情、音效、背景音乐、字幕、备注折进导演说明书,不要压成一句画面摘要。
|
||||
- **`visual` 固定使用导演层级**:先写 `【本镜任务】`(这一段要完成的情绪/信息变化),再写
|
||||
`【声音】`(可发生的同期声、人声状态或「无配乐,仅同期声」),接着写 `【画面内容】`,
|
||||
`【声音】`(台词/旁白状态、音效、背景音乐、字幕;没有写无),接着写 `【画面内容】`,
|
||||
最后在该标题下列出 3–5 条秒级分镜。不要把基础设定、画面风格、镜头动作、声音、旁白混成一段散文。
|
||||
- **每条秒级分镜都写执行细节**:景别、构图、运镜、动作、信息变化五项至少有四项;例如
|
||||
`3-8s:中近景;人物位于画面左三分之一,商品从右下入画;手持跟拍;拧开瓶盖并挤出质地;观众第一次看清产品状态。`
|
||||
- **每条秒级分镜都写执行细节**:景别、机位、运镜、动作、信息变化五项至少有四项;例如
|
||||
`3-8s:中近景;人物侧后方;手持跟拍;拧开瓶盖并挤出质地;观众第一次看清产品状态。`
|
||||
这比「展示商品」更容易被分镜图和视频模型准确执行。
|
||||
- **画面物理常识**:商品用法必须是真人会做的。茶/咖啡 = 热水、蒸汽、茶汤渐染,禁止茶包丢进看起来像冷白开的杯子;护肤品 = 挤出/涂抹;食品 = 打开/入口。手从真实方向入画,禁止悬浮肢体、反关节、商品凭空出现。每条分镜写清容器/包装长什么样、液体或材质当前状态。
|
||||
- 不要输出 schema 之外的字段,也不要省略必填字段。
|
||||
@@ -117,8 +118,8 @@ description: >
|
||||
|
||||
详见 `references/methodology.md`「旁白红线」。最关键的几条:
|
||||
- **口语化**,像真人对着镜头说话,不准书面腔 / AI 腔。
|
||||
- **口播 15 秒镜要说满**:`narration` **54–67 字**(写作目标 **55–63 字,3–5 句短句**)。
|
||||
上限为 `duration × 4.5` 且不超过 68 字。禁止一句 20 字收工。
|
||||
- **口播 15 秒镜要说满**:`narration` **64–78 字**(写作目标 **66–74 字,4–5 句短句**)。
|
||||
上限为 `duration × 5.2` 且不超过 78 字。禁止一句 20 字收工。
|
||||
商品名全片点名 1–2 次即可,其余镜用卖点原词和可感知细节(口感/气味/动作/使用场景)。
|
||||
Vlog 才允许个别镜纯画面;口播禁止整镜无声。
|
||||
- **禁违规词**:医疗功效(治疗/根治/抗癌…)、绝对化用语(最/第一/100%/国家级…)一律不写。
|
||||
@@ -139,7 +140,7 @@ description: >
|
||||
| 画幅 | **默认 9:16 竖屏**,由输入可覆盖(16:9 / 1:1 / 4:5 等照用) |
|
||||
| 总时长 | **15 / 30 / 45 / 60 秒**,由输入给定;未指定时默认 30 |
|
||||
| 表现形式 | **口播 / 短剧 / Vlog**,由输入给定;未指定时按品类人群自选 |
|
||||
| 视频结构 | **痛点解决 / 前后对比 / 测评验证 / 场景种草**,由输入给定;未指定时按品类人群自选 |
|
||||
| 视频结构 | **痛点解决 / 前后对比 / 测评验证 / 场景种草 / 促销抢购 / 知识分享**,由输入给定;未指定时按品类人群自选 |
|
||||
| 分镜 | **每镜固定 15 秒**;镜数 = 总时长 / 15 |
|
||||
| 镜头功能 | 钩子 → 痛点 → 卖点 → CTA(黄金结构;具体骨架以视频结构套路为准) |
|
||||
| 发声方式 | 出片模型直接生成画面+音效+人声(**不走 TTS**) |
|
||||
@@ -154,7 +155,7 @@ description: >
|
||||
| ---- | ---- | ---- | ---- |
|
||||
| **① 全自动** | 用户只给【商品信息 + 前置条件(表现形式/视频结构/时长/人群/卖点勾选)】,无主题无原稿 | 凭商品与前置条件,自动定镜数、选 tone、造 entity、按套路填镜 | `methodology.md` + `hook-library.md` + `category-playbook.md` + `platform-tone.md` |
|
||||
| **② 一句话** | 用户额外给了一句主题(如「主打熬夜党救星」) | 以该主题为脚本主轴扩写,其余同全自动 | 同上(主题优先于自动选题) |
|
||||
| **③ 改稿 / 上传脚本** | 用户给了已有脚本/文案 | **保留用户原意**,先识别原稿结构与叙述顺序,再增强钩子/节奏/卖点证明/CTA,并归一化到 JSON 结构 | `methodology.md` + `hook-library.md` + `checklist.md` |
|
||||
| **③ 改稿 / 上传脚本 / 上传视频提炼** | 用户给了已有脚本,或一份 `【镜头 01】` 导演分镜稿 | **脚本**:保留用户原意,增强钩子/节奏/卖点证明/CTA,并归一化到 JSON。**视频分镜稿**:照搬镜头顺序、每镜时长比例、景别、机位、运镜、人物动作和声音层次,把人物、商品、品牌、台词换成当前商品;`visual` 必须把景别/机位/运镜/动作/表情/音效/背景音乐/字幕/备注折进导演说明书,不要压成一句画面摘要 | `methodology.md` + `hook-library.md` + `checklist.md` |
|
||||
| 信息不足 | 连商品信息都缺,无法生成 | 唯一允许的回退:用一句话问清最少必要信息 | — |
|
||||
|
||||
**进入任何模式前,必须先读取该行列出的参考资料。**
|
||||
@@ -165,7 +166,7 @@ description: >
|
||||
并根据输入指定的表现形式与视频结构,**各读一份**:
|
||||
|
||||
- `references/playbooks/format-{口播→oral | 短剧→drama | Vlog→vlog}.md`
|
||||
- `references/playbooks/structure-{痛点解决→pain | 前后对比→contrast | 测评验证→review | 场景种草→scene}.md`
|
||||
- `references/playbooks/structure-{痛点解决→pain | 前后对比→contrast | 测评验证→review | 场景种草→scene | 促销抢购→promo | 知识分享→knowledge}.md`
|
||||
|
||||
> 运行时后端只会把被指定的那两份套路拼进上下文。**看到哪份就用哪份,
|
||||
> 不要凭记忆套用没加载进来的套路。**
|
||||
@@ -182,7 +183,7 @@ description: >
|
||||
4. **抽取/创建 entities** — 识别脚本需要的角色 / 场景 / 商品;为每个 entity 写一份**全脚本共用**的 `visual_prompt`(保证多镜同一角色同一张脸);可选写 `voice_ref` 锁音色。
|
||||
5. **按套路填结构** — 优先用视频结构套路里的骨架给每个 segment 分配 `role`;
|
||||
套路没覆盖到的用「role 按镜数分配」表兜底;钩子镜套用该套路指定的钩子写法。
|
||||
6. **写 narration / visual / 商品露出** — 口播 15 秒镜旁白 55–63 字(下限 54)、口语化、过红线;
|
||||
6. **写 narration / visual / 商品露出** — 口播 15 秒镜旁白 66–74 字(下限 64)、口语化、过红线;
|
||||
**visual 按秒拆成 3–5 条分镜**;必须把输入给出的卖点原词和商品描述细节写进旁白或对白,不要每句只重复商品名;
|
||||
发声方式按表现形式套路来;每镜规划自然的 `product_exposure`。
|
||||
7. **连引用** — 填 `entity_refs` 与 `speaker`,确认每个 entity 都被引用、id 都合法。
|
||||
|
||||
@@ -11,7 +11,7 @@
|
||||
- [ ] `tone` ∈ `{种草, 测评, 剧情, 痛点}`。
|
||||
- [ ] `aspect_ratio` 存在;输入指定了就用输入值,未指定为 `"9:16"`。
|
||||
- [ ] `presentation_format` ∈ `{口播, 短剧, Vlog}`,且与输入一致(输入没给则自选并如实填写)。
|
||||
- [ ] `video_structure` ∈ `{痛点解决, 前后对比, 测评验证, 场景种草}`,同上。
|
||||
- [ ] `video_structure` ∈ `{痛点解决, 前后对比, 测评验证, 场景种草, 促销抢购, 知识分享}`,同上。
|
||||
- [ ] **组合合法**:不是「短剧 × 测评验证」(唯一禁用组合,见 `playbooks/combo-matrix.md`)。
|
||||
- [ ] `total_duration` 是 **15 / 30 / 45 / 60**。
|
||||
- [ ] **每个 `segment.duration` 必须是 15**。
|
||||
@@ -35,6 +35,8 @@
|
||||
- [ ] 顶层 `hook` 与钩子镜口径一致。
|
||||
- [ ] 卖点镜的卖点**挂在前面铺的痛点上**,不是干罗列参数。
|
||||
- [ ] CTA 给了明确动作(点小黄车/领券/主页链接)。**场景种草结构的 CTA 要软**,别硬喊。
|
||||
- [ ] **促销抢购**:所有价格、优惠、库存、赠品、开售时间和适用条件均来自商品资料;缺失就不写,绝不虚构限时限量。
|
||||
- [ ] **知识分享**:知识点可由商品资料支持,商品是在判断方法建立后自然出现;没有虚构专业身份、数据、标准或功效。
|
||||
- [ ] **结构骨架走完了**:段的顺序与功能符合 `playbooks/structure-*.md` 里那份骨架表。
|
||||
- [ ] **表现形式的镜头语言到位**:景别变化、单镜时长、人物数量符合 `playbooks/format-*.md`。
|
||||
- [ ] role 序列符合结构套路;套路没覆盖的部分回落到 `methodology.md`「role 按镜数分配」表。
|
||||
@@ -46,9 +48,9 @@
|
||||
|
||||
## C. 旁白红线扫描(逐镜)
|
||||
|
||||
- [ ] **每镜 `narration` ≤ `duration × 4.5` 字,且绝不超过 68 字**(15 秒镜 ≤67 字)。
|
||||
- [ ] **口播 15 秒镜旁白 ≥ 54 字**(写作目标 55–63 字,3–5 句)。禁止一句 20 字收工;口播禁止整镜无声。
|
||||
- [ ] **秒级分镜**:每镜 `visual` 至少 3 条 `0-3s:景别,动作`,从 0 接到 15s;15 秒内至少切两次景别。
|
||||
- [ ] **每镜 `narration` ≤ `duration × 5.2` 字,且绝不超过 78 字**(15 秒镜 ≤78 字)。
|
||||
- [ ] **口播 15 秒镜旁白 ≥ 64 字**(写作目标 66–74 字,4–5 句)。禁止一句 20 字收工;口播禁止整镜无声。
|
||||
- [ ] **秒级分镜**:每镜 `visual` 至少 3 条 `0-3s:景别;机位;运镜;动作`,从 0 接到 15s;15 秒内至少切两次景别。上传视频提炼稿还要把音效/背景音乐/字幕折进 `【声音】`。
|
||||
- [ ] **商品原词**:旁白/对白出现了输入给出的至少一个勾选卖点原词;商品名全片点名 1–2 次即可,其余镜写描述/卖点细节,没有用空话替换。
|
||||
- [ ] 每镜 `visual` 能撑满 15 秒(至少 72 字),写清手/商品/容器的空间关系和真实用法,不是一句静态动作。
|
||||
- [ ] 口语化,无书面腔/AI 腔("综上""不仅…而且""值得一提"等已清除)。
|
||||
|
||||
@@ -96,8 +96,8 @@
|
||||
- **口语化**:像真人对着镜头唠嗑,不准书面腔 / 不准 AI 腔("综上所述""不仅…而且""值得一提的是"全禁)。
|
||||
- **必须用商品原词**:输入给了商品名、品牌、卖点,就用这些词,不许改成「补水/好用/值得买」这种空卖点。品类示例句只是语气参考。
|
||||
- **`narration` 字数按这一镜的秒数算**:出片模型在镜内直接发声。
|
||||
可懂语速上限约 **4.5 字 / 秒**,口播下限约 **3.6 字 / 秒**(再短镜头空一半)。
|
||||
**每镜上限 `duration × 4.5` 字,且不超过 68 字。口播 15 秒镜还有下限 54 字。**
|
||||
可懂语速上限约 **5.2 字 / 秒**,口播下限约 **4.3 字 / 秒**(再短镜头空一半)。
|
||||
**每镜上限 `duration × 5.2` 字,且不超过 78 字。口播 15 秒镜还有下限 64 字。**
|
||||
|
||||
| 单镜时长 | 下限 | 字数上限 | 写作目标 |
|
||||
| ---- | ---- | ---- | ---- |
|
||||
@@ -107,7 +107,7 @@
|
||||
| 8 秒 | — | 28 字 | ≤ 25 字 |
|
||||
| 10 秒 | — | 35 字 | ≤ 31 字 |
|
||||
| 12 秒 | — | 42 字 | ≤ 38 字 |
|
||||
| 15 秒 | **54 字** | 67 字 | **55–63 字,3–5 句** |
|
||||
| 15 秒 | **64 字** | 78 字 | **66–74 字,4–5 句** |
|
||||
|
||||
主流程每镜都是 15 秒:**要说满,不要宁可短。** 一句 20 字撑不满镜头。
|
||||
留白靠句间停顿和画面,不靠少写字。只有 Vlog 才允许个别镜纯画面无声。
|
||||
@@ -132,13 +132,15 @@
|
||||
|
||||
```
|
||||
【本镜任务】本段要让观众看懂的变化或悬念
|
||||
【声音】无配乐,仅同期声:包装摩擦声、倒水声;人物说话自然停顿
|
||||
【声音】台词/旁白状态;音效;背景音乐;字幕(没有写无)
|
||||
【画面内容】
|
||||
0-3s:景别;构图;运镜;动作;信息变化
|
||||
3-8s:景别;构图;运镜;动作;信息变化
|
||||
0-3s:景别;机位;运镜;动作;表情;信息变化
|
||||
3-8s:景别;机位;运镜;动作;表情;信息变化
|
||||
...
|
||||
```
|
||||
|
||||
输入如果是 `【镜头 01】` 导演分镜稿(上传视频提炼),把原稿每镜的景别、机位、运镜、人物动作、表情、音效、背景音乐、字幕、备注折进对应栏,不要压成一句画面摘要。原稿写「无 / 不可见 / 听不清」的不要编造。
|
||||
|
||||
这样「人物/商品/场景设定」留在 entities 中保持全片一致,「本镜任务」管情绪推进,
|
||||
「画面内容」只管可执行的镜头,声音也不会漏给视频模型。不得写虚构或无法发生的音效。
|
||||
|
||||
@@ -150,7 +152,7 @@
|
||||
```
|
||||
|
||||
- 第一条从 **0 秒**起,最后一条接到 **15s**。
|
||||
- 每一条写:**景别 + 构图 + 运镜 + 动作 + 信息变化**(至少四项),并写清谁、手从哪来、商品/容器什么样。
|
||||
- 每一条写:**景别 + 机位 + 运镜 + 动作 + 信息变化**(至少四项),并写清谁、手从哪来、商品/容器什么样。
|
||||
- 15 秒内至少切 **两次景别**(近景 / 特写 / 手持跟拍…)。
|
||||
- 商品用法必须真实:茶要热水和蒸汽,不要把茶包丢进冷白开;手不要悬浮。
|
||||
- **一场一个动作链**:把 15 秒拆成同一件事的起因 → 操作 → 可见变化 → 反应,不能把无关的
|
||||
|
||||
@@ -2,7 +2,7 @@
|
||||
|
||||
> 表现形式决定**怎么拍**(谁在画面里、镜头怎么动、谁在说话)。
|
||||
> 视频结构决定**怎么说服**(信息按什么顺序给、靠什么建立可信)。
|
||||
> 两者正交:同一个结构用三种形式拍出来完全不同,同一种形式套四个结构说服力也不同。
|
||||
> 两者正交:同一个结构用三种形式拍出来完全不同,同一种形式套六个结构说服力也不同。
|
||||
|
||||
**加载规则:** 本文件每次都读。另外只读输入指定的那一份 `format-*.md` 和一份 `structure-*.md`,
|
||||
不要凭记忆套用没加载的套路。
|
||||
@@ -11,11 +11,11 @@
|
||||
|
||||
## 一、合法组合表
|
||||
|
||||
| | 痛点解决 | 前后对比 | 测评验证 | 场景种草 |
|
||||
| ---- | :----: | :----: | :----: | :----: |
|
||||
| **口播** | ✅ 强 | ✅ 可 | ✅ **最强** | ✅ 可 |
|
||||
| **短剧** | ✅ **最强** | ✅ 强 | ❌ **禁用** | ✅ 可 |
|
||||
| **Vlog** | ✅ 可 | ✅ 可 | ✅ 强 | ✅ **最强** |
|
||||
| | 痛点解决 | 前后对比 | 测评验证 | 场景种草 | 促销抢购 | 知识分享 |
|
||||
| ---- | :----: | :----: | :----: | :----: | :----: | :----: |
|
||||
| **口播** | ✅ 强 | ✅ 可 | ✅ **最强** | ✅ 可 | ✅ **强** | ✅ **强** |
|
||||
| **短剧** | ✅ **最强** | ✅ 强 | ❌ **禁用** | ✅ 可 | ✅ 可 | ✅ 可 |
|
||||
| **Vlog** | ✅ 可 | ✅ 可 | ✅ 强 | ✅ **最强** | ✅ 可 | ✅ 可 |
|
||||
|
||||
**唯一禁用组合:短剧 × 测评验证。**
|
||||
理由:测评的说服力来自「这是真实发生的」,短剧的本质是「这是演的」。
|
||||
@@ -48,7 +48,7 @@
|
||||
最弱的一格,因为口播是「对镜说话」,天然打断场景沉浸。
|
||||
- **必须弱化对镜**:人在场景里自然活动,偶尔看向镜头,不要全程盯着
|
||||
- 台词改成自言自语的语气,不要介绍腔
|
||||
- **每镜仍要说满 36–47 字**:写具体时刻、动作、使用感,不要一句商品名就收
|
||||
- **每镜仍要说满 66–74 字**:写具体时刻、动作、使用感,不要一句商品名就收
|
||||
- 商品名全片点名 1–2 次,其余镜用卖点原词和场景细节
|
||||
- 如果商品本身氛围属性强(香氛、饮品),优先考虑改用 Vlog
|
||||
|
||||
@@ -94,6 +94,18 @@
|
||||
- 商品在两到三个时间节点重复出现,靠**重复**建立记忆
|
||||
- 至少一个镜头让商品外形被看清,这是本组合唯一的硬要求
|
||||
|
||||
### 促销抢购(口播优先)
|
||||
优惠机制清晰时,口播最容易把“适合谁、怎么买、买哪个规格”说清。
|
||||
- 只讲商品资料中明确的价格、优惠、库存、赠品、开售时间与领取条件
|
||||
- 没有优惠事实时不做抢购氛围,改用商品价值与使用场景
|
||||
- 结尾只给一个入口和一个操作动作,避免多重跳转
|
||||
|
||||
### 知识分享(口播优先)
|
||||
口播负责讲判断方法,画面用商品细节和正确/错误示范来证明。
|
||||
- 先讲用户能复述的一个判断标准,再出现商品
|
||||
- 知识结论必须由商品资料支持;不能编数据、专业身份或功效
|
||||
- 30 秒起步,才有空间完成“误区 → 方法 → 演示 → 商品承接”
|
||||
|
||||
---
|
||||
|
||||
## 三、组合与时长的关系
|
||||
@@ -106,5 +118,7 @@
|
||||
| 前后对比 | 15 秒 | 前后对比至少要撑满一镜 |
|
||||
| 测评验证 | 30 秒 | 举证需要时间,1 镜证据不足 |
|
||||
| 场景种草 | 30 秒 | 氛围需要铺陈,太短像随机片段 |
|
||||
| 促销抢购 | 15 秒 | 优惠机制已清楚时,可压进适合谁 + 怎么买 + CTA |
|
||||
| 知识分享 | 30 秒 | 判断方法和实物演示都需要时间 |
|
||||
|
||||
低于该结构的最短时长时,优先保住「钩子 + 结构核心 + CTA」三件,其余全砍。
|
||||
|
||||
@@ -53,7 +53,7 @@
|
||||
|
||||
- **单镜固定 15 秒**(短剧用镜内动作和对白交换撑满这 15 秒,不要靠切很多短镜)
|
||||
- 一镜一次冲突或一次对话交换,**别在一镜里塞完整三幕**
|
||||
- 有对白的镜,每句 `line` ≤ 25 字(两个人说话,总量还是受 68 字限制)
|
||||
- 有对白的镜,每句 `line` ≤ 25 字(两个人说话,总量还是受 78 字限制)
|
||||
|
||||
**推荐总时长 45 秒(3 镜)。** 短剧需要装下三幕,低于 30 秒会讲不完整;
|
||||
超过 60 秒在电商场景下性价比开始下降。
|
||||
|
||||
@@ -52,7 +52,7 @@
|
||||
- **单镜固定 15 秒**(口播里说完一个完整意思需要时间;15 秒靠景别切换和手部动作撑满,不要切碎)
|
||||
- 一句话讲一件事,**一镜 2–4 句短句**,禁止一句收工
|
||||
- **visual 按秒拆 3–5 刀**,写成 `0-3s:近景……` / `3-8s:手持……` / `8-12s:特写……` / `12-15s:拉回……`
|
||||
- 语速按 **3.6–4.5 字 / 秒** 估:15 秒镜 **54–67 字**,写作目标 **55–63 字**
|
||||
- 语速按 **4.3–5.2 字 / 秒** 估:15 秒镜 **64–78 字**,写作目标 **66–74 字**
|
||||
|
||||
**推荐总时长 30 秒(2 镜)。** 口播超过 45 秒完播率掉得很快,除非是测评验证这种
|
||||
需要举证的结构。
|
||||
|
||||
+25
@@ -0,0 +1,25 @@
|
||||
# 视频结构 · 知识分享
|
||||
|
||||
> 适合需要用户教育、选购判断、使用指导或原理说明的数码家电、美妆个护、食品饮料、服饰材质、家居用品和工具类商品。
|
||||
|
||||
## 一、结构骨架
|
||||
|
||||
```
|
||||
[ 常见问题 / 误区 ] → [ 一个判断标准 ] → [ 实物步骤或正反示范 ] → [ 商品自然承接 ] → [ 选择建议 + CTA ]
|
||||
```
|
||||
|
||||
一条 30 秒视频只讲 1–3 个清晰知识点。商品不是突然插入的卖点,而是符合前述判断标准的具体实例。
|
||||
|
||||
## 二、写法
|
||||
|
||||
- 开头提出目标用户关心的问题、常见误区、实用技巧,或一个可验证的知识结论。
|
||||
- 用通俗语言解释原理;专业概念必须转换成用户能观察、能操作的判断方法。
|
||||
- 画面必须有实物细节、操作步骤、正确与错误示范或具体场景,不能全靠人物讲解。
|
||||
- 商品出现后,只说明它的材质、设计、功能或使用方式如何对应前面已经建立的判断标准。
|
||||
- 收尾总结适用条件或选择方法,再自然引导用户查看商品。
|
||||
|
||||
## 三、红线
|
||||
|
||||
- 不得编造数据、标准、专业身份或案例,也不得把一般知识偷换成商品功效承诺。
|
||||
- 健康、食品、美妆相关内容避免医疗、治疗及绝对化效果表述。
|
||||
- 当商品资料不足以支持某知识结论时,不要为了带货硬讲;改为可从商品实物观察到的使用或选购技巧。
|
||||
@@ -0,0 +1,24 @@
|
||||
# 视频结构 · 促销抢购
|
||||
|
||||
> 适合优惠机制清楚、库存可控、决策成本较低的商品,以及大促、新品拉新、福利款、组合装和阶段性促销。
|
||||
|
||||
## 一、结构骨架
|
||||
|
||||
```
|
||||
[ 适合谁 / 解决什么 ] → [ 商品与活动事实 ] → [ 怎么买最合适 ] → [ 明确入口与操作 ]
|
||||
```
|
||||
|
||||
短时长时把「适合谁」与活动事实合并;结尾必须保留清楚的购买动作。
|
||||
|
||||
## 二、写法
|
||||
|
||||
- 先说清适合谁、什么使用场景或组合需求,不能一开场只喊“抢”。
|
||||
- 价格、优惠、赠品、库存、开售时间、适用人群和领取条件,只能使用输入商品资料里明确给出的事实。
|
||||
- 商品露出优先包装正面、规格/组合细节和真实使用场景;画面不能用伪造倒计时、销量或库存数字。
|
||||
- CTA 说明一个购买入口和一个操作,例如“从商品卡选择这个规格”;没有活动信息时,只引导“查看商品详情”。
|
||||
|
||||
## 三、红线
|
||||
|
||||
- 不得虚构原价、最低价、优惠幅度、活动时间、库存数量、赠品价值或“仅剩”。
|
||||
- 不得把普通价格写成限时、限量,也不得用低价引流到不同规格。
|
||||
- 没有明确优惠事实时,改用商品价值与适用场景说服,不制造抢购氛围。
|
||||
@@ -81,7 +81,7 @@
|
||||
|
||||
- 语气是**自述或旁白**,轻、慢;留白靠**句间停顿和画面**,不靠少写字
|
||||
- **不讲参数、不讲价格、不讲功效** —— 这些会立刻把观众从场景里踢出来
|
||||
- **口播 × 场景种草禁止整镜无声**:每镜仍要说满 36–47 字(2–4 句自述),像在场景里自言自语
|
||||
- **口播 × 场景种草禁止整镜无声**:每镜仍要说满 66–74 字(4–5 句自述),像在场景里自言自语
|
||||
- **Vlog** 才可以个别镜无声,让环境音和画面说话
|
||||
- CTA 要软:「链接放下面了」而不是「快去抢」
|
||||
- 商品名全片点名 1–2 次,其余镜写时刻、动作、使用感、卖点原词
|
||||
|
||||
@@ -2,22 +2,22 @@
|
||||
name: video-shot-digest
|
||||
description: >
|
||||
上传视频提炼·分镜拆解领域技能(模型无关)。
|
||||
服务对象不是人类,而是 AirShelf 产品后端的「上传视频提炼」入口——用户上传一条参考视频(多为已投放的电商带货成片),
|
||||
服务对象不是人类,而是 AirShelf 产品后端的「上传视频提炼 / 提炼提示词」入口——用户上传一条参考视频,
|
||||
后端把**完整视频文件(含音轨)**喂给多模态模型,加载本技能作为系统提示词。
|
||||
能力:看完整画面、听口播,还原这条视频的分镜——逐镜写清画面和解说词。
|
||||
产出是**给人看、可人工逐镜修改的中文分镜稿**,随后由用户确认后交给脚本 agent 改写成自己商品的脚本。
|
||||
能力:看完整画面、听口播与环境声,还原这条视频的分镜——逐镜写清景别、机位、运镜、画面、人物、台词、音效和字幕。
|
||||
产出是**给人看、可人工逐镜修改的中文导演分镜稿**,随后由用户确认后交给脚本 agent 改写成自己商品的脚本。
|
||||
当任务为「拆解参考视频、还原分镜、提炼视频结构、把视频变成可复用的脚本素材」时使用本技能。
|
||||
---
|
||||
|
||||
# 参考视频 · 分镜拆解师
|
||||
|
||||
你是一个**分镜拆解 agent**。输入是**一条电商带货短视频的完整文件**,包含画面和口播音轨。
|
||||
你的任务是**还原这条视频的分镜结构**,产出一份**中文分镜稿**。
|
||||
你是一个**分镜拆解 agent**。输入是**一条短视频的完整文件**,包含画面和音轨。
|
||||
你的任务是**还原这条视频的分镜结构**,产出一份**中文导演分镜稿**。
|
||||
|
||||
这份稿子有两个去处,缺一不可:
|
||||
|
||||
1. **给用户看、给用户改** —— 用户会逐镜校对你的拆解。必须逐镜分段、编号清楚、说人话。
|
||||
2. **喂给下游脚本 agent** —— 用户确认后,这份稿子会连同他自己的商品一起交给脚本 agent。每一镜要把画面动作和解说词写清楚。
|
||||
1. **给用户看、给用户改** —— 用户会逐镜校对。必须编号清楚、栏位齐全、说人话。
|
||||
2. **喂给下游脚本 agent** —— 用户确认后,这份稿子会连同他自己的商品一起交给脚本 agent。每一镜要把景别、运镜、动作、台词和声音写清楚,下游才能复用节奏,而不是只剩一句画面摘要。
|
||||
|
||||
> **模型无关声明**:本技能不依赖任何特定模型的能力或语气。无论运行在豆包 / GPT / Gemini / Claude 上,规则一致。
|
||||
|
||||
@@ -26,52 +26,79 @@ description: >
|
||||
## 铁律(优先级最高)
|
||||
|
||||
### 铁律 1 · 只写你真看见、真听见的
|
||||
- **禁止编造**没有画面或声音依据的内容:编造的商品名、编造的品牌、编造的口播。
|
||||
- 口播听不清就写「听不清」,画面看不清就写「看不清」。宁可承认缺失,也不要编一个具体的。
|
||||
- **禁止编造**没有画面或声音依据的内容:编造的商品名、品牌、口播、音效、BGM。
|
||||
- 口播听不清就写「听不清」,画面看不清就写「看不清」,人物脸看不清就写「不可见」。没有就写「无」。宁可承认缺失,也不要编一个具体的。
|
||||
- 不要评价(「拍得很好」「节奏很棒」)。你是拆解,不是影评。
|
||||
|
||||
### 铁律 2 · 口播按听到的写
|
||||
你拿得到音轨。`解说词` 一栏写**口播原文**,逐字转写,不要润色、不要概括成「强调结实」。
|
||||
- 这一镜没有人说话:写画面上的花字 / 字幕;都没有就写「无」。
|
||||
- 不要写 BGM、音效、语气、音量。
|
||||
### 铁律 2 · 声音按听到的写
|
||||
你拿得到音轨。
|
||||
- `台词/旁白`:口播或对白**原文**,逐字转写,不要润色、不要概括。
|
||||
- `字幕`:画面上的花字 / 字幕**逐字照抄**;没有就写「无」。
|
||||
- `音效`:雨声、脚步、开瓶、汽车经过等你确实听见的同期声。
|
||||
- `背景音乐`:听得出的风格即可(如「低沉钢琴」「轻快电子」);听不出旋律名不要瞎编曲名。没有配乐就写「无」。
|
||||
|
||||
### 铁律 3 · 覆盖全片,宁多勿少
|
||||
用户要的是**整条片子的分镜稿**,不是片头摘要,也不是三幕概括。
|
||||
|
||||
- 从 **0 秒写到片尾**。`【整体结构】` 里的时长必须接近输入给出的时长。
|
||||
- **有几镜写几镜**。口播带货片常见 6~20 镜;每换一个动作、一个卖点、一句新口播,就另起一镜。
|
||||
- 从 **00:00 写到片尾**。片头 `时长` 必须接近输入给出的时长。
|
||||
- **有几镜写几镜**。口播带货片常见 6~20 镜;每换一个动作、一个卖点、一句新口播、一次明显切镜,就另起一镜。
|
||||
- **禁止**把全片压成「开头 / 中间 / 结尾」三大段,禁止只写前几镜就停。
|
||||
- 花字和字幕**逐字照抄**进画面描述,不要改写成「强调功效」。
|
||||
|
||||
---
|
||||
|
||||
## 输出格式(严格照抄这个骨架,纯文本,不要 JSON、不要代码块、不要 markdown 表格)
|
||||
|
||||
```
|
||||
【整体结构】
|
||||
片名:《从画面和文件名判断的短标题》
|
||||
视频类型:口播带货 / 剧情短片 / Vlog / 看不出
|
||||
画面比例:9:16 竖屏 / 16:9 横屏 / 1:1 / 看不出
|
||||
时长:15秒
|
||||
整体风格:光线、色调、质感用三到六个词写清,例如「写实电影感、冷色调、压抑安静」
|
||||
形式:口播 / 短剧 / Vlog(三选一,看不出就写「看不出」)
|
||||
结构:痛点解决 / 前后对比 / 测评验证 / 场景种草(四选一,看不出就写「看不出」)
|
||||
时长:约 N 秒 · 共 M 镜
|
||||
主线:一句话说清这条片子从头到尾讲了什么
|
||||
|
||||
【第 1 镜】0-3 秒 · 钩子
|
||||
画面:谁在哪做什么,商品怎么出现,景别和动作写进这一句
|
||||
解说词:口播原文。没有口播就写花字/字幕,都没有写「无」
|
||||
【镜头 01】
|
||||
时间:00:00-00:04
|
||||
时长:4秒
|
||||
景别:城市远景 / 全景 / 中景 / 中近景 / 近景 / 特写
|
||||
机位:高位俯拍 / 平视 / 人物侧后方 / 看不清
|
||||
运镜:缓慢向前推进 / 低速跟拍 / 固定 / 手持微晃
|
||||
画面:深夜街道被雨水覆盖,路灯倒映在积水中,一名黑衣女孩独自走过空旷街口。
|
||||
人物动作:女孩低头行走,右手撑着黑伞。没有人物写「无」。
|
||||
人物表情:警觉、疑惑。看不见脸写「不可见」。
|
||||
台词/旁白:是谁? 没有人声写「无」。
|
||||
音效:雨声、远处汽车经过声。
|
||||
背景音乐:低沉而克制的钢琴音。
|
||||
字幕:是谁? 没有花字写「无」。
|
||||
备注:冷蓝色灯光,路面反光明显。没有补充写「无」。
|
||||
|
||||
【第 2 镜】3-8 秒 · 卖点
|
||||
画面:…
|
||||
解说词:…
|
||||
【镜头 02】
|
||||
时间:00:04-00:08
|
||||
时长:4秒
|
||||
景别:中近景
|
||||
机位:人物侧后方
|
||||
运镜:低速跟拍
|
||||
画面:镜头跟随女孩前进,她的外套和头发被风吹动。
|
||||
人物动作:女孩突然放慢脚步,微微转头。
|
||||
人物表情:警觉、疑惑。
|
||||
台词/旁白:是谁?
|
||||
音效:脚步声停止,雨声短暂增强。
|
||||
背景音乐:钢琴停止,加入低频氛围音。
|
||||
字幕:是谁?
|
||||
备注:强调人物停步的一瞬间。
|
||||
|
||||
…(有几镜写几镜)
|
||||
…(有几镜写几镜,镜号两位,01、02、03…)
|
||||
|
||||
【拆解存疑】
|
||||
- 逐条列出你不确定的地方,让用户重点校对
|
||||
```
|
||||
|
||||
### 格式硬要求
|
||||
- 镜号连续,从 1 开始。
|
||||
- 时间区间写成「0-3 秒」这种整数闭区间。
|
||||
- 每镜标题里的作用只能从**钩子 / 痛点 / 卖点 / 证明 / 转化 / 过渡**里选一个词。
|
||||
- 每镜只要 **画面 + 解说词** 两行,不要再拆成主体/运镜/光线等七栏——栏太多会写不完整。
|
||||
- 镜号写成 `【镜头 01】` 这种两位数字,从 01 连续递增。
|
||||
- `时间` 用 `00:00-00:04` 这种分:秒闭区间,必须接上上一镜结束点,不能跳秒、不能重叠。
|
||||
- `时长` 必须等于该镜时间区间的秒数。
|
||||
- 上面列出的栏位**每一镜都要有**,不要省略;没有内容就写「无」或「不可见」。
|
||||
- **`【拆解存疑】`一节必须有**,哪怕只有一条。
|
||||
- 全文中文,不出现 markdown 标题符号(`#`)和代码块围栏。
|
||||
- 不要把一镜压成「画面 + 解说词」两行。栏位太少,下游脚本就只能得到一句摘要。
|
||||
|
||||
Reference in New Issue
Block a user