完成极速成品和脚本优化
This commit is contained in:
@@ -11,7 +11,7 @@
|
||||
- [ ] `tone` ∈ `{种草, 测评, 剧情, 痛点}`。
|
||||
- [ ] `aspect_ratio` 存在;输入指定了就用输入值,未指定为 `"9:16"`。
|
||||
- [ ] `presentation_format` ∈ `{口播, 短剧, Vlog}`,且与输入一致(输入没给则自选并如实填写)。
|
||||
- [ ] `video_structure` ∈ `{痛点解决, 前后对比, 测评验证, 场景种草}`,同上。
|
||||
- [ ] `video_structure` ∈ `{痛点解决, 前后对比, 测评验证, 场景种草, 促销抢购, 知识分享}`,同上。
|
||||
- [ ] **组合合法**:不是「短剧 × 测评验证」(唯一禁用组合,见 `playbooks/combo-matrix.md`)。
|
||||
- [ ] `total_duration` 是 **15 / 30 / 45 / 60**。
|
||||
- [ ] **每个 `segment.duration` 必须是 15**。
|
||||
@@ -35,6 +35,8 @@
|
||||
- [ ] 顶层 `hook` 与钩子镜口径一致。
|
||||
- [ ] 卖点镜的卖点**挂在前面铺的痛点上**,不是干罗列参数。
|
||||
- [ ] CTA 给了明确动作(点小黄车/领券/主页链接)。**场景种草结构的 CTA 要软**,别硬喊。
|
||||
- [ ] **促销抢购**:所有价格、优惠、库存、赠品、开售时间和适用条件均来自商品资料;缺失就不写,绝不虚构限时限量。
|
||||
- [ ] **知识分享**:知识点可由商品资料支持,商品是在判断方法建立后自然出现;没有虚构专业身份、数据、标准或功效。
|
||||
- [ ] **结构骨架走完了**:段的顺序与功能符合 `playbooks/structure-*.md` 里那份骨架表。
|
||||
- [ ] **表现形式的镜头语言到位**:景别变化、单镜时长、人物数量符合 `playbooks/format-*.md`。
|
||||
- [ ] role 序列符合结构套路;套路没覆盖的部分回落到 `methodology.md`「role 按镜数分配」表。
|
||||
@@ -46,9 +48,9 @@
|
||||
|
||||
## C. 旁白红线扫描(逐镜)
|
||||
|
||||
- [ ] **每镜 `narration` ≤ `duration × 4.5` 字,且绝不超过 68 字**(15 秒镜 ≤67 字)。
|
||||
- [ ] **口播 15 秒镜旁白 ≥ 54 字**(写作目标 55–63 字,3–5 句)。禁止一句 20 字收工;口播禁止整镜无声。
|
||||
- [ ] **秒级分镜**:每镜 `visual` 至少 3 条 `0-3s:景别,动作`,从 0 接到 15s;15 秒内至少切两次景别。
|
||||
- [ ] **每镜 `narration` ≤ `duration × 5.2` 字,且绝不超过 78 字**(15 秒镜 ≤78 字)。
|
||||
- [ ] **口播 15 秒镜旁白 ≥ 64 字**(写作目标 66–74 字,4–5 句)。禁止一句 20 字收工;口播禁止整镜无声。
|
||||
- [ ] **秒级分镜**:每镜 `visual` 至少 3 条 `0-3s:景别;机位;运镜;动作`,从 0 接到 15s;15 秒内至少切两次景别。上传视频提炼稿还要把音效/背景音乐/字幕折进 `【声音】`。
|
||||
- [ ] **商品原词**:旁白/对白出现了输入给出的至少一个勾选卖点原词;商品名全片点名 1–2 次即可,其余镜写描述/卖点细节,没有用空话替换。
|
||||
- [ ] 每镜 `visual` 能撑满 15 秒(至少 72 字),写清手/商品/容器的空间关系和真实用法,不是一句静态动作。
|
||||
- [ ] 口语化,无书面腔/AI 腔("综上""不仅…而且""值得一提"等已清除)。
|
||||
|
||||
@@ -96,8 +96,8 @@
|
||||
- **口语化**:像真人对着镜头唠嗑,不准书面腔 / 不准 AI 腔("综上所述""不仅…而且""值得一提的是"全禁)。
|
||||
- **必须用商品原词**:输入给了商品名、品牌、卖点,就用这些词,不许改成「补水/好用/值得买」这种空卖点。品类示例句只是语气参考。
|
||||
- **`narration` 字数按这一镜的秒数算**:出片模型在镜内直接发声。
|
||||
可懂语速上限约 **4.5 字 / 秒**,口播下限约 **3.6 字 / 秒**(再短镜头空一半)。
|
||||
**每镜上限 `duration × 4.5` 字,且不超过 68 字。口播 15 秒镜还有下限 54 字。**
|
||||
可懂语速上限约 **5.2 字 / 秒**,口播下限约 **4.3 字 / 秒**(再短镜头空一半)。
|
||||
**每镜上限 `duration × 5.2` 字,且不超过 78 字。口播 15 秒镜还有下限 64 字。**
|
||||
|
||||
| 单镜时长 | 下限 | 字数上限 | 写作目标 |
|
||||
| ---- | ---- | ---- | ---- |
|
||||
@@ -107,7 +107,7 @@
|
||||
| 8 秒 | — | 28 字 | ≤ 25 字 |
|
||||
| 10 秒 | — | 35 字 | ≤ 31 字 |
|
||||
| 12 秒 | — | 42 字 | ≤ 38 字 |
|
||||
| 15 秒 | **54 字** | 67 字 | **55–63 字,3–5 句** |
|
||||
| 15 秒 | **64 字** | 78 字 | **66–74 字,4–5 句** |
|
||||
|
||||
主流程每镜都是 15 秒:**要说满,不要宁可短。** 一句 20 字撑不满镜头。
|
||||
留白靠句间停顿和画面,不靠少写字。只有 Vlog 才允许个别镜纯画面无声。
|
||||
@@ -132,13 +132,15 @@
|
||||
|
||||
```
|
||||
【本镜任务】本段要让观众看懂的变化或悬念
|
||||
【声音】无配乐,仅同期声:包装摩擦声、倒水声;人物说话自然停顿
|
||||
【声音】台词/旁白状态;音效;背景音乐;字幕(没有写无)
|
||||
【画面内容】
|
||||
0-3s:景别;构图;运镜;动作;信息变化
|
||||
3-8s:景别;构图;运镜;动作;信息变化
|
||||
0-3s:景别;机位;运镜;动作;表情;信息变化
|
||||
3-8s:景别;机位;运镜;动作;表情;信息变化
|
||||
...
|
||||
```
|
||||
|
||||
输入如果是 `【镜头 01】` 导演分镜稿(上传视频提炼),把原稿每镜的景别、机位、运镜、人物动作、表情、音效、背景音乐、字幕、备注折进对应栏,不要压成一句画面摘要。原稿写「无 / 不可见 / 听不清」的不要编造。
|
||||
|
||||
这样「人物/商品/场景设定」留在 entities 中保持全片一致,「本镜任务」管情绪推进,
|
||||
「画面内容」只管可执行的镜头,声音也不会漏给视频模型。不得写虚构或无法发生的音效。
|
||||
|
||||
@@ -150,7 +152,7 @@
|
||||
```
|
||||
|
||||
- 第一条从 **0 秒**起,最后一条接到 **15s**。
|
||||
- 每一条写:**景别 + 构图 + 运镜 + 动作 + 信息变化**(至少四项),并写清谁、手从哪来、商品/容器什么样。
|
||||
- 每一条写:**景别 + 机位 + 运镜 + 动作 + 信息变化**(至少四项),并写清谁、手从哪来、商品/容器什么样。
|
||||
- 15 秒内至少切 **两次景别**(近景 / 特写 / 手持跟拍…)。
|
||||
- 商品用法必须真实:茶要热水和蒸汽,不要把茶包丢进冷白开;手不要悬浮。
|
||||
- **一场一个动作链**:把 15 秒拆成同一件事的起因 → 操作 → 可见变化 → 反应,不能把无关的
|
||||
|
||||
@@ -2,7 +2,7 @@
|
||||
|
||||
> 表现形式决定**怎么拍**(谁在画面里、镜头怎么动、谁在说话)。
|
||||
> 视频结构决定**怎么说服**(信息按什么顺序给、靠什么建立可信)。
|
||||
> 两者正交:同一个结构用三种形式拍出来完全不同,同一种形式套四个结构说服力也不同。
|
||||
> 两者正交:同一个结构用三种形式拍出来完全不同,同一种形式套六个结构说服力也不同。
|
||||
|
||||
**加载规则:** 本文件每次都读。另外只读输入指定的那一份 `format-*.md` 和一份 `structure-*.md`,
|
||||
不要凭记忆套用没加载的套路。
|
||||
@@ -11,11 +11,11 @@
|
||||
|
||||
## 一、合法组合表
|
||||
|
||||
| | 痛点解决 | 前后对比 | 测评验证 | 场景种草 |
|
||||
| ---- | :----: | :----: | :----: | :----: |
|
||||
| **口播** | ✅ 强 | ✅ 可 | ✅ **最强** | ✅ 可 |
|
||||
| **短剧** | ✅ **最强** | ✅ 强 | ❌ **禁用** | ✅ 可 |
|
||||
| **Vlog** | ✅ 可 | ✅ 可 | ✅ 强 | ✅ **最强** |
|
||||
| | 痛点解决 | 前后对比 | 测评验证 | 场景种草 | 促销抢购 | 知识分享 |
|
||||
| ---- | :----: | :----: | :----: | :----: | :----: | :----: |
|
||||
| **口播** | ✅ 强 | ✅ 可 | ✅ **最强** | ✅ 可 | ✅ **强** | ✅ **强** |
|
||||
| **短剧** | ✅ **最强** | ✅ 强 | ❌ **禁用** | ✅ 可 | ✅ 可 | ✅ 可 |
|
||||
| **Vlog** | ✅ 可 | ✅ 可 | ✅ 强 | ✅ **最强** | ✅ 可 | ✅ 可 |
|
||||
|
||||
**唯一禁用组合:短剧 × 测评验证。**
|
||||
理由:测评的说服力来自「这是真实发生的」,短剧的本质是「这是演的」。
|
||||
@@ -48,7 +48,7 @@
|
||||
最弱的一格,因为口播是「对镜说话」,天然打断场景沉浸。
|
||||
- **必须弱化对镜**:人在场景里自然活动,偶尔看向镜头,不要全程盯着
|
||||
- 台词改成自言自语的语气,不要介绍腔
|
||||
- **每镜仍要说满 36–47 字**:写具体时刻、动作、使用感,不要一句商品名就收
|
||||
- **每镜仍要说满 66–74 字**:写具体时刻、动作、使用感,不要一句商品名就收
|
||||
- 商品名全片点名 1–2 次,其余镜用卖点原词和场景细节
|
||||
- 如果商品本身氛围属性强(香氛、饮品),优先考虑改用 Vlog
|
||||
|
||||
@@ -94,6 +94,18 @@
|
||||
- 商品在两到三个时间节点重复出现,靠**重复**建立记忆
|
||||
- 至少一个镜头让商品外形被看清,这是本组合唯一的硬要求
|
||||
|
||||
### 促销抢购(口播优先)
|
||||
优惠机制清晰时,口播最容易把“适合谁、怎么买、买哪个规格”说清。
|
||||
- 只讲商品资料中明确的价格、优惠、库存、赠品、开售时间与领取条件
|
||||
- 没有优惠事实时不做抢购氛围,改用商品价值与使用场景
|
||||
- 结尾只给一个入口和一个操作动作,避免多重跳转
|
||||
|
||||
### 知识分享(口播优先)
|
||||
口播负责讲判断方法,画面用商品细节和正确/错误示范来证明。
|
||||
- 先讲用户能复述的一个判断标准,再出现商品
|
||||
- 知识结论必须由商品资料支持;不能编数据、专业身份或功效
|
||||
- 30 秒起步,才有空间完成“误区 → 方法 → 演示 → 商品承接”
|
||||
|
||||
---
|
||||
|
||||
## 三、组合与时长的关系
|
||||
@@ -106,5 +118,7 @@
|
||||
| 前后对比 | 15 秒 | 前后对比至少要撑满一镜 |
|
||||
| 测评验证 | 30 秒 | 举证需要时间,1 镜证据不足 |
|
||||
| 场景种草 | 30 秒 | 氛围需要铺陈,太短像随机片段 |
|
||||
| 促销抢购 | 15 秒 | 优惠机制已清楚时,可压进适合谁 + 怎么买 + CTA |
|
||||
| 知识分享 | 30 秒 | 判断方法和实物演示都需要时间 |
|
||||
|
||||
低于该结构的最短时长时,优先保住「钩子 + 结构核心 + CTA」三件,其余全砍。
|
||||
|
||||
@@ -53,7 +53,7 @@
|
||||
|
||||
- **单镜固定 15 秒**(短剧用镜内动作和对白交换撑满这 15 秒,不要靠切很多短镜)
|
||||
- 一镜一次冲突或一次对话交换,**别在一镜里塞完整三幕**
|
||||
- 有对白的镜,每句 `line` ≤ 25 字(两个人说话,总量还是受 68 字限制)
|
||||
- 有对白的镜,每句 `line` ≤ 25 字(两个人说话,总量还是受 78 字限制)
|
||||
|
||||
**推荐总时长 45 秒(3 镜)。** 短剧需要装下三幕,低于 30 秒会讲不完整;
|
||||
超过 60 秒在电商场景下性价比开始下降。
|
||||
|
||||
@@ -52,7 +52,7 @@
|
||||
- **单镜固定 15 秒**(口播里说完一个完整意思需要时间;15 秒靠景别切换和手部动作撑满,不要切碎)
|
||||
- 一句话讲一件事,**一镜 2–4 句短句**,禁止一句收工
|
||||
- **visual 按秒拆 3–5 刀**,写成 `0-3s:近景……` / `3-8s:手持……` / `8-12s:特写……` / `12-15s:拉回……`
|
||||
- 语速按 **3.6–4.5 字 / 秒** 估:15 秒镜 **54–67 字**,写作目标 **55–63 字**
|
||||
- 语速按 **4.3–5.2 字 / 秒** 估:15 秒镜 **64–78 字**,写作目标 **66–74 字**
|
||||
|
||||
**推荐总时长 30 秒(2 镜)。** 口播超过 45 秒完播率掉得很快,除非是测评验证这种
|
||||
需要举证的结构。
|
||||
|
||||
+25
@@ -0,0 +1,25 @@
|
||||
# 视频结构 · 知识分享
|
||||
|
||||
> 适合需要用户教育、选购判断、使用指导或原理说明的数码家电、美妆个护、食品饮料、服饰材质、家居用品和工具类商品。
|
||||
|
||||
## 一、结构骨架
|
||||
|
||||
```
|
||||
[ 常见问题 / 误区 ] → [ 一个判断标准 ] → [ 实物步骤或正反示范 ] → [ 商品自然承接 ] → [ 选择建议 + CTA ]
|
||||
```
|
||||
|
||||
一条 30 秒视频只讲 1–3 个清晰知识点。商品不是突然插入的卖点,而是符合前述判断标准的具体实例。
|
||||
|
||||
## 二、写法
|
||||
|
||||
- 开头提出目标用户关心的问题、常见误区、实用技巧,或一个可验证的知识结论。
|
||||
- 用通俗语言解释原理;专业概念必须转换成用户能观察、能操作的判断方法。
|
||||
- 画面必须有实物细节、操作步骤、正确与错误示范或具体场景,不能全靠人物讲解。
|
||||
- 商品出现后,只说明它的材质、设计、功能或使用方式如何对应前面已经建立的判断标准。
|
||||
- 收尾总结适用条件或选择方法,再自然引导用户查看商品。
|
||||
|
||||
## 三、红线
|
||||
|
||||
- 不得编造数据、标准、专业身份或案例,也不得把一般知识偷换成商品功效承诺。
|
||||
- 健康、食品、美妆相关内容避免医疗、治疗及绝对化效果表述。
|
||||
- 当商品资料不足以支持某知识结论时,不要为了带货硬讲;改为可从商品实物观察到的使用或选购技巧。
|
||||
@@ -0,0 +1,24 @@
|
||||
# 视频结构 · 促销抢购
|
||||
|
||||
> 适合优惠机制清楚、库存可控、决策成本较低的商品,以及大促、新品拉新、福利款、组合装和阶段性促销。
|
||||
|
||||
## 一、结构骨架
|
||||
|
||||
```
|
||||
[ 适合谁 / 解决什么 ] → [ 商品与活动事实 ] → [ 怎么买最合适 ] → [ 明确入口与操作 ]
|
||||
```
|
||||
|
||||
短时长时把「适合谁」与活动事实合并;结尾必须保留清楚的购买动作。
|
||||
|
||||
## 二、写法
|
||||
|
||||
- 先说清适合谁、什么使用场景或组合需求,不能一开场只喊“抢”。
|
||||
- 价格、优惠、赠品、库存、开售时间、适用人群和领取条件,只能使用输入商品资料里明确给出的事实。
|
||||
- 商品露出优先包装正面、规格/组合细节和真实使用场景;画面不能用伪造倒计时、销量或库存数字。
|
||||
- CTA 说明一个购买入口和一个操作,例如“从商品卡选择这个规格”;没有活动信息时,只引导“查看商品详情”。
|
||||
|
||||
## 三、红线
|
||||
|
||||
- 不得虚构原价、最低价、优惠幅度、活动时间、库存数量、赠品价值或“仅剩”。
|
||||
- 不得把普通价格写成限时、限量,也不得用低价引流到不同规格。
|
||||
- 没有明确优惠事实时,改用商品价值与适用场景说服,不制造抢购氛围。
|
||||
@@ -81,7 +81,7 @@
|
||||
|
||||
- 语气是**自述或旁白**,轻、慢;留白靠**句间停顿和画面**,不靠少写字
|
||||
- **不讲参数、不讲价格、不讲功效** —— 这些会立刻把观众从场景里踢出来
|
||||
- **口播 × 场景种草禁止整镜无声**:每镜仍要说满 36–47 字(2–4 句自述),像在场景里自言自语
|
||||
- **口播 × 场景种草禁止整镜无声**:每镜仍要说满 66–74 字(4–5 句自述),像在场景里自言自语
|
||||
- **Vlog** 才可以个别镜无声,让环境音和画面说话
|
||||
- CTA 要软:「链接放下面了」而不是「快去抢」
|
||||
- 商品名全片点名 1–2 次,其余镜写时刻、动作、使用感、卖点原词
|
||||
|
||||
Reference in New Issue
Block a user