大量修改二期功能清单内容

This commit is contained in:
Azmat@qq.com
2026-08-17 18:26:42 +08:00
parent 36e91aab3c
commit d1ecb52125
76 changed files with 4222 additions and 294 deletions
@@ -4,7 +4,9 @@ description: >
电商带货短视频·脚本生成领域技能(模型无关)。
服务对象不是人类编剧,而是 AirShelf 产品后端的「脚本生成 agent」——在运行时按需加载本技能作为领域知识。
能力:把【商品信息 + 前置条件】或【一句话主题】或【用户已有脚本】,
自动收敛成一份结构化的带货短视频脚本 JSON(默认 9:16 竖屏可改 / 时长 15·30·60·90 秒四档 / 每 15 秒一镜)。
自动收敛成一份结构化的带货短视频脚本 JSON
(默认 9:16 竖屏可改 / 总时长 5–60 秒按 5 秒步进 / 单镜 4–15 秒可不等长 /
按「表现形式 × 视频结构」套路生成)。
当任务为「生成带货脚本 / 扩写主题 / 优化已有脚本 / 商品转视频脚本」时使用本技能。
核心目标是「电商小白点一下按钮就出能吸睛、能转化的脚本」,不是影视级艺术性。
---
@@ -29,9 +31,11 @@ description: >
{
"hook": "前3秒主打钩子(一句话)",
"tone": "种草|测评|剧情|痛点",
"presentation_format": "口播|短剧|Vlog",
"video_structure": "痛点解决|前后对比|测评验证|场景种草",
"aspect_ratio": "9:16",
"total_duration": 60,
"segment_count": 4,
"total_duration": 30,
"segment_count": 3,
"entities": [
{
"id": "c1",
@@ -53,11 +57,11 @@ description: >
"segments": [
{
"index": 0,
"duration": 15,
"duration": 12,
"role": "钩子|痛点|卖点|CTA",
"narration": "这一镜被说出来的台词/旁白,≤55字",
"narration": "这一镜被说出来的台词/旁白,字数上限=duration×3.5",
"speaker": "可选,指向某 entity 的 id;画外旁白时为 null",
"visual": "这一镜的画面:主体+动作+景别/运镜(特写/全景/手持跟拍/推拉摇)+一个画面或情绪的变化,够导演撑满15秒,约40-70字,别只写一句静态动作",
"visual": "这一镜的画面:主体+动作+景别/运镜(特写/全景/手持跟拍/推拉摇)+一个画面或情绪的变化,够导演撑满这一镜的秒数,约40-70字,别只写一句静态动作",
"product_exposure": "商品露出方式(手持/特写/使用中)",
"entity_refs": ["c1", "s1"],
"dialogue": []
@@ -68,20 +72,29 @@ description: >
字段纪律:
- `tone` 必须是四选一枚举;`role` 必须是四选一枚举。
- **表现形式与视频结构由输入给定**:`presentation_format``口播|短剧|Vlog`)和
`video_structure``痛点解决|前后对比|测评验证|场景种草`)**原样回填到输出里**,不要自己改。
输入没给时,按商品品类与人群自行选一组最合适的,并如实填进这两个字段。
- **画幅由输入给定**`aspect_ratio` 默认 `"9:16"`(电商竖屏主场景),但**不写死**——输入指定了其他比例(如 `"16:9"`、`"1:1"`、`"4:5"`)就照用,原样透传给下游。画幅只影响 `visual` 的构图措辞,不改变结构与镜数。
- **时长档位由输入给定**`total_duration` 只能取 `15 | 30 | 60 | 90` 之一(输入未指定时默认 `60`。**不要写死。**
- **每 15 秒切一镜**`segment_count = total_duration / 15`,即 15→1 镜、30→2 镜、60→4 镜、90→6 镜;每镜 `duration=15``index` 从 0 连续递增(粗暴切,不做复杂时长算法)。
- 各档位的 4 镜功能(role)如何分配/压缩/扩展,见 `references/methodology.md`「档位 × 黄金结构映射」
- **时长由输入给定**`total_duration` 取 **560 秒之间的 5 的倍数**5/10/15/…/60),输入未指定时默认 `30`。**不要写死。**
- **单镜时长 4–15 秒,允许不等长**:每个 `segments[].duration` 必须是 **4 到 15 之间的整数**
(15 秒是下游出片模型的硬上限,越界下游直接拒绝出片)
该长的镜给足、该短的镜压短,**不要机械均分**。
- **镜时长必须精确加总**`sum(segments[].duration) == total_duration`,一秒都不能差。
- **`segment_count` = `segments` 的实际长度**,且 `index` 从 0 连续递增。
- 镜数怎么定、role 怎么按镜数分配,见 `references/methodology.md`「时长 → 镜数 → 黄金结构映射」。
- `entities[].id` 全局唯一,`segments[].entity_refs` 与 `speaker` 只能引用已声明的 id。
- **发声方式每镜自己判断**(不强求统一,看这一镜的内容和场景):
- **旁白/口播** → 填 `narration``dialogue` 留空 `[]`(大多数电商镜是这种);
- **角色对话** → 填 `dialogue`:元素为 `{"speaker":"角色 entity 的 id,或 null=旁白","line":"台词"}`,每条 `line` ≤55 字;并把各 `line` 拼进 `narration` 兜底下游字幕/配音。剧情向、多角色互动、或一句自然的吐槽/接话更带感时都可以用,**不必非到「剧情」档**;
- **纯画面展示** → `narration` 与 `dialogue` 都留空(没人说话,只有画面)。
- **判断权交给你**:依据用户输入与这一镜的功能/场景决定。**不是每个 15 秒都得有对白,也不必死守旁白**;但**别无故给每镜都塞对白**(那样很假),自然才好。
- **判断权交给你**:依据用户输入与这一镜的功能/场景决定。**不是每一镜都得有对白,也不必死守旁白**;但**别无故给每镜都塞对白**(那样很假),自然才好。
- 发声方式还受**表现形式**约束:口播只用 `narration`、短剧必须用 `dialogue`、Vlog 以画外旁白为主。
以 `references/playbooks/format-*.md` 里那一份为准。
- **每个声明的 entity 至少被一个 segment 引用**(不留孤儿 entity)。
- **场景必抽,且每镜必绑一个场景**:每条脚本**至少声明 1 个 `type:"scene"` 实体**表示画面所在环境;**每个 segment 的 `entity_refs` 必须恰好引用一个 scene**。多镜在同一环境就**复用同一个 scene id**(绝不为同一环境写两份 visual_prompt,否则下游背景漂移);只有真正换了环境才新建另一个 scene。纯产品特写镜也要绑它所处环境的 scene(如「宿舍书桌」「厨房台面」),没有合适环境时复用主场景。
- `visual_prompt` 由你自动生成,小白无需打字。
- **每镜 `visual` 要够厚撑满 15 秒**:一段话写清 ①主体+动作 ②景别/运镜(特写/全景/手持跟拍/推拉摇,至少给一个镜头语言)③一个画面或情绪的变化(从…到…)。约 **40–70 字**,**禁止只写一句静态动作**(如「女主举起商品展示」撑不住 15 秒,要补镜头与变化)。注意:这是给生图/视频导演的画面,**不占 narration 的 55 字额度**。
- **每镜 `visual` 要够厚撑满这一镜的秒数**:一段话写清 ①主体+动作 ②景别/运镜(特写/全景/手持跟拍/推拉摇,至少给一个镜头语言)③一个画面或情绪的变化(从…到…)。约 **40–70 字**,**禁止只写一句静态动作**(如「女主举起商品展示」撑不住十几秒,要补镜头与变化)。4–6 秒的短镜可以只给一个动作 + 一个镜头语言,但仍要写清景别。注意:这是给生图/视频导演的画面,**不占 narration 的字额度**。
- 不要输出 schema 之外的字段,也不要省略必填字段。
### 铁律 2 · 输出前自检
@@ -93,7 +106,8 @@ description: >
详见 `references/methodology.md`「旁白红线」。最关键的几条:
- **口语化**,像真人对着镜头说话,不准书面腔 / AI 腔。
- **每镜 narration ≤ 55 字**Seedance 15 秒内直接发声,字数 = 可懂语速上限)。
- **每镜 narration ≤ `duration × 3.5` 字,且绝不超过 55 字**(出片模型在镜内直接发声,
3.5 字/秒是可懂语速上限)。短镜装不下就拆到下一镜,或干脆留空走纯画面。
- **禁违规词**:医疗功效(治疗/根治/抗癌…)、绝对化用语(最/第一/100%/国家级…)一律不写。
- 不浮夸、不空喊,卖点要落到「商品怎么解决痛点」。
@@ -110,10 +124,12 @@ description: >
| 参数 | 值 |
| ---- | ---- |
| 画幅 | **默认 9:16 竖屏**,由输入可覆盖(16:9 / 1:1 / 4:5 等照用) |
| 总时长 | **15 / 30 / 60 / 90 秒四档**,由输入给定;未指定时默认 60 |
| 分镜 | 每 15 秒一镜,均分(粗暴切,不做复杂算法)→ 1 / 2 / 4 / 6 镜 |
| 镜头功能 | 钩子 → 痛点 → 卖点 → CTA(黄金结构;不同档位按映射表压缩/扩展,见方法论) |
| 发声方式 | Seedance 直接生成画面+音效+人声(**不走 TTS** |
| 总时长 | **560 秒,5 秒步进**,由输入给定;未指定时默认 30 |
| 表现形式 | **口播 / 短剧 / Vlog**,由输入给定;未指定时按品类人群自选 |
| 视频结构 | **痛点解决 / 前后对比 / 测评验证 / 场景种草**,由输入给定;未指定时按品类人群自选 |
| 分镜 | **单镜 4–15 秒,可不等长**;镜数按表现形式的推荐节奏定(见方法论 |
| 镜头功能 | 钩子 → 痛点 → 卖点 → CTA(黄金结构;具体骨架以视频结构套路为准) |
| 发声方式 | 出片模型直接生成画面+音效+人声(**不走 TTS**) |
---
@@ -123,23 +139,38 @@ description: >
| 模式 | 触发条件 | 处理逻辑 | 需读取 |
| ---- | ---- | ---- | ---- |
| **① 全自动** | 用户只给【商品信息 + 前置条件(调性/平台/时长/卖点勾选)】,无主题无原稿 | 凭商品与前置条件,自动定、选 tone、造 entity、按映射填镜 | `methodology.md` + `hook-library.md` + `category-playbook.md` + `platform-tone.md` |
| **① 全自动** | 用户只给【商品信息 + 前置条件(表现形式/视频结构/时长/人群/卖点勾选)】,无主题无原稿 | 凭商品与前置条件,自动定镜数、选 tone、造 entity、按套路填镜 | `methodology.md` + `hook-library.md` + `category-playbook.md` + `platform-tone.md` |
| **② 一句话** | 用户额外给了一句主题(如「主打熬夜党救星」) | 以该主题为脚本主轴扩写,其余同全自动 | 同上(主题优先于自动选题) |
| **③ 改稿** | 用户给了已有脚本/文案 | **保留用户原意**,增强钩子/节奏/卖点/CTA,并归一化到 JSON 结构 | `methodology.md` + `hook-library.md` + `checklist.md` |
| **③ 改稿 / 上传脚本** | 用户给了已有脚本/文案 | **保留用户原意**,先识别原稿结构与叙述顺序,再增强钩子/节奏/卖点证明/CTA,并归一化到 JSON 结构 | `methodology.md` + `hook-library.md` + `checklist.md` |
| 信息不足 | 连商品信息都缺,无法生成 | 唯一允许的回退:用一句话问清最少必要信息 | — |
**进入任何模式前,必须先读取该行列出的参考资料。**
### 套路资料(三种模式都适用)
除上表外,**每次生成都必须读** `references/playbooks/combo-matrix.md`
并根据输入指定的表现形式与视频结构,**各读一份**:
- `references/playbooks/format-{口播→oral | 短剧→drama | Vlog→vlog}.md`
- `references/playbooks/structure-{痛点解决→pain | 前后对比→contrast | 测评验证→review | 场景种草→scene}.md`
> 运行时后端只会把被指定的那两份套路拼进上下文。**看到哪份就用哪份,
> 不要凭记忆套用没加载进来的套路。**
> 套路里的结构骨架、镜头语言、发声方式、红线,**优先级高于本文件的通用默认值**。
---
## 生成流程(内部执行,一次走完,不暂停)
1. **路由** — 判定输入模式(①/②/③),加载对应 references。
2. **定** — 从输入读取画幅(`aspect_ratio` 默认 9:16)与时长档位(15/30/60/90,未指定默认 60,算出 `segment_count = total_duration / 15`。
3. **定调(tone)** — 依据品类话术 + 平台调性 + 前置条件,选定 `tone`;②③ 模式尊重用户已表达的倾向
1. **路由** — 判定输入模式(①/②/③),加载对应 references;再按输入的表现形式与视频结构加载那两份套路
2. **定** — 画幅(`aspect_ratio` 默认 9:16)与时长560 秒,未指定默认 30
按表现形式的推荐单镜节奏定出镜数,再给每镜分配 4–15 秒的时长,**确保加总等于总时长**
3. **定调(tone)** — 依据视频结构 + 品类话术 + 平台调性,选定 `tone`;②③ 模式尊重用户已表达的倾向。
4. **抽取/创建 entities** — 识别脚本需要的角色 / 场景 / 商品;为每个 entity 写一份**全脚本共用**的 `visual_prompt`(保证多镜同一角色同一张脸);可选写 `voice_ref` 锁音色。
5. **按档位填黄金结构** — 依「档位 × 黄金结构映射表」给每个 segment 分配 `role`钩子镜套用 `hook-library.md` 的公式。
6. **写 narration / visual / 商品露出** — 每镜旁白 ≤55 字、口语化、过红线;每镜规划自然的 `product_exposure`
5. **按套路填结构** — 优先用视频结构套路里的骨架给每个 segment 分配 `role`
套路没覆盖到的用「role 按镜数分配」表兜底;钩子镜套用该套路指定的钩子写法
6. **写 narration / visual / 商品露出** — 每镜旁白 ≤ `duration × 3.5` 字、口语化、过红线;
发声方式按表现形式套路来;每镜规划自然的 `product_exposure`。
7. **连引用** — 填 `entity_refs` 与 `speaker`,确认每个 entity 都被引用、id 都合法。
8. **自检** — 跑 `checklist.md`,过了再输出。
9. **输出** — 仅输出铁律 1 的 JSON。
@@ -150,7 +181,10 @@ description: >
| 文件 | 内容 | 何时读取 |
| ---- | ---- | ---- |
| `references/methodology.md` | 黄金结构模板(钩子→痛点→卖点→CTA)、档位 × 结构映射表、entity 一致性原则、商品露出规范、旁白红线(含违规词清单) | **每次生成都读** |
| `references/playbooks/combo-matrix.md` | 表现形式 × 视频结构 合法组合表、各组合交叉点要点、结构最短可用时长 | **每次生成都读** |
| `references/playbooks/format-*.md` | 单份表现形式套路:人物设置、镜头语言、单镜节奏、发声方式、专属红线 | **读被指定的那一份** |
| `references/playbooks/structure-*.md` | 单份视频结构套路:结构骨架、每段功能与判断标准、钩子写法、专属红线 | **读被指定的那一份** |
| `references/methodology.md` | 黄金结构模板(钩子→痛点→卖点→CTA)、时长 → 镜数映射、entity 一致性原则、商品露出规范、旁白红线(含违规词清单) | **每次生成都读** |
| `references/hook-library.md` | 前 3 秒钩子公式库(痛点提问 / 反差 / 数字冲击 / 身份代入 …,含例句) | 每次生成都读(写钩子镜时) |
| `references/category-playbook.md` | 分品类话术(美妆 / 食品 / 3C / 服饰 / 家居…的语气与卖点侧重) | 全自动 / 一句话模式 |
| `references/platform-tone.md` | 平台调性(抖音 / 快手 / 小红书 / 视频号 的节奏与风格差异) | 全自动 / 一句话模式 |
@@ -10,9 +10,14 @@
- [ ] 最终只输出**一个** JSON 对象,无 schema 外的多余文字/注释。
- [ ] `tone``{种草, 测评, 剧情, 痛点}`
- [ ] `aspect_ratio` 存在;输入指定了就用输入值,未指定为 `"9:16"`
- [ ] `total_duration``{15, 30, 60, 90}`
- [ ] `segment_count == total_duration / 15`,且 `segments` 数组长度等于它
- [ ] 每个 `segment.duration == 15``index` 从 0 连续递增无跳号
- [ ] `presentation_format``{口播, 短剧, Vlog}`,且与输入一致(输入没给则自选并如实填写)
- [ ] `video_structure``{痛点解决, 前后对比, 测评验证, 场景种草}`,同上
- [ ] **组合合法**:不是「短剧 × 测评验证」(唯一禁用组合,见 `playbooks/combo-matrix.md`
- [ ] `total_duration`**560 之间 5 的倍数**
- [ ] **每个 `segment.duration` 是 415 之间的整数**(15 是下游出片硬上限,越界直接出不了片)。
- [ ] **`sum(segments[].duration) == total_duration`**,逐个加一遍,差一秒都不行。
- [ ] `segment_count == len(segments)``index` 从 0 连续递增无跳号。
- [ ] 镜数落在 `ceil(total_duration/15)``floor(total_duration/4)` 区间内。
- [ ] 每个 `segment.role``{钩子, 痛点, 卖点, CTA}`
- [ ] 首镜 `role == 钩子`;末镜收 CTA(独立 CTA 镜,或末镜旁白末尾含明确行动指令)。
- [ ] `entities` 每项 `type``{character, scene, product}``id` 全局唯一。
@@ -20,7 +25,7 @@
- [ ] **每个声明的 entity 至少被一个 segment 引用**(无孤儿 entity)。
- [ ] **至少声明 1 个 `type==scene` 实体;每个 segment 的 `entity_refs` 恰好引用一个 scene**(同环境复用同一 scene id,换环境才新建;产品特写镜也要绑所处环境的 scene)。
- [ ] `speaker` 要么为 `null`,要么指向一个 `type==character` 的 id。
- [ ] 必填字段无缺失:顶层 `hook/tone/aspect_ratio/total_duration/segment_count/entities/segments`
- [ ] 必填字段无缺失:顶层 `hook/tone/presentation_format/video_structure/aspect_ratio/total_duration/segment_count/entities/segments`
每 entity 有 `id/type/name/visual_prompt/ref_index`
每 segment 有 `index/duration/role/narration/visual/product_exposure/entity_refs`
@@ -29,17 +34,22 @@
- [ ] 钩子镜第一句在前 3 秒抛出钩子,套用了 `hook-library.md` 的某个公式。
- [ ] 顶层 `hook` 与钩子镜口径一致。
- [ ] 卖点镜的卖点**挂在前面铺的痛点上**,不是干罗列参数。
- [ ] CTA 给了明确动作(点小黄车/领券/主页链接)。
- [ ] 档位映射正确:role 序列符合 `methodology.md`「档位 × 黄金结构映射」表。
- [ ] 90s 的多个卖点镜**各有侧重不重复**
- [ ] CTA 给了明确动作(点小黄车/领券/主页链接)。**场景种草结构的 CTA 要软**,别硬喊。
- [ ] **结构骨架走完了**:段的顺序与功能符合 `playbooks/structure-*.md` 里那份骨架表。
- [ ] **表现形式的镜头语言到位**:景别变化、单镜时长、人物数量符合 `playbooks/format-*.md`
- [ ] role 序列符合结构套路;套路没覆盖的部分回落到 `methodology.md`「role 按镜数分配」表。
- [ ] 多个卖点镜**各有侧重不重复**。
- [ ] **逐条过了这两份套路各自的「专属红线」**,一条都没踩。
- [ ] 同一角色/场景/商品全程复用同一 entity(没有给同一对象写出两份 visual_prompt)。
- [ ] 每个 `visual_prompt` 信息足够喂图模型(角色/场景/商品的外观特征写清)。
- [ ] 每镜 `product_exposure` 自然、与 role 匹配(参考方法论露出表)。
## C. 旁白红线扫描(逐镜)
- [ ] 每镜 `narration`55 字(硬上限;目标 ≤50 留缓冲,逐字数一遍,别凭感觉
- [ ] 每镜 `visual` ≥ 40 字且含「景别/运镜 + 一个画面变化」,不是一句静态动作(撑满 15 秒)。
- [ ] **每镜 `narration` ≤ `duration × 3.5` 字,且绝不超过 55 字**(逐镜按自己的秒数数一遍,别凭感觉。
4 秒镜 ≤14 字、8 秒镜 ≤28 字、15 秒镜 ≤52 字,对照表见 `methodology.md`)。
- [ ] 每镜 `visual` 含「景别/运镜 + 一个画面变化」,不是一句静态动作;能撑满这一镜的秒数
(≥8 秒的镜约 40–70 字;4–6 秒的短镜可以更短,但景别必须写清)。
- [ ] 口语化,无书面腔/AI 腔("综上""不仅…而且""值得一提"等已清除)。
- [ ] **违规词扫描**:无医疗功效词(治疗/根治/抗癌/消炎/排毒/速效…)。
- [ ] **绝对化用语扫描**:无 最/第一/唯一/100%/国家级/永久/绝对/史上 等。
@@ -22,22 +22,50 @@
---
## 二、档位 × 黄金结构映射(关键)
## 二、时长 → 镜数 → 黄金结构映射(关键)
时长由输入给定(15/30/60/90 四档),每 15 秒一镜,`segment_count = total_duration / 15`
镜数变了,四个功能要**压缩或扩展**,按下表分配 `role`
### 2.1 时长规则(不再是固定四档,也不再每镜等长)
| 档位 | 镜数 | role 序列(index 0→N | 压缩/扩展说明 |
| ---- | ---- | ---- | ---- |
| **15s** | 1 | `[钩子]` | 一镜到底:开头 3 秒钩子 → 中段一句卖点 → 末尾一句 CTA,全压进这 15 秒旁白里 |
| **30s** | 2 | `[钩子, 卖点]` | 镜0 钩子里带出痛点;镜1 讲卖点并在旁白末尾收一句 CTA |
| **60s** | 4 | `[钩子, 痛点, 卖点, CTA]` | 标准黄金结构,一镜一功能 |
| **90s** | 6 | `[钩子, 痛点, 卖点, 卖点, 卖点, CTA]` | 痛点后给 3 个卖点镜:核心卖点 / 场景化演示 / 信任背书(口碑·数据);末镜 CTA |
- **总时长**由输入给定:**5–60 秒之间、5 秒一档**(5/10/15/…/60)。未指定时默认 30。
- **单镜时长 4–15 秒**,这是下游出片模型的硬上限,**任何一镜都不许超过 15 秒、不许低于 4 秒**。
- **每镜时长可以不一样。** 该长的镜(讲卖点、举证)就给足,该短的镜(空镜、转场、一句钩子)就压短。
别再机械均分。
- 所有 `segments[].duration` 相加**必须精确等于** `total_duration`
### 2.2 镜数怎么定
镜数不是算出来的,是**按表现形式的节奏定**的。先取该形式的推荐单镜时长,再用总时长去除:
| 表现形式 | 推荐单镜时长 | 理由 |
| ---- | ---- | ---- |
| **口播** | 10–15 秒 | 说完一个完整意思需要时间,切太碎话会断 |
| **短剧** | 6–10 秒 | 靠切换制造节奏,镜头长了拖沓 |
| **Vlog** | 5–8 秒 | 碎片拼贴感,镜头短、数量多 |
`segment_count ≈ total_duration / 推荐单镜时长`,向最接近的整数取整,
然后**必须**落在 `ceil(total_duration/15)``floor(total_duration/4)` 这个区间内。
例:口播 30 秒 → 30/12 ≈ 2.5 → 3 镜(如 12+10+8)。
  短剧 45 秒 → 45/8 ≈ 5.6 → 6 镜(如 8+7+9+7+8+6)。
  Vlog 30 秒 → 30/6.5 ≈ 4.6 → 5 镜(如 6+6+7+6+5)。
### 2.3 role 按镜数分配
| 镜数 | role 序列(index 0→N | 说明 |
| ---- | ---- | ---- |
| **1** | `[钩子]` | 一镜到底:钩子 → 一句卖点 → 一句 CTA,全压进这一镜的旁白 |
| **2** | `[钩子, 卖点]` | 镜0 钩子里带出痛点;镜1 讲卖点并在末尾收 CTA |
| **3** | `[钩子, 卖点, CTA]` | 痛点并进钩子镜 |
| **4** | `[钩子, 痛点, 卖点, CTA]` | 标准黄金结构,一镜一功能 |
| **5** | `[钩子, 痛点, 卖点, 卖点, CTA]` | 两个卖点镜要各有侧重 |
| **N ≥ 4** | `[钩子, 痛点, 卖点 × (N-3), CTA]` | 通用规则:首钩子、次痛点、末 CTA,中间全是卖点 |
说明:
- `role` 字段只能取 `钩子|痛点|卖点|CTA` 四个枚举值。"信任背书""场景演示"等都归入 `卖点`
- 短档位(15/30s)靠**旁白内压缩多功能**达成"留人+转化",不要因为镜少就丢掉 CTA
- 90s 的 3 个卖点镜要**各有侧重、不重复**(核心功效 / 真实使用场景 / 别人为什么买)。
- `role` 只能取 `钩子|痛点|卖点|CTA` 四个枚举值。"信任背书""场景演示""前后对比"等都归入 `卖点`
- **镜少也不许丢 CTA** —— 镜数 ≤2 时把 CTA 压进末镜旁白的最后一句
- 个卖点镜要**各有侧重、不重复**(核心功效 / 真实使用场景 / 别人为什么买 / 举证读数)。
- 视频结构会覆盖这里的默认分配 —— 以 `playbooks/structure-*.md` 里的骨架为准,
本表只是没有指定结构时的兜底。
---
@@ -74,8 +102,22 @@
## 五、旁白红线(硬规则,违反即不合格)
- **口语化**:像真人对着镜头唠嗑,不准书面腔 / 不准 AI 腔("综上所述""不仅…而且""值得一提的是"全禁)。
- **每镜 `narration` ≤ 55 字**Seedance 在 15 秒内直接发声,55 字是可懂语速**硬上限**
**写作目标 ≤ 50 字**,留 5 字缓冲——宁可短、不要卡满;短档位(15/30s)一镜要装多功能时尤其要狠删,先保 CTA 不被砍
- **`narration` 字数按这一镜的秒数算**:出片模型在镜内直接发声,可懂语速上限约 **3.5 字 / 秒**
**每镜 `narration` ≤ `duration × 3.5` 字,且任何情况下不超过 55 字。**
对照表(写作目标再留 10% 缓冲,宁可短不要卡满):
| 单镜时长 | 字数上限 | 写作目标 |
| ---- | ---- | ---- |
| 4 秒 | 14 字 | ≤ 12 字 |
| 5 秒 | 17 字 | ≤ 15 字 |
| 6 秒 | 21 字 | ≤ 19 字 |
| 8 秒 | 28 字 | ≤ 25 字 |
| 10 秒 | 35 字 | ≤ 31 字 |
| 12 秒 | 42 字 | ≤ 38 字 |
| 15 秒 | 52 字 | ≤ 47 字 |
**短镜不要硬塞长句** —— 装不下就把这句拆到下一镜,或者干脆让这镜没有旁白(纯画面)。
总时长很短、一镜要装多功能时尤其要狠删,先保 CTA 不被砍。
- **不浮夸、不空喊**:卖点要给具体理由,不堆形容词。
- **违规词禁令**(电商广告法红线,一律不写):
- **医疗功效类**:治疗 / 根治 / 疗效 / 抗癌 / 消炎 / 杀菌(无证) / 排毒 / 速效 / 抑制 ××病 …
@@ -0,0 +1,108 @@
# 表现形式 × 视频结构 · 组合矩阵
> 表现形式决定**怎么拍**(谁在画面里、镜头怎么动、谁在说话)。
> 视频结构决定**怎么说服**(信息按什么顺序给、靠什么建立可信)。
> 两者正交:同一个结构用三种形式拍出来完全不同,同一种形式套四个结构说服力也不同。
**加载规则:** 本文件每次都读。另外只读输入指定的那一份 `format-*.md` 和一份 `structure-*.md`
不要凭记忆套用没加载的套路。
---
## 一、合法组合表
| | 痛点解决 | 前后对比 | 测评验证 | 场景种草 |
| ---- | :----: | :----: | :----: | :----: |
| **口播** | ✅ 强 | ✅ 可 | ✅ **最强** | ✅ 可 |
| **短剧** | ✅ **最强** | ✅ 强 | ❌ **禁用** | ✅ 可 |
| **Vlog** | ✅ 可 | ✅ 可 | ✅ 强 | ✅ **最强** |
**唯一禁用组合:短剧 × 测评验证。**
理由:测评的说服力来自「这是真实发生的」,短剧的本质是「这是演的」。
两者直接冲突 —— 演出来的实测读数没有任何可信度,反而会让观众怀疑品牌。
输入若指定了这个组合,按「短剧 × 痛点解决」处理,并在 `hook` 里保持剧情感。
---
## 二、各组合要点(只看你被指定的那一格)
### 口播 × 痛点解决
最直给的一条。人在画面里直接把痛点说出来,靠**共犯身份**建立信任。
- 钩子用「我们这种___的人都懂」,第一句就把观众归类进来
- 讲卖点那镜必须切商品特写,手要入画
- 全片一个人一个场景,靠景别变化撑节奏
### 口播 × 前后对比
口播里唯一画面重于台词的组合。人要**退到画外**让位给对比画面。
- 「之前 / 之后」两镜人不出镜或只出手,避免抢戏
- 人只在开头(交代条件)和结尾(收 CTA)出镜
- 台词负责讲清「同机位、同光线、几天」,画面负责证明
### 口播 × 测评验证 ★ 最强组合
带货转化率最高的组合,尤其适合中高客单价。
- 人的**身份权威性**要在前 3 秒立住(从业年限 / 专业背景 / 测过多少款)
- 读数特写时人可以出画外,但声音要连着不断
- 必须说一个缺点,且要从「专业判断」的角度说,不是随口一句
### 口播 × 场景种草
最弱的一格,因为口播是「对镜说话」,天然打断场景沉浸。
- **必须弱化对镜**:人在场景里自然活动,偶尔看向镜头,不要全程盯着
- 台词改成自言自语的语气,不要介绍腔
- 如果商品本身氛围属性强(香氛、饮品),优先考虑改用 Vlog
### 短剧 × 痛点解决 ★ 最强组合
完播率和转化率兼顾的组合,短剧的天然主场。
- 第一幕直接**演**痛点,不用台词解释(这比口播讲痛点强十倍)
- 副角在转折点带出商品,主角不要自夸
- 第三幕的「结果」就是痛点解决后的同一场景,形成闭环
### 短剧 × 前后对比
把对比拆进剧情里,用**两幕**承载前后。
- 前后两幕必须同场景同机位,只有主角状态变了
- 中间用一个短镜交代使用过程,否则反转不可信
- 台词极简,让画面对比自己说话
### 短剧 × 场景种草
剧情化的生活切片,广告感最低。
- 冲突要**很轻**(不是麻烦,是一个小小的期待)
- 商品是场景里的一个自然道具,不承担解决问题的功能
- 结尾不要强反转,停在氛围里就好
### Vlog × 痛点解决
用生活流水记录痛点,比口播柔和,比短剧真实。
- 痛点出现在时间线上的某个节点(「下午三点,又开始了」)
- 商品在下一个节点自然出现,不做介绍
- CTA 要软,硬推会破坏 Vlog 的可信度
### Vlog × 前后对比
用**时间跨度**做对比,Vlog 天然适合记录「第 1 天 / 第 7 天」。
- 每个时间点用同机位拍一次,形成序列
- 画面上标时间(Day 1 / Day 7),这是 Vlog 里唯一允许的字幕硬信息
- 中间的日常镜头就是「过程可见」,可信度天然高
### Vlog × 测评验证
生活化实测,比正经测评亲和,但证据强度要守住。
- 测的过程放进真实生活场景(在自家厨房测,不在摄影棚)
- 读数依然要给特写、要看得清,这条不能因为是 Vlog 就放松
- 结论用自述语气给(「反正我是回购了,但它确实有点贵」)
### Vlog × 场景种草 ★ 最强组合
氛围感最强的组合,适合食品饮料、家居、香氛、户外。
- 全片可以没有一句参数,纯靠光、声音、细节
- 商品在两到三个时间节点重复出现,靠**重复**建立记忆
- 至少一个镜头让商品外形被看清,这是本组合唯一的硬要求
---
## 三、组合与时长的关系
表现形式给出推荐时长,视频结构决定能压到多短:
| 结构 | 最短可用 | 原因 |
| ---- | ---- | ---- |
| 痛点解决 | 15 秒 | 痛点一句、卖点一句、CTA 一句,勉强够 |
| 前后对比 | 10 秒 | 前后两镜就能成立,最抗压缩 |
| 测评验证 | 20 秒 | 举证需要时间,低于 20 秒证据不足 |
| 场景种草 | 20 秒 | 氛围需要铺陈,太短像随机片段 |
低于该结构的最短时长时,优先保住「钩子 + 结构核心 + CTA」三件,其余全砍。
@@ -0,0 +1,81 @@
# 表现形式 · 短剧
> 有角色、有冲突、有转折的微型情节剧。观众先被故事勾住,商品在转折点出场。
> 完播率最高的形式,但**商品露出最容易被故事盖掉**——这是短剧唯一的死穴。
---
## 一、本质
短剧卖的是**代入感**:观众在主角身上看到自己,于是相信主角的选择。
所以短剧的商品不能靠「介绍」,只能靠「解决」——它必须是剧情里那个**转折的原因**。
**判断标准:** 把商品从剧情里拿掉,如果故事依然能讲通,那这条短剧就白拍了。
商品必须是不可替换的转折点。
---
## 二、人物设置
- **两到三个角色,不能更多。** 短视频装不下第四个人,观众记不住。
- 标准配置是**一主一副**
- **主角** = 有困扰的人(观众的镜子)—— 戏份最重,情绪弧线在他身上
- **副角** = 推动者(闺蜜 / 同事 / 家人 / 店员)—— 负责把商品带进来
- 让**副角**说出商品,别让主角自卖自夸。第三方推荐的可信度远高于自述。
- 每个角色在 `entities` 里独立声明,`visual_prompt` 写清外形与穿着,全片锁脸。
---
## 三、三幕结构(必须走完)
短剧再短也要有完整的起承转合,否则就是没头没尾的片段。
| 幕 | 占比 | 内容 | 必须做到 |
| ---- | ---- | ---- | ---- |
| **第一幕 · 困境** | 前 30% | 主角遇到具体的麻烦,情绪是负面的 | 麻烦要**具体可见**,不能是抽象的「我很累」 |
| **第二幕 · 转折** | 中间 40% | 副角带出商品,主角将信将疑到尝试 | **商品在这里第一次出现**,且要被手拿着看清 |
| **第三幕 · 结果** | 后 30% | 主角状态反转,情绪变正面 | 反转要**看得见**,画面上的变化比台词重要 |
**转折点必须在整片的 1/3 处。** 商品出现太晚(超过一半时长)观众已经划走了。
---
## 四、镜头语言
- **对话镜用中景**(能看到两个人的关系和肢体)
- **情绪镜用近景**(主角的表情就是共鸣点)
- **商品出场必须给一个特写**,哪怕只有 2 秒
- 场景可以有两个(如「工位」→「家里」),但不要超过两个,换太多观众会晕
---
## 五、节奏与单镜时长
- **单镜 6–10 秒**(短剧靠切换制造节奏,镜头长了就拖)
- 一镜一个动作或一次对话交换,**别在一镜里塞完整对话**
- 有对白的镜,每句 `line` ≤ 25 字(两个人说话,总量还是受 55 字限制)
**推荐总时长 45 秒。** 短剧需要装下三幕,低于 30 秒会讲不完整;
超过 60 秒在电商场景下性价比开始下降。
---
## 六、发声方式
短剧是**唯一必须用 `dialogue` 的形式**。
- `dialogue` 填角色对白:`[{"speaker":"c1","line":"..."},{"speaker":"c2","line":"..."}]`
- `narration` 把各句 `line` 拼起来兜底(下游字幕和配音要用)
- 允许个别镜是纯画面(`narration``dialogue` 都空),用来给情绪留白
- **别每一镜都塞满对白** —— 有沉默的镜,情绪才有落点
---
## 七、短剧专属红线
-**商品在最后才出现** —— 转折点在 1/3 处,不是结尾
-**角色超过三个** —— 观众记不住
-**主角自己夸商品** —— 让副角说,或让结果说
-**冲突是抽象的** —— 「最近好烦」不算冲突,「客户又打回来第五版」才算
-**结局只靠台词交代** —— 反转必须在画面上看得见
-**把测评做成短剧** —— 演出来的测评没有可信度,这个组合是禁用的
@@ -0,0 +1,75 @@
# 表现形式 · 口播
> 一个人对着镜头说话。观众看的是「这个人可信不可信」,不是「这个故事好不好看」。
> 电商带货里最稳、转化最直接的形式。信息密度最高,制作最省。
---
## 一、本质
口播的全部说服力压在**说话的人**身上。画面只是背书,台词才是主体。
所以口播脚本的重心是:**每一句话都要有信息**,不能有一句是废话铺垫。
**判断标准:** 把画面全遮住只听声音,如果这条视频依然成立,那口播就写对了。
---
## 二、人物设置
- **只要一个人。** 口播不需要第二个角色。真的需要对话就别选口播,选短剧。
- 这个人必须有一个**明确身份**,且身份要跟商品可信度挂钩:
- 用过的人(真实用户)→ 讲体验
- 懂行的人(成分党 / 从业者 / 测评师)→ 讲原理
- 同类人(同龄 / 同职业 / 同困扰)→ 讲共鸣
- 身份在**第一镜前 3 秒内交代完**,用一句话,别铺垫。
- ✅「我做了六年护肤研发,这瓶我拆开跟你讲。」
- ❌「大家好,欢迎来到我的频道,今天想跟大家聊一个话题。」
`entities` 里这个人是唯一的 `type:"character"`,全片复用同一 `visual_prompt`
---
## 三、镜头语言
口播的画面变化不靠剧情,靠**景别切换**和**手部动作**。同一个人同一个场景,
连续 30 秒不换机位会让人划走。
| 镜头功能 | 景别 | 用法 |
| ---- | ---- | ---- |
| 开场钩子 | 近景(胸上) | 眼睛对镜头,情绪最强的一句话 |
| 讲痛点 | 中近景 | 可以有手势,身体略前倾 |
| 讲卖点 | 特写 / 手持商品 | **必须切到商品**,手入画,让观众看清 |
| 演示 | 商品特写(人出画外) | 只拍手和商品,人声继续 |
| 收 CTA | 近景回到人 | 眼睛回到镜头,语速放慢 |
**铁律:讲卖点的那一镜,商品必须实体出现在画面里被手拿着。** 光靠嘴说卖点、
画面还是大头,是口播最常见的失败。
---
## 四、节奏与单镜时长
- **单镜 10–15 秒**(口播里说完一个完整意思需要时间,切太碎会让话说不完整)
- 一句话讲一件事,**一镜讲一到两句话**
- 语速按 **3.5 字 / 秒** 估:12 秒的镜 ≈ 42 字,别超
**推荐总时长 30 秒。** 口播超过 45 秒完播率掉得很快,除非是测评验证这种
需要举证的结构。
---
## 五、发声方式
- `narration` 全填,`dialogue` **永远留空 `[]`**(只有一个人,没有对话)
- `speaker` 指向那个 character 的 id(不是画外音,是这个人在说)
- 口播不用画外旁白 —— 人就在画面里,再加一层旁白会精神分裂
---
## 六、口播专属红线
-**开场自我介绍 + 寒暄** —— 前 3 秒必须是钩子,不是「大家好」
-**一个机位怼到底** —— 至少 3 次景别变化
-**念稿腔** —— 短句、口语、允许有语气词(「说真的」「你听我讲完」)
-**多个人轮流说** —— 那是短剧或访谈,不是口播
-**台词写成书面语** —— 「其具备优异的保湿性能」→「它是真的锁水,我这脸一天不干」
@@ -0,0 +1,85 @@
# 表现形式 · Vlog
> 第一人称的生活记录。镜头是「我的眼睛」,观众跟着我过一段生活,商品自然地出现在里面。
> 广告感最低的形式,适合高频消费品和生活方式类商品。
---
## 一、本质
Vlog 卖的是**生活方式**,不是商品参数。观众想要的是「我也想过这样的日子」,
商品是这种生活的一部分,顺手被带走。
**判断标准:** 如果观众看完记住的是「这个人的生活真好」而不是「这个商品参数真好」,
但依然想买,那 Vlog 就写对了。**Vlog 不许硬推。**
---
## 二、人物设置
- **一个第一人称主角**,通常出镜但不总是对着镜头说话
- 主角可以是**半出镜**的:只有手、只有背影、只有侧脸 —— 这反而更有代入感
- 可以有配角,但配角是**生活的一部分**(室友、同事、宠物),不承担推销功能
- 主角身份靠**生活细节**建立,不靠自我介绍:
- ✅ 画面里是加班到十点的工位、外卖盒、屏幕上的表格
- ❌ 台词说「我是一个每天加班的上班族」
---
## 三、时间线结构
Vlog 靠**时间推进**组织,不靠论证推进。这是它跟口播、短剧最大的区别。
常用时间骨架(选一条,别混):
| 骨架 | 适合品类 | 节点示例 |
| ---- | ---- | ---- |
| **一天** | 日用 / 护肤 / 食品 / 咖啡 | 早上起床 → 出门 → 午间 → 下班 → 睡前 |
| **一次外出** | 服饰 / 箱包 / 户外 / 相机 | 出门前准备 → 路上 → 到达 → 回程 |
| **一件事** | 厨具 / 家居 / 工具 | 决定做 → 准备 → 过程 → 完成 |
**商品出现在某个时间节点上,作为「这个时刻我在用它」**,不单独开一段介绍。
---
## 四、镜头语言
Vlog 的镜头必须有**手持感和生活质感**,这是它的可信度来源。
- **手持跟拍**为主,允许轻微晃动
- 大量**空镜和细节镜**:窗外的光、杯子上的水汽、桌面一角 —— 这些是 Vlog 的质感
- 商品**不给硬广式特写**,给「使用中的手部特写」
- 光线尽量自然光,时间感要对(早上是冷白光,傍晚是暖黄光)
---
## 五、节奏与单镜时长
- **单镜 5–8 秒**(Vlog 是碎片拼贴,镜头短、数量多)
- 允许有 4–5 秒的纯空镜,用来换时间段
- 不需要每镜都说话,**画面自己会讲**
**推荐总时长 30 秒。** Vlog 靠氛围,时长太短装不下时间感(低于 20 秒会像随机片段),
太长又超出电商场景的耐心。
---
## 六、发声方式
- 以**画外旁白**为主:`narration` 填,`speaker` 设为 `null`(是「我」在回想,不是对镜头说)
- `dialogue` 基本不用;只有真实生活对话才填(如跟室友的一句闲聊)
- **允许整镜无声**`narration``dialogue` 都空),纯画面 + 环境音
- 旁白语气是**自言自语**,不是介绍:
- ✅「这杯是今天唯一的清醒时刻。」
- ❌「这款咖啡采用精品阿拉比卡豆,风味层次丰富。」
---
## 七、Vlog 专属红线
-**中途切换成口播** —— 突然对着镜头开始介绍商品,Vlog 的气就泄了
-**给商品硬广特写** —— 商品只在「被使用」时出现
-**旁白讲参数** —— 参数是口播和测评的活,Vlog 只讲感受
-**时间线跳跃混乱** —— 时间必须单向推进,不许倒叙
-**强行喊 CTA** —— Vlog 的 CTA 要软(「链接我放下面了」而不是「快点小黄车」)
-**摆拍痕迹重** —— 完美构图反而失真,允许不完美
@@ -0,0 +1,95 @@
# 视频结构 · 前后对比
> 用「之前」和「之后」的差距直接说服。视觉冲击最强的一条结构,几乎不需要台词。
> 核心风险:对比不可信 → 观众觉得是摆拍 → 反噬品牌。
---
## 一、结构骨架
```
[ 之前 · 惨状 ] → [ 使用过程 ] → [ 之后 · 反转 ] → [ 并排复现 + CTA ]
↑ 两端必须同机位、同光线、同角度
```
| 段 | 功能 | role | 判断标准 |
| ---- | ---- | ---- | ---- |
| **1 · 之前** | 建立基准 | `钩子` | 直接展示,不铺垫。第一帧就是「之前」 |
| **2 · 使用过程** | 建立因果 | `卖点` | 让观众看到**怎么做到的**,否则反转不可信 |
| **3 · 之后** | 制造冲击 | `卖点` | 反转要在同一条件下呈现 |
| **4 · 并排 + CTA** | 落定 + 转化 | `CTA` | 左右分屏或快切复现对比,然后收 CTA |
**时长很短(≤20 秒)时可压成三段**:之前 → 之后 → CTA,省掉过程段。
但过程段是可信度的来源,能留就留。
---
## 二、可信度铁律(本结构的生死线)
前后对比最容易被观众判定为「假」。守住这四条:
1. **同机位** —— 前后两镜的角度、距离、构图必须一致
2. **同光线** —— 不许「之前」打冷光、「之后」打暖光,这是最常见的作弊
3. **同条件** —— 不许「之前」素颜、「之后」化妆;变量只能有一个,就是商品
4. **过程可见** —— 中间必须有真实的使用过程,不能直接跳切
**在 `visual` 里明确写出「与第 X 镜同机位同光线」**,让下游生图时保持一致。
---
## 三、对比什么
按品类选一个维度,**只对比一个维度**:
| 品类 | 对比维度 | 呈现方式 |
| ---- | ---- | ---- |
| 清洁 / 护理 | 状态变化 | 同一块区域的特写前后 |
| 收纳 / 家居 | 空间变化 | 同一角度的全景前后 |
| 服饰 | 版型 / 搭配 | 同一姿势的全身前后 |
| 食品 / 厨具 | 成品效果 | 同一容器同一角度 |
| 工具 / 3C | 效率变化 | 同一任务的耗时对比(可上计时器) |
**禁止同时对比两个维度**,观众的注意力只够看一个变化。
---
## 四、时间标注
前后对比几乎都需要交代**时间跨度**,否则观众不知道要等多久。
- 在画面上或旁白里给出明确时间:「7 天」「一次」「30 秒」
- 时间必须真实,**不许模糊化**(「短时间内」这种写法会降低可信度)
- 短时间见效的商品把时间往前放(是卖点);需要长期的就诚实说(是预期管理)
---
## 五、钩子写法(第一镜)
前后对比的钩子就是**「之后」的画面先闪一下**,或者直接从「之前」开始。
1. **结果前置** — 先给 1 秒「之后」,再回到「之前」(最抓人)
2. **惨状直击** — 直接展示「之前」,不加任何解释
3. **数字冲击** —「7 天,同一个角度。」
---
## 六、台词分寸
**这是台词最少的一条结构。** 画面已经在说话了,台词只做三件事:
- 交代条件(同机位、时间跨度)
- 交代过程(用了什么、怎么用)
- 收 CTA
**别用台词描述画面已经展示的东西。** 「你看,明显干净多了」是废话,观众看得见。
---
## 七、本结构红线
-**前后条件不一致** —— 换光、换角度、换妆容,一律判假
-**跳过使用过程** —— 直接从「之前」切「之后」,观众不信
-**对比两个以上维度** —— 注意力分散,一个都记不住
-**时间含糊** —— 必须给明确时长
-**夸大反转幅度** —— 效果超出商品实际能力就是虚假宣传
-**用台词代替画面** —— 这条结构的说服力在画面,不在嘴
@@ -0,0 +1,94 @@
# 视频结构 · 痛点解决
> 先把观众的痛戳到,再把商品端上来。电商转化率最稳的一条结构,适用面最广。
> 核心风险:痛点不够具体 → 观众不对号入座 → 整条视频白做。
---
## 一、结构骨架
```
[ 痛点场景 ] → [ 痛点放大 ] → [ 商品介入 ] → [ 结果 + CTA ]
↑ 必须具体到可复现的一幕
```
| 段 | 功能 | role | 判断标准 |
| ---- | ---- | ---- | ---- |
| **1 · 痛点场景** | 让观众「这就是我」 | `钩子` | 一个具体的、有画面的、发生在昨天的场景 |
| **2 · 痛点放大** | 让观众意识到代价 | `痛点` | 说出这个麻烦带来的**后果**,不只是麻烦本身 |
| **3 · 商品介入** | 给出解法 | `卖点` | 卖点必须**正面对准**前面的痛点,一一对应 |
| **4 · 结果 + CTA** | 转化 | `CTA` | 结果要可见,CTA 要有动作 |
时长短时按此顺序压缩,段可以合并但**顺序不能变**。
---
## 二、痛点怎么写才算合格
**唯一标准:具体到能拍出来。**
| ❌ 不合格 | ✅ 合格 |
| ---- | ---- |
| 头发很油 | 早上洗的头,下午三点开会刘海已经一绺一绺 |
| 收纳很乱 | 每次找充电线要翻三个抽屉,最后在沙发缝里 |
| 皮肤状态不好 | 昨晚两点睡,今早粉底卡在法令纹里 |
| 做饭很麻烦 | 下班到家七点半,等米饭熟就八点十分 |
**方法:给痛点加时间、加地点、加一个具体后果。** 抽象的痛点没有人会认领。
---
## 三、痛点放大的分寸
放大是为了让观众意识到「这事得解决」,不是为了制造焦虑。
- ✅ 放大**代价**:耽误的时间、多花的钱、错过的场合、别人的眼光
- ❌ 不许贩卖容貌焦虑、身材焦虑、年龄焦虑
- ❌ 不许暗示不用这个商品会有健康后果(这条越线就是违规)
**一句话就够。** 放大段是全片最短的,超过一句就变成说教。
---
## 四、卖点必须一一对应
这是「痛点解决」结构最容易翻车的地方。
**规则:前面戳了几个痛点,后面就只讲几个卖点,且必须一一对上。**
```
痛点:下午三点头发就油
↓ 必须对上
卖点:它的控油是靠 XX 成分吸附,我实测撑到晚上八点
```
**禁止**在这里罗列商品的全部卖点。跟痛点无关的卖点一个都不要提 —— 它们只会
稀释说服力。一条视频解决一个痛点就够了。
---
## 五、结果与 CTA
- **结果必须可见**:同一个场景、同一个时间点,状态变了
- CTA 给**一个**明确动作,不要给两个(「点小黄车」和「关注我」二选一)
- 紧迫感可以有,但不许用绝对化用语(「最后一天」可以,「全网最低」不行)
---
## 六、钩子写法(第一镜)
痛点解决结构的钩子优先用这三种:
1. **痛点提问** —「你有没有过这种情况:___?」
2. **场景直击** — 直接演那一幕,不解释(画面自己说话)
3. **共犯身份** —「我们这种___的人,都懂。」
---
## 七、本结构红线
-**痛点抽象** —— 最致命,写不具体就重写
-**卖点跟痛点对不上** —— 观众会觉得答非所问
-**一条视频戳三个痛点** —— 一个就够,多了就散
-**贩卖焦虑** —— 放大代价可以,制造恐慌不行
-**痛点段太长** —— 痛点占比不超过全片一半,否则观众会难受到划走
@@ -0,0 +1,98 @@
# 视频结构 · 测评验证
> 用举证的方式说服。观众要的不是「你说它好」,而是「你怎么证明它好」。
> 客单价越高,这条结构越有效。核心风险:只有结论没有证据 → 变成软广。
---
## 一、结构骨架
```
[ 提出质疑 ] → [ 设定验证方法 ] → [ 当场验证 ] → [ 给出结论 + CTA ]
↑ 站在观众那一边,而不是商品那一边
```
| 段 | 功能 | role | 判断标准 |
| ---- | ---- | ---- | ---- |
| **1 · 提出质疑** | 建立中立立场 | `钩子` | 用观众的口吻问出怀疑,不许一开始就夸 |
| **2 · 验证方法** | 建立方法可信 | `痛点` | 说清「我要怎么测」,方法要看起来公平 |
| **3 · 当场验证** | 举证 | `卖点` | 必须有**可见的过程和读数**,不能只给结论 |
| **4 · 结论 + CTA** | 转化 | `CTA` | 结论要有保留(说清适合谁不适合谁) |
---
## 二、立场问题(本结构的灵魂)
测评验证跟其他结构最大的区别:**你不站在商品这边,你站在观众这边。**
- 开场是**质疑**,不是推荐:
- ✅「这瓶卖 299,说能扛住一整天。我不太信,今天实测。」
- ❌「今天给大家推荐一款超好用的产品。」
- 全片语气是**验证**,不是介绍
- 结论必须**有保留**,全是好话反而没人信
**如果整条视频没有一句对商品不利的话,观众会判定这是广告。**
---
## 三、证据类型(至少给两种)
| 证据类型 | 呈现方式 | 可信度 |
| ---- | ---- | ---- |
| **实测读数** | 计时器 / 温度计 / 秤 / 尺 —— 画面上要看得见数字 | 最高 |
| **对照组** | 同时测另一个东西作参照 | 高 |
| **过程可见** | 完整拍出使用过程,不剪断 | 高 |
| **时间跨度** | 「连续用了 7 天」+ 每天记录 | 中高 |
| **第三方背书** | 检测报告 / 成分表 / 销量 | 中(不能单独用) |
| **主观感受** | 「我觉得挺好用」 | 最低(不能单独用) |
**铁律:至少要有一种是可见的客观证据(读数或对照组)。** 全靠主观感受的
「测评」就是伪装成测评的口播。
---
## 四、诚实分寸
- **必须说一个缺点。** 缺点要真实但不致命(价格偏高、颜色少、需要适应期)
- 说清**适合谁、不适合谁** —— 这既是诚实,也是精准筛选目标客户
- 不许伪造读数、不许剪掉不利结果
- 不许用绝对化用语和医疗功效词(这条结构最容易踩,因为在「讲效果」)
---
## 五、钩子写法(第一镜)
1. **数字质疑** —「标称 8 小时,我测测到底几小时。」
2. **价格质疑** —「299 一瓶,凭什么?」
3. **打脸预告** —「我本来想吐槽它的,结果……」(反转型,很抓人)
4. **对照开场** — 直接把两个东西并排放在画面里
---
## 六、镜头语言
- **验证过程必须是长镜或连续镜**,频繁跳剪会让人怀疑剪掉了什么
- 读数、仪表、计时器要给**特写**,让观众自己看清
- 人可以出画外只留手,重点在被测的东西上
- 对照组要**同框**,不要分别拍
---
## 七、时长注意
测评验证是**唯一适合做长的结构**。举证需要时间,压得太短就没有证据密度。
- 低于 20 秒时,只能给一种证据 —— 优先给实测读数
- 推荐 45–60 秒,能完整走完「质疑 → 方法 → 验证 → 结论」
---
## 八、本结构红线
-**开场就夸** —— 立场立刻崩塌,后面说什么都没用
-**只有结论没有过程** —— 那不是测评,是广告
-**全是优点没有缺点** —— 观众判定为软广
-**证据全是主观感受** —— 至少要有一个客观读数
-**伪造或含糊读数** —— 涉嫌虚假宣传
-**做成短剧演出来** —— 演绎的测评没有可信度,这个组合是禁用的
-**医疗功效词 / 绝对化用语** —— 本结构最高发区,输出前重点扫描
@@ -0,0 +1,105 @@
# 视频结构 · 场景种草
> 不讲痛点、不做对比、不举证,只把商品放进一个让人向往的场景里。
> 观众买的是那个场景,商品是入场券。核心风险:光有氛围没有商品记忆点。
---
## 一、结构骨架
```
[ 场景建立 ] → [ 商品自然入场 ] → [ 场景因它更好 ] → [ 软 CTA ]
↑ 场景本身要有吸引力,不靠商品撑
```
| 段 | 功能 | role | 判断标准 |
| ---- | ---- | ---- | ---- |
| **1 · 场景建立** | 制造向往 | `钩子` | 光、空间、氛围先立住,**商品先不出现** |
| **2 · 商品入场** | 自然带出 | `卖点` | 商品是被**使用**的,不是被展示的 |
| **3 · 场景升级** | 建立关联 | `卖点` | 让观众看到「有了它,这个场景更完整」 |
| **4 · 软 CTA** | 转化 | `CTA` | 语气要轻,不能破坏氛围 |
---
## 二、场景怎么选
**规则:选一个观众想进入、但门槛不高的场景。**
| ✅ 好场景 | ❌ 坏场景 |
| ---- | ---- |
| 周末早晨的厨房,光从窗户斜进来 | 豪华别墅(太远,无法代入) |
| 加班后回到家的第一件事 | 泛泛的「日常生活」(无记忆点) |
| 露营地的傍晚,炉子上在烧水 | 摄影棚白底(没有场景) |
| 出差酒店,把随身的小东西摆开 | 商品堆在桌上的平铺展示 |
**判断标准:观众看完能说出「这是什么时候、什么地方」,才算场景立住了。**
---
## 三、氛围要素(至少给三样)
场景种草的说服力来自细节密度。每条脚本至少铺三样:
- **光**:晨光 / 夕照 / 台灯 / 烛光 —— 光决定情绪,必须明确写进 `visual`
- **声音**:水沸 / 键盘 / 雨 / 风 —— 写进 `visual` 提示环境音
- **触感**:蒸汽、毛毯的绒、杯壁的温度 —— 让画面有温度
- **时间**:具体到时刻(清晨六点 / 下午三点 / 睡前)
- **陪衬物**:书、猫、外卖盒、耳机 —— 让场景像真的有人生活
---
## 四、商品怎么出场
**铁律:商品必须在「被使用」的状态下出现,不许摆拍展示。**
| ✅ | ❌ |
| ---- | ---- |
| 手拿起杯子喝了一口,杯子在画面里 | 杯子放在桌上转一圈的产品镜 |
| 把它挂在帐篷上,光亮起来 | 手举着它对镜头展示 |
| 穿着它走过街角 | 平铺在床上拍细节 |
**但商品必须被看清。** 至少要有一个镜头能让观众认出商品的外形和品牌。
这是场景种草最容易丢的东西 —— 氛围拉满,观众记住了氛围,没记住商品。
---
## 五、钩子写法(第一镜)
场景种草的钩子是**画面**,不是话。
1. **氛围直给** — 第一帧就是最好看的那一帧,不解释
2. **时刻宣告** —「周六早上八点,我唯一不设闹钟的一天。」
3. **动作开场** — 从一个具体动作切入(拉开窗帘、按下开关)
**不要用提问式钩子**,那是痛点解决的写法,会破坏场景的沉浸感。
---
## 六、台词分寸
- 语气是**自述或旁白**,轻、慢、留白
- **不讲参数、不讲价格、不讲功效** —— 这些会立刻把观众从场景里踢出来
- 可以整镜无声,让环境音和画面说话
- CTA 要软:「链接放下面了」而不是「快去抢」
---
## 七、跟其他结构的边界
场景种草**不承担说服功能**,它承担的是「想要」功能。
- 观众看完不会觉得「我需要」,而是「我想要」
- 所以它**不适合客单价高的商品**(高客单需要理由,要用测评验证)
- 适合:食品饮料、家居小物、香氛、服饰配件、露营户外
---
## 八、本结构红线
-**商品没被看清** —— 最常见的失败,氛围盖过商品
-**讲参数或价格** —— 立刻破坏沉浸感
-**摆拍式产品展示镜** —— 商品只在被使用时出现
-**场景太远太贵** —— 观众代入不了就没有种草效果
-**用提问式钩子** —— 那是痛点结构的写法
-**硬 CTA** —— 「三、二、一上链接」会毁掉整条视频的调性
-**场景描述抽象** —— 「温馨的家」不算场景,要有光、有时间、有物件