# 电商带货脚本 · 核心方法论 > 每次生成都读。本文件是脚本的"骨架 + 红线",钩子句式见 `hook-library.md`。 --- ## 一、黄金结构:钩子 → 痛点 → 卖点 → CTA 带货短视频的灵魂是**前 3 秒留人 + 结尾促转化**。四个功能镜各司其职: | role | 功能 | 它要做的事 | 旁白要点 | | ---- | ---- | ---- | ---- | | **钩子** | 3 秒留人 | 第一句话/第一帧就让人停下不划走 | 用 `hook-library.md` 的公式,制造痛点共鸣或反差冲击 | | **痛点** | 共鸣 | 把用户"对,我就这样"的处境讲出来 | 具体场景化,不抽象,让人对号入座 | | **卖点** | 商品解决 | 商品如何**恰好**解决上面的痛点 | 卖点落到痛点上,给"凭什么信"的理由(成分/效果/对比/口碑) | | **CTA** | 转化行动 | 回到开头那个具体情境,把商品交到「这样的人」手里 | 给谁 + 为什么值得试 + 一句自然的口语引导。**禁止喊平台指令**(小黄车 / 点下方 / 赶紧下单 / 抢购 / 手慢无) | **铁原则:** - **首镜永远是钩子**——3 秒内必须抛出钩子,否则用户划走。 - **末镜永远收 CTA**——可以是独立 CTA 镜,也可以是末镜旁白末尾自然收一句。收的是「谁适合、为什么值得试」,不是喊口号。 - **卖点必须挂在痛点上**——不是罗列参数,是"这个痛点 → 商品这样解决"。 - **一条只讲一个核心情境**——先选一个「时间 + 地点 + 小麻烦/小欲望」,整条围绕它推进; 不要把商品详情页的所有卖点搬进来。 - **每镜必须有变化**——人物的处境、手上的动作或眼前的结果至少推进一项;镜与镜不能只是 换种说法重复夸商品。 --- ## 二、时长 → 镜数 → 黄金结构映射(关键) ### 2.1 时长规则(每镜固定 15 秒) - **总时长**由输入给定:**15 / 30 / 45 / 60**。未指定时默认 30。 - **每镜时长固定 15 秒**,这既是主流程产品规则,也是下游出片模型的硬上限。 - 镜数直接由总时长决定:15 秒 → 1 镜,30 秒 → 2 镜,45 秒 → 3 镜,60 秒 → 4 镜。 - **不要**写成 8/10/12 这种不等长,也**不要**自行加减镜。15 秒要靠画面变化和一句完整意思撑满,不是靠切碎镜头。 - 所有 `segments[].duration` 相加**必须精确等于** `total_duration`。 ### 2.2 镜数怎么定 镜数**不是按表现形式估算的**,就是 `total_duration / 15`。 表现形式只影响这一镜里怎么拍(口播把 15 秒说完一件事;短剧在 15 秒里完成一次冲突/对白交换;Vlog 用镜内空镜+细节撑满),**不改变镜数**。 ### 2.3 role 按镜数分配 | 镜数 | role 序列(index 0→N) | 说明 | | ---- | ---- | ---- | | **1** | `[钩子]` | 一镜到底:钩子 → 一句卖点 → 一句 CTA,全压进这一镜的旁白 | | **2** | `[钩子, 卖点]` | 镜0 钩子里带出痛点;镜1 讲卖点并在末尾收 CTA | | **3** | `[钩子, 卖点, CTA]` | 痛点并进钩子镜 | | **4** | `[钩子, 痛点, 卖点, CTA]` | 标准黄金结构,一镜一功能 | | **5** | `[钩子, 痛点, 卖点, 卖点, CTA]` | 两个卖点镜要各有侧重 | | **N ≥ 4** | `[钩子, 痛点, 卖点 × (N-3), CTA]` | 通用规则:首钩子、次痛点、末 CTA,中间全是卖点 | 说明: - `role` 只能取 `钩子|痛点|卖点|CTA` 四个枚举值。"信任背书""场景演示""前后对比"等都归入 `卖点`。 - **镜少也不许丢 CTA** —— 镜数 ≤2 时把 CTA 压进末镜旁白的最后一句。 - 多个卖点镜要**各有侧重、不重复**(核心功效 / 真实使用场景 / 别人为什么买 / 举证读数)。 - 视频结构会覆盖这里的默认分配 —— 以 `playbooks/structure-*.md` 里的骨架为准, 本表只是没有指定结构时的兜底。 --- ## 三、entity 一致性原则 `entities` 是全脚本共享的角色 / 场景 / 商品池,保证**多镜同一角色是同一张脸、同一商品是同一个包装**。 - **一个角色/场景/商品 = 一个 entity = 一份 `visual_prompt`**。多镜复用同一 id,**绝不为同一对象写两份 visual_prompt**(会导致下游生图人脸/包装漂移)。 - `visual_prompt` 由你**自动生成**(小白不打字):写清外观特征(角色:性别/年龄段/发型/穿着/气质;场景:地点/光线/风格;商品:品类/包装/颜色/摆放),用于直接喂图模型。 - **角色与商品必须隔离出图**:角色的 `visual_prompt` 只能写人物外观与气质,生成的是纯色背景的单人角色参考图; 禁止写商品、包装、品牌、Logo、价签、桌子、电脑、杯子、手持物或生活场景。商品由独立 product 基础资产锁定, 只在视频镜头里与人物同框,避免人物图把真实包装改掉。 - **儿童用品不生成儿童角色**:任何未成年人(婴儿、宝宝、幼儿、儿童、小朋友、0–17 岁)都不能作为 `character` 或视频的画面主体。 这类商品改用商品平铺、材质/包装/尺寸细节和成人手部或成年照护者局部演示;适用年龄只写在旁白和商品信息中,不把儿童写成要生图的人物。 - **人物描述默认审核友好**:没有锁定参考人物时,只写明确成年人,不自创年轻年龄区间或幼态化称呼;服装日常得体,镜头以平视、自然俯拍和尊重主体的正面构图为主。遇到不适合直接出片的输入,先在内部改成积极、友善的日常互动,产物只保留改写后的可拍内容,不复述原措辞,也不写风险词清单或否定式免责声明。 - `type` 三选一:`character`(人) / `scene`(环境) / `product`(商品)。一份脚本通常至少 1 个 `product`、**至少 1 个 `scene`**。 - **场景与镜头一一对应(可复用)**:**每个 segment 的 `entity_refs` 必须恰好引用一个 `scene`**——它就是这一镜画面所处的环境。多镜同环境就复用同一个 scene id(如全程宿舍 → 只一个「宿舍书桌」scene,4 镜都引用它);真正换了地点才新建另一个 scene。纯产品特写镜也要绑它所处环境的 scene(无明确环境则复用主场景)。这样下游「场景」基础资产能成图、且同环境背景一致。 - `ref_index` 是该 entity 在图集里的参考序号(从 1 递增,供下游三视图/参考图对齐)。 - `voice_ref`(二期,可选):角色音色参考,用于锁音色;无则 `null`。 - **每个声明的 entity 至少被一个 segment 的 `entity_refs` 引用**,不留孤儿。 - `segments[].speaker` 指向某 `character` 的 id 表示该镜由角色开口说;`null` = 画外旁白。 --- ## 四、商品露出规范(`product_exposure`) 每镜都要规划商品怎么自然出现,避免生硬插入。按 role 给推荐露出方式: | role | 推荐露出 | 说明 | | ---- | ---- | ---- | | 钩子 | 可弱露出或不露 | 钩子先抓人,商品可作悬念,第 1 镜末尾闪一下也行 | | 痛点 | 不露 / 反面对照 | 展示"没有它"的糟糕状态,商品先按住 | | 卖点 | **特写 / 使用中** | 商品成为主角:成分特写、质地特写、上脸/上手使用中 | | CTA | 手持 / 包装正面 | 手持商品对镜头,包装正面清晰,人物状态已经变好(画面里不出现任何购物浮层或文字) | 露出方式词汇统一用:`手持` / `特写` / `使用中` / `包装正面` / `场景摆放` / `对比展示`(可组合,如"手持+特写")。 --- ## 五、旁白红线(硬规则,违反即不合格) - **口语化**:像真人对着镜头唠嗑,不准书面腔 / 不准 AI 腔("综上所述""不仅…而且""值得一提的是"全禁)。 - **必须用商品原词**:输入给了商品名、品牌、卖点,就用这些词,不许改成「补水/好用/值得买」这种空卖点。品类示例句只是语气参考。 - **`narration` 字数按这一镜的秒数算**:出片模型在镜内直接发声。 可懂语速上限约 **5.2 字 / 秒**,口播下限约 **4.3 字 / 秒**(再短镜头空一半)。 **每镜上限 `duration × 5.2` 字,且不超过 78 字。口播 15 秒镜还有下限 64 字。** | 单镜时长 | 下限 | 字数上限 | 写作目标 | | ---- | ---- | ---- | ---- | | 4 秒 | — | 14 字 | ≤ 12 字 | | 5 秒 | — | 17 字 | ≤ 15 字 | | 6 秒 | — | 21 字 | ≤ 19 字 | | 8 秒 | — | 28 字 | ≤ 25 字 | | 10 秒 | — | 35 字 | ≤ 31 字 | | 12 秒 | — | 42 字 | ≤ 38 字 | | 15 秒 | **64 字** | 78 字 | **66–74 字,4–5 句** | 主流程每镜都是 15 秒:**要说满,不要宁可短。** 一句 20 字撑不满镜头。 留白靠句间停顿和画面,不靠少写字。只有 Vlog 才允许个别镜纯画面无声。 - **不浮夸、不空喊**:卖点要给具体理由,不堆形容词。 - **拒绝详情页腔**:禁止用「全面升级 / 高品质 / 性价比很高 / 闭眼入 / 值得买」替代体验与证据。 台词要有当下的个人判断,例如先说自己卡在哪,再说为什么这一步让自己改观。 - **违规词禁令**(电商广告法红线,一律不写): - **医疗功效类**:治疗 / 根治 / 疗效 / 抗癌 / 消炎 / 杀菌(无证) / 排毒 / 速效 / 抑制 ××病 … - **绝对化用语**:最 / 第一 / 顶级 / 唯一 / 100% / 国家级 / 世界级 / 永久 / 绝对 / 史上 … - **虚假承诺**:包治 / 三天见效 / 立刻变白 / 永不反弹 … - 替换策略:用"帮助""更""不少人反馈""上脸清爽"等柔性、主观化表达替代。 > 自检阶段必须逐镜扫一遍违规词,命中即改写。详见 `checklist.md`。 --- ## 六、15 秒场内的秒级分镜(硬规则) 主流程一场就是 15 秒。15 秒里**必须再切 3–5 刀**,写进 `visual`。 > **★ 中间没有分镜图了。** `visual` 会**原样交给视频生成模型**,不再经过一张关键帧图去补全画面。 > 你没写的,模型自己编;你写含糊的,画面就含糊。所以 `visual` 要写到 > 「一个不认识这个商品的摄影师照着就能拍」的程度。 `visual` 不写普通画面摘要,固定按下面的导演说明书结构输出(四栏,逐栏写满): ``` 【本镜任务】本段要让观众看懂的变化或悬念 【光线氛围】光源方向与性质(窗光/顶光/台灯/逆光);色温冷暖;明暗对比;整体色调(各镜保持一致) 【声音】台词/旁白状态;音效;背景音乐(没有写无)—— 没有字幕栏,也不要提这两个字 【画面内容】 0-3s:景别;机位;运镜;主体在画面中的位置;具体动作;信息变化 3-8s:景别;机位;运镜;手与商品的空间关系;可见细节 ... ``` 输入如果是 `【镜头 01】` 导演分镜稿(上传视频提炼),把原稿每镜的景别、机位、运镜、人物动作、表情、音效、背景音乐、备注折进对应栏,不要压成一句画面摘要。**原稿的「字幕 / 花字」一栏一律丢弃**,不搬进新脚本。原稿写「无 / 不可见 / 听不清」的不要编造。 这样「人物/商品/场景设定」留在 entities 中保持全片一致,「本镜任务」管情绪推进, 「光线氛围」锁住全片视觉调性(原来这件事由分镜图承担,现在只能靠文字), 「画面内容」只管可执行的镜头,声音也不会漏给视频模型。不得写虚构或无法发生的音效。 ``` 0-3s:近景,人看镜头或看向场景,先立住环境和情绪 3-8s:手部入画,开始使用商品(写清容器、材质、液体/膏体状态) 8-12s:商品特写,用法过程可见 12-15s:拉回人物,使用后的反应 ``` - 第一条从 **0 秒**起,最后一条接到 **15s**。 - 每一条写全:**景别 + 机位 + 运镜 + 动作 + 信息变化**(五项都要),并写清谁、用哪只手、 从哪个方向入画、握商品哪里、商品/容器什么样。 - 15 秒内至少切 **两次景别**(大特写 / 特写 / 近景 / 中近景 / 中景 / 全景)。 - **每镜至少出现一个运镜词**(手持跟拍 / 推近 / 拉远 / 横摇 / 环绕 / 固定机位); 没有运镜词,出片会拍成呆板的静止画面。 - **只写拍得出来的东西**:禁止「展示商品 / 呈现质感 / 体现高级感」这类评价词,禁止心理描写, 画面描述里一个「字幕」都不要出现(要求加的、声明没有的都不要写),口播只以声音存在;禁止一镜内跨场景跨时间。 - 商品用法必须真实:茶要热水和蒸汽,不要把茶包丢进冷白开;手不要悬浮。 - **一场一个动作链**:把 15 秒拆成同一件事的起因 → 操作 → 可见变化 → 反应,不能把无关的 剧情、多个卖点、跳场景硬塞进同一场。画面提供证据,台词提供判断或转折,不要互相复述。 - 允许另给 `beats:[{start,end,shot_size,action}]`,但 `visual` 仍要能折成上面这种多行文本。 --- ## 七、CTA 怎么写(硬规则) **旧写法已废弃。** 「点下方小黄车」「赶紧下单」「手慢无」这类平台指令腔一律禁止 —— 它把一条好片子瞬间打回广告,观众听到就划走,而且换平台就穿帮。 ### 禁用词(出现即不合格) 小黄车、购物车、点下方、点击下方、点击购买、立即购买、马上下单、赶紧下单、抢购、秒杀、 手慢无、别犹豫、冲、买它、闭眼入、直接拍、上车。 ### 合格的 CTA = 三件事,一句话说完 1. **回到钩子那个情境** —— 不是泛泛的"推荐给大家",是"你要是也……" 2. **点名谁适合** —— 具体到人群或处境(久坐犯困的、洗头后半天吹不干的、租房没灶台的) 3. **一句自然的引导** —— 像跟朋友说话,给个理由,不下命令 ### 参考写法(照着这个语气写,别照抄原句) - 「你要是也天天下午三点犯困,可以试试这个,我一盒能喝小半个月。」 - 「链接放这儿了,先看看合不合适再说,不着急。」 - 「租房没灶台的,这个是真省事,我用了俩月了。」 - 「想少踩点坑,就照我说的这两个点挑,别的其实差不太多。」 ### 还要注意 - **一个 CTA 就够**,不要既让人下单又让人关注。 - **紧迫感只能来自真实事实**(商品资料里写明的活动 / 规格 / 库存);没有事实就不制造紧迫感, 更不许编"最后一天""仅剩 3 件"。 - **绝对化用语照旧禁止**(最 / 第一 / 唯一 / 100% / 全网最低)。 - **画面里不出现任何购买入口、价格贴片或浮层** —— 成片无文字叠加,转化靠说得对,不靠贴图。