# Bozai Storyboard

> |

- **Type:** Skill
- **Install:** `agentstack add skill-miaqu766520-a11y-ai-line-skills-bozai-storyboard`
- **Verified:** Yes — security-reviewed for prompt injection and unsafe behavior
- **Seller:** [miaqu766520-a11y](https://agentstack.voostack.com/s/miaqu766520-a11y)
- **Installs:** 0
- **Category:** [Agent Skills](https://agentstack.voostack.com/c/agent-skills)
- **Latest version:** 0.1.0
- **License:** MIT
- **Upstream author:** [miaqu766520-a11y](https://github.com/miaqu766520-a11y)
- **Source:** https://github.com/miaqu766520-a11y/ai-line-skills/tree/main/skills/bozai-storyboard

## Install

```sh
agentstack add skill-miaqu766520-a11y-ai-line-skills-bozai-storyboard
```

Requires the [AgentStack CLI](https://agentstack.voostack.com/docs/cli). Works with Claude Code, Cursor, and any MCP-compatible agent.

## About

# 分镜表（bozai-storyboard）

> 品牌说明：本 skill 源自「博仔说」AI 自媒体生产线，此为粉丝通用化改写版——方法论不变，个人配置已替换为内置通用资源。

> **版本线**：
> - **v1.0（2026-08-04）**：首版。双格式（MD+JSON）、节奏声明、口播线/演示线双模板、红线继承下游组装规范。
> - **v1.1（通用版）**：动效选型改用内置《通用动效词汇表》，去个人路径，上下游改为文字接口。

口播稿定稿和生产线之间，原来没有可审阅的中间产物——用户只能在**成片**上提意见，改一次就是重录/重渲，成本极高。
本 skill 把审阅点前移：**先出分镜表 → 用户审表改表确认 → 才进生产线。**

## 何时使用本 skill

- 用户说「分镜」「分镜表」「脚本运镜」「制作脚本」「拍之前先出个表」「先列个镜头表」
- 口播稿已定稿，准备做视频（真人出镜或工具演示都行）
- 上次成片返工太多（素材不对、卡片时机不对、节奏不对），想在便宜的地方先对齐

## 何时不用

- 稿子还没定 → 先把稿子定稿（用户确认的原话稿），别替用户定稿
- 只是改成片细节（字幕错词/音量/卡片颜色） → 直接改工程，不必补分镜表
- 成片交付审核 → 不在本 skill 范围（成片出来后再走质检流程）

## 在流水线中的位置

```
口播稿/配音稿定稿（用户已确认）
  → 【本 skill】分镜表 storyboard.md + storyboard.json（★ 用户审阅闸门）
  → 生产线：按分镜表录屏/取材/组装画面/配音/后期，产出成片
```

上游是谁不重要（手写稿还是写稿 skill 产物都行），重要的是**稿子已定稿且用户确认**；下游是任意组装手段（Remotion 数据层、剪映工程、真人拍摄执行单都吃这张表）。

## 五步流程

0. **开工先读规范（第 0 步，不许跳）**：完整通读本 SKILL.md 的「红线继承」节 + 对应产线模板（`references/koubo-line.md` 或 `references/demo-line.md`）+《通用动效词汇表》使用规则——事前熟读是规范，事后检查是浪费 token 的返工。
1. **读口播稿**：只接已定稿的稿子（带【段名｜时间码】的长稿最好，段结构直接可用）。稿子里每个数字的出处一并记下，进备注列。
2. **判产线**（判断不了就问用户，别猜）：

   | 信号 | 口播线 koubo | 演示线 demo |
   |------|-------------|-------------|
   | 真人出镜原片 | 有 | 没有（或不露脸） |
   | 内容主体 | 人讲 + 素材截图轮播 | 工具/产品的真实操作录屏 |
   | 稿子口头禅 | 「我跟你说」「我实测下来」 | 「你看这个页面」「点这里」「我给你演示」 |
   | 配音 | 真人原声（或克隆音色） | 克隆 TTS（如配套 voicebox-clone skill；或任意 TTS） |
   | 画幅 | 竖屏 9:16 / 横屏 16:9 | 横屏 16:9 为主（竖屏需窗口化） |
   | 分镜重点 | 素材点位 + 卡片时机 | 操作步骤 + 光标路径 + 弹卡对齐 |

3. **出分镜表**：先读对应模板再动笔——口播线读 `references/koubo-line.md`，演示线读 `references/demo-line.md`。MD 和 JSON **一起出**，字段以 `storyboard.schema.json` 为准。
   **动效选型强制步骤（不许跳）**：分镜表的动效列**禁止自由发挥/只写「滑入/淡入」**——必须先读 `references/动效词汇表.md`（内置通用词库），按「按环节速查」表逐段选命名动词；选定后在备注列标词名。跳过此步 = 成片必然 PPT 感返工（实证教训，见文末「实战回流」）。
4. **用户审表**（★ 本 skill 存在的意义）：把 MD 表格给用户，请他重点过——口播句是否逐字一致、节奏型对不对味、素材点位缺不缺素材、卡片文案中英、CTA 方式、总时长。改哪列都行，**改完同步 JSON**。
5. **移交生产线**：用户说「确认了 / 就按这个做」之后，把 `storyboard.json` 交给组装层：
   - 口播线 → segments 直接映射字幕数据 / 素材卡 / 关键词弹入卡（映射关系见 `references/koubo-line.md`「对接组装层」表）
   - 演示线 → operation 列直接变录屏脚本步骤；segments 映射场景/卡片/字幕数据层（映射关系见 `references/demo-line.md`「对接组装层」表）
   - 用户没确认，**不许进生产线**（审阅闸门是强制闸门）
   - **移交任务书必须随附对齐数据源**：词级时间戳 JSON（每个字的起音）是组装层做卡片锚点/字幕行/翻页对齐的唯一米——只给行级/推算段界=对齐必然返工。词级数据在配音 QA 产物里（*_words*.json），移交时写明绝对路径

## 双格式铁律

- **Markdown 表格 = 给用户看的**（审阅、批注、改）；**JSON = 给组装层数据直接消费的**（subs/CARDS/SCENES 数据源）
- 两者内容必须**逐字段一致**：任何一版有改动，立刻同步另一版。JSON 合法性以 `storyboard.schema.json` 校验
- 默认保存位置：**当前视频工程目录下 `storyboard.md` + `storyboard.json`**（与口播稿同级；用户没指定工程目录就先问放哪）
- **归档**（审表确认后建议必做）：复制 MD+JSON 到当前项目的归档目录（如 `/分镜稿归档/YYYY-MM-DD_选题短名/`）——工程目录是工作副本，归档是留档追溯副本

## 红线继承（下游组装的教训，在分镜阶段就守住）

1. **不剪/不改用户口述原话**：`speech` 字段逐字抄自口播稿。审表时用户要改句子 → 这是改稿，先把理解复述给用户确认，改动量大的回写稿环节重走
2. **数字可溯源**：口播句和卡片里的每个数字，备注列必须标出处（工作日志/真实数据）；AI 编的示例数字标 `[存疑-示例]`，用户确认前不当定稿
3. **卡片中英双语**：每张卡 zh+en，不留纯中文；英文字幕意译缩写即可（若成片只发中文平台，用户明确同意后可降级为单语，默认仍双语）
4. **8 色语义配色**：`result` 红慎用（只留小面积语义必需处）、**成果/完成优先 green**、**相邻两张卡不许同色**、同场景内 ≥3 色轮换。**CTA 药丸固定 action 黄**，它前面那张卡要避开黄色
5. **安全边距意识（分镜阶段就规划坐标，别到生产线才发现放不下）**：
   - 竖屏：左右安全线 **SAFE_X=100**（20:9 手机全屏每边裁 ~68px，内容宽 ≤880）；素材/卡片/字幕都落在安全线内
   - 横屏：右下角若放人物小窗（直径 ~320），其区域 x[1480,1800]×y[600,920] 不可侵入，内容右边界 ≤1440；不放人物小窗时按同思路给四角留白
6. **合规**：CTA 用提问引评论/点赞门槛；禁止「我看到就发你」、禁止网址/微信类导流词；演示素材先过导流检查（有二维码/联系方式就标 seekSec 跳过）

## 节奏声明（每张分镜表开头必须先声明）

**先给节奏命名，再排段**。没命名节奏的分镜表不许交付。

| 节奏型 | 结构串示例 | 适用 |
|--------|-----------|------|
| **钩子慢-干货快-卡点-收** | SLOW-fast-fast-fast-HOLD-SLOW-fast | 30–60s 知识口播（口播线默认） |
| **痛点三连-登场-对照收** | fast×3-SLOW-steady-steady-HOLD-fast | 90s+ 长稿口播 / 产品故事 |
| **钩子-稳推-砸点-收** | slow-fast-steady×n-HOLD-fast | 演示线默认（直进钩子/痛点 → 功能稳推 → 成果砸点 → 收） |
| **快闪-稳推-砸点-收** | FAST-steady×n-HOLD-fast | 演示线可选（用户点名要片头预告时才用：3s 快闪预告 → 功能稳推 → 成果砸点 → 收；不默认） |
| **悬念慢开-爬坡-顶收** | SLOW-build-build-HOLD-fast | 观点/认知型口播（设问钩子慢开，金句顶点停顿） |

声明规则：
- 可以用上表，也可以自定，但**必须命名**（节奏词约定：SLOW=放慢 / fast=提速 / steady=稳速 / FAST=快切 / HOLD=卡点停顿）
- `rhythm.sequence` 逐段标节奏，段数与 segments 一致；`rhythm.peak` 标能量峰值段（=口播最重强调处，通常配 big 卡/keyword-pop）
- 时长基准 **6.2 字/秒**；某段超 7 字/秒在备注标「偏密风险」

## 审表检查清单

**AI 自查（交付给用户前逐项过）**
- [ ] **空背景禁令（第一优先级）**：逐段检查——任何段 >1.5s 只有空底+字幕 = 打回重写。过门段默认目录卡（chip 带图标依次弹入）；枚举段用幽灵槽占位；每段「画面信息密度」列（操作/弹卡/动效/放大镜）写满才出稿
- [ ] 每段 speech 与口播稿逐字一致（无剪改、无「顺了一下」）
- [ ] 节奏已命名 + sequence 段数一致 + peak 已标
- [ ] estSec 合计 = estTotalSec；总时长符合目标（短视频 30s 档 ≈170–195 字）
- [ ] 每张卡 zh+en 齐全；相邻卡不同色；红色 ≤1 处小面积；成果用 green
- [ ] **动效列全部是《通用动效词汇表》内命名动词**，备注列已标词名
- [ ] 素材点位都落实：截图有文件名、视频素材有 seekSec；缺的标 `[缺素材]` 不瞎编
- [ ] 竖屏段位置规划没超 SAFE_X=100；横屏段没侵入人物小窗保护区
- [ ] CTA 合规（提问引评论/点赞门槛，无导流词）
- [ ] MD 与 JSON 逐字段一致；JSON 过 schema 校验（node -e 或 python jsonschema）

**请用户重点审（把 MD 给用户时明说）**
1. 口播句逐字对不对（要改=改稿，先复述确认）
2. 节奏型对不对味、峰值段放得对不对
3. 素材点位：哪些素材还没有，要补拍/补截
4. 卡片文案中英要不要换说法
5. CTA 方式选哪个
6. 总时长接不接受

## 参考文件

- `references/动效词汇表.md` — 动效列唯一词源（镜头/元素/强调/布局/转场五类命名动词 + 按环节速查 + 反面清单）
- `references/koubo-line.md` — 口播线分镜模板（素材点位 + 卡片时机 + CTA + 中英文案；空白模板 + 填满示例）
- `references/demo-line.md` — 演示线分镜模板（页面 → 操作 → 假光标路径 → 弹卡中英 → 配音对齐；空白模板 + 填满示例）
- `storyboard.schema.json` — JSON Schema（双格式铁律的 JSON 侧契约）
- `examples/koubo-storyboard-example.md` / `.json` — 口播线填满示例（9 段，竖屏）
- `examples/demo-storyboard-example.md` / `.json` — 演示线填满示例（9 段，横屏）

## 上下游衔接（文字接口，读约定不读路径）

- **上游输入**：已定稿口播稿/配音稿——要求能按【段名】或自然段拆出 segments；稿内数字带出处。若装有配套写稿 skill，直接接其定稿产物
- **下游消费（口播线）**：本表 `speech/speechEn` → 字幕数据；`card.color/style` → 8 色语义卡片组件；`estSec 累计` → 场景边界帧；`asset.src/seekSec/position` → 素材卡数据
- **下游消费（演示线）**：本表 `operation`（页面/操作/光标路径/waitMs）→ 录屏脚本步骤；`segments` → 场景/弹卡/字幕数据层；`card.timingNote` → 弹卡锚点（对齐配音念到该词 ±0.15s）
- **配音**：克隆配音建议用配套 `voicebox-clone` skill（产出 mp3 + spans.json + 词级时间戳，正好是本表卡片锚点需要的米）；真人原声则录完配音再回填时间轴

## 实战回流（生产线教训，通用化保留）

1. **按钮/输入框文案必须对真实 UI**：分镜里写的每个按钮名、输入框、徽标，出稿前对照真实页面核对一遍——曾实证一处分镜编造 4 处按钮文案，录屏时全扑空返工。操作：写录屏操作时直接打开目标页抄文案，不凭印象。
2. **空背景纪律**：卡片段/过门段 >1.5s 空底+字幕 = 观众流失点（终审曾点名「1:58-2:08 空洞」）。分镜阶段自检：每段「画面信息密度」列不写满不出稿；过门段默认升级目录卡。
3. **页面真实状态标注**：涉及「演示数据/真实数据」的段落，分镜备注里写死用哪种（曾实证先录假数据版被判「太假」返工重录真实名单）。
4. **动效选型不落词库必返工**：只写「滑入/淡入」的成片被批 PPT 感——这就是动效列强制走《通用动效词汇表》的由来。

## Source & license

This open-source skill is cataloged on AgentStack and links to its original source — we do not rehost the code.

- **Author:** [miaqu766520-a11y](https://github.com/miaqu766520-a11y)
- **Source:** [miaqu766520-a11y/ai-line-skills](https://github.com/miaqu766520-a11y/ai-line-skills)
- **License:** MIT

Install and usage instructions live in the source repository linked above.

## Pricing

- **Free** — Free

## Security capabilities

Automated source analysis of v0.1.0 — what this tool can access:

- **Network access:** no
- **Filesystem access:** no
- **Shell / process execution:** no
- **Environment & secrets:** no
- **Dynamic code execution:** no

*"Yes" means the capability is present in the source — more access means more to trust, not that it is unsafe.*


## Versions

- **0.1.0** — security scan: passed — Imported from the upstream source.

## Links

- Listing page: https://agentstack.voostack.com/l/skill-miaqu766520-a11y-ai-line-skills-bozai-storyboard
- Seller: https://agentstack.voostack.com/s/miaqu766520-a11y
- Browse the marketplace: https://agentstack.voostack.com/browse

---
Listed on AgentStack — the marketplace for AI agent skills and MCP servers. Every listing is security-reviewed. Creators keep 70%.
