# Starter Rubric：观点类视频（Opinion-Based Video）— v2 已校准

适用于做 2-5 分钟视频、内容是讲一个观点 / 一个概念 / 一篇文章 / 一种社会现象的博主——总之**你的观点本身是产品**，画面只是载体。

> **重要：这份是已校准的 v2 公式**
> 来自一个中文观点视频博主（抖音，25+ 已发样本，T+3d/7d/8d 数据回收完毕）。**这是真实生效的版本，不是猜想**。完全没数据的新博主请用 [opinion-video-zero.md](opinion-video-zero.md)（v0 等权占位）。

---

## v2 综合分公式（**已校准**）

```
composite = (ER×1.5 + SR×1.5 + HP×1.5 + QL + NA + AB + SAT) / 8.5 × 2.0
```

每个维度 0-5 整数分。综合分范围 0-10。

权重设定理由：ER / SR / HP 三项 ×1.5，因为情感 / 社会 / 钩子是当前账号最强的传播驱动力。**这些权重是凭直觉设定后被数据部分验证的**，不是回归拟合——你的账号需要重新拟合。

---

## 7 个维度

### ER — Emotional Resonance（情感共鸣，权重 ×1.5）
*稿子能否在前 30 秒让观众产生一种**具体的、能命名的**情感？*

- **0** — 纯信息传递；没有情感钩子
- **3** — 一般共鸣（"嗯，我也有过这种感觉"）
- **5** — 锐利、具体、**让人不太愿意承认**的自我识别。观众心想"这就是我，我之前不想承认"

5/5 anchor：暗恋自欺、家庭义务、内化的失败感——任何让观众认出自己同时微微感到不适的内容。
0 分对照：纯学术陈述、抽象概念论文。

### SR — Social Resonance（社会议题共振，权重 ×1.5）
*稿子触及一个当下的、有争议的、或结构性重要的社会模式吗？*

- **0** — 纯个人 / 人际层面
- **3** — 触到一个公认的社会现象（职场动态 / 恋爱 / 家庭），但没加新视角
- **5** — 命名了一个观众**认识但没有语言形容**的结构性模式

5/5 anchor：参考博主的"房价/状元"——"学生坠楼 vs 高考状元"的非对称冲击直击阶层 / 教育 / 生命价值三个议题交叉。
0 分对照：纯个人情感（暗恋 / 关系）。

### HP — Hook Potential（钩子强度，权重 ×1.5）
*前 3 秒能不能逼观众看下去 30 秒？*

- **0** — 通用开场（"大家好，今天聊一聊..."）
- **3** — 具体的承诺或反直觉断言
- **5** — 一个具体生动的场景或断言，观众无法停止处理

不要把 HP 与"猎奇"混淆。一个安静但具体的开场（"有些关系不是在某一刻结束的——它们在你还在里面的时候就已经偏移"）也可以是 HP=5。

### QL — Quotable Lines（金句密度，权重 ×1.0）
*稿子里至少 2-3 行能被截图、能作为独立文字单独传播吗？*

- **0** — 全是叙述；没有警句
- **3** — 结尾有一句令人记住的
- **5** — 多句独立可用、分布在稿子不同位置（开场 / 中间 / 结尾）

> **校准 caveat**：参考博主的数据显示 **QL=5 不在于"金句数量"**，更接近"每句金句离开视频后还能在评论里 / 截图里 / 朋友的微信里独立存活吗？"——这个细微的定义偏差会被未来的 v2.1 升级吸收。

### NA — Narrativity（叙事性，权重 ×1.0）
*有没有一个可辨识的弧线——铺垫、升级、收束——还是平铺直叙的论点列表？*

- **0** — 列表式结构
- **3** — 松散的主线
- **5** — 紧凑的三幕结构，结尾 payoff 在开场就已埋好

对观点视频来说，NA 比对叙事视频重要性低。把它当 tiebreaker 维度，不是主驱动。

> **校准 caveat**：参考博主的数据中 NA 与 HP 部分冗余——v2.1 候选版本里 NA 被砍。在你的账号上单独验证。

### AB — Audience Breadth（受众广度，权重 ×1.0）
*这个议题的潜在受众有多广？*

- **0** — 极小众（专业圈 / 单一兴趣）
- **3** — 中等（一类人群）
- **5** — 普世（暗恋 / 家庭 / 工作）

> **校准 caveat**：AB 在参考博主的数据里被发现是**误导信号**——求职是 AB=5 但分播比 0.96%（最低）。"广"不等于"愿意传播"。v2.1 候选版本会用 TS（Topic Shareability）替代 AB。**当前 v2 仍保留 AB，因为 v2.1 还在验证**。

### SAT — Satire Depth（讽刺深度，权重 ×1.0）
*稿子用了多层反讽 / 戏仿格式 / 自指嘲讽吗？*

- **0** — 真诚直陈
- **3** — 一层反讽
- **5** — 嵌套或自指反讽（例如，一篇**关于**某现象的稿子，**用那个现象的格式**写出来）

如果你的频道走真诚路线，SAT 给 3 当占位，**不要**让它影响排序。如果你的频道走戏仿路线，这个维度重要。

5/5 anchor：参考博主的"房价/状元"——三层反讽（虚构国框架 + 学术论文形式戏仿 + 致谢段自我指涉）。

---

## v2.1 候选维度（**未升正**，仅供探索）

下列两个维度在参考博主的数据上展示了独立预测力，但还没通过完整的升级验证流程。**你不要在自己起步阶段直接用这两个维度**——风险大于收益。

### MS — Memetic Shareability（模因可挪用性）
*观众能复用作者的句式吗？*

5/5 anchor：参考博主"停止期待"中的「她不一样」/「他不一样」模因——观众主动套用句式自嘲，2266 赞独占榜首，全文出现 12+ 变体。
0 分对照：金句被原样引用但**不被挪用造句**——参考博主"谁问你了"中的「无需求信息供给」362 赞独占但只能引用。

为什么重要：被引用的金句驱动**单次传播**。可挪用的模板驱动**生成式传播**——评论本身变成表演，每次表演都是免费的传播。

### TS — Topic Shareability（议题分享冲动）
*观众转发这条视频，转发本身会不会暴露 ta 不想暴露的处境？*

- **1** — 转发等于承认一件痛苦或被污名化的事（求职、被冒犯、最近分手且熟人能猜出对象）
- **3** — 转发是中性的
- **5** — 转发**本身就是表演**（集体吐槽 / in-group 黑话 / 价值观站队 / 安全的自嘲）

为什么重要：议题广度 ≠ 流量。一个"普世"但社交暴露的议题（如求职）跑不过一个"小众"但分享安全的议题（如吐槽老板）。**Shareability 才是约束变量，不是 breadth**。

> **如果你想试 v2.1**：跑完 5 篇 v2 校准 + 主动收集 MS 和 TS 的"试评分"作为候选维度数据。证据足够（≥3 样本支持）后通过 `/cheat-bump` 走完整升级流程。

---

## Bucket 预测（**仅适用于已有粉丝基础的校准期用户**）

> ⚠️ **新人不要用这套绝对桶**。0 粉账号的视频典型在 100-1000 播放区间——照搬下表会让所有预测都落"底部 99%"。
> Cold-start 用户请用 [opinion-video-zero.md](opinion-video-zero.md) 的**比率桶方案**。
> Calibration 用户（≥5 篇有数据）由 `/cheat-init` 询问 baseline 后自动派生。
> 下表是"参考博主"（中文抖音观点视频，~1w 粉，25+ 已发样本）的实际拟合——**不是普适常量**。

不要预测一个具体数字。预测一个 **bucket** + 概率分布。

| Bucket | 范围（万播放）| 参考博主的先验概率 |
|---|---|---|
| 底部 | <5w | 5% |
| 基础盘 | 5-30w | 35% |
| 命中 | 30-100w | 45% |
| 爆款 | 100-150w | 12% |
| 现象级 | >150w | 3% |

**重要**：按你的账号自己的 percentile 设 bucket 边界。你的"爆款"可能是 5w（参考博主级别）或 5k（新人级别）或 500w（大 V）。直接照抄上表的人会得到永远偏高 / 偏低的预测。

校准过 ≥5 篇后跑 `/cheat-bump --bucket-only` 让系统基于你的实际分布自动派生。

每次预测要给：
- **最可能的 bucket**（headline call）
- **中枢**（你在那个 bucket 内的点估计）
- **所有 bucket 的概率分布**（必须加起来 100%）

---

## T+N 复盘窗口

默认：**T+3d**。

为什么 3 天而不是 5 / 7：
- 大多数短视频平台的算法分发决策在 72 小时内基本结束
- 等更久会引入噪声（缓慢长尾、二次推荐）不增加信号
- T+3d 让你能**每周跑一次校准循环**，rubric 保持响应速度

只有在你有证据证明自己平台行为不同的时候才覆盖。覆盖记得写进 `rubric_notes.md`。

---

## Anchors（锚点样本）

打分新稿时，找 2-4 个 composite 接近的旧样本，列出它们的实绩。**锚点对比能抓出公式抓不到的错误**。

锚点集是你边发边攒出来的。**在你有 ≥5 篇校准过的作品之前，锚点不可用——这是正常的**。Cold-start 期跳过锚点对比，但要在预测文件里标 `锚点对比：N/A（cold-start）`。

---

## 这套 rubric 注定会打错的地方（已知 limitations）

参考博主的数据暴露的失败模式。在你自己的数据里也要警惕：

1. **时长**：rubric 里没有任何维度捕捉稿子时长。4 分钟稿要付出完播率代价。完播率单独追踪
2. **议题时效 / 平台情绪**：算法偏好会变。上个月被推的话题这个月可能被压
3. **概念密度**：一个稿子里塞太多自创术语（4 个以上缩写、多个框架）压缩理解负担、伤完播率。当前 rubric 没惩罚这个
4. **MS / TS 的相互作用**（v2.1 候选维度）：两者独立看可能 OK，但真正爆款需要两个都 ≥4。单维度极致很少够

---

## 打分速度 cheat sheet

打新稿的分时给自己定个时间。重点是**给一个能被复盘的判断**，不是写论文。

- **每个维度 30 秒**是合适的节奏。如果某个维度让你想超过这个时间，你在合理化，不是在打分
- **相信你的第一个整数**。如果你在 3 和 4 之间反复横跳，写 3 + 一个备注。打 5 次以后 rubric 会告诉你是不是系统性偏低
- **打分前不看锚点**。如果你打分前先查"停止期待打了多少分"，你已经被锚定了。**先盲打，再对比**

---

## 与 `cheat-on-content` 子 skill 的对应

这份 starter rubric 被以下 skill 读取：
- `/cheat-init` cold-start 模式 → 默认复制本文件到 `rubric_notes.md`（如选择 calibration 模式且 mode 决定能用 v2 公式）
- `/cheat-score` 和 `/cheat-predict` → 读 `rubric_notes.md` 拿当前公式
- `/cheat-bump` → 这份 starter 是 bump 的"先验起点"，bump 后被替换为用户自己拟合的版本
