# `checks.jsonl` 中文说明

原始文件：`source_repo/checks.jsonl`

这个文件是一张总表，共 63 个检查项。每个检查项都对应某个任务的一个评分点，分成四类：

- `A`：准确性 / 遵循指令
- `C`：关键洞察，通常要求调和矛盾来源
- `AQ`：分析质量，两两比较
- `P`：呈现质量，两两比较

## 字段说明

| 字段 | 含义 |
|---|---|
| `check_id` | 检查编号 |
| `task_id` | 所属任务 |
| `week` | 周次 |
| `check_type` | 检查类型 |
| `scoring_type` | `binary` 或 `pairwise` |
| `taskdoer_output_file` | 被评分的交付物 |
| `files_needed` | 判分所需源文件 |
| `check_description` | 检查在验证什么 |
| `score_1_criteria` | 通过标准 |
| `score_0_criteria` | 失败标准 |
| `specific_file_locations` | 证据所在位置 |

## 任务 1：市场结构图

| 检查 | 中文要点 |
|---|---|
| `W1-T1-A-01` | 检查是否把壳蛋市场拆成 retail / foodservice / industrial / direct 四个渠道，并给出量化份额。 |
| `W1-T1-A-02` | 检查 `.tex` 和 `.pdf` 是否是干净的单页成品、能正确编译、页面整洁。 |
| `W1-T1-A-03` | 检查 Aurora 是否被放在修订后的 #2 份额位置，并体现其私有状态与“以最新修订值为准”的原则。 |
| `W1-T1-A-04` | 检查住房系统标签是否严格使用监管术语：free-range / barn / colony / conventional cage。 |
| `W1-T1-A-05` | 检查是否画出 2022 和 2027 两阶段转型、零售商推动的 deadline，以及 Aurora 的 colony 暴露。 |
| `W1-T1-A-06` | 检查生产商 roster 是否跨多个来源三角验证，并把 Aurora 视为净新增而不是挤掉别人的份额。 |
| `W1-T1-A-07` | 检查是否不仅按份额区分生产商，还要显示每家企业的 cage-free 转型进度。 |
| `W1-T1-A-08` | 检查是否画出端到端价值链、标注 Aurora 的位置、买方力量和零售端 margin 逻辑。 |
| `W1-T1-A-09` | 检查是否遵守 Halberd 的“不下投资建议”规则以及美式英语拼写。 |
| `W1-T1-C-01` | 检查是否调和了生产系统 mix 与渠道 cut 的来源冲突。 |
| `W1-T1-C-02` | 检查是否把 broker 对治理的正面说法与尽调中需要继续核查的治理问题区分开。 |
| `W1-T1-AQ-01` | 两两比较：哪一版市场图分析质量更强。 |
| `W1-T1-P-01` | 两两比较：哪一版市场图呈现更专业。 |

## 任务 2：市场模型

| 检查 | 中文要点 |
|---|---|
| `W1-T2-A-01` | 检查是否设置至少三个笼养退出 / cage-ban 转型情景，并让不同系统价格随情景变化。 |
| `W1-T2-A-02` | 检查是否把 Aurora 作为净新增纳入、区分各 producer 的转型节奏、区分 free-range 与 barn 的价格带。 |
| `W1-T2-A-03` | 检查财务口径是否用 USD，并且 FX 来自 Halberd 的 central assumptions。 |
| `W1-T2-A-04` | 检查预测里是否显式加入饮食结构变化和植物基替代风险。 |
| `W1-T2-A-05` | 检查是否使用 Halberd 的渠道定价纪律，尤其是零售双栏结构。 |
| `W1-T2-A-06` | 检查是否引用 RetailIQ 弹性并在至少一个压缩情景里机械地让 free-range 向 barn 替代。 |
| `W1-T2-A-07` | 检查工作簿是否无错误、可追踪、命名清晰，且关键假设带来源和日期。 |
| `W1-T2-A-08` | 检查是否遵守“不下投资建议”和美式英语规则。 |
| `W1-T2-A-09` | 检查情景命名是否具体，并解释各情景为何不同。 |
| `W1-T2-C-01` | 检查底层 flock sizing 是否使用 gold expert series，而不是 retired consultant 的低置信度说法。 |
| `W1-T2-C-02` | 检查是否同时保留 top-down 与 bottom-up，并解释差异来自结构性渠道覆盖。 |
| `W1-T2-C-03` | 检查是否区分 premium free-range 与 commodity free-range，并把 Aurora 归为 commodity tier。 |
| `W1-T2-AQ-01` | 两两比较：哪一版模型方法更透明、可审计。 |
| `W1-T2-P-01` | 两两比较：哪一版 Excel 呈现更专业。 |

## 任务 3：标的评估

| 检查 | 中文要点 |
|---|---|
| `W1-T3-A-01` | 检查是否按 Halberd 的四步 haircut 方法，用 Cal-Maine 作为锚点推导 Aurora 的 fair-value EV/EBITDA。 |
| `W1-T3-A-02` | 检查是否至少给出三个有量化经济性的 bottom-line 价值创造杠杆。 |
| `W1-T3-A-03` | 检查是否把 2027 colony deadline 作为首要风险，并量化 EBITDA at risk。 |
| `W1-T3-A-04` | 检查是否遵守不下建议、USD 口径和美式英语，并按 IC 预读的收尾结构做总结。 |
| `W1-T3-A-05` | 检查是否呈现 McKenna 家族持有和继任逻辑。 |
| `W1-T3-A-06` | 检查是否呈现前三大客户集中度、Foodstuffs 关联和 EBITDA 风险。 |
| `W1-T3-A-07` | 检查是否至少给出三个有年化 EBITDA 贡献的 top-line 机会。 |
| `W1-T3-A-08` | 检查是否有 profit pool 框架以及完整的生产商对标。 |
| `W1-T3-A-09` | 检查是否覆盖增长动态和监管时点。 |
| `W1-T3-A-10` | 检查是否有弹性驱动的定价建议，且明确引用 RetailIQ 的 own-price elasticity。 |
| `W1-T3-A-11` | 检查 deck 是否达到 IC 预读的排版质量和颜色语义一致性。 |
| `W1-T3-A-12` | 检查是否逐条反驳 Aurora draft IM 的五个牛市说法。 |
| `W1-T3-A-13` | 检查是否有资产概况页，并且首用时定义行业 / 交易缩写。 |
| `W1-T3-A-14` | 检查是否按要求对标 Cal-Maine、Hartley Pearce 和 precedent transaction。 |
| `W1-T3-A-15` | 检查是否讨论电价、合同续签和规模杠杆差距。 |
| `W1-T3-A-16` | 检查是否量化 ETS、劳工 / 移民和生物安全尾部风险。 |
| `W1-T3-A-17` | 检查是否 чест实地讨论副产品、spent hen 和替代用途。 |
| `W1-T3-A-18` | 检查页数是否落在 10 到 25 页之间。 |
| `W1-T3-C-01` | 检查是否调和持续 free-range 溢价与当前压缩趋势的冲突。 |
| `W1-T3-C-02` | 检查是否把“2027 可顺利转换”与实际 consent / chick supply 时间约束调和。 |
| `W1-T3-C-03` | 检查是否按要求对全部三家可比公司做规模与产品 mix 调整，并拒绝直接照搬卖方 ask。 |
| `W1-T3-C-04` | 检查是否用结构性成本不对称纠正 broker 的“更优运营者”叙事。 |
| `W1-T3-AQ-01` | 两两比较：哪一版 target deck 分析更强。 |
| `W1-T3-P-01` | 两两比较：哪一版 target deck 更适合 IC 预读。 |

## 任务 4：简报视频

| 检查 | 中文要点 |
|---|---|
| `W1-T4-A-01` | 检查是否同时提出具体的 customer-concentration DD 工具和 customer-contract-terms DD 工具，以及至少一个 capex / consent 工具。 |
| `W1-T4-A-02` | 检查是否用 Aurora-specific 的量化数据来谈风险，而不是泛泛而谈行业风险。 |
| `W1-T4-A-03` | 检查字幕是否与视频口播逐字一致、时间码对齐。 |
| `W1-T4-A-04` | 检查是否保持纯评估口吻、至少给出两条带 Aurora 锚点的核心发现。 |
| `W1-T4-A-05` | 检查是否量化 colony deadline slippage 的 EBITDA 风险。 |
| `W1-T4-A-06` | 检查所有财务数字是否按 USD 和 central assumptions FX 口径呈现。 |
| `W1-T4-A-07` | 检查开放问题是否明确点名某个 consent / RMA 文件并说明去哪里核查。 |
| `W1-T4-A-08` | 检查开场 primer 是否覆盖供应链、母鸡生命周期和副产品经济三个部分。 |
| `W1-T4-C-01` | 检查是否调和 free-range premium 的来源冲突，并给出供应侧压缩机制。 |
| `W1-T4-C-02` | 检查是否指出替代用途说法与实际地理 / consent 现实之间的冲突。 |
| `W1-T4-AQ-01` | 两两比较：哪一版视频叙事更强。 |
| `W1-T4-P-01` | 两两比较：哪一版视频 + 字幕更专业。 |

## 怎么读这份文件

如果你想快速理解 benchmark，建议按这个顺序看：

1. 先看任务 1 到任务 4 的检查分布。
2. 再看每个任务里 A / C / AQ / P 的比例。
3. 最后对照 `grader/` 文件里的 rubric、source graph 和 traceability，理解每个检查为什么能被评分。
