# 阶段 1.5 — 三重验证筛选 ## 目标 从候选单元池里,筛出**真正值得做成独立 skill 的方法论单元**。通不过的降级为 example / 引用 / 术语,但不独立成 skill。 这是 cangjie-skill 区别于"书摘工具"的核心质量门。 ## 三重验证 (全部通过才录取) ### V1 — 跨域验证 (Cross-domain) **问题**: 这个单元在书中**至少 2 个独立的语境**下有佐证吗? - "独立"的含义: 不是同一个案例换个说法,而是两个不同的故事/不同的章节/不同的对象都在讲同一个道理 - **通过**: 《穷查理宝典》中"逆向思维"在投资决策、避免灾难、教学方法三个独立场景中都出现 → 通过 - **不通过**: 某个漂亮句子只在一章里出现过一次,没有书内的独立证据 → 降级为金句 example **为什么**: 在多个语境中反复出现的,才是作者真正想传达的稳定方法论,而不是一时兴起的表达。 ### V2 — 预测力测试 (Predictive Power) **问题**: 能用这个单元,推导出书里没明说的某个问题的答案吗? - 自己设计一个书中没直接讨论过的场景 - 尝试用这个方法论去分析它 - **通过**: 能得出一个有意义、非平庸的结论 → 通过 - **不通过**: 只能得出"努力就会成功"之类的废话 → 这个单元没有真正的解释力,降级 **为什么**: 真正的方法论必须有**外推能力**。如果它只能复述书里的例子,它是描述不是方法。 ### V3 — 独特性检验 (Exclusivity) **问题**: 这个单元是否是"任何聪明人都会说的常识"? - 如果把作者名字抹掉,一个对书本领域毫无了解的聪明人也能说出来 → 不通过 - 必须是作者**独特视角 / 反直觉见解 / 独特术语体系** → 通过 - **通过**: 段永平的"stop doing list" — 主动列出不做什么,反常识 → 通过 - **不通过**: "要尊重时间" — 太常识了,没人需要一个 skill 来告诉自己这个 **为什么**: 常识不需要 skill 承载,Claude 本身就知道。只有作者的**差异化见解**才值得固化成 skill。 ## 验证执行流程 1. 把阶段 1 的 5 个 candidates/*.md 合并成一个总候选池 2. 去重: 同一方法论被多个 extractor 提取的,合并成一条 3. 对每条候选跑 V1 / V2 / V3,记录判断和理由 4. 通过的,写入 `books//verified.md` 5. 未通过的,写入 `books//rejected/.md`,**必须写明不通过的是哪一项、原因是什么** (审计价值) 6. **用户轻确认** ★: 把"通过的 N 个候选标题 + 淘汰的 M 个"展示给用户,问一句"这 N 个会做成 skill,有想捞回或砍掉的吗?" 得到确认再进入阶段 2 — 阶段 2–4 是全流程最耗时的部分,这一句话的成本能避免大量返工 ## 输出模板 (verified.md 单条) ```yaml id: f01 title: 逆向思维 type: framework V1_cross_domain: passed: true evidence: - 第 3 讲: 投资决策场景 - 第 7 讲: 工程设计场景 - 第 11 讲: 教学方法场景 V2_predictive_power: passed: true novel_question: "如果面试官问我一个不知道答案的问题该怎么办?" derived_answer: "逆问'我最不希望他认为我是什么样的人',从这个反面倒推应该展现什么" V3_exclusivity: passed: true why_not_common: "常识是'要多想',逆向思维是'优先反着想' — 这是反直觉的排序" → 进入阶段 2 ``` ## 常见失败模式 1. **V1 作弊** — 把同一例子换个说法算两处。要求: 必须是不同章节 + 不同对象 + 不同结论。 2. **V2 作弊** — 用一个其实书里讨论过的类似问题冒充"新问题"。要求: 新问题应该让人第一眼不知道书里怎么说。 3. **V3 过松** — 只要"说得比较文雅"就认为不是常识。要求: 看**内容**本身是否反直觉,而不是措辞。 ## 数量预期 经验上,一本方法论密集的书 (如《穷查理宝典》) 通过率约 30–50%。一本散文类书可能只有 5–10%。通过率过低 (<5%) 或过高 (>80%) 都要警惕: - 过低: extractor 可能质量差,要重跑 - 过高: 验证标准可能太松