4.1 KiB
4.1 KiB
阶段 1.5 — 三重验证筛选
目标
从候选单元池里,筛出真正值得做成独立 skill 的方法论单元。通不过的降级为 example / 引用 / 术语,但不独立成 skill。
这是 cangjie-skill 区别于"书摘工具"的核心质量门。
三重验证 (全部通过才录取)
V1 — 跨域验证 (Cross-domain)
问题: 这个单元在书中至少 2 个独立的语境下有佐证吗?
- "独立"的含义: 不是同一个案例换个说法,而是两个不同的故事/不同的章节/不同的对象都在讲同一个道理
- 通过: 《穷查理宝典》中"逆向思维"在投资决策、避免灾难、教学方法三个独立场景中都出现 → 通过
- 不通过: 某个漂亮句子只在一章里出现过一次,没有书内的独立证据 → 降级为金句 example
为什么: 在多个语境中反复出现的,才是作者真正想传达的稳定方法论,而不是一时兴起的表达。
V2 — 预测力测试 (Predictive Power)
问题: 能用这个单元,推导出书里没明说的某个问题的答案吗?
- 自己设计一个书中没直接讨论过的场景
- 尝试用这个方法论去分析它
- 通过: 能得出一个有意义、非平庸的结论 → 通过
- 不通过: 只能得出"努力就会成功"之类的废话 → 这个单元没有真正的解释力,降级
为什么: 真正的方法论必须有外推能力。如果它只能复述书里的例子,它是描述不是方法。
V3 — 独特性检验 (Exclusivity)
问题: 这个单元是否是"任何聪明人都会说的常识"?
- 如果把作者名字抹掉,一个对书本领域毫无了解的聪明人也能说出来 → 不通过
- 必须是作者独特视角 / 反直觉见解 / 独特术语体系 → 通过
- 通过: 段永平的"stop doing list" — 主动列出不做什么,反常识 → 通过
- 不通过: "要尊重时间" — 太常识了,没人需要一个 skill 来告诉自己这个
为什么: 常识不需要 skill 承载,Claude 本身就知道。只有作者的差异化见解才值得固化成 skill。
验证执行流程
- 把阶段 1 的 5 个 candidates/*.md 合并成一个总候选池
- 去重: 同一方法论被多个 extractor 提取的,合并成一条
- 对每条候选跑 V1 / V2 / V3,记录判断和理由
- 通过的,写入
books/<slug>/verified.md - 未通过的,写入
books/<slug>/rejected/<id>.md,必须写明不通过的是哪一项、原因是什么 (审计价值) - 用户轻确认 ★: 把"通过的 N 个候选标题 + 淘汰的 M 个"展示给用户,问一句"这 N 个会做成 skill,有想捞回或砍掉的吗?" 得到确认再进入阶段 2 — 阶段 2–4 是全流程最耗时的部分,这一句话的成本能避免大量返工
输出模板 (verified.md 单条)
id: f01
title: 逆向思维
type: framework
V1_cross_domain:
passed: true
evidence:
- 第 3 讲: 投资决策场景
- 第 7 讲: 工程设计场景
- 第 11 讲: 教学方法场景
V2_predictive_power:
passed: true
novel_question: "如果面试官问我一个不知道答案的问题该怎么办?"
derived_answer: "逆问'我最不希望他认为我是什么样的人',从这个反面倒推应该展现什么"
V3_exclusivity:
passed: true
why_not_common: "常识是'要多想',逆向思维是'优先反着想' — 这是反直觉的排序"
→ 进入阶段 2
常见失败模式
- V1 作弊 — 把同一例子换个说法算两处。要求: 必须是不同章节 + 不同对象 + 不同结论。
- V2 作弊 — 用一个其实书里讨论过的类似问题冒充"新问题"。要求: 新问题应该让人第一眼不知道书里怎么说。
- V3 过松 — 只要"说得比较文雅"就认为不是常识。要求: 看内容本身是否反直觉,而不是措辞。
数量预期
经验上,一本方法论密集的书 (如《穷查理宝典》) 通过率约 30–50%。一本散文类书可能只有 5–10%。通过率过低 (<5%) 或过高 (>80%) 都要警惕:
- 过低: extractor 可能质量差,要重跑
- 过高: 验证标准可能太松