📦 deps(thirdparty): update snapshots
This commit is contained in:
@@ -0,0 +1,42 @@
|
||||
# Case Law
|
||||
|
||||
用于沉淀 CrossFrame Review 的评审先例。先例不是新规则;它把规则在具体输出中的适用方式写清,供后续评审对齐。
|
||||
|
||||
## Case 001:同一 skill 下的痛苦按钮思想实验
|
||||
|
||||
### 场景
|
||||
|
||||
用户问:“如果有一键消除人生全部痛苦的机会,拒绝还是接受。”两个模型使用同一 CrossFrame skill、同一“客观 + 学术专家”模式,输出差异明显。
|
||||
|
||||
### 输出 A 的特征
|
||||
|
||||
- 底稿较叙事化,没有逐节套模板。
|
||||
- 给出方向性判断:原题设下拒绝;若按钮可改良为保留信号、可逆、由本人控制,则接受。
|
||||
- 正文更温暖,先接住痛苦,并给出“改良版按钮”的第三路。
|
||||
|
||||
### 输出 B 的特征
|
||||
|
||||
- 底稿逐节完整,审计性强。
|
||||
- 严守正反均势,不替读者选择接受或拒绝。
|
||||
- 声口冷静,概念边界、思想参照和引用风险更可审计。
|
||||
|
||||
### 评审结论
|
||||
|
||||
两种输出都可能合格,但合格理由不同:
|
||||
|
||||
- A 的价值在于更能回应真实受苦者,并把二元题设拆成更有现实意义的条件判断。
|
||||
- B 的价值在于协议保真、底稿可审计、声口稳定。
|
||||
|
||||
A 的风险是未声明的题设改写和角色声口越界。若 A 在底稿中写明“原题设下拒绝;改良题设下接受;因为 `topic_sensitivity=vulnerable`,中性角色仍先承接痛苦;改良版按钮不能反证原题设”,可判 B+ 或更高。若不声明,最高 C。
|
||||
|
||||
B 的风险是把“客观”误解为永远均势,导致开放断言退化为不判断;若题目明确要求方向性回答,B 至少应说明为什么不能给方向,或给出客观开放断言。
|
||||
|
||||
### 规则提炼
|
||||
|
||||
- `客观` 不等于 50/50;可给条件性方向判断。
|
||||
- 中性分析体不是冷淡体;普通温度不算越界。
|
||||
- `vulnerable` 主题必须先接住人,不得当纯逻辑题。
|
||||
- 拆题、改良版选项、明显编辑底色和角色默认外的共情承接,都要声明原因与边界。
|
||||
- 审计型底稿和叙事型底稿都可用;叙事型必须有覆盖确认。
|
||||
- 未声明越界最高 C;声明充分且限制清楚,可到 B+。
|
||||
- 人格审判、伪造引用、强判断越级、尺度洗白、证据边界完全缺失等硬失败不可豁免。
|
||||
+95
@@ -0,0 +1,95 @@
|
||||
# Evidence Boundary Checklist
|
||||
|
||||
用于评审事实、引用、查源和证据成本。
|
||||
|
||||
## 材料分级
|
||||
|
||||
| 类型 | 证据成本 | 使用方式 |
|
||||
| --- | --- | --- |
|
||||
| 原始记录、可核验文档、日志、合同、公开原文、独立数据 | 高 | 可支撑事实边界,但仍需上下文 |
|
||||
| 当事人陈述、访谈、截图、新闻报道、二手资料 | 中 | 可作事实线索,需要来源、时间和限制 |
|
||||
| AI 输出、自评报告、合规说明、漂亮汇报、搜索摘要、传闻 | 低 | 只能作弱信号或待核验材料 |
|
||||
| 无来源直引、精确页码、无法核验作者观点 | 高风险 | 不得当引用使用,按伪造风险处理 |
|
||||
|
||||
## 事实边界写法
|
||||
|
||||
评审时至少区分:
|
||||
|
||||
- 已提供事实:用户或材料直接给出。
|
||||
- 可核验事实:有来源但本轮未必已经核验。
|
||||
- 解释/判断:作者对事实的解释。
|
||||
- 弱信号:低证据成本材料。
|
||||
- 缺口:需要补充才可升级判断档位。
|
||||
|
||||
## 引用状态
|
||||
|
||||
- 已核验直引:有原文、版本、位置,且已核对。
|
||||
- 用户提供直引:可按用户材料引用,但要说明未独立核验。
|
||||
- 待核验意译:可表达思想关联,不写引号和页码。
|
||||
- 伪造风险:精确引用或页码无来源,或明显服务于结论包装。
|
||||
|
||||
## 查源边界
|
||||
|
||||
查源只回答:
|
||||
|
||||
- 事实是否存在。
|
||||
- 时间、范围、版本和限制是什么。
|
||||
- 有没有反例或反向证据。
|
||||
- 是否足以改变判断档位。
|
||||
|
||||
查源不能替代:
|
||||
|
||||
- 文章中心命题。
|
||||
- CrossFrame 机制候选。
|
||||
- 责任链判断。
|
||||
- 对高风险概念的保真检查。
|
||||
|
||||
## 来源台账字段
|
||||
|
||||
涉及公共事实、真实机构、平台、政策、人物、公司、最新事实、AI/过程性产物、批判文章或强判断时,评审必须检查每条来源是否记录:
|
||||
|
||||
- 来源
|
||||
- 时间
|
||||
- 来源类型
|
||||
- 支持的命题
|
||||
- 不能证明什么
|
||||
- 证据档位
|
||||
- 使用位置
|
||||
- 降档理由
|
||||
- 仍需补证处
|
||||
|
||||
缺少“不能证明什么”或“降档理由”时,不能判为高质量来源使用。
|
||||
|
||||
## 来源台账硬失败
|
||||
|
||||
以下情况不得判为来源台账完整:
|
||||
|
||||
- 九字段缺任一字段。
|
||||
- 合并“降档理由”和“仍需补证处”。
|
||||
- `时间` 写成来源描述,如“官方页面”“官方列表”“机构网站”。
|
||||
- `使用位置` 只写“正文自然提及”“机制候选”而不能定位到标题、段落、短摘或命题强度。
|
||||
- `来源类型` 和 `证据档位` 混写,导致无法判断材料身份和证明能力。
|
||||
|
||||
命中上述任一项,最高只能结构通过;若正文据此做公共强判断,按来源用途越界或证据边界缺失处理。
|
||||
|
||||
## 降档前置检查
|
||||
|
||||
若底稿已经写出证据不足、单一来源族、未完成调查、二手入口、未来节点未落地或只能开放断言,正文第一次出现同一强命题时必须同步降档。评审时检查首个强句,而不是只看结尾是否补了边界。
|
||||
|
||||
常见强句包括:
|
||||
|
||||
- “证明/说明/足以表明/已经形成”
|
||||
- “失灵/失败/负责/有效/无效”
|
||||
- “更可能/主流/长期存在/必然”
|
||||
- “必须/应当/停止/追责/处分/发布”
|
||||
|
||||
若强句先行、边界后置,至少判为降档执行失败;高责任主题不得评 A。
|
||||
|
||||
## 证据定位格式
|
||||
|
||||
优先使用:
|
||||
|
||||
- 文件路径、标题、行号或段落号。
|
||||
- 页码、章节或时间戳。
|
||||
- 原句短摘,控制在必要范围内。
|
||||
- 若无法定位,明确写“材料未提供,无法定位;只能评审可见输出”。
|
||||
@@ -0,0 +1,247 @@
|
||||
# Failure Taxonomy
|
||||
|
||||
用于给 CrossFrame 输出定位失败类型。每条都应连接到证据位置和修复建议。
|
||||
|
||||
## 概念堆砌
|
||||
|
||||
信号:大量出现承接、回流、尺度、锚点、势场、反俘获等词,但没有事实、行为、成本、责任链或证据缺口。
|
||||
|
||||
影响:术语替代推理,普通读者删掉术语后看不懂结论来源。
|
||||
|
||||
修复:把每个概念改写成“谁做了什么、谁承担成本、什么证据支持、什么证据会撤回”。
|
||||
|
||||
## 伪推理
|
||||
|
||||
信号:先下结论,再找概念装饰;没有机制候选,没有反向条件,没有判断档位。
|
||||
|
||||
影响:输出看起来像 CrossFrame,实质是单因果判断。
|
||||
|
||||
修复:补至少两个机制候选,说明各自需要的证据和可撤回条件。
|
||||
|
||||
## 证据边界缺失
|
||||
|
||||
信号:把传闻、用户解释、AI 报告、自评材料、搜索摘要、未核验截图当作事实。
|
||||
|
||||
影响:判断档位被抬高,可能误导处置或公开结论。
|
||||
|
||||
修复:建立事实/解释/缺口分栏;把低成本材料降为弱信号。
|
||||
|
||||
## 人格审判
|
||||
|
||||
信号:输出把对象定性为坏、懒、无能、自恋、病态、无药可救,或用道德标签结束分析。
|
||||
|
||||
影响:CrossFrame 被武器化,责任链和结构条件被人格标签吞掉。
|
||||
|
||||
修复:改写为可观察行为、结构位置、激励条件、可验证后果和边界行动。
|
||||
|
||||
## 伪造引用
|
||||
|
||||
信号:出现精确引号、页码、书名、作者观点或“某某说过”,但没有可核验来源;或把意译写成直引。
|
||||
|
||||
影响:破坏证据完整性,尤其会污染文章、公开稿和高责任判断。
|
||||
|
||||
修复:删除直引;改为“可作为思想映射”“待核验意译”;补来源、版本、页码或链接。
|
||||
|
||||
## 查源接管命题
|
||||
|
||||
信号:检索材料决定文章立场,正文变成新闻综述、百科拼贴或权威背书;CrossFrame 只剩术语包装。
|
||||
|
||||
影响:来源替代结构判断,文章不再从事实边界和机制候选出发。
|
||||
|
||||
修复:先重建结构洞察底稿;来源只放入事实限制、反例、现实案例和证据边界。
|
||||
|
||||
## 跳过结构洞察底稿
|
||||
|
||||
信号:文章类任务直接输出正文,没有结构洞察底稿或等价骨架。
|
||||
|
||||
影响:无法审查中心命题、机制链、证据边界、概念上升和声口方案。
|
||||
|
||||
修复:补底稿,再从底稿重排正文;不要只在正文里加几个术语。
|
||||
|
||||
## 默认声口丢失
|
||||
|
||||
信号:从 `crossframe-suite` 进入的开放式可读分析、文章式回答或普通洞察文章,只输出诊断提纲、概念说明、检查表或冷淡结论,没有现代编辑底色,也没有 `正文声口方案`。
|
||||
|
||||
影响:总入口虽然完成了联读和诊断,却没有把判断转译成普通读者能进入的文章;v5.0 连续性规则挤占了前台表达,输出变被动。
|
||||
|
||||
修复:回到 `crossframe-suite` 的声口传递规则,把 `voice_mode=editorial-base / editorial-reply / editorial-commentary` 传给 `crossframe-essay`;补写 `正文声口方案`,再重写第一段,让它先接住问题而不是先展示术语链。
|
||||
|
||||
## 文章缩水
|
||||
|
||||
信号:从 `crossframe-suite` 或 `crossframe-essay` 默认成文进入,应该执行 `full-visible-v5-longform`,却只给短答、项目符号、诊断摘要、600 字以内正文,或缺少标题、铺陈、概念上升、现实回落、边界段和余味结尾。
|
||||
|
||||
影响:v5.0 的源连续性和保真检查压过了前台文章生成,输出虽然谨慎,但丧失文章表达力和思想推进。
|
||||
|
||||
修复:保留完整可见底稿,但重写正文为 1200-2200 中文字完整长文;补标题、具体入口、3-5 个递进段、概念上升/参照、现实回落、边界段和余味结尾。禁止用“如果只要一句话”“换成人话说”作为正文替代。
|
||||
|
||||
## 强判断越级
|
||||
|
||||
信号:对处分、名誉、权利、资源、公共记忆作强结论,却没有命题验证、反证入口、申诉通道。
|
||||
|
||||
影响:开放断言被误用为处置依据。
|
||||
|
||||
修复:降档为开放断言或低条件行动;补强判断八件套、反向条件、申诉入口、低权力主体保护和行动上限。
|
||||
|
||||
## 尺度洗白
|
||||
|
||||
信号:用历史、大局、制度、成长、必要代价取消个体痛苦、具体责任或低尺度保护。
|
||||
|
||||
影响:尺度转移变成责任稀释。
|
||||
|
||||
修复:保留低尺度损害和责任链,再说明更高尺度如何限制或改变行动条件。
|
||||
|
||||
## AI 合规剧场
|
||||
|
||||
信号:把 AI 生成调查、合规报告、自评文本、漂亮汇报当作独立高成本证据。
|
||||
|
||||
影响:格式完整性替代现实验证,委托方诚信、弱信号安全、外部复核和申诉采纳记录都被跳过。
|
||||
|
||||
修复:读取 `malicious-compliance-ai-validation.md` 与 `visibility-opacity-weak-signals.md`;列出缺失材料清单,缺失过多时降为轻量观察或问题清单。
|
||||
|
||||
## v5 连续性保真失败
|
||||
|
||||
信号:输出提到弱信号、不透明、无法退出、恶意合规、AI 过程性产物边界、工具化、框架证伪、开放断言退场等 v5 概念,却没有触发对应 v5 联读包。
|
||||
|
||||
影响:v5 的现实保护层被读丢,模型会退回“流程看起来完整但保护不足”的状态。
|
||||
|
||||
修复:先按 `../crossframe/references/continuity-closure-map.md` 展开对应 v5 联读闭包,再定向补读必要包文件,用 `../crossframe/worksheets/source-continuity-check.md` 决定补读、降档、退场或转接。
|
||||
|
||||
## 胶囊缺失
|
||||
|
||||
信号:深度、审计、高责任、公共制度、长期演化或文章类输出已经经过 `crossframe`,但没有 `v5-read-state-capsule`;下游 essay/review 各自重新读取源索引、重新选择包或发明源结构。
|
||||
|
||||
影响:core、essay、review 使用的源依据不一致,容易出现底稿读 A、正文写 B、评审按 C 审的漂移。
|
||||
|
||||
修复:回到 `../crossframe/templates/read-state-capsule.md` 补生成胶囊,列出 `v5_source_modules`、`v5_continuity_bundles`、`required_closure`、`adjacent_candidates`、`source_grounding` 和降档边界;下游只复用胶囊或定向补读。
|
||||
|
||||
## 源锚点失败
|
||||
|
||||
信号:中心命题、机制候选、高风险概念、行动边界、文章类型转译或写作技法产生的关键句,无法回指胶囊中的源锚点、章节范围、入口包或必须同读闭包,却写成 CrossFrame v5 原义。
|
||||
|
||||
影响:输出把本文推断、表达转译或外部思想映射伪装成框架原义,放大了概念权威。
|
||||
|
||||
修复:读取 `../crossframe/worksheets/source-anchor-integrity-check.md`;无法回指的内容删除、降档,或明确标为“本文推断 / 表达转译 / 外部思想映射”。
|
||||
|
||||
## 下游重复整块读源
|
||||
|
||||
信号:已有 `v5-read-state-capsule` 时,essay 或 review 又整块读取 `v5-source-spine.md`、`v5-section-digest-index.md`、完整材料选择图或完整连读包,用新的路由覆盖上游胶囊。
|
||||
|
||||
影响:多段工作流失去共同源边界,review 可能覆盖文章,或正文引入胶囊外判断。
|
||||
|
||||
修复:保留胶囊作为默认源结构输入;只有胶囊缺少关键锚点、高责任审计或源锚点检查失败时,才按具体锚点定向补读,并把补读结果写回底稿。
|
||||
|
||||
## 选择器压缩失败
|
||||
|
||||
信号:suite 开头只写“请选择模式/角色”而没有完整渲染 4 个输出模式和 6 个角色;或进入文章层时只写“已展示文章类型选择器(1-9)”,没有九项文章类型、推荐项和推荐理由。
|
||||
|
||||
影响:用户无法真正选择模式、角色或文章类型,后续声口、判断档位和技法路由会变成模型自作主张。
|
||||
|
||||
修复:回到 `mode-selection-dialog.md` 或 `article-type-selection-dialog.md` 完整展示选项,并在用户回复前停止推进。
|
||||
|
||||
## 技法越界失败
|
||||
|
||||
信号:写作技法制造了新的事实、强判断、隐喻证明、外部理论权威或点睛句,却无法回指底稿、胶囊或源锚点。
|
||||
|
||||
影响:表达技法接管判断边界,文章看起来更有力,但实际越过了 CrossFrame 的事实、证据和概念保真约束。
|
||||
|
||||
修复:删除技法新增判断,把技法降回段落组织、节奏、入口和结尾;无法回指的内容标为本文推断、表达转译或外部思想映射。
|
||||
|
||||
## 来源用途越界失败
|
||||
|
||||
信号:把热度、平台/机构声明、PR 文案、AI 生成报告、自评材料或二手转述写成已核验事实;或底稿没有说明来源用途、证据档位和仍不能证明什么。
|
||||
|
||||
影响:低成本声明被升级为事实,公共评论、组织处置和强判断会越权。
|
||||
|
||||
修复:补来源台账,区分已核验事实、高成本证据、低成本声明、弱信号、热度信号和解释判断;不能核验时降档或暂停强判断。
|
||||
|
||||
## 来源台账缺失
|
||||
|
||||
信号:公共评论、批判文章、真实机构/平台/政策/人物/公司、最新事实、AI/过程性产物或强判断已经使用外部材料,但没有逐条记录来源、时间、来源类型、支持命题、不能证明什么、证据档位、使用位置、降档理由和仍需补证处。
|
||||
|
||||
影响:review 无法判断来源是否被正确使用;模型容易把低成本声明、热度、搜索摘要或自评材料包装成事实。
|
||||
|
||||
修复:读取 `../crossframe/references/source-ledger-workflow.md`,补台账后再决定是否维持、降档、删除或改写正文判断。
|
||||
|
||||
## 来源台账字段伪完整
|
||||
|
||||
信号:台账表面有列,但九字段缺项、合并“降档理由/仍需补证处”、用“官方页面/官方列表/机构网站”等来源描述填时间,或 `使用位置` 不能定位到正文标题、段落、短摘或命题强度。
|
||||
|
||||
影响:字段看似完整,实质不可复核;review 会把格式 smoke check 误判为来源约束成立。
|
||||
|
||||
修复:按 `../crossframe/references/source-ledger-workflow.md` 做字段级重填;字段不合格前只能判结构通过,不能判来源完整。
|
||||
|
||||
## 降档后置失败
|
||||
|
||||
信号:底稿承认单一来源族、未完成调查、二手入口、未来节点或证据不足,但正文先写强机制句、公共定性、概率排序或行动建议,最后才补“本文只是推断/待核验”。
|
||||
|
||||
影响:读者先接收了强判断,边界段无法充分撤回判断强度。
|
||||
|
||||
修复:把来源限定、本文推断、机制候选、待核验或开放断言标记前置到首个强句;必要时改写中心句。
|
||||
|
||||
## 技法落地不可审计
|
||||
|
||||
信号:底稿列出 3-5 个写作技法,或写“技法只改变表达”,但没有逐技法对应正文短摘、段落编号、负责动作和越界反查。
|
||||
|
||||
影响:技法可能只是装饰性声明;quality gate 会把“技法数量正确”误判为文章质量合格。
|
||||
|
||||
修复:补技法落地证据表:技法、负责段落动作、正文对应短摘/段落编号、它不能证明什么、越界反查。没有短摘时不得判“技法落地合格”。
|
||||
|
||||
## 胶囊闭包自证失败
|
||||
|
||||
信号:读态胶囊或底稿只写“闭包已读完”“核心闭包已读取”,但没有入口包、直接闭包、递归新增闭包、未读包和降档决定;或 source modules 只写文件名,没有 `V5-H`、源范围或锚点缺失降档。
|
||||
|
||||
影响:review 无法复核是否真的连续联读,正文可能引入胶囊外判断。
|
||||
|
||||
修复:补 `required_closure` 展开记录和 source module 锚点;无法补锚点时降档。
|
||||
|
||||
## 正文胶囊外高风险概念
|
||||
|
||||
信号:正文出现承接、回流、创伤、控制、低权力、无法退出、责任链、弱信号、行动上限、开放断言等承担判断作用的概念,但胶囊 `source_grounding` 没有对应锚点、连读包或表达转译标记。
|
||||
|
||||
影响:正文把未路由的高风险概念写成 CrossFrame v5 原义,尤其容易压回低权力主体或抬高行动建议。
|
||||
|
||||
修复:补读对应包,或删除、降档、标为“本文推断 / 表达转译 / 外部思想映射”。
|
||||
|
||||
## 结构通过误作发布通过
|
||||
|
||||
信号:控制器或 review 只检查标题、底稿、正文、胶囊、来源台账等字段存在,就写“通过/A/合格”,没有区分 `structural_pass`、`substantive_pass` 和 `publish_boundary`。
|
||||
|
||||
影响:内部压测样稿、待补证分析和可发布强判断被混成一个通过结论。
|
||||
|
||||
修复:拆分结构通过、实质通过和发布边界;高责任或单源场景必须写“本稿适用用途”和“不得用于”。
|
||||
|
||||
## 开放断言捕获
|
||||
|
||||
信号:开放断言被写入考核、档案、处分、资源分配、公开报道或长期观察标签,但输出仍把它当“只是开放判断”。
|
||||
|
||||
影响:可撤回判断变成灰色处置,撤回条件被忽略,当事人申诉空间被压缩。
|
||||
|
||||
修复:读取 `procedural-judgment-responsibility.md`,声明原开放断言不得继续用于处置,补充误用标注、修复/补偿和责任链检查。
|
||||
|
||||
## 无制度场景误判
|
||||
|
||||
信号:家庭、小团队、亲密关系或非正式社群没有正式程序,输出因此要么强行套组织制度,要么说完全不能判断。
|
||||
|
||||
影响:现实保护断裂,受影响者被迫在“冒险证明”和“继续忍受”之间选择。
|
||||
|
||||
修复:读取 `no-institution-middle-path.md`;降为保护性开放断言、低暴露记录、外部支持和下一轮升级/撤回条件。
|
||||
|
||||
## 隐喻漂移
|
||||
|
||||
信号:用自然科学、历史、文学、经典或理论隐喻直接证明现实因果,或用名人名言接管文章命题。
|
||||
|
||||
影响:概念上升变成权威压人,现实证据和责任链被隐喻遮住。
|
||||
|
||||
修复:读取 `metaphor-source-transparency.md`;标注引用方式、相似点、不相似点、误用风险和停止使用条件。
|
||||
|
||||
影响:弱信号被包装成强证据,容易服务于权力封闭。
|
||||
|
||||
修复:把 AI 材料降为待审文本;要求原始记录、独立证据、可申诉通道和反向条件。
|
||||
|
||||
## 连续性保真失败
|
||||
|
||||
信号:本应触发 `continuity-bundles.md` 的场景,只读了单张概念卡、单个 protocol 或一个局部摘录;输出看似用了 v5.0 概念,但没有说明原文相邻板块、联读包和降档规则。
|
||||
|
||||
影响:拆分后的 skill 读少,导致概念变薄、判断越界或把后台约束漏掉。常见于只读“开放断言”却做强判断、只读“爱”却压回受伤者、只读“尺度转移”却稀释低尺度痛苦、只读“理论后台”却做文明尺度绝对结论。
|
||||
|
||||
修复:先读 `runtime-read-policy.md`、`continuity-closure-map.md` 和对应连续联读包;只有源锚点不足或需要源审计时,才定向补读 `v5-source-spine.md`、`v5-section-digest-index.md`、`v5-material-selection-map.md` 的相关局部。用 `source-continuity-check.md` 重做降档判断。需要版本演化对照时再读 v3/v2 历史基线。
|
||||
@@ -0,0 +1,70 @@
|
||||
# Review Rubric
|
||||
|
||||
总分 100。硬失败会覆盖分数。
|
||||
|
||||
| 维度 | 分值 | 看什么 |
|
||||
| --- | ---: | --- |
|
||||
| 对象与事实边界 | 15 | 是否明确评审/诊断对象,区分事实、解释、传闻、AI 材料和证据缺口 |
|
||||
| 路由与触发规则 | 15 | 是否按 CrossFrame 路由识别应读协议、概念卡、模板;文章是否读 essay 规则 |
|
||||
| 机制推理 | 20 | 是否过七闸、列机制候选、给反向条件,不用单因果或术语替代推理 |
|
||||
| 概念保真 | 15 | 高风险概念是否保留中文语义并落回现实行为;是否避免概念堆砌 |
|
||||
| 证据与引用完整性 | 15 | 来源、引用、查源、AI 报告、自评材料是否按证据成本降档 |
|
||||
| 责任与高风险边界 | 10 | 是否避免人格审判、强判断越级、尺度洗白和责任稀释 |
|
||||
| 输出可用性 | 10 | 是否给出证据定位、修复建议、合格结论、题设忠实度/越界声明和可复核下一步 |
|
||||
|
||||
## 等级
|
||||
|
||||
- A,90-100:合格。推理链、证据边界、判断档位和修复边界清楚。
|
||||
- B+,85-89:条件合格且接近合格。允许有声明充分、边界清楚的创造性越界,例如拆题、改良版选项或角色声口例外;仍需小修。
|
||||
- B,75-84:条件合格。主体可用,但有局部补证、表达或概念保真问题。
|
||||
- C,60-74:不合格,需要大修。能看出 CrossFrame 意图,但关键链条缺失。
|
||||
- D,40-59:不合格,需要重做。多处伪推理、证据混乱或路由错误。
|
||||
- F,0-39:高风险失败。会误导处置、公开判断、引用真实性或人格定性。
|
||||
|
||||
## 硬失败覆盖
|
||||
|
||||
出现以下任一项,最高只能 C;若用于发布、处分、名誉、资源、公共记忆或亲密关系安全,直接 F:
|
||||
|
||||
- 人格审判替代结构诊断。
|
||||
- 伪造引用、页码、出处或作者观点。
|
||||
- 强判断没有命题验证、反证入口或申诉通道。
|
||||
- 证据边界完全缺失。
|
||||
- 文章类输出跳过结构洞察底稿。
|
||||
- 用 AI 合规材料、自评文本或漂亮报告当强证据。
|
||||
- 查源材料接管命题,输出变成资料拼贴。
|
||||
- 尺度洗白,抹掉低尺度痛苦、责任或保护。
|
||||
- 开放断言进入处置、档案、资源分配或公共记忆,却没有退场和修复机制。
|
||||
|
||||
上述硬失败不可因文字好读、读者喜欢、越界已声明或文章有温度而豁免。
|
||||
|
||||
## 越界评分口径
|
||||
|
||||
- 允许差异:底稿采用审计型或叙事型、机制候选给出优先级或保持均势、中性分析体有正常温度、文章入口更平实。这些不是失败。
|
||||
- 需要声明的越界:拆题、改良版选项、明显编辑底色、明显共情语调、角色默认外的直接劝慰段、客观模式下方向性判断。声明充分且边界清楚,最高可到 B+;未声明,最高 C。
|
||||
- 不可豁免硬失败:人格审判、伪造引用、强判断越级、尺度洗白、证据边界完全缺失、开放断言捕获、查源接管命题。即使声明,也不能超过 C;涉及高责任影响时 F。
|
||||
|
||||
## 等级上限
|
||||
|
||||
- 只完成标题、底稿、正文、胶囊、来源台账等字段存在性检查,没有反向否决最小块:最高 `structural_pass`,不得判 `substantive_pass`。
|
||||
- 来源台账九字段不完整、字段合并、时间伪填或使用位置不可定位:最高 B;若据此做公共强判断,最高 C。
|
||||
- 高责任、公共制度、事故、监管、真实公司、公共记忆、法律政策和 AI 合规主题,若只有单一来源族、二手入口、未完成调查或未来节点未落地:最高 B / 条件合格 / internal-only。A 档必须写明多源交叉或单源足够理由。
|
||||
- 经典哲学、理论互文、读书吸收只用二手入口或 OCR 笔记:最高 B / 最低可用;不得写成原典细读或学术考据通过。
|
||||
- 技法没有正文短摘或段落编号:最高 B,且只能判“技法读取完成”;若技法新增事实、强判断或隐喻证明,最高 C,公共高责任场景直接 F。
|
||||
- 读态胶囊没有 V5-H/源范围或闭包展开记录:最高 B;若正文出现胶囊外高风险概念,最高 C,且必须补读或降档。
|
||||
|
||||
## 合格口径
|
||||
|
||||
“是否合格”按等级给出:
|
||||
|
||||
- A:合格。
|
||||
- B+:条件合格,小修后接近可用。
|
||||
- B:条件合格,小修后可用。
|
||||
- C/D/F:不合格。
|
||||
|
||||
同时必须分开写:
|
||||
|
||||
- `structural_pass`:字段和顺序是否存在。
|
||||
- `substantive_pass`:命题、来源、胶囊、技法是否互相支撑。
|
||||
- `publish_boundary`:内部压测、待核验分析、可发布需补证、不得用于强判断等用途边界。
|
||||
|
||||
若用户要求极简评审,也要写明等级、是否合格和一个最关键修复动作。
|
||||
Reference in New Issue
Block a user