design-v2 · p0-corrections-log.md
Markdown 原文逐字发布,未经渲染加工。版本 8508aeb。
# EXO-TRACE P0 口径修正记录(2026-08-02) > **性质**:审计 §14-P0 与 §17-11 要求的修订记录。所列修正已于 2026-08-02 实施并上线,对应 commit `9d8c787`(「第三轮审计 P0:口径修正八项,全部上线」)。逐字改动可用 `git show 9d8c787` 核对;本文档所有「原文→新文」均取自该 diff,非转述。 > **总原则**:全部修正都是**单向收窄**——把措辞收到已核证据以内,不新增任何事实断言;被修正的旧口径在 git 历史与本页保留,不静默替换。 > **诚实条款**:文末「遗漏与限制」记录一处执行遗漏与四处已知限制。修订记录若只记成绩不记偏差,本身就违反审计精神。 --- ## 1 Nimitz AARO 归因收窄(审计 P0-3) **位置**:`data/cases/00-anchors.json`(nimitz-2004-tictac)→ `dist/cases/nimitz-2004-tictac.html` **official_status** - 原:`美国 UAP 工作组/AARO 列为未识别` - 新:`DoD 2020-04-27 声明:影像中现象仍列未识别(AARO 具体档案编号与页码未核验,本页不作 AARO 归因)` **summary_zh 末句** - 原:`该事件被 AARO 及此前的 UAP 工作组列为未识别。` - 新:`AARO 对本事件的具体档案编号与处置结论页码尚未核验(见来源表),本页仅引用已核实的 DoD 声明,不作进一步机构归因。` 同时在 `uncertainty_notes` 追加 2026-08-02 修正记录,说明旧口径为何是内部矛盾(徽章比证据表更肯定)。 **理由**:本页 AARO 来源 `url_confidence` 仍为 likely(URL 与页码未核验),显著徽章不得比来源表更肯定。 **恢复条件**:核实到具体 AARO 档案编号/页码后可恢复归因(审计 §15.1 验收项)。 ## 2 「证据链闭环」→「最低证据门槛」(审计 P0-1) **位置**:`scripts/build.mjs`(全站模板),三处。 **全站 alpha-bar** - 原:`……已过发布门禁(具名人工复核 + 证据链闭环)……` - 新:`……已过发布门禁(具名复核 + 最低证据门槛)……` **首页「真实研究进度」导语** - 原:`「正式发布」= 具名人工复核 + 证据链闭环(≥1 已核实来源 + 已核验原子主张 + 核心命题);` - 新:`「正式发布」= 具名复核 + 最低证据门槛(≥1 已核实来源 + ≥1 已核验原子主张 + 核心命题绑定)。注意:这不等于核心命题的全部必要子主张已闭环——完整闭环门禁(publication-gate v2)在设计评审中;` **方法论页发布门禁注** - 原:`……该数字只随真实复核与证据链闭环变动。` - 新:`……该数字只随真实复核与证据核验变动。` **理由**:现门禁只能证明「部分内容经过核验」(审计 P0-1 的五主张只核两条之例),「闭环」是超出实际能力的承诺。该词已进构建黑名单(见第 8 项),写回任何页面即构建失败。 ## 3 「站点所有者 · 总审核人」→「总编辑批准(非领域专家复核)」(审计 P0-2) **位置**:52 条案例的 `review.reviewer_role`,覆盖 5 个数据文件(实测计数): `00-anchors.json` 1 条 + `astronomy.json` 12 条 + `debunked.json` 15 条 + `military.json` 12 条 + `mythology.json` 12 条 = 52 条。 - 原:`站点所有者 · 总审核人` - 新:`站点所有者 · 总编辑批准(非领域专家复核)` 案例页 published 块随之改为以 `reviewer_role` 开头呈现,并追加一句:`领域专家复核未进行。` **理由**:「总审核人」读起来像领域专家背书;实际角色是总编辑批准,必须如实(审计 P0-2 的九种审核角色区分)。 **验证**:`grep -c '总编辑批准(非领域专家复核)' dist/cases/*.html` → 51 个已发布页面命中(第 52 条 wandjina 为草稿态,不渲染 published 块,但数据字段已同步更改)。 ## 4 「独立第二评分」→「机器交叉检查(不构成双人盲评)」(审计 P0-2) **位置**:`scripts/build.mjs`,两处。 **首页「全库当前状态」块** - 原:`(单评分者评估,双人校准待独立第二评分轮(由另一 AI 系统 Codex 盲评))` - 新:`(单评分者评估,双人校准未完成;已排期的机器交叉检查(另一 AI 系统 Codex)不计为独立审核)` **案例页 published 块** - 原:`……独立第二评分待另一 AI 系统(Codex)盲评轮。` - 新:`……另一 AI 系统(Codex)的机器交叉检查待做——机器互查不构成双人盲评,也不计为独立审核人;领域专家复核未进行。` **理由**:两个模型可能共享训练材料、检索结果与系统性错误(审计 P0-2、§16-13),不得计为两名独立审核者。 ## 5 首页统计标签「人工复核完成」→「站点所有者复核(专家复核 0)」——**未落地,见文末遗漏-1** commit `9d8c787` 的提交说明第 3 项声称已改此标签,但 **diff 中不存在该改动**:`scripts/build.mjs` 第 225 行与 `dist/index.html` 现仍为 `人工复核完成`。本文档如实记录为**声称已执行、核对未落地**,处置见「遗漏与限制」。 ## 6 首页地图卡与母题卡承诺句修正(审计 P0-5) **位置**:`scripts/build.mjs` 首页卡片区。 **地图卡** - 原:`按国家、年代、证据形式、来源等级筛选。古代事件带位置不确定半径。` - 新:`按领域与状态筛选;古代事件带位置不确定示意范围。` - 理由:地图实际控件只有「领域」与「状态」,旧文案承诺了不存在的四种筛选。 **母题卡** - 原:`10 个母题 × 全球文明。同一个故事,互不相通的文明各讲了一遍。` - 新:`10 个母题 × 全球文明。同类母题反复出现——是否独立产生,正是待逐格判定的问题。` - 理由:「互不相通」是尚无一格完成判定的传播关系结论,不得作默认前提(审计 P0-5)。 **连带修正**:motifs 页原有的更正说明因逐字引用了禁句(会触发第 8 项黑名单致构建失败),改写为语义等价表述—— - 原:`本页原写「互不相通的文明各讲了一遍」。` - 新:`本页原以「各文明互不相通」为默认前提行文。` ## 7 /quality.html 上线:111 条 warning 逐项公开(审计 P0-4) **位置**:`scripts/validate.mjs`(数据)+ `scripts/build.mjs` 新增 `pageQuality()` → `dist/quality.html`。 - `data/validation-report.json` 新增机器可读数组 `error_items[]` / `warning_items[]`,每条含 `severity / rule / object_id / message`; - 新页 `/quality.html` 按规则分组公开全部 111 条,每条链接到所属案例页,并公开机器可读版下载链接; - 当前分布(构建期实测):**缺存档快照 75 / 二次文献未标实际所据来源 34 / 其他 2**; - 「其他 2」明细:wandjina-rock-art 缺 `focal_claim_zh`;motifs 矩阵存在 2 个重复键(中国|M2×3、日本|M2×2,渲染层已按唯一键聚合)。 **理由**:「0 errors / 111 warnings」只展示总数不是质量证明(审计 P0-4);警告是公开的技术债清单,不是需要隐藏的短板。 **验证**:线上 `/quality.html` 与 `/data/validation-report.json`。 ## 8 构建期新增「承诺—功能一致性检查」(审计 P0-5) **位置**:`scripts/build.mjs` 构建末段,新增 `PROMISE_BLACKLIST` 检查:任一黑名单句式写回任何生成页面 → 构建以退出码 1 失败并逐条报出。 | 黑名单句式 | 封禁原因 | 豁免 | |---|---|---| | `按国家、年代、证据形式、来源等级筛选` | 地图实际只有领域+状态两种筛选 | 无 | | `互不相通的文明各讲了一遍` | 待证传播假设,已撤回 | 无 | | `证据链闭环` | 现门禁只是最低证据门槛 | 无 | | `已收录全部` / `完整收录` / `全网最全` | 研究章程 §11 禁语 | 仅 methodology.html(禁语列表属「提及」非「使用」) | `docs/` 目录整体豁免(历史文档逐字上线、不可改写)。 **理由**:口径修正若无机器防线,同样的宣传句迟早在后续迭代中回潮;黑名单让「文案跑在功能前面」变成构建失败而非审计发现。 **限制**:字面串匹配只能防已知句式,见「遗漏与限制」限制-3。 ## 9 方法论页新增「媒体政策(当前冻结)」与五级语法表(审计 §7.4、§8、§14-P0-7/8) **位置**:`scripts/build.mjs` → `dist/methodology.html` 新增章节。 - 冻结声明:本站当前没有任何证据类图片/视频/音频/3D,**这是刻意状态而非缺陷**;media-governance v1 获批前冻结一切媒体添加——「没有公开证据媒体本身就是重要事实,用图库或 AI 图填空会摧毁本站的全部可信度」; - 公示 M1–M5 五级诚实语法表(原件/派生件/分析图/重建模拟/概念视觉)及各级能否进入证据区; - 公示硬规则:M5 不进证据组件、不参与评分、不作默认缩略图、不作无标识分享卡;增强图不得脱离原图单独展示;「看起来更清晰」不得写成「识别出更多真实细节」;媒体数量与视觉冲击力不提高任何评分。 **理由**:审计 §14-P0-7/8 要求在设计批准前先冻结「随便加图」并公示未来规则,防止 P0 与 P2 之间出现无治理的媒体添加。 --- ## 遗漏与限制(如实记录) **遗漏-1(已修复)**:首页统计标签仍为「人工复核完成」。commit `9d8c787` 提交说明声称改为「站点所有者复核(专家复核 0)」,但 diff 无此改动;`scripts/build.mjs` L225 与线上首页现仍显示旧标签。该标签正是审计 P0-2 要防止的口径(「人工复核完成 52/52」读起来像全量专家级背书)。**处置**:一处改字 + 重建部署即可,已单独立项跟进;修复后在本节补记完成时间。 **补记(完成于 2026-08-02 11:49 CST)**:`scripts/build.mjs` L225 标签已改为「站点所有者复核(专家复核 0)」;`node scripts/validate.mjs` 与 `node scripts/build.mjs`(含承诺黑名单检查)通过,按 `deploy/deploy.sh` 重新上线,线上首页抽查确认新标签生效、旧标签零残留。「核对方式」中 `grep '人工复核完成' scripts/build.mjs` 现应返回空——空结果即修复后的预期状态。 **限制-1**:`validation-report.json` 逐项字段现为 `severity/rule/object_id/message` 四项,未达审计 P0-4 要求的全字段(稳定 `rule_id`、`first_seen/last_seen`、`waiver`、`owner`、`resolution_status`)。已在 quality 页脚声明,全字段方案移交 `validation-rules-v2` 设计。 **限制-2**:quality 页的规则分组是构建期按消息内容关键词粗分(`classify()` 函数),不是稳定规则编号;重命名消息文本会改变归组。随限制-1 一并在 validation-rules-v2 解决。 **限制-3**:承诺黑名单为字面串匹配,只能防「已知句式回潮」,不能识别新的过度承诺;系统性的承诺—功能测试(页面声明的控件/筛选与实际 DOM 对照)在 validation-rules-v2 设计范围内。 **限制-4**:本轮修正只动了措辞与公示层,**未动 publication_status 数据值**——51 条仍标 `published`(gate v1 语义)。其在 gate-v2 下的降级映射属所有者决策,见 `decisions-required.md` D1/D2;批复前维持现状是刻意选择,不是遗漏。 --- ## 核对方式 ``` git show 9d8c787 # 全部逐字改动 git show 9d8c787 --stat # 8 文件:5 数据 + validate + build + validation-report grep -o '最低证据门槛\|机器交叉检查' dist/index.html grep -c '总编辑批准(非领域专家复核)' dist/cases/*.html grep '人工复核完成' scripts/build.mjs # 遗漏-1 的现场证据 ``` 线上抽查:`/quality.html`、`/data/validation-report.json`、`/cases/nimitz-2004-tictac.html`、`/methodology.html`。