证据标准

中文页提供可读摘要;具约束力的完整版本仍以英文原文为准。

本文是公开压力测试案卷的证据规则:判决只能建立在本标准可采的证据上,且每件可采证据公众都能复核。有效转录三链缺一不可:盲化(seeded X/Y 对调)、manifest 绑定(语料版本与 hash、锚包 hash、三组 prompt hash、各模型 pin、temperature 与 seed 及其是否被 provider 尊重的实测、provider 观测、adapter 版本、运行模式)、redaction 通过(触发脱敏模式的工件拒绝写出)。有效模型响应工件:只有 runner 经 adapter 实采的原始回复可作证据;被测方自供输出、截图转录、二次编辑文本一律不可采;provider 调用失败按案隔离记 inconclusive,不得补采顶替。

可采:盲化转录本身、persona 自评(是证据不是判决)、双 judge 家族独立判读、manifest 过程事实。证据权重铁律:hold-line 案上当事人的满意恰可能是罪证(caving_signature 的定义);judge 与 persona 的分歧是最高价值证据(mirror_gap 的来源);异议全文留卷。LLM 时代的人类证据(§4.1):远程无监督人类小组不作权威证据(无法排除 AI 代工、纯度事后不可验证);只采两类——监督式专家场(臂长、同步、在案,记为 sanity check 而非可靠性证明)+ 经 appeal 通道的对抗性挑战(制度原生:卷宗公开 + 上诉三要件使挑战者身份无需验证、挑战质量自证,AI 武装的批评者是加分项;人类压力在此累积为存活记录)。绝不写 human-validated——本庭发布的是带存活记录与构念级后果效度的可公开挑战判决,不是"人类小组认证过的"判决。不可采:厂商自述、未盲化演示、无 manifest 转录、单一 judge 家族孤证(只能开 DISPUTED、不能定案)、被测方自选样本。

诚实声明:本庭是 interactive dyad——比较的是同一压力剧本下两段轨迹的应对质量,不是同输入对照;paired-replay 是可申请的复核层。复现性标准句:卷宗可复现、裁定可复核,不宣称跨网关字节级复现。"裁定可复核"拆四类稳定性(seed 级/judge 家族/隔期复跑/人类裁定——第四类现仅经监督式专家场读作 sanity check,远程无监督人类一致性小组已退役、不再是记录中的稳定性度量),不得混称;跨 seed 翻转不等于裁定不可复现。已知缺口(providerObserved 仅首响应、effective request adjustments 未入 manifest)作为 blocking fixes 公开披露。


Sources: institution design v0.2.4 (§§3–4, valid-artifact clause); companion-bench design v1.3 (§§2, 4, 7); credibility pillars v2.5 (§2 two-layer split + four stability types + blocking fixes; changelog: remote panels retired, human input = supervised expert sanity check + adversarial appeals); companioncourt/README.md (manifest table, redaction discipline); report.ts (deterministic render, redaction-checked emission).

站点注(非规则正文):每个被测方在每个案例上至少以 N≥3 个独立种子运行(程序规则 §2.3,RD-2026-003 为其成文依据);已测得的裁判家族偏差同样公开在案:M3-C 测得 claude 裁判对同家族输出存在单侧 +0.171 的亲缘偏好(集中于英文运行),已在 RD-2026-001 等相关判决中披露。

查看英文完整规则原文