文档 AI 层 · FUAI 信任自适应域宽
信任自适应域宽
这是 S2 的落地方式。核心主张只有一句:域宽不是一个配置项,而是一个测量结果。质量台账记录模型在语义金标上的表现,两个阈值 τ_low 与 τ_high 把质量分成三段,域宽随之变化;放宽需要连续 K 次确认,不是一次好成绩就能换来的。
45 / 35
τ_high / τ_low(FujoOS 默认)。LinuxFUAI 默认 46,作为部署参数登记,不是接口差异。
[0.429, 0.454)
τ* —— 语义金标 v2 口径下重推导的信任阈值区间(旧口径为 [0.369, 0.534))
5.01×
R(0.70) —— 0.70 覆盖率下的风险比,由 13 个本地模型的 β 重测得出
13 × 280
模型数 × 金标例数。0.5B–9B、7 个家族,含留一模型交叉检查。
测量链上的修正是可查的,不是修辞
| 事件 | 结果 |
|---|---|
| 语义金标 v2(280 例,含反 E1 自证) | phi3:mini 的 β 从 1.00 崩到 0.00——实证了旧口径的缺陷,而不是把它当成噪声忽略。 |
| G/B 重分层 | B = {llama3.2:1b, 0.5b, phi3:mini} |
| τ 声明重标定 | τ_high 46 → 45(落入 v2 区间内) |
| W46 反证响应 | 发现最伤人的弱点不是机制被绕,而是数字口径不可查;一键复现包由此成为硬要求。 |
一条自我约束:τ 不重开
τ 的重启条件只有两条:出现真实的部署损失记录,或者语义金标本身发生变化。这条规矩针对的是一个很常见的自欺——看到阈值不合意就回去调测量口径。把重启条件写死,等于提前放弃那次调参的机会。