评估:fail-closed自我置信度独立校验(ADR-0016,全ADR对抗审查组G③) #187
Loading…
Add table
Add a link
Reference in a new issue
No description provided.
Delete branch "%!s()"
Deleting a branch is permanent. Although the deleted branch may continue to exist for a short time before it actually gets removed, it CANNOT be undone in most cases. Continue?
来源
全量32条ADR设计合理性对抗审查(评估侧内部执行,2026-08-21),组G·架构/触发管线设计缺口。经独立agent对抗式反驳后确认成立。
问题
ADR-0016(reference resolution)的 fail-closed 机制完全依赖同一次 LLM 调用对自己"该不该给出 resolved_subject"的自我置信度判断,没有任何独立校验或语料标定。对 events/relations 这两类写入目标(与 profile 不同,它们没有 ADR-0009"tentative→confirmed"这类事后纠错缓冲),一旦这次自我置信度判断本身错了(该fail-closed时没触发,或不该fail-closed时误触发),后果没有二次挽回机会。
需要评估的问题
占位标题-稍后回填-09to 评估:fail-closed自我置信度独立校验(ADR-0016,全ADR对抗审查组G③)grill后补充核实(暂不改变票的状态,记录现状供后续参考):
原票提出的两个评估方向,核实后都不是"现成可选":
置信度阈值方案:全仓搜索确认没有任何"LLM结构化输出数值置信度+阈值"的先例——现有的confidence/score字段(gating.py的
level1_score、向量相似度阈值、tier2_significance_score等)全部是本地计算或向量库返回值,不是模型自报的。新增这类阈值还要过ADR-0011的治理方法论(标定方法:收真实QQ决策快照→离线回放调),项目从未部署,标定环节结构性走不通——与ADR-0005 grill时发现的"标定承诺无兑现路径"是同一个问题。tentative/confirmed缓冲方案:核实发现引用的参照系统(ADR-0009 profile的tentative→confirmed自动晋升通道,issue #175 grill定案)本身还没有落地——issue #175/PR #177只改了docs,全仓 grep
auto_promoted|hit_count|last_hit|promot零代码命中,实现票 #175 目前仍是"状态:智能体就绪"、未被实现。events/relations当前也确认没有任何中间态字段(EventRecord/RelationshipEdge均无status/tentative字段),若要套用不是"复用现成机制",是要连存储结构一起新建。本票被 #175 事实阻塞:#175落地前,"给events/relations引入类似机制"这个方向连参照实现都不存在,无法有意义地评估细节。维持"待评估"状态,不开实现票也不关闭,留待 #175 完成后再回头看这个方向是否可行。