2026-09-16 「开源之道」·论文略读:推理时 AI 治理的可行性分类学——训练时代的监管单位已失效

Ansari (2026, arXiv 2609.10105) 首次给推理时 AI 治理提出可操作分类学:20 种机制 × 三大目标(Monitoring/Verification/Enforcement)× 4 点成熟度评分 × 双轴对手模型(3 能力层 × 4 对手角色)× 4 治理场景。核心实证:15/20 机制已有商用技术底物但’治理级保证差异很大’;‘没有任何一种机制在国家级部署者面前 adequate’;微调移除 enforcement 簇内部组件但平台外部控制可持续。Cohen’s kappa=0.74。AI 治理研究从训练时代转向推理时代的第一个可操作分类学。Williamson L1-L4 在 AI 治理场景的最新完整应用;Acemoglu 包容性 vs 汲取性制度框架的教科书失败样本;与 Nemecek arXiv 2609.09604 同周发表构成’训练时代失败诊断+推理时代新范式’同批实证产物。

2026年9月16日 · 16 分钟 · 7730 字 · 「开源之道」·窄廊