前沿 AI 国际治理机制 · 让能力曲线跑不过护栏
本条为初评草案(AI 辅助编目 · 评于 2026-07):T 阶为三问初评(撬动面 × 停滞度 × 临界性),双评过 σ 门并红蓝复核后才升"已建档"。查不到的字段留空不编。点亮者会进入亮星候选流程,其贡献与星阶按 HCF 独立重评,不从暗星自动继承。
前沿 AI 国际治理指对最强大 AI 模型的跨国评测、能力与风险报告、以及事故通报的制度安排。目前各国刚冒出 AI 安全研究所,但彼此的测试标准、信息共享和事故上报还没有形成有约束力的国际机制。它是文明级方向,因为前沿 AI 的能力增长比任何治理机制的建立速度都快,一旦出现跨国级失控或滥用,缺乏统一的预警与响应通道。攻破它,等于在能力爆发前把护栏先建起来。
机制级卡点:一是大国竞争——AI 被视为国家竞争力核心,谁都不愿把能力细节交给国际核查,treaty 级约束几乎无从谈起;二是能力核查难——模型能力难以从外部客观测量和验证,评测方法学本身还在早期,导致“可核查的治理”缺乏技术基础。治理速度结构性地落后于能力曲线。
各国 AI 安全研究所网络(英国 AISI、美国、新加坡等)、《国际 AI 安全报告》(Bengio 主持);跨国有约束力的评测与通报机制仍未成形
适合机器学习 + 政策交叉背景的年轻人,尤其懂模型评测(evals)的稀缺。可从“可核查的能力评测方法”这一子问题切入——这是整个治理的技术瓶颈,进某国 AI 安全研究所或参与国际 AI 安全报告的研究网络,把评测做成可跨国互认的底座。
谁在攻这颗暗星 · 攻关者名录7 人
这不是终点站——今天在这颗暗星上攻坚的人,就是明天点亮它、登上星光榜的候选。名录含科研、创业与第三方三类关键角色,初评待核实,欢迎补充与纠正。
去哪家 · 机构与公司名录6 家 · 其中初创/成长期 3
给求职者和投资人的信息增量——不只是听过的大机构,更多是正在攻这颗暗星的初创与新公司(联网实搜、初创优先排序,初评待核实)。