罗盘 / 权力锁定防范
暗星档案 · 未点亮的星

可逆治理与永久权力锁定防范

本条为初评草案(AI 辅助编目 · 评于 2026-07):T 阶为三问初评(撬动面 × 停滞度 × 临界性),双评过 σ 门并红蓝复核后才升"已建档"。查不到的字段留空不编。点亮者会进入亮星候选流程,其贡献与星阶按 HCF 独立重评,不从暗星自动继承。

可逆治理与永久权力锁定防范T6 量级 · 行星
防止 AI 赋能的全域监控把某个政权或价值观不可逆地"焊死",永久关闭人类文明的纠错能力。
暗星编号DS-0258
R · 风险与文明安全
领域civilization-safety
状态初评草案 · 待双评与红蓝复核
这是什么 · 为什么难

在明确法域内,形成可审计的权力集中/不可逆性指标;关键 AI 权限具有限定、可撤销、可回滚日志;至少由立法/司法/独立审计等两个以上主体复核;演练中单一领导或单一供应商不能绕过撤销与制衡。

卡在哪 · 机制级卡点

问题本身难以实证——锁定一旦发生就没有反例数据,事前研究只能靠机制推演;直接触碰现实政权的敏感神经,学术界和资助方都本能回避;且它横跨政治哲学、AI 治理、监控技术三个互不对话的领域,没有现成学科容纳它。

谁在攻

无人区(Forethought 等存在风险研究方向有零星探索,无系统性攻坚者)

怎么参与

读政治哲学/比较政治 + AI 治理的交叉,补上对监控技术栈的真实理解;进存在风险或 AI 治理研究机构;从可形式化的子问题切入,比如"监控-执行自动化程度的不可逆性指标"或"历史上极权衰亡机制的量化归因"。

谁在攻这颗暗星 · 攻关者名录7 人

这不是终点站——今天在这颗暗星上攻坚的人,就是明天点亮它、登上星光榜的候选。名录含科研、创业与第三方三类关键角色,初评待核实,欢迎补充与纠正。

ACADEMIA学界 · 科研7
威廉·麦卡斯基尔William MacAskill哲学家/长期主义研究者
牛津大学、Forethought 基金会创始人
在《我们欠未来什么》中把'价值锁定'(value lock-in)确立为核心存在风险议题,系统论证AI如何永久没收未来世代的纠错可能
托比·奥德Toby Ord哲学家/存在风险研究者
牛津大学
在《The Precipice》中将不可逆的权力与价值锁定列为文明尾部风险,推动其进入长期主义研究议程
尼克·博斯特罗姆Nick Bostrom哲学家
宏观战略研究计划(原牛津人类未来研究所)
在《超级智能》中提出'单一体'(singleton)概念,最早刻画全域监控加自动执行如何造成永不被纠正的权力结构
汤姆·戴维森Tom Davidson高级研究员
Forethought
主笔《AI-Enabled Coups》(2025),论证先进AI如何让极小群体或个人夺取并永久锁定全球权力,是本方向少有的系统性攻坚
卢卡斯·芬维登Lukas Finnveden研究员
Forethought
合著Finnveden-Riedel-Shulman(2023)关于AGI使价值/制度无限期锁定成为技术可行的研究,及AI-enabled coups报告
卡尔·舒尔曼Carl Shulman研究员
Forethought(相关研究合作者)
与Finnveden等合著AGI与锁定的技术可行性分析,探讨可逆性保全的制度与技术设计
罗丝·哈德沙尔Rose Hadshar研究员
Forethought
合著《AI-Enabled Coups》,研究AI驱动的权力集中的早期指标与制度防范

去哪家 · 机构与公司名录3 家 · 其中初创/成长期 0

给求职者和投资人的信息增量——不只是听过的大机构,更多是正在攻这颗暗星的初创与新公司(联网实搜、初创优先排序,初评待核实)。

来源 · 可查证