NB-0071Ⅺ · 公正之治 · 被善待与自治的渴望
AI摄政时代的宪法AI治理
在AI比政府更强大之前,写一部人类和机器都必须遵守的活宪法。
20颗暗星在攻
8.3潜能光度
4个方向
R前沿 AI 国际治理机制 · 让能力曲线跑不过护栏前沿模型的跨国评测、报告与事故通报制度尚未建立,治理速度追不上能力曲线——这是当代最紧迫的文明级减风险方向之一。T6 · 行星R前沿AI危险能力与保障评估把危险能力、现实伤害路径与绑定缓解动作变成可复测门槛。T6 · 行星RAI 算力的硬件辅助核验用防篡改认证核验高端 AI 加速器的状态、用量和合规声明。T6 · 行星RAI 评估科学 · 能力预测把「这个模型会什么、危险在哪」从事后发现变成部署前可预测的科学——AI 时代的风洞试验。T6 · 行星R算力核查 · 硬件层的 AI 治理机制国际 AI 条约要像核查核设施一样核查大规模训练——算力是 AI 中唯一可物理盘点的投入品,而核查机制只有论文没有工程。T6 · 行星R算法透明度与可问责的可执行标准 · 从原则宣言到可审计规范各国AI监管文件都写了'算法透明',但至今没有一套可实操的第三方审计标准T6 · 行星RAI芯片出口管制有效性博弈管制升级五轮,芯片还是能绕道流出T6 · 行星RAI agent 经济 · 机器间交易机制AI agent 之间自主签约、支付、交易正在发生,而身份、授权、责任的机制层几乎空白——先跑后立规的窗口正在打开。T5 · 新星R元伦理收敛 · 价值不确定性不同价值体系能否收敛、道德没有确定答案时该如何行动——AI 对齐与文明间冲突共同的上游难题。T5 · 新星R模型权重与算法机密安全让前沿 AI 模型权重扛得住国家级攻击者的窃取——AI 风险链条中最脆、也最被低估的一环。T5 · 新星RAI 网络攻防失衡 · 给旧代码世界穿上盔甲AI 把漏洞挖掘成本压向零,而全球关键基础设施跑在亿万行陈旧代码上——防御必须先于攻击成熟。T5 · 新星R政府算法决策的可解释问责政府用AI打分福利/风险时,公民有权知道凭什么被打了那个分T5 · 新星R多智能体合谋与对齐失衡单个AI很听话,一群AI凑一起可能会串通作恶T5 · 新星R安全关键系统的AI认证标准AI要开飞机、开车之前,得先有人敢签字担保T5 · 新星R政府AI采购强制算法影响评估政府买AI系统前,先强制算清楚它会伤害谁T5 · 新星R开源前沿模型发布的风险收益机制该不该把最强AI模型的权重直接公开下载T5 · 新星RAI系统跨国事故报告协调机制AI出了大事故,各国怎么第一时间知道该不该联手响应T5 · 新星RAI系统法律主体地位悬而未决AI闯了祸,谁来负责——现在的答案是"找个人来背锅"T5 · 新星A部署后分布漂移监测模型上线之后,世界变了它却不知道T4 · 亮星RAI生物设计工具风险评估 · 给AI划CBRN红线的度量衡在AI真能设计病原体之前,先把'多危险'量出个数