罗盘 / AI攻防失衡
暗星档案 · 未点亮的星

AI 网络攻防失衡 · 给旧代码世界穿上盔甲

本条为初评草案(AI 辅助编目 · 评于 2026-07):T 阶为三问初评(撬动面 × 停滞度 × 临界性),双评过 σ 门并红蓝复核后才升"已建档"。查不到的字段留空不编。点亮者会进入亮星候选流程,其贡献与星阶按 HCF 独立重评,不从暗星自动继承。

AI 网络攻防失衡 · 给旧代码世界穿上盔甲T5 量级 · 新星
AI 把漏洞挖掘成本压向零,而全球关键基础设施跑在亿万行陈旧代码上——防御必须先于攻击成熟。
暗星编号DS-0316
R · 风险与文明安全
领域ai-computing
状态初评草案 · 待双评与红蓝复核
这是什么 · 为什么难

电网、医院、银行、水务的软件栈里堆积着几十年的陈旧代码,过去它们靠「找漏洞很贵」这层经济护城河苟活。AI 正在拆掉这层护城河:自动化漏洞挖掘(如 Google Project Zero 的 Big Sleep 已用 LLM 找到真实零日漏洞)让攻击成本指数下降,而打补丁、重写、形式化验证的速度远远跟不上。这是一个有明确时间窗口的竞赛:如果自动防御(AI 自动修复、大规模形式化加固、内存安全语言迁移)不能先于自动攻击成熟,文明的数字地基会先被打穿。DARPA 的 AIxCC 挑战赛证明了「AI 自动找洞并自动修复」在技术上已经起步——但从竞赛原型到覆盖真实世界的亿万行代码,中间是整个未被攻克的战场。

卡在哪 · 机制级卡点

攻击只需找到一个洞,防御要堵住所有洞——AI 同等放大双方时天平天然偏向进攻。自动修复面临「补丁不能破坏原有功能」的正确性约束,比找洞难一个量级;形式化验证至今无法规模化到遗留系统;而关键基础设施的更新周期以十年计,部署速度本身就是卡点。

谁在攻

DARPA(AIxCC 人工智能网络挑战赛)、Google Project Zero(Big Sleep)、XBOW

怎么参与

读程序分析、模糊测试、形式化方法与 LLM for code 的交叉方向,复现 AIxCC 决赛系统的公开代码是最好的入门实战。进做自动漏洞挖掘/修复的团队(Project Zero 类研究组、AIxCC 参赛团队衍生公司),从「给一类真实开源基础设施组件做全自动找洞+修洞闭环」这个子问题切入。

谁在攻这颗暗星 · 攻关者名录8 人

这不是终点站——今天在这颗暗星上攻坚的人,就是明天点亮它、登上星光榜的候选。名录含科研、创业与第三方三类关键角色,初评待核实,欢迎补充与纠正。

ACADEMIA学界 · 科研2
金泰秀Taesoo Kim教授、Team Atlanta 队长
佐治亚理工学院 / 三星研究院
领衔 Team Atlanta,以自动漏洞发现-修复系统 ATLANTIS 夺得 AIxCC 决赛冠军,是「AI 自动攻防闭环」从原型走向真实开源系统的代表性攻关者。
尹寅秀Insu Yun教授、Team Atlanta 核心成员
韩国科学技术院(KAIST)电气工程学院
率 KAIST 研究团队参与 Team Atlanta,主攻模糊测试与自动化漏洞挖掘,是冠军系统 ATLANTIS 的关键技术贡献者之一。
INDUSTRY业界 · 创业与工程3
乌格·德·摩尔Oege de Moor创始人兼 CEO
XBOW
GitHub Copilot 与 GitHub 高级安全的创造者,创办自主渗透测试公司 XBOW,其 AI agent 于 2025 年登顶 HackerOne 全球排行榜——把「自动化攻击」这一侧的现实威胁具象化,反证防御侧必须提速。
谢尔盖·格拉祖诺夫Sergei Glazunov安全研究员
Google Project Zero
Project Zero「Naptime→Big Sleep」研究的核心作者之一,推动用 LLM 在真实代码中发现零日漏洞(如 SQLite),把 AI 自动漏洞挖掘从设想变为工程现实。
马克·布兰德Mark Brand安全研究员
Google Project Zero
与 Project Zero、DeepMind 合作研发 Big Sleep 这一 LLM 漏洞挖掘 agent,是「AI 找洞」侧真实成果(多个开源组件真实零日)的直接推动者。
THIRD PARTY第三方 · 政策/资助/倡导3
安德鲁·卡尼Andrew CarneyAIxCC 项目经理
美国国防高级研究计划局(DARPA)
作为 DARPA「AI 网络挑战赛」(AIxCC)项目经理,主持了这场证明「AI 能自动找洞并自动修洞」的旗舰竞赛,并推动决赛系统向真实基础设施部署。
凯瑟琳·费舍尔Kathleen Fisher计算机科学教授、AIxCC 发起时的 DARPA I2O 主任
美国国防高级研究计划局(DARPA)信息创新办公室 / 塔夫茨大学
在担任 DARPA 信息创新办公室(I2O)主任期间发起 AIxCC,把「用 AI 自动加固关键基础设施陈旧代码」立成国家级研究议程。
乔什·阿斯Josh Aas执行董事、Prossimo 内存安全项目发起人
互联网安全研究组(ISRG)
在创办 Let's Encrypt 的 ISRG 之下发起 Prossimo,系统性推动关键基础设施软件向内存安全语言(Rust 等)迁移——从根因侧削减「陈旧代码」的可攻击面。

去哪家 · 机构与公司名录6 家 · 其中初创/成长期 5

给求职者和投资人的信息增量——不只是听过的大机构,更多是正在攻这颗暗星的初创与新公司(联网实搜、初创优先排序,初评待核实)。

XBOW初创
2024 创 · C轮 $120M · 估值超 $10 亿(独角兽) · 美国旧金山
全自主进攻性安全平台,AI agent 自己发现、验证并利用漏洞,把渗透测试从「一次性」变成机器速度的持续测试。
↗ 创始人 Oege de Moor 正是 GitHub Copilot 与 GitHub Advanced Security 的缔造者;其 AI agent 2025 年 6 月登顶 HackerOne 排行榜、提交 1060+ 有效漏洞——攻击侧自动化已被商业化验证,正是这颗暗星「护城河被拆」的活证据。
Theori初创
AIxCC 决赛第三名($150 万奖金) · 美国 / 韩国
把 DARPA AIxCC 的 cyber reasoning 系统产品化为 Xint,对真实开源基础设施做自动找洞+修洞。
Xint 已在 Redis、Postgres、MariaDB、Python、Linux、苹果 XNU 内核等一线开源项目里实测挖到真实漏洞——是极少数把竞赛原型真正推向「亿万行遗留代码」战场的团队。
Reclaim Security初创
A轮 $2000 万(Acrew Capital 领投)
专注自动化网络漏洞修复/整改(remediation),补足「找到洞之后怎么快速修」的防御侧短板。
资本罕见地押注「修」而非「找」——正对应这颗暗星的核心判断:自动修复比自动找洞难一个量级、却是防御赢下时间窗口的胜负手。
Astelia初创
A轮 $3500 万(Index Ventures 领投)
AI 驱动的暴露面/漏洞管理(exposure management),帮组织在攻击成本骤降的环境里持续盘点并收敛风险敞口。
2024→2025 年 AI 安全赛道融资从 $21.6 亿飙到 $63.4 亿、近乎三倍,Astelia 是防御侧新钱涌入的代表标的之一。
Trail of Bits成长期
2012 创 · AIxCC 决赛第二名($300 万奖金)· 小型企业 · 美国纽约
老牌安全研究与审计公司,用 AI 自动漏洞挖掘+修复覆盖关键基础设施。
↗ 与美国卫生部(HHS)合作专攻医疗设备漏洞、已修复大量真实缺陷——正好命中「医院跑在陈旧代码上」这条防御侧最难啃的骨头。
Team Atlanta科研实验室
AIxCC 决赛冠军($400 万奖金) · 美国 / 韩国
由乔治亚理工、三星研究院、KAIST、POSTECH 专家组成的联合战队,做 AI 自动找洞+修洞的 cyber reasoning 系统。
AIxCC 头名,系统已开源;决赛全场 7 队在 5400 万行代码上平均每个任务只花 $152、45 分钟完成修补——这个「便宜到可规模化」的数据点是防御侧能否追上的关键锚。

来源 · 可查证