星光榜 / Victoria Krakovna
亮星详情 · 跨时代榜

Victoria Krakovna

已复评 · 红蓝通过 · 尚待认证(AI 辅助编目 · 评于 2026-07):已有可追溯的独立复评与红蓝通过记录,但尚未获得最终认证。页面中的小数和名次是当前输入在 HCF Canonical v1 公式下的草案排序,不代表证据达到同等精度;排名靠前不会自动获得认证。

V
Victoria KrakovnaVictoria KrakovnaT4 · 亮星
作为 DeepMind AI 安全团队的主要共同作者,开发用于检测安全行为的 gridworlds,并系统整理 specification gaming 失败案例。
星光编号SL-4438
星阶T4 · 亮星
年代 / 领域— · 作为 DeepMind AI 安全团队的主要共同作者,开发用于检测安全行为的 gridworlds,并系统整理 specification gaming 失败案例。
状态已复评 · 红蓝通过 · 尚待认证

文明贡献与代表成果

核心贡献

作为 DeepMind AI 安全团队的主要共同作者,开发用于检测安全行为的 gridworlds,并系统整理 specification gaming 失败案例。

作用机制 · 论文、代码与案例库都为 DeepMind 多作者工作;本人是署名主要作者,不称独立提出。

这分是怎么落桶的 · 计分卡

已复评 · 红蓝通过 · 尚待认证分档口径:极高 / 高 / 中 / 低 / 微。没点亮的桶亮度算 0、只加不减,不拖后腿也不当负分。
认知与真理
把奖励钻漏与规范失效整理为可分析、可测试的 AI 安全问题。
可持续与文明安全
对当代 AI 安全研究有方法价值,尚未证明已防止高后果事件。
生存与健康
二评未提出可独立计分的直接贡献;Canonical v1 整桶置零。
能力与生产力
二评未提出可独立计分的直接贡献;Canonical v1 整桶置零。
协作与治理
二评未提出可独立计分的直接贡献;Canonical v1 整桶置零。
文化价值与意义
二评未提出可独立计分的直接贡献;Canonical v1 整桶置零。
桶亮度相加,一句人话:每桶分数先换成亮度(b = 10G/2 − 1,分越高亮度涨得越快),六桶亮度相加成总光度,再压缩成对外分、落进星阶——所以偏科的支柱型贡献照样能站上高阶。公式本身 → 读这把尺
计分推导 · 五维明细全展开AUDIT · 可逐行复算
ISDUSpG = 五维几何平均
认知与真理653564.856
可持续与文明安全553454.317
生存与健康000000
能力与生产力000000
协作与治理000000
文化价值与意义000000

五维 = Impact 影响强度 / Scope 影响范围 / Duration 持续时间 / Uniqueness 不可替代 / Spillover 外溢,每维 0–10,五维相乘开五次方根——任何一维塌了都会拖低整桶,偏科救不了单桶。聚合层由脚本按现行尺确定性复算,不经人手。

来源 · 可查证