罗盘 / AI辅助同行评审·质量把关
暗星档案 · 未点亮的星

AI辅助同行评审·质量把关

本条为初评草案(AI 辅助编目):T 阶为三问初评(撬动面 × 停滞度 × 临界性),双评过 σ 门并红蓝复核后才升"已建档"。查不到的字段留空不编。点亮者会进入亮星候选流程,其贡献与星阶按 HCF 独立重评,不从暗星自动继承。

AI辅助同行评审·质量把关T5 量级 · 新星
审稿人不够用了,AI能不能守住科学质量关
暗星编号DS-0961
E · 能量与能力前沿
领域governance-institutions
状态初评草案 · 待双评与红蓝复核
这是什么 · 为什么难

同行评审是科学质量的最后一道闸门,但审稿人短缺、审稿质量参差已是公开危机。2025年3-8月间24.5%的高影响力期刊修订了AI审稿政策,NEJM AI的Fast Track流程让GPT-5、Gemini 2.5 Pro与人类编辑独立评审再对照;ReviewerToo项目用开源模型在ICLR 2025的1963篇投稿上测试,接收/拒绝判断准确率达81.8%,逼近人类审稿人83.9%的平均水平。攻破意味着审稿产能瓶颈被打破,学术出版能匹配论文产出的指数增长,同时不牺牲质量把关。

卡在哪 · 机制级卡点

AI审稿准确率仍略低于人类且在边界案例(创新性判断、方法学微妙缺陷)上表现更弱;各学科政策严重不统一,材料/化学/农业科学超50%期刊明令禁止AI参与审稿;ICLR已有约21%审稿被标记为AI全自动生成,滥用与问责机制(AI审稿意见出错谁负责)尚无共识。

谁在攻

NEJM AI(Fast Track流程用GPT-5/Gemini 2.5 Pro与人类编辑独立评审对照);ReviewerToo项目(用gpt-oss-120b在ICLR 2025投稿上测试接收判断准确率)

怎么参与

关注NEJM AI、ICLR等期刊会议公开的AI审稿政策与评测数据,或参与开源审稿辅助工具评测