罗盘 / AI训练数据版权与合法授权机制
暗星档案 · 未点亮的星

AI训练数据版权与合法授权机制

本条为初评草案(AI 辅助编目):T 阶为三问初评(撬动面 × 停滞度 × 临界性),双评过 σ 门并红蓝复核后才升"已建档"。查不到的字段留空不编。点亮者会进入亮星候选流程,其贡献与星阶按 HCF 独立重评,不从暗星自动继承。

AI训练数据版权与合法授权机制T5 量级 · 新星
给AI训练数据建一套人人认可、可规模化的付费授权规则
暗星编号DS-0933
R · 风险与文明安全
领域ai-computing
状态初评草案 · 待双评与红蓝复核
这是什么 · 为什么难

大模型训练普遍依赖未经授权的海量版权内容,已引发《纽约时报》诉 OpenAI、Getty Images 诉 Stability AI、Anthropic 15 亿美元集体诉讼和解等一系列案件,判决结果不一(Kadrey v. Meta 认定训练构成合理使用,Thomson Reuters v. Ross 则相反)。与此同时 ProRata.ai、TollBit 等内容授权市场平台开始出现,试图建立可规模化的"训练数据付费授权"基础设施,OpenAI 也已与 Condé Nast、金融时报等媒体签署授权协议。攻破意味着形成一套被创作者、平台与 AI 公司普遍接受的技术+法律授权标准,替代当前个案诉讼与零散双边协议的混乱局面。

卡在哪 · 机制级卡点

卡在法律层面(不同法域对"训练是否构成合理使用"判决相互矛盾,尚无统一先例)与技术层面(缺乏可规模化追踪数据来源、按使用量分成的可信基础设施)的双重僵局,任何单一授权平台都难以覆盖全网内容。

谁在攻

ProRata.ai · TollBit

怎么参与

法律/产品背景可从内容授权协议模板与数据溯源技术标准切入,相关诉讼文书与授权协议已公开可查