可纠正性研究基金
7 étapes1 pièces3 Sources
可纠正性研究基金(Corrigibility Research Fund)是 Lightcone Infrastructure 旗下、由 Max Harms 管理的小型 AI 安全资助项目,2026 年至少发放 20 万美元,资助让 AI 保持"人类知情且可控、不抗拒被纠正"的可纠正性研究。它走双轨:事前申请的资助(单笔 5千–3.5万美元,一封邮件即可申请)与无需申请的追溯奖励,后者分两波发放。9 月 3 日公布首轮 8 笔资助共 13.2 万美元,9 月 30 日发出第一波奖励共 7.5 万美元,10 月 1 日又追加 4.8 万美元奖励近期论文,12 月中旬还计划发放超 6 万美元的第二波。与 Schmidt Sciences、ARIA 等九位数级别的大项目相比,它的意义在于低门槛:独立研究者和小团队用一下午就能申请。其理论赌注是 Harms 的主张——可纠正性比直接对齐目标更稳健,因为它是迭代式的、容得下人类纠错;硬性约束是研究不得加速 AI 能力。能否把追溯奖励做成常态化机制,材料本身也标注为待观察。
【背景】可纠正性指 AI 主动帮助操作者发现并修复自身缺陷的性质,区别于"一次把目标对齐到位"的价值对齐路线。
Comment on en est arrivé là
基金正式宣布设立,说明其定位、可纠正性研究的界定及资助与奖励双轨机制。
corrigibilityresearch.org ↗Granted AI 发文详解该基金:2026 年至少发放 20 万美元,资助单笔 5千–3.5万美元,首轮申请截止 8 月 23 日,奖励分 9 月底约 4 万与 12 月中 6 万+两波。
grantedai.com ↗第一轮资助申请截止。
grantedai.com ↗公布首轮 8 笔资助共 13.2 万美元及荣誉提名,同时发布申请评审方法说明。
corrigibilityresearch.org ↗发出第一波"现有工作奖励",总额 7.5 万美元,无需申请、追溯认可 2026 年内的可纠正性研究。
corrigibilityresearch.org ↗