过去 24 小时,AI 圈的核心话题几乎都围绕 OpenAI:官方接连披露自动化研究里程碑与对齐长文,同时 Fortune 爆料其基准数据多次被修改。以下为精选动态汇总。
💡 技巧与观点
OpenAI 宣布达到”自动化研究实习生”里程碑:内部 agent 运行时已达人力的 3.1 倍
OpenAI 公开内部数据称,已达成自动化研究实习生里程碑——AI 现在能在人类监督下完成熟练研究员需要数天才能做完的明确任务。截至 8 月中旬,其研究组织每投入 1 个人工工作日,就对应约 3.1 个 agent 工作日的运行时长(该比值衡量运行时间而非等效生产力)。有 OpenAI 员工观点认为,递归自我改进可能成为未来几年 AI 能力跃升的关键,作者也呼吁其他 AI 公司像 OpenAI 一样公开此类数据。
OpenAI 发布内部研究加速报告:兑现自动化研究实习生目标,剑指 2028 年 3 月的”自动化 AI 研究员”
OpenAI 在官网发文披露自动化研究进展,宣布已兑现去年秋天设定的目标:到今年 9 月拥有可在人类指导下完成耗时数天明确研究任务的”自动化研究实习生”。下一步计划是在 2028 年 3 月之前造出更高阶的”自动化 AI 研究员”,研究自动化路线图进一步清晰。
OpenAI 长文《An Alien Mind》谈对齐与监测困境:CoT 监控能力正在减弱
OpenAI 发布长文,回顾 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点,并系统区分了”目标对齐”与”价值对齐”。文章坦承,链式思维(CoT)监控的效果正随模型能力提升而逐步减弱,同时称 GPT-6 Astra 在对齐表现上明显优于 GPT-5.6 Sol。作者预期进展可能走向机器递归自我改进(RSI),并呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。
Fortune 爆料:OpenAI 多次修改 GPT-6 Astra 基准测试数据,部分成绩大幅波动
据 Fortune 报道,自 9 月 3 日发布 GPT-6 Astra 公告以来,OpenAI 已多次修改评测基准数据。例如 Astra 的幻觉率数字曾从 4.2% 下调至 2%,之后又改了回去。基准成绩的反复修改引发外界对评测透明度与发布口径的关注。
来源:AI HOT(aihot.virxact.com)