OpenAI 首席科学家发文《An Alien Mind》:对齐未解,希望「自愿放缓」成为常态

OpenAI 首席科学家 Jakub Pachocki 发表长文,中心论点是:AI 正在变成一种我们并不完全理解的「异类智能」,可能很快就难以监测,并且越来越多地驱动自身的研发。他给出三个判断:目前没有任何一家实验室把对齐和监测做到了足以支撑全速扩展的程度;他预计、也希望「自愿放缓」在行业内成为常态,直到各方建立起共同的安全门槛;各国政府应把 AI 发展的国际协调列为优先事项。文中把对齐拆成两层:目标对齐指模型是否努力完成交给它的目标;价值对齐指目标含糊、互相冲突或遇到对抗时,模型能否依据一套高层原则做出合理行为。Pachocki 认为后者才是更难也更要紧的那层。这是公司首席科学家本人写在 OpenAI 官网上的话,与下一条对照着读,分量才完整。

OpenAI 披露内部研究自动化数据:每个人类工作日对应 3.1 个 agent 工作日

同一天,OpenAI 发文披露编码 agent 在公司内部研究流程里用到了什么程度:官方称已达成此前设定的 2026 年 9 月阶段目标「自动化研究实习生」,即能在人类指导下完成定义清晰、原本需要熟练研究员几天时间的研究任务;到 8 月中旬,研究部门每一个人类工作日对应 3.1 个 agent 工作日,8 月单个研究者跑的实验数量也创下 2025 年 1 月开始统计以来的新高,官方措辞是这与内部 Codex 使用量上升「相关」。下一个内部目标是 2028 年 3 月做出「自动化 AI 研究员」。两点保留:「agent 工作日」按 agent 总运行时长折算成标准八小时工作日计算,而 agent 是并行跑的,其中不少运行时长可能是冗余或失败的尝试,OpenAI 自己也提醒这些使用量数据只是不完美的代理指标,3.1 倍工时并不等于 3 倍产出;官方也承认研究链条上瓶颈很多,整体进度不会跟任何单项指标同速。即便打了这些折扣,这仍是头部实验室迄今给出的最具体的「AI 加速 AI 研究」内部数据。

Anthropic 15 亿美元版权和解进入分钱阶段,作者发现出版商多拿了

Anthropic 图书版权和解(总额 15 亿美元、每本盗版书赔 3,000 美元)进入实际支付阶段,作者群体开始收到分配通知,随即发现出版商和版权代理在主张不属于他们的份额。按和解条款,仍在版的传统出版书由作者与出版商五五分成,自出版或版权已回归的书则全额归作者——「版权回归」是一个合同流程,不是自动生效的开关:通常在图书绝版后,作者向出版商发出书面要求,出版商若未在约定期限内重印或再授权该书,出版权才回到作者手里(Authors Guild 的合同范本条款详细列了步骤)。悬疑作家 April Henry 称 HarperCollins 对一本「至少 17 年前」就已回归的书主张了分成;追踪出版业乱象的 Writer Beware 项目负责人 Victoria Strauss 说收到大量一模一样的投诉,称问题普遍且系统性,但她不愿把记录混乱就能解释的事归咎于蓄意侵占,Authors Guild 已给出提交异议的流程。AI 版权官司走到执行层,最大的梗阻不是 AI 公司,而是出版业几十年攒下的版权记录烂账;我赌这条分钱管线处理争议的方式,会成为后续同类和解的模板。

今日一句话:加速的数据和放缓的呼吁出自同一家公司的同一天——前沿实验室内部对「现在有多快」的体感,已经比外界的任何警告都更直接。