OpenAI 说明 Codex 删文件事故成因

Thibault Sottiaux 公开解释了 Codex 意外删除用户文件的根因:在全权限、无沙箱的模式下,模型本想把 $HOME 环境变量改写指向一个临时目录,却失手直接删掉了 $HOME 本身——用 Sottiaux 自己的话说,这是一次 honest mistake(无心之失)。这不是一次「模型学坏了」的对齐事故,而是一个更朴素的工程问题——agent 一旦在无沙箱下拿到全量文件权限,一次普通的失误就足以造成不可逆的破坏。sandbox 该不该默认开、开发者该不该为了方便关掉它,是所有 agentic coding 工具都绕不开的权衡。

Kimi K3 与 Inkling:开源模型冲向 3T 参数级

Moonshot AI 发布 2.8T 参数的 Kimi K3,自称首个「开放 3T 级」模型,官方承诺权重将在 7 月 27 日前放出;同一时间,Mira Murati 的 Thinking Machines Lab 也发布了自己的首个开源权重模型 Inkling(975B MoE,激活参数 41B)。两者放在一起看,开源阵营的竞争重心已经从「能不能开源」转向「谁的开源模型参数规模更接近闭源前沿」——这对训练和推理成本都是压力测试,值得看后续 benchmark 是否撐得起参数量的叙事。

Anthropic 把 Fable 5 转正,纳入 Premium 订阅

7 月 20 日起,Fable 5 将成为 Max/Team Premium 订阅的常驻模型(此次变更 Anthropic 仅在官方 X 帐号公告,官网新闻页未发文,标题链接即该原帖)。这个节奏变化本身不算意外,但时间点上紧跟 GPT-5.6 Sol 的竞争压力,说明模型迭代周期正在被对手的发布节奏牵着走,而不是单纯按自己的 roadmap 走。

GPT-5.6 协助解决凸优化 30 年悬案?先别急着信

Reddit 上一则热帖(Hacker News 上也有讨论)称 GPT-5.6 通过一次 prompt 协助填补了凸优化领域一个悬而未决 30 年的证明缺口,但讨论区里对证明严谨性的质疑声不小。这类「AI 解决数学难题」的叙事这几个月出现频率很高,套路也很像:先有轰动性标题,再由数学共同体慢慢挑出证明漏洞。在没有同行评审确认之前,这条更适合当作「值得关注的传闻」,而不是「事实」。

Global Index on Responsible AI 2026 报告发布

GIRAI 2026 从五个维度评估各国负责任 AI 承诺的落地情况。对做 Responsible AI 的人来说,这类跨国对比数据是难得的量化参照,后续如果拿到具体排名和方法论细节,值得单独展开分析。

今日一句话:Codex 事故说明现在限制 agentic 工具的不是模型能力,而是权限设计——谁先把「最小权限」做成默认值,谁就先避开下一次头条事故。