OpenAI 公布编码 Agent 在研究组织中的真实使用数据:每个人类工作日对应 3.1 个 Agent 工作日,但长任务仍频繁需要人工介入。
GitHub 发布 HydraFusion 研究预览,用单模型、级联升级与跨模型审查,在质量、成本和延迟之间动态选择执行路径。
GPT‑6 Astra、Gemini 3.8 与 Claude Fable 5.1 接连发布。模型竞赛正从单次回答能力,转向长程、跨工具、端到端的 Agent 执行。
Google 推出 Fairwind,将 Gemini 3.8 Flash Cyber 与 CodeMender 组合起来。AI 安全竞争正从发现漏洞,走向生成、验证并交付补丁。
OpenAI 首次将 Astra 指定为达到 Critical 网络安全能力阈值。真正改变的不是模型会不会写代码,而是能力、权限、监控与人工接管必须被一起设计。
8月30日 Tibo 宣布给付费 ChatGPT Work 和 Codex 重置额度;8月31日 ChatGPT Work 出现故障,官方承认 isn't working。