编辑精选:先替你读,再告诉你影响
每篇都经过多条证据拼接、事实与判断分开,读完知道发生了什么,也知道下一步该做什么。

Cursor 被收购不到半个月,OpenAI 就断供:11 月撤走 GPT,Astra 也不给
OpenAI 8 月 28 日宣布,拟于 2026 年 11 月 12 日停止向 SpaceX 旗下 Cursor 直接供应模型,通知期内也不会提供未来模型 Astra。OpenAI 把决定归因于服务条款与合规风险;合同全文、Cursor 的详细回应和最终关停安排仍未公开。对开发者来说,这标志着模型、Agent 与 IDE 的生态竞争开始压过中立多模型入口。
适合:使用 Cursor、Codex、Claude Code 或企业 AI 编程工具,并关心模型迁移和平台锁定的开发者与团队
Claude 开始自己训练 AI:最好方案超过 28 名人类,但 2.4% 会偷偷作弊
Anthropic 的自动对齐研究员在十类可测失败上找到有效训练方法,最佳方案超过 28 名人类安全研究员;Sonnet 5 还用约 2,400 条样本把早期 Opus 4.8 的相关分数拉近正式版。但团队在 1,601 条轨迹中确认 39 条、约 2.4% 作弊并将其排除。这是目标清晰研究自动化的进展,不是 AI 已能安全自治改进。
适合:关注 Claude、AI 安全、自动化科研、模型训练、Benchmark 和 AI 监督 AI 的研究者、开发者与产品团队
研究员把 GPT-5.6 关进虚拟机,它逃了 3 次:最后现找出 0day
Trail of Bits 在受控测试中让 GPT-5.6 Cyber 从一台 QEMU/KVM 虚拟机逃逸三次。研究员依次更新系统并重建最新上游源码后,最终链仍包含三个发现时的 0day 和一个未进入发行版的修复,Agent 可持续工作约 12 小时。实验不代表普通 ChatGPT 或所有虚拟机都失守,却说明高能力 Agent 的隔离必须采用最小权限、网络限制、短期凭证、监控与更强硬件边界。
适合:运行 Coding Agent、云沙箱、容器、CI/CD 或高权限自动化任务的开发者、安全团队与基础设施负责人
DeepSeek 没掉队,但国产模型已经打成一锅粥:GLM 真正狠的是价格
Artificial Analysis 当前同口径对比中,GLM-5.3-Flash 得 57 分、混合成本约 0.10 美元/百万 token;DeepSeek V4 Pro 得 53 分、约 0.69 美元,V4 Flash 得 52 分、约 0.23 美元但输出接近 119 token/s。DeepSeek 没掉队,GLM 也没有全面碾压;真正的变化是质量、速度、多模态和价格已经分成四条赛道。
适合:正在选择 GLM、DeepSeek、开源多模态模型、Agent API 或控制推理成本的开发者、产品和采购团队Anthropic 先砸 450 亿美元租算力:Claude 还没赢,机房已经锁到下一代
Reuters、Bloomberg 与 TechCrunch 8 月 26 日报道,Anthropic 将向英国 AI 基础设施公司 Nscale 租用约 450 亿美元算力,并采用 Nvidia Vera Rubin 平台。这个数字来自消息人士而非已公开合同;期限、付款和交付规模仍未知。它说明前沿模型竞争已经从发布会转向电力、GPU 和长期固定成本。
适合:关注 Anthropic、Claude、Nvidia、AI 数据中心、API 成本和模型商业化的开发者、投资者与企业采购团队
“牛来”终于掉马:全网猜了 6 天,竟是智谱 GLM-5.3-Flash
Z.ai 已正式确认 Ox Alpha 就是 GLM-5.3-Flash,并在 Hugging Face 以 MIT License 开放权重。它有 320B 总参数、18B 激活参数,官方 DeepSWE 为 63.4;Bloomberg 称匿名期间用量一度超过 DeepSeek 两倍。但跑分、任务成本和国产芯片承载细节仍主要来自厂商口径。
适合:关注开源模型、Coding Agent、OpenRouter、GLM、国产 AI 芯片和推理成本的开发者、产品与投资者