编辑精选:先替你读,再告诉你影响
每篇都经过多条证据拼接、事实与判断分开,读完知道发生了什么,也知道下一步该做什么。

DeepSeek 没掉队,但国产模型已经打成一锅粥:GLM 真正狠的是价格
Artificial Analysis 当前同口径对比中,GLM-5.3-Flash 得 57 分、混合成本约 0.10 美元/百万 token;DeepSeek V4 Pro 得 53 分、约 0.69 美元,V4 Flash 得 52 分、约 0.23 美元但输出接近 119 token/s。DeepSeek 没掉队,GLM 也没有全面碾压;真正的变化是质量、速度、多模态和价格已经分成四条赛道。
适合:正在选择 GLM、DeepSeek、开源多模态模型、Agent API 或控制推理成本的开发者、产品和采购团队Anthropic 先砸 450 亿美元租算力:Claude 还没赢,机房已经锁到下一代
Reuters、Bloomberg 与 TechCrunch 8 月 26 日报道,Anthropic 将向英国 AI 基础设施公司 Nscale 租用约 450 亿美元算力,并采用 Nvidia Vera Rubin 平台。这个数字来自消息人士而非已公开合同;期限、付款和交付规模仍未知。它说明前沿模型竞争已经从发布会转向电力、GPU 和长期固定成本。
适合:关注 Anthropic、Claude、Nvidia、AI 数据中心、API 成本和模型商业化的开发者、投资者与企业采购团队
“牛来”终于掉马:全网猜了 6 天,竟是智谱 GLM-5.3-Flash
Z.ai 已正式确认 Ox Alpha 就是 GLM-5.3-Flash,并在 Hugging Face 以 MIT License 开放权重。它有 320B 总参数、18B 激活参数,官方 DeepSWE 为 63.4;Bloomberg 称匿名期间用量一度超过 DeepSeek 两倍。但跑分、任务成本和国产芯片承载细节仍主要来自厂商口径。
适合:关注开源模型、Coding Agent、OpenRouter、GLM、国产 AI 芯片和推理成本的开发者、产品与投资者
ChatGPT 终于能“自己上班”了:新邮件一来就醒,登录后继续干活
OpenAI 8 月 25 日同时为 ChatGPT Work 补上两个缺口:用户可在安全表单中登录受支持的网站,然后让云浏览器继续;Gmail、Slack 和 GitHub PR 事件也能直接触发任务。它开始像数字助手,但网站支持、账号资格、人工批准与提示注入风险仍是硬边界。
适合:关注 AI Agent、企业自动化、Zapier/Make/RPA、ChatGPT Work 和浏览器 Agent 的产品、运营与开发团队OpenAI 用英伟达 GPU 上的模型造芯片,第一代就把 Blackwell 压到了身后
OpenAI 8 月 25 日公布首颗自研推理芯片 Jalapeño 的实测:在 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 的固定 8k/1k InferenceX 测试中,其峰值每瓦工作量比英伟达 GB200/GB300 高 1.5–1.9 倍,端到端延迟低 1.7–3.6 倍。结果很强,但芯片仍是工程样片,数字由 OpenAI 提供,Rubin、长上下文和多轮 Agent 负载尚未完整验证。
适合:关注英伟达、OpenAI 基础设施、推理成本、数据中心电力和 AI 芯片供应链的开发者、投资者与产品团队899美元的 Mac mini,开始被苹果当成“常驻 AI Agent”卖了
Apple 8 月 25 日发布 M6 Mac mini、M5 Pro Mac mini 和 M5 Ultra Mac Studio,首次把 Mac mini 明确写成“always-on agentic computing”设备。M6 Mac mini 起价 899 美元,最高 32GB 统一内存;M5 Ultra Mac Studio 最高 512GB、1.2TB/s 带宽。它更像是在卖一台可以长期运行本地模型和 Agent 的低噪声节点,而不只是更快的桌面电脑。但 Apple 的 AI 性能数字来自自家测试,模型兼容性、持续功耗和真实 Agent 体验仍未知。
适合:想在本地运行大模型、Coding Agent、家庭服务器和隐私敏感工作流的开发者与重度用户