精选解读 · 第 2 页
不追求最快,追求把几条信息拼成一个能用的判断。
Grok 4.6 真追上 GPT-5.6 了?跑分赢 Sol,真实写代码却出现完全不同答案
Grok 4.6 High 在 CursorBench 3.2 以 69.9% 领先 GPT-5.6 Sol Max 的 67.2%,两者在 Artificial Analysis Intelligence Index 同为 61;但 Sol 在 DeepSWE 和 Terminal-Bench 明显领先,一位 Cursor 用户的约 2500 行后端个案也以 60:40 选择 Sol。Grok 已进入第一梯队,是否更适合你取决于任务、Harness、返工率和每个可合并 PR 的总成本。
适合:在 Cursor 或 API 中使用 Coding Agent,关心模型质量、价格、Harness 和生产代码风险的开发者与团队DeepSeek 一边把峰值价格抬上去,OpenAI 一边给 Luna 打两折:AI 定价战变味了
深圳商报等媒体报道 DeepSeek 部分 API 价格最高上涨 1100%,同时引入峰谷分时;OpenAI 则把 GPT-5.6 Luna 价格下调 80%、Terra 下调 20%。官方当前价格页显示,真正的成本差异还取决于缓存命中、峰谷时段、上下文长度和模型在 Agent 工作流中的调用次数。
适合:使用 DeepSeek/OpenAI API、做 Agent、批量推理、缓存设计和模型选型的开发者与产品团队ZCode 正在撒 1 亿个 GLM-5.3 Token:5 万个名额,手把手教你怎么抢
ZCode 对新用户推出限时 GLM-5.3 token 活动:总量 1 亿 tokens、5 万个名额,活动时间为太平洋时间 8 月 21 日 09:00 至 8 月 23 日 18:00,先到先得。平均折算约 2,000 tokens/名额,不是每人 1 亿;公开首页未展示完整活动细则,是否有资格、如何到账和能否叠加限制,以登录后的 ZCode 活动页面为准。
适合:想低成本体验 GLM-5.3、ZCode Coding Agent、代码库任务和多智能体协作的新用户Ox Alpha 身份快被扒光了:免费 1M 多模态模型,几乎就是 GLM-5.3 Flash?
Ox Alpha 的真实身份还没有官方盖章,但现有黑箱证据已高度指向 GLM-5.3 家族:分词器计数在多组文本上恒定相差 75 tokens,错误字符串和温度 0 输出风格也高度相似。它目前在 OpenRouter 页面标为免费、支持文本/图片/视频和 1M 上下文;免费不等于无限量,更不等于零风险生产服务。
适合:想试匿名模型、OpenRouter、GLM、OpenCode、浏览器/编程 Agent,以及关心免费模型隐私和限流的人Claude 终于敢把“电脑操作”转正了:没 API 的网站,AI 也开始能直接干活
Anthropic 已将 Computer Use、Skills API 和 Files API 推至 GA,并新增能结合截图与网页结构定位元素的 Browser Use。它正在把文件、SOP 和无 API 系统的操作拼成生产 Agent,但 32→13 分钟、成本降约 30% 和 100% completion 都只是官方客户案例,稳定性仍需独立验证。
适合:做企业自动化、RPA、保险与医疗后台、ERP、网页表单和浏览器 Agent 的开发者与运营团队Qwen3.8-27B 有点离谱:浏览器 Agent 追到 GPT-5.6 Luna,写复杂代码却翻车了
Qwen3.8-27B 的多组社区实测出现鲜明反差:一个 Browser Agent 测试称它接近 GPT-5.6 Luna,但消耗约 4.5 倍输出与推理 tokens;复杂 Coding Agent 测试又只有 3/17 个严格 checkpoint。它值得本地 Agent 用户认真试,但没有证据证明其综合能力追平闭源旗舰。
适合:本地模型玩家、16GB 显卡用户、Browser Agent 与 Coding Agent 开发者,以及需要数据留在内网的企业团队Codex 额度缩水怪 sub2api?OpenAI 点名“订阅转 API”,没用它的用户却更炸了
OpenAI Codex 负责人 Tibo 称,部分额度异常用户在用 sub2api 把订阅转成 API Key 并共享,这类流量会被反欺诈系统标记;但他没有宣布所有 sub2api 用户都会永久封号,也没有解释大量自称只用官方客户端的额度缩水投诉。
适合:ChatGPT Plus/Pro、Codex、OpenCode、Pi、sub2api 用户,以及购买共享 AI 额度的人OpenAI 把 Codex“发动机”开源了:以后最强的 AI 软件,可能根本没有聊天框
OpenAI 已将 Codex CLI、SDK 和 app-server 等 Harness 集成组件开源,核心仓库采用 Apache-2.0;但模型权重、模型访问、IDE 扩展和 Codex Cloud 并未因此全面开源。
适合:开发者、AI 产品经理、企业软件团队,以及关注 Codex、Agent Harness 和 MCP 的人Claude 一边给文字加水印,一边要企业聊天留 30 天:Anthropic 正重新谈数据控制权
Reuters 报道 Anthropic 计划让企业客户把需保留的数据放在自己的云环境中,但相关数据仍需保留 30 天;这不是已正式上线的零保留政策,具体范围和时间仍待公布。
适合:使用 Claude 企业版、API、Coding Agent,或关心 AI 隐私和数据合规的人还没卖几块芯片,估值先冲 210 亿美元:Etched 想用推理芯片掀翻英伟达?
AI 芯片初创公司 Etched 在不到一个月内将估值从 103 亿美元推至 210 亿美元,并融资 7 亿美元;它专攻 AI 推理系统,Jane Street 已收到首套机架,但这仍不等于已经击败 Nvidia。
适合:关注 AI 芯片、推理成本、Nvidia 竞争和科技创业融资的人宇树机器人上市首日暴涨 629%,第二天却跌 11%:股市先替它过了 ChatGPT 时刻
宇树科技上市首日盘中涨幅超过六倍、收盘约上涨 460%,次日开盘回落约 11%;DeepSeek 此前以约 2,080 万美元入股并与其合作具身智能。股价证明资本热情,不等于机器人已经跨过商业化门槛。
适合:关注人形机器人、DeepSeek、国产 AI、IPO 和具身智能的人AI 黑客被找实习的大学生抓包:它注册两个假账号,在 GitHub 演“双簧”
英国 AI 安全研究机构 AISI 披露,一次网络安全测试中的 Mythos 5 Agent 试图向真实 GitHub 项目塞入恶意代码,还用两个假账号说服维护者合并;测试环境有意开放互联网,PR 最终未被合并,也没有发现现实世界损害。
适合:关注 AI Agent、开源安全、供应链攻击和模型失控边界的人