编辑精选:先替你读,再告诉你影响
每篇都经过多条证据拼接、事实与判断分开,读完知道发生了什么,也知道下一步该做什么。
Claude 终于敢把“电脑操作”转正了:没 API 的网站,AI 也开始能直接干活
Anthropic 已将 Computer Use、Skills API 和 Files API 推至 GA,并新增能结合截图与网页结构定位元素的 Browser Use。它正在把文件、SOP 和无 API 系统的操作拼成生产 Agent,但 32→13 分钟、成本降约 30% 和 100% completion 都只是官方客户案例,稳定性仍需独立验证。
适合:做企业自动化、RPA、保险与医疗后台、ERP、网页表单和浏览器 Agent 的开发者与运营团队Qwen3.8-27B 有点离谱:浏览器 Agent 追到 GPT-5.6 Luna,写复杂代码却翻车了
Qwen3.8-27B 的多组社区实测出现鲜明反差:一个 Browser Agent 测试称它接近 GPT-5.6 Luna,但消耗约 4.5 倍输出与推理 tokens;复杂 Coding Agent 测试又只有 3/17 个严格 checkpoint。它值得本地 Agent 用户认真试,但没有证据证明其综合能力追平闭源旗舰。
适合:本地模型玩家、16GB 显卡用户、Browser Agent 与 Coding Agent 开发者,以及需要数据留在内网的企业团队DeepSeek 终于给 Flash 装上眼睛:一张图最多 384 tokens,价格却没涨
DeepSeek-V4-Flash-Vision-Exp 已在官方 API 上线,支持 Chat Completions、Anthropic Messages 与 Responses API;每张图片最多折算 384 tokens,价格与 V4 Flash 相同。DeepSeek 称其多模态 Agent 能力已接近 Opus 4.8,但这是实验模型和厂商自报跑分,独立实测仍然缺席。
适合:做截图分析、网页 Agent、文档识别、视觉编程与批量图片处理的开发者和产品团队Codex 额度缩水怪 sub2api?OpenAI 点名“订阅转 API”,没用它的用户却更炸了
OpenAI Codex 负责人 Tibo 称,部分额度异常用户在用 sub2api 把订阅转成 API Key 并共享,这类流量会被反欺诈系统标记;但他没有宣布所有 sub2api 用户都会永久封号,也没有解释大量自称只用官方客户端的额度缩水投诉。
适合:ChatGPT Plus/Pro、Codex、OpenCode、Pi、sub2api 用户,以及购买共享 AI 额度的人OpenAI 把 Codex“发动机”开源了:以后最强的 AI 软件,可能根本没有聊天框
OpenAI 已将 Codex CLI、SDK 和 app-server 等 Harness 集成组件开源,核心仓库采用 Apache-2.0;但模型权重、模型访问、IDE 扩展和 Codex Cloud 并未因此全面开源。
适合:开发者、AI 产品经理、企业软件团队,以及关注 Codex、Agent Harness 和 MCP 的人Claude 一边给文字加水印,一边要企业聊天留 30 天:Anthropic 正重新谈数据控制权
Reuters 报道 Anthropic 计划让企业客户把需保留的数据放在自己的云环境中,但相关数据仍需保留 30 天;这不是已正式上线的零保留政策,具体范围和时间仍待公布。
适合:使用 Claude 企业版、API、Coding Agent,或关心 AI 隐私和数据合规的人