AI 周报:算力物理极限与 Agent 降本之战
大厂死磕定制芯片与液冷,Gemini Flash 让 GUI 自动化成本暴跌。
本周 OpenAI 发布 Broadcom 代工的 Jalapeno 定制芯片,NVIDIA 强调液冷技术,算力竞争逼近物理极限。同时 Google 为 Gemini 3.5 Flash 增加 Computer Use,大幅降低 Agent 自动化成本。Anthropic 则指控阿里非法提取模型能力,凸显模型产权争议。
本周看点
这周看下来,我最大的感受是:AI 行业的竞争已经从“谁的模型跑分高”变成了“谁能把算力成本打下来”以及“谁能把 Agent 真正塞进用户的工作流”。底层在拼物理极限和定制硅片,应用层在拼 GUI 自动化和模型产权。
1. OpenAI 终于亮出了自己的定制芯片 Jalapeno
- 发生了什么 OpenAI 正式公布了他们首款定制芯片 Jalapeno,由 Broadcom 代工制造。这标志着他们开始 seriously 搞自研硅片了。
- 深度解读 老实说,这步棋 OpenAI 必须走。现在训练和推理的算力成本太夸张了,完全依赖 NVIDIA 不仅贵,而且产能受限。我注意到 Broadcom 最近成了各大厂定制芯片的“代工红人”。OpenAI 搞 Jalapeno,核心目的肯定不是为了去卖芯片,而是为了在推理侧把单 token 成本压到极致。当模型能力趋同,推理成本就是生死线。
- 影响分析 对创业者来说,这意味着未来调用 OpenAI API 的价格可能还有下探空间,或者他们能提供更便宜的轻量级推理服务。如果你在做重度依赖 LLM 推理的应用,这是个利好。但也提醒我们,纯套壳做 API 转发的中间件生意,利润空间会被进一步挤压。
- 链接 TechCrunch 报道
2. Google 让 Gemini 3.5 Flash 长出了“手”:Computer Use 来了
- 发生了什么 Google 官方博客宣布,Gemini 3.5 Flash 模型现在支持 Computer Use 功能。
- 深度解读 这个真的香。之前 Anthropic 的 Computer Use 让人眼前一亮,但 Flash 级别的模型做这个,意义完全不同。Flash 主打的是低延迟和低成本。把 Computer Use 能力下放到 Flash 模型,意味着 GUI 自动化(也就是下一代 RPA)的调用成本被大幅打下来了。我觉得这可能比单纯提升模型智商更有商业价值。以前 Agent 操作电脑又慢又贵,现在用 Flash 跑,很多高频的后台自动化任务终于能算得过来账了。
- 影响分析 做 RPA 或者企业工作流自动化的团队要注意了,这可能是个降维打击。传统基于规则或简单视觉识别的 RPA 会加速被淘汰。开发者应该赶紧去测一下 Gemini 3.5 Flash 在复杂 UI 下的点击准确率,看看能不能替换掉现有的昂贵方案。
- 链接 Google 官方博客
3. Anthropic 指控阿里“非法提取” Claude 能力,模型蒸馏的灰色地带
- 发生了什么 根据路透社的消息,Anthropic 公开表示阿里巴巴非法提取了 Claude AI 模型的能力。
- 深度解读 这事儿挺敏感的。大模型圈子里,“蒸馏”和“借鉴”的界限一直很模糊。Anthropic 这次直接点名,说明他们对自家模型被“白嫖”去训练竞品已经忍无可忍了。这也反映出一个趋势:随着开源和闭源模型的差距在某些特定任务上缩小,通过 API 调用去“蒸馏”大模型能力成了很多后发玩家的捷径。但这条路现在面临巨大的合规和公关风险。
- 影响分析 如果你在做模型微调或者训练自己的小模型,千万别再随便拿顶级闭源模型的 API 输出去做 SFT 数据了,法务风险在急剧上升。对于企业级用户,在选择底层模型供应商时,可能也要考虑这种知识产权纠纷带来的潜在断供风险。
- 链接 Reuters 报道
4. NVIDIA 谈 AI 工厂液冷:算力的物理瓶颈比想象中近
- 发生了什么 NVIDIA 官方博客发了一篇关于 AI 工厂液冷技术的文章,详细讨论了下一代数据中心的散热方案。
- 深度解读 结合前面 OpenAI 搞定制芯片来看,这其实是一枚硬币的两面。算力不仅在硅片层面遇到瓶颈,在物理散热层面也快到极限了。风冷早就压不住现在的 AI 芯片功耗了。NVIDIA 大力推液冷,说明未来的 AI 基础设施不仅是买几张卡的事,而是整个机房改造的重资产游戏。
- 影响分析 这对做 AI 算力租赁或者私有化部署的创业者是个警告:基础设施的隐性成本(散热、电力、改造)正在飙升。如果你还在按传统的 IDC 模式算 ROI,可能会亏得很惨。
- 链接 NVIDIA 博客
小结
这周的信号很明确:大厂在疯狂往底层物理和硬件层扎(定制芯片、液冷),试图锁死成本优势;而在应用层,Agent 的“手脚”正在变得更便宜、更敏捷(Gemini Flash Computer Use)。至于模型能力本身,护城河的争夺已经上升到了法律和合规层面。别光盯着模型跑分了,看看电费和 API 账单吧,那才是接下来的主战场。
相关文章
Agent基础设施与评估体系全面补位
本周信号清晰:AISPA暴露系统提示词黑箱风险,OSReward试图统一计算机使用Agent的跨平台评估标准,Change2Task解决了编码智能体训练数据自动化生成的瓶颈。配合MIT Sloan对AI金融建议的提问质量研究和VAD多模态蒸馏技术,整个行业正从能力展示转向基础设施补位阶段。
2026-08-01当 AI 学会自主操作,安全与信任谁来兜底?
本周动态指向一个清晰趋势:AI 系统正从被动应答转向主动操作。无论是审查提示词的 AISPA、评估电脑操作代理的 OSReward,还是反思 LLM 路由和推理正确性的实践,都表明行业正从'能不能用'转向'怎么安全可控地用'。Tailscale 披露的 Hugging Face 入侵事件则为 AI 供应链安全敲响了警钟。