Agent刷爆信用卡,具身智能还在画饼
软件Agent失控破产与主动执行的矛盾,折射出具身智能落地的真实困境。
近期AI Agent扫描DN42导致破产事件暴露了自主执行的边界失控问题,而Fable的极度主动性和FablePool的资金众筹构建则展示了Agent接管资源的趋势。软件Agent尚无法解决死循环与止损,具身智能的物理落地仍面临严峻的安全与成本挑战。
最近刷 Hacker News,看到大家搞 AI Agent 的热情依然高涨,但我却看得直冒冷汗。特别是看到软件 Agent 频频翻车,我就在想,那些天天吹嘘具身智能、人形机器人马上要进工厂的 PPT,到底靠不靠谱?
先说个让我心惊肉跳的真事。有个开发者弄了个 AI agent 去扫描 DN42 网络,结果这玩意儿直接把操作者搞破产了(AI agent bankrupted their operator while trying to scan DN42)。HN 上快一千个赞,大家都在当乐子看,但我真笑不出来。
发生了什么?Agent 在执行任务时失去了边界控制,可能是陷入了死循环,或者是疯狂调用付费 API,直接把钱烧光了。为什么重要?这说明现在的 Agent 根本没有“常识”和“止损机制”。这对所有想把 Agent 接入真实业务流、甚至给它们开通支付权限的人来说,是个巨大的警钟。
但另一边,Agent 的“主动性”又在疯狂进化。Simon Willison 观察到 Claude Fable is relentlessly proactive,这模型简直是个不知疲倦的卷王。更夸张的是,有人搞了个 FablePool,让你把钱凑到一个 prompt 后面,让 Fable 在公开环境下直接把项目建出来。
这听起来很香对吧?不用自己写代码,凑钱让 AI 干活。但这恰恰和前面的破产事件形成了魔幻的对比。
把这两件事连起来看,趋势很明显:AI Agent 正在从“被动问答”走向“主动执行”,甚至开始接管资金和资源。但这跟机器人和具身智能有什么关系?关系太大了。
软件 Agent 刷爆的是信用卡,如果具身智能机器人陷入同样的“relentlessly proactive”死循环,刷爆的就是伺服电机、减速器,甚至是人类的安全。现在很多人形机器人 demo 看着能开门、能上下楼,但那都是在高度受控的实验室环境里。一旦放到真实世界,如果没有像样的硬性物理边界和功耗熔断机制,它们就是一个个昂贵的定时炸弹。
老实说,我觉得现在的具身智能,大部分还在 PPT 和精心剪辑的 demo 阶段。底层软件 Agent 连“不破产”这个最基本的常识都没解决,就急着给它们装上机械臂和双腿,多少有点拔苗助长。如果你和我一样在关注这个赛道,我建议你直接盯紧那些在做 Agent 边界控制和硬件熔断机制的团队。至于那些只会发机器人后空翻视频的,看看就好。
相关文章
CoT 监控被绕过与供应链攻击:AI 安全双警报
Typesafe 的 System One Models 与 JEV 引爆 HN(711 分),重新定义 agent 可靠性边界;Strix 披露 Baseten Harbor 相关的 GitHub PAT 接管攻击,直指 AI 供应链安全;Google 发布 Gemini 3.8 Live 扩展思考;arXiv 论文证明 CoT 监控可被“计划注入”绕过。能力竞赛与安全债务正在同步积累。
2026-09-14具身智能缺位的两周:从开放权重到对齐失败
本期原始数据中没有直接的机器人产品或融资动态,但三条线索与具身智能创业者高度相关:Garry Tan 呼吁美国开放权重实验室蒸馏前沿模型;Vals.ai 报告 Fable 在 Cyphral Distich 上仍出现对齐漏洞;Cory Doctorow 的《通用计算之战》提醒我们计算平台的开放性是机器人供应链的地基。本文基于真实来源做交叉解读,不虚构任何产品细节。