温馨提示:文本由机器自动转译,部分词句存在误差,以视频为准
00:00
Garner一句话揭穿,市面上数千个agent产品里,真正有自主能力的只有约130个。剩下99%的所谓agent本质是chatbot r PA或者FL+LM。这就是agent washing.Agent washing把传统自动化工具贴上agent标签,价格翻3倍,演示视频拍的很炫。反共10点企业落地agent失败主因不是模型不够聪明,而是被营销词骗进了演示陷阱。一个真实例子,某厂agent其实是ALS路由加LLM润色工具调用是写死的,根本不会规划。
01:03
识别agent washing问3句话。第一句,他能不能在没有P的情况下自己规划下一步?第2句,它调用工具时是否带持久记忆与跨步骤状态。掉线之后能不能恢复上下文?第三句,执行失败时,他能不能自主改路径,换工具,而不是直接报500,把球踢回给人?真自主A阵子的代价是算力程以3~5治理成本指数上升。便宜的不是真自主,是脚本。选型三步走,先问自主档位,Observe advice with approval fully autonomous, 再看模型。
02:07
再看凭证与t Switch能调用支付就有命名owner与可测试熔断,否则一律降级到只读档。一句话,别被agent两个字绑架,先问他能自主到什么程度,再谈价格。
我来说两句