//TODO 本篇未写完
2026年,Agent产品已经进入到了“能用,但是否好用?”的阶段,Agent应用的【稳定、可用】成为目前阶段的主题,因此harness备受重视。由于大模型输出的质量目前依然无法很好控制,以及上下文中任何一步都有可能被突然打断,所以异常处理、格式、重试等逻辑非常重要,也就是提出的Agent loop架构。这也是早期的一些Agent产品无法避免的问题:可能中途因为某些异常,突然终止(而且无提示),或者由于工具调用失败直接污染上下文,导致整个对话都无法再进行(cursor、Joyclaw都出现过这个问题)。
在我的观点里,技术发展的历程大概会是这样的过程:技术原型,初步研究受到关注 -> 早期杀手级应用,全面爆火 -> 所有人开始探索各种路线 -> 出现稳定可用范式,所有人开始抄,开始大规模落地 -> 应对高并发问题,各种配套框架、工具、设备出现 -> 开发生态全面完善,所有的细节都被填补 -> 成熟。
以此来看,目前依然是Agent应用发展的早期,即“稳定可用范式”这一环。大多数Agent还做不到“非常可用”,只有豆包、codex之类的成功产品才需要考虑Agent的高并发问题(当然,也说不清楚这种成功是不是拿钱拿算力堆出来的)。