连着用 agent 做了几个小工具后,我发现它已经不像人在工作了

最近我连续用 agent 做了好几个小工具。在这个过程里,我有个习惯:一边让它干活,一边盯着它,观察它工作时的思考过程和执行逻辑。看下来有几个心得。

一、agent 的能力,比两个月前有了非常大的提升

最直接的感受是:思考快、准、狠,而且卓有成效。这不是渐进式的一点点变好——既有同一个工具两个月内的能力差异,也有不同工具之间的能力跃迁。隔了两个月再用,明显不是一个东西了。

二、它遇到卡点,会自己造工具

第二点更让我意外。它遇到卡点的时候,不是在现有的路子上死磕,而是会突破现有方式,自己创造工具去解决。

举个具体的例子。我给它派了一个任务,其中有一项子任务是下载一个比较大的文件。按照它当时那种通用的下载方式,速度算下来得下载八个多小时。它没有傻等,而是果断放弃了原有的通用下载方式,自己写了一个多线程的下载工具,十几分钟就把这个大文件拉下来了。

这种做法,其实不太符合人类工作的习惯。人碰到这种情况,通常只有两种反应:要么就等着,要么换一个现成的下载工具再试试。但它不是。它遇到问题、现有工具搞不定,就直接造一个工具,直接搞定。

这是一个很关键的区别:人默认在「已有工具的集合」里选,它默认「工具是可以现造的」。

三、和 IDE 时代的体验,已经完全不是一回事

第三点,是它和用 IDE 那个时代的体验相比,已经完全不同了。IDE 时代,你得把需求说得非常详细——架构怎么设计、用什么方案,你要深度参与中间过程,不断给它提供支持。但现在的 agent,你只需要把目标说清楚,把要什么说清楚就好。至于中间选什么架构、用什么工具、跑什么方案,他自己决定、自己测试。你的角色变了:从「参与过程」变成「只管要结果」。