@allen471 在 现在的 Agent,本质上是不是还只是“会调用工具的聊天机器人”? 中发帖
这两天一直在折腾 Pi Agent,本来想着把 memory、todo、review、模型路由这些补齐,应该就能比较好用了。
结果越折腾越感觉不是这么回事 😂
现在的 Agent 单次任务其实已经挺强了,写代码、查资料、调工具、开子 Agent 都没啥问题。但任务一长,就很容易忘记之前为什么这么做、做到哪了,压几次上下文之后一些重要信息也慢慢丢了。
所以我现在有点怀疑:
很多 Agent,本质上是不是还只是“会调用工具的聊天机器人”?
工具其实已经很多了,我反而觉得现在缺的是靠谱的“长期状态管理”——它得一直知道自己做过什么、为什么这么做、哪些路失败了,以及下一步该干嘛。
最近看到一些科研 Agent 在搞 Research Graph,把 idea、实验、结果这些串起来,感觉这个思路挺有意思。
大家实际用下来怎么看?
现在 Agent 最大的短板,是模型还不够强、工具还不...