本文系统分享了关于 agent 开发的思考,全文近 一万字,阅读需要 15 分钟,对于想要学习 agent 开发的同学也许大有裨益。 我开源了一个极简 Agent 框架,叫 Kiso 。 最初其实来源于一个很朴素的念头:我能不能做出一个比 Pi 更简单、更稳定、更省 token 的 Agent 框架。对于一个多少有点技术理想的 Agent 研究者来说,如果最后没能在开源 Agent 这件事上留下点自己的痕迹,实在是手痒难耐。 所以即便是重复造轮子,我也便造了。 但“简单、稳定、省 token”是一开始写在草稿纸上的三个愿望。而愿望和工程现实之间,隔着巨大的鸿沟。一旦真正去拆解像 Pi 这样的参考实现,就会发现它已经把“极简”逼到了一个很难继续压缩的位置:默认工具极少,系统提示词非常克制,Loop 也没有多少多余的控制逻辑。在这样的前提下,如果所谓创新只是再少两个工具、再少几百个 prompt token ,工程空间其实已经非常有限。 做着做着,我发现自己真正想解决的问题变了。 我开始意识到,一个 Agent 真正难以被托付的原因,往往并不是它不会调用某个工具,也...