AI开发者 - 构建Agent的三个核心思想_anthropic 构建有效agent的三个核心思想-优快云博客

前言

本文章主要内容来源于Anthropic（Claude）的工程师Barry Zhang的分享

视频地址：https://www.youtube.com/watch?v=D7_ipDqhtwk

如何构建一个有效的Agent：https://www.anthropic.com/engineering/building-effective-agents

博客阐述了如何去构建一个有效的Agent，以及各种场景下构建Agent的形式，对比当下构建我们构建的Agent，还是有一部分内容缺失的，比如缺少了内容的feedback，缺少了对于Agent执行任务质量的自动检验。

视频中作者主要对博客中的构建Agent的三个要点进行了展开，观点比较新颖，尤其是第三点，对于如何构建Agent提出了不一样的思考方向，接下来主要就这三点内容进行阐述。

Barry Zhang列出了几个CheckList用来判断自己的场景是否适合构建Agent

不复杂：比如很容易就可以构建出整个决策树，这种建议采用工作流的方式，并且是比较经济实用的。
复杂：Agent适合处理比较模糊的问题，比如代码生成，只是一个从需求转换为代码的过程，结果的预期是模糊的，两个不同的人，写出来的代码肯定都不一样，但达成的效果都是一样的。

这里主要指的是成本，也就是让Agent去做这件事带来的价值是否与消耗的token是否成正比。

否则还是考虑考虑工作流或者不使用Agent吧。

Agent是否在任务的各个节点是否都可以做的很好。

这一点没太理解作者的解释，我个人理解是如果整个任务中，有一些节点不适合Agent去做，可以尝试将这些节点抽离出来，以工作流的方式去实现，或者是在多Agent协作的模式中，将这些节点拆分到其它的Agent中去做，也就是简化单一Agent职责。

通过这一点可以反思下我们目前的Agent，有没有这些问题，在设计Agent之初，应该考虑到这一点，当然还要具体场景具体分析了。比如目前我们的场景，有没有正确的帮用户去处理相关的任务，效果是不是如预期一样进行，是不是缺少了这个Feedback机制。

在本节的最后，作者举例为什么Agent适合编码，按照上述的几个标准，都给出了相应的解释：

任务的复杂性： 将设计文档转换为代码本就是一个比较复杂且模糊的事情
任务的价值： 作为开发人员，当然我们认为自己的代码的价值很高~
可行性： Agent可以胜任这个工作，感觉作者有点儿过于自信Claude的编码能力了，虽然做简单的作业是没有问题，但如果当代码文件过多时，AI的能力显得就不足了。不过最近OpenAI（CodeX）和Google（jules）都发布了代码生成的Agent，但现阶段仅限于对GitHub仓库的项目进行操作
**执行错误的风险和发现错误的成本：**代码生成可以生成对应的单测和持续集成来验证生成的质量