The Closing Window
从一个Agent到多个 image
Photo by Shubham Dhage on Unsplash

从一个Agent到多个

AI Insights

TL;DR

Agent协调工具已经从复杂的基础设施变成了一个下午就能搭建好的东西。Superset、Cline Kanban和Paperclip等项目让你可以轻松地在自己的工作中并行运行多个Agent,而claw-code则展示了当Agent自主协调时会发生什么。Trail of Bits证明了这在组织层面同样有效——通过构建一个系统,而不是仅仅分发许可证。

使用AI Agent对我来说相当具有革命性。它让我能够自动化和运行那些通常会占据我大部分时间的工作和流程,现在以一种更简单的方式完成,不再依赖于我投入的时间。这不是什么新闻;我想每个人都在网上看到过很多人分享的这种体验。我现在越来越多看到的是协调多个Agent的便利性或可及性,这显然会成倍提升你的效率。这种Agent的协调正在软件开发、个人Agent领域,甚至在组织内部以更抽象的方式发生。

我不想加重很多人都能感受到的那种压力——那种被落下的感觉。但我确实想以强烈的紧迫感鼓励每个人开始接触这些工具,因为真正理解可能性的转变、理解这项技术现在可以提供的生产力环境范围,确实需要一些时间。

Agent的协调和编排并不是什么必然全新的东西。之前就有一些例子,但新的是我看到新项目不断上线,让实现这种运行多个Agent的编排环境变得非常简单。所以我有几个相关的例子,然后还有一个略微相关的例子,展示了一个组织如何在整个公司范围内大规模地协调Agent和使用Agent的人。我认为这是一个值得在这里包含的重要用例,因为发现和结果都相当显著。这又是事物发展之快的又一个例子。

编程Agent

前几个Agent编排的例子与编程Agent有关。我在各种信息流中看到的、觉得有意思的项目包括Superset、Cline Kanban和mngr。

Superset让你可以在一个组织良好的界面中运行多个终端窗口的编程Agent,还能通过自动创建worktree帮你轻松创建软件开发项目的额外副本。这让你可以在一个组织良好的界面中对单个项目运行多个任务。在这之前,我的终端有多个窗口,但Superset帮助从视觉上组织一切,并通过视觉提示帮你追踪每个Agent的状态——它们何时在运行,何时完成了任务。这个项目对我来说超级有用。

接下来是Cline Kanban。我还没怎么用过这个项目。自从上周看到它后,我总是忘记更多地使用它。但简单来说,它也通过将项目分解为单独的任务来帮助协调Agent和任务。直接引用产品页面的话:"Create, manage, and chain agent tasks within a single view."

最后在今天的编程Agent中,让我们看看mngr。我不确定我会不会大量使用这个最后的工具,因为解决方案本身相当高级。但我把它包含在这里是因为它令人印象深刻,推动了软件开发方式的边界。MNGR解决方案让你不仅可以在本地环境中启动Agent,还可以在任何你能通过SSH连接的地方——SSH是一种通过终端连接到不同计算机的协议。Claude Desktop和Claude Code的某些功能就是这样工作的,但在MNGR中这一切是在后台自动发生的。你可以控制如何运行Agent,基本上就是协调一支在不同机器上运行的Agent舰队,这真的很酷,但也许超出了我的需求,或者也许只是超出了我目前的想象力。

个人Agent

在过去几个月里,由Open Claw推广的自主个人Agent出现了爆发式增长。上周我看到了这个叫Paperclip的新项目,它基本上是一个编排工具,用于在一个"控制平面"(control plane)中运行多个这样的个人Agent,这是他们网站的定义。也许使用"个人Agent"这个词有点误导,因为Paperclip背后的意图是让你轻松建立一家由AI Agent在不同角色中运营的公司。你设定高层目标、指标和预期结果。CEO Agent负责招聘、委派和执行。这是对大多数人使用Claude Code时的"结对编程"模式的有意突破。

我已经安装了Paperclip但还没使用过,所以我不能保证所有这些填充不同角色的Agent的协调有多高效和功能完善。但我看过的演示看起来非常令人印象深刻。

接下来是claw-code。从技术上讲,这与编程Agent或编程Agent的协调有关,但与我之前提到的编程Agent非常不同,因为这展示的是完全自主的工作。其含义更接近于通用Agent行为,而不是专门的软件开发。如果你没听说的话,Claude Code的源代码上周被泄露了,在一天之内——甚至更短,一个晚上——就有人用不同的编程语言重写了整个实现。这就是我们在这里讨论的,将Claude Code自主地重写为claw-code。我建议你去读这位开发者的帖子。他有一些非常有趣的见解,而他协调开发这个市场上最受欢迎的编程Agent之一的副本的架构、设置和机制——他只通过Discord这个聊天应用来完成——简直令人震惊。

以下是他的一个见解:

"But if you are staring at the generated Python files, you are looking at the wrong layer. The code is a byproduct. The Rust port that followed is also a byproduct. The thing worth studying in the claw-code repository is the system that produced all of it. claw-code was always a showcase. The point was never the Python files or the Rust crates. The point was the clawhip-based agent coordination system that built them while the developer was asleep."

被"体制化"的Agent

在美式英语中,当你说某人被"institutionalized",意思是他们被送进了精神健康机构。我觉得这个小标题在这里很合适,因为Trail of Bits所做的事情对于任何曾在非小型机构中努力推动过任何变革的人来说,都会觉得不可思议。

Trail of Bits是一家约140人的网络安全咨询公司。在大约一年的时间里,他们从5%的员工实际使用AI,发展到AI增强的审计员每周发现200个bug,之前是15个。现在所有报告的bug中有20%最初由AI发现。他们每个销售代表的收入达到800万美元,而行业基准是200-400万美元。这些不是小幅改进。这是一个140人公司产出能力的结构性转变。

让他们的故事值得与Superset和Paperclip等个人工具一起在这里提及的原因是,他们在组织层面解决了协调问题。这不仅仅是给人们提供AI访问权限的问题。Trail of Bits构建了他们所称的六部分"操作系统"。

简短版本是:他们将所有人标准化到相同的工具上,编写了一本内部手册,不仅解释规则还解释背后的推理,创建了一个成熟度矩阵让人们可以看到自己的位置和成长方向,进行了聚焦的采用冲刺,迫使人们进入自主模式,将每次项目的经验捕获为可重用的工件,然后通过沙箱化和通过设备管理软件推送到机器上的加固默认配置使自主性变得安全。最终,他们积累了94个插件、201个技能、84个专业Agent和超过400个参考文件。每个项目都让下一个更快。

身份认同的重新框架对我产生了特别强烈的共鸣,因为我自己已经经历过阻力。他们的安全审计员是专家,而专家比任何人都更抗拒AI,因为他们的技能是他们身份的核心。Trail of Bits没有与之对抗,而是侧身绕了过去。他们将AI能力从"我使用AI"重新框架为"我是那个让AI变得危险的人"。这是身份的升级,不是威胁。它之所以有效,是因为它与这些人已有的自我认知一致。漂亮的执行,Trail of Bits。

这意味着什么

这就是事物发展的方向。本文前面的例子展示了个人如何协调多个Agent。Trail of Bits展示了当整个组织系统性地这样做时会发生什么。搞明白这一点的公司和没搞明白的公司之间的差距将会迅速拉大。我把这件事更少地当作观察对象,更多地当作要努力构建的方向——无论是在我自己的工作流程中,还是在我思考如何将其带给我工作中的团队时,作为一个我希望模板化然后推广到整个组织的东西。

Powered by Buttondown.