跳到正文

多 Agent 协作

Subagent、并行 Agent、Agent 团队的编排方法和经验。

最新精选

第 1–20 条 · 共 36 条
今天10/6周二
  1. Hacker News · MCP78

    Flash-Agents:把 Claude Code 的编码任务交给 DeepSeek Flash worker 的 MCP 插件

    Flash-Agents 是一个 Claude Code 插件,把实现切片、移植测试、审查 diff、梳理代码库这类有边界的编码工作交给 DeepSeek V4.1 Flash worker,Claude 保留架构、验收标准和最终审查。

    推荐理由:作者把 Claude Code 的编码任务外包给 DeepSeek Flash worker,并给出沙箱、补丁与实测数据,可据此判断成本与安全边界。

10/4周日
  1. DEV Community · Claude Code85

    如何阻止 AI 编程智能体过早宣称任务完成

    作者运行一套全自主实现系统,由编排器把任务分发给并行实现 Agent(底层是 Claude Code),最初 Agent 可以自行把任务标记为完成,结果出现未跑测试、验收标准未满足、放宽断言让测试变绿、硬编码返回值等问题。

    推荐理由:作者用可检查的验收标准、带证据的完成报告和只读验证 Agent 三层设计,解决智能体过早宣称完成的问题。

10/3周六
9/28周一
9/24周四
9/22周二
  1. AI Coder · Telegram78

    在 Claude Code 中按角色路由模型:一周实践与 Hook 强制约束

    作者参照自己的 Codex 配置,为 Claude Code 搭了一套按角色分配模型的路由:主线程做协调者,explorer 用 Haiku 只做代码搜索,worker 用 Opus 走 TDD 实现,verifier 用 Sonnet 独立跑检查,senior 用 high 档 Opus 处理资金、数据和并发,reviewer 换另一个模型做语义评审。

    推荐理由:作者用一周实测给出 Claude Code 多模型分工的配置、Hook 强制约束和成本取舍,可迁移到自己的多智能体流程。

9/10周四
  1. Cursor · Changelog76

    Cursor 推出「项目」功能,用协调智能体承接长周期开发任务

    Cursor 推出「项目」功能,用于承接一项功能、一次迁移或一个完整应用这类长周期工作,可在数月内保持上下文并把任务委派给成千上万个子智能体。项目由云端智能体驱动,协调智能体不写代码,只负责规划、分派并交回成果,需要本机测试时再启动本地智能体;每个项目维护一组在云端和本地机器间同步的文件,持续积累研究成果、artifacts 和对代码库的了解。

    推荐理由:官方给出项目式多智能体协作的上下文共享与自动触发机制,可据此判断长周期任务如何被接管。

9/9周三
9/5周六
  1. Ryan Lopopolo66

    为发明智能体而生的智能体平台:把能力接口与实现解耦

    作者 Ryan Lopopolo 提出,智能体是一组能力之上的参数化程序,这些能力包括模型与配置、推理与工具调用循环、计算机、磁盘、上下文、Skills、工具、连接器、运行时、网络策略、身份、IAM、护栏、I/O 通道和系统提示词。

    推荐理由:作者用自己构建多个智能体的经历,提出把能力接口与实现解耦的平台架构思路,可供做 Agent 平台的团队参考。

  2. GitHub Blog · Copilot71

    GitHub Copilot 推出 Project HydraFusion,用多模型运行时编排提升编码质量

    GitHub 在 Copilot CLI 中以研究预览形式推出 Project HydraFusion,通过运行时编排在多个提供商的模型间选择执行方案,用户像选普通模型一样选择它,按各模型标准费率计费。

    推荐理由:GitHub 官方给出 HydraFusion 的三种编排模式与三项基准的成本质量对比,可据此判断多模型编排在真实编码任务中的取舍。

9/2周三
  1. 陈与小金 · AI Coding 博客78

    Claude Code 子代理 subagents 用法:一次派 13 个 AI 干活,主对话只收 3 个结论

    作者结合自己一次派 13 个子代理配分镜的实操,讲解 Claude Code 和 Codex 都有的 subagents 功能:子代理在独立窗口干活,只把结论交回主对话。

    推荐理由:作者用一次派 13 个子代理配分镜的实操,说明子代理如何把过程留在主对话之外、只回传结论。

8/21周五
  1. Jesse Vincent66

    我用 Vibe Coding 让智能体造出能编译 SQLite 的 C 编译器

    作者 Jesse Vincent 在自研智能体框架 Evener 里用手机下达目标,让智能体自主实现一个能编译 SQLite 并通过基本冒烟测试的 ARM64 C 编译器,耗时约 21 小时,使用 Evener 加 GLM 5.2。

    推荐理由:作者用自主智能体循环从零生成可编译 SQLite 的 C 编译器,可看到递归子智能体与目标设定的实际效果。

8/19周三
  1. Cursor · Changelog66

    Cursor 更新云端智能体与 Harness:支持事件订阅、子智能体独立运行和 /goal

    Cursor 更新云端智能体和 Cursor harness,让云端智能体可以订阅事件源,在 PR、Slack 讨论串或定时任务有新动态时恢复运行,并持续推进直至完成,修复 CI 问题、处理 bot 评论。

    推荐理由:云端智能体从单次执行转向订阅事件、持续跟进 PR 与 Slack 讨论串,读者可据此判断自动化边界的变化。

8/18周二
  1. Lovable · Blog74

    Lovable 如何把 lovable.dev 从 Next.js 迁到自家 TanStack Start 栈

    Lovable 用六个月把月访问 4200 万的 lovable.dev 从 Next.js 迁到自家 TanStack Start 托管栈,迁移期间两套框架并行运行,由代理 worker 按路由和用户分流,最终 Next.js 专属代码只占 3%。

    推荐理由:Lovable 官方复盘把 90 万行代码从 Next.js 迁到自家 TanStack Start 栈,双框架并行、AI 智能体批量迁移和一次 OOM 事故的细节都可直接借鉴。

8/13周四
  1. Augment Code · Blog62

    Augment Code 扩展 Cosmos:把代码评审做成 PR 到合并的智能体闭环

    Augment Code 将其 Cosmos 评审系统从代码评审扩展到完整的 PR 到合并闭环,新增 Verifier、PR Fixer、Review Dashboard 和 cosmos approve 四项能力,由多个专职 Expert 分别负责风险分析、逐行正确性评审、设计评审、运行时验证和修复。

    推荐理由:Augment 把代码评审扩展成覆盖修复、验证与审批的 PR 到合并闭环,读者可据此判断多智能体分工的落地方式。

8/7周五
  1. InfoQ · AI Coding Presentations83

    Spotify 如何用后台编码智能体 Honk 持续重写代码库

    Spotify 平台团队分享了后台编码智能体 Honk 的演进过程,它从替换迁移脚本起步,逐步接入构建与测试验证,把合并 PR 的节奏从 3 个月 1000 个提升到 10 天 1000 个。

    推荐理由:Spotify 团队复盘 Honk 从脚本迁移到后台编码智能体的演进,重点讲验证与标准化如何决定生成代码能否合并。

7/24周五
  1. Lovable · Blog71

    Lovable 如何用 AI 黑客智能体集群对自己打夺旗赛

    Lovable 在内部搭建了一套进攻性安全程序,让 AI 智能体集群像人类攻击者一样探测系统入口,直到拿到可验证的漏洞证据。它用夺旗赛的思路做验证:把 flag 散布在基础设施和权限最高的产品界面中,不预埋任何漏洞,智能体取到 flag 就说明找到了真实入侵路径,而不是模型猜测。

    推荐理由:Lovable 公开了用夺旗机制验证漏洞的内部攻防智能体编排方法,可迁移到自家安全测试流程。

7/22周三
  1. Augment Code · Blog62

    什么是循环工程,领先软件工程团队如何用它

    Augment Code 提出循环工程,即设计从触发、执行、验证到完成结果的智能体循环,让智能体承担中间环节、人类只在需要判断的检查点介入。文章把循环工程与提示词工程、上下文工程分层对比,并给出触发、执行、验证、结果、改进五个阶段,以及代码评审、工单转 PR、漏洞修复、事故响应四种已在生产运行的团队级循环。

    推荐理由:Augment Code 把循环工程拆成触发、执行、验证、结果、改进五阶段,并给出四种已在生产运行的团队级循环形态。

7/5周日
  1. Jesse Vincent68

    用 Claude Code 与 Slack 上的智能体互相评审来开发 Sen 2.0

    作者 Jesse Vincent 在 Prime Radiant 用 Claude Code 通过 Slackline 命令行 Slack 客户端与自家智能体 Ada 协作,让 Claude 提出改动、Ada 评审并测试、Claude 再部署更新,形成智能体互相评审的开发循环。

    推荐理由:作者用两个智能体互相评审、测试、部署的循环,展示了一种可迁移的智能体协作开发模式。