用三个 Codex CLI 终端搭建多智能体开发工作流:实现者、审查者与深度推理升级
在 GPT-6.1 Sol 发布后账号用量重置、VS Code 尚未提供该模型的情况下,一位开发者改用 Codex CLI,并行运行三个终端:GPT-6.1 Sol Max Fast 负责实现与最终决策,GPT-6.1 Sol Max 负责审查,Astra Max Fast 负责深度推理与升级。三个会话通过 MCP 工具协调,作者用 /status 复制状态上下文在主实现者会话中继续推进。
在 GPT-6.1 Sol 发布后账号用量重置、VS Code 尚未提供该模型的情况下,一位开发者改用 Codex CLI,并行运行三个终端:GPT-6.1 Sol Max Fast 负责实现与最终决策,GPT-6.1 Sol Max 负责审查,Astra Max Fast 负责深度推理与升级。三个会话通过 MCP 工具协调,作者用 /status 复制状态上下文在主实现者会话中继续推进。
有用户在组织内用 Claude Code 自动化工作流时遇到一致性问题:Claude 常搜索所有项目找参考,导致每次实现结果不同,还会绕过预校验模板和渲染函数,直接手写组件。即使用 skills 文件要求它使用组件库,也只是偶尔生效。该用户希望找到办法,让 Claude 稳定判断组件是否匹配用户需求,并改用组件库 SDK。
作者用 Git worktree 让每个并行编码任务各占一个分支和检出目录,解决了多个智能体编辑同一份代码的冲突,但浏览器测试仍无法确定实际跑的是哪个 worktree 的代码。
一个由 AI 智能体写代码、作者不读代码的产品项目里,自动检查多次给出错误结论。作者发现 86 个检查从未被任何流程触发,秘密扫描因 git 默认转义俄文文件名而漏掉 1413 个文件中的 438 个,新检查把 WHERE 误认成表别名而放过注入的错误,测试面板和智能体副本还发来三次假告警。
推荐理由:作者用五个真实案例说明自动检查为何会给出假绿或假红,并给出可迁移的验证规则。
ToolForte 作者把站内 360 个浏览器小工具的 111 个(后增至 180 个)暴露为 MCP 工具,结果发现列表过大挤占上下文窗口、智能体频繁选错工具,改为默认只展示 14 个、其余 166 个靠搜索查找。
文本进入语言模型前会被 tokenizer 切成 token 并映射为词表编号,token 不等于单词或固定字符数,例如 BERT 的 tokenizer 会把 "I have a new GPU!
一位开发者用 Claude Code 的 mods(可在终端绘制的插件)做了 7 款小游戏,让实际工作进度驱动游戏进程:完成一轮对话拉动老虎机拉杆,工具调用失败触发 Atari 风格决斗,每运行一个工具掉落一块俄罗斯方块,编辑文件时章鱼破坏城市。
作者用 Suno 制作了一首恐怖童谣《Ten Little Candles》,并让 Claude Code 在单个会话中把它做成 Tim Burton 风格的 SVG 音乐视频。
一位缺乏编程经验的 Vibe Coding 爱好者反馈,自己用 AI 做出的几个复杂项目实际耗时都是预期的 3-4 倍。他通常先用 AI 规划再动手,几小时就能做出不错的原型,但随后加功能、修 bug 会陷入无数轮排查循环,一两天后每轮排查耗时几乎等于整个首次构建。他常用 Kilo Code 搭配 DeepSeek 或 GLM 模型,并因受挫而频繁更换编程助手,现寻求改进建议。
作者安装的 Claude Code 守卫插件在 /plugin 中显示已启用,却完全没有拦截 rm -rf、force push 等危险命令,问题不在插件代码,而是 harness 在事件到达前就丢弃了它。
作者因反复向 Claude Code 重述项目决定,做了 jevmem:每条消息后由 TypeSafe AI 的 Jev 判断是否值得保留,是则往仓库的 JEVMEM.md 写一行,下个会话把相关行送回 Claude,改主意就划掉旧行,团队通过 git 共享同一文件。
作者为无人值守运行的编码智能体搭了一套基于隐藏 git ref 的检查点机制,每个任务开始前对整个工作树(含未跟踪文件)做快照,验证失败时自动回滚,恢复操作本身也可撤销。
推荐理由:作者用约 40 行 shell 把 git 检查点做成可回滚基础设施,给出了无人值守跑编码智能体时的具体做法和边界。
作者按近期提交活跃度、issue 处理情况和实际功能是否兑现三项标准,筛出 5 个仍在维护的社区 MCP Server:Desktop Commander、n8n-mcp、Slack MCP Server、DuckDuckGo MCP Server 和 MySQL MCP Server,并给出对应的 claude mcp add 安装命令。
Vinkius 生态新增壶铃摆动计算器,通过 MCP 为 AI 智能体提供 calculate_volume、plan_workout_structure、estimate_power、get_progression_path 四个确定性工具,用于计算训练量、编排组数与休息、估算瓦特功率输出并给出进阶建议。
作者把 Google Workspace 的八个远程 MCP 服务器接入 Claude Code 的配置过程脚本化,并打包成可安装的 google-workspace-mcp Skill 和插件,仓库地址为 github.com/xbill9/workspace-mcp-claude。
作者想从手机(最好是 WhatsApp 或 Telegram)访问自己的 Claude Code 配置,于是梳理了目前存在的四种方案并逐一对比。
作者开源了 Project Athena v9.9.9 内核(MIT 许可),一套本地优先的记忆与治理框架,用于解决 Claude Code 反复纠正、子智能体越界改文件、以及中途撞上额度上限后状态丢失的问题。
推荐理由:作者用 1900 次会话验证的 CLAUDE.md 瘦身与本地记忆方案,给出了可直接复用的目录结构和验证规则。
一位 Claude 用户为改善 token 用量,改用 Opus 做规划、按任务难度分配不同模型,结果收到提示:82% 的用量来自 subagent 密集的会话,因为每个 subagent 都会发起自己的请求。他感觉 subagent 比主对话更耗 token,但因使用更便宜的模型而认为影响不大,于是发帖询问自己的做法是否正确。
有用户在 Claude Code 上下文变大、准备运行 /compact 前,会先告诉 Claude“我要压缩了再继续”,Claude 随后回复已总结要点。该用户认为这样做能减少 /compact 后重要信息丢失,但表示从未实际测试过,效果似乎取决于具体情况:有时只总结聊天内容,有时最新状态也会写入 memory。
作者因近期 Anthropic 大量封号且申诉难、订阅费不退,在支持 Claude 的地区自建 VPS,用 Docker 跑 CLIProxyAPI 保存 OAuth 登录并暴露兼容 API,再通过 SSH 隧道让 Claude Desktop 和 Claude Code 走这个网关。
作者在开源看板 ticket-tracker 中让无头 Claude Code 会话处理工单,遇到需要人决策的问题时调用 ask_question 并结束本轮,进程退出后由编排器用 claude -p --resume 加同一 session id 恢复,答案作为下一条提示词传入。
作者 Craig Solomon 分享了测试 MCP 服务端守卫的方法,核心是把守卫从工具函数体里抽成可单独调用的纯函数,让拒绝路径变成一张参数化用例表。
Scout Packs 将其 x402 线索查询 API 从每次 $0.10 下调至 $0.01,原因是 AI 智能体运营钱包普遍将单次调用上限设为 $0.005,$0.10 相当于默认上限的 20 倍,钱包会直接拒绝支付。
作者用 Antigravity 和 Google AI Pro 订阅,在半天内生成 Go 配置库 goconf,支持 .env、JSON、YAML、TOML、INI 和系统环境变量,带级联加载、校验和 Secret[T] 防泄漏,已以 v0.1.0 发布。
AI Hero Skills 发布 v1.3,新增 /implement-spec、/pr、/retro 三个技能,把主流程从 /grill-with-docs → /to-spec → /to-tickets 延伸到实现、PR 和复盘。
推荐理由:作者把技能集补成从写 spec 到 PR、复盘的完整链路,并给出各环节的取舍与已知粗糙处。
PapaProxy.net 的 MCP 服务器提供 50 个工具,覆盖代理账户的库存与定价、订单续费、IP 白名单、凭证、IP 刷新、用量分析、账单和工单,支持 Cursor、Claude Code 及任何支持自定义请求头的远程 MCP 客户端,所有账户免费使用。
MCP 思维导图把 Claude、ChatGPT 等 AI 助手直接连到思维导图服务器,让可视化层级图在对话窗口内生成,省去复制粘贴到独立应用的手动步骤。Claude Desktop 的 MCP 体验目前最顺畅,ChatGPT 的 MCP 支持也已可用但相对碎片化。当前限制包括首次需配置服务器、多数开源服务器只支持单向生成、视觉质量参差、移动端支持有限。
n8n 的 AI Agent 节点不靠提示词限制花钱,而是挂载指向支付服务器的 MCP Client Tool,由服务器按每个智能体的预算和规则判定每笔付款。Pink Agentic AI Payments 会返回 allowed、pending_human 或 blocked 三种结果,超限付款转人工审批,礼品卡等类别直接拦截。
一个团队回顾了用 Claude Code 六周构建产品的全部会话,发现 2752 条提示词里很多是重复输入的同一类纠正,于是把最常重复的整理成 Skill。他们列出代价最大的几类问题,包括 API 未就绪时用 mock 数据、只看 CSS 就断言已居中、失败迁移后的清理步骤误删线上计费数据、本地测试向假地址发出约 50 封真实邮件、只要一个导航链接却得到整个导航重设计。
开发者发布免费 MIT 插件 deutsch-loop,在 Claude Code 单轮运行超过 12 秒且德语错题到期时,于提示框上方弹出情景卡片,可用 `/nochmal` 边等边作答。卡片和判分各调用一次 Sonnet,状态栏与面板不调用模型;配套 Skill 也能在 Codex 运行,插件依赖 Claude Code 的 mods API(早期访问,测试于 2.1.286)。
作者把 Claude Code 的笔记库放进私有 GitHub 仓库,用 SessionStart 和 Stop 两个 Hook 调用 20 行 bash 脚本,在会话开始时 clone 或 pull、每次回答后 commit 并 push,从而在台式机和笔记本之间同步 114 条笔记。
作者分享自己把 Claude Code 接到免费 LLM API 上的做法,通过设置 ANTHROPIC_BASE_URL 和 ANTHROPIC_AUTH_TOKEN 两个环境变量,把请求路由到 Google AI Studio 的 Gemini 2.5 Flash 或 Groq,Cursor 和 Codex CLI 也有对应的 base URL 配置方式。
作者主张让 AI 智能体只填发票数据、不写 HTML,把版式、法务条款和计算固化在人工审核过的模板里。
一位用户实测同一批 9 条语音生成任务,ChatGPT 经 runway 耗时 48 秒,而使用 GPT Astra 的 Codex 耗时 21 分 18 秒。该用户提醒,若用 Codex 处理非编程任务,可以试试改用 ChatGPT 聊天界面。
作者用 Claude Code 配合 Bit 的 MCP 工具构建并部署了一个客服工单平台,产出 Vite React 前端、Express 工单服务、MongoDB 持久化和带 HTTPS 的托管控制台。
作者为 AI 编码智能体配置了 5 个 Skill,解决三周后智能体反复重写同一个 helper 文件、忘记项目约定、不写测试的问题。
文章用官方 TypeScript SDK 演示如何以编程方式连接 MCP Server,先分别构建 stdio 和 HTTP(Streamable HTTP 与旧版 SSE)两种传输,再共用一个 probe 函数完成握手并枚举工具、资源和提示词。
一位开发者已从 X server 起自建整套桌面环境,包括窗口管理器、终端、shell 和信息栏,并完成含约 50 个应用的 Fe2O3 套件,涵盖文本编辑器 scribe、消息中心 kastrup、浏览器 gaze、文件管理器 pointer、RPN 可编程计算器 rpnx 及可运行 Doom 的游戏引擎 funkey。
一位用户在 r/vibecoding 发帖询问,是否有人已经用 vibe coding 做出把图片和视频转成 Instagram Reel 的应用。他每次外出拍大量照片和视频想做成 Reel,但回家安顿下来往往已过去 2-3 天,也就失去了剪辑兴趣,因此想知道有没有处境相同的人做过这类应用。
JANCTION Render 上线文件上传页,用户把本地 .blend 拖入后获得 12 小时有效的链接,粘贴给 Claude.ai 或 ChatGPT 即可作为 scene_url 提交渲染,无需安装 CLI 或 Blender 插件。