实测十款 Claude Code Mod:守卫崩溃后命令照样执行,只留下三款
作者在 Claude Code 2.1.288 上用 85 个会话、882 条提示、5993 次工具调用实测十款 Mod,发现没有 .catch 的守卫 Hook 抛错后会被跳过,命令照常执行,加上 catch 返回 deny 才能失败关闭。
推荐理由:作者用 85 个会话、5993 次工具调用实测十款 Claude Code Mod,给出可迁移的取舍标准与失败开放问题。
用 Hooks、脚本和 CI 约束和自动化 Agent 的行为。
作者在 Claude Code 2.1.288 上用 85 个会话、882 条提示、5993 次工具调用实测十款 Mod,发现没有 .catch 的守卫 Hook 抛错后会被跳过,命令照常执行,加上 catch 返回 deny 才能失败关闭。
推荐理由:作者用 85 个会话、5993 次工具调用实测十款 Claude Code Mod,给出可迁移的取舍标准与失败开放问题。
作者给 Claude Code 加了 Read(./.env) 拒绝规则,但 Claude 在 Read 被拒后改用 Bash 执行 grep DATABASE_URL .env,把生产连接串打印到了对话里。
推荐理由:作者实测发现 Read 拒绝规则挡不住 Bash 读取 .env,并给出三层防护配置,可迁移到自己的权限设置。
俄罗斯电商平台 Flawwow 的联合创始人 Артем Гамбицкий 介绍了公司内部的产品沙箱:允许没有工程背景的同事把 AI 智能体写的应用直接发布到生产环境,四个月内 150 人提交了 262 个项目、约 5000 次部署,这些代码没有任何程序员读过。
推荐理由:作者公开了让非工程同事用 AI 智能体写代码并安全上线的四层防护与资源踩坑细节,可迁移到自建内部沙箱。
一位有六年 SaaS 经验的产品设计师用 Claude Code 独自开发生活规划器 Котомка,几乎全部代码由 AI 编写,他负责提需求、验收和决策。
推荐理由:作者用真实仓库记录了一个人靠 Claude Code 做产品时踩过的坑,以及围绕 AI 搭起的规则、Hook 和测试护栏。
作者参照自己的 Codex 配置,为 Claude Code 搭了一套按角色分配模型的路由:主线程做协调者,explorer 用 Haiku 只做代码搜索,worker 用 Opus 走 TDD 实现,verifier 用 Sonnet 独立跑检查,senior 用 high 档 Opus 处理资金、数据和并发,reviewer 换另一个模型做语义评审。
推荐理由:作者用一周实测给出 Claude Code 多模型分工的配置、Hook 强制约束和成本取舍,可迁移到自己的多智能体流程。
Cursor 推出「项目」功能,用于承接一项功能、一次迁移或一个完整应用这类长周期工作,可在数月内保持上下文并把任务委派给成千上万个子智能体。项目由云端智能体驱动,协调智能体不写代码,只负责规划、分派并交回成果,需要本机测试时再启动本地智能体;每个项目维护一组在云端和本地机器间同步的文件,持续积累研究成果、artifacts 和对代码库的了解。
推荐理由:官方给出项目式多智能体协作的上下文共享与自动触发机制,可据此判断长周期任务如何被接管。
一个六人移动端团队用 Cursor 的 hooks、safe-list 和 Telegram 机器人,把项目约定从提示词变成运行时强制。
推荐理由:作者把 Cursor 的 hooks、safe-list 和 Telegram 机器人串成一套可复用的团队协作方案,读者能据此判断哪些约束该交给运行时而非提示词。
Spotify 开源插件 shunt,通过 Claude Code 的 PreToolUse hooks 拦截超过 350 行的整文件读取,把 Read 以及 cat。
推荐理由:Spotify 用 PreToolUse Hook 把大文件读取和样板代码生成转给廉价模型,给出可迁移的成本拆分思路。
Cline 团队用 Cline SDK 搭了一个代码审查智能体,把审查拆成 review 与 judge 两段 agent 循环,再由驱动脚本把存活的问题以一条 COMMENT 事件批量提交到 GitHub PR。
推荐理由:完整拆解一个代码审查智能体的插件、Hook 与两段式循环,可迁移到其他自动化审查场景。
Cursor 更新云端智能体和 Cursor harness,让云端智能体可以订阅事件源,在 PR、Slack 讨论串或定时任务有新动态时恢复运行,并持续推进直至完成,修复 CI 问题、处理 bot 评论。
推荐理由:云端智能体从单次执行转向订阅事件、持续跟进 PR 与 Slack 讨论串,读者可据此判断自动化边界的变化。
Anthropic 宣布从 8 月 14 日起,Pro、Max 和 Team 套餐的新会话默认运行 auto mode,并停止对分类器额外 token 开销收费;Enterprise、Claude API、AWS、Bedrock、Google Cloud 和 Microsoft Foundry 暂时保持可选,计划下个月改为默认。
推荐理由:Anthropic 公布 auto mode 的安全评测数据与内部拦截案例,可据此判断默认权限模式对现有工作流的影响。
Cline 官方博客介绍如何用插件和 Hook 给智能体循环加上确定性行为与护栏。插件是单个对象文件,可复用在同一份代码的 CLI、VS Code、JetBrains 和 SDK 上。
推荐理由:原文给出 Cline 插件与 Hook 的完整代码示例,读者可据此为智能体循环加上日志记录和危险命令拦截。
Anthropic 在 Claude Code 内部已积累数百个活跃使用的 Skill,团队将其归纳为库与 API 参考、产品验证、数据获取与分析、业务流程自动化、代码脚手架、代码质量与评审、CI/CD 与部署、Runbook、基础设施运维九类,并指出最好的 Skill 应干净地落在其中一类。
推荐理由:Anthropic 内部数百个 Skill 的分类框架与编写经验,可迁移到团队自建 Skill 库。
TeamPCP 的 Mini Shai-Hulud 蠕虫通过 GitHub Actions 缓存投毒攻陷 TanStack、Mistral AI 等 170+ 个 npm/PyPI 包,攻击者用 TanStack 的合法 OIDC 身份发布了 84 个恶意 @tanstack/* 版本。
推荐理由:复盘了攻击者如何借 GitHub Actions 缓存投毒窃取 OIDC 令牌并写入 Claude Code Hook 实现持久化,可了解供应链攻击的新手法。
Martin Fowler 团队的文章梳理了编码智能体的上下文工程,把上下文配置分为可复用提示词(指令与指导两类)、上下文接口(工具、MCP Server、Skills)和工作区文件,并按“谁决定加载”分为 LLM、人类和智能体软件三类。
推荐理由:以 Claude Code 为例梳理编码智能体的上下文配置手段,并给出按需加载与逐步构建的取舍思路。
作者为 Claude Code 构建了 episodic-memory 插件,让它能检索过去的会话记录。Claude Code 默认把 ~/.claude/projects 下的 .jsonl 会话日志在一个月后删除,可通过 ~/.claude/settings.json 的 cleanupPeriodDays 延长保留。
推荐理由:作者把 Claude Code 的会话日志做成可语义检索的情景记忆,读者可据此判断长期上下文如何跨会话保留。