跳到正文

新工具与 Skill

值得一用的新工具、新 Skill、新 MCP Server 和开源项目。

最新精选

第 1–20 条 · 共 31 条
10/6周二
  1. DEV Community · MCP76

    AI 智能体实际会怎样使用你的 MCP server:五类日志看不到的失败模式

    作者用自建的 mcpspan 对演示订票 MCP server 做埋点分析,总结出五类日志里看不到的智能体调用问题:智能体猜测不存在的工具名、参数不符合 schema 被 SDK 在 handler 前拒绝、工具描述措辞导致参数类型理解错误、同一参数反复重试的循环,以及响应体积过大挤占上下文窗口。

    推荐理由:作者用自建 MCP 分析工具实测出五类日志里看不到的智能体调用失败模式,可迁移到自己的 MCP server 排查。

  2. Reddit · ClaudeCode / Codex / VibeCoding76

    本地代理把 Claude Code 请求分散到多个 Max 账号,并在额度耗尽前切换

    作者开源了 claudemanager,一个本地守护进程,让 Claude Code 通过 ANTHROPIC_BASE_URL 指向它,只改动请求的 Authorization 头,就能把会话路由到 5 小时、每周和单模型窗口余量最多的 Max 账号,并在窗口填满前按自定义阈值切换。

    推荐理由:作者开源了一个本地代理,把多个 Claude Code Max 账号按额度余量自动分流,并顺带记录了请求日志。

  3. Hacker News · MCP78

    Flash-Agents:把 Claude Code 的编码任务交给 DeepSeek Flash worker 的 MCP 插件

    Flash-Agents 是一个 Claude Code 插件,把实现切片、移植测试、审查 diff、梳理代码库这类有边界的编码工作交给 DeepSeek V4.1 Flash worker,Claude 保留架构、验收标准和最终审查。

    推荐理由:作者把 Claude Code 的编码任务外包给 DeepSeek Flash worker,并给出沙箱、补丁与实测数据,可据此判断成本与安全边界。

  4. Hacker News · MCP78

    Spill:把超大的 MCP 返回结果移出上下文,存入本地 DuckDB

    Spill 是一个 Apache-2.0 开源工具,通过 Hook 拦截超过 32 KiB 的 MCP 工具返回,将其存为本地 DuckDB 表(~/.spill/spill.duckdb),智能体只拿到一个紧凑描述符,再用 SQL 查询而不是读入 5 万 token 的原始 JSON。

    推荐理由:Spill 把超大 MCP 返回落到本地 DuckDB,让智能体用 SQL 取数,为上下文窗口紧张提供了一种可复用的思路。

10/5周一
  1. Reddit · ClaudeCode / Codex / VibeCoding78

    用 CLAUDE.md 加本地 MCP 记忆架构,避免 Claude Code 反复纠正和烧额度

    作者开源了 Project Athena v9.9.9 内核(MIT 许可),一套本地优先的记忆与治理框架,用于解决 Claude Code 反复纠正、子智能体越界改文件、以及中途撞上额度上限后状态丢失的问题。

    推荐理由:作者用 1900 次会话验证的 CLAUDE.md 瘦身与本地记忆方案,给出了可直接复用的目录结构和验证规则。

  2. Hacker News · MCP77

    我连续 37 天夜间测量 MCP 注册表:19.2% 的服务器 24 小时内改动了工具面

    作者搭建 mcp-transparency-log,按计划爬取官方 MCP 注册表中所有公开可达的服务器,记录其工具名、描述、JSON schema 和四个 annotation 提示,写入带签名树头的 append-only 日志。

    推荐理由:作者连续 37 天夜间爬取 MCP 官方注册表,用可复现的日志量化工具面变化,并公开了两次错误修正过程。

10/4周日
  1. Hacker News · MCP76

    RugSnare:对 MCP 工具描述做哈希固定,检测批准后的静默变更

    RugSnare 是一个针对 MCP 工具描述的运行时完整性工具,对每个已批准工具的 { name, description, inputSchema } 做规范化哈希固定,之后任何静默变更都会触发告警并让 CI 失败(exit 1)。

    推荐理由:RugSnare 把 MCP 工具描述做哈希固定,在批准之后持续检测静默变更,并给出 66 组官方 server 版本的实测数据。

10/3周六
9/15周二
9/10周四
  1. Vibe Code Textbook · Articles78

    编程智能体的四种提示词模式:plan mode、skills 与保存的提示词

    文章从 Claude Code、Codex 和 Gemini CLI 的官方文档中整理出四种提示词模式:先计划再编辑、给智能体一个可运行的检查、让智能体反过来访谈你、把反复重打的提示词存成文件,并给出各家对应的命令、参数和文件格式。

    推荐理由:横向对照 Claude Code、Codex、Gemini CLI 三家文档,给出计划模式、可运行检查、访谈式提问和保存提示词四种模式的命令与文件格式。

9/2周三
  1. Hacker News · Agent Skills78

    mattpocock 发布面向真实工程的 AI 编程 Agent Skills

    作者 mattpocock 发布了一套自己日常使用的 AI 编程 Agent Skills,定位是真实工程而非 vibe coding,强调小而可改、可组合、兼容任意模型。

    推荐理由:作者把多年工程经验拆成一组可组合的 Skill,并说明每个 Skill 针对的失败模式,读者可据此判断能否接入自己的开发流程。

7/11周六
  1. Habr · Kova13v80

    用证据契约约束 Claude Code 的测试结论:一套 QA Skill 包

    一位 QA 工程师把半年在 Claude Code 上做 Web 测试的经验整理成开源 Skill 包 paranoid-qa,核心是一份证据契约:Pass/Fail 只能依据截图、请求体、日志等实际产物,未验证写 Not tested,环境受阻写 Blocked,表单必须检查真实提交 payload。

    推荐理由:作者把半年 QA 经验固化成 Claude Code 的测试 Skill 包,并给出可直接复用的证据契约与失败清单。

7/8周三
  1. AI Hero · Skills Updates65

    AI Hero skills 仓库发布 v1.1:新增 /wayfinder,重命名 /to-spec 与 /to-tickets

    AI Hero 的 skills 仓库发布 v1.1,把 /to-prd 重命名为 /to-spec,将 /to-plan 和 /to-issues 合并为 /to-tickets,并新增 /wayfinder、/research、/prototype 等 Skill。

    推荐理由:作者把 grilling 到部署的完整 Skill 流程讲清楚,并给出重命名、合并和新增 /wayfinder 的迁移命令,适合想搭 AI 开发工作流的人参考。

6/25周四
  1. Kondasamy Jayaraman · Engineering Blog78

    Ponytail:让 AI 智能体少写代码的规则集与六级决策阶梯

    Ponytail 是一个 MIT 许可的规则集,可接入 Claude Code、Codex、Cursor、Copilot、Gemini CLI 等智能体,通过六级决策阶梯让模型在写自定义代码前先判断是否该做、标准库或平台内置能否解决,从而减少生成代码量。

    推荐理由:Ponytail 用六级决策阶梯约束 AI 智能体少写代码,并给出真实仓库上的基准与成本数据,可迁移到团队规范。

6/20周六
5/14周四
  1. Permission Protocol · AI Agent Incident Tracker78

    Microsoft Defender 发现 Mage AI 与 MCP 服务器未鉴权部署,可获 cluster-admin 权限执行 RCE

    Microsoft Defender for Cloud 发现生产环境中的 Mage AI 与 MCP 服务器未启用鉴权,攻击者可执行 shell 命令并获得 cluster-admin 权限,还能窃取同集群工作负载的凭据。

    推荐理由:材料给出 Mage AI 与 MCP 服务未鉴权部署导致 RCE 的完整链路,可据此检查自家 Helm chart 与 MCP 配置。

5/12周二
5/11周一
5/9周六
  1. OpenAI · Codex Cookbook72

    OpenAI 在 Codex 中推出 Goals 持久目标功能

    OpenAI 在 Codex 0.128.0 起提供 Goals 功能,把一次性提示词变成线程内持久目标,Codex 会持续对照测试、基准或产物等证据判断是否完成。

    推荐理由:官方给出 Goals 的适用边界、六要素写法和生命周期命令,可据此判断何时该用持久目标替代一次性提示词。

4/30周四
  1. AI Hero · Skills Updates62

    AI Hero 更新 Skills:/ubiquitous-language 并入 /grill-with-docs

    AI Hero 的 skills 仓库更新,把 /ubiquitous-language 废弃并合并进新 Skill /grill-with-docs,输出从 ubiquitous-language.md 改为 context.md,并支持多个限界上下文各自维护共享语言。

    推荐理由:作者把 /ubiquitous-language 合并为 /grill-with-docs,并给出 ADR 触发条件与多限界上下文做法,可迁移到自己的 Skill 配置。