让智能体写数据而不是写 HTML:用 MCP 模板与校验避免发票出错
作者主张让 AI 智能体只填发票数据、不写 HTML,把版式、法务条款和计算固化在人工审核过的模板里。
作者主张让 AI 智能体只填发票数据、不写 HTML,把版式、法务条款和计算固化在人工审核过的模板里。
一位 GPU 云平台创始人把团队从 5 人缩到 2 人后,围绕 Claude 自建了一套多仓库开发编排工具 Shiploop,并已开源。它用一个 advisor 会话负责思考和规划,worker 各自在独立 git worktree 中写代码以避免并行冲突,同时跨会话管理上下文、保留失败经验,并把每个任务先写入队列文件防止会话中断丢工作。
一位用户实测同一批 9 条语音生成任务,ChatGPT 经 runway 耗时 48 秒,而使用 GPT Astra 的 Codex 耗时 21 分 18 秒。该用户提醒,若用 Codex 处理非编程任务,可以试试改用 ChatGPT 聊天界面。
作者搭建 mcp-transparency-log,按计划爬取官方 MCP 注册表中所有公开可达的服务器,记录其工具名、描述、JSON schema 和四个 annotation 提示,写入带签名树头的 append-only 日志。
推荐理由:作者连续 37 天夜间爬取 MCP 官方注册表,用可复现的日志量化工具面变化,并公开了两次错误修正过程。
作者用 Claude Code 配合 Bit 的 MCP 工具构建并部署了一个客服工单平台,产出 Vite React 前端、Express 工单服务、MongoDB 持久化和带 HTTPS 的托管控制台。
作者为 AI 编码智能体配置了 5 个 Skill,解决三周后智能体反复重写同一个 helper 文件、忘记项目约定、不写测试的问题。
文章用官方 TypeScript SDK 演示如何以编程方式连接 MCP Server,先分别构建 stdio 和 HTTP(Streamable HTTP 与旧版 SSE)两种传输,再共用一个 probe 函数完成握手并枚举工具、资源和提示词。
一位开发者已从 X server 起自建整套桌面环境,包括窗口管理器、终端、shell 和信息栏,并完成含约 50 个应用的 Fe2O3 套件,涵盖文本编辑器 scribe、消息中心 kastrup、浏览器 gaze、文件管理器 pointer、RPN 可编程计算器 rpnx 及可运行 Doom 的游戏引擎 funkey。
一位用户在 r/vibecoding 发帖询问,是否有人已经用 vibe coding 做出把图片和视频转成 Instagram Reel 的应用。他每次外出拍大量照片和视频想做成 Reel,但回家安顿下来往往已过去 2-3 天,也就失去了剪辑兴趣,因此想知道有没有处境相同的人做过这类应用。
JANCTION Render 上线文件上传页,用户把本地 .blend 拖入后获得 12 小时有效的链接,粘贴给 Claude.ai 或 ChatGPT 即可作为 scene_url 提交渲染,无需安装 CLI 或 Blender 插件。
一个 AI 智能体上线了按次付费的爱尔兰租金 HTTP API,县级租金免费,城镇/都柏林邮区租金 $0.02、房价对比 $0.05,以 USDC 结算。未付费请求返回 HTTP 402,同时携带 x402(Base 上的 USDC)和 MPP(Tempo)两种支付挑战,同一路由同时支持两者。
作者指出 Cursor 和 Claude Code 等工具的 CLAUDE.md 与内置记忆只覆盖单机或单仓库,无法跨工具、跨成员共享团队决策,导致同一架构取舍被反复解释。
一位用户用 Claude Code(Opus 5.5,max effort)制作了一部 3.5 分钟的蟹状星云脉冲星影片,从真实的 Chandra X 射线图像飞入到距脉冲星表面 20 英里处,并配有旁白和原创配乐。
开源项目 Juggling(Apache-2.0,alpha)让 Codex 以 Writer 身份在只读沙箱中作答,再由一个全新的独立 Codex 会话复核,返回 PASS、CHANGES_REQUESTED 或 CANNOT_REVIEW,无法验证必需步骤时以 HOLD 加原因码停止且不重试。
有用户在 Claude Code 中让 Claude 为每项工作估算"若由人类完成"的成本,并对比 API 成本与人类工时的比值。该比值可用于长期观察模型能力是变强还是被削弱——比值下降说明模型更划算,上升则相反。作者也承认估算可能不准确,但认为关键是其随时间的变化趋势。
作者在 Claude Code 的票据管理插件 GraphOps 上实测新增的 Autopilot 功能,睡前执行 /graph-ops:autopilot-tree <ticketId>,醒来时计划、多轮评审、测试和 PR 都已完成。
团队为 x402 商店发布了一个 MCP server,让任何 AI 智能体无需账号和 API key 即可按次付费调用服务。付款前它会读取价格并与钱包主人设定的限额比对,在 Base 上完成支付;未配置钱包时只显示价格不付款,工具信息从商店实时读取,新增商品无需更新。目前尚未产生非测试的真实销售。
MCP 规范在 7 月 28 日改为无状态,取消了 initialize 握手和 Mcp-Session-Id,每个请求自带协议版本、客户端信息与能力,并新增 Mcp-Method、Mcp-Name 头。
用户反馈 Sol 6.1 会在任何借口下中断 /goal 目标,99% 的情况下停止并升级,且理由完全是编造的。该用户表示已按 OpenAI 的提示词建议调整,但模型仍无法像以前那样自主完成目标,必须全程盯着。
一位开发者用 Claude 开发自用 Mac 小应用,靠 readme.md 和 session_state.md 记录项目状态,每次改完代码就让 Claude 执行 git commit push main 推到 GitHub,并频繁使用 /clear。
一位开发者用 openclaw 智能体在聊天室接单、PI coding agent 实际写码,本地跑 glm 5.3 并偶尔用前沿模型做 review,配合 ChatGPT 5.6 sol 做头脑风暴和需求规格,任务记录在自托管 Gitea 仓库。
一位用户从 100 美元 GPT 计划转向 20 美元 Claude Code 计划后,发现 Opus 5.5 medium 比 Sol 6.1 high 快 10 倍,每小时仅消耗约 1% 周用量,但完成工作量更高。
用 AI 开发钓鱼游戏进入第 10 周,作者在 itch 发布了免费测试 demo,可下载试玩并反馈,Steam 版本还要再等几周。本周主要做发布前打磨:船体泡沫从水面贴图改为真实模拟波浪、港口树木与光照等画面升级、风暴巨浪机制重做,并修复若干 bug。
作者把多年来反复对 AI 智能体口述的规则整理成 Senzu,一个面向 Claude Code 和 Codex 的西班牙语插件包,包含 Skills、会直接阻断操作的 muros(hooks)和 /plan、/verificar、/brief 等命令。
作者用 Claude Code 现场把第三方决策模型 Jev(typesafe/jev-1.13,来自 TypeSafe AI)接入工作流,Jev 只回答 choice、score、noul 三类带置信度的结构化问题,经 OpenRouter 调用约每千次两美分、单次不到一秒。
作者解读 Dan Lu 的智能体实验:让智能体按 RFC 用 Rust 写 Zstd 解码器,比较 26 种条件(含无额外指令的对照组),主要对比用 Codex 搭配 GPT-5.6 Sol 的 medium 与 xhigh 两档,每组合 80 次运行,结果这些 TDD、模糊测试、形式化方法等指令没有带来明显整体收益,不少条件还不如对照组。
Jam 的托管 MCP server 是主要编程接口,提供 33 个工具(其中两个为别名),而 Jam 并未发布通用 REST API 参考。读取 Jam 时 MCP 与 CLI 能力接近,但只有 CLI 加 webhooks 能创建 Jam、录制屏幕并响应 jam.created 事件。Jam MCP 认证支持浏览器 OAuth 和 PAT,PAT 绑定单一用户与工作区,有效期最长一年。
drobek 允许应用所有者把已发布到 gallery 的应用设为可复制,其他人可将其复制进自己的工作区并让 AI 智能体修改。副本以源应用的已发布文件作为 version 1,拥有独立身份和版本历史,但不继承原作者的预览改动、用户、记录、API key、密钥值、上传文件和代理配置。
把远程 MCP server 接入 Claude Code 只需一条命令:给 Claude Code 一个名称和服务器地址,服务器连上后其工具即可在同一会话中供智能体调用。更难的是服务器一侧——要决定无密钥、无付费的用户能做什么,文章以自家 server 为例展示这两部分。
MCP Server 需要两步发布:二进制推到 npm 或 PyPI,元数据发布到官方 MCP Registry,Glama、PulseMCP、mcp.so、Smithery 等目录只是重新扫描并缓存 Registry 的内容。
2026 年 AI 编程工具已分化为三类:GitHub Copilot 以插件形式嵌入编辑器,Cursor 是独立 AI IDE,Anthropic 的 Claude Code 则是终端优先的智能体。
在 Claude Code 或 Cursor 中,把仓库粘贴进聊天只服务当前对话,不会留下可复用的 Agent Skill;本地 SKILL.md 则是一个可在本机反复加载的文件。
Claude Code 与 Cursor 在五项 TypeScript monorepo 任务中各完成 4/5,中位通过 CI 时间分别为 12m 40s 和 11m 05s,结论是平局。
有开发者在 VS Code 中测试一套多智能体开发工作流,用 GitHub Copilot 额度同时调度多个大语言模型:Claude 5.5 Opus 作为中央协调者负责主开发架构并下发后台子任务,Codex CLI 在后台并发执行这些子任务,GPT-6.1 则在 IDE 内驱动多个并行子智能体处理代码补全、重构和上下文辅助。
一份教程演示如何用 Claude Code、Codex、Cursor 或 Antigravity 生成单文件 index.html 学习计时器,数据存在浏览器 localStorage,可离线运行、无需账号和服务器。
Vinkius 发布 Maker-Space Access Planner,一个基于 MCP 的决策支持引擎,把用户身份、培训认证与项目需求三类条件交叉校验,暴露 evaluate_access_eligibility、validate_tool_requirements 等四个工具,避免智能体靠猜测判断门禁。
作者把 Claude Code 与 Auth0 MCP Server 配对,用最小权限 scope、OAuth 2.0 设备授权流和 CLAUDE.md 约束,让智能体在单个终端会话里审计并重构一个 Flask 应用的 Auth0 JWT 校验。
Uber Engineering 介绍了其 MCP Gateway 的设计,该平台在发布时托管了 800 多个 MCP server 和 5000 个工具,让已有的 HTTP、gRPC、TChannel 服务无需改动即可通过 MCP 访问。
Taimen 团队开源了 v0.2.0(Apache-2.0),并复盘用平台自身队列开发它的过程:核心实体是独立于执行者的工作单元,代码任务只有在分支合并后才算关闭,验收由任务类型声明人工评审加确定性合并两步。