Перейти к содержимому

#Агент

Сегодня 0 материалов
06.10вт
  1. DEV Community · Codex74

    Codex 与 Claude Code 同任务实测:质量打平,Codex 成本低 2.4 倍

    作者在 python-humanize 仓库上用四个任务(真实 issue 修 bug、按规格加功能、无行为变更重构、带 3 个植入 bug 的代码评审)各跑两遍,Claude Code 2.1.291(claude-opus-5-5)与 Codex CLI 0.160.0(gpt-6.1-sol)16 次运行全部通过检查,四个评审都找齐 3 个植入 bug 且无误报。

    Ожидает перевода

  2. Reddit · ClaudeCode / Codex / VibeCoding60

    OpenAI 在欧盟为 ChatGPT 和 Codex 文本加入 textGrain 隐藏水印

    OpenAI 表示欧盟符合条件的 ChatGPT 和 Codex 文本将携带名为 textGrain 的隐藏水印,未来几周内面向所有套餐推出,目前仅限欧盟。该水印是词选择上的统计模式而非可见标签,OpenAI 称其不识别用户、账号或提示词,检测器不公开,仅获批研究人员可申请使用。

    Ожидает перевода

  3. DEV Community · MCP76

    Как ИИ-агент на самом деле использует ваш MCP-сервер: пять типов сбоев, которых не видно в логах

    Автор разметил собственный демонстрационный MCP-сервер для бронирования с помощью самодельного mcpspan и по результатам анализа выделил пять типов проблем с вызовами агента, которых не видно в логах: агент угадывает несуществующие имена инструментов; параметры не соответствуют схеме, и SDK отклоняет их ещё до вызова хендлера; из-за формулировки описания инструмента тип параметра понимается неверно; один и тот же параметр повторяется в цикле ретраев; а слишком большой объём ответа переполняет контекстное окно.

    Почему это важно: Автор на практике с помощью самодельного инструмента анализа MCP выявил пять типов сбоев при вызовах агента, которых не видно в логах, — эти находки можно перенести на свой MCP-сервер для диагностики.

  4. Reddit · ClaudeCode / Codex / VibeCoding59

    用 Claude Code 修复 Codex 遗留的 Blender 怪物模型颈部贴图

    作者用 Codex 的 Sol 5.6 在 Blender 里搭出一个复杂怪物模型,项目当时只有几百 MB;随后 Astra 和 Sol 6/6.1 花数周修复颈部一块皮肤贴图,中间草稿和迭代文件让项目膨胀到近 3TB,问题仍未解决。

    Ожидает перевода

  5. DEV Community · MCP71

    用 100 行 Python 检查器识别链式 Skill 审批劫持

    作者用标准库 Python 写了一个约 100 行的 chain_check.py,用两条规则检测链式 Skill 审批劫持:单 Skill 规则标记同一文本中同时出现状态变更动作(upload、send、delete、transfer)和审批声明的 Skill,链式规则在已安装 Skill 间构建写读图,标记 A 写入含审批声明的文件、B 读取后执行状态变更动作的路径。

    Ожидает перевода

  6. Habr · Claude Code64

    用英文给编码智能体写提示词更省 token 吗?40 次实测只差 12 个 token

    作者用 5 个 Python 任务、Haiku 4.5 和 Sonnet 5.5 各跑两遍共 40 次,对比俄语和英语提示词的 token 消耗与成本。俄语提示词平均每任务多 12 个 token,但单次运行平均读取约 22.2 万输入 token,其中 94% 是每轮从缓存重读的系统提示词、工具说明和项目文件,语言差异只占约 0.005%。

    Ожидает перевода

  7. DEV Community · Claude Code62

    写一个智能体能用的 SKILL.md,并先测试它

    作者提出 SKILL.md 只有在 description 与用户提问匹配时才会被加载,正文决定加载后发生什么,因此值得信任的前提是先用真实输入跑一遍并读回结果。他建议把规则写成可校验的形式,并在一个更强和一个更弱的模型上分别测试,且测试要能失败。

    Ожидает перевода

  8. DEV Community · MCP78

    Инъекция промпта — это проблема плоскости данных: переносим границу от модели к вызову инструментов

    Автор считает, что инъекцию промпта не стоит пытаться решить с помощью более умных моделей. Вместо этого границу нужно провести там, где агент выполняет действия, — так же, как при SQL-инъекциях используют параметризованные запросы.

    Почему это важно: Автор проводит аналогию между инъекцией промпта и SQL-инъекцией и предлагает перенести границу с уровня модели на уровень вызова инструментов, а также приводит практичную схему: стратегический слой и поэтапное разделение чтения и записи.

  9. Reddit · ClaudeCode / Codex / VibeCoding71

    用 vibe coding 替换企业 SaaS:省下订阅费却花了 1.5 万到 2 万美元

    作者所在公司想用 AI 自研工具替换一个每月 200 美元、支持 200 多个应用的同步类 SaaS,结果开发约 1 个月、支持与修 bug 又花 1 个月,同步 bug 还导致公司多数产品在批发网站上显示缺货数周,估计损失 1 万美元销售额。

    Ожидает перевода

  10. Habr · Вайбкодинг69

    用 Claude 和 ChatGPT 一周做出耳部穴位图谱:AI 哪里做对了,哪里在骗人

    一位有医学背景的作者用 Claude 写代码、ChatGPT 生成图片,花约一个工作日做出可交互的耳部穴位图谱,包含 15 个耳部穴位、可平滑切换的五层解剖结构、按是否有综述筛选、键盘导航和英文版卡片,第二页为颈后 9 个穴位。

    Ожидает перевода

  11. Reddit · ClaudeCode / Codex / VibeCoding60

    用旧 Android 加 6 美元 ESP32 冒充蓝牙耳机,把电话接进 Codex CLI 实时语音

    作者用一块 599 卢比(约 6 美元)的 ESP32 冒充蓝牙耳机(hands-free profile,16 kHz),把通话音频经 USB 传回手机,再由手机上的应用推流给 Codex CLI 的实时语音,全程用 ChatGPT 套餐登录,不需要 API key、Twilio 或 SIP。

    Ожидает перевода

  12. DEV Community · MCP58

    MCP 与自定义 REST 工具的安全对比及最新 MCP 架构

    文章对比了 MCP 与自定义 REST 工具在安全上的差异,指出 MCP 只标准化通信,认证、授权、最小权限、输入校验和监控仍需应用与后端自行实现。文中介绍了当前定稿的 MCP 规范 2026-07-28 的关键变化,包括无状态协议设计、server/discover、Streamable HTTP、多轮往返请求和 Tasks 扩展,并说明本地仍常用 stdio。

    Ожидает перевода

  13. Tproger · Программирование12

    Future AGI 1.47.0 新增通话指标并改进 AI 智能体回答评估

    Future AGI 1.47.0 发布,在运行分析中新增通话与语音指标卡片,并修复模拟通话结果与运行详情的对齐问题。评估对话时,错误语言回答、涉及其他产品的回答以及未获回复的请求现统一计为未处理请求;测试环境评估还修复了完整提示词和对话参与者标识的传递。聊天构建器页面支持折叠与调整宽度,宽度在窗口缩放后保留。

    Ожидает перевода

  14. DEV Community · MCP78

    Анонимная проверка работоспособности 78 MCP-серверов из реестра: полный цикл вызовов проходят 51.3%

    Pennyforge провёл анонимную проверку работоспособности 78 серверов, отвечающих на initialize, из 186 эндпоинтов в публичном срезе реестра MCP с диапазоном a–b. Полный цикл initialize → tools/list → один безопасный tools/call прошли только 40 из них (51.3%).

    Почему это важно: Анонимная проверка работоспособности 78 MCP-серверов из реестра с воспроизводимыми данными по многоуровневой аутентификации и миграции версий спецификации.

  15. DEV Community · Claude Code65

    query-inspector:在提交前提取并调优 SQL/ORM 查询的 Claude Code Skill

    query-inspector 是一个 Claude Code 插件,由 tuning-report 和 inventory-report 两个 Skill 组成,从 git 变更中提取 SQL/ORM 查询,诊断缺失索引、N+1 和反模式,并给出带 file:line 的 CREATE INDEX 建议。

    Ожидает перевода

  16. DEV Community · MCP22

    Snaplii 推出 AI Agent 钱包 Snaplii Cash:预充值额度能兜底,但无法判断单笔消费该不该花

    Snaplii 于 10 月 5 日发布 Snaplii Cash,一个供 AI 智能体消费的独立预充值钱包,用户可设置消费上限(示例 $50),智能体不接触信用卡和银行信息,并支持 MCP 兼容的一次性预充值凭证。

    Ожидает перевода

  17. 宝玉71

    SemiAnalysis 实测 Anthropic、OpenAI 等九家 AI 订阅套餐后得出,同样 200 美元,Claude 订阅折算的 Token 用量约为 OpenAI 的 5 倍。

    Ожидает перевода

    ЦитатаSemiAnalysis@SemiAnalysis_

    Anthropic Subscriptions Offer 5x+ More Value Than OpenAI Limit testing every AI subscription plan from Anthropic, OpenAI, Meta, SpaceXAI, MiniMax, Moonshot, Zdotai, Cursor, and Cognition https://newsletter.semianalysis.com/p/anthropic-subscriptions-offer-5x

  18. 宝玉71

    据 The Information 10 月 5 日报道,Meta 和微软都在减少员工内部使用 Anthropic 的 Claude,转向自家模型和工具。

    Ожидает перевода

    ЦитатаNIK@ns123abc

    🚨BREAKING: Microsoft and META are aggressively cutting employee use of Claude ahead of Anthropic's IPO Microsoft has cut internal claude spend by more than 33%, nuked per-employee token budget from $100k/month to $10k/month, and forced Copilot to auto-route to cheaper models META used Claude code to build Muse, then cut active users from 60,000 to 30,000 (50% decline) after launch, and replaced it with Muse Code Palantir and Nvidia are also scaling back claude over soaring prices and data privacy fears it’s OVER…

  19. DEV Community · MCP62

    A2A 与 MCP 在 2026 年如何分工:什么时候该让智能体互相通信而不是调用工具

    作者认为 MCP 与 A2A 不是竞争关系,而是不同层次的两类协议:MCP 面向被调用的工具与数据服务,A2A 面向拥有目标、能自行规划并回报任务状态的同级智能体。判断标准是问对方是否拥有目标并自行决策,是能力就归 MCP,是自主工作者就归 A2A。两者可以组合成栈,A2A 负责智能体之间的委派,MCP 负责智能体内部调用工具,作者建议先用工具,只有存在真正可委派的目标时才升级为智能体。

    Ожидает перевода

  20. DEV Community · MCP65

    mcpward 1.1 上架 GitHub Actions Marketplace,用 lockfile 锁定 MCP 工具契约

    mcpward 更新到 1.1 并上架 GitHub Actions Marketplace,它把 MCP 服务器 tools/list 返回的工具定义存进 lockfile,工具描述、必填参数或 readOnlyHint 发生变化时让 CI 失败。

    Ожидает перевода

  21. Habr · Вайбкодинг62

    一位 Rust 开发者为什么仍然害怕用 AI 写代码

    Rust 开发者 NikTimf 在 Habr 撰文说,自己仍然害怕用 AI 写代码,原因不是生成质量差,而是生成量太大、后续没人真正看懂。他列举了具体代价:多个智能体之间要反复传递上下文,答案冲突时还得自己判断谁对;公司只允许本地或自研模型时,用惯强模型的人很难退回;同事充当 meat proxy 转发 AI 答案,理解任务和推进实现的活仍落在自己身上。

    Ожидает перевода

  22. Hacker News · Vibe Coding 讨论71

    一个不会写代码的工厂工人如何用 Vibe Coding 搭出 Linux 智能体编排应用 B.O.T.S.

    一位没有编程基础的作者讲述自己从 Bolt、Claude 到 ChatGPT 的 Vibe Coding 经历,最终用 12 个阶段、171 小时编排运行时间搭出 Linux 原生个人智能体编排工具 B.O.T.S.。

    Ожидает перевода

  23. Reddit · ClaudeCode / Codex / VibeCoding71

    windvane:自动起草检查点、在合适时机压缩并自行恢复的 Claude Code 插件

    作者发布 windvane,一个 MIT 许可、无依赖的 Claude Code 插件,用 Python 引擎在会话中自动看护上下文:recorder 根据任务列表、编辑、提交和上一条回复起草检查点,模型一次调用即可接受或改一个字段;插件监控上下文填充,在检查点落盘后于下一个回合边界压缩,并自行发一条提示让模型从检查点继续。

    Ожидает перевода

  24. Reddit · ClaudeCode / Codex / VibeCoding58

    AI Pair 发布 VS Code 扩展:让 AI 智能体以人类节奏打字并讲解

    作者发布 VS Code 扩展 AI Pair Programmer,让编程智能体在编辑器里以可跟上的速度逐字输入并解释自己在做什么,用户可随时打断或接管。该扩展内置支持 Claude Code、Codex、OpenCode、Gemini CLI、Cursor 和 GitHub Copilot,任何支持 MCP 的智能体也可手动接入,作者称它更适合能力较强的模型,弱模型在这种工作方式下容易吃力。

    Ожидает перевода

  25. Hacker News · MCP60

    Metagente 发布:用几行声明式代码构建原生支持 MCP 和 A2A 的 AI 智能体

    Metagente 是一个用于构建 AI 智能体的小型语言,作者用 Rust 写成的单二进制解释器执行声明式 agent 文件,原生支持 MCP 和 A2A,可直接调用任意 MCP 工具并与其他智能体通信。

    Ожидает перевода