Перейти к содержимому

#Агент

Сегодня 0 материалов
12.01пн
11.01вс
  1. OpenAI Developer Blog · Codex71

    Skyscanner 如何用 JetBrains MCP 增强 Codex CLI

    Skyscanner 工程师把 OpenAI 的 Codex CLI 接入 JetBrains IDE 的 MCP server,让 Codex 能调用 IDE 的 get_file_problems 检查文件错误、执行预设的 run configurations 跑测试和 lint。

    Ожидает перевода

    Почему это важно: Skyscanner 工程师把 Codex CLI 接入 JetBrains MCP,让 AI 直接读取 IDE 报错并跑测试,读者可借鉴这套反馈闭环。

08.01чт
  1. The Agentic Engineer · Blog60

    用 Gemini 为 AI 工作流加上图像目标检测能力

    作者介绍如何用 Gemini 2.5 Flash 做图像目标检测,让 AI 工作流不仅能描述图片,还能返回物体所在坐标。做法是给模型一张图和自然语言提示词,要求返回含 label 与 box_2d 的 JSON 数组,坐标按 0-1000 归一化,再用 normalize_to_pixels 换算回真实像素。

    Ожидает перевода

06.01вт
  1. Harper Reed62

    如何从手机远程使用 Claude Code:Tailscale、Mosh 与 TMUX 配置

    作者介绍自己从 iPhone 远程运行 Claude Code 的完整方案,需要解决网络、终端客户端、工作站和工具四件事。网络用 Tailscale 打通任意设备到工作站的连接,终端客户端选 blink,工作站是一台持续供电、网络良好的 Mac;工具层面用 SSH 密钥、Mosh 保持断线后连接可恢复、TMUX 让多个 Claude Code 会话长期运行并随时重连。

    Ожидает перевода

05.01пн
01.01чт
  1. Permission Protocol · AI Agent Incident Tracker76

    Злоумышленники использовали Claude Code для разведки и атаки методом перебора паролей на OT-инфраструктуру мексиканской водоснабжающей компании

    По данным исследования Dragos, злоумышленники с помощью Claude Code и OpenAI GPT-4.1 атаковали OT-среду мексиканской водоснабжающей компании: Claude Code отвечал за масштабный поиск и идентификацию промышленных шлюзов vNode, изучение учётных данных производителей, генерацию списков паролей и их перебор, а GPT-4.1 — за структурированный анализ данных и вывод результатов на испанском языке.

    Почему это важно: Dragos восстановил полную цепочку действий злоумышленников, которые с помощью Claude Code и GPT-4.1 вели разведку и перебор паролей в OT-среде мексиканской водоснабжающей компании, — так видно, как ИИ распределяется по этапам жизненного цикла вторжения.

29.12пн
  1. Permission Protocol · AI Agent Incident Tracker71

    Zenity Labs 披露 Copilot Studio Connected Agents 默认开启可致静默后门

    Zenity Labs 披露 Microsoft Copilot Studio 的 Connected Agents 功能默认在所有新建智能体上开启,恶意智能体可静默调用同一环境中受信任智能体的工具,且目标智能体的活动标签页不产生任何记录。

    Ожидает перевода

27.12сб
  1. Martin Alderson38

    旅行社用了 10 年崩塌,软件工程师才走到第 3 年

    美国旅行社数量从 2000 年的 124,000 家降至 2012 年的 65,000 家,历时十年;而 LLM 在软件工程领域的采用率从 2022 年的 0% 升至 2025 年的 84%,速度远超当年互联网对旅行社的冲击。作者认为,只会把需求手动翻译成代码的通用型开发者,处境类似当年被 OTA 淘汰的普通旅行社代理。

    Ожидает перевода

25.12чт
  1. The Agentic Engineer · Blog66

    我为什么不再逐行读 AI 生成的代码,改用可视化证据验证

    作者 Matthew Fontana 分享自己不再逐行审查 AI 生成的代码,而是用 Playwright MCP 让智能体截图证明功能可用。他给出的做法是直接提示智能体导航到页面、截图、点击并截图结果,例如让智能体截取空表单、填入非法数据截取校验错误、再正确填写截取成功状态,三张图即可判断表单是否可用。

    Ожидает перевода

20.12сб
  1. Jesse Vincent70

    用 Codex 和 ChatGPT 5.2 反编译 Android 游戏 Wordiest 并移植到 iOS

    作者把 Wordiest 最后一个 Android APK 交给 Codex + ChatGPT 5.2,半小时内得到可玩的核心游戏,几小时后完成 Android 与 iOS 版本,全程未写也未读一行代码。

    Ожидает перевода

    Почему это важно: 作者用 Codex 反编译 Android 游戏并移植到 iOS,展示了智能体开发中难易直觉失效的真实体验。

18.12чт
  1. Jesse Vincent60

    Superpowers 4.0 发布:代码评审拆分为规格评审与代码评审两个智能体

    Superpowers 4.0 发布,核心改动是把实现步骤后的代码评审拆成两个智能体:先由 spec review 智能体确认实现符合计划,通过后 code review 智能体再检查代码质量,两步都改为循环执行,协调智能体知道实现者修复后要重跑评审。

    Ожидает перевода

15.12пн
  1. Permission Protocol · AI Agent Incident Tracker60

    报道称 AI 编码机器人失误导致 AWS 服务中断

    据 Financial Times 报道,中国区一次持续 13 小时的 AWS 服务中断被归因于使用 Amazon Kiro AI 编码智能体时的用户操作失误。Amazon 据称将该事件描述为影响极其有限。报道指出,生产环境的删除、重建或发布变更本应经过签名审批流程,但公开信息未披露具体控制边界,因此无法确认智能体是否触及部署代码、内部工具或发布操作。

    Ожидает перевода

12.12пт
  1. Hacker News · AI Code Review 讨论66

    DeepSource 发布 Autofix Bot:静态分析与 AI 混合的代码审查智能体

    DeepSource(YC W20)团队发布 Autofix Bot,一个把静态分析与前沿 AI 智能体结合的代码审查智能体,面向 AI 编码工作流。其混合架构分三步:5000+ 确定性检查器建立高精度基线并由子智能体抑制误报,AI 审查以静态发现为锚点并调用 AST、数据流图、控制流、导入图等工具,最后由子智能体生成修复、静态校验后输出干净的 git patch。

    Ожидает перевода

10.12ср
  1. Jesse Vincent68

    packnplay: одна команда запускает ИИ-агент для разработки в контейнере

    Джесси Винсент выпустил открытый инструмент packnplay: команда packnplay run claude --dangerously-skip-permissions запускает заранее настроенный временный контейнер для работы ИИ-агента разработки.

    Почему это важно: Автор упаковал в одну команду всю возню с настройкой запуска ИИ-агента для разработки в контейнере и рассказал, как конкретно решать конфликты учётных данных Claude Code.

02.12вт
  1. Jesse Vincent69

    Собираем мост логов между фронтендом и бэкендом для ИИ-агента по разработке, чтобы было проще отлаживать веб-приложения

    Когда автор разрабатывает веб-приложение с помощью ИИ-агента, он часто натыкается на баги в клиентском JavaScript. Если агент не может решить их, просто читая код, он запускает интерактивную отладку через браузерный MCP — только чтобы посмотреть логи в консоли браузера. И токены тратятся, и медленно.

    Почему это важно: Автор предлагает переиспользуемый способ организовать мост логов между фронтендом и бэкендом, чтобы ИИ-агент видел логи фронтенда и без браузерного MCP.

30.11вс
  1. Martin Alderson62

    作者认为我们正处在评测看不见的 GPT-4 式跃迁中

    作者 Martin Alderson 认为当前模型进步是一次更微妙的 GPT-4 时刻,但现有基准测不出来。他指出 Gemini 3 Pro Preview 在设计网页和落地页上明显强于其他模型,并给出流程:上传产品 CSS 让模型提取设计系统,再结合产品截图生成 HTML 原型。

    Ожидает перевода

24.11пн
21.11пт
  1. Jesse Vincent62

    Double Shot Latte:用 Stop hook 让 Claude Code 自动继续干活

    作者发布 Claude Code 插件 Double Shot Latte(DSL),用 Stop hook 在 Claude 想停下来请求人工确认时,把最近几条消息交给另一个 Claude 实例判断是否真的需要人介入,倾向于让它继续工作;若 Claude 在五分钟内三次尝试停止则放弃接管。

    Ожидает перевода

19.11ср
  1. OpenAI · Codex Cookbook67

    Как поэтапно переделать легаси-кодовую базу с помощью Codex CLI

    OpenAI в Codex Cookbook описывает полный процесс переделки легаси-кодовой базы с помощью Codex CLI на примере системы управления инвестиционным портфелем на COBOL: пять этапов вокруг проектного документа ExecPlan.

    Почему это важно: На примере системы управления инвестиционным портфелем на COBOL показаны переиспользуемые документы и процесс проверки для поэтапной переделки легаси-кодовой базы с помощью Codex CLI.

07.11пт
  1. Terminal-Bench · News62

    Terminal-Bench выпустил версию 2.0 и пакет оптимизаций для оценки в Harbor

    Terminal-Bench выпустил версию 2.0 и пакет Harbor: первый — это более строго проверенный и сложный бенчмарк для оценки агентов, второй — для их оценки и оптимизации. Harbor переписал тестовый фреймворк Terminal-Bench: теперь можно разворачивать контейнеры в облаке, есть интерфейсы rollout для RL и SFT, а также совместимость с любыми агентами, которые упаковываются в контейнер.

    Почему это важно: Вместе с Terminal-Bench 2.0 вышел Harbor — читатели узнают, как проверяются бенчмарки для агентов и как масштабировать их в облаке.

02.11вс
27.10пн
  1. Jesse Vincent74

    Переносим Skills и Superpowers в OpenAI Codex CLI

    Автор Джесси Винсент за один вечер перенёс Superpowers и всю систему SKILL.md в OpenAI Codex CLI; релиз вышел вместе с Superpowers 3.3.0.

    Почему это важно: Автор перенёс систему SKILL.md из Claude в Codex CLI, показал соответствие инструментов и способ установки — по этому можно судить, реально ли переиспользовать Skill между моделями.

24.10пт
  1. Jesse Vincent36

    用 ChatGPT Atlas 的 Agent 模式清理 Facebook 信息流

    作者用 ChatGPT Atlas 的 Agent 模式自动清理 Facebook 信息流,通过一段提示词让智能体持续滚动页面、隐藏赞助帖并对含 Follow/Join 链接的帖子点“不感兴趣”,最终信息流只剩自己关注的人发布的真实帖子。作者对 AI 浏览器的提示注入风险仍持警惕,表示目前不会把银行或邮箱凭据交给这类浏览器。

    Ожидает перевода

23.10чт
17.10пт
15.10ср
  1. Martin Fowler · Exploring Generative AI74

    拆解 Spec-Driven Development:Kiro、spec-kit 与 Tessl 三种工具实测

    Martin Fowler 试用 Kiro、spec-kit 和 Tessl 三款自称实现 spec-driven development(SDD)的工具,把 SDD 归纳为 spec-first、spec-anchored、spec-as-source 三个层次,并指出目前所有方案都停留在 spec-first。

    Ожидает перевода

    Почему это важно: 作者亲手试用 Kiro、spec-kit 和 Tessl 三款 SDD 工具,给出 spec-first、spec-anchored、spec-as-source 三层划分,并指出小任务被过度规格化的问题。

12.10вс
  1. Jesse Vincent62

    Superpowers 2.0 发布次日,作者发现 Claude Code 原生 Skills 机制可能让它过时

    作者发布 Superpowers 2.0,把 skills 抽成可 fork 和本地管理的独立 git 仓库,方便添加、定制和分享 skills。随后他在 claude --debug 日志中发现 Claude Code 会把 SKILL.md 的 YAML name 字段转成 SlashCommand,并认为可以自动激活它们,这比他设计的引导方式更可靠。

    Ожидает перевода

02.10чт
01.10ср
  1. Hacker News · Context Engineering 讨论76

    Anthropic об эффективном контекстном инжиниринге для ИИ-агентов

    Команда Anthropic, занимающаяся прикладным ИИ, пишет, что контекстный инжиниринг — продолжение промпт-инжиниринга, а его суть в том, чтобы при ограниченном бюджете внимания отобрать минимальный набор токенов с высоким сигналом.

    Почему это важно: Anthropic официально описывает системный подход к контекстному инжинирингу, включая выбор между тремя стратегиями для длительных задач: сжатием, заметками и субагентами.

29.09пн
  1. Jesse Vincent66

    Переписываем правила CLAUDE.md на языке dot из GraphViz

    Автор переписал правила CLAUDE.md — вместо длинного текста получилась блок-схема на языке dot из GraphViz: имена узлов заданы строками в кавычках, разные формы обозначают решения, команды и предупреждения, а у каждого шага есть явное условие запуска.

    Почему это важно: После того как правила CLAUDE.md превратились в граф на dot из GraphViz, Claude стал лучше их соблюдать. Этот подход можно перенести и на свои проекты.

28.09вс
25.09чт
  1. Martin Fowler · Exploring Generative AI62

    把 AI 锚定到参考应用:用 MCP server 做代码模式漂移检测

    Martin Fowler 分享用参考应用(reference application)给编码助手提供可编译、一致的代码样例,做法是建一个 MCP server 让助手访问 Spring Boot 的 repository、service、controller 等典型模式样例,替代在 markdown 里手写代码片段。

    Ожидает перевода

24.09ср
  1. Hacker News · Context Engineering 讨论87

    Практический опыт Manus в контекстной инженерии для ИИ-агентов: шесть принципов

    Команда Manus поделилась опытом контекстной инженерии, накопленным при создании ИИ-агентов. В основе — проектирование с учётом KV-кэша, управление инструментами через маскирование, а не удаление, использование файловой системы как контекста, управление вниманием через повторение списка задач, сохранение ошибочного содержимого и отказ от привязки к few-shot примерам.

    Почему это важно: Команда Manus обобщила опыт четырёх переписываний фреймворка агентов в шесть принципов контекстной инженерии — их можно напрямую применить к собственной реализации агента.

29.08пт
  1. OpenAI · Codex Cookbook74

    在 GitLab CI/CD 中用 Codex CLI 自动做代码质量检查与安全修复

    OpenAI Codex Cookbook 给出把 Codex CLI 接入 GitLab CI/CD 的完整做法,用于生成 CodeClimate JSON 代码质量报告、把 SAST 结果整理成 security_priority.md,并让 Codex 输出可 git apply 的补丁。

    Ожидает перевода

    Почему это важно: 官方 Cookbook 给出把 Codex CLI 接入 GitLab CI 的完整配置,含提示词约束、JSON 标记提取与 diff 校验,可直接照搬。

26.08вт