Перейти к содержимому

Практика и руководства

Лучшие практики, воспроизводимые рабочие процессы и руководства с командами и настройками.

Новые избранные материалы

Материалы 41–60 · Всего 117
19.08ср
  1. Cline · Blog71

    Методика оценки и трассировка открытых моделей Cline

    Cline открывает методику оценки своих открытых моделей и выкладывает для скачивания и анализа трассировки и результаты «восхождения», стоившие больше тысячи долларов. В статье приводится Hill Climber's Checklist — пять эвристик: задать метрику-«Полярную звезду», измерить шум, разложить режимы отказа по задачам, моделям и поставщикам, не считать по умолчанию, что чем больше рассуждений, тем лучше, и сохранять закрытый оценочный набор.

    Почему это важно: Cline публикует методику оценки и трассировки на тысячи долларов и даёт пять переносимых эвристик «восхождения», полезных командам, которые собирают собственный harness.

  2. OpenAI Developer Blog · Codex71

    OpenAI открыла исходный код Codex harness и опубликовала клиентский протокол app-server

    OpenAI выложила в открытый доступ harness, на котором работают приложение Codex, CLI и расширения для IDE, а через клиентский протокол Codex app-server открыла такие возможности, как создание потоков, запуск раундов, получение событий и обработка запросов на утверждение.

    Почему это важно: Компания официально опубликовала harness Codex и протокол app-server — по ним можно понять, как встраивать ИИ-агентов в собственные продукты и где проходят границы такого встраивания.

18.08вт
  1. Lovable · Blog74

    Как Lovable перенесла lovable.dev с Next.js на собственный стек TanStack Start

    За шесть месяцев Lovable перевела lovable.dev с месячной аудиторией 4200 на собственный хостинговый стек TanStack Start. Во время миграции оба фреймворка работали параллельно: прокси-воркер распределял трафик по маршрутам и пользователям. В итоге на код, специфичный для Next.js, осталось всего 3%.

    Почему это важно: Lovable официально разобрал, как перенёс 90 тысяч строк кода с Next.js на собственный стек TanStack Start: детали параллельной работы двух фреймворков, массовой миграции силами ИИ-агентов и одного инцидента с переполнением памяти можно смело перенимать.

14.08пт
  1. Addy Osmani · Blog78

    Циклическая инженерия по Эдди Османи: управление параллельными ИИ-агентами через примитивы goal и loop в Claude Code

    Эдди Османи рассказывает, как каждый день параллельно запускает от 5 до 10 ИИ-агентов, обычно не больше 5 одновременно, и раскладывает циклическую инженерию на два примитива Claude Code: goal доводит одну ограниченную задачу до проверяемого критерия завершения, а loop с фиксированным интервалом перезапускает промпт, как cron.

    Почему это важно: Автор разбирает свою повседневную практику параллельного запуска от 5 до 10 ИИ-агентов на два примитива — goal и loop — и показывает, как писать переиспользуемый Skill проверки и условия остановки.

11.08вт
  1. Paper Compute · Engineering Blog80

    如何降低 AI Agent 成本:审计 500 个 Claude Code 会话后的三类成本泄漏

    作者用 tapes 记录并导出团队最近 500 个 Claude Code 会话,按工具名和参数做指纹统计,发现同一会话内完全重复的工具调用只占 3.6%(932/25587),真正的开销在别处。

    Ожидает перевода

    Почему это важно: 作者审计 500 个 Claude Code 会话,把成本拆成会话内、会话间与会话周边三类,给出可复用的排查方法。

07.08пт
  1. InfoQ · AI Coding Presentations83

    Как Spotify с помощью фонового ИИ-агента для разработки Honk непрерывно переписывает кодовую базу

    Команда платформы Spotify рассказала, как развивался фоновый ИИ-агент для разработки Honk: начав с замены скриптов миграции, его постепенно подключили к сборке и проверке тестами, и темп слияния пул-реквестов вырос с 1000 за 3 месяца до 1000 за 10 дней.

    Почему это важно: Команда Spotify разбирает путь Honk от скриптов миграции до фонового ИИ-агента для разработки, уделяя особое внимание тому, как верификация и стандартизация определяют, можно ли сливать сгенерированный код.

03.08пн
  1. OpenAI · Codex Cookbook71

    Итеративная разработка с Codex: от AGENTS.md до поэтапных файлов сборки

    OpenAI Codex Cookbook предлагает набор репозиторных соглашений для встраивания Codex в процесс разработки: AGENTS.md хранит постоянные инструкции для репозитория, PLANS.md служит источником поэтапных планов, а сами этапы разбиваются на файлы сборки в harness/build/ — для каждого этапа указаны цели, критерии приёмки, границы и точки согласования.

    Почему это важно: OpenAI официально описывает полное соглашение о структуре каталогов для ограничения Codex через AGENTS.md, PLANS.md и поэтапные файлы сборки — его можно перенести в свой репозиторий.

30.07чт
  1. Martin Fowler · Exploring Generative AI78

    重构的经济收益:一次用 Claude Code 量化 token 节省的实验

    Martin Fowler 用一个约 15 万行、几乎全由 Claude Code 和 Cursor 写成的 Rust 应用做实验,把 17,155 行的数据访问层按严格重构步骤拆分,每步后用全新子智能体执行同一个代表性改动并记录 token 消耗。

    Ожидает перевода

    Почему это важно: 作者用同一改动反复跑重构前后对比,量化出重构对智能体 token 消耗的实际影响,并指出节省来自文件切分而非代码总量下降。

26.07вс
  1. Hacker News · Context Engineering 讨论82

    Anthropic выпустила новые правила контекстной инженерии для моделей Claude 5-го поколения

    Участник технической команды Anthropic Тарик Шихипар написал статью, в которой обобщил новые правила контекстной инженерии для моделей Claude 5-го поколения. По его словам, для таких моделей, как Claude Opus 5 и Claude Fable 5, из Claude Code уже удалили более 80% системного промпта, и при этом в оценках кода не удалось измерить никаких потерь.

    Почему это важно: Anthropic официально опубликовала новые правила контекстной инженерии для моделей Claude 5-го поколения и рассказала, как сокращать системный промпт, CLAUDE.md и Skills.

25.07сб
  1. Cline · Blog79

    Cline 用递归自我改进让智能体自主把 Kimi K3 在 Terminal-Bench 2.1 提到 88.8%

    Cline 用一条提示词启动 17 小时连续运行的编码智能体,以 GPT-5.6-Sol 为 leader 模型,把 Kimi K3 在 Terminal-Bench 2.1 上的成绩从基线 69/89(77.5%,$79)提升到确认运行 79/89(88.8%,$49.8),超过 Moonshot 自报的 88.3%。

    Ожидает перевода

    Почему это важно: Cline 用一条提示词让智能体自主完成 17 小时爬山,把 Terminal-Bench 2.1 从 77.5% 提到 88.8%,可看具体修了哪些 harness 问题。

24.07пт
  1. Lovable · Blog71

    Lovable 如何用 AI 黑客智能体集群对自己打夺旗赛

    Lovable 在内部搭建了一套进攻性安全程序,让 AI 智能体集群像人类攻击者一样探测系统入口,直到拿到可验证的漏洞证据。它用夺旗赛的思路做验证:把 flag 散布在基础设施和权限最高的产品界面中,不预埋任何漏洞,智能体取到 flag 就说明找到了真实入侵路径,而不是模型猜测。

    Ожидает перевода

    Почему это важно: Lovable 公开了用夺旗机制验证漏洞的内部攻防智能体编排方法,可迁移到自家安全测试流程。

22.07ср
  1. Augment Code · Blog62

    Что такое циклический инжиниринг и как его применяют ведущие команды разработки ПО

    Augment Code предлагает циклический инжиниринг — проектирование цикла ИИ-агента, который охватывает путь от триггера и выполнения до верификации и получения результата: агент берёт на себя промежуточные шаги, а человек подключается только на контрольных точках, где нужно принять решение. В статье циклический инжиниринг сравнивается по уровням с промпт-инжинирингом и контекстным инжинирингом, а также описаны пять стадий — триггер, выполнение, верификация, результат и улучшение — и четыре командных цикла, уже работающих в продакшене: код-ревью, превращение тикета в PR, исправление уязвимостей и реагирование на инциденты.

    Почему это важно: Augment Code разбивает циклический инжиниринг на пять этапов — триггер, выполнение, верификацию, результат и улучшение — и приводит четыре командных цикла, уже работающих в продакшене.

20.07пн
  1. Addy Osmani · Blog74

    Эдди Османи о «фабриках ПО»: явные и скрытые фабрики, где узкое место — проверка

    Эдди Османи описывает «фабрику ПО» как три уровня: loop, harness и factory. Фабрика — это не более умный ИИ-агент, а несколько loop с harness, которые сходятся в один шлюз проверки, а внешний цикл остаётся под управлением человека.

    Почему это важно: Автор разбирает «фабрику ПО» на три уровня — loop, harness и factory — и показывает, что настоящее узкое место — проверка, а не генерация.

19.07вс
  1. Hacker News · Claude Code 高分80

    把闲置 Mac 配成 Claude Code 可完全控制的常驻机器:分步指南

    作者 ykev 发布一份分步指南,教用户把闲置 Mac 变成 Claude Code 可完全控制、开启 computer use 的常驻机器,可从手机 Claude app 或主 Mac 经 SSH 操作。

    Ожидает перевода

    Почему это важно: 作者把闲置 Mac 改造成 Claude Code 常驻控制机,给出从 SSH、免密 sudo 到 computer use 的完整步骤,可迁移到任意两台机器。

17.07пт
  1. Ryan Lopopolo71

    Code Red требует цикла поддержки: с помощью Codex /goal превратить аварийный ремонт в постоянную эксплуатацию

    Автор, опираясь на опыт участия в первом code yellow в Stripe, отмечает, что после большинства code red остаются лишь разбор инцидента и уставшие инженеры, а метрики снова оказываются без внимания. Он считает, что после каждого code red нужно запускать цикл поддержки и использовать команду /goal в OpenAI Codex, чтобы превратить разовый запрос на написание кода в постоянную цель с чёткими критериями завершения: тогда постоянно работающий кластер ИИ-агентов будет следить за метриками, выполнять нужные действия и запрашивать ручную проверку.

    Почему это важно: Опираясь на опыт code yellow в Stripe, автор предлагает с помощью /goal в Codex превратить разовый аварийный ремонт в долгосрочный цикл поддержки, который можно перенести в управление SLO.

08.07ср
  1. AI Hero · Skills Updates65

    Репозиторий skills от AI Hero выпустил v1.1: добавлен /wayfinder, переименованы /to-spec и /to-tickets

    Репозиторий skills от AI Hero выпустил v1.1: /to-prd переименован в /to-spec, /to-plan и /to-issues объединены в /to-tickets, а также добавлены новые Skill — /wayfinder, /research, /prototype и другие.

    Почему это важно: Автор подробно разбирает весь процесс работы со Skill — от grilling до развёртывания — и приводит команды миграции для переименования, объединения и добавления /wayfinder. Будет полезно тем, кто хочет собрать собственный рабочий процесс для разработки с ИИ.

  2. Martin Fowler · Exploring Generative AI71

    在本地小模型上做智能体编码的实测体验

    Martin Fowler 在 M3 Max 48GB 和 M5 Pro 64GB 上实测 Qwen3.6 35B MoE、Gemma 4 31B/26B、Qwen Coder Next 80B 等本地小模型的智能体编码能力,按内存、速度、工具调用、代码正确性、上下文、任务复杂度、代码质量逐层筛选。

    Ожидает перевода

    Почему это важно: 作者用两个具体任务对比多款本地小模型的智能体编码表现,并给出可复用的任务选择标准。

06.07пн
  1. 宝玉80

    Команда Claude Code разбирает четыре типа циклов ИИ-агентов и способы их применения

    Команда Claude Code определяет цикл ИИ-агента как повторяющийся рабочий цикл, который выполняется до заданного условия остановки, и делит такие циклы на четыре типа — пошаговые, целевые, временные и проактивные — по четырём признакам: способу запуска, условию остановки, используемым базовым командам и типу задач.

    Почему это важно: Команда Claude Code делит циклы на четыре типа — пошаговые, целевые, временные и проактивные — и описывает для каждого способ запуска, остановки и контроля токенов.

05.07вс
  1. Jesse Vincent68

    Разработка Sen 2.0 через взаимное рецензирование кода между Claude Code и ИИ-агентом в Slack

    Автор Джесси Винсент в Prime Radiant использует Claude Code и работает через Slackline — консольный клиент Slack, — чтобы взаимодействовать со своим ИИ-агентом Ada: Claude предлагает изменения, Ada их рецензирует и тестирует, после чего Claude разворачивает обновления. Так замыкается цикл разработки с взаимным рецензированием между агентами.

    Почему это важно: Автор показывает переносимую модель совместной разработки с участием ИИ-агентов, построенную на цикле взаимного рецензирования, тестирования и развёртывания двумя агентами.

03.07пт
  1. Lovable · Blog88

    花掉 8.5 万美元 token 后,我在 Lovable 扩展智能体编程的经验

    Lovable 一名工程师从今年 1 月到 6 月把个人 token 花费从每月约 600 美元推到 5 月的约 2.5 万美元、累计约 8.5 万美元,同时把每周合并 PR 数从 20-30 个提升到 150 个以上。

    Ожидает перевода

    Почему это важно: 作者公开了自己每月约 2.5 万美元 token 的智能体开发配置,包括风险分级、多智能体评审和上下文管理,可迁移到其他团队。