Перейти к содержимому

Контекст и память

CLAUDE.md, AGENTS.md, сжатие контекста и управление памятью: как дать агенту нужную информацию.

64 избранных материалаСвязанные темыРабочие процессыСтоимость и лимитыSkills

Новые избранные материалы

Материалы 41–60 · Всего 64
30.04чт
  1. Augment Code · Blog71

    Augment Code проверила на практике правила в стиле Карпати: ИИ-агент для разработки не написал код лучше, но сделал это быстрее и дешевле

    Augment Code добавила в начало AGENTS.md около 2.5 тыс. символов правил кодирования в стиле Карпати и сравнила, как Auggie, Claude Code и Codex справляются с 40 пул-реквестами OpenClaw.

    Почему это важно: Сравнительный тест трёх ИИ-агентов для разработки на одной и той же партии пул-реквестов показывает: ограничения в промпте в основном экономят деньги, а не повышают качество, и при этом каждый харнесс работает по-своему.

22.04ср
  1. Augment Code · Blog88

    Augment Code протестировала AGENTS.md на практике: хороший файл сравним с апгрейдом модели, а плохой лучше не писать

    Augment Code вытащила из своего монорепозитория несколько десятков AGENTS.md и на внутреннем наборе тестов AuggieBench сравнила, как один и тот же агент справляется с задачей при наличии этих файлов и без них. Лучшие файлы дают такой же прирост качества, как переход с Haiku на Opus, а худшие — ухудшают результат по сравнению с полным отсутствием AGENTS.md.

    Почему это важно: Augment Code с помощью внутренних метрик измерила, насколько различается эффект от разных вариантов написания AGENTS.md; читатели могут использовать это, чтобы перестроить документацию в своём репозитории.

15.04ср
  1. Kondasamy Jayaraman · Engineering Blog78

    12 паттернов построения ИИ-агентов, извлечённых из утечки исходного кода Claude Code

    Автор разобрал архитектуру, всплывшую после утечки исходников Claude Code, и пришёл к выводу: в её основе лежит не секретный алгоритм, а цикл while на Python — меньше 30 строк — плюс словарь инструментов, а останавливается всё по stop_reason!

    Почему это важно: Автор выделил из утёкшего кода 12 комбинируемых паттернов инженерии ИИ-агентов и предложил четырёхнедельный план освоения — удобно сверить со своей реализацией и найти пробелы.

10.04пт
  1. Ryan Lopopolo65

    怎样才算把活干好:写清非功能性需求才能让 AI 智能体收敛

    Ryan Lopopolo 认为,AI 让验证问题变得明显,因为每个真实任务都依赖一个我们几乎从不写下来的问题,即怎样才算把活干好。产出和评审都涉及语气、品味、风险容忍度、打磨程度、可接受的捷径和完成标准等大量非功能性决策,过去团队靠组织设计、社交规范、招聘和入职把这些隐含规则传递给人,而模型无法走招聘流程,因此交给它的任务基本都欠规范。

    Ожидает перевода

    Почему это важно: 作者以在 OpenAI 做代码智能体的经历说明,非功能性需求不写下来,评审智能体就会陷入无休止的拉扯。

06.04пн
  1. 宝玉78

    Руководство по экономии токенов в Claude Code: осторожнее с контекстом на 1M — и открывать новый сеанс, и не открывать его — одинаково неправильно

    Баоюй разбирает механизм кэширования промптов в Claude Code, объясняет, почему лимит так быстро расходуется, и даёт правила экономии токенов. Он отмечает, что кэш работает только для префикса: у основного агента окно кэша — 1 час, у дочерних агентов — 5 минут, а чтение из кэша стоит примерно в десять раз дешевле пересчёта. Поэтому частые /clear, наоборот, запускают полную перестройку контекста по полной цене. Критерий такой: если кэш ещё горячий и задача не сменилась — продолжайте диалог; новый сеанс открывайте только когда кэш истёк, задача сменилась или в контексте слишком много шума.

    Почему это важно: Разберём, как расходуется квота Claude Code, отталкиваясь от механизма кэширования промптов: покажем, когда стоит продолжить сессию, а когда начать заново, и дадим готовые конфиги, которые можно скопировать.

05.04вс
  1. Drew Breunig78

    Как Claude Code собирает системный промпт

    Дрю Брейниг разобрал структуру сборки системного промпта по неожиданно утёкшему на прошлой неделе исходному коду Claude Code: все компоненты делятся на постоянно включённые и условно включённые, а их состав меняется в зависимости от таких переключателей, как output_style, repl_mode, user_type_ant, skills_enabled, mcp_connected и других.

    Почему это важно: Автор разобрал динамическую логику сборки системного промпта в Claude Code и показал, как на практике устроена условная работа с контекстом.

17.03вт
  1. 宝玉87

    Как команда Anthropic использует Claude Code Skills: девять категорий и советы по написанию

    Инженер команды Claude Code в Anthropic Тарик Шихипар обобщил опыт использования нескольких сотен активных Skills внутри компании и разбил их на девять категорий: библиотеки и справочники по API, проверка продуктов, сбор и анализ данных, автоматизация бизнес-процессов, генерация заготовок кода, качество кода и код-ревью, CI/CD и развёртывание, руководства по эксплуатации, а также работа с инфраструктурой.

    Почему это важно: Классификацию и советы по написанию Skills, принятые внутри Anthropic для нескольких сотен инструментов, можно перенести на дизайн собственных Skills в команде.

  2. Paper Compute · Engineering Blog78

    日志即自愈反馈回路:用遥测让智能体跨会话积累经验

    作者让智能体在 stereOS 虚拟机里用 PyBoy 无头运行宝可梦红,速度约为实时的 100 倍,智能体自己输出 NAV、BATTLE、BACKTRACK 等日志前缀,这些日志经 tapes 代理流入 Kafka,再由 Flink SQL 做 STUCK_LOOP、TOKEN_SPIKE 异常检测,JSONL 与 DuckDB 负责跨会话查询。

    Ожидает перевода

    Почему это важно: 作者用终端里跑宝可梦的智能体做实验,展示日志如何变成跨会话的观测记忆并反哺下一轮运行。

16.03пн
  1. 宝玉78

    8 уровней агентной инженерии: от автодополнения в редакторе до автономных команд ИИ-агентов

    Бассим Эледат разбил практический путь AI-ассистированной разработки на 8 уровней: от автодополнения по Tab и IDE с ИИ-агентами до контекстной инженерии, композитной инженерии, MCP и навыков, Harness Engineering, фоновых ИИ-агентов и, наконец, автономных команд ИИ-агентов.

    Почему это важно: Автор разбил AI-ассистированную разработку — от автодополнения по Tab до автономных команд ИИ-агентов — на 8 уровней, так что читатели могут определить, на каком этапе находится их команда.

09.03пн
  1. Paper Compute · Engineering Blog78

    我让 Agent 玩 1000 回合宝可梦,它始终没走出卧室

    作者构建的宝可梦红版自主 Agent 跑了 1000 回合仍停在卧室,原因是它把背景瓦片图地址 0xC4F2 当成文本框状态标志,一直按 A 键却不知道卡住。

    Ожидает перевода

    Почему это важно: 作者用 1000 回合卡在卧室的失败复盘,说明记录并回放 Agent 会话状态比改提示词更能定位静默故障。

23.02пн
  1. OpenAI Developer Blog · Codex72

    用 Codex 跑 25 小时长时程任务:一份可复用的项目记忆文件栈

    OpenAI 用 GPT-5.3-Codex 在 Extra High 推理档下从空仓库连续运行约 25 小时、消耗约 13M token、生成约 3 万行代码,做出一个可测试的设计工具。

    Ожидает перевода

    Почему это важно: 作者用 25 小时、13M token 的实测展示长时程智能体如何靠持久化项目记忆和逐里程碑验证保持不跑偏。

08.02вс
  1. Martin Alderson78

    Автоматически улучшаем CLAUDE.md по журналам сессий ИИ-агента

    Автор предлагает улучшать файлы CLAUDE.md или AGENTS.md по журналам сессий ИИ-агента: сессии Claude Code лежат в ~/.claude/projects, Codex — в ~/.codex/sessions, оба в формате JSONL, но со своими схемами.

    Почему это важно: Автор по журналам сессий ИИ-агента вычисляет, что стоит поправить в CLAUDE.md, и выложил в открытый доступ CLI, который сокращает поиск с нескольких минут до нескольких секунд.

05.02чт
  1. Martin Fowler · Exploring Generative AI75

    Контекстная инженерия для ИИ-агентов разработки: разбираем на примере Claude Code, какие бывают способы конфигурации

    Команда Мартина Фаулера разобрала контекстную инженерию для ИИ-агентов разработки и разделила настройку контекста на переиспользуемые промпты (две категории — инструкции и руководства), контекстные интерфейсы (инструменты, MCP-сервер, Skills) и файлы рабочего пространства, а по тому, «кто решает, что загружать», — на три типа: LLM, человек и программное обеспечение агента.

    Почему это важно: На примере Claude Code разбираем способы настройки контекста для ИИ-агентов разработки и показываем, как выбирать между загрузкой по требованию и постепенным наращиванием контекста.

30.01пт
  1. Jesse Vincent66

    Latent Space Engineering:用情绪化提示词让 AI 智能体进入更好状态

    Jesse Vincent 提出 Latent Space Engineering,即通过提示词把模型推入更有利于完成任务的潜在空间,而非只往上下文窗口塞事实信息。

    Ожидает перевода

    Почему это важно: 作者提出用情绪化提示词把模型推入更佳状态,并给出多个可迁移的实操例子。

17.12ср
  1. Jesse Vincent66

    Skill в Claude Code не срабатывает? Возможно, модель их просто не видит

    Claude Code даёт модели знать о существующих Skill, добавляя их названия и описания в системный промпт. Но если Skill слишком много или поле описания слишком длинное, в системный промпт они не попадут — и модель не сможет их использовать. К тому же промпт требует, чтобы модель не использовала Skill, которых в этом списке нет.

    Почему это важно: Автор объясняет, почему Claude Code не активирует установленные Skill, и предлагает готовое временное решение через переменную окружения.

02.12вт
  1. Jesse Vincent69

    Собираем мост логов между фронтендом и бэкендом для ИИ-агента по разработке, чтобы было проще отлаживать веб-приложения

    Когда автор разрабатывает веб-приложение с помощью ИИ-агента, он часто натыкается на баги в клиентском JavaScript. Если агент не может решить их, просто читая код, он запускает интерактивную отладку через браузерный MCP — только чтобы посмотреть логи в консоли браузера. И токены тратятся, и медленно.

    Почему это важно: Автор предлагает переиспользуемый способ организовать мост логов между фронтендом и бэкендом, чтобы ИИ-агент видел логи фронтенда и без браузерного MCP.

27.10пн
  1. OpenAI Developer Blog · Codex64

    Dagster Labs 如何用 Codex 做技术文档与教学

    Dagster Labs 分享了用 OpenAI Codex 加速技术文档写作、跨媒介内容转换和文档覆盖度评估的实践。他们重写了 CONTRIBUTING.md,明确文档层级、结构和最佳实践,让 Codex 能据此生成符合规范的文档;还借助 gh 命令让 Codex 解读 PR 的 diff 和描述,并让 Codex 把教程改写成 YouTube 视频脚本。

    Ожидает перевода

    Почему это важно: Dagster 团队把 Codex 用于文档写作、PR 解读和内容跨媒介转换,其中用文档生成代码来反向衡量文档覆盖度的做法可以迁移。

23.10чт
  1. Jesse Vincent69

    Дополняем Claude Code эпизодической памятью с помощью episodic-memory

    Автор сделал для Claude Code плагин episodic-memory, который умеет искать по записям прошлых сессий. По умолчанию Claude Code удаляет журналы сессий в формате .jsonl из каталога ~/.claude/projects через месяц; этот срок можно продлить с помощью cleanupPeriodDays в файле ~/.claude/settings.json.

    Почему это важно: Автор превратил журналы сессий Claude Code в эпизодическую память с семантическим поиском, так что читатель может сам оценить, как долгосрочный контекст сохраняется между сессиями.

19.10вс
  1. Jesse Vincent71

    Автор собрал собственный superpowers-chrome MCP и снизил затраты на запуск с 13678 токенов до 947

    Для Claude Code автор сделал лёгкий Chrome MCP и Skill под названием superpowers-chrome: при запуске конфигурация MCP занимает всего 947 токенов, тогда как Microsoft Playwright MCP только на активное состояние требует 13678 токенов — это примерно 7% контекстного окна.

    Почему это важно: Автор сравнил расход токенов у собственного Chrome MCP и Playwright MCP и показал, какие компромиссы возникают при проектировании интерфейса инструментов для LLM.

15.10ср
  1. Martin Fowler · Exploring Generative AI74

    拆解 Spec-Driven Development:Kiro、spec-kit 与 Tessl 三种工具实测

    Martin Fowler 试用 Kiro、spec-kit 和 Tessl 三款自称实现 spec-driven development(SDD)的工具,把 SDD 归纳为 spec-first、spec-anchored、spec-as-source 三个层次,并指出目前所有方案都停留在 spec-first。

    Ожидает перевода

    Почему это важно: 作者亲手试用 Kiro、spec-kit 和 Tessl 三款 SDD 工具,给出 spec-first、spec-anchored、spec-as-source 三层划分,并指出小任务被过度规格化的问题。