Автор выложил в открытый доступ claudemanager — локальный демон, который позволяет Claude Code через ANTHROPIC_BASE_URL направить запросы к нему: достаточно изменить только заголовок Authorization, и сессии уйдут на аккаунт Max с наибольшим остатком в окнах 5 часов, недели и отдельной модели, а при приближении к заполнению окна произойдёт переключение по заданным порогам.
Почему это важно: Автор выложил в открытый доступ локального агента, который автоматически распределяет запросы между несколькими аккаунтами Claude Code Max в зависимости от остатка квоты и попутно ведёт журнал запросов.
Spill — это инструмент с открытым исходным кодом под лицензией Apache-2.0. Он перехватывает через хук ответы MCP-инструментов размером более 32 КиБ и сохраняет их в локальную таблицу DuckDB (~/.spill/spill.duckdb). Агент получает только компактный дескриптор и дальше обращается к данным через SQL, а не читает исходный JSON на 5 тысяч токенов.
Почему это важно: Spill сбрасывает слишком большие ответы MCP в локальный DuckDB, и агент достаёт данные через SQL — это переиспользуемый подход к нехватке места в контекстном окне.
05.10пн
понедельник
DEV Community · Claude CodeИзбранное редакциейОценка ИИ8282
Автор сделал для ИИ-агента, работающего без присмотра, систему чекпоинтов на скрытых git-рефах: перед началом каждой задачи снимается снимок всего рабочего дерева (включая неотслеживаемые файлы), а если проверка не прошла, изменения откатываются автоматически; сам откат тоже можно отменить.
Почему это важно: Автор уложил git-чекпоинты в инфраструктуру с поддержкой отката примерно в 40 строк shell и рассказал, как именно запускать ИИ-агента для разработки без присмотра и где проходят границы этого подхода.
29 сентября на DevDay в Сан-Франциско OpenAI представила GPT-6.1 Sol; API называется gpt-6.1-sol, цена — 2 доллара за миллион входных токенов и 10 долларов за миллион выходных, кэшированный ввод — 0.10 доллара. Это пятая часть стандартной цены GPT-6 Astra.
Почему это важно: На DevDay OpenAI выпустила GPT-6.1 Sol, снизив цену до пятой части от Astra, а заодно обновила Codex, Agents API и систему плагинов — по этим изменениям можно оценить затраты и эволюцию инструментария.
Открытый проект Paseo собирает командные агенты Claude Code, Codex, OpenCode и Pi в одном интерфейсе управления; при этом все агенты по-прежнему работают локально на компьютере. На данный момент у проекта 18700+ звёзд.
Почему это важно: В оригинале показан подход, при котором несколько командных агентов собираются в единый интерфейс и задачи передаются между агентами — это пригодится разработчикам, которые одновременно запускают несколько агентов.
21.09пн
понедельник
The Agentic Engineer · BlogИзбранное редакциейОценка ИИ8080
Почему это важно: На примере примерно двадцати строк shell автор показывает, как отвязать harness Claude Code от конкретной модели, и подробно разбирает маршрутизацию по четырём слотам моделей и подводные камни.
GitHub выпустил Project HydraFusion в Copilot CLI в статусе исследовательского превью: оркестрация на уровне рантайма выбирает, какая модель из нескольких провайдеров будет выполнять задачу. Пользователь выбирает HydraFusion так же, как обычную модель, а оплата идёт по стандартным тарифам каждой модели.
Почему это важно: GitHub приводит сравнение трёх режимов оркестрации HydraFusion и трёх базовых вариантов по стоимости и качеству — по нему можно судить, что даёт многомодельная оркестрация на реальных задачах программирования.
03.09чт
четверг
GitHub Blog · CopilotИзбранное редакциейОценка ИИ7272
Команда Terminal-Bench выпустила Terminal-Bench 3.0 — первая версия включает 74 задач в 7 областях, у сильнейших моделей проходимость около 34%. По сравнению с Terminal-Bench 2.1 здесь больше разнообразия задач, а для постоянного улучшения бенчмарка добавили CI/CD, семантическое версионирование и перенос результатов.
Почему это важно: Terminal-Bench 3.0 пересобирает бенчмарк на 74 задачах и версионировании через CI/CD — читатель увидит, как новый бенчмарк разводит модели по результатам.
19.07вс
воскресенье
Hacker News · Claude Code 高分Избранное редакциейОценка ИИ8080
Саймон Уиллисон рассказывает, как прописать инструмент LLM CLI прямо в строке шебанга скрипта, чтобы текстовые файлы на английском (или любом другом языке) можно было запускать напрямую. Ключевая конструкция — #!
Почему это важно: Автор поместил LLM CLI в шебанг, чтобы обычные текстовые скрипты запускались напрямую, и показал, как подключать вызовы инструментов и шаблоны.
22.04ср
среда
Permission Protocol · AI Agent Incident TrackerИзбранное редакциейОценка ИИ8080
Автор предлагает улучшать файлы CLAUDE.md или AGENTS.md по журналам сессий ИИ-агента: сессии Claude Code лежат в ~/.claude/projects, Codex — в ~/.codex/sessions, оба в формате JSONL, но со своими схемами.
Почему это важно: Автор по журналам сессий ИИ-агента вычисляет, что стоит поправить в CLAUDE.md, и выложил в открытый доступ CLI, который сокращает поиск с нескольких минут до нескольких секунд.
Автор на практике проверил новую поддержку Skills в OpenAI Codex CLI: пока функция скрыта за фич-флагом, включить её можно командой codex --enable skills.
Почему это важно: Автор протестировал поддержку Skills в Codex, сравнил её с тем, как загружаются Skills в Claude Code, и показал структуру каталогов и правила срабатывания.
Джесси Винсент выпустил открытый инструмент packnplay: команда packnplay run claude --dangerously-skip-permissions запускает заранее настроенный временный контейнер для работы ИИ-агента разработки.
Почему это важно: Автор упаковал в одну команду всю возню с настройкой запуска ИИ-агента для разработки в контейнере и рассказал, как конкретно решать конфликты учётных данных Claude Code.
OpenAI в Codex Cookbook описывает полный процесс переделки легаси-кодовой базы с помощью Codex CLI на примере системы управления инвестиционным портфелем на COBOL: пять этапов вокруг проектного документа ExecPlan.
Почему это важно: На примере системы управления инвестиционным портфелем на COBOL показаны переиспользуемые документы и процесс проверки для поэтапной переделки легаси-кодовой базы с помощью Codex CLI.