Перейти к содержимому

Новые инструменты и Skills

Новые инструменты, Skills, MCP-серверы и открытые проекты, которые стоит попробовать.

31 избранный материалСвязанные темыSkillsMCP и вызов инструментовПрактика и руководства

Новые избранные материалы

Материалы 21–31 · Всего 31
31.03вт
  1. Jesse Vincent71

    Superpowers 作者用 CLAUDE.md 拦截智能体提交的低质 PR

    Superpowers 作者 Jesse Vincent 称项目 GitHub star 已超 12 万,随之而来大量由智能体自动提交的低质 PR,仓库 PR 拒绝率达 94%。

    Ожидает перевода

    Почему это важно: Superpowers 作者用 94% PR 拒绝率说明智能体批量提 PR 的现状,并给出可复用的 CLAUDE.md 拦截写法。

24.03вт
  1. Permission Protocol · AI Agent Incident Tracker88

    TeamPCP 通过被污染的 Trivy GitHub Action 在 PyPI 投毒 LiteLLM 1.82.7 和 1.82.8

    TeamPCP 通过被污染的 Trivy GitHub Action 劫持 LiteLLM 的 CI/CD 流水线,窃取 PyPI 发布凭证后发布了带后门的 LiteLLM 1.82.7 和 1.82.8。

    Ожидает перевода

    Почему это важно: 复盘 LiteLLM 被投毒事件的三阶段攻击链与 .pth 持久化机制,可帮助排查自身 CI/CD 与 Kubernetes 风险。

08.02вс
  1. Martin Alderson78

    Автоматически улучшаем CLAUDE.md по журналам сессий ИИ-агента

    Автор предлагает улучшать файлы CLAUDE.md или AGENTS.md по журналам сессий ИИ-агента: сессии Claude Code лежат в ~/.claude/projects, Codex — в ~/.codex/sessions, оба в формате JSONL, но со своими схемами.

    Почему это важно: Автор по журналам сессий ИИ-агента вычисляет, что стоит поправить в CLAUDE.md, и выложил в открытый доступ CLI, который сокращает поиск с нескольких минут до нескольких секунд.

10.12ср
  1. Jesse Vincent68

    packnplay: одна команда запускает ИИ-агент для разработки в контейнере

    Джесси Винсент выпустил открытый инструмент packnplay: команда packnplay run claude --dangerously-skip-permissions запускает заранее настроенный временный контейнер для работы ИИ-агента разработки.

    Почему это важно: Автор упаковал в одну команду всю возню с настройкой запуска ИИ-агента для разработки в контейнере и рассказал, как конкретно решать конфликты учётных данных Claude Code.

02.12вт
  1. Jesse Vincent69

    Собираем мост логов между фронтендом и бэкендом для ИИ-агента по разработке, чтобы было проще отлаживать веб-приложения

    Когда автор разрабатывает веб-приложение с помощью ИИ-агента, он часто натыкается на баги в клиентском JavaScript. Если агент не может решить их, просто читая код, он запускает интерактивную отладку через браузерный MCP — только чтобы посмотреть логи в консоли браузера. И токены тратятся, и медленно.

    Почему это важно: Автор предлагает переиспользуемый способ организовать мост логов между фронтендом и бэкендом, чтобы ИИ-агент видел логи фронтенда и без браузерного MCP.

07.11пт
  1. Terminal-Bench · News62

    Terminal-Bench выпустил версию 2.0 и пакет оптимизаций для оценки в Harbor

    Terminal-Bench выпустил версию 2.0 и пакет Harbor: первый — это более строго проверенный и сложный бенчмарк для оценки агентов, второй — для их оценки и оптимизации. Harbor переписал тестовый фреймворк Terminal-Bench: теперь можно разворачивать контейнеры в облаке, есть интерфейсы rollout для RL и SFT, а также совместимость с любыми агентами, которые упаковываются в контейнер.

    Почему это важно: Вместе с Terminal-Bench 2.0 вышел Harbor — читатели узнают, как проверяются бенчмарки для агентов и как масштабировать их в облаке.

27.10пн
  1. Jesse Vincent74

    Переносим Skills и Superpowers в OpenAI Codex CLI

    Автор Джесси Винсент за один вечер перенёс Superpowers и всю систему SKILL.md в OpenAI Codex CLI; релиз вышел вместе с Superpowers 3.3.0.

    Почему это важно: Автор перенёс систему SKILL.md из Claude в Codex CLI, показал соответствие инструментов и способ установки — по этому можно судить, реально ли переиспользовать Skill между моделями.

23.10чт
  1. Jesse Vincent69

    Дополняем Claude Code эпизодической памятью с помощью episodic-memory

    Автор сделал для Claude Code плагин episodic-memory, который умеет искать по записям прошлых сессий. По умолчанию Claude Code удаляет журналы сессий в формате .jsonl из каталога ~/.claude/projects через месяц; этот срок можно продлить с помощью cleanupPeriodDays в файле ~/.claude/settings.json.

    Почему это важно: Автор превратил журналы сессий Claude Code в эпизодическую память с семантическим поиском, так что читатель может сам оценить, как долгосрочный контекст сохраняется между сессиями.

19.10вс
  1. Jesse Vincent71

    Автор собрал собственный superpowers-chrome MCP и снизил затраты на запуск с 13678 токенов до 947

    Для Claude Code автор сделал лёгкий Chrome MCP и Skill под названием superpowers-chrome: при запуске конфигурация MCP занимает всего 947 токенов, тогда как Microsoft Playwright MCP только на активное состояние требует 13678 токенов — это примерно 7% контекстного окна.

    Почему это важно: Автор сравнил расход токенов у собственного Chrome MCP и Playwright MCP и показал, какие компромиссы возникают при проектировании интерфейса инструментов для LLM.

09.10чт
  1. Jesse Vincent78

    Superpowers: как автор в октябре 2025 года использовал ИИ-агент для разработки

    Автор Джесси Винсент выпустил Superpowers — набор Skill на основе новой плагинной системы Claude Code. После установки плагин через hook session-start внедряет вводные подсказки, чтобы Claude сам искал и применял Skill.

    Почему это важно: Автор упаковал свой рабочий процесс с ИИ-агентом для разработки в устанавливаемый плагин Skill — читатели могут напрямую воспользоваться его подходом от мозгового штурма до реализации через TDD.

19.05пн
  1. Terminal-Bench · News62

    Terminal-Bench 发布首个终端智能体评测基准

    Terminal-Bench 发布首个版本,用于量化 AI 智能体在终端中执行复杂任务的能力,首发数据集 Terminal-Bench-Core-v0 包含 80 个手工编写并人工验证的任务,每个任务配有独立 Docker 环境、人工验证的解法与测试用例。

    Ожидает перевода

    Почему это важно: Terminal-Bench 给出 80 个带 Docker 环境和测试用例的终端任务,可用来横向比较不同智能体在命令行中的实际表现。