Перейти к содержимому

#Стоимость/лимиты

Сегодня 0 материалов
06.10вт
  1. Hacker News · MCP78

    Flash-Agents: MCP-плагин, который отдаёт задачи кодирования из Claude Code воркеру DeepSeek Flash

    Flash-Agents — это плагин для Claude Code, который передаёт ограниченные по объёму задачи кодирования — реализацию отдельных фрагментов, перенос тестов, ревью diff, разбор кодовой базы — воркеру DeepSeek V4.1 Flash, а Claude оставляет за собой архитектуру, критерии приёмки и финальное ревью.

    Почему это важно: Автор отдаёт задачи кодирования из Claude Code на аутсорс воркеру DeepSeek Flash и приводит песочницу, патчи и данные реальных замеров, по которым можно оценить затраты и границы безопасности.

  2. DEV Community · Claude Code71

    quota-audit:按项目和 Skill 拆解 Claude Code 额度消耗的 Skill

    作者因 Claude Code 的 /usage 只给账号级百分比、无法看出哪个项目吃掉额度,写了名为 quota-audit 的 Skill,读取本机 ~/.claude/projects/*/*.jsonl 中的 token 用量,按项目、按 Skill 归因,并列出 5h、24h、7d 各窗口的估算花费、超过 150k context 的 session 和撞限记录。

    Ожидает перевода

05.10пн
  1. Reddit · ClaudeCode / Codex / VibeCoding69

    Плагин cache-warmer: чтобы Claude Code не приходилось переписывать весь кэш после паузы

    Автор выпустил плагин cache-warmer, который решает проблему: если не обращаться к Claude Code дольше 5 минут, следующий промпт приходится переписывать по полной стоимости кэша, затраты на длинные сессии накапливаются, а первый ответ приходит заметно медленнее.

02.10пт
01.10чт
  1. Hacker News · Coding Agent 讨论71

    Weave Router 2.0 开源发布:为编码智能体做模型路由,追平 Astra 级性能

    Weave 团队发布开源模型路由 Weave Router 2.0,可接入 Claude Code、Codex 等编码智能体,在多个 LLM 之间按任务切换,例如用 Astra 处理复杂调试和系统设计、用 Deepseek v4 Flash 处理简单前端改动。

    Ожидает перевода

28.09пн
27.09вс
18.09пт
02.09ср
  1. AI Coder · Telegram71

    前 Yandex 搜索负责人推出 Keenable,为 AI 智能体做搜索

    前 Yandex 搜索与广告负责人 Andrey Styskin 与曾为 Alexa 构建 web grounding 的 Matthias Petri 推出 Keenable,已从 Accel 和 Conviction 融资 2600 万美元,自建 crawler、索引和 ranking stack,索引超过 1000 亿文档。

    Ожидает перевода

06.08чт
17.07пт
20.06сб
  1. Kondasamy Jayaraman · Engineering Blog83

    Headroom:在智能体与账单之间做上下文压缩的本地代理

    Headroom 是一个开源、本地优先的代理,拦截 LLM API 调用并在请求到达服务商前重写 messages 数组,应用代码和模型都不用改。

    Ожидает перевода

    Почему это важно: Headroom 把上下文压缩放到代理层,读者可据此判断长会话智能体的 token 成本能否降下来。

02.05сб