Skip to content
Original
Habr · Claude Code· Corkyz0011·· 8 days agoAI score62

按每小时 token 消耗给五家 API 网关排成本:Claude Opus 5.5 与 GPT-6 Sol 对比

Original title: Сколько стоит час работы кодинг-агента: рейтинг пяти API-шлюзов по расходам

The title and summary in the selected language are awaiting translation.

AI overview

作者导出自己 49 个 Claude Code 会话、138 小时活跃工作的日志,统计出每小时平均消耗 1530 万缓存读取、86 万缓存写入、5.1 万输出和 560 普通输入 token,再按这套固定用量给 TeamoRouter、LiteAI、RouterAI、Polza AI、ProxyAPI 五家 API 网关算每小时花费。

Full text

The full text in the selected language is awaiting translation. The original is shown for now.

После выхода Claude Opus 5.5 и GPT-6 Sol я пошёл сравнивать цены API-шлюзов с оплатой из России. И быстро упёрся в то, что строчка «ввод / вывод за миллион токенов» плохо объясняет будущий счёт. В моих сессиях Claude Code основная нагрузка приходится на кэш, а цены его чтения и записи приходится искать отдельно.

Поэтому я посчитал по-другому: сколько стоил бы один и тот же объём токенов у разных шлюзов. За основу взял среднюю нагрузку за час активной работы в Claude Code по своим логам.

Критерий рейтинга один: сколько денег уйдёт на одинаковый объём токенов за условный час. Чем меньше сумма, тем выше место. Для каждой модели — свой порядок: не по цене ввода и не по общему баллу за разные модели. LiteAI тоже участвует в сравнении, но его пакетную цену пересчитываю отдельно и отмечаю как оценку.

Это расчёт по указанным ниже ставкам, а не замер фактических списаний через каждый шлюз и не рейтинг качества. Стабильность, время до первого токена и реальные расходы на одинаковые задачи оставляю для следующих частей.

Откуда профиль нагрузки

Я выгрузил логи своих 49 рабочих сессий Claude Code за два месяца. Паузы длиннее получаса исключил, получилось 138 часов активной работы. Это исторический профиль моего использования, а не двухмесячный тест только что вышедших моделей.

В расчёте на один такой час:

Категория

Токенов за час

В миллионах

Чтение кэша

15 300 000

15,3

Запись в кэш

860 000

0,86

Вывод

51 000

0,051

Обычный, некэшированный ввод

560

0,00056

Чтений примерно в 18 раз больше, чем записей, и в 300 раз больше, чем вывода. Здесь важно не перепутать объём уникального текста с суммарным использованием: один и тот же контекст может учитываться при чтении кэша во многих запросах.

Категории в расчёте считаются отдельно: обычный ввод не включает токены, уже отнесённые к чтению или записи кэша. Поэтому одна и та же категория не оплачивается в формуле дважды. Здесь приведены агрегированные данные без полной выгрузки логов. По ним можно повторить расчёт расходов, но нельзя независимо проверить саму статистику нагрузки.

Кого сравниваю

В сравнении пять шлюзов: TeamoRouter, LiteAI, RouterAI, Polza AI и ProxyAPI. Для четырёх из них, кроме LiteAI, считаю расходы по отдельным ставкам четырёх категорий токенов для каждой модели. Это не полный обзор рынка и не утверждение, что все маршруты внутри каждого шлюза стоят одинаково.

LiteAI участвует в рейтинге с оценкой по пакету. У него пакетная покупка токенов, поэтому способ расчёта отличается: у остальных шлюзов умножаю объём каждой из четырёх категорий на её ставку и складываю результаты, а у LiteAI оцениваю весь объём по цене выбранного пакета. Для рейтинга беру пакет 100 млн токенов за 2 000 ₽ — это 20 ₽ за миллион. Это не безусловная базовая ставка и не самая низкая пакетная цена на странице. Другие пакеты посчитаны ниже.

В рейтинге Opus — все пять шлюзов. В рейтинге GPT — четыре шлюза с расчётной стоимостью и строка LiteAI без места. GPT-6 Sol в доступном перечне моделей LiteAI я не нашёл, поэтому расходы для него не рассчитываю. Это ограничение опубликованного каталога, а не результат проверки доступности через API.

Какие цены использую

Все ставки ниже — рубли за миллион токенов. Дата ценового сравнения — 28 сентября 2026 года. Долларовые цены переведены по курсу 84,34 ₽ за $1: это округлённое значение курса Банка России на 26 сентября — 84,3414 ₽.

Для воспроизводимости дальше считаю именно по числам, показанным в таблицах. Итог за час округляю один раз, до целого рубля. Это немного менее точно, чем расчёт по неокруглённым долларовым ставкам, зато читатель может повторить его без скрытых исходных данных.

Промокоды и индивидуальные договорные скидки не учитываю. Пакеты LiteAI и динамические скидки TeamoRouter отмечаю отдельно — их нельзя выдавать за одинаковый бессрочный базовый тариф.

Порядок шлюзов в таблицах ставок такой же, как в рейтингах ниже: от меньшей расчётной суммы за час к большей, а не по цене ввода. Официальные ставки стоят отдельно в конце таблиц как ориентир и не получают места среди шлюзов.

Claude Opus 5.5

Платформа

Ввод

Вывод

Чтение кэша

Запись кэша

TeamoRouter

86

432

4,3

108

LiteAI — пересчёт пакета

20

20

20

20

RouterAI

439

2 193

21,9

548

Polza AI

472

2 361

23,6

590

ProxyAPI

840

4 200

42

1 050

Официально — Anthropic, ориентир

337

1 687

16,9

422

Строка LiteAI — не четыре отдельно опубликованных тарифа. Для оценки применяю пакетную цену 20 ₽ за миллион ко всем четырём категориям. В частности, списание чтений и записей кэша из пакета один к одному ещё нужно подтвердить по фактическому биллингу.

Для строк Opus с раздельными тарифами выбран тариф записи с TTL 5 минут; пересчёт единого пакета LiteAI не означает, что у него отдельно подтверждена такая ставка записи. У Anthropic запись с TTL 1 час стоит дороже: $8 вместо $5 за миллион токенов. В моих сессиях использовался именно часовой кэш.

Я сохраняю объёмы чтения и записи из логов и меняю только ставку. Это не симуляция перехода на пятиминутный кэш: при другом TTL часть повторных обращений может потребовать новой записи. Поэтому табличный результат нельзя считать обещанием фактического счёта после смены настроек. Применимость пятиминутной ставки у каждого шлюза тоже требует подтверждения.

GPT-6 Sol — запросы до 272 тыс. входных токенов

Платформа

Ввод

Вывод

Чтение кэша

Запись кэша

TeamoRouter

29

145

2,9

36

Polza AI

118

590

11,8

148

RouterAI

219

1 096

21,9

274

ProxyAPI

420

2 100

42

525

LiteAI: модель не найдена, расчёта нет

—

—

—

—

Официально — OpenAI Standard, ориентир

169

843

16,9

211

Официально — OpenAI Flex, справочно

84,34

421,70

8,43

105,43

У GPT использую его собственные категории тарификации. Правило «пятиминутная запись» от Anthropic сюда не переношу. Профиль из Claude Code здесь нужен только как одинаковый набор объёмов: это не прогноз реального часа в Codex и не сравнение стоимости выполнения одной задачи разными моделями.

Не все ставки, маршруты и сроки действия цен удалось подтвердить в полном объёме. На некоторых открытых страницах указаны значения, отличающиеся от табличных. Поэтому результат относится именно к приведённым ставкам, а не гарантирует, что после пополнения будет действовать та же цена. Если режим обслуживания не подтверждён, не считаю его автоматически Standard.

Рейтинг по расходам: от меньшей суммы за час к большей

Место определяется только расчётной суммой: кто дешевле при одинаковом объёме токенов, тот выше. У Opus и GPT отдельные таблицы, потому что порядок шлюзов у них разный. Прямой официальный API — ценовой ориентир, а не участник рейтинга посредников.

Для шлюзов с раздельными тарифами формула такая:

C = 15,3 × Pчтение + 0,86 × Pзапись + 0,051 × Pвывод + 0,00056 × Pввод

Где C — рубли за условный час, а P — соответствующая ставка за миллион токенов. Например, для официальной строки Opus:

15,3 × 16,9 + 0,86 × 422 + 0,051 × 1687 + 0,00056 × 337 = 707,71572 ₽

После округления — 708 ₽. Для LiteAI вместо четырёх независимых ставок использую пересчёт пакета, пояснение — сразу под рейтингом.

Claude Opus 5.5: рейтинг расходов для пяти шлюзов

Место по расходам

Шлюз

Расчётные расходы, ₽/ч

К Anthropic

1

TeamoRouter

181

0,26×

2

LiteAI — оценка по пакету

≈324

≈0,46×

3

RouterAI

918

1,30×

4

Polza AI

989

1,40×

5

ProxyAPI

1 760

2,49×

Официальный ориентир, вне рейтинга: Anthropic — около 708 ₽/ч (1,00×).

У LiteAI другой способ расчёта: здесь приведена оценка по пакету. В рейтинге использован пакет 100 млн токенов за 2 000 ₽, то есть 20 ₽ за миллион. Складываю все четыре категории — получается 16,21156 млн токенов за час — и умножаю на единую пакетную цену:

C_LiteAI = (15,3 + 0,86 + 0,051 + 0,00056) × 20 = 324,2312 ₽ ≈ 324 ₽/ч

Предполагается, что чтения и записи кэша расходуют пакет один к одному; по фактическому биллингу это ещё не проверено. 324 ₽ — стоимость условно израсходованных токенов, а не минимальное пополнение и не обещание фактического списания. Другой пакет даст другую оценку; варианты приведены ниже.

GPT-6 Sol: рейтинг расходов при том же объёме токенов

Место по расходам

Шлюз

Расчётные расходы, ₽/ч

К OpenAI Standard

1

TeamoRouter

83

0,17×

2

Polza AI

338

0,70×

3

RouterAI

627

1,30×

4

ProxyAPI

1 201

2,49×

—

LiteAI: модель не найдена, место не присваивается

—

—

Официальные ориентиры, вне рейтинга: OpenAI Standard — около 483 ₽/ч (1,00×), OpenAI Flex — около 241 ₽/ч (0,50×). Flex — другой режим обслуживания, а не ещё один шлюз. Связь цены Polza с маршрутом openai/flex ещё требует подтверждения; считать условия всех строк одинаковыми нельзя.

Множители рассчитаны по неокруглённым итогам формулы, а не по округлённым рублям за час. Обе таблицы ранжируют только ожидаемые расходы при указанных ценах и фиксированном потреблении. Они не содержат оценки качества и не показывают уже измеренные фактические списания.

Как пакет LiteAI меняет оценку расходов

Для основного рейтинга выбран сценарий 20 ₽ за миллион с явной пометкой «оценка по пакету». На странице покупки есть и другие цены, в том числе 15 ₽ за миллион. Поэтому 324 ₽ — не универсальная стоимость и не минимальная оценка среди всех пакетов. Ниже — остальные варианты, чтобы можно было учесть свой объём покупки.

Пакет

Предоплата

₽ за 1 млн токенов

Opus, условные ₽/ч

1 млн токенов

30 ₽

30

486

10 млн токенов

300 ₽

30

486

100 млн токенов — в рейтинге

2 000 ₽

20

≈324

1 млрд токенов

15 000 ₽

15

243

Здесь сумма четырёх категорий составляет 16,21156 млн токенов за условный час. Умножаю её на пакетную ставку. Расчёт предполагает, что и чтения, и записи кэша списываются из пакета один к одному, как следует из заявленного единого тарифа. Это ещё нужно проверить по фактическому биллингу; пока результат условный.

Столбец «за час» — нормализованная стоимость расхода, а не минимальная сумма платежа. Например, одного пакета на 1 млн токенов для такого часа недостаточно. Неизрасходованный остаток большого пакета тоже не превращается автоматически в экономию.

Что получается из этих цифр

При этой нагрузке разброс ставок даёт почти десятикратную разницу. По ставкам из таблицы расчёт Opus составляет 181 ₽ у TeamoRouter и 1 760 ₽ у ProxyAPI — примерно 9,7 раза. Это условный результат для конкретных строк, а не доказательство одинаковой производительности или одинакового числа запросов при смене base_url.

У официальной строки Opus около половины суммы приходится на запись кэша. Из 708 ₽ это примерно 363 ₽; чтение — 259 ₽, вывод — 86 ₽, обычный ввод — меньше рубля. Записей около 5,3% от суммы входных категорий, но при выбранном тарифе запись примерно в 25 раз дороже чтения. Для моего профиля сравнивать только ввод и вывод действительно недостаточно.

Самая низкая цена ввода не даёт первого места по расходам. Для LiteAI при пакетной ставке 20 ₽ за миллион получается около 324 ₽/ч — второе место в рейтинге Opus, хотя ввод дешевле. Другие пакетные ставки дают около 486 ₽/ч и 243 ₽/ч; последняя оценка требует предоплаты 15 000 ₽. Место определяется расходами на весь набор токенов, но размер пакета и порог покупки тоже нужно учитывать.

Polza нужно сравнивать с подходящим официальным режимом. Принадлежность этой цены GPT-6 Sol к маршруту openai/flex ещё требует подтверждения. Если цена относится именно к нему, то 338 ₽ — около 70% от OpenAI Standard, но примерно 140% от стоимости официального Flex. Режим OpenAI Flex дешевле стандартного в обмен на более медленные ответы и возможную нехватку ресурсов. Измерять задержку буду отдельно; здесь важно не скрывать разницу условий.

Низкая цена TeamoRouter тоже требует пояснения. На сайте описаны динамические скидки, зависящие от стоимости апстрима, а среди причин низкой цены названы оптовые условия и временные субсидии. Это объяснение самого сервиса, а не независимое подтверждение одинаковых условий с прямым API. Точный маршрут, режим обслуживания, ставку записи кэша и условия скидки на момент сравнения я пока не подтвердил в полном объёме. Эту цену нельзя считать постоянным базовым тарифом.

Как пополнить баланс и что это меняет в цене

Шлюз

Способы пополнения

Что важно для сравнения

TeamoRouter

СБП, Т-Банк, Visa / Mastercard / «Мир», ЮMoney, SberPay

Баланс в USD; способы оплаты, курс рублёвого платежа, комиссия и минимум пока не подтверждены по каждому варианту

LiteAI

Карта, СБП

Цена токена зависит от размера пакета

RouterAI

Карты российских банков, СБП, счёт для юрлиц и ИП

Способы оплаты и применимость цены к выбранному маршруту пока не подтверждены полностью

Polza AI

Карта, СБП, расчётный счёт

Итоговые условия платежа и выбранный маршрут пока не подтверждены полностью

ProxyAPI

Карта, СБП, счёт для юрлиц

Способы оплаты, итоговая сумма и состав налогов пока не подтверждены полностью

Пересчёт долларового прайса по курсу ЦБ — только способ привести ставки к одной валюте. Он не означает, что пользователь пополнит баланс по тому же курсу. Фактическая рублёвая стоимость долларового баланса считается как «сколько рублей списано / сколько долларов зачислено», с учётом комиссии.

Таблицы выше — сравнение указанных ставок, а не проверенный расчёт полной суммы оплаты. Платёжные комиссии, фактический курс зачисления и налоговый состав отдельно не нормализованы. Рекламную скидку на токены, стоимость пополнения и цену запроса нельзя смешивать в одну цифру без этих условий.

Где заканчивается этот расчёт

Профиль нагрузки мой, а не универсальный. При коротких сессиях, другой истории диалога или другом TTL доля чтений и записей может измениться. Тогда нужно заново подставить объёмы в формулу; обещать, что разрыв обязательно вырастет, оснований нет.

Для GPT выбран короткий ценовой диапазон. Если реальные запросы выходят за его пределы, их нужно считать отдельно, а не применять базовую ставку ко всем токенам. В расчёте нет самостоятельных расходов на инструменты и подписки, а также дополнительных расходов, которые могут появиться при ретраях или переключении маршрута.

Главный вывод этой части простой: ранжирую по ожидаемым расходам на одинаковый набор токенов — чем меньше сумма, тем выше место. LiteAI участвует с явно обозначенной оценкой по пакету, остальные шлюзы — с суммой расходов по отдельным категориям. Для моей нагрузки это полезнее сравнения одной цены ввода, но низкая расчётная стоимость ещё не означает минимальные реальные расходы на выполненную задачу.

Что дальше

В следующей части прогоню одинаковые задачи через выбранные шлюзы: сравню время до первого токена, долю ошибок при пяти параллельных запросах и фактические списания. Условия запуска и повторы опишу отдельно.

Счётчики токенов тоже сопоставлю с официальным API, но только как проверку учёта и поиск аномалий. Совпадение или расхождение счётчиков само по себе не доказывает, какая модель отвечала.

Кого добавить в следующую часть? Пишите в комментариях.

Source: Habr · Claude Code · habr.com