Claude подорожал по-разному: как шлюзы считают час работы
После выхода Claude Opus 5.5 и GPT-6 Sol автор сравнил пять API-шлюзов и посчитал не цену токенов, а стоимость одного часа работы кодинг-агента. Разброс получился почти десятикратным — от 181 до 1 756 рублей за тот же объём нагрузки.
Почему обычный прайс плохо показывает реальный счёт
Автор статьи посмотрел на тарифы пяти API-шлюзов с оплатой из России: TeamoRouter, LiteAI, RouterAI, Polza AI и ProxyAPI. Но вместо привычного сравнения по цене ввода и вывода он взял реальную нагрузку из своих логов Claude Code и пересчитал, сколько стоит условный час работы при одинаковом объёме токенов.
Смысл такого подхода простой: в кодинг-агенте большая часть расходов уходит не только на обычный ввод, но и на кэш — его чтение и запись. В логах автора чтений оказалось примерно в 18 раз больше, чем записей, и в 300 раз больше, чем вывода, поэтому именно кэш сильнее всего влияет на итоговую сумму.
Что именно сравнивали и почему это важно
Для расчёта автор взял 49 рабочих сессий Claude Code за два месяца и отобрал 138 часов активной работы, убрав паузы длиннее получаса. Это не тест свежих моделей в одинаковых задачах, а исторический профиль реального использования, то есть ближе к жизни, чем к лабораторному замеру.
Он отдельно учёл четыре категории токенов: обычный ввод, запись кэша, чтение кэша и вывод. Для четырёх шлюзов стоимость считалась по раздельным ставкам, а LiteAI оценивался по пакетной цене: в расчёте использовался пакет 100 млн токенов за 2 000 рублей, то есть 20 рублей за миллион. При этом автор отдельно оговаривает, что это оценка по опубликованным ставкам, а не проверка фактических списаний через каждый сервис.
Что получилось и где кроется экономия
Главный вывод статьи — самый дешёвый тариф на бумаге не всегда даёт самый дешёвый час работы. Автор отмечает, что если чтение кэша стоит столько же, сколько обычный ввод, то итоговый час выходит почти вдвое дороже, чем у шлюза с более дешёвым кэшем. То есть смотреть только на цену входа — недостаточно, особенно если агент много работает с длинным контекстом.
Для пользователей это полезно по очень приземлённой причине: можно сэкономить на автоматизации кода, если правильно выбрать шлюз и учесть не только базовую цену модели, но и кэш. Это важно для разработчиков, небольших команд и тех, кто часто запускает ИИ-помощника на длинных задачах. В статье также указано, что расчёт привязан к ценам на 28 сентября 2026 года и не учитывает промокоды или индивидуальные скидки.