Claude против ChatGPT Pro: почему сравнение по токенам обманчиво
Исследование SemiAnalysis дало Anthropic заметное преимущество в тарифах за $200, но вывод «Claude в 5,6 раза выгоднее» не так прост, как кажется. Если смотреть не только на цену токенов, а на реальную работу моделей, картина становится куда сложнее.
Что именно сравнили аналитики
SemiAnalysis оценили, какой объем использования дают подписки Claude и ChatGPT при цене $200 в месяц, а затем перевели этот объем в API-эквивалент. По их расчетам, у Claude получилось около $11 726, а у ChatGPT — примерно $2 084.
На первый взгляд это выглядит как серьезный разгром OpenAI. Но важная деталь в том, что исследователи считали не «сколько задач решит подписка», а сколько токенов и какого типа трафика она позволяет получить по сравнению с оплатой через API.
Почему токены не равны полезной работе
У сравниваемых моделей разная цена входных, кэшированных и выходных токенов. В источнике указаны цены GPT-6.1 Sol и Claude Opus 5.5: у Claude токены в основных категориях примерно вдвое дороже.
Из-за этого долларовый эквивалент подписки Claude выглядит особенно крупным. Но сами авторы исследования отдельно показывают и другой показатель — число доступных токенов. Здесь преимущество Claude уже меньше: примерно 2,8 раза вместо 5,6.
Почему результат зависит от того, как модель думает
Самое интересное начинается, когда сравнивают не только лимиты, но и то, сколько токенов модель тратит на одну задачу. По данным Artificial Analysis, Opus 5.5 в их тестах получает более высокий Intelligence Index, чем GPT-6.1 Sol: 58 против 52.
Но за это качество приходится платить расходом: в benchmark-задаче Opus генерирует в 3,13 раза больше выходных токенов и использует примерно в 3,36 раза больше токенов на рассуждения. В итоге одна и та же задача у Claude может выходить примерно в 8,3 раза дороже.
Что это значит для обычного пользователя
Главный вывод простой: смотреть только на «API-эквивалент» недостаточно. Эта метрика показывает, сколько стоил бы доступный объем токенов, если покупать его через API, но не говорит напрямую, сколько полезной работы вы сделаете.
Для повседневных задач это важнее, чем кажется. Если вы используете ИИ для длинных диалогов, анализа документов, генерации текстов или агентских сценариев, стоит смотреть не только на цену подписки, но и на то, как быстро модель расходует лимит и насколько она экономно решает ваши задачи. Даже при всех оговорках Anthropic сейчас выглядит очень сильным конкурентом, а Claude — интересным вариантом для тех, кому важны большие лимиты и мощное рассуждение.