Новости ИИ

Старая модель снова удержала лидерство в тесте цена/качество

Редакция Lord GPT · 11.06.2026
Абстрактная сцена сравнения нескольких ИИ-моделей на фоне рейтинга и графиков

Свежий батл-тест снова показал, что на рынке ИИ не всегда побеждает самая новая или самая большая модель. В честном очном сравнении одна из прошлогодних моделей по-прежнему удержала первое место по соотношению цены и качества, а несколько других участников оказались заметно сильнее, чем ожидалось.

Что показал новый очный тест

Автор сравнил сразу четыре модели в одном батче, чтобы проверить, не исказили ли кросс-сессионные замеры картину. Такой подход полезен, когда хочется понять не абстрактные рейтинги, а реальную разницу между моделями в одинаковых условиях.

Главный вывод оказался неожиданно простым: две версии Gemma в прямой проверке показали себя примерно на одном уровне, хотя раньше одна из них выглядела заметно сильнее. Зато DeepSeek V4 Flash оказался недооценённым и в свежем тесте поднялся выше прежней оценки. Это хороший сигнал для тех, кто выбирает модель под рабочие задачи и не хочет переплачивать за имя.

Почему лидерство старой модели важно для пользователей

Самое интересное в разборе — не просто список победителей, а то, что модель, вышедшая летом, снова удержала первое место по цене и качеству. Для обычного пользователя это означает, что иногда выгоднее брать не самую новую модель, а ту, которая уже доказала стабильность в реальной работе.

Для бизнеса и команд это особенно полезно: можно точнее выбирать ИИ под задачи поддержки, маркетинга, анализа текстов и автоматизации рутины. Если модель даёт хороший результат без лишних затрат, она быстрее окупается и проще масштабируется внутри компании.

Что ещё изменилось в лидерборде

Автор также обновил подход к оценке и добавил скорость генерации как отдельный критерий. Это важный сдвиг: в реальной работе ценится не только качество ответа, но и то, насколько быстро модель выдаёт результат.

Кроме того, в разборе упомянуты ещё несколько моделей июня, пересмотрены оценки за год и добавлены новые колонки в лидерборд. По сути, рынок ИИ продолжает двигаться, но иногда самые заметные улучшения происходят не у новинок, а у моделей, которые просто стабильно держат планку.

Частые вопросы

Что полезного из такого теста обычному пользователю?

Он помогает понять, какая модель даёт лучший баланс между качеством, стоимостью и скоростью, а значит — выбрать более выгодный ИИ для работы и повседневных задач.

Почему одна и та же модель может выглядеть по-разному в тестах?

Результат зависит от метода проверки, набора задач и условий сравнения. Поэтому честная очная ставка часто точнее, чем разрозненные замеры в разные моменты.

На что смотреть при выборе модели кроме качества ответов?

Важно учитывать цену, скорость генерации, стабильность на разных задачах и то, насколько модель подходит именно под ваши сценарии — например, тексты, аналитику или поддержку клиентов.

Читайте также

Попробовать Lord GPT бесплатно →