1 сентября Anthropic выпустила Claude Fable 5.1 — новую топовую модель для программирования и сложной интеллектуальной работы. Это событие могло бы стать очередным раундом в гонке ИИ-моделей, но Financial Times обращает внимание на показательный пример: спустя примерно два месяца после выхода предыдущей версии Fable 5 на неё приходилось лишь около 11% расходов на продукты Anthropic среди корпоративных клиентов, которых отслеживает платформа Ramp. Цифра не отражает всю выручку Anthropic, а лишь выборку корпоративных трат, к тому же запуск Fable 5 был прерван из-за экспортных ограничений, но тенденция очевидна: компании всё чаще выбирают более дешёвые модели, если дополнительное качество frontier-модели не влияет на бизнес-результат.
Эта ситуация — не внезапный сдвиг, а закономерный итог эволюции рынка LLM с 2022 года. Тогда, 30 ноября 2022 года, OpenAI запустила ChatGPT, превратив языковые модели из исследовательской технологии в массовый продукт. Уже 14 марта 2023 года вышла GPT-4, которая показала заметный скачок в тестах: в симуляции американского bar exam она оказалась в верхних 10% результатов, тогда как GPT-3.5 — около нижних 10%. GPT-4 стала точкой отсчёта для индустрии, и конкурентов оценивали по приближению к её уровню. Но уже в 2023 году стало ясно, что одной характеристики «умнее» недостаточно: Anthropic сделала ставку на размер контекста (Claude получила окно в 100 тысяч токенов), а Google в декабре представила Gemini 1.0 сразу в трёх вариантах — Ultra, Pro и Nano, фактически разбив понятие «лучшая модель» на классы.
| Год | Событие | Значение |
|---|---|---|
| 2022 | Запуск ChatGPT | LLM стали массовым продуктом |
| 2023 | Выход GPT-4 | Скачок качества, точка отсчёта для индустрии |
| 2023 | Google Gemini 1.0 (Ultra/Pro/Nano) | Разделение моделей на классы |
| 2024 | Gemini 1.5 Pro | Mixture-of-Experts, контекст до 1 млн токенов |
| 2024 | Claude 3 (Haiku/Sonnet/Opus) | Линейка по балансу интеллекта и цены |
| 2024 | GPT-4o и Gemini 1.5 Flash | Упор на скорость и низкую стоимость |
В 2024 году тренд на специализацию усилился. Google в феврале выпустила Gemini 1.5 Pro с архитектурой Mixture-of-Experts и контекстом до миллиона токенов в превью, показав, что важна не просто мощность, а эффективность. В марте Anthropic представила Claude 3 в вариантах Haiku, Sonnet и Opus, прямо разделив модели по балансу интеллекта, скорости и стоимости. В мае OpenAI выпустила GPT-4o, которая на текстовых задачах работала на уровне GPT-4 Turbo, но была вдвое дешевле через API, а Google почти одновременно показала Gemini 1.5 Flash с акцентом на низкую задержку и стоимость. К концу 2024 года рынок окончательно перешёл от идеи «одна большая модель должна уметь всё» к системам, где вычислительная мощность распределяется в зависимости от сложности задачи.
По данным Ramp, на Fable 5 приходилось около 11% корпоративных расходов на продукты Anthropic спустя два месяца после релиза.
Для бизнеса это означает смену приоритетов: вместо погони за самой мощной моделью компании оценивают экономическую эффективность. Если модель среднего класса справляется с задачей, переплата за frontier-модель не оправдана. Это подтверждается и данными Ramp, и логикой развития индустрии, где лидеры сами предлагают линейки моделей разного уровня. Показательно, что даже Anthropic, известная своими мощными моделями, вынуждена учитывать этот спрос, а Google и OpenAI активно развивают лёгкие версии. Гонка за абсолютное первенство в бенчмарках уступает место конкуренции за оптимальное соотношение цены и качества, и это меняет стратегии как разработчиков, так и их клиентов.

