3 августа Alibaba выпустила финальную версию Qwen3.8 Max — мультимодальную модель со смесью экспертов и 2,4 трлн параметров. Она принимает текст, изображения и видео, возвращает текст и поддерживает контекст до миллиона токенов. В режиме мышления доступно до 983 тысяч входных и 131 тысячи выходных токенов. Миллион токенов вмещает примерно десять романов или несколько крупных репозиториев с документацией. Большой контекст снимает привычную инженерную возню с нарезкой документов, повторной подачей файлов и потерянными кусками контекста.
Гибридное мышление включено по умолчанию. Модель умеет вызывать функции, работать со встроенными инструментами и выдавать структурированный результат. Alibaba отдельно продвигает её для программирования и профессиональных агентных процессов. На странице модели встречается обещание проектов продолжительностью более десяти дней. Пока это заявление производителя, независимого воспроизведения такого марафона я не нашёл.
| Модель | Intelligence Index | Agentic Index |
|---|---|---|
| Qwen3.8 Max | 58,1 | 58,4 |
| Claude Fable 5 | 62,1 | 56,6 |
Artificial Analysis прогнала Qwen3.8 Max через собственный набор тестов. В широком Intelligence Index модель получила 58,1 балла. Claude Fable 5 набрала 62,1. Июльская формулировка про уровень сразу под Fable выглядит довольно точной: разрыв составил четыре балла. В Agentic Index порядок меняется. Qwen3.8 Max получила 58,4 балла, Claude Fable 5 получила 56,6. Выше Qwen на момент проверки стояли только два режима Claude Opus 5. Этот индекс собирает задачи, где модель должна выполнить работу через инструменты: разбираться с терминалом, вести многошаговый процесс и доводить прикладную задачу до результата.
Цена: $2 за миллион входных токенов, $6 за выходные; это в 5 раз дешевле Claude Fable 5 на входе и в 8,3 раза на выходе.
Получилась редкая аккуратная картина. Claude Fable 5 сильнее по широкому набору интеллектуальных задач. Qwen3.8 Max лучше прошла узкую агентную часть. Для чат-бота первая цифра важнее. Для системы, которая ходит по инструментам, правит файлы и выполняет длинную цепочку действий, вторая уже заслуживает отдельного теста.
Alibaba установила единую ставку: $2 за миллион входных токенов и $6 за миллион выходных. Чтение закэшированного контекста стоит $0,25 за миллион токенов. У Claude Fable 5 официальная цена составляет $10 за вход и $50 за выход. Qwen обходится в пять раз дешевле на входе и примерно в 8,3 раза дешевле на выходе. Возьмём агентный процесс, который за несколько часов съел 10 млн входных и 5 млн выходных токенов. По базовым ставкам он обойдётся в $50 на Qwen3.8 Max и в $350 на Claude Fable 5. Разница семикратная. Кэш, повторные вызовы и разное количество рассуждений изменят итоговый чек. Порядок цен уже виден без лупы.
Qwen3.8 Max заодно дешевле предыдущей Qwen3.7 Max. Та стоила $2,50 за вход и $7,50 за выход. Новая флагманская модель получила скидку в 20 процентов ещё до того, как успела состариться. В индустрии ИИ календарь иногда работает быстрее отдела продаж.
У цены есть мелкая бухгалтерская сноска. На полном прогоне Intelligence Index модель выдала около 150 млн токенов. Медиана сопоставимых моделей у Artificial Analysis составляет 66 млн. Qwen оказалась примерно в 2,3 раза многословнее медианы. Сам тестовый прогон стоил лаборатории $1741. Сумма относится ко всему набору испытаний и ничего не говорит о цене одного обычного запроса. Она показывает характер модели: Qwen охотно тратит токены на рассуждение. В длинном агентном цикле часть экономии может уйти на дополнительные шаги и подробные внутренние монологи.
Скорость нормальная: около 82 выходных токенов в секунду через API Alibaba. Artificial Analysis измерила у Claude Fable 5 примерно 70 токенов в секунду. Qwen3.8 Max доступна через QwenCloud, API уже работает. Открытые веса пока не опубликованы, что ограничивает самостоятельное развёртывание. Для разработчиков, которые строят агентные системы, Qwen3.8 Max выглядит привлекательно из-за цены и агентных показателей, но стоит учитывать многословность и отсутствие открытых весов.

