OpenAI представила предварительную версию режима Ultrafast для своей флагманской модели GPT-5.6 Sol. Режим обеспечивает до 750 выходных токенов в секунду, что примерно в 14 раз быстрее стандартного режима. Ускорение достигается за счет использования чипов Cerebras, с которыми OpenAI в этом году заключила партнерство на десять миллиардов долларов. Пока сервис доступен только через OpenAI API для
Ultrafast-режим сочетает скорость небольших моделей с полными возможностями большой модели рассуждений, что позволяет выполнять больше полезной работы за секунду. Например, при реагировании на инциденты инженеры могут анализировать логи, изменения кода и отчеты, пока инцидент еще происходит, что помогает быстрее выявить причину и подготовить исправление. OpenAI уже использует эту возможность внутри компании. В финансах модель может оценивать рыночные сигналы и выявлять подозрительные транзакции в реальном времени. В поддержке клиентов — решать сложные запросы, требующие обращения к нескольким системам. В электронной коммерции — отвечать на вопросы о товарах, проверять наличие и давать персональные рекомендации, пока покупатель не ушел с сайта.
| Режим | Скорость | Цена |
|---|---|---|
| Стандартный | Базовый уровень | Стандартная |
| Fast Mode | до 2,5x | примерно вдвое дороже |
| Ultrafast | до 750 токенов/с | выше, чем Fast Mode |
OpenAI также видит применение в исследованиях: эксперименты, которые раньше выполнялись ночью как пакетные задания, теперь могут стать интерактивными сессиями, где команды тестируют идеи, просматривают результаты и корректируют подход без перерыва в работе.
Скорость 750 токенов в секунду позволяет анализировать логи и код в реальном времени во время инцидентов.

OpenAI монетизирует скорость через тарифные уровни. Через API уже доступен режим Fast Mode, который обещает до 2,5-кратного ускорения с меньшей задержкой для GPT-5.6 Sol примерно по двойной цене. Ultrafast добавляет третий, более быстрый и, вероятно, более дорогой уровень. Логика повторяет подход облачных провайдеров, таких как AWS, которые давно берут больше за ту же услугу с более высокой производительностью. Если скорость станет узким местом в разных отраслях, такая тарификация позволит OpenAI получать долю от выгоды, которую ускорение приносит клиентам.



