OpenAI 13 августа 2026 года представила режим Ultrafast для своей флагманской модели GPT-5.6 Sol. Режим ускоряет обработку запросов в 14 раз по сравнению со стандартным режимом, достигая скорости до 750 выходных токенов в секунду. Токены — это фрагменты текста, которые модель генерирует при ответе; чем выше скорость, тем быстрее пользователь получает результат.
Ultrafast работает на базе чипов Cerebras, с которыми OpenAI заключила партнёрство. Пока режим доступен в предварительной версии ограниченному числу клиентов, но компания обещает расширить доступ по мере роста мощностей. В блоге OpenAI отмечается: «До сих пор для получения скорости в реальном времени обычно приходилось выбирать меньшую или более специализированную модель. Ultrafast указывает на новое направление: больше полезной работы в секунду».
Новый режим ориентирован на корпоративные сценарии, где скорость критична: реагирование на инциденты, клиентская поддержка, анализ финансовых рынков и электронная коммерция. Например, в поддержке Ultrafast может мгновенно обрабатывать запросы клиентов, сокращая время ожидания. В финансовой аналитике — быстро обрабатывать большие объёмы данных для принятия решений.
Ultrafast работает на базе чипов Cerebras и пока доступен ограниченному кругу клиентов.

Конкуренты также развивают ускоренные версии моделей. Anthropic запустила fast mode для Claude, но, по данным OpenAI, она не достигает скорости Ultrafast. Это подчёркивает конкурентное преимущество OpenAI, хотя и требует мощной инфраструктуры.
Для бизнеса Ultrafast означает возможность использовать большую языковую модель в задачах, где раньше требовались лёгкие и быстрые модели. Это может снизить задержки и повысить эффективность, но пока доступ ограничен, и неизвестно, как это повлияет на стоимость API. В целом, Ultrafast — шаг к более отзывчивым ИИ-системам, которые могут работать в реальном времени.



