OpenAI 13 августа 2026 года представила режим Ultrafast для своей флагманской модели GPT-5.6 Sol. Режим ускоряет обработку запросов в 14 раз по сравнению со стандартным режимом, достигая скорости до 750 выходных токенов в секунду. Токены — это фрагменты текста, которые модель генерирует при ответе; чем выше скорость, тем быстрее пользователь получает результат.

Ultrafast работает на базе чипов Cerebras, с которыми OpenAI заключила партнёрство. Пока режим доступен в предварительной версии ограниченному числу клиентов, но компания обещает расширить доступ по мере роста мощностей. В блоге OpenAI отмечается: «До сих пор для получения скорости в реальном времени обычно приходилось выбирать меньшую или более специализированную модель. Ultrafast указывает на новое направление: больше полезной работы в секунду».

Новый режим ориентирован на корпоративные сценарии, где скорость критична: реагирование на инциденты, клиентская поддержка, анализ финансовых рынков и электронная коммерция. Например, в поддержке Ultrafast может мгновенно обрабатывать запросы клиентов, сокращая время ожидания. В финансовой аналитике — быстро обрабатывать большие объёмы данных для принятия решений.

Ultrafast работает на базе чипов Cerebras и пока доступен ограниченному кругу клиентов.

Image Credits:Olivier Morin/AFP / Getty Images
Image Credits:Olivier Morin/AFP / Getty Images · Источник: TechCrunch AI

Конкуренты также развивают ускоренные версии моделей. Anthropic запустила fast mode для Claude, но, по данным OpenAI, она не достигает скорости Ultrafast. Это подчёркивает конкурентное преимущество OpenAI, хотя и требует мощной инфраструктуры.

Для бизнеса Ultrafast означает возможность использовать большую языковую модель в задачах, где раньше требовались лёгкие и быстрые модели. Это может снизить задержки и повысить эффективность, но пока доступ ограничен, и неизвестно, как это повлияет на стоимость API. В целом, Ultrafast — шаг к более отзывчивым ИИ-системам, которые могут работать в реальном времени.