OpenAI представила Ultrafast: GPT-5.6 Sol отвечает в 14 раз быстрее

OpenAI представила Ultrafast: GPT-5.6 Sol отвечает в 14 раз быстрее

OpenAI открыла ранний доступ к Ultrafast, новому классу скорости для своих моделей. В этом режиме флагманская модель GPT-5.6 Sol работает до 14 раз быстрее, чем при обычной (Standard) обработке, и генерирует до 750 исходящих токенов в секунду. Режим запускается первым в OpenAI API и работает на инфраструктуре партнёра компании, Cerebras; это следующий шаг их сотрудничества по сверхнизкой задержке вывода.

По словам компании, раньше выбор был вынужденным: чтобы получить скорость реального времени, приходилось брать модель поменьше или более узкоспециализированную. Ultrafast, как заявляет OpenAI, снимает этот компромисс, топовый по интеллекту GPT-5.6 Sol становится доступен там, где важна каждая секунда.

OpenAI называет пять сценариев, где режим уже показал себя: реагирование на инциденты (анализ логов, недавних изменений кода и отчётов инженеров прямо во время сбоя, чтобы быстрее найти причину и подготовить исправление); финансовый анализ и безопасность (разбор рыночных сигналов и транзакций, выявление подозрительной активности, пока ситуация ещё меняется); поддержка клиентов и голосовые сервисы (решение сложных обращений в реальном времени без пауз в разговоре); коммерция (ответы на вопросы о товаре, проверка наличия, персональные рекомендации и решение проблем на оформлении заказа, пока покупатель ещё не передумал); исследовательская работа (превращение экспериментов, которые раньше запускали на ночь и проверяли утром, в интерактивную сессию с возможностью сразу скорректировать подход и перезапустить).

Внутри самой OpenAI группа разработчиков уже тестирует GPT-5.6 Sol в режиме Ultrafast, прежде всего для реагирования на инциденты и для исследовательской работы. При разборе инцидентов инженеры используют его, чтобы быстро прочитать логи, проанализировать трассировки, свести переписку и наметить следующие проверки и черновик исправления, при этом решения о диагнозе и развёртывании по-прежнему остаются за инженерами. В исследованиях команда применяет Ultrafast для быстрого поиска по источникам знаний и данных и их сведения в сводку; привычный цикл "эксперимент за ночь, разбор результатов утром" сжимается до нескольких итераций в течение рабочего дня.

Сейчас GPT-5.6 Sol в режиме Ultrafast доступен в ограниченном превью узкой группе клиентов из сфер разработки, коммерции, финансового анализа и поддержки; доступ будет расширяться по мере роста мощностей. Компания собирает данные о том, где выигрыш в скорости даёт наибольший эффект, чтобы на основе этого развивать продукт дальше. Цена тарифа, точные сроки расширения доступа и скорость обработки входящих (не только исходящих) токенов в источнике не названы.

Ключевые факты

  • OpenAI представила Ultrafast, режим работы GPT-5.6 Sol на скорости до 14 раз выше обычной (Standard) обработки
  • Скорость генерации, до 750 исходящих токенов в секунду; вычисления выполняет партнёр OpenAI, компания Cerebras
  • Режим запускается первым в OpenAI API и сейчас доступен в ограниченном превью узкой группе клиентов
  • Названные сценарии применения: реагирование на инциденты, финансовый анализ и безопасность, поддержка клиентов, коммерция, исследовательская работа
  • Цена, точные сроки расширения доступа и скорость обработки входящих токенов в материале не раскрыты

Почему это важно

До сих пор скорость реального времени и уровень интеллекта модели были противоположными полюсами: чтобы получить быстрый ответ, разработчики брали модель попроще. Ultrafast, попытка OpenAI снять этот компромисс и предложить топовую по возможностям модель GPT-5.6 Sol на скорости, сопоставимой с интерактивными сервисами, за счёт специализированного инференс-партнёра Cerebras, а не за счёт урезания самой модели.

Кому это важно

В первую очередь, компаниям, которые строят продукты с жёсткими требованиями к задержке ответа: команды реагирования на инциденты и SRE, финансовые и security-аналитики, служба поддержки и голосовые ассистенты, e-commerce-платформы и исследовательские команды, которым нужно проверять гипотезы в интерактивном режиме, а не ждать ночного прогона.

Как это применить

Пока доступ ограничен: Ultrafast работает первым делом в OpenAI API и открыт узкой группе клиентов по превью-программе, попасть в которую можно, оставив заявку у OpenAI на уведомление о расширении доступа. Ни цена тарифа, ни точные условия перехода на общий доступ в материале не названы, компания говорит лишь, что будет расширять доступ по мере роста мощностей.

Можно ли доверять

Это официальный пост OpenAI, а не независимый тест: цифры 14x и 750 токенов в секунду, собственные заявления компании и партнёра Cerebras, без независимых бенчмарков или сравнения с другими провайдерами. Сами кейсы использования (реагирование на инциденты, исследования) описаны на примере внутренней команды OpenAI, то есть это не сторонние отзывы клиентов.

Риски и подводные камни

Доступ ограничен узкой группой клиентов, поэтому пока нельзя проверить, как заявленное 14-кратное ускорение и качество ответов ведут себя при массовой нагрузке. Цена не объявлена, быстрый режим может оказаться существенно дороже стандартного тарифа. Материал не раскрывает, как ускорение сказывается на точности или стабильности ответов модели и как обрабатываются входящие (не только исходящие) токены.