Содержание
Ultrafast для GPT-5.6 Sol: зачем OpenAI понадобилась скорость в 14 раз выше
OpenAI показала Ultrafast — новый режим обработки для GPT-5.6 Sol, который работает до 14 раз быстрее стандартного. Сервис запускается сначала в OpenAI API и способен генерировать до 750 выходных токенов в секунду.
Большая модель без привычной задержки
Обычно разработчикам приходится выбирать между качеством крупной модели и быстрым ответом более компактной. Ultrafast сохраняет возможности GPT-5.6 Sol, но сокращает ожидание настолько, чтобы использовать модель в интерактивных продуктах и рабочих процессах реального времени.
OpenAI называет среди сценариев реагирование на сбои, анализ финансовых и защитных сигналов, поддержку клиентов и голосовые интерфейсы, персонализацию интернет-магазинов и быстрые исследовательские итерации. Например, модель может читать логи, изменения кода и сообщения команды, пока инцидент ещё продолжается.
Скорость обеспечивает Cerebras
Режим работает на инфраструктуре Cerebras с вычислительными системами на пластинах. Партнёры заявляют, что высокая пропускная способность достигается без ухудшения качества ответов: веса модели удерживаются ближе к вычислениям, а задержки на перемещение данных сокращаются.
По тестам Cerebras, GPT-5.6 Sol Ultrafast обработала 2500 вопросов Humanity's Last Exam за 11 часов 11 минут. Для сравнения, Claude Fable 5 потребовалось более 78 часов при сопоставимой точности. Это результаты самого партнёра, поэтому их стоит воспринимать как ориентир до независимых проверок.
Кому доступен Ultrafast
Сейчас Ultrafast работает как ограниченный предварительный запуск для небольшой группы клиентов OpenAI API. Компания обещает расширять доступ по мере роста мощностей; присоединиться к списку ожидания можно на странице официального анонса.
Для бизнеса практический эффект не только в более быстрых ответах чат-бота. Если режим сохранит заявленное качество под реальной нагрузкой, сложные AI-агенты смогут выполнять последовательные действия почти без пауз, а сотрудникам реже придётся переключаться между задачами в ожидании результата.