Нейролюб
НовостьНейросетиOpenAIGPT‑5.6

OpenAI ускорила GPT-5.6 Sol в 14 раз — до 750 токенов в секунду

Новый режим Ultrafast запускает GPT-5.6 Sol до 14 раз быстрее стандартного режима и выдаёт до 750 токенов в секунду.

Кирилл Киреев

13.08.2026 · 3 минут чтения · Нейросети

Официальная иллюстрация GPT-5.6 Sol Ultrafast от Cerebras

Содержание

Ultrafast для GPT-5.6 Sol: зачем OpenAI понадобилась скорость в 14 раз выше

OpenAI показала Ultrafast — новый режим обработки для GPT-5.6 Sol, который работает до 14 раз быстрее стандартного. Сервис запускается сначала в OpenAI API и способен генерировать до 750 выходных токенов в секунду.

Большая модель без привычной задержки

Обычно разработчикам приходится выбирать между качеством крупной модели и быстрым ответом более компактной. Ultrafast сохраняет возможности GPT-5.6 Sol, но сокращает ожидание настолько, чтобы использовать модель в интерактивных продуктах и рабочих процессах реального времени.

OpenAI называет среди сценариев реагирование на сбои, анализ финансовых и защитных сигналов, поддержку клиентов и голосовые интерфейсы, персонализацию интернет-магазинов и быстрые исследовательские итерации. Например, модель может читать логи, изменения кода и сообщения команды, пока инцидент ещё продолжается.

Скорость обеспечивает Cerebras

Режим работает на инфраструктуре Cerebras с вычислительными системами на пластинах. Партнёры заявляют, что высокая пропускная способность достигается без ухудшения качества ответов: веса модели удерживаются ближе к вычислениям, а задержки на перемещение данных сокращаются.

По тестам Cerebras, GPT-5.6 Sol Ultrafast обработала 2500 вопросов Humanity's Last Exam за 11 часов 11 минут. Для сравнения, Claude Fable 5 потребовалось более 78 часов при сопоставимой точности. Это результаты самого партнёра, поэтому их стоит воспринимать как ориентир до независимых проверок.

Кому доступен Ultrafast

Сейчас Ultrafast работает как ограниченный предварительный запуск для небольшой группы клиентов OpenAI API. Компания обещает расширять доступ по мере роста мощностей; присоединиться к списку ожидания можно на странице официального анонса.

Для бизнеса практический эффект не только в более быстрых ответах чат-бота. Если режим сохранит заявленное качество под реальной нагрузкой, сложные AI-агенты смогут выполнять последовательные действия почти без пауз, а сотрудникам реже придётся переключаться между задачами в ожидании результата.

Хочешь узнавать первым о таких новостях?

Переходи в наш телеграм канал где мы ежедневно публикуем самые свежие и интересные новости

Перейти в Телеграм

Хочешь узнавать первым о таких новостях?

Переходи в наш телеграм канал где мы ежедневно публикуем самые свежие и интересные новости

Чиби Новости