История
август 14, 2026
OpenAI рассчитывает, что GPT-5.6 Ultrafast сделает передовой ИИ по-настоящему режимом реального времени
OpenAI демонстрирует режим на базе Cerebras для GPT-5.6 Sol, который, по её словам, достигает скорости 750 токенов в секунду. Обещание заключается не только в более быстрых ответах, но и в переходе к ИИ, способному работать внутри текущих бизнес-решений — хотя доступ пока остаётся ограниченным.
OpenAI делает смелую ставку на то, что следующий прорыв в ИИ будет связан не с более «умной» моделью, а с такой, которая достаточно быстра, чтобы иметь значение, пока кризис, звонок или транзакция ещё продолжаются. Новый уровень Ultrafast обещает перенести возможности передовой модели в те моменты, где задержка долгое время была сдерживающим фактором.
Компания начала ограниченный предварительный просмотр API GPT-5.6 Sol Ultrafast — уровня сервиса на базе Cerebras, который, как она утверждает, работает до 14 раз быстрее стандартной обработки и может выдавать до 750 выходных токенов в секунду. OpenAI подаёт релиз как отказ от привычного компромисса: «До сих пор получение скорости в реальном времени обычно означало выбор в пользу меньшей или более специализированной модели».1
Непосредственные цели — высоконагруженные бизнес-процессы. OpenAI говорит, что этот режим может помочь инженерам читать логи и готовить исправления во время сбоя, позволить финансовым командам оценивать сигналы по мере движения рынков и дать системам поддержки возможность решать сложные запросы, не прерывая разговор с клиентом. Компания также видит более быстрый цикл исследований: эксперименты, которые раньше запускались на ночь, теперь можно многократно тестировать, просматривать и корректировать в течение рабочего дня.
Это обещание опирается не только на «сырую» скорость вывода. Компания утверждает, что сочетание высокой отзывчивости с более продвинутыми возможностями рассуждения GPT-5.6 Sol может изменить сам подход к дизайну продуктов, делая голосовых ассистентов, коммерческие инструменты и системы живых исследований менее похожими на отложенные чат-интерфейсы и больше — на активных соавторов.
За пределами собственного позиционирования OpenAI практическое ограничение очевидно: Ultrafast по-прежнему доступен только избранной группе клиентов, пока наращиваются мощности. Запуск также происходит на всё более конкурентном рынке ускоренного инференса, где конкурирующие провайдеры ИИ представили более быстрые режимы, но, как утверждает OpenAI, не с заявленным уровнем пропускной способности. В отчёте о запуске говорится, что предварительный доступ изначально нацелен на такие области, как реагирование на инциденты, поддержка клиентов, анализ рынков и электронная коммерция.2
Пока что главное — это контролируемый тест, а не массовый релиз. Но аргумент OpenAI однозначен: если компаниям больше не придётся жертвовать интеллектом ради скорости, то самая значимая работа ИИ может сместиться от бэк-офисных задач к решениям в рамках живых операционных процессов.