OpenAI показала Ultrafast для GPT-5.6 Sol: до 750 токенов в секунду.
OpenAI показала скоростной режим Ultrafast для модели GPT-5.6 Sol. Это тот самый Sol на Cerebras, которого ждали с конца июля: до 750 выходных токенов в секунду и до 14 раз быстрее обычной обработки.
Модель осталась прежней, интеллект не урезают. Меняется только аппаратная часть. Если раньше за скорость платили качеством и выбирали модель поменьше, то теперь старшая модель отвечает в реальном времени.
В блоге OpenAI показывают, где это меняет работу: разбор аварии, пока она ещё идёт, поддержка и голосовые сценарии без пауз посреди разговора, ответы покупателю, пока он не ушёл из корзины. Внутри самой OpenAI ночные прогоны экспериментов сжались до нескольких итераций за рабочий день.
Пока это ограниченное превью в API для отобранных клиентов, дальше доступ будут открывать по мере роста мощностей. Цену не назвали, но записаться на уведомление может любой желающий.

