OpenAI ускорила GPT-5.6 Sol в 14 раз: до 750 токенов в секунду на железе Cerebras!
OpenAI ускорила GPT-5.6 Sol в 14 раз: модель теперь выдаёт до 750 токенов в секунду.
Для этого Sol запустили на железе Cerebras: модель отвечает почти мгновенно и не тратит время на постоянную перегонку данных между памятью.
На бенчмарке HLE полный прогон занял чуть больше 11 часов. У Claude Fable тот же тест занял почти 80 часов.
Пока Ultrafast доступен только ограниченной группе пользователей. Когда он доберётся до всех, нейросеть будет отвечать гораздо быстрее.

