Celeris-1 вышла на первое место по скорости генерации — около 2 086 токенов в секунду!
Мир нейросетей продолжает ускоряться. Модель Celeris-1 показала впечатляющую скорость генерации — около 2 086 токенов в секунду, заняв первое место в рейтинге скорости по данным независимой платформы Artificial Analysis. Самое интересное, что такая производительность достигается на стандартных GPU, без применения специализированных ускорителей.
Разработчики также провели собственное тестирование на бенчмарке MMLU-Pro, где модель набрала 75,9%. Для сравнения:
- GPT-5 mini — 78,5%
- GPT-5 — 81,9%
При этом Celeris-1 отвечала примерно в 13-16 раз быстрее оппонентов. Секрет такой скорости кроется в особой архитектуре, которая снижает зависимость от последовательной генерации «токен за токеном».
Стоит отметить, что показатели качества и сравнение с GPT-5 предоставлены самой командой Celeris, а параметр reasoning budget у моделей был установлен в ноль. Однако независимый замер Artificial Analysis однозначно подтверждает главное: преодоление рубежа в 2 000 токенов в секунду стало реальностью.

