Рейтинг Chatbot Arena для React: Claude Fable ушёл в отрыв, Opus сравнялся с Qwen, GLM и Minimax.
Рейтинг Chatbot Arena для React обновился, и мы спешим поделиться главными выводами. Arena известна тем, что отражает реальное голосование конечных пользователей, а не синтетические метрики. Это особенно важно для фронтенда на React.
Opus 4.6 сравнялся с Qwen, GLM и Minimax
Результаты Claude Opus 4.6 теперь находятся в пределах статистической погрешности с Qwen 3.7 Max, GLM 5.1, Minimax и даже младшей Claude Sonnet 4.6. Причина кроется в общих SFT-датасетах, на которых обучаются современные языковые модели.
Claude Fable — король с оговорками
Значительный отрыв у Claude Fable. Оценки указывают на огромный размер — порядка 10 триллионов параметров, что позволяет модели очень чётко воспроизводить обучающие примеры и выполнять точные интерполяции. Но после эмбарго Трампа Fable стала исключительно академической моделью без возможности коммерческого использования.
Вывод для разработчиков и бизнеса: хотите зарабатывать на клиентах — обращайте внимание на их реальные предпочтения. Chatbot Arena в этом плане честный компас.

