LMSYS Arena добавила full‑stack категорию: Kimi K3 снова лидирует, но Claude и ChatGPT почти не уступают.
На платформе LMSYS Arena (Арена) появилась отдельная категория full‑stack для A/B‑тестов агентов. Теперь оценивается способность создавать и фронтенд, и бэкенд, то есть «полный стек».
Мы изучили расклады: модель Kimi K3 снова заняла первое место, но топовые LLM (Kimi K3, Claude, ChatGPT) идут практически вровень. При таком равенстве решающим фактором становятся цена и скорость работы модели.

