Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Открытая Qwen3.8-27B дала бой Claude Opus 4.6: 2:2 в coding-тестах.

Alibaba выложила Qwen3.8-27B: плотную модель на 27,8 млрд параметров с открытыми весами и лицензией Apache 2.0. Она нативно понимает текст, изображения и видео, а режим мышления включён по умолчанию и переключается между low, medium и xhigh.

Главная интрига: результаты против Claude Opus 4.6 с максимальным reasoning effort.

Результаты в coding-тестах

  • SWE-bench Pro: 61,7 против 53,4 в пользу Qwen;
  • QwenSWEBench: 79,0 против 63,8 в пользу Qwen;
  • Terminal-Bench 2.1: 73,0 против 78,2 в пользу Opus;
  • NL2Repo-Bench: 42,3 против 47,6 в пользу Opus.

Получается счёт 2:2 среди четырёх coding-строк, где есть цифры обеих моделей. В управлении компьютером Qwen также заявляет 84,3 на OSWorld-Verified против 72,7 у Opus.

Но это не чистый A/B-тест. QwenSWEBench: внутренний бенчмарк Alibaba. В SWE-bench Pro задачи исправили и заново прогнали модели Qwen, а результат Opus взяли из отчёта Anthropic. Поэтому правильный вывод не «27B окончательно победила Opus», а компактная локальная модель местами уже подошла к закрытому флагману.

Что получаем на практике

  • нативный контекст: 262 144 токена, до 1 млн он растягивается через YaRN;
  • 64 слоя с чередованием Gated DeltaNet и обычного attention;
  • MTP для ускорения генерации в движках, которые его поддерживают;
  • официальные BF16-веса занимают 55,6 ГБ.

Для домашнего запуска уже появились сторонние GGUF-кванты Unsloth:

  • от 12 до 13 ГБ памяти: 2-bit, файл 10,32 ГБ;
  • 16 ГБ: 3-bit, 13,44 ГБ;
  • 24 ГБ GPU: оптимальный Q4, от 17,11 до 17,92 ГБ;
  • 32 ГБ и больше: Q6, 22,88 ГБ.

У GGUF vision projector скачивается отдельно: файл mmproj весит ещё 0,93 ГБ. С обычным F16 KV-кэшем полный контекст 262K на одной 24-ГБ карте не поместится. Для длинных диалогов придётся уменьшать контекст, квантовать сам кэш или использовать offload в RAM.

Ещё одно уточнение: класс Max уже не полностью закрыт. Qwen отдельно выложила 2,4T-A95B checkpoint под собственной лицензией. Но именно 27B намного реалистичнее запустить дома, и только она здесь распространяется по Apache 2.0.

Официальные веса и документация · Кванты GGUF · Инструкция по локальному запуску

Этот пост Вконтакте:

Ещё новости:

ИИ-агент Anthropic попытался взломать чужой проект на GitHub.
Anthropic открыла Claude Cowork в мобильном приложении для всех платных подписчиков.
Нейросеть Claude, судя по всему, нашла решение для матрицы Адамара порядка 668!
Вышел технический репорт Sona: одна модель заменила весь рекомендательный стек Яндекс Музыки.
Цифровой мастер-класс: три нейросети воссоздали «Мону Лизу».
Алиса AI понимает фото: сложный запрос можно вообще не формулировать словами.
OpenAI запускает безлимитные текстовые чаты с GPT-5.6 Luna для Free и Go.
OpenAI готовит домашнюю ИИ-колонку-пончик за $300+ и планирует выпуск в 2027 году.
На Arena появилась новая модель OpenAI GPT-Image Mona-lisa-1 с водяным знаком SynthID!
Впервые в истории: 25-летний парень получил уголовное дело из-за переписки с ChatGPT.