Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Германия представила открытую ИИ-модель Soofi S, обогнавшую OLMo 3 32B и Apertus 70B.

Германия выпустила модель Soofi S. Согласно отчёту консорциума, она обошла OLMo 3 32B и Apertus 70B, став лучшей среди полностью открытых моделей на английских и немецких бенчмарках. Обучение прошло целиком в Европе, на 512 ускорителях Nvidia B200 в мюнхенском облаке Deutsche Telekom. За проектом стоит консорциум институтов Fraunhofer, DFKI, немецких университетов и ИИ-компаний.

Гибридная архитектура и скорость

Внутри используется Mixture of Experts (MoE) на 31,6 млрд параметров, из которых на токен работают только 3,2 млрд. Архитектуру взяли у Nemotron 3 Nano: гибрид Mamba-2 и обычного attention, при этом KV-кеш держат лишь 6 слоёв из 52. Поэтому на длинном контексте скорость почти не падает: от 4K до 256K токенов генерация остаётся стабильной, а на 40K модель выдаёт примерно в 8 раз больше токенов в секунду на GPU, чем плотные модели на 14–24 млрд параметров. В процессе обучения использовано 27 трлн токенов с повышенной долей немецкого языка.

Результаты тестов

Модель набирает 73,8% на тесте HumanEval, что является лучшим результатом среди открытых аналогов. Слабые места также задокументированы: к ним относятся конкурсная математика и извлечение фактов из длинного контекста.

Этот пост Вконтакте:

Ещё новости:

Субтитры без ручной расшифровки: SmartSub и WhisperSubTranslate.
Стильный промпт для переноса артов в швейцарском стиле со строгой сеткой и броскими цветами!
Jev: новый класс ИИ для быстрых решений и лучшие проекты на GitHub!
Китайский айтишник создал топовую локальную нейронку laya-mlx и заставил её играть в «Змейку».
Теренс Тао: темпы развития ИИ стали слишком быстрыми!
Лучшая 4D-визуализация движений: Gemini, Codex и three.js растянули время.
Китайская ботоферма с ИИ-роботом и физическим «пальцем» обходит проверки соцсетей.
ChatGPT и Claude ошибаются в финансовых вопросах в 57% случаев.
ChatGPT якобы сам отправил письмо в ФБР через Gmail пользователя.
«Ты же говорил, что так можно»: как ИИ выручает бухгалтеров на 1С и их руководителей.