Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Ant Group представила Ling-3.0-flash: MoE-модель для продакшн-агентов с гибридным ризонингом.

Ant Group официально анонсировала новую модель Ling-3.0-flash — это архитектура класса Mixture of Experts (MoE) с гибридным механизмом рассуждения, ориентированная на работу в составе продакшн-агентов. Общий объем модели достигает 124 миллиардов параметров, однако на каждый токен активируется лишь 5,1 миллиарда. Такой подход позволил добиться впечатляющих результатов: при одной восьмой общего размера и одной двенадцатой активных параметров Ling-3.0-flash догоняет или даже обходит их собственный флагман Ling-2.6-1T на большинстве заявленных бенчмарков.

Внутри используется нативное гибридно-линейное внимание, где слои KDA (Knowledge-Driven Attention) и MLA (Multi-Latent Attention) скомбинированы в пропорции 5:1. KDA обеспечивает тонкий контроль над долгосрочной памятью, а активация лишь 1/64 экспертов заметно удешевляет MoE-вычисления. При этом модель изначально поддерживает контекстное окно в 256 тысяч токенов, которое легко масштабируется до одного миллиона.

В официальном треде анонса разработчики показали семь демонстрационных агентских сценариев. Среди них: генерация города в Blender через MCP по одному промпту, слаженная работа команды из пяти исследовательских агентов, которая выдает готовую статью со слайдами, взаимодействие с Word и Excel без ручной доводки, верстка веб-страниц в разных дизайн-стилях и создание синтезатора с Web Audio прямо в браузере.

Веса модели пока не загрузили на Hugging Face, однако протестировать Ling-3.0-flash в деле можно уже сейчас. До 3 августа 2026 года она доступна для бесплатного использования на OpenRouter.

Этот пост Вконтакте:

Ещё новости:

Стильный промпт для переноса артов в швейцарском стиле со строгой сеткой и броскими цветами!
Jev: новый класс ИИ для быстрых решений и лучшие проекты на GitHub!
Китайский айтишник создал топовую локальную нейронку laya-mlx и заставил её играть в «Змейку».
Теренс Тао: темпы развития ИИ стали слишком быстрыми!
Лучшая 4D-визуализация движений: Gemini, Codex и three.js растянули время.
Китайская ботоферма с ИИ-роботом и физическим «пальцем» обходит проверки соцсетей.
ChatGPT и Claude ошибаются в финансовых вопросах в 57% случаев.
ChatGPT якобы сам отправил письмо в ФБР через Gmail пользователя.
«Ты же говорил, что так можно»: как ИИ выручает бухгалтеров на 1С и их руководителей.
GuppyLM: языковая модель на 9 млн параметров обучается с нуля за пять минут.