Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Пять новинок OpenRouter: Mercury 2.5 Preview, Granite 4.2 8B, Ling 3.0 Flash Fin, Wan 3.0 Prime и Hailuo 3 Max.

На OpenRouter за неделю появились пять новых моделей. Коротко рассказываем о каждой; индексы Artificial Analysis новичков можно сравнить с Fable 5.1, Opus 5, Sol, Kimi K3, GLM-5.3 и Qwen3.8-Max.

Mercury 2.5 Preview

Mercury 2.5 Preview от Inception, диффузионная LLM: пишет не по токену, а параллельно блоками, отсюда заявленные 1107 токенов в секунду на обычных GPU (замер OpenRouter скромнее, около 105). Появился режим рассуждений с уровнями, контекст 260 тысяч. По словам Inception, модель прибавила больше 10 баллов к Mercury 2 и держится на уровне GPT 5.6 Luna на низком усилии и Haiku 4.5; индекса Artificial Analysis у неё пока нет, на графике за неё стоит Luna. До 8 сентября скидка 80%: 0,04 $ за млн входных токенов и 0,15 за выходные, дальше 0,20 и 0,75.

Granite 4.2 8B

Granite 4.2 8B от IBM, плотная модель с рассуждениями, обучена с нуля на 15 трлн токенов, контекст 128 тысяч с расширением до 512. Единственная из пятёрки с полной таблицей замеров IBM, но до флагманов ей далеко: индекс интеллекта 19,6 против 57,5 у GLM-5.3-Flash, это модель под дешёвые массовые задачи, а не под агентов. Apache 2.0, веса лежат на HuggingFace, в API 0,10 $ и 0,15 $ за млн.

Ling 3.0 Flash Fin

Ling 3.0 Flash Fin от Ant Group, финансовая версия Ling 3.0 Flash: MoE, 5,1 млрд активных из 124, заточена под инвестиционные задачи с длинным планированием. Бесплатно, контекст 262 тысячи; бенчмарков и весов именно этой версии нет, базовая Ling 3.0 Flash набирает 37,8 индекса.

Две видеомодели

Wan 3.0 Prime от Alibaba, быстрый режим Wan 3.0: текст и первый кадр в видео, от 480p до 1080p, клипы от 2 до 30 секунд со звуковой дорожкой, 0,068 $ за секунду в 480p и 0,28 в 1080p.

Hailuo 3 Max, дообученная вместе с fal.ai версия MiniMax H3: управление первым и последним кадром, 480p и 768p, от 5 до 15 секунд, 0,05 и 0,08 $ за секунду, то есть дешевле самой H3 при 768p. По качеству fal обещает лучшее следование промпту и картинку, независимых замеров пока нет.


Ещё новости:

Стильный промпт для переноса артов в швейцарском стиле со строгой сеткой и броскими цветами!
Jev: новый класс ИИ для быстрых решений и лучшие проекты на GitHub!
Китайский айтишник создал топовую локальную нейронку laya-mlx и заставил её играть в «Змейку».
Теренс Тао: темпы развития ИИ стали слишком быстрыми!
Лучшая 4D-визуализация движений: Gemini, Codex и three.js растянули время.
Китайская ботоферма с ИИ-роботом и физическим «пальцем» обходит проверки соцсетей.
ChatGPT и Claude ошибаются в финансовых вопросах в 57% случаев.
ChatGPT якобы сам отправил письмо в ФБР через Gmail пользователя.
«Ты же говорил, что так можно»: как ИИ выручает бухгалтеров на 1С и их руководителей.
GuppyLM: языковая модель на 9 млн параметров обучается с нуля за пять минут.