Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

США возвращаются в открытый ИИ: Inkling, Laguna S 2.1 и Muse Glimmer.

США возвращаются в гонку открытых моделей

После того как Meta* закрыла линейку Llama, сильные позиции на рынке открытых моделей заняли китайские лаборатории: Kimi, Qwen, DeepSeek и GLM. Веса любой из этих моделей можно скачать в разных вариантах. У американских команд оставались только Gemma 4 от Google и Nemotron 3 от Nvidia. Эти модели хорошие, но по бенчмаркам они серьёзно отставали.

Сейчас ситуация меняется быстро: за месяц на открытый рынок вышли два новых американских игрока и вернулся один старый.

Thinking Machines и Inkling

Стартап Thinking Machines, основанный экс-CTO OpenAI Мирой Мурати, 15 июля представил модель Inkling на 975 млрд параметров, а 31 июля добавил Inkling-Small на 276 млрд. Старшая версия сейчас является крупнейшей открытой моделью от американской лаборатории и набирает 41 балл в рейтинге Artificial Analysis, но всё ещё уступает китайским моделям. Младшая версия в четыре раза меньше, однако проигрывает старшей всего один балл.

В прошлом году Thinking Machines запустили платформу Tinker для дообучения открытых моделей. Многие называют её лучшей на рынке, и своя открытая линейка, вероятно, займёт в ней центральное место.

Poolside и Laguna S 2.1

Стартап Poolside представил модель Laguna S 2.1 на 118 млрд параметров. Если для запуска даже младшей Inkling нужны профессиональные GPU, то Laguna S 2.1 помещается в ИИ-компьютеры для энтузиастов, например Nvidia DGX Spark.

Модель также отстаёт от китайских решений, но в Poolside делают упор на «конвейер» обучения, который позволяет выпускать новую версию каждые пять недель. Если такой темп сохранится, компания может наверстать позиции за несколько тренировочных заходов.

Meta* возвращается с Muse Glimmer

Старый игрок на рынке открытых моделей: Meta*. Компания вложила крупные ресурсы в команду суперинтеллекта, и это начало приносить результаты. За последние месяцы вышли графическая Muse Image, видео Muse Video и классическая LLM Muse Spark. Компания сразу попала в группу тех, кто «наступает на пятки OpenAI и Anthropic».

Большую Muse Spark дистиллировали в открытую Muse Glimmer. Это самая интересная модель из подборки для обычного пользователя: её размер составляет всего 30 млрд параметров, поэтому её можно запускать на системах с 18-24 ГБ видеопамяти, правда, в квантованной версии. Речь идёт о топовых, но домашних ПК или Mac.

Зачем открывать модели

Открытость вовсе не благотворительность. У стратегии открытых весов есть несколько выгод. Во-первых, открываются догоняющие: фронтир-модели OpenAI и Anthropic сейчас вне досягаемости, поэтому нужно предлагать то, чего у них нет. Лучший выбор: открытые веса, так как новые Claude и GPT закрыты. Этим путём уже идут китайские компании, теперь к ним добавились конкуренты из США.

Во-вторых, важна политика. Доступ к американским моделям из Китая закрыт, и всегда возможен симметричный ответ. Зависеть от Пекина американские клиенты не хотят, поэтому при появлении сильного местного производителя они перейдут к нему.

Почему это важно

Конкуренция идёт на пользу конечному пользователю. Последние месяцы показали, что фронтир-модели могут оказаться недостаточно надёжными: их могут отозвать решением правительства, как Claude Fable 5 в начале лета. Системы безопасности могут помешать срочной «мирной» задаче: во время взлома Hugging Face западные ИИ отказались отвечать, и защитникам пришлось разворачивать китайскую GLM-5.2.

Даже небольшие открытые модели сейчас прогрессируют очень быстро. Поэтому мы не исключаем, что через 6-12 месяцев многие пользователи придут к схеме, когда в пару к ИИ-подписке будет развернута небольшая локальная модель. Она поможет экономить лимиты, отвечать на зацензуренные вопросы и запускать эксперименты вплоть до дообучения. Чем больше открытых моделей на рынке, тем лучше.

Этот пост Вконтакте:

Ещё новости:

Telegram платит по 100 USDT за лучшие мемы в Твиттере.
Круглосуточные ИИ-сотрудники: Cursor представил Grok Bot!
Anthropic включает Auto Mode по умолчанию в Claude Code: ИИ-проверяющий будет принимать решения без участия человека.
OpenAI открыла защитникам доступ к GPT-5.6-Cyber: модель ищет уязвимости нулевого дня и собирает цепочки эксплойтов.
xAI выпустила Grok 4.6: модель сравнялась с GPT-5.6 Sol и стала экономичнее Opus 5.
DeepSeek V4 Pro 0813 тихо вышел в API: миллион токенов контекста и цены от 0,435 доллара.
ByteDance добавила в OpenRouter Seed 2.0 Code, Seed 2.1 Turbo и видеогенератор Seedance 2.0 Mini.
OpenAI показала Ultrafast для GPT-5.6 Sol: до 750 токенов в секунду.
Google выпустила Gemini 3.7 Flash: модель для агентов и кодинга уже в OpenRouter.
Qwen3-ASR теперь в OpenRouter: распознавание речи на 0,6 и 1,7 млрд параметров.