Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Atria Dawn Preview: агентная модель Shanghai AI Lab на 744B параметрах.

Мы изучили агентную модель Atria Dawn Preview от Shanghai AI Lab. Модель предназначена для исследований и инженерии, базируется на GLM-5.2 с 744 млрд параметров (MoE) и превращает открытую задачу в исполняемый и воспроизводимый результат: анализ, план, код, эксперимент, разбор ошибок и повтор.

Ключевые режимы

  • Discovery: глубокий ресёрч и поиск по источникам.
  • Creation: разработка софта, игр, визуализаций и ML-систем.
  • Delivery: отчеты, презентации и структурированные продукты из документов.
  • Cybersecurity: анализ уязвимостей и фиксы в авторизованных средах.

Характеристики

  • 744 млрд параметров.
  • Контекст 256K токенов.
  • BFCL v4 77.0, DeepSearchQA 96.0: лидирует среди конкурентов.
  • Есть FP8-версия.
  • Работает только с текстом, изображения на вход не принимает.

Интеграции и доступ

Модель встраивается в Codex, Claude Code и Kimi Code через API. Собственный API доступен в двух регионах: международном и Китае. Лицензия MIT.

Код и веса опубликованы на GitHub и Hugging Face.

Этот пост Вконтакте:

Ещё новости:

Стильный промпт для переноса артов в швейцарском стиле со строгой сеткой и броскими цветами!
Jev: новый класс ИИ для быстрых решений и лучшие проекты на GitHub!
Китайский айтишник создал топовую локальную нейронку laya-mlx и заставил её играть в «Змейку».
Теренс Тао: темпы развития ИИ стали слишком быстрыми!
Лучшая 4D-визуализация движений: Gemini, Codex и three.js растянули время.
Китайская ботоферма с ИИ-роботом и физическим «пальцем» обходит проверки соцсетей.
ChatGPT и Claude ошибаются в финансовых вопросах в 57% случаев.
ChatGPT якобы сам отправил письмо в ФБР через Gmail пользователя.
«Ты же говорил, что так можно»: как ИИ выручает бухгалтеров на 1С и их руководителей.
GuppyLM: языковая модель на 9 млн параметров обучается с нуля за пять минут.