Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Step-Audio-R1.1 установил новый рекорд SOTA в аудио-рассуждениях.

Модель Step-Audio-R1.1 от StepFun AI установила новый рекорд (SOTA) на лидерборде Artificial Analysis в категории Speech Reasoning.

Модель обошла конкурентов, включая Grok, Gemini и GPT-Realtime, показав точность 96.4%.

Ключевые особенности модели:

  • Native Audio Reasoning (End-to-End) — способность рассуждать непосредственно в аудиоформате без дополнительных преобразований.
  • Audio-native CoT (Chain of Thought) — цепочка рассуждений, изначально спроектированная для работы с аудио.
  • Real-time streaming inference — возможность работы в режиме реального времени, аналогично живому диалогу.
  • FULLY OPEN SOURCE — модель полностью открыта для использования и изучения.

Это достижение указывает на выход аудио-искусственного интеллекта на новый уровень возможностей.

Демо-версия доступна по ссылке: https://modelscope.cn/studios/stepfun-ai/Step-Audio-R1

Страница модели: https://modelscope.cn/models/stepfun-ai/Step-Audio-R1.1

Этот пост Вконтакте:

Ещё новости:

Вышел Skales: полезный ИИ-агент, который запустится даже на слабом ПК.
Эндрю Ын представил open source ИИ-агента OpenWorker.
Авито запустил флешмоб: что пользователи никогда не доверят ИИ?
Любую книгу можно превратить в навык для нейросети: вышел конвертер book-to-skill.
Anthropic научит Claude проектировать процессоры.
Higgsfield выложили 95-минутный ИИ-фильм Hell Grind со всеми промптами.
Cloudflare выдал ИИ-агентам кошельки и читаемые адреса для оплаты API и контента.
Бывший сотрудник Google запустил «AI-бота», который оказался обычным человеком.
Человек с помощью Claude написал Bluetooth-радар для поиска телефона.
Бабушкины сказки от нейросетей: родители бьют тревогу.