Nnets [Neural Networks] — старейший в России культовый ИИ-журнал о нейросетях, искусственном интеллекте и роботах.

Ежедневные новости и аналитика нейромира.

Авторские материалы, исследования, обзоры и подборки.

Будущее уже здесь!

Новости по тегу Музыка и аудио

image
Музыка и аудио [Тег]

Искусственный интеллект и нейросети улучшают качество аудио, убирают шум, восстанавливают записи и усиливают голосовые дорожки, делая звук чистым и естественным. Они также применяются для синтеза голоса, озвучки, генерации музыки и звуковых эффектов, создавая аудиоконтент по тексту и ускоряя работу звукорежиссёров, композиторов и подкастеров.

MiniMax-H3 доступен в ComfyUI с первого дня: 2K-видео со звуком на RTX 3060.
Обладатель «Грэмми» подал в суд за кражу музыкального ИИ.
VibeVoice-ASR-BitNet: лёгкая модель распознавания речи от Microsoft для работы на CPU.
Microsoft представила сразу две ИИ-модели: MAI Image 2.5 Pro и MAI Voice 2 Flash.
Alibaba Cloud представила ASR-модель Qwen-Audio-3.0-ASR-Flash с точным распознаванием терминов.
MiniMax H3: открытые веса и 2K-видеогенерация возвращаются.
Нейросеть Яндекса научилась генерировать прогулочные маршруты и озвучивать их: в Картах появились сотни маршрутов с аудиогидами.
Google выпустила Lyria 3.5: качество музыки на высоте, но русский язык пока не покорился.
Микрофильм «The Last Battle» создан с помощью Midjourney, Banana, Seedance 2 и Suno.
OpenAI выпустила GPT Transcribe для расшифровки аудио. Насколько она хороша для русского языка?