Audio-tldr локально пересказывает видео и подкасты с помощью Whisper.
Мы обратили внимание на проект Audio-tldr. Это инструмент, который локально делает короткий пересказ любого видео или подкаста и не отправляет данные в облако.
Модель Whisper распознаёт речь прямо на компьютере пользователя: аудиодорожка преобразуется в текст, а затем из него формируется сжатая выжимка с ключевыми тезисами.
Проект имеет открытый исходный код и доступен на GitHub.

