Вышел VoiceStudio — опенсорсный набор локальных инструментов для работы с голосом. Он умеет клонировать и генерировать голоса, очищать аудио, распознавать речь, автоматически дублировать видео и собирать многоголосые аудиокниги из EPUB и PDF. Все вычисления выполняются на устройстве пользователя — без аккаунтов, подписок, облачных лимитов и передачи данных. VoiceStudio объединяет 16 движков генерации речи и 11 систем распознавания, поддерживает 646 языков и доступен для Windows, Linux и macOS. Найдете легко, можно запускать на сервере без GPU. tg / max