Sound production tips: post #115 — TG.ME

Сегодня у меня день нейронок 😊

Потестировал некоторые модели для генерации музыки и голоса (TTS) в Pinokio. Если вдруг кто-то не знаком с Pinokio - бегите и устанавливайте его скорее. Это приложение-лаунчер для локального запуска open-source AI-инструментов (без ручной возни с Python, Git, venv, зависимостями и командами в терминале)

Погонял пару часов свободный генератор музыки - убийцу Suno слабый, но зато локальный аналог Suno
- StableDAW.

И все-таки решил, что использовать не буду и снёс 😄
В комментариях вложил несколько примеров его работы.

Оставил Omnivoice и Higgs - очень годные голосовые модели для клонирования голоса и TTS .
Также добавил MMAudio (про которую писал чуть выше) - генератор звука из видео

Также осталась хорошая проверенная E2-f5-tts с вот такими весами - модель для генерации фраз из клона (TTS), но требует ручной настройки (например расстановки ударений)
❤8🔥2👏2
June 17, 2026 1K 19 18