🗣 Supertonic — сверхбыстрая нейросеть для озвучки текста прямо на твоём устройстве
Разработчики из Supertone выпустили open-source движок Supertonic 3 — новое поколение Text-to-Speech (TTS), которому вообще не нужен интернет или мощная видеокарта. Вся генерация происходит локально на процессоре твоего ПК, смартфона или прямо в браузере, обеспечивая абсолютную приватность.
✨ Что умеет:
1️⃣ Космическая скорость: Генерирует речь до 167 раз быстрее реального времени (обработка целой веб-страницы занимает меньше секунды).
2️⃣ Огромная база языков: Третья версия поддерживает 31 язык (включая русский) и содержит сотни готовых голосов с разными эмоциями.
3️⃣ Клонирование голоса (Voice Cloning): Можно загрузить короткую аудиозапись своего голоса, и ИИ мгновенно заговорит твоим тембром на любом из доступных языков.
4️⃣ Умный разбор текста: Нейросеть «из коробки» понимает и правильно озвучивает даты, сокращения, валюту, формулы и аббревиатуры без предварительной подготовки текста.
5️⃣ Для любых платформ: Легко встраивается в проекты на Python, JavaScript/Node.js, C++, Rust, Swift, iOS и Android.
🔥 Бесплатно:
• Модель полностью open-source с открытыми весами (OpenRAIL-M). Её можно скачать и использовать полностью бесплатно и без ограничений.
• В браузере доступно бесплатное веб-демо, где можно тестировать пресеты голосов, менять скорость и скачивать готовые файлы .wav. • Платная подписка (Pro Play Desktop) нужна только в том случае, если вам требуются коммерческие лицензии на предустановленные голоса и облачный софт от разработчиков. Для личного использования и разработки всё бесплатно.
🔗 Попробовать / GitHub: https://github.com/supertone-inc/supertonic
#AI #VoiceAI #TTS #OpenSource #Audio #Prosdprompt