Модель весит всего 120 млн параметров и умеет воспроизводить голос по короткому образцу длиной 5–20 секунд.
— Генерирует аудио меньше чем за минуту
— По заявлениям разработчиков, работает значительно быстрее аналогов
— Поддерживает несколько языков, а новые уже готовятся
— Всё запускается локально, без отправки записи голоса на сервер
Мини-студия озвучки прямо в ноутбуке — тут.

