Python Portal: post #6065 — TG.ME

Большинство голосовых ассистентов работают по очереди — сначала говорите вы, потом отвечает он, и так по кругу.

NVIDIA сделала модель, которая работает иначе, и её уже можно попробовать.

Она называется Nemotron 3 VoiceChat и входит в открытый набор NeMo Speech.

Модель слушает и отвечает в реальном времени в полнодуплексном режиме, поэтому её можно перебить прямо посреди фразы — почти как в обычном разговоре.

Для локального запуска самого фреймворка нужны GPU и CUDA.

Но у модели есть живая демоверсия, которую может открыть и попробовать любой.

https://github.com/NVIDIA-NeMo/Speech

👉 @PythonPortal
👍11❤3
August 23, 2026 3K 2 67