Здравствуйте, Кварк!!!
Вы писали:
> Скорость лучше регулировать через Sonic или SoundTouch.
конец цитаты.
Спасибо за подсказку библиотек!
Но, как я понимаю, чтобы обработать какое-то аудио, его сперва надо
получить? То есть, модель уже выдаёт речь. но её надо накопить в
буфер, обработать и только потом воспроизвести?
Это ведь даст задержку? А если уменьшать буфер, при больших скоростях
может получиться так, что обработанный фрагмент аудио будет
воспроизведён быстрее, чем будет готов следующий и речь будет как-бы
тормозить.
Или я чего-то не понимаю? Что с задержкой?
Цитата.
> Покажите вашей
> нейросети, как это реализовано в драйвере Silero TTS для NVDA, и
> попросите сделать аналогично.
Конец цитаты.
Принято! Поищу драйвер и попробую отдать агенту для изучения.
Цитата
> Сейчас, судя по всему, модель сама меняет
> скорость, что получается у неё, мягко говоря, отвратительно.
Конец цитаты.
Да, именно так.