fluxions AI vui
Небольшие разговорные модели речи, которые могут запускаться на устройстве
Это опенсорсный конкурент notebooklm
Голосовая модель 100М параметров
Умеет клонировать голос
модели могут издавать различные неречевые звуки. Добавляйте в текст охи-ахи, это должно улучшить результат
Vui.BASE - базовая модель, обученная на 40 тысячах часов аудио-разговоров.
Vui.ABRAHAM - модель одного говорящего, может отвечать с учетом контекста.
Vui.COHOST - диалоговая модель двух собеседников
Попробовать на офсайте - на старте дают 10000 кредитов. По русски ни бельмес к сожалению. Качество речи ужасное. Ах да, это ж мелкие модели для смартфонов
Код
Веса
Демо - здесь будет HF демоспейс
#tts #text2speech #voicecloning #conversation #mobile
>>Click here to continue<<