diff --git a/examples/test_optimized_no_streaming.py b/examples/test_optimized_no_streaming.py index c186f74..cbdce0c 100644 --- a/examples/test_optimized_no_streaming.py +++ b/examples/test_optimized_no_streaming.py @@ -74,11 +74,13 @@ def main(): log_time(start, "Model loaded") # Reference audio setup - ref_audio_path = "../neurona-10sec.wav" + ref_audio_path = "kuklina-1.wav" ref_text = ( - "Обоссышься точно, я короче твои цветы продала, цветы с подоконника, рюкзак, сменку, " - "пару парт, ща еще окна и сторожа еще смотри приедут. А У тебя кстати родители. " - "Перед тобой Тони Старк, только после пту. Стив Джобс, только с контузией. Илон Макс, не Маск. " + "Это брат Кэти, моей одноклассницы. А что у тебя с рукой? И почему ты голая? У него ведь куча наград по " + "боевым искусствам. Кэти рассказывала, правда, Лео? Понимаешь кого ты побила, Лая? " + "Только потрогай эти мышцы... Не знала, что у тебя такой классный котик. Рожденная луной. " + "Лай всегда откопает что-нибудь этакое. Да, жаль только, что занимает почти всё её время. " + "Не понимаю, почему эта рухлядь не может подождать, пока ты проведешь время с сестрой." ) start = time.time() @@ -89,7 +91,7 @@ def main(): log_time(start, "Voice clone prompt created") # Test text - test_text = "Привет всем! Я того всё ебала, что за новый голос тут на обзоре у вилсакома? А? Так он мне понравился. Ганс оф буллщит." + test_text = "Всем привет! Это тестовый текст для озвучки! Стриминг звучит нормально только через несколько секунд." results = [] diff --git a/examples/test_streaming.py b/examples/test_streaming.py index 8e66578..e6364fe 100644 --- a/examples/test_streaming.py +++ b/examples/test_streaming.py @@ -25,9 +25,13 @@ start = log_time(start, "Load Base model") # for real speedup, use vLLM for LM inference (or SGlang probably) # torch.compile doesn't help much for autoregressive generation due to dynamic shapes -ref_audio_path = "ref-audio.wav" +ref_audio_path = "kuklina-1.wav" ref_text = ( - "ref text" + "Это брат Кэти, моей одноклассницы. А что у тебя с рукой? И почему ты голая? У него ведь куча наград по " + "боевым искусствам. Кэти рассказывала, правда, Лео? Понимаешь кого ты побила, Лая? " + "Только потрогай эти мышцы... Не знала, что у тебя такой классный котик. Рожденная луной. " + "Лай всегда откопает что-нибудь этакое. Да, жаль только, что занимает почти всё её время. " + "Не понимаю, почему эта рухлядь не может подождать, пока ты проведешь время с сестрой." ) voice_clone_prompt = clone_model.create_voice_clone_prompt( @@ -37,7 +41,7 @@ voice_clone_prompt = clone_model.create_voice_clone_prompt( start = log_time(start, "Create voice clone prompt") # Test sentence -test_text = "Hello! This is the test text" +test_text = "Всем привет! Это тестовый текст для озвучки! Стриминг звучит нормально только через несколько секунд." # ============== Standard generation ============== print("\n--- Standard generation ---") diff --git a/examples/test_streaming_optimized.py b/examples/test_streaming_optimized.py index b51d43e..e6d056a 100644 --- a/examples/test_streaming_optimized.py +++ b/examples/test_streaming_optimized.py @@ -101,11 +101,13 @@ def main(): log_time(start, "Model loaded") # Reference audio setup - ref_audio_path = "../neurona-10sec.wav" + ref_audio_path = "kuklina-1.wav" ref_text = ( - "Обоссышься точно, я короче твои цветы продала, цветы с подоконника, рюкзак, сменку, " - "пару парт, ща еще окна и сторожа еще смотри приедут. А У тебя кстати родители. " - "Перед тобой Тони Старк, только после пту. Стив Джобс, только с контузией. Илон Макс, не Маск. " + "Это брат Кэти, моей одноклассницы. А что у тебя с рукой? И почему ты голая? У него ведь куча наград по " + "боевым искусствам. Кэти рассказывала, правда, Лео? Понимаешь кого ты побила, Лая? " + "Только потрогай эти мышцы... Не знала, что у тебя такой классный котик. Рожденная луной. " + "Лай всегда откопает что-нибудь этакое. Да, жаль только, что занимает почти всё её время. " + "Не понимаю, почему эта рухлядь не может подождать, пока ты проведешь время с сестрой." ) start = time.time() @@ -116,7 +118,7 @@ def main(): log_time(start, "Voice clone prompt created") # Test text - test_text = "Привет всем! Я того всё ебала, что за новый голос тут на обзоре у вилсакома? А? Так он мне понравился. Ганс оф буллщит." + test_text = "Всем привет! Это тестовый текст для озвучки! Стриминг звучит нормально только через несколько секунд." results = [] diff --git a/kuklina-1.wav b/kuklina-1.wav new file mode 100644 index 0000000..0e62f4b Binary files /dev/null and b/kuklina-1.wav differ diff --git a/neurona-10sec.wav b/neurona-10sec.wav deleted file mode 100644 index 5d68c6f..0000000 Binary files a/neurona-10sec.wav and /dev/null differ