twinkiey :
я для своего проекта использую лично Google gemini 3.1 flash tts, через Google AI Studio. даются там вполне неплохие лимиты, если мы говорим об уже налаженной работе "запрос -> результат", а не дебаге на этапе написания кода под это дело, там да, лимиты поджимают. но самое главное - бесплатно, к тому же можно сделать ротацию из нескольких аккаунтов гугла, там уж хоть по сто озвучек делайте в день (или несколько часов, не помню, не упирался у себя в такие лимиты). короче говоря потом если нужен особый голос, то можно конвертить через RVC-модельку. запускается локально, нужно только обучить ее сначала под себя, делал это через Kaggle, там линукс конечно мой любимый был, в котором не было половины зависимостей, но дается 30 часов в неделю чистой работы топовой видеокарты, а то и двух. пару часиков и готова RVC-модель. я это короче к чему, такой пайплайн тоже рабочий, если кому интересно, и кто наткнется на мой коммент, то вот постарался поделиться опытом ресерчинга, раз в кой это веке шарю в проблеме
2026-06-01 06:17:02