Hocam Edge yi bu iş için entegre edebilirsiniz. Google ın konuşmasına göre biraz daha güzel tonlamalara ve konuşmaya sahip. Yapay Zeka TTS alanında bazı çalışmalarım ve programlarım mevcut 10 saniyelik bir sesi klonlayıp insansı bir konuşma çıktısı elde edebiliyor. Ama ücretsiz ve basit bir yöntem açısından Edgeyi deneyebilirsiniz.
hocam sorun şurda "
00:00:21,360 --> 00:00:26,160
tamamlandı. bu başka bir günün hikayesi. Yakında bir
" bu bir str çıktı örenği zaman bazlı transcript vermekte,edge de her ses için ayrı tuşlama yapıp bunu edit uygulamasına aktarıp render almakla uğraşmam lazım"ElevenLabs " dan direk insan sesi de çekebilirdim daha iyi olur fakat PYTHON ile şimdilik test için google apı olmadan ses çıktısı veren %90 otomasyon sistemi deniyorum 0 api 0 para 0 zorluk suz