İstediğin gibi olmaz çünkü ses kopyalama yetmiyor. Videodaki ses tonlama da yapıyor. Yani çekirdek kütüphane eğitilmeli veya eğitilmişi bulunmalı. Bunun yerine şunu yapmayı denersen daha mantıklı olabilir: Sesi önce mp3 ya da wav formatında indirip texte çevir. Ardından noktalama işaretlerine dikkat ederek gpt vb. ile düzelttir. Tonlama yapabilen bir ai seslendiriciyle bunu seslendir. Mevcut teknolojide en mantıklı yol bence bu şekilde olur.
Çok kibarsınız teşekkür ederim. Dediginizi uygulayacağım ama yine de platform öneriniz olursa ses klonlama için değil de seslendirme için dinlemek isterim. Tekrardan teşekkür ederim size