Merhabalar hocam,
Kedi ve kopek seslerinden olusturdugunuz veriyi spektogram yani gorsel olarak cikti alabilir, sonrasinda bu gorselleri ile yapay sinir aginizi egitebilir ve "object detection" yontemi ile vereceginiz ses doyasinin spektogramindaki, egittiginiz veri ile eslesen saniyeleri tespit edebilirsiniz. Bu anlamda ihtiyaciniz olabilecek kaynaklari asagida bulabilirsiniz. Bir sorunuz olursa direk mesaj yoluyla bana ulasabilirsiniz
Ses dosyasindan spektegram ciktisi =
Beginner Guide to Visualizing Audio as a Spectrogram in Python - Dolby.io
Kullanabileceginiz hazir veri=
Audio Cats and Dogs | Kaggle
Object detection =
Object Detection | TensorFlow Hub
Verileri object detection'a hazirlamak icin kullanabileceginiz yazilim=
LabelImg (tzutalin.github.io)