Tebrik ederim. O oyunu oynamadım ancak benchmarklarda sıkça kullanılan bir oyun. LLMler bu oyunda çok başarılı değil diye biliyorum. Senin başarın takdir edilmeli! Eğitim için ne kadar süre harcadın? Proje open source mü?
Teşekkür ederim hocam.
Eğitim sürecinde bir problemi yok, graph uzayında olduğu için skorlu edge atamaları yapıyor, cache mekanizması var. LLM modelleri eğitim verisi arttıkça yavaşlar, bu model tam tersine katlanarak hızlanıyor. Hatta başka bir mimari geliştirmiştim, ilk 50k makaleyi 30-40 dakikada yutmuştu. Ama mimaride çok eksik var hocam. Daha open source paylaşmaya falan hazır değil. Deneysel olarak geliştiriyorum sadece vakit buldukça.