M_Can adlı üyeden alıntı: mesajı görüntüle
Bilemedim, zaten her yeni modelde çinli modeller en iyileri tokatlıyor tarzında ilerliyor, Benchmarklar güvenilir mi ? bilmediğimden soruyorum
Glm 5.2 gibi modellerden iyidir kesin olarak ancak Fable ve GPT 5.6 gibi modellerden olmadığını net olarak deneyerek gördüm. Şu anda X üzerinde felaket bir hype yapılıyor modele 2 gün sonra unutulacak zaten. Benchmark tarafına gelirsek bu çinli modellerin daha önce de benchmark skorları arttırmak için özel train edildiğini görmüştük o yüzden çok inanmıyorum.