Leolynn adlı üyeden alıntı: mesajı görüntüle
Astra olduğuna emin gibiyiz, kalitesi epey yüksek. Ölçüm yaptım, model hızı yüksek fakat gelen response tüm hızın içinden geçiyor.

Opencode dönüşü:

OpenCode kaydına göre önceki yanıtımın hızı yaklaşık 98,5 token/sn.
- Üretim: 273 token ÷ 2,771 saniye = 98,52 token/sn
- İlk yazının gelmesini bekleme: 14,4 saniye
- Yanıtın tamamen bitmesi: 17,2 saniye
- Bekleme dahil ortalama: 15,9 token/sn Yani yazmaya başladıktan sonra yaklaşık 100 token/sn; gecikmenin büyük kısmı ilk yazı gelmeden önce.

100 token/sn gayet iyi fakat 15,9 token/sn düşünce bir anlamı kalmıyor. Bu hız ile en ufak şey yapmak çile maalesef. V100 denen dandik kart ile Qwen 3.8 27B çalıştırsak daha hızlı çalışıyor.

bir oyun yaptiricam en üst baremden konusuyorum. 2 milyar token veya 20000 istek cikicak gibim grok 4.6 dan detaylica hesaplattim. 6 astra yada fable 5.1 e ayptiriacm ve bunu burdan almak gerek. siz ne onerirsiniz. astrami fable mi .