Merhaba,

DeepSeek V4 Flash ve Gemini 2.5 vb. nispeten düşük kalibreli modellerin gösterdikleri kullanılan token ile modern modellerin token çalışma prensipleri çok aynı değiller hocam. Özellikle Çinli modeller bu konuda biraz farklı çalışıyorlar. Standart bir insanın doğru çalışan bir konfigürasyonda asla çıkamayacağı seviyelerde token usage gösteriyorlar. GLM & Kimi gibi modellerin token maliyetlerinin düşük olması sebebiyle çok ucuz sanılması da bu yüzden. Düşük contextte iyi modeller ve iyi sonuçlar veriyorlar fakat context büyüdükçe çok token yakıyorlar bir bakıyorsunuz toplam maliyet Amerikalı modellere yaklaşmış. Command Code önerebilirdim ama bahsetmişsiniz. Bir de şu arkadaş var; Freebuff bedava veriyor. Fena değil gibi. Ayrıca bir de PM iletiyorum. İyi çalışmalar.