Merhaba, API hizmetini özellikle Codex CLI ile uzun süreli coding-agent görevlerinde kullanmayı düşünüyorum. Satın almadan önce birkaç noktayı netleştirmek istiyorum:
- “GPT-5.6 Sol Ultra” tam olarak hangi model ID’sini kullanıyor? gpt-5.6-sol modeli ve yüksek/maksimum reasoning ayarı mı, yoksa ayrı bir model veya routing sistemi mi?
- Sol Ultra için fiyatlar, sayfadaki GPT-5.6 Sol fiyatlarıyla aynı mı: input $0.15/M, cached $0.015/M ve output $0.90/M?
- 272K context geçildiğinde uygulanan fiyat çarpanı tam olarak nedir? Input, cached input ve output için ayrı ayrı hangi çarpan uygulanıyor?
- 272K sınırı tek bir API isteğinin context büyüklüğüne göre mi, yoksa oturumdaki toplam token kullanımına göre mi hesaplanıyor?
- Codex CLI tarafından yeniden gönderilen repository context gerçekten cached token olarak mı ücretlendiriliyor? Cache hit oranını usage panelinde görebiliyor muyuz?
- Reasoning tokenları output token fiyatından mı hesaplanıyor ve usage panelinde ayrı gösteriliyor mu?
- Bir agent görevi sırasında tool call, reconnection veya retry yapılırsa başarısız/tekrar edilen istekler ücretlendiriliyor mu?
- Model başına rate limit, eşzamanlı istek ve günlük kullanım sınırı var mı?
- Gönderilen source code, prompt ve dosyalar saklanıyor mu? Saklama süresi nedir ve model eğitimi için kullanılıyor mu?
- Model erişimi kaldırılırsa, uzun süreli teknik problem yaşanırsa veya hizmet kapanırsa kalan API bakiyesi için iade garantisi var mı?
- USDT/BEP20 ödemesinde sistemin beklediği net tutara ağ ücreti veya 0,01 USDT kesinti ayrıca eklenmeli mi?
Ayrıca bir kullanıcı yaklaşık 984 milyon tokenın 21,8 USD tuttuğunu belirtmiş. Bu kullanımın input/cached/output dağılımını gösteren detaylı usage raporu mevcut mu? Bu örnek güncel fiyatlandırmayla hâlâ mümkün mü?
Teşekkürler.
1) gpt-5.6-sol model idsini kullanıyor ultra kısmı reasoningle ilgili, model ismi gpt 5.6 sol.
2) evet aynı, sayfada ne yazıyorsa birebir o. güncel olarak %3 mesela.
3) context çarpan olayı şöyle; bu zaten resmi openAI apisinin de uyguladığı bir durum.
context tek istekte 272 bin tokeni aşarsa ki bu her projede kolay kolay olmaz, input 2x, output ise 1.5x olarak fiyatlandırılıyor. tabii ki indirimli fiyat üzerinden belirleniyor bu çarpan.
(
https://developers.openai.com/api/docs/pricing)
4) tek bir istek 272k tokeni aşarsa uygulanıyor.
5) cache hit oranını doğrudan yüzde olarak göremiyorsunuz fakat harcadığınız tokenin ne kadarı input ne kadarı output ve ne kadarı cache read/write bunu görebiliyorsunuz. oran ise standart ve sorunsuz, cachenin sebepsiz yere düşük olması gibi bir durum yok her şey şeffaf.
6) reasoning tokenleri panelde ayrılmıyor, output tokenlerine dahildir.
7) başarısız olan hiçbir istek ücretlendirmez, token verisi şarttır. kopma durumları da yaşanmaz zaten.
8) herhangi bir sınır yok, isterseniz yüklediğiniz miktarı bir günde bitirirsiniz. concurrency limiti ise hesap başına 50 ile sınırlı, 30-50 tane aynı anda agent çalıştırmıyorsanız sorun olmaz.
9) hiçbir şey saklanmıyor, sunucu sadece iletme ve alma görevini yapıyor. kimse öyle bir telemetri işine uğraşmaz zaten. modelleri de biz eğitemeyiz malum model sahibi OpenAI.
10) servis kullanılabilir halde değilse ve kısa vadede herhangi bir gelişme olmazsa mevcut bakiyenizi iade alabilme hakkınız var.
11) otomatik kripto ödemeleri için fee hesaplaması tamamen sizin sorumluluğunuzda, sistemin size verdiği miktar ham miktardır, yani o adrese tam olarak ulaşması gereken miktar. bununla ilgili bir uyarı alıyorsunuz deposit etmeye çalışırken.
ayrıca cache hit göstergesi olayını beğendim, yakında ekleriz. umarım merakını gidermişimdir.