Arkaplanda gemini flash 2.5 entegresi mevcut hocam. Context caching ile token tasarrufu sağlamaya çalışıyoruz.
Gayet iyi hocam. Bu alanda rekabet çok fazla bu nedenle müşteri portföyünüzün oluşması zaman alabilir veya planlamada kurduğunuz sınıra hiç ulaşamayabilirsiniz. İşleriniz iyi giderse ve hizmetinize talep çok artarsa bir süre sonra açık kaynaklı modellere geçmek tasarruflu olacaktır, bu benim şahsi görüşüm. Başlangıç veya az/orta müşteri portföyünde LLM apisi kullanmak (şuan kullandığınız gibi) daha mantıklı.