• 29-08-2026, 12:51:36
    #10
    Frown adlı üyeden alıntı: mesajı görüntüle
    örnek verebilir misin
    Mesela ben bir borsa takip botu yaptığımı düşünelim. Bot gün boyunca BIST'teki yüzlerce hissenin fiyat, hacim, RSI, MACD, hareketli ortalama, KAP haberleri gibi verilerini topluyor.
    Normalde bunları tek tek incelemek saatler sürer. Ben veriyi Ollama üzerinde çalışan local AI modeline gönderiyorum.
    AI'dan doğrudan "al/sat" demesini istemiyorum. Benim belirlediğim analiz kriterlerini kullanarak veriyi yorumlamasını istiyorum.
  • 29-08-2026, 12:53:27
    #11
    Pos3idon adlı üyeden alıntı: mesajı görüntüle
    Mesela ben bir borsa takip botu yaptığımı düşünelim. Bot gün boyunca BIST'teki yüzlerce hissenin fiyat, hacim, RSI, MACD, hareketli ortalama, KAP haberleri gibi verilerini topluyor.
    Normalde bunları tek tek incelemek saatler sürer. Ben veriyi Ollama üzerinde çalışan local AI modeline gönderiyorum.
    AI'dan doğrudan "al/sat" demesini istemiyorum. Benim belirlediğim analiz kriterlerini kullanarak veriyi yorumlamasını istiyorum.
    peki local ai dogru analiz ettiğini nasıl teyit edebiliyorsun ; nasıl güveniyorsun ; ben local ai hiç güvenmem mesela ; bunun için ek bir dogrulama var mı
  • 29-08-2026, 12:56:08
    #12
    o yüzden son kararı ben veriyorum dedim ya
  • 29-08-2026, 13:28:47
    #13
    Pos3idon adlı üyeden alıntı: mesajı görüntüle
    o yüzden son kararı ben veriyorum dedim ya
    ama sonucta ozet cıkartıyor ; o özet tek tek inceliyor musun mesela
  • 29-08-2026, 14:34:55
    #14
    Gizlilik gerektiren hassas verilerle çalışmıyor veya sansürsüz,kesintisiz yoğun işlemler yapmıyorsan, Claude varken sırf model çalıştırmak için 250-300 bin TL donanıma gömmek tamamen ölü yatırım olur hocam.
  • 29-08-2026, 14:57:02
    #15
    Frown adlı üyeden alıntı: mesajı görüntüle
    Arkadaşlar Ne işler için local ai kullanıyorsunuz ? sistemi toplamak için 250 300 bin bir model içni masraf yapmaya gerek var mı ? claude her şeyi hallediyor. ekstra yardımcı olacak bir local ai gerek var mı ? tecrübeleriniz nedir ?
    2 ya da daha fazla dgx spark kullanarak lokalde deepsek v4 flash son sürümü, qwen 3.8 flash modelini (1x dgx spark bile yeterli), glm 5.3 flash modellerini çalıştırabilirsiniz. Bu modellerin benchmark skorlarına bakarsanız Opus 4.6 ile 4.8 seviyesinde olduklarını görebilirsiniz. Eğer 4'ten fazla dgx spark olursa doğrudan glm 5.3 modelinin kuantize sürümlerini çalıştırabilirsiniz. 1x dgx spark şu anda ikinci elde 300bin TL bandında.
    Öte yandan lokal kullanıcı gpu larında örneğin 1x 3090 da benchmark skorlarında Opus 4.6 seviyesinde olduğu görülen qwen 3.8 27b modelini çalıştırmak ve dflash2 kullanarak saniyede 60 token hızlarına ulaşmak mümkün. Tabi maksimum bağlam uzunluğu 100k ile sınırlı oluyor. Üstelik bu 27b modeli aşırı düşünme modunda çalışırsa vaat ettiği benchmark skorlarına ulaşıyor. Örneğin 4-5k çıktı tokeni vereceği durumlarda 25-30k arası sadece düşünme tokeni harcadığı oluyor.
    27b modeli hariç diğer modellerden bile ileri seviye (Fable, Sol vb.) modellerin performansını beklemek abes olur. Ancak Opus 4.8 civarı performans günlük kullanımda gayet yeterli olacaktır. Şahsen elimde 1 adet dgx spark olsaydı qwen 3.8 flash modelini kullanır, ağır kodlama dışında neredeyse bütün işlerimi ona yaptırırdım; buna ufak tefek kodlama ihtiyaçları da dahil.

    Tabii bu işin bir de resim, ses ve video gibi LLM dışı bir dünyası var; onlar ayrı bir konu.
  • 29-08-2026, 17:11:45
    #16
    zCrawel adlı üyeden alıntı: mesajı görüntüle
    2 ya da daha fazla dgx spark kullanarak lokalde deepsek v4 flash son sürümü, qwen 3.8 flash modelini (1x dgx spark bile yeterli), glm 5.3 flash modellerini çalıştırabilirsiniz. Bu modellerin benchmark skorlarına bakarsanız Opus 4.6 ile 4.8 seviyesinde olduklarını görebilirsiniz. Eğer 4'ten fazla dgx spark olursa doğrudan glm 5.3 modelinin kuantize sürümlerini çalıştırabilirsiniz. 1x dgx spark şu anda ikinci elde 300bin TL bandında.
    Öte yandan lokal kullanıcı gpu larında örneğin 1x 3090 da benchmark skorlarında Opus 4.6 seviyesinde olduğu görülen qwen 3.8 27b modelini çalıştırmak ve dflash2 kullanarak saniyede 60 token hızlarına ulaşmak mümkün. Tabi maksimum bağlam uzunluğu 100k ile sınırlı oluyor. Üstelik bu 27b modeli aşırı düşünme modunda çalışırsa vaat ettiği benchmark skorlarına ulaşıyor. Örneğin 4-5k çıktı tokeni vereceği durumlarda 25-30k arası sadece düşünme tokeni harcadığı oluyor.
    27b modeli hariç diğer modellerden bile ileri seviye (Fable, Sol vb.) modellerin performansını beklemek abes olur. Ancak Opus 4.8 civarı performans günlük kullanımda gayet yeterli olacaktır. Şahsen elimde 1 adet dgx spark olsaydı qwen 3.8 flash modelini kullanır, ağır kodlama dışında neredeyse bütün işlerimi ona yaptırırdım; buna ufak tefek kodlama ihtiyaçları da dahil.

    Tabii bu işin bir de resim, ses ve video gibi LLM dışı bir dünyası var; onlar ayrı bir konu.
    çok teşekkür ederim