• 15-08-2026, 01:53:08
    #19
    CrypticaL adlı üyeden alıntı: mesajı görüntüle
    bende 2 pc mevcut ana pc de 48gb ram + 16 gb vram var 5070ti ve R9 9900X yükü dağıtıp işlemci ve ekran kartını aynı anda kullandırtabiliyorum diğer pc ile bağlantı sağlayıp ondaki ekran kartsız i5 13.nesil ve 32 gb ram'i takviye olarak kullandırtabiliyorum lan bağlantısı ile ve OpenClaw'ı o şekilde kullanıyorum zaten ana pc den bağımsız Proxmox sayesinde.
    16GB Vram sayesinde bu kadar hızı alabiliyorsunuz hocam
  • 15-08-2026, 03:09:11
    #20
    yusuf68700 adlı üyeden alıntı: mesajı görüntüle
    16GB Vram sayesinde bu kadar hızı alabiliyorsunuz hocam
    Şüphesiz evet ama MoE ile cpu ya yük bindirip K ve V cache quantization ayarlarını Q8_0 yapınca asıl hız farkı ortaya çıkıyor artı olarak hızlı dikkat seçeneği de fark ettiriyor saniyelik token konusunda bilginiz olsun.
  • 15-08-2026, 03:11:07
    #21
    CrypticaL adlı üyeden alıntı: mesajı görüntüle
    Şüphesiz evet ama MoE ile cpu ya yük bindirip K ve V cache quantization ayarlarını Q8_0 yapınca asıl hız farkı ortaya çıkıyor artı olarak hızlı dikkat seçeneği de fark ettiriyor saniyelik token konusunda bilginiz olsun.
    sorun LLM Studiodaymış doğrudan llama İle çalıştırınca Qwen3.6 35B A3B modelde 40 token hızına çıkabildim fakat Qwen 3.8 de en fazla saniyede 4 token hızını görebildim
  • 15-08-2026, 03:15:19
    #22
    yusuf68700 adlı üyeden alıntı: mesajı görüntüle
    sorun LLM Studiodaymış doğrudan llama İle çalıştırınca Qwen3.6 35B A3B modelde 40 token hızına çıkabildim fakat Qwen 3.8 de en fazla saniyede 4 token hızını görebildim
    Elimde birikmiş işler olduğundan dolayı henüz test edemiyorum 3.8 versiyonunu ama 3.6 da sizin de söylediğiniz gibi hızlar o civarda evet. Yine de 4 token çok az geldi bana unsloth'un GGUF versiyonunu deneme imkanınız var ise öneririm çok daha stabil çalışacaktır Windows da.
  • 15-08-2026, 05:23:39
    #23
    AWS'den EC2 Running On-Demand 4vCPU talep açtım, onaylanırsa kuracağım ilk yapay zeka modeli olacak.
    g6e.xlarge açıp L40S 48 GB üzerinde Qwen3.8-27B test edeceğim.
  • 15-08-2026, 07:31:56
    #24
    Macbook air m4 cihazda kayda değer çalıştırabileceğim bir ai varmı ?
  • 15-08-2026, 09:31:37
    #25
    Biraz erken, bir kaç sene içerisinde VRAM kapasiteleri arttıkça ve modeller optimize oldukça evimizde ki bilgisayarlar ile localde yapay zeka işlerini sansürsüz yapabileceğiz. Şuan stabil bir sistem kurmak epey maliyetli, localde yapay zekaya kod yazdırmak mevcut giriş, orta seviyesi bilgisayarlar ile pek verimli olmuyor.
  • 15-08-2026, 14:03:53
    #26
    yusuf68700 adlı üyeden alıntı: mesajı görüntüle
    Hocam aşağıda ki modeli RTX4060 Ve 64 GB Ram ile kullanıyorum saniyede 20 token hızı alıyorum sansür olmaması sebebi ile inanılmaz iş görüyor bazen zeka olarak GPT 3.5 Turbo ile aynı
    https://huggingface.co/llmfan46/Qwen...d-heretic-GGUF
    Yapay zekalar vram tüketiyor. Normal ram çok birşey ifade etmiyor
  • 15-08-2026, 14:26:36
    #27
    A.AY adlı üyeden alıntı: mesajı görüntüle
    Yapay zekalar vram tüketiyor. Normal ram çok birşey ifade etmiyor
    Gerekli optimizasyonlar ile 40 token e çıktım o modelde