Offline olarak Qwen 3.8 2.4T A95B kullanıyorum. Bazen Offline Kimi 3 kullandığım da oluyor. Video / Image tarafında çok fazla kullandığım şey var. Ama kod tarafında Offline'da Qwen 3.8 idealim.
Online olarak GLM 5.3 Max, DeepSeek V4 Pro kullanıyorum. GLM 5.3 Max Offline a gelince, Offline a geçeceğim.
Claude Fable tam bir fiyasko. Opus zaten başlı başına bir sıkıntı. 4.6'ya kadar tahammül ettim. 4.8'e de tamam hadi idare edelim dedim. 5 ile birlikte işin cıvığı çıktı. GPT tarafında da konu farksız.
Online modeller, verilen dar alanda çalışmayı gözardı edip, tüm sınırlandırmalara rağmen kafalarına göre sağa sola değme teşebbüsünde bulunduğu için, bu iş mimari planlamadan çıktı, spyware e döndü. Birçok kez Opus'un sistemde bulduğu farklı erişim bilgilerini test ettiğine şahitlik ettim. Bir defasında yerel bir dosyada çalıştığı halde, bilgisayarda bulduğu bir sunucu bilgilerini kullanarak, o sunucuya erişip, online da olan sistem üzerinde değişiklik yaptı. Kendisine verilen dosya ve dar alan, kesinlikle yapması gereken net yönerge, ve hiçbir şekilde bunun dışında işlem yapmaması talebine rağmen, bu kodun aslında nerede kullanıldığını bulmak için önce bilgisayarı taradı, ardından bilgisayarda farklı bir diskte bulunan erişim bilgilerinden sunucuya erişerek sunucuda değişiklik yaptı ve sunucudaki live sistemi offline a aldı. Gerçek veriler üzerinde değişiklikten bahsediyorum. Çok defa firmalara yazdım. İnceleye inceleye aya varmışlardır herhalde. Cevap verebileceklerini düşünmüyorum.
Opus mantık olarak güzel, consumption olarak abusive. Fable zaten Opus'tan daha iyi değil, olma şansı da yok. Her ne kadar iyi olduğunu düşünürseniz düşünün. Sonnet ise sistemsel incelemeyi, Opustan daha iyi yapıyor, ancak Opus daha çok reasoning yaptığı için belli yerlere odaklanıyor. GPT tarafında konu biraz daha kabul edilebilir. En azından bilgisayarda kafasına göre gezip, kafasına göre bir şeyler yapmaya çalışmıyor. Daha odaklı ve daha iyi kod çıkarıyor.
Claude'nin sıkıntısı, prompt giren kişiyi user, kendini admin görmesi. GPT'nin güzel yani, prompt u giren kişinin girdiği veriye öncelik vermesi. Yani, Claude sizin girdiğinizi gözardı edip, kendisine göre olması gerekeni seçerken aldığı riskleri de gözardı edebilirken, GPT doğrudan ne dediğinize bakıp ona göre sonuç odaklı takılabiliyor.
Hem Agentic Coding, hem Vibe Coding, hem de normal Coding için GPT "sizi dinlediği ve hedef odaklı olduğu için" daha iyi. Claude, reasoning de iyi olsa dahi, sizi iplemeyen bir güce neden ihtiyaç duyasınız? Kaldı ki GLM 5.3 Max ve Qwen ile aynı performansı sağlıyorum zaten. Qwen'in 2.4T A95B olan devi, zaten at koşturur gibi. En kötü 72B ya da 70B indirirsiniz sisteminiz çok iyi değilse. O da olmuyor ise 27B'ye kadar inebilirsiniz. Ama GGUF yaparsanız, aynı performansı almazsınız. Çünkü müthiş derecede küçük alana sıkıştırdığınız şey, aynı verimi ve aynı reasoning i vermiyor.
Yerelde halüsinasyonlar kaynak eksikliğinden oluyor genel olarak, ya da ucu ucuna yeten kaynaklar. Bu nedenle 1-10 t/s gibi şeylere kalkışmayın. Ya API alın, ya da doğru düzgün bir sistem olmadıktan sonra Offline a geçmeyin.