• 01-07-2016, 01:37:57
    #28
    Üyeliği durduruldu
    RUZGARBERAT adlı üyeden alıntı: mesajı görüntüle
    Böyle bilimsel ve enstüti diliyle konuşmasak herkes bir şeyler okuyup anlasana hı ?

    - uzun makale iyidir demek doğru olmaz , iyi sıkışır, sıkışırsa patlar demek de doğru olmaz.

    * uzun ve konuyu doğru şekilde anlatan makale iyidir diyelim .
    * makale , içerik , tanıtım uzunluğu anlatımı ifadesi, sektöre ve amaca göre değişkendir.
    * sürekli bir kalıpta / sayıda / formatta yazılan siteler belli bir süre sonra çakılır ( ya benim sitem min 500 kelime ya diyen abiler özellikle )
    * google için heran dengeleri, bilindik teorileri, şehir efsaneleri yıkmak anlık bir güncellemeye bakar

    - saygılar.
    Dediklerin hemen hemen doğru kardeşim. Ancak son maddeye katılmıyorum.

    Dengeleri ve teorileri bir anda yıkamaz maalesef içerik konusunda. Zaten google gerizekalı ve asalak bir sistem. Kısacası dizin sitelerinin otomatik versiyonu. 7/24 botları gezer tarar durur. Başka hiç bir halta yaramazlar.

    Kısacası biz ve sitelerimiz olmasa, Google hiç bir işe yaramaz. Yani bu tabii ki bir anlatım biçimi, 2016 yılında böyle bir şeyin olma ihtimali sıfır

    Son maddene katılmama sebebine gelirsek, arama mantalitesini kullanıcılara, aramalara ve lokasyona göre "yeni yeni" geliştiren Google, bu sistemi programlama ve veri mantığı değişmediği sürece değiştiremez. Ki bu da imkansız. Çünkü bu algoritmalar belirli matematiksel hesaplamalarla yapılır ve sonuç buna göre yansıtılır.

    "Standart matematik teorilerine ve formüllerine göre" ayarladığı algoritmayı, maalesef bizlerde anlayabiliyoruz az çok... Bu yüzden bu sistemin değişmesi imkansız, hatta yakın sürede daha kolay anlaşılabilir bir hâle gelecek.

    Bir önceki postumda da yazdığım gibi, aradaki şeyleri "irdelememizi" istiyor. İrdelenince de Alkadrazın dediği kümeler ve osmanbeyin dediği kaliteli içerikler ortaya çıkıyor...

    Olay budur
  • 01-07-2016, 02:56:00
    #29
    Bilo adlı üyeden alıntı: mesajı görüntüle
    Kesinlikle doğru

    Aslında çok daha yakından incelediğimizde makale uzunlukları ile sıralamalar arasında çokta fazla bir ilişki yok.
    Tablodaki ilk sütun orijinal makalenin "byte" miktarını veriyor.
    Bu rakam aynı anda makaledeki boşluksuz karakter sayısını veriyor (hemen hemen)

    orijinal makale : 1439 - 17381 - 16638... (byte)
    orijinal makale : 1423 - 17255 - 16468... (boşluksuz karakter sayıları)

    Hangi anahtar kelimede denenirse denensin sıralamalar ile ciddi anlamda bir ilişkisi yok (makale uzunluğunun)

    Hatta ve hatta ileri sıralara gittikçe uzun makalelerin daha etkili olduğunu düşünen kişilerin makaleleri ile daha fazla karşılaşılıyor. İçeriğine baktığınızda ise çoğu resmen zırva.

    Türk Dil Kurumu'nun tüm kaynaklarını (kitaplar ve hocalar) kullanabildiğim için uzun zamandır "semantik" ile iç içeyim. Yaptığım en büyük ilerleme;
    - Bir paragrafın kendinden önceki ve sonraki paragrafla
    - Bir kelimenin kendinden 4-5 kelime önceki ve yine 4-5 kelime sonraki kelime ile ciddi anlamda yakından ilişkili olduğu üzerine.

    Uzun süredir bunu formüle dökmeye çalışıyorum. Aslında bir şeyler yakaladım.
    Yakaladığımdan neredeyse kesin eminim çünkü formüle dökebildiğim hangi makaleyi yayınlasam direk spama giriyor... yani 1-2 saat kadar sonra ilk 500 den uçuyor

    Demek ki doğru yoldayım

    Ah keşke daha fazla vakit ayırabilsem... ama öncelikli sorumluluklar alınmış işler verilen sözler yaşamak, tadına varmak zorunda olduğum hayatım vs. vs.

    Sevgiler
    .
    osmanbey adlı üyeden alıntı: mesajı görüntüle
    alkadraz kardeşim senin bahsettiğinle, textlerin sıkıştırılma oranının bir alakası yok.
    mesela bu makaleler uzun oldukları için içlerinde and ve or kelimeleri daha fazla çıkar.
    bu teorinin "içeriğinde daha çok and ve or geçen makaleler daha üstte çıkıyor" dememden bir farkı yok.

    dediğim istatistik olarak doğru ama google and ve or sayarak o makaleleri listelemiyor şüphesiz

    şurada söyledim arkadaşa https://www.r10.net/google-optimizasy...post1071724247

    daha uzun textler daha yüksek sıkıştırma oranı ile sıkıştırılır, daha yüksek oranda sıkıştırıldığından değil, daha kapsamlı, uzun 1200-1500 kelimelik makaleler olduklarından ( bu yüzden doğal linkleri de çok olduğundan, daha çok paylaşıldığından ) ilk sayfalarda çıkıyorlar.

    Uzun makalelerin alakalı alakasız term dağılımlarıyla, ziplenme oranı arasında bir bağ olması mümkün ve mantıklı gözükmüyor. her teoriye mavi boğuncuk dağıtma.
    HighQuality adlı üyeden alıntı: mesajı görüntüle
    @Bilo; @aLKaDraZ; @osmanbey;

    Konudaki diğer mesajımda da söyledim. Ancak bu işten anlayan birinin, gerçek manada açıklama yapması (aLKaDraZ) olayı derinleştirdi.

    Önceki mesajımda söylemiştim ki, veri işlemelerinde tablolardan ve sütunlardan bahsetmiştim örnek olarak. Ve hepsinin belirli arama mantalitesi içerisinde gerçekleştirildiğini vurgulamıştım. Haliyle sıkıştırma olayının aslında hikaye olduğunu, olayın tamamen anlambilim metriklerine dayandığını da söylemiştim.
    https://www.r10.net/1071726892-post13.html
    Mesajımdan kısa kesitler;

    "google zaten anlambilim teknolojisine yönelmiş durumda."

    "hoca ilk dersimizde semantic nedir diye sormuştu."

    "yabancıl anahtarlardan tutun, aradığınız nesnenin sergilenmesine kadar her şey basit programlarda dahi anlam bilim metoduyla çalışmakta."

    "Yazıyla olan anlambilim alakası ise, daha fazla kelime öbeği ve konunun geniş tutulmasından dolayı google uzun yazıları daha çok dikkate alır. Çünkü statik anlamlar birleşerek dinamik bir veri ortaya çıkartır ve google algoritması bunu işleyerek ön sıralara çıkartır."

    Bold olarak işaretlediğim kısımda bahsettiğim olayı çok iyi bir şekilde özetlemiş alkadraz üstat.

    Bu öbeklerin birleşimi ve arama trendlerine göre (Bilo'nun dediği gibi) yeni kelimeler ve kelime türevleri doğurur. Bu doğurganlığa alkadraz'ın vermiş olduğu KÜME kelimesi biçilmiş kaftandır.

    C# ve VTYS (Veri Tabanı Yönetim Sistemi) hakkında yaklaşık 1.5 yıldır çalışıyorum.

    Kesinlikle ahrefs, moz, majestic gibi araçlara ihtiyaç duymadan nokta atışı yapabilmeniz mümkün. Ha bu demek olmuyor ki bu araçları kullanmadan hedeflere ulaşmak değil.

    Bu tarz verilerle (anlambilim) ürettiğiniz içerikler, gerçekten "trend" konumda olabiliyor. Paylaştığınız yazının konusu ne olursa olsun. Google, kullanıcı ve arama bazlı işlemiş olduğu verileri, taradığı sayfalarda görmek istiyor. Bu kesin.

    Bu yüzden, anlam bilim kurgusuyla yazacağınız her yazı daha öne çıkar. Bu kurguyu ise illaki bir programcı olmanız gerekmez kurmak için.

    En basitinden onlarca kelime aracı ve aranma hacmi araçları var.

    Bir konu yazdığınızı düşünün.... Konumuz "katarakt" olsun.

    Katarakt nedir?
    Katarakt ameliyatı
    Katarakt ameliyatı nasıl yapılır?

    V.s gibi konular genel metriklerdir. Google sizden, aradaki kalan başlıkları irdelemenizi istiyor.

    Bu yazdığım örneklerdeki başlıkları ve açıklamaları yazınızda bulundurmanız tabii ki artı puan. 100 üzerinden 65 alır. Bilemedin 70.

    Ama söylemiş olduğum gibi ara terimler (tıp terimleri olsun, ansiklopedik bilgiler olsun, wikipedia destekli bilgiler olsun) tamamlandığında, Alkadrazın söylemiş olduğu KÜME toplanmış oluyor. %100'ünü hesaplamak imkansız, çünkü Google'ın hangi algoritma mantalitesi ile çalıştığını kestirmek zor. Sürekli güncelleniyor ve emin olun onlar bizden daha zeki

    Bu şekilde veriler toplayarak oluşturduğunuz KÜME, yazı içerisinde kelime kalabalığı hissi değil, tam tersine HQC oluşturur. Nickim gibi High Quality Content olarak onlarca yabancıl kaynak bulabilirsiniz. Ama bunlar söylediğim "genel metrikler" üzerinedir.

    Kısacası olay sıkıştırma değil, osmanbey adlı üyenin söylediği gibi kaliteli içeriğin oluşması ve kelime gruplarının alkadrazın dediği gibi KÜME oluşturması ve bir süre sonra daha çok değer kazanması.

    Ben de bildiklerimi elimden geldiğince paylaşırım. Bilgi paylaşınca yok olmaz, çoğalır...
    Merhabalar,

    Öncelikle güzel mesajlarınız için teşekkür ederim

    Burdaki en hassas konu aslında winzip in sıkıştırma algoritmasını bilmekten geçiyor. Ben winzip hangi algoritmayi kullandığını bilmiyorum fakat text sıkıştırıcıları genelikle harf harf ilerleyip her kelimeye bir sayısal rakam veriyorsaki veriyordur.(araştırma sonuçum bu yanlış olabilir.) Bu aynen bizim kullandığımız TF-İDF ( term frequency–inverse document frequency) oranlarını bize winzip in algoritmasıda vermiş oluyor bir nevi. Zaten vermeseydi bilo nun sunduğu caps farklı çıkardı. Ben bu konulara yıllardır kafa çatlatıp program yazıyorum ama adamın birisi çıkıyor (bilo) benim yaptığım işlemi winzip gibi bir programla hemde bedavaya yapıyorsaki yapmış görünüyor ona şapka çıkarmaktan başka birşey yapamam ....

    Osmanbey hocam, Ayrıca benim yaptığım analizlerde (or ,and v.s.) kelimeler yani stopwords kelimeler çıkarılıp yapılıyor. Yani hem fikiriz o konuda. Fakat bilo yapmamış bunu ama aynı sonuçu almış. İş sıkıştırma algoritmasını bilmekten geçiyor kısacası. Yani konuya yazan herkez aslında doğru şeyler yazıyor fakat birisi farklı bir yol deneyip sonuça ulaşırken bilo akıl dışı bir yaklaşımla sonuça ulaşmış gözüküyor.

    Edit...

    Ha belki bu analiz size kelimeleri göstermiyor orası ayrı fakat alakadar bir KÜME olup olmadığınızı size gösterebilir diyorum.

    --R10.NET; Flood Engellendi -->-> Yeni yazılan mesaj 02:56:00 -->-> Daha önceki mesaj 02:35:09 --

    Ayrıca doküman doğrusallaştırma (document linearization) diye bir kavramda var. Yani uzun dökümanların kısa dökümanlara avantaj sağlamasını engelleyen bir sistemdir. Bu işlemlerde arama motorları stopwords gibi kelimeleri elerler köklerine indirirler v.s. Fakat makalede farklı terim(ilişkisi terim, semantik kelimeler) ne kadar çoksa bu dökümanı her halükarda uzun bir döküman haline getirir. Önceki mesajımda söylediğim gibi buda dökümanın daha başarılı olmasını ve daha çok arama ile eşleşmesini sağlar. v.s. v.s. biri winzip in algoritmasını açıklarsa tam olarak olur veya olmaz diyebiliriz. saygı ve sevgiler. Surçi lisan ettiysek afola.