Google ın algoritması henüz translate ile çevrilen içeriği ayırt edebilecek kadar gelişmiş değil. Ama ben bunun 1 sene kadar süreceğini sonra kolaylıkla yakalayabileceğini düşünüyorum.

Bazı arkadaşların dediği gibi bir sayfayı bilmem kaç dile çevirerek sıralama hesabı yapamaz google. Çevrilen içeriğin geri çevrilip sağlaması yapılarak özgünlük ölçümü yapılabileceğini düşünenler yanlış düşünüyor.

Çünkü çeviri programı zaten çevirirken bir miktar deforme ediyor anlatımı. Siz onu geriye çevirmeye kalktığınızda da bir miktar daha deforme eder. Ayrıca hangi dilden çevrildi meselesi var. Google ın bir türkçe sayfayı ingilizce almanca ispanyolca fransızca italyanca rusça gibi dillere çevirip o dillerdeki indexlerle karşılaştırma imkanı yoktur. Bu işlemler aşırı kaynak tüketimine neden olur. Google milyar sayfa ile uğraşıyor. Bu şekilde her sayfadan 1 ana 15 tane de çeviri indexlemesi lazım karşılaştırma için. İndex yükü 10 kat, karşılaştırma yükü 10 kat artar.

Ama bir yazının filtreden kurtulması için sadece özgün olması yetmez. Translate programları çevirileri yaparken dillerin yapılarının örtüşmemesi nedeniyle deforme ederler. Google da semantik algoritması geliştikçe bu saçma salak çevirilerin anlamsız olduğunu görüp sayfayı direk filtreye alabilir. Bunu yapısal analiz ile yapabilir. Bir metindeki kelimeleri zamir, sıfat, isim, fiil olarak ayırabilir. Ve bunların sıralamalarını matematiksel değerlere ve grafiklere çevirebilir. Belli bir oranın üzerindeki sapmalar yaşandığında (mesela araya bağlaç almadan bir kaç zamir mükerrer defalar yan yana geliyorsa ) yazının yapısal olarak güvenilmez ve Türk dil yapısına uygun olmadığını çıkarabilir.

Ben henüz Türkçe konusunda bu kadar derin ve gelişmiş bir semantik motorun çalıştığına inanmıyorum. İlk belirtileri geliyor ama henüz akıllıca tasarlanmış anlamsız spam sayfaları yakalayamıyor tam olarak. Ama 1 sene içinde translatecileri temizlemeye başlar google.