önce şunu not düşeyim verdiğin site node.js / express te kodlanmış
2. si adam herhalde Türkiye'de önde gelen haber sitelerine göre uyarlamış botu

ama şu siteleri bile doğru çekebiliyor >

http://www.nytimes.com/2012/11/22/te...he-turkey.html

http://www.faz.net/aktuell/politik/e...-11968260.html

şu konunu linkini denedim

https://www.r10.net/php/922002-php-uz...-var-mi-3.html

sizin son yazdığınız cevabın içeriğini verdi

demek oluyorki adamlardaki mantık şu

1- metalarda description da geçen part ı tagların arasında aratıyor makalenin geri kalanını buluyor
2- içeriğinde en uzun yazı olan tagın içeriğini haber in gövdesi olarak tanımlıyor
3- h1/h2 tarzı bir şey haber in üstünde yer alan kısa başlığı haber konusu olarak nitelendiriyor veya title/ "og:title" dan da çekiyor olabilir

bunları regexle falan taratıp yapmıyor dom la parse ederek yapıyor

oxford davetiyesi olan atsın

şimdi benim yazdığım cevap seninkinden büyük olduğu için haber gövdesi olarak benimkini görecek