Python ile Toplu Canonical Kontrolü

0 Yanıt 0 Görüntülenme
·
Katılımcılar
Konuyu Açan #1
Giriş
Web sitelerinde SEO açısından önemli unsurlardan biri de sayfa canonical etiketi. Bu etiket, arama motorlarına bir sayfanın tercih edilen versiyonunu belirtmek için kullanılır ve çoğu zaman içerik yinelenmesi sorununu önlemek amacıyla eklenir. Ancak, büyük sitelerde yüzlerce veya binlerce sayfa varsa, her bir sayfa için canonical etiketinin doğru olup olmadığını manuel kontrol etmek zaman alıcı ve hataya açık olur. Bu noktada Python gibi otomasyon araçları devreye girer: toplu kontrol scriptleri yazarak, tüm sayfaları tarayabilir ve canonical etiketiyle ilgili sorunları tespit edebilirsiniz.

Teknik Yaklaşım ve Metodoloji
İlk aşamada, hedef sitenin tüm sayfalarının URL listesini elde etmek gerekir. Bu işlem, site haritası (sitemap.xml) veya site içi tarama (web crawler) ile yapılabilir. Daha sonra, Python kullanarak, her sayfayı HTTP isteğiyle çekip, içeriğinde canonical etiketi olup olmadığını ve doğru URL referansını içerip içermediğini kontrol edebilirsiniz.

Bu işlemi yaparken requests kütüphanesi, HTML içeriğini analiz etmek için de BeautifulSoup kullanmak oldukça pratiktir. İşte temel bir örnek:

KOD
12345678910111213141516171819202122import requests  
from bs4 import BeautifulSoup

def canonical_check(url):  
    response = requests.get(url)  
    if response.status_code != 200:  
        return f"{url} erişilemiyor."  
    soup = BeautifulSoup(response.text, 'html.parser')  
    canonical_tag = soup.find('link', rel='canonical')  
    if canonical_tag and canonical_tag.get('href'):  
        canonical_href = canonical_tag['href']  
        if canonical_href == url:  
            return f"{url} canonical etiketi doğru."  
        else:  
            return f"{url} canonical etiketi yanlış, referans: {canonical_href}"  
    else:  
        return f"{url} canonical etiketi yok."

[b]Kullanım örneği[/b]
urls = ['https://ornek.com/sayfa1', 'https://ornek.com/sayfa2']  
for url in urls:  
    print(canonical_check(url))


Bu temel script, her URL için canonical etiketinin varlığını ve doğruluğunu raporlar. Daha gelişmiş versiyonlarda, sonuçları CSV veya JSON formatında kaydedip, detaylı raporlar oluşturmak da mümkündür.

Sonuç ve Uygulama Alanları
Bu yöntem, büyük sitelerde SEO sağlığı açısından düzenli kontroller yapmak için idealdir. Ayrıca, hatalı veya eksik canonical etiketlerini tespit edip, site güncellemelerini planlamak konusunda faydalıdır. Otomasyon sayesinde zaman ve insan hatası azalır, sitenin arama motorlarındaki görünürlüğü korunur.

Bu teknik, özellikle e-ticaret, içerik platformları ve büyük haber siteleri gibi çok sayfalı sitelerde yaygın şekilde kullanılabilir.

İşte böyle, canonical etiketlerinin toplu kontrolü için temel bir Python yaklaşımı sundum.

Yanıt vermek için giriş yapmış olmalısınız.

Bu konuyu görüntüleyen kullanıcılar (Toplam: 2, Üyeler: 2, Misafirler: 0)
Toplam: 2 (üyeler: 2, misafirler: 0)
0 alıntı seçildi