robots.txt HTTP 200 Durum Kontrol Scripti

0 Replies 4 Views
·
Participants
Thread Starter #0
[quote]
robots.txt dosyasının erişilebilirliğini düzenli olarak kontrol etmek, web sitesi güvenliği ve SEO açısından kritik öneme sahiptir. Bu noktada, robots.txt dosyasının sunucu tarafından doğru biçimde sunulduğundan emin olmak için otomatik kontrol scriptleri kullanmak oldukça faydalıdır.

İşte temel bir Python script örneği: Bu script, belirli bir URL’deki robots.txt dosyasının HTTP durum kodunu sorgular ve sonucu raporlar. Özellikle, durum kodunun 200 olup olmadığını kontrol ederek, dosyanın erişilebilirliğini denetleyebilirsiniz.

Kod örneği:

CODE
1234567891011121314151617181920
import requests

def check_robots_txt(url):
    if not url.startswith('http'):
        url = 'http://' + url
    robots_url = url.rstrip('/') + '/robots.txt'
    try:
        response = requests.get(robots_url, timeout=10)
        if response.status_code == 200:
            print(f"{robots_url} -> Durum: 200 OK, Dosya erişilebilir.")
        elif response.status_code == 404:
            print(f"{robots_url} -> Durum: 404 Not Found, Dosya bulunamadı.")
        else:
            print(f"{robots_url} -> Durum: {response.status_code}")
    except requests.RequestException as e:
        print(f"Hata oluştu: {e}")

[b]Kullanım örneği[/b]
check_robots_txt('example.com')


Bu script, temel erişim durumu kontrolü sağlar. Daha gelişmiş takipler için, zaman aşımı, erişim hataları ve içerik analizi gibi ek özellikler eklenebilir. Ayrıca, düzenli aralıklarla çalıştırmak veya farklı URL’ler için toplu kontrol yapmak mümkündür.

Sizler de benzer otomasyonlar veya farklı programlama dilleri kullanarak kendi ihtiyaçlarınıza göre uyarlamalar yapabilirsiniz. Bu sayede robots.txt erişilebilirliği konusunda proaktif ve hızlı önlemler alabilirsiniz.

Başka sorular veya geliştirme önerileriniz var mı? Önerilerinizi ve deneyimlerinizi paylaşmanız bu konuyu daha verimli hale getirir.

You must be logged in to reply.

0 quotes selected