[B]PDF dosyalarını bölmek veya ayırmak, belge yönetiminde sık karşılaşılan ihtiyaçlardan biridir. Bu işlem, özellikle büyük raporların belirli bölümlerini çıkarmak veya tek tek sayfaları ayrı dosyalara dönüştürmek istendiğinde kullanılır. Python’un sağladığı çeşitli kütüphaneler sayesinde bu işlemi otomatikleştirmek oldukça kolay hale gelir. En yaygın kullanılan kütüphanelerden biri PyPDF2 olup, kullanım açısından hem hafif hem de etkilidir.
PyPDF2 kütüphanesi, PDF dosyalarını okuma, sayfa ayırma ve yeni dosyalar oluşturma işlemlerini basit fonksiyonlar aracılığıyla gerçekleştirir. İlk olarak, bu kütüphaneyi yüklemek gerekir:
Örnek olarak, bir PDF dosyasını sayfa sayfa ayıran temel bir script hazırlayalım:
12345678910111213141516import PyPDF2
def pdf_bol(dosya_yolu, cikis_klasoru):
with open(dosya_yolu, 'rb') as dosya:
pdf = PyPDF2.PdfReader(dosya)
toplam_sayfa = len(pdf.pages)
for sayfa_numarasi in range(toplam_sayfa):
writer = PyPDF2.PdfWriter()
writer.add_page(pdf.pages[sayfa_numarasi])
cikis_dosyasi = f"{cikis_klasoru}/sayfa_{sayfa_numarasi + 1}.pdf"
with open(cikis_dosyasi, 'wb') as cikis:
writer.write(cikis)
print(f"{cikis_dosyasi} kaydedildi.")
[b]Kullanım[/b]
pdf_bol('ornek.pdf', 'ayrilmis_sayfalar')
Bu script, belirtilen PDF dosyasını alır, toplam sayfa sayısını tespit eder ve her sayfayı ayrı bir PDF olarak belirttiğiniz klasöre kaydeder. İsterseniz, belirli sayfa aralıklarını veya bölümlere göre ayırma gibi daha gelişmiş fonksiyonlar da eklenebilir.
PDF bölme işlemi, belge içeriğine göre farklılık gösterebilir; örneğin, bölümlerin veya sayfa gruplarının otomatik tespiti farklı kütüphaneler veya daha gelişmiş algoritmalar gerektirebilir. Bu temel script, başlangıç seviyesinde veya tek sayfalık bölme işlemleri için uygundur. Bu konuda başka hangi özellikleri veya detayları görmek istediğinizi merak ediyorum.