Autor del tema
#0
PDF dosyaları, içeriklerini paylaşmanın yaygın bir yolu haline geldi. Ancak bazen, bu dosyalardan görselleri çıkarmak gerekebilir. Python, bu işlemi kolaylaştıran birçok kütüphane sunmaktadır. Bu yazıda, PDF dosyalarından görsel çıkarmak için Python kullanarak nasıl etkili bir yol izleyebileceğinizi anlatacağım.
Öncelikle, PDF dosyalarından görsel çıkarmak için kullanabileceğiniz popüler bir kütüphane olan PyMuPDF (fitz) kütüphanesini inceleyelim. Bu kütüphane, PDF dosyalarındaki sayfaları okuma, manipüle etme ve içerik çıkarma gibi işlemleri kolaylıkla yapmanıza olanak tanır.
İlk olarak, PyMuPDF kütüphanesini yüklemeniz gerekiyor. Bunun için terminal veya komut istemcisinde aşağıdaki komutu çalıştırabilirsiniz:
Kurulum tamamlandıktan sonra, aşağıdaki örnek kodu kullanarak PDF dosyasından görselleri çıkarabilirsiniz:
Bu kod, belirtilen PDF dosyasındaki her sayfadaki görselleri tarar ve bulduğu görselleri PNG formatında kaydeder. Her görsel, sayfa numarasına ve görselin sırasına göre adlandırılır.
Sonuç olarak, Python ile PDF dosyalarından görsel çıkarmak oldukça basittir. Bu yöntemi kullanarak farklı PDF dosyalarındaki görselleri hızlı bir şekilde elde edebilirsiniz. Siz de bu süreçte yaşadığınız deneyimleri veya farklı yöntemleri paylaşmak isterseniz, yorumlarınızı bekliyorum!
Öncelikle, PDF dosyalarından görsel çıkarmak için kullanabileceğiniz popüler bir kütüphane olan PyMuPDF (fitz) kütüphanesini inceleyelim. Bu kütüphane, PDF dosyalarındaki sayfaları okuma, manipüle etme ve içerik çıkarma gibi işlemleri kolaylıkla yapmanıza olanak tanır.
İlk olarak, PyMuPDF kütüphanesini yüklemeniz gerekiyor. Bunun için terminal veya komut istemcisinde aşağıdaki komutu çalıştırabilirsiniz:
CODE
1pip install PyMuPDFKurulum tamamlandıktan sonra, aşağıdaki örnek kodu kullanarak PDF dosyasından görselleri çıkarabilirsiniz:
CODE
12345678910111213141516171819202122
import fitz # PyMuPDF kütüphanesini içe aktar
[b]PDF dosyasını aç[/b]
pdf_document = fitz.open("ornek.pdf")
[b]Sayfa döngüsü[/b]
for page_number in range(len(pdf_document)):
page = pdf_document.load_page(page_number) # Sayfayı yükle
image_list = page.get_images(full=True) # Sayfadaki görselleri al
for image_index, img in enumerate(image_list):
xref = img[0] # Görselin referans numarasını al
base_image = pdf_document.extract_image(xref) # Görseli çıkar
image_bytes = base_image["image"] # Görselin byte'larını al
# Görseli kaydet
with open(f"gorsel_{page_number + 1}_{image_index + 1}.png", "wb") as image_file:
image_file.write(image_bytes)
[b]PDF dosyasını kapat[/b]
pdf_document.close()
Bu kod, belirtilen PDF dosyasındaki her sayfadaki görselleri tarar ve bulduğu görselleri PNG formatında kaydeder. Her görsel, sayfa numarasına ve görselin sırasına göre adlandırılır.
Sonuç olarak, Python ile PDF dosyalarından görsel çıkarmak oldukça basittir. Bu yöntemi kullanarak farklı PDF dosyalarındaki görselleri hızlı bir şekilde elde edebilirsiniz. Siz de bu süreçte yaşadığınız deneyimleri veya farklı yöntemleri paylaşmak isterseniz, yorumlarınızı bekliyorum!