Python'un veri analizi ve işleme alanında en güçlü kütüphanelerinden biri olan pandas, Excel dosyalarıyla çalışırken büyük esneklik sağlar. Bu konu, özellikle veri mühendisleri ve analistleri için temel bir beceridir. Pandas ile Excel kullanımı, veri okuma, yazma, filtreleme ve düzenleme gibi işlemleri kolayca yapmanıza olanak tanır. Bu yazıda, pandas ile Excel üzerinde temel ve ileri seviye işlemlere odaklanacağız.
İlk olarak, pandas kütüphanesini yükleyip, Excel dosyalarını içeri aktarabiliriz. Bunun için
read_excel fonksiyonunu kullanıyoruz. Örneğin, bir dosyayı DataFrame'e şu şekilde yükleyebilirsiniz:
123import pandas as pd
df = pd.read_excel('dosya_adi.xlsx', sheet_name='Sayfa1')
Burada, 'sheet_name' parametresi ile belirli bir sayfayı seçebilirsiniz. Ayrıca, Excel dosyası birden çok sayfa içeriyorsa,
ExcelFile sınıfı ile tüm sayfaları listeleyebilirsiniz:
123xls = pd.ExcelFile('dosya_adi.xlsx')
sayfalar = xls.sheet_names
df_1 = xls.parse(sayfalar[0])
Veri çıktıktan sonra, pandas'ın filtreleme, sıralama ve toplama fonksiyonlarıyla veriyi analiz edebilirsiniz. Örneğin, belirli bir sütunda belirli bir değere sahip satırları almak:
1filtered_df = df[df['SutunAdı'] == 'Değer']
Excel'e veri yazmak ise,
to_excel fonksiyonuyla gerçekleşir. Bu fonksiyon, DataFrame'i yeni veya mevcut bir Excel dosyasına kaydeder:
1df.to_excel('yeni_dosya.xlsx', index=False)
İleri seviye kullanımda, çoklu sayfa yazma, biçimlendirme veya biçimsel düzenlemeler için
openpyxl veya
xlsxwriter gibi motorlar kullanılabilir. Bu motorlar, çalışma sayfalarına stil, hücre formatı ve grafik ekleme gibi gelişmiş özellikler sağlar.
Sonuç olarak, pandas ile Excel üzerinde temel işlemlerden, karmaşık raporlama ve biçimlendirmeye kadar pek çok fonksiyonu etkin biçimde kullanmak mümkündür. Bu yetenekler, veri analizi sürecini hızlandırırken, otomasyon ve raporlama kalitesini artırır.