pandas.read_excel()

Функция read_excel() загружает данные из файла Excel (.xlsx, .xls) в DataFrame. Требует установленных пакетов openpyxl (для .xlsx) или xlrd (для .xls).

Совет

Установка зависимостей: pip install openpyxl.

Сигнатура

pandas.read_excel(io, sheet_name=0, header=0, names=None,
                  index_col=None, usecols=None, dtype=None,
                  skiprows=None, nrows=None, na_values=None)

Параметры

  • io — путь к файлу, URL или объект ExcelFile.

  • sheet_name — имя или индекс листа; None — все листы; список — несколько.

  • header — номер строки заголовка.

  • usecols — диапазон столбцов: "A:C" или список индексов.

  • skiprows — сколько строк пропустить сверху.

Возвращаемое значение

DataFrame или dict[str, DataFrame] (при нескольких листах).

Примеры

Пример 1. Базовое чтение

import pandas as pd

df = pd.read_excel("sensors.xlsx")
print(df.head())
   ts  temp  hum
0   0  22.1   55
1   1  22.3   55
2   2  22.5   56

Пример 2. Конкретный лист по имени

import pandas as pd

df = pd.read_excel("data.xlsx", sheet_name="Логи")
print(df.shape)
(120, 4)

Пример 3. Все листы сразу

import pandas as pd

sheets = pd.read_excel("data.xlsx", sheet_name=None)
for name, df in sheets.items():
    print(name, df.shape)
Логи (120, 4)
Настройки (10, 2)

Пример 4. Только столбцы A и C

import pandas as pd

df = pd.read_excel("data.xlsx", usecols="A,C")
print(df.columns.tolist())
['ts', 'hum']

Пример 5. Пропуск шапки и свои имена

import pandas as pd

df = pd.read_excel(
    "data.xlsx",
    skiprows=3,
    header=None,
    names=["ts", "temp", "hum"],
)
print(df.head(2))
   ts  temp  hum
0   0  22.1   55
1   1  22.3   55

См. также

Примечание

Лицензия и источники

Техническое описание функции адаптировано из официальной документации Pandas (https://pandas.pydata.org/docs/), BSD-3-Clause License. Примеры и пояснения — © AlashEd Wiki.