pandas.read_excel()
Функция read_excel() загружает данные из файла Excel (.xlsx, .xls) в DataFrame. Требует установленных пакетов openpyxl (для .xlsx) или xlrd (для .xls).
Совет
Установка зависимостей: pip install openpyxl.
Сигнатура
pandas.read_excel(io, sheet_name=0, header=0, names=None,
index_col=None, usecols=None, dtype=None,
skiprows=None, nrows=None, na_values=None)
Параметры
io— путь к файлу, URL или объектExcelFile.sheet_name— имя или индекс листа;None— все листы; список — несколько.header— номер строки заголовка.usecols— диапазон столбцов:"A:C"или список индексов.skiprows— сколько строк пропустить сверху.
Возвращаемое значение
DataFrame или dict[str, DataFrame] (при нескольких листах).
Примеры
Пример 1. Базовое чтение
import pandas as pd
df = pd.read_excel("sensors.xlsx")
print(df.head())
ts temp hum
0 0 22.1 55
1 1 22.3 55
2 2 22.5 56
Пример 2. Конкретный лист по имени
import pandas as pd
df = pd.read_excel("data.xlsx", sheet_name="Логи")
print(df.shape)
(120, 4)
Пример 3. Все листы сразу
import pandas as pd
sheets = pd.read_excel("data.xlsx", sheet_name=None)
for name, df in sheets.items():
print(name, df.shape)
Логи (120, 4)
Настройки (10, 2)
Пример 4. Только столбцы A и C
import pandas as pd
df = pd.read_excel("data.xlsx", usecols="A,C")
print(df.columns.tolist())
['ts', 'hum']
Пример 5. Пропуск шапки и свои имена
import pandas as pd
df = pd.read_excel(
"data.xlsx",
skiprows=3,
header=None,
names=["ts", "temp", "hum"],
)
print(df.head(2))
ts temp hum
0 0 22.1 55
1 1 22.3 55
См. также
Примечание
Лицензия и источники
Техническое описание функции адаптировано из официальной документации Pandas (https://pandas.pydata.org/docs/), BSD-3-Clause License. Примеры и пояснения — © AlashEd Wiki.