Python pandas не полностью читает xlsx файл
Интересует такая проблема: Требуется открыть файл xlsx для дальнейшей работы с ним. Но при попытке открыть его через модуль pandas, он читает только первую ячейку таблицы.
UserWarning: Workbook contains no default style, apply openpyxl's default
warn("Workbook contains no default style, apply openpyxl's default")
<class 'pandas.core.frame.DataFrame'>
Index: 0 entries
Data columns (total 1 columns):
# Column Non-Null Count Dtype
--- ------ -------------- -----
0 Идентификатор 0 non-null object
dtypes: object(1)
memory usage: 0.0+ bytes
None
Но если открыть файл через Excel и просто пересохранить, то все в порядке и читает уже правильно.
<class 'pandas.core.frame.DataFrame'>
RangeIndex: 32 entries, 0 to 31
Data columns (total 6 columns):
# Column Non-Null Count Dtype
--- ------ -------------- -----
0 Идентификатор 32 non-null int64
1 Дата создания 32 non-null datetime64[ns]
2 Уровень 1 32 non-null object
3 Уровень 2 32 non-null object
4 Уровень 3 32 non-null object
5 Уровень 4 32 non-null object
dtypes: datetime64[ns](1), int64(1), object(4)
memory usage: 3.9+ KB
None
Код программы ниже:
import download, pandas, openpyxl
RAWFILE_NAME = 'rawFile.xlsx'
download.downloadFile(RAWFILE_NAME)
rawxl = pandas.read_excel(RAWFILE_NAME, engine = 'openpyxl')
print(rawxl.info())