Phyton+openpyxl: сортировка файла без перезаписи

Есть пандас датафрейм, данные из которого выгружаются в ексель. Изначально делал это стандартными df.to_excel(), после того как провел сортировку данных по дате (от свежих к старым. Но это приводило к полной перезаписи файла и терялось все форматирование. Нашел здесь вот такой код

def append_df_to_excel(filename, df, sheet_name='Sheet1', startrow=None,
                   truncate_sheet=False, 
                   **to_excel_kwargs):
"""
Append a DataFrame [df] to existing Excel file [filename]
into [sheet_name] Sheet.
If [filename] doesn't exist, then this function will create it.

Parameters:
  filename : File path or existing ExcelWriter
             (Example: '/path/to/file.xlsx')
  df : dataframe to save to workbook
  sheet_name : Name of sheet which will contain DataFrame.
               (default: 'Sheet1')
  startrow : upper left cell row to dump data frame.
             Per default (startrow=None) calculate the last row
             in the existing DF and write to the next row...
  truncate_sheet : truncate (remove and recreate) [sheet_name]
                   before writing DataFrame to Excel file
  to_excel_kwargs : arguments which will be passed to `DataFrame.to_excel()`
                    [can be dictionary]

Returns: None
"""
from openpyxl import load_workbook

# ignore [engine] parameter if it was passed
if 'engine' in to_excel_kwargs:
    to_excel_kwargs.pop('engine')

writer = pd.ExcelWriter(filename, engine='openpyxl')

try:
    # try to open an existing workbook
    writer.book = load_workbook(filename)

    # get the last row in the existing Excel sheet
    # if it was not specified explicitly
    if startrow is None and sheet_name in writer.book.sheetnames:
        startrow = writer.book[sheet_name].max_row

    # truncate sheet
    if truncate_sheet and sheet_name in writer.book.sheetnames:
        # index of [sheet_name] sheet
        idx = writer.book.sheetnames.index(sheet_name)
        # remove [sheet_name]
        writer.book.remove(writer.book.worksheets[idx])
        # create an empty sheet [sheet_name] using old index
        writer.book.create_sheet(sheet_name, idx)

    # copy existing sheets
    writer.sheets = {ws.title:ws for ws in writer.book.worksheets}
except FileNotFoundError:
    # file does not exist yet, we will create it
    pass

if startrow is None:
    startrow = 0

# write out the new sheet
df.to_excel(writer, sheet_name, startrow=startrow, **to_excel_kwargs)

# save the workbook
writer.save()

Отлично отрабатывает и в файл идет дозапись данных без потери форматирования. И тут возникла проблема. Этот код дописывает строки в конец файла. Получается, что новые записи, требующие обработки, оказываются в самом низу. Я боюсь сотрудники их буду просто терять. Возможно ли как-то модифицировать код или сделать дополнительный код, который отсортирует екселевский файл по столбцу "Дата создания" (или по другому заданному имени) и сохранит данные без потери форматирования? Заранее спасибо.


Ответы (0 шт):