pd dataframe 读取处理 有合并单元格的excel方式
创始人
2024-05-30 03:44:53

from pathlib import Path
import openpyxl

拆分所有的合并单元格,并赋予合并之前的值。

由于openpyxl并没有提供拆分并填充的方法,所以使用该方法进行完成

def unmerge_and_fill_cells(worksheet):
all_merged_cell_ranges = list(
worksheet.merged_cells.ranges
)

for merged_cell_range in all_merged_cell_ranges:merged_cell = merged_cell_range.start_cellworksheet.unmerge_cells(range_string=merged_cell_range.coord)for row_index, col_index in merged_cell_range.cells:cell = worksheet.cell(row=row_index, column=col_index)cell.value = merged_cell.value

读取原始xlsx文件,拆分并填充单元格,然后生成中间临时文件。

def unmerge_cell(filename):
wb = openpyxl.load_workbook(filename)
for sheet_name in wb.sheetnames:
sheet = wb[sheet_name]
unmerge_and_fill_cells(sheet)
filename = filename.replace(“.xls”, “_temp.xls”)
wb.save(filename)
wb.close()

# openpyxl保存之后,再用pandas读取会存在公式无法读取到的情况,使用下面方式就可以了
# 如果你的excel不涉及公式,可以删除下面内容
# 原理为:使用windows打开excel,然后另存为一下
# from win32com.client import Dispatch
# xlApp = Dispatch("Excel.Application")
# xlApp.Visible = False
# xlBook = xlApp.Workbooks.Open(str(Path(".").absolute() / filename))  # 这里必须填绝对路径
# xlBook.Save()
# xlBook.Close()return filename

if name == ‘main’:
unmerge_cell(r"bench.xlsx")

相关内容

热门资讯

分众传媒董事会通过联营公司股份... 中访网数据  分众传媒信息技术股份有限公司于2026年1月22日以通讯表决方式召开了第九届董事会第八...
华泰证券完成董事会换届及高管团...   炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会! 中访网数据  华泰证...
漫步在高椅古村的旧时光里 (来源:劳动午报)转自:劳动午报 或许是年纪渐长,近年逐渐偏爱带古味的村镇。当指尖抚过斑驳的墙垣,我...
“就业、就业、还是就业” 达沃...   刺骨的严寒、紧张的政治局势以及对人工智能的种种质疑,丝毫没有削弱商界领袖在达沃斯论坛上对 “技术...
“文明乡村入镜来”佳作选登   推荐单位 济南市摄影家协会  为深入实施文明乡风建设工程,展现农村精神文明建设新成效,由济南市委...