Python Excel 拆分工具:根据特定列内容将 Excel 文件拆分为多个工作簿
import os
import openpyxl
import threading
import platform
def split_excel_file(file_path):
# 打开Excel文件
wb = openpyxl.load_workbook(file_path)
sheet = wb.worksheets[0] # 获取第一个工作表
# 获取第二行所有单元格的内容
row2_values = [cell.value for cell in sheet[2]]
# 获取第一列所有单元格的内容
col1_values = [cell.value for cell in sheet['A']]
# 排除A1单元格
col1_values = col1_values[1:]
# 拆分第一列单元格内容到新的工作表
unique_values = set(col1_values)
# 创建线程列表
threads = []
for value in unique_values:
count = col1_values.count(value)
new_sheet_name = f'{value} ({count} 人)'
new_sheet = wb.create_sheet(title=new_sheet_name)
# 在新工作表的第一行插入原工作表A1单元格的内容
new_sheet.insert_rows(1)
for col_num, cell in enumerate(sheet[1], 1):
new_sheet.cell(row=1, column=col_num, value=cell.value)
# 添加第二行单元格内容到新工作表
new_sheet.append(row2_values)
# 添加第一列单元格内容到新工作表
rows = []
for row_num, cell_value in enumerate(col1_values):
if cell_value == value:
rows.append([cell.value for cell in sheet[row_num + 2]])
# 创建线程
t = threading.Thread(target=append_rows, args=(new_sheet, rows))
threads.append(t)
# 合并第一行单元格并居中
num_cols = new_sheet.max_column
new_sheet.merge_cells(start_row=1, start_column=1, end_row=1, end_column=num_cols)
new_sheet.cell(row=1, column=1).alignment = openpyxl.styles.Alignment(horizontal='center', vertical='center')
# 启动所有线程
for t in threads:
t.start()
# 等待所有线程结束
for t in threads:
t.join()
# 删除工作表名字为表头(1)人的工作表
if '表头 (1 人)' in wb.sheetnames:
wb.remove(wb['表头 (1 人)'])
# 删除新工作表中的空行
for sheet in wb.worksheets:
rows = sheet.max_row
cols = sheet.max_column
for row in range(rows, 0, -1):
empty = True
for col in range(1, cols+1):
if sheet.cell(row=row, column=col).value is not None:
empty = False
break
if empty:
sheet.delete_rows(row)
# 保存为新的excel文件
new_file_path = os.path.splitext(file_path)[0] + '_拆分结果.xlsx'
wb.save(new_file_path)
# 获取所有工作表
sheets = wb.sheetnames
# 排除第一个工作表
sheets = sheets[1:]
# 创建拆分结果文件夹
if platform.system() == 'Windows':
desktop_path = os.path.join(os.path.expanduser('~'), 'Desktop')
else:
desktop_path = os.path.join(os.path.expanduser('~'), '桌面')
folder_name = '拆分结果'
folder_path = os.path.join(desktop_path, folder_name)
if not os.path.exists(folder_path):
os.mkdir(folder_path)
# 遍历每个工作表
for sheet_name in sheets:
# 创建新的Excel文件
new_wb = openpyxl.Workbook()
new_sheet = new_wb.active
# 复制工作表内容到新的Excel文件
sheet = wb[sheet_name]
for row in sheet.iter_rows():
for cell in row:
new_sheet[cell.coordinate].value = cell.value
# 保存新的Excel文件
file_name = f'{sheet_name}.xlsx'
file_path = os.path.join(folder_path, file_name)
new_wb.save(file_path)
# 关闭新的Excel文件
new_wb.close()
# 关闭原Excel文件
wb.close()
def append_rows(sheet, rows):
for row in rows:
sheet.append(row)
def main():
file_path = input('请输入需要拆分的Excel文件路径:')
split_excel_file(file_path)
print('拆分完成!!')
if __name__ == '__main__':
main()
这个代码实现了一个 Excel 文件拆分工具,可以根据第一列单元格的内容将单个 Excel 文件拆分为多个包含相同内容的工作簿,每个工作簿对应第一列中唯一的值。它还支持多线程加速处理,并提供用户界面方便操作。
代码的功能:
- 打开 Excel 文件: 使用
openpyxl库打开用户输入的 Excel 文件。 - 获取数据: 获取第一列和第二行所有单元格的内容,并使用
set去重第一列的值。 - 创建新工作表: 遍历第一列中唯一的值,并为每个值创建一个新的工作表。
- 添加数据到新工作表: 将原始工作表的第二行和与当前值对应的第一列数据添加到新工作表中。
- 多线程处理: 使用
threading库创建线程,并使用Thread类为每个新工作表创建线程。 - 保存结果: 将所有新工作表保存到一个新的 Excel 文件中,并创建名为 '拆分结果' 的文件夹存储所有拆分后的 Excel 文件。
- 用户界面: 使用
input()函数让用户输入需要拆分的 Excel 文件路径。
如何使用:
- 确保已安装
openpyxl和threading库。 - 运行代码。
- 在命令行中输入需要拆分的 Excel 文件路径。
- 代码将自动将 Excel 文件拆分为多个工作簿,并保存在名为 '拆分结果' 的文件夹中。
注意:
- 此代码只能根据第一列的内容进行拆分。
- 如果 Excel 文件中包含多个工作表,代码将只处理第一个工作表。
- 确保 Excel 文件中第二行包含列标题。
- 如果需要修改拆分规则,请更改代码中的逻辑。
总结:
这个 Python 脚本是一个实用的 Excel 拆分工具,可以帮助用户快速将单个 Excel 文件拆分为多个工作簿,并支持多线程加速处理,提高效率。
原文地址: https://www.cveoy.top/t/topic/ozDT 著作权归作者所有。请勿转载和采集!