Python自动化脚本:使用Selenium处理考后核验
Python自动化脚本:使用Selenium处理考后核验
本脚本使用Python和Selenium库,实现自动打开浏览器,读取Excel文件中的考生信息,并在'考后核验'网页中进行查询的功能。
功能:
- 打开指定的Excel表格,路径为'C:\Users\Administrator\Desktop\考后核验.xlsx'。
- 在桌面上创建一个名为'照片'的文件夹。
- 遍历Excel表格时间单元'K'列,并在'照片'文件夹内创建以时间命名的子文件夹,重复的时间只创建一次。
- 遍历Excel表格内'A'列数据,获取学号。
- 在'考后核验'网页中查找考生信息输入框,输入学号并点击'查询'按钮。
代码:
import os
import time
import psutil
from selenium.webdriver.chrome.options import Options
from selenium import webdriver
from selenium.webdriver.common.by import By
import openpyxl
# 检查是否已经存在浏览器实例,如果存在则不再创建
for proc in psutil.process_iter():
try:
if 'chrome' in proc.name() and '--remote-debugging-port=9224' in proc.cmdline():
options = Options()
options.add_experimental_option('debuggerAddress', '127.0.0.1:9224')
break
except:
pass
else:
# 创建浏览器实例
os.system(r'start chrome --remote-debugging-port=9224 --user-data-dir='D:\评阅用'')
options = Options()
options.add_experimental_option('debuggerAddress', '127.0.0.1:9224')
# 在已有的浏览器实例中查找标签页
driver = webdriver.Chrome(options=options)
tabs = driver.window_handles
for tab in tabs:
driver.switch_to.window(tab)
if driver.title == '考后核验':
print('登陆成功')
break
# 打开Excel表格
wb = openpyxl.load_workbook(r'C:\Users\Administrator\Desktop\考后核验.xlsx')
sheet = wb.active
# 创建照片文件夹
if not os.path.exists(r'C:\Users\Administrator\Desktop\照片'):
os.mkdir(r'C:\Users\Administrator\Desktop\照片')
# 存储已创建的文件夹名
created_folders = set()
# 遍历时间单元K列
for row in sheet.iter_rows(min_row=2, max_row=sheet.max_row, min_col=11, max_col=11):
for cell in row:
# 获取时间单元内的数据
data = cell.value
if data:
# 创建子文件夹
folder_name = time.strftime('%Y-%m-%d %H-%M-%S', time.strptime(data, '%Y-%m-%d %H:%M:%S'))
if folder_name not in created_folders:
folder_path = os.path.join(r'C:\Users\Administrator\Desktop\照片', folder_name)
if not os.path.exists(folder_path):
os.mkdir(folder_path)
created_folders.add(folder_name)
# 遍历表格内'A'列数据
for row in sheet.iter_rows(min_row=2, max_row=sheet.max_row, min_col=1, max_col=1):
for cell in row:
# 获取学号
student_id = cell.value
if student_id:
# 在网页内查找考生信息
search_input = driver.find_element(By.XPATH, '//input[@placeholder='姓名/考生号']')
search_input.clear()
search_input.send_keys(student_id)
time.sleep(1) # 等待页面加载完成
search_button = driver.find_element(By.XPATH, '//button[contains(text(), '查询')]')
search_button.click()
time.sleep(1) # 等待查询结果加载完成
# TODO: 处理查询结果并保存照片
注意:
- 使用本脚本前,请确保已安装Python、Selenium和openpyxl库。
- 请根据实际情况修改代码中的文件路径、网页元素XPATH等信息。
- 本脚本仅供学习参考,请勿用于非法用途。
原文地址: https://www.cveoy.top/t/topic/fIKH 著作权归作者所有。请勿转载和采集!