import os
import time
import psutil
from selenium.webdriver.chrome.options import Options
from selenium import webdriver
from selenium.webdriver.common.by import By
import openpyxl

# 检查是否已经存在浏览器实例,如果存在则不再创建
for proc in psutil.process_iter():
    try:
        if 'chrome' in proc.name() and '--remote-debugging-port=9224' in proc.cmdline():
            options = Options()
            options.add_experimental_option('debuggerAddress', '127.0.0.1:9224')
            break
    except:
        pass
else:
    # 创建浏览器实例
    os.system(r'start chrome --remote-debugging-port=9224 --user-data-dir='D:\评阅用'')
    options = Options()
    options.add_experimental_option('debuggerAddress', '127.0.0.1:9224')

# 在已有的浏览器实例中查找标签页
driver = webdriver.Chrome(options=options)
tabs = driver.window_handles
for tab in tabs:
    driver.switch_to.window(tab)
    if driver.title == '考后核验':
        print('登陆成功')
        break

# 打开Excel表格
wb = openpyxl.load_workbook(r'C:\Users\Administrator\Desktop\考后核验.xlsx')
sheet = wb.active

# 创建照片文件夹
if not os.path.exists(r'C:\Users\Administrator\Desktop\照片'):
    os.mkdir(r'C:\Users\Administrator\Desktop\照片')

# 遍历时间单元K列
time_values = set()  # 用集合存储时间值,去重
for row in sheet.iter_rows(min_row=2, max_row=sheet.max_row, min_col=11, max_col=11):
    for cell in row:
        # 获取时间单元内的数据
        data = cell.value
        if data:
            time_values.add(data)

# 创建子文件夹
for time_value in time_values:
    folder_name = time.strftime('%Y-%m-%d %H-%M-%S', time.strptime(time_value, '%Y-%m-%d %H:%M:%S'))
    folder_path = os.path.join(r'C:\Users\Administrator\Desktop\照片', folder_name)
    if not os.path.exists(folder_path):
        os.mkdir(folder_path)

# 遍历表格内'A'列数据
for row in sheet.iter_rows(min_row=2, max_row=sheet.max_row, min_col=1, max_col=1):
    for cell in row:
        # 获取学号
        student_id = cell.value
        if student_id:
            # 在网页内查找考生信息
            search_input = driver.find_element(By.XPATH, '//input[@placeholder='姓名/考生号']')
            search_input.clear()
            search_input.send_keys(student_id)
            time.sleep(1)  # 等待页面加载完成
            # 点击查询按钮
            search_button = driver.find_element(By.XPATH, '//button[text()='查询']')
            search_button.click()
            time.sleep(1)  # 等待查询结果加载完成

代码解释:

  1. 导入必要的库: 代码首先导入了所需的库,包括 os 用于文件操作,time 用于时间处理,psutil 用于检查进程,selenium 用于浏览器自动化,openpyxl 用于处理Excel文件。
  2. 连接浏览器: 代码检查是否已存在Chrome实例并在调试模式下运行。如果找到,它将连接到该实例;否则,它将启动一个新的Chrome实例。
  3. 打开Excel文件: 代码使用 openpyxl 打开指定的Excel文件并选择活动工作表。
  4. 创建文件夹: 代码在桌面上创建一个名为“照片”的文件夹,用于存储考生照片。
  5. 创建子文件夹: 代码遍历Excel文件中的“K”列,获取每个单元格中的时间值,并使用该时间值作为名称创建子文件夹。
  6. 查找考生信息: 代码遍历Excel文件中的“A”列,获取每个单元格中的学号。然后,它使用Selenium在网页上查找相应的输入框,输入学号,并模拟点击“查询”按钮。

注意: 这段代码只是一个示例,您可能需要根据您的具体需求进行修改。例如,您需要根据实际网页结构修改XPath表达式,以及根据需要添加下载照片等功能。

Python自动化:使用Selenium处理考后核验与照片整理

原文地址: https://www.cveoy.top/t/topic/fIJr 著作权归作者所有。请勿转载和采集!

免费AI点我,无需注册和登录