该 Python3 代码可以自动提取视频文件的信息,并生成包含文件名、文件路径、大小、时长、分辨率、码率等信息的 Excel 表格。代码使用 mediainfo 工具获取视频信息,并利用 openpyxl 库将信息写入 Excel 文件。

代码功能:

  1. 支持多种视频格式:'.mp4', '.avi', '.mkv', '.wmv', '.mov', '.flv', '.m2ts', '.ts', '.rm', '.rmvb', '.vob', '.3gp', '.webm', '.hdmov', '.mp4v', '.mpv4', '.divx', '.xvid', '.f4v', '.mpeg', '.asf', '.asx', '.m2t'。
  2. 自动遍历指定文件夹,提取所有视频文件信息。
  3. 获取视频文件大小、时长、分辨率、码率、帧率、音频码率、音频采样率、音频语言等信息。
  4. 计算压缩比率。
  5. 生成 Excel 文件,并设置表格样式。
  6. 记录处理失败的文件,并保存到 'err.txt' 文件中。

代码示例:

import os
import re
import subprocess
import openpyxl
import math
from openpyxl.styles import Font, PatternFill, Alignment

# 视频格式
supported_formats = [
    '.mp4',
    '.avi',
    '.mkv',
    '.wmv',
    '.mov',
    '.flv',
    '.m2ts',
    '.ts',
    '.rm',
    '.rmvb',
    '.vob',
    '.3gp',
    '.webm',
    '.hdmov',
    '.mp4v',
    '.mpv4',
    '.divx',
    '.xvid',
    '.f4v',
    '.mpeg',
    '.asf',
    '.asx',
    '.m2t',
]

# 输出Excel路径
excel_folder = '.'

# 输出Excel文件名
excel_file = 'video_info.xlsx'

# 正则表达式匹配码率数据中的空格
pattern = re.compile(r'(\d+)\s+(\d+)')

# 创建Excel文件
wb = openpyxl.Workbook()
ws = wb.active
ws.title = 'Video Info'

# 锁定表头
ws.freeze_panes = 'A2'

# 设置表头样式
header_font = Font(bold=True, color='800080')  # 紫色
header_fill = PatternFill('solid', fgColor='C5E0B4')
header_alignment = Alignment(horizontal='center', vertical='center')
headers = [
    '文件名',
    '文件路径',
    '格式',
    '大小',
    '时长',
    '分辨率',
    '码率',
    '帧率',
    '音频码率',
    '音频采样率',
    '音频语言',
    '压缩比率',
    '文件总数',
]
for col, header in enumerate(headers, start=1):
    cell = ws.cell(row=1, column=col, value=header)
    cell.font = header_font
    cell.fill = header_fill
    cell.alignment = header_alignment

# 处理失败文件个数
failed_count = 0

# 总计处理文件数
total_count = 0

# 遍历所有视频文件
success_count = 0
row = 2  # 从第二行开始写入数据

def process_video(video_file):
    global success_count, row, failed_count
    try:
        # 获取文件名
        file_name = os.path.basename(video_file)

        # 获取文件大小并进行单位换算
        size = os.path.getsize(video_file)
        if size < 1024:
            size_str = f'{size} B'
        elif size < 1024 * 1024:
            size_str = f'{size / 1024:.2f} KiB'
        elif size < 1024 * 1024 * 1024:
            size_str = f'{size / 1024 / 1024:.2f} MiB'
        else:
            size_str = f'{size / 1024 / 1024 / 1024:.2f} GiB'

        # 使用mediainfo获取视频信息 / 音频信息
        video_result = subprocess.run(
            [
                'mediainfo',
                '--Inform=Video;%Format%|%Width%x%Height%|%BitRate/String%|%FrameRate%|%Duration/String3%',
                video_file,
            ],
            stdout=subprocess.PIPE,
        )
        video_output = video_result.stdout.decode().strip()
        audio_result = subprocess.run(
            [
                'mediainfo',
                '--Inform=Audio;%BitRate/String%|%SamplingRate/String%|%Language/String%',
                video_file,
            ],
            stdout=subprocess.PIPE,
        )
        audio_output = audio_result.stdout.decode().strip()

        # 解析输出结果
        video_info = video_output.split('|')
        audio_info = audio_output.split('|')

        # 处理多音轨情况
        audio_bitrate = []
        audio_sampling_rate = []
        audio_lang = []
        for i in range(len(audio_info) // 3):
            audio_bitrate.append(audio_info[i * 3])
            audio_sampling_rate.append(audio_info[i * 3 + 1])
            audio_lang.append(audio_info[i * 3 + 2])

        # 时长取整
        duration = video_info[4].split('.')[0]
        h, m, s = duration.split(':')
        duration = f'{h}:{m}:{str(s).zfill(2)}'

        # 以分钟计算的时长 2
        duration_minutes = int(h) * 60 + int(m) + math.ceil(float(s)) / 60

        # 计算压缩比率
        ratio = round(duration_minutes / size * 1000000000, 2)

        # 使用正则表达式替换码率数据中第一个数字和第二个数字之间的空格
        bitrate = re.sub(pattern, r'\1\2', video_info[2])

        # 写入Excel文件
        ws.cell(row=row, column=1, value=file_name)
        ws.cell(row=row, column=2, value=os.path.dirname(video_file))  # 写入文件路径
        ws.cell(row=row, column=3, value=video_info[0])
        ws.cell(row=row, column=4, value=size_str)
        ws.cell(row=row, column=5, value=duration)
        ws.cell(row=row, column=6, value=video_info[1])
        ws.cell(row=row, column=7, value=bitrate)
        ws.cell(row=row, column=8, value=video_info[3])
        ws.cell(row=row, column=9, value=' / '.join(audio_bitrate))
        ws.cell(row=row, column=10, value=' / '.join(audio_sampling_rate))
        ws.cell(row=row, column=11, value=' / '.join(audio_lang))
        ws.cell(row=row, column=12, value=ratio)
        ws.cell(row=2, column=13, value=total_count) # 写入文件总数
        # 打印进度
        success_count += 1
        row += 1

    except Exception as e:
        # 处理失败,跳过并打印文件名和具体错误信息
        failed_count += 1
        print(f'处理文件 {video_file} 时失败:{e}')
        # 将失败的文件写入到err.txt
        with open('err.txt', 'a') as f:
            f.write(f'{video_file}\n')
        return False

    return True

def process_folder(video_folder):
    global total_count
    # 获取视频文件列表(包括子目录)
    video_files = []
    for root, dirs, files in os.walk(video_folder):
        for file in files:
            for format in supported_formats:
                if file.endswith(format):
                    video_files.append(os.path.join(root, file))
                    break
    total_count = len(video_files)
    if total_count == 0:
        print('无视频文件或路径为空')
    else:
        for i, video_file in enumerate(video_files, start=1):
            if process_video(video_file):
                print(f'已处理 {success_count}/{total_count} 共计', end='\r')
            else:
                print(f'处理文件 {i}/{total_count} 时失败', end='\r')
        print(f'已处理 {success_count}/{total_count} 共计')

# 文件路径
path = input('请输入文件路径:')
if os.path.isfile(path):
    # 1个文件 total_count += 1
    total_count = 1 
    process_video(path)
elif os.path.isdir(path):
    process_folder(path) 

if total_count > 0:
    # 设置对齐
    l_col = ws['L']
    for cell in l_col:
        cell.alignment = Alignment(horizontal='left')
    m_col = ws['M']
    for cell in m_col:
        cell.alignment = Alignment(horizontal='center')

    # 设置total_count项字体加粗
    total_count_cell = ws.cell(row=2, column=13)
    total_count_cell.font = Font(bold=True, color='FF0000')

    # 不固定列宽
    for col in ws.columns:
        col_letter = col[0].column_letter
        if col_letter not in ['C', 'H']:  
            ws.column_dimensions[col_letter].width = 11

    # 保存Excel文件
    if not os.path.exists(excel_folder):
        os.makedirs(excel_folder)
    excel_file_path = os.path.join(excel_folder, excel_file)
    wb.save(excel_file_path)

    # 打印处理失败文件个数和总计处理文件数
    print(
        f'已完成,处理成功 {success_count} 个文件,处理失败 {failed_count} 个文件,视频信息已保存到 {excel_file_path}'
    )

使用方法:

  1. 安装必要的库:pip install openpyxl mediainfo
  2. 将代码保存为 Python 文件(例如,video_info.py)。
  3. 运行代码,输入要处理的视频文件路径或文件夹路径。
  4. 代码将自动提取视频信息并生成 Excel 文件,保存在当前目录下的 video_info.xlsx 文件中。

注意事项:

  • 确保系统中已安装 mediainfo 工具。
  • 代码仅支持提取视频文件的信息,不支持其他类型的文件。
  • 代码中使用了正则表达式,可根据实际情况进行调整。

代码分析:

  1. 导入必要的库:os, re, subprocess, openpyxl, math, openpyxl.styles
  2. 定义支持的视频格式列表 supported_formats
  3. 定义输出 Excel 文件的路径 excel_folder 和文件名 excel_file
  4. 定义正则表达式 pattern 用于匹配码率数据中的空格。
  5. 创建 Excel 工作簿 wb 和工作表 ws,设置工作表名称为 Video Info
  6. 锁定表头 ws.freeze_panes = 'A2'
  7. 设置表头样式:字体、填充颜色、对齐方式。
  8. 定义表头 headers
  9. 遍历表头,将表头信息写入 Excel 文件的第一行。
  10. 定义处理失败文件个数 failed_count 和总计处理文件数 total_count
  11. 定义全局变量 success_countrow 用于记录处理成功的文件数和写入数据的行数。
  12. 定义函数 process_video 用于处理单个视频文件。
  13. process_video 函数中,获取文件名、文件大小、时长、分辨率、码率、帧率、音频码率、音频采样率、音频语言等信息。
  14. 计算压缩比率。
  15. 将获取的信息写入 Excel 文件对应行。
  16. 定义函数 process_folder 用于处理整个文件夹。
  17. process_folder 函数中,遍历文件夹,获取所有视频文件列表。
  18. 遍历所有视频文件,调用 process_video 函数处理每个文件。
  19. 设置 Excel 文件的格式,保存文件。
  20. 打印处理结果。

该代码提供了一个自动提取视频信息并生成 Excel 表格的框架,您可以根据自己的需求进行修改和扩展。

Python3 视频信息提取代码解析:自动生成视频数据 Excel 表格

原文地址: http://www.cveoy.top/t/topic/mGnV 著作权归作者所有。请勿转载和采集!

免费AI点我,无需注册和登录