可以使用Python的os和re模块来实现批量统计文件夹下txt文件中的特定关键词词频。

以下是一个示例代码,假设要统计文件夹“/myfolder”下所有txt文件中“apple”和“orange”的词频:

import os
import re

# 定义文件夹路径和关键词
folder_path = "/myfolder"
keywords = ["apple", "orange"]

# 遍历文件夹中的所有txt文件
for filename in os.listdir(folder_path):
    if filename.endswith(".txt"):
        file_path = os.path.join(folder_path, filename)
        
        # 打开文件并读取内容
        with open(file_path, "r") as f:
            content = f.read()
            
            # 统计关键词出现次数
            frequencies = {}
            for keyword in keywords:
                frequency = len(re.findall(keyword, content, re.IGNORECASE))
                frequencies[keyword] = frequency
                
            # 输出结果
            print("File:", filename)
            for keyword, frequency in frequencies.items():
                print(keyword, "appears", frequency, "times")

此代码将遍历文件夹“/myfolder”中的所有txt文件,并统计每个文件中“apple”和“orange”的出现次数。输出结果将显示每个文件的名称以及每个关键词的出现次数。

何利用python批量统计文件夹下txt文件中的特定关键词词频

原文地址: https://www.cveoy.top/t/topic/biXh 著作权归作者所有。请勿转载和采集!

免费AI点我,无需注册和登录