何利用python批量统计文件夹下txt文件中的特定关键词词频
可以使用Python的os和re模块来实现批量统计文件夹下txt文件中的特定关键词词频。
以下是一个示例代码,假设要统计文件夹“/myfolder”下所有txt文件中“apple”和“orange”的词频:
import os
import re
# 定义文件夹路径和关键词
folder_path = "/myfolder"
keywords = ["apple", "orange"]
# 遍历文件夹中的所有txt文件
for filename in os.listdir(folder_path):
if filename.endswith(".txt"):
file_path = os.path.join(folder_path, filename)
# 打开文件并读取内容
with open(file_path, "r") as f:
content = f.read()
# 统计关键词出现次数
frequencies = {}
for keyword in keywords:
frequency = len(re.findall(keyword, content, re.IGNORECASE))
frequencies[keyword] = frequency
# 输出结果
print("File:", filename)
for keyword, frequency in frequencies.items():
print(keyword, "appears", frequency, "times")
此代码将遍历文件夹“/myfolder”中的所有txt文件,并统计每个文件中“apple”和“orange”的出现次数。输出结果将显示每个文件的名称以及每个关键词的出现次数。
原文地址: https://www.cveoy.top/t/topic/biXh 著作权归作者所有。请勿转载和采集!