Python 提取文本数据并保存为字典:从文件中读取 ID 和值
使用 Python 提取文本数据并保存为字典:从文件中读取 ID 和值
假设您有以下格式的数据:
@821 ?? 'Label1' ? RC ?? 'TADDTRANSCRIPTION'---------------
Te&xt
其中 @821 是 ID,Te&xt 是值。如何通过读取 ID 获取对应的值,并将它们保存为字典呢?
使用 Python 的正则表达式模块 re
您可以使用 Python 的正则表达式模块 re 来提取 ID 和值,并将它们保存为字典。以下是示例代码:
import re
data = {}
with open("data.txt", "r") as file:
for line in file:
match = re.search(r'@(\d+)\s+.*?'"(.*?)" \s+\?', line)
if match:
id = match.group(1)
value = match.group(2)
data[id] = value
print(data)
假设数据保存在名为 "data.txt" 的文件中。代码会逐行读取文件内容,使用正则表达式匹配行中的 ID 和值,并将它们保存到字典 data 中。最后,打印出字典 data 的内容。
注意: 上述代码只能提取 ID 和值中的数字和文本部分,特殊字符如 @、'、? 等会被忽略。如果需要保留这些特殊字符,请修改正则表达式的匹配规则。
原文地址: https://www.cveoy.top/t/topic/pl3C 著作权归作者所有。请勿转载和采集!