【发布时间】:2021-12-07 15:27:04
【问题描述】:
import re
splitRegex = r"(Personal Info|Personal|Personal Information)|(Work Experience|Work)|(Education|School|Certificates)"
text = "Personal Info\nText\nText\nText\nText\nWork Experience\nText\nText\nText\nText\nEducation\nText\nText\nText\nText\nText"
x = [tuple(i.splitlines()) for i in re.split(splitRegex, text) if i != ""]
d = dict([("".join(x[i]), x[i + 1]) for i in range(0, len(x) // 2, 2)])
print(d)
在上面的示例代码中,我想根据标题拆分文本。我想通过正则表达式确定这些标题(因为可以有同义词)re.split 但通常返回 NoneType。这显然会导致错误。如果我添加一个 if 条件来检查我是否不是 None,那么错误就会消失,但字典最终会丢失很多数据。
有没有人知道解决这个问题的方法或实现相同目标的方法?
请记住,以上只是一个示例。我需要将其用于简历/简历,因此布局和标题可能会根据使用的简历略有不同。
【问题讨论】: