【发布时间】:2018-03-15 06:48:04
【问题描述】:
我有一份文档,其中包含电子邮件地址和 IP 地址。我需要根据电子邮件地址和 IP 地址拆分文档,以将文件中的每个 IP/电子邮件地址或单词存储在一个数组中。
有没有办法使用 regex/String Tokenizer 来查找电子邮件/IP 地址来执行此操作?我知道如何使用 regex/String Tokenizer 逐行分隔句子中的单词。只是不确定如何查找电子邮件/IP 地址。 因为文件可能包含不应该包含在数组中的@ \ // 等非法字符。
例如我的文档包含:
您可以联系test@test.com,地址是192.168.1.1。
我的数组应该包含:
你
可以
联系
test@test.com
地址
是
192.168.1.1
【问题讨论】:
-
您是否要对字符串进行标记,然后针对每个标记运行正则表达式以查找后续匹配项?我认为这接近您所需要的:regexr.com/3gspa,创建一个将匹配所有基于 RFC 的正则表达式,但我认为这应该有效
-
是的,我想对字符串进行标记。我遇到了一个问题,因为我无法使用 String Tokenizer 来检索令牌,因为 IP 地址和电子邮件地址会因为它们包含的符号而被拆分为单独的令牌。感谢您的帮助!
标签: java regex tokenize stringtokenizer