【问题标题】:extracting alphanumeric values following some given text in a sentence在句子中的某些给定文本之后提取字母数字值
【发布时间】:2015-06-15 15:06:19
【问题描述】:

我想在句子中提取一些字母数字值。这些值将在某些给定文本模式之后或之前。我已经尝试过 stanford nlp 的 regexner 工具。但我想使用其他一些工具,如解析的 tokenregex。 情况。要输入的建筑代码是123A。访问代码是456。有很多这样的句子。我想从这样的句子中提取代码值。

【问题讨论】:

  • 对于需要插件、库或工具来做某事的问题,SO 会皱眉头。 SO 旨在帮助您调试您编写的编程代码。
  • 您有任何代码来显示您所做/尝试过的事情吗?您有示例输入/输出吗?

标签: regex stanford-nlp


【解决方案1】:

对此最简单的答案是“查找任意数量的字母,然后查找至少一个(可以更多)数字,然后是任意数量的字母。”

所以你最终会得到类似/\w*\d+\w*/ 的东西。如果您使用的正则表达式引擎不理解\w\d,您也可以尝试使用/[a-z]*[0-9]+[a-z]*/

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2014-11-24
    • 1970-01-01
    • 2018-01-25
    • 2020-02-08
    • 2019-10-14
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多