【发布时间】:2020-03-30 01:52:07
【问题描述】:
努力想出一种巧妙的方法来匹配以下所有粗体字词。应该排除所有前导和尾随括号,并且不匹配实际页面 url 之外的任何内容,无论是提供原始的、带有域等的。本质上是一个文本框,人们可以在其中以他们想要的任何有效方式输入 url,我们只想获得实际页面它代表我们的网站。
https://www.example.com/page-words/
http://www.example.com/page-other-words/
www.example.com/页面/另一个页面
更多页面/更多/
example.com/page-more-words/
/文档/
/文字
测试
其他/
【问题讨论】:
-
您使用哪种语言?
-
有 URL 解析器会为你做这件事。取决于您使用的语言,但这里没有必要使用正则表达式。
-
也许:regex101.com/r/h0Cohs/1 在第 2 组中被捕获
-
@MDR - 完美!谢谢!如果您作为答案提交,我可以标记为解决方案吗?我将在 python 中实现它,但我只是在寻找原始的正则表达式,所以我不必只依赖任何 python。
-
@Miles np。完毕。很高兴它有帮助。
标签: regex