【发布时间】:2021-12-16 14:39:38
【问题描述】:
我正在研究一个正则表达式,旨在禁止在 url 中包含某些单词的本地网站。网站的结构是: http|https://mysite.si 可能出现在“.si”之前或之后(在路径中)的禁用词。我这样做是因为我的内容过滤器不太擅长阻止我不希望我的孩子接触到的本地网站。到目前为止,我想出了以下几点:
(?!.*(word1|word2|word3...|wordx))(https|http)://.*[.]si
其中 wordx 表示被禁止的词。虽然我很高兴以上过滤掉了我希望它过滤掉的内容,但我发现性能太慢(单词列表由 400 个单词组成)并且希望有任何提高性能的建议。
【问题讨论】:
-
这是什么语言?
-
这是蟒蛇。编辑了问题以添加该详细信息。正则表达式被输入到接受 python 正则表达式的内容过滤器中。
标签: python regex regex-negation