【发布时间】:2020-10-20 23:43:30
【问题描述】:
在 UTF-8 编码表和 Unicode 字符中,我使用补充私人使用区域,因为我确信它们不会用于任何文本中的单个字符。 事实是现在我需要在文本中找到它们。这是一个基本示例:
\u{f0001} hahrehr \u{f0002} eryteryte \u{f0003}\n yfukguk\u{f0004}\nggikggk
你可以看到 \u{f...} 是我的特殊字符。 如果我们 console.log 这个文本:
console.log("\u{f0001} hahrehr \u{f0002} eryteryte \u{f0003}\n yfukguk\u{f0004}\nggikggk</");
现在我需要一些东西来找到所有这些特殊字符。我想到了一个正则表达式,但我不知道如何处理 \u{f...} 的解释不同这一事实。
我知道我的问题不是很清楚,但我有任何可以帮助我的想法。
【问题讨论】:
-
所以你需要用这种格式捕获所有字符“\u{..}”?
-
我需要全部捕获以替换它们
-
/\udb80\udc01/会找到它,因为它实际上是两个 ucs16 字符。见mathiasbynens.be/notes/javascript-unicode 和mathiasbynens.be/notes/es6-unicode-regex
标签: javascript regex