【发布时间】:2019-04-12 10:50:32
【问题描述】:
我在文档的 bigquery 中尝试使用 NFKC 的 NORMALIZE 函数,我发现我可以将字符串转换为可读格式。例如
WITH EquivalentNames AS (
SELECT name
FROM UNNEST([
'Jane\u2004Doe',
'\u0026 Hello'
]) AS name
)
SELECT
NORMALIZE(name, NFKC) AS normalized_str
FROM EquivalentNames
GROUP BY 1;
& 字符显示正确,但我有一个表,其中有一列 STRING,其值中包含 unicode 字符,但我无法使用 NORMALIZE 将其转换为可读格式。
我还尝试了其他一些解决方案 Decode Unicode's to Local language in Bigquery 但还没有任何效果。
【问题讨论】:
-
请澄清——你的意思是你的字符串看起来像
'Jane\\u2004Doe',即转义出现在内容中吗?您提供的示例没有这种行为。 -
附上数据图片
标签: google-bigquery unicode-normalization