【发布时间】:2014-01-14 07:38:30
【问题描述】:
我有一个 ETL 进程,它定期从 ODBC 数据源中提取代码,对其进行操作,然后将其插入到我的 postgres 数据库中。此数据源中的一列通常包含奇数字符。
在大多数情况下,我可以适当地捕获和转换所有字符,但是我有一个存在于 ODBC 数据源中的字符,不能被带入 postgres(该字符之后的所有文本都被截断),而且我我很难确定这个角色是什么。
我什至不能直接在这篇文章中插入一个字符示例,因为它被删除了:/ 我能得到的最接近的是 textmate 中的字符的屏幕截图(我唯一可以实际看到字符的应用程序):
字符是 1 和 0 之间的菱形。当我的数据进入时,0 之后的所有内容都被截断。
有没有什么好的方法可以识别这个字符是什么,以便我想办法把它去掉?
【问题讨论】:
-
将其保存到文本文件并生成文件的十六进制转储。如果仍然不清楚,请在此处添加。
-
“0 之后的所有内容都被截断”,你的意思是 1 之后吗?
-
@tripleee,是的,对不起,我的意思是在 1 之后。关于十六进制转储的好主意。我会试试看。
-
@triplee,十六进制转储将字符显示为十六进制空值 (00)。这让我能够继续前进。你想回答这个问题,以便我可以给你信用吗?还有,谢谢! :)
-
不,请自行回答,谢谢。
标签: postgresql character-encoding character removing-whitespace