【发布时间】:2012-10-04 11:43:27
【问题描述】:
我有大量包含 PHP、HTML 和 Javascript 文件的嵌套目录,应该全部编码为 UTF-8。但是,有人编辑了几个文件并使用 ISO-8859-1 编码保存了它们。不幸的是,它们都与 UTF-8 文件混在一起。
我想使用iconv 工具将错误编码的文件转换为UTF-8(如here 所述)。问题主要出现在 ISO-8859-1 有效但 UTF-8 无效的字符上。
我认为合适的起点是查找所有包含无效 UTF-8 的文件。有什么好的方法可以做到这一点?
我意识到这不会涵盖所有可能显示错误字符的情况。关于如何解决这个混乱的任何进一步提示?
【问题讨论】:
标签: utf-8 character-encoding iconv