【发布时间】:2018-07-12 12:47:43
【问题描述】:
我正在进行的项目采用 xml 文件和输入流并将它们转换为 pdf 和文本。在单元测试中,我将此生成的文本与具有预期输出的.txt 文件进行比较。
我现在面临的问题是这些 .txt 文件没有以 UTF-8 编码并且在写入时没有保留这些信息(即变音符号)。
我已经阅读了几篇关于持久化和编码.txt 文件的文章。包括correcting the encoding、saving and opening files in Visual Studio with encoding等等。
我想知道是否有 text file format 支持有关编码的元信息,例如 xml 或 html。
我正在寻找的解决方案是:
- 易于适应同一团队中的任何同事
- 它是持久的,不取决于我在编辑器中选择编码
- 不需要任何额外的外来程序
- 可以在不修改或只修改
File类的情况下读取,它是 C# 的输入读取 - 至少支持 UTF-8 编码
【问题讨论】:
-
为什么不同意所有文本文件都是 UTF-8 格式?
-
我认为这与其说是一个协议,不如说是一个配置问题。我看到了其中的可能性,但我认为支持注释的文件可能会更有帮助。
标签: file encoding utf-8 persistence file-type