【发布时间】:2016-01-22 01:46:27
【问题描述】:
[python 3.4] 有一个 UTF-8 文件混合了日文和二进制文件。 我尝试使用以下代码读取行:
line = None
linecount = 0
with codecs.open(destfile, 'r', 'utf-8') as fd:
while True:
try:
line = fd.readline()
linecount += 1
except UnicodeDecodeError:
continue
if not line:
break;
print(linecount)
尝试忽略带有二进制代码的行,但它会在带有二进制代码的行处停止。
如何正确读取文件而忽略二进制代码行
【问题讨论】:
-
文件样本将帮助您获得更好的答案。
标签: python unicode utf-8 readline python-unicode