如果您想在 Python 3 中输出原始字节,则不应使用 print 函数,因为它用于以默认编码输出文本。相反,您可以使用sys.stdout.buffer.write。
ASCII 是 7 位编码,所以如果你所谓的 ASCII 包含像 b'\x80' 这样的字符,它就不是合法的 ASCII。也许您的数据实际上是使用 iso-8859-1(又名 latin-1)编码的,或者它可能是密切相关的 Windows 变体 cp1252。要正确执行此类操作,您需要确定用于创建数据的实际编码。
如果你想输出"Test\x80Test2\x81" 并让十六进制转储看起来像这样:
00000000 54 65 73 74 80 54 65 73 74 32 81 |Test.Test2.|
你可以的
import sys
s = "Test\x80Test2\x81"
sys.stdout.buffer.write(s.encode('latin1'))
这是可行的,因为 Latin-1 是 Unicode 的一个子集。这是一个快速演示:
import binascii
a = ''.join([chr(i) for i in range(256)])
b = a.encode('latin1')
print(binascii.hexlify(b))
输出
b'000102030405060708090a0b0c0d0e0f101112131415161718191a1b1c1d1e1f202122232425262728292a2b2c2d2e2f303132333435363738393a3b3c3d3e3f404142434445464748494a4b4c4d4e4f505152535455565758595a5b5c5d5e5f606162636465666768696a6b6c6d6e6f707172737475767778797a7b7c7d7e7f808182838485868788898a8b8c8d8e8f909192939495969798999a9b9c9d9e9fa0a1a2a3a4a5a6a7a8a9aaabacadaeafb0b1b2b3b4b5b6b7b8b9babbbcbdbebfc0c1c2c3c4c5c6c7c8c9cacbcccdcecfd0d1d2d3d4d5d6d7d8d9dadbdcdddedfe0e1e2e3e4e5e6e7e8e9eaebecedeeeff0f1f2f3f4f5f6f7f8f9fafbfcfdfeff'
但是,如果您实际上是在处理二进制数据,那么您首先不应该将其存储在文本字符串中,您应该使用bytes,或者可能是bytearray。从我之前的示例中生成 b 字节字符串的合理方法是执行
b = bytes(range(256))
如果你有一个像b"Test\x80Test2\x81" 这样的bytes 对象,你可以使用
将这些字节转储到标准输出
sys.stdout.buffer.write(b"Test\x80Test2\x81")