【问题标题】:Is there 'strings' command for utf-8? [closed]utf-8 是否有“字符串”命令? [关闭]
【发布时间】:2013-07-04 12:40:18
【问题描述】:

linux 命令strings 在二进制文件中查找ASCII 字符串。 是否有任何命令行工具可以在二进制文件中显示 UTF-8 字符串?

【问题讨论】:

  • 不,没有。

标签: string bash utf-8


【解决方案1】:

strings 命令支持--encoding 选项。检查man page

但是,我未能使用任何可能的选项值提取 UTF-8 字符串。目前正在搜索他们的邮件列表。如果我找到更多帮助,将更新此内容

【讨论】:

  • UTF-8 字符是可变字节宽度,它不适用于strings 的固定宽度模式匹配性质。
  • 在我的 Debian 9 上,strings -e S 使用 UTF-8。 strings 版本:2.28LANG=de_CH.UTF-8
  • @12431234123412341234123 感谢您的评论!我稍后会测试它,如果我能重现它,我会更新答案
  • "S = single-8-bit-byte characters",您对为什么该选项适用于 UTF-8 有任何参考吗?通过grep -q -n -axv'.*' 管道仍然显示一些垃圾,也通过`iconv -f utf-8 -t utf-8 -c`。
  • 无法理解最后的评论。 UTF-8 在一个字节中编码的字符是代码点 U+0000 到 U+007F。这些与 ASCII-7 的相同范围(0x00 到 0x7f)相同,顺便说一下,它是 ASCII-7 的 all。对于除此之外的任何内容,例如“Ä”,UTF-8 使用两个字节或更多字节(而 ISO/IEC 8859 /“扩展 ASCII”使用 0x80..0xff 的范围对单字节编码集合中的其他字符进行编码) .不存在“用一个字节编码的 UTF-8 字符,比 ASCII 多”。
猜你喜欢
  • 1970-01-01
  • 2016-07-18
  • 2017-10-21
  • 1970-01-01
  • 2016-10-23
  • 2013-08-16
  • 2012-10-23
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多