最近在WuxiaWorld上看书. 线上看总有些不方便, 不能点词查词. 便想爬下来看. 

 

爬取的过程当中发现符号编码有点问题, 不能够正常显示. 

如下:

 

显示为:

英文符号乱码

正确应该显示的内容是:

英文符号乱码

 

####

查看了一下资料, 应该是因为标点符号的编码出入造成的.

这里的英文符号使用的并非是utf8编码. 

 

尝试几次后. 重新编码可以解决该问题:

增加语句如下:

        # 标点转码
        content = str(chapter_content).encode('iso-8859-1')
        content = chapter_content.decode('utf8')

 

  

相关文章:

  • 2021-12-27
  • 2022-12-23
  • 2021-12-28
  • 2021-12-27
  • 2021-12-19
  • 2022-12-23
  • 2021-12-27
  • 2022-12-23
猜你喜欢
  • 2023-04-06
  • 2021-12-02
  • 2021-12-27
  • 2021-12-27
  • 2022-12-23
  • 2022-12-23
  • 2021-12-06
相关资源
相似解决方案