【发布时间】:2019-09-12 01:07:06
【问题描述】:
我正在使用 BeautifulSoup 用 python 抓取一个 Cyrillic 网站,但我遇到了一些麻烦,每个单词都显示如下:
С¡Ð¸Ð»ÑановÑка С°Ð²ÐºÐ¾Ð²Ð° во ази
我还尝试了一些其他西里尔文网站,但它们运行良好。
我的代码是这样的:
from bs4 import BeautifulSoup
import requests
source = requests.get('https://').text
soup = BeautifulSoup(source, 'lxml')
print(soup.prettify())
我应该如何解决它?
【问题讨论】:
标签: python web-scraping beautifulsoup character-encoding cyrillic