【发布时间】:2012-01-31 01:50:05
【问题描述】:
该页面以 UTF-8 编码,并且使用 python 的 HTMLParser 它运行良好,没有UnicodeDecodeError,但是当我尝试使用 BeautifulSoup 解析它时确实出现错误。
我已经尝试过_*_ 编码:utf-8 _*_,.encode('utf-8') 到处都是,但我仍然收到错误
import urllib
from BeautifulSoup import BeautifulSoup
args=urllib.urlencode({'keywords':'magic'})
doc=urllib.urlopen('http://www.example.com/submit', args)
soup=BeautifulSoup(doc)
stuff = soup.findAll('section',id='banner')
print stuff
Traceback (most recent call last):
File "test.py", line 7, in <module>
print stuff
UnicodeEncodeError: 'ascii' codec can't encode character u'\xed' in position 112: ordinal not in range(128)
【问题讨论】:
标签: python unicode encoding beautifulsoup