【发布时间】:2014-06-14 18:19:26
【问题描述】:
我正在尝试获得用韩语编写的特定文本。有没有更有效的方法来做到这一点,而不是将其转换为字符串并从那里解析?
代码:
#input: url
#output: name
def urlSC(url):
soup = BeautifulSoup(urllib2.urlopen(url).read())
name = soup.find('span', id = 'lblKName')
输出:
<span id="lblKName">구세군앵커리지한인교회<br>The Salvation Army Anch. Korean Corps.</br></span>
想要: 구세군앵커리지한인교회
【问题讨论】:
-
你不需要 'span' 也不需要
id= 'lblKName'会做同样的工作。 -
@PadraicCunningham:我没看到!谢谢。
标签: python html regex parsing beautifulsoup