【发布时间】:2015-10-22 02:43:40
【问题描述】:
我应该编写一个进入网站并获得其标题的代码,所以这是我拥有的代码
import urllib.request
def findTitle(url):
urllib.request.Request(url)
#open url
urllib.request.urlopen(url)
urllib.request.urlopen(url).read().decode('utf-8')
#set same variable equal to the end of <title> tag
endTitlePos = url.find("<title>")
#set variable equal to starting position of <title> tag
startTitlePos = url.find("<title>", endTitlePos)
startTitlePos += len("<title>")
#set new variable equal to </title>
TitleContent=url.find("</title>",startTitlePos)
#return slice of output between the two variables
title = url[startTitlePos:endTitlePos]
content_list=[]
content_list.append(title)
return content_list
def main():
url="https://google.com/search"
print(findTitle(url))
main()
我们以谷歌为例。现在它应该只打印“google”但目前它打印“['//google.com/searc']”我只是好奇我在这里缺少什么,我的意思是它看起来很简单但我不知道为什么它打印url 而不是标题,我如何将它从列表中变成字符串?
【问题讨论】: