【发布时间】:2012-03-12 15:13:07
【问题描述】:
我一直在尝试获取此处找到的 xml 数据:http://www.thetvdb.com/api/D1BD82E2AE599ADD/mirrors.xml
您会注意到 xml 数据很容易在您的网络浏览器中读取。但是,当我尝试使用 urllib2 加载它时,会出现以下问题。 (基于http://www.doughellmann.com/PyMOTW/urllib2/上的教程):
import urllib2
response = urllib2.urlopen('http://www.thetvdb.com/api/D1BD82E2AE599ADD/mirrors.xml')
print response.read()
输出:
'<?xml version="1.0" encoding="UTF-8" ?>\n<Mirrors>\n <Mirror>\n <id>1</id>\n <mirrorpath>http://thetvdb.com</mirrorpath>\n <typemask>7</typemask>\n </Mirror>\n</Mirrors>\n'
我已经尝试过其他网站(例如:python.org),它似乎可以工作。问题似乎与库无关(我在 urllib、httplib、httplib2 等方面也遇到过同样的问题),而且问题似乎特定于我要获取的站点。
什么给了?
编辑:好吧,好像我对我“应该”看到的内容感到困惑。出于好奇,有人知道“脚本”部分是什么吗?我正在使用谷歌浏览器(稳定版)查看页面。
【问题讨论】:
-
你有输出。那么有什么问题呢?
-
你在说什么错误?输出对我来说看起来很好。
-
你的问题是什么?您的 xml 似乎是有效的,您是否尝试使用 xml 库对其进行解析?
-
@Celada 我是吗?它看起来与在 Web 浏览器中加载页面时显示的数据完全不同。我正在使用此信息更新问题...
-
@CédricJulien 我希望看到我的网络浏览器中出现的确切内容,但也许这是一个愚蠢的假设。不过,为什么整个脚本部分都不见了?