【发布时间】:2016-05-29 21:14:47
【问题描述】:
我使用 R 来解析 html 代码,我想知道最有效的方法来稀疏以下代码:
<script type="text/javascript">
var utag_data = {
environnement : "prod",
device : getDevice(),
displaytype : getDisplay($(window).innerWidth()),
pagename : "adview",
pagetype : "annonce"}</script>
我开始这样做了:
infos = unlist(xpathApply(page,
'//script[@type="text/javascript"]',
xmlValue))
infos=gsub('\n| ','',infos)
infos=gsub("var utag_data = ","",infos)
fromJSON(infos)
上面的代码返回的东西真的很奇怪:
$nvironnemen
[1] "prod"
$evic
NULL
$isplaytyp
NULL
$agenam
[1] "adview" etc.
我想知道如何以非常有效的方式做到这一点:如何直接解析 javascript 中的数据列表? 谢谢。
【问题讨论】:
-
代码正在发挥作用。它没有错。或者你的意思是没有得到
NULL的键设备和显示类型? -
好吧,事实上,我很惊讶在输出中,environnement 被转换为“$nvironnemen”,我认为这是一个错误。你怎么解释这个?
标签: javascript r web-scraping