【发布时间】:2012-11-01 03:15:35
【问题描述】:
我读过的一些问题 http://facebook.stackoverflow.com/questions/1927676/scraping-a-facebook-app-for-data
http://facebook.stackoverflow.com/questions/2028940/access-to-facebook-data
我想创建一个电子表格,其中将包含我在 facebook 游戏中拥有的所有差异项目,即武器盔甲。我认为这将相当容易。我已经创建了一些使用 c++、javascript、php 和较小程度的 python 的经验。我已经能够将项目导入 Excel 电子表格。但它会导入网页上的所有内容。我希望能够为每种类型的项目提供单独的电子表格,并自动更新电子表格。所以我去了谷歌数据API。一个问题是facebook不会让我的谷歌电子表格脚本访问任何它将我重定向到登录页面的东西(或者至少这是我怀疑的,因为当我运行调试时它显示重定向的url)。然后我读到了 javascript 如何在 coss domain.cross domain javascript 中不起作用。和 sience google spript 是基于 java 的,我认为这可能是问题所在。所以我去了 scraperwikihttps://scraperwiki.com/ 并在 php 中创建了一个脚本,认为可以解决问题。现在我应该提到,我已经测试了我是否可以在不登录 facebook 的情况下访问此页面(这意味着我退出了 facebook 并调用了该站点,并且我能够在浏览器中拉出该站点并使用 java shell 来获取我想要的数据然后当我单击另一个需要我登录到 facebook 的链接时,登录屏幕会显示我会单击书签到我想要从中获取数据的页面,我可以看到它并从 javashell 获取数据。 )
那么,在这个长篇大论之后,我的问题是 1. oauth 会解决这个障碍吗?
如果我创建了一个 FB 应用程序,我是否能够获取我想要的数据,然后将其获取到 google 电子表格?
像 Watin https://stackoverflow.com/questions/tagged/watin 这样的方法会更好吗? (我不知道它有什么能力)
【问题讨论】:
-
我在看的另一件事是bookmaklets。如果我可以在打开浏览器时运行脚本,它可以调用我想要获取数据的页面,然后将其导入电子表格。我想我可以让浏览器保持打开状态并让计划任务运行这本小册子。
-
阅读此链接后,小书签似乎可以正常工作 [stackoverflow.com/questions/2128367/…
标签: ruby facebook google-app-engine web-scraping watir