【发布时间】:2016-12-14 06:28:28
【问题描述】:
我正在做一个小脚本,我想收集所有关于标签的“代码:”。
例如:
https://www.instagram.com/explore/tags/%s/?__a=1
下一页将是:
https://www.instagram.com/explore/tags/plebiscito/?__a=1&max_id=end_cursor
但是,我的缺点是让每个 url 都能得到我需要的东西(这是人们的 cmets 和用户名)。 所以当脚本工作时,它并不能满足我的需要。
“obtain_max_id”函数有效,得到以下 end_cursors,但我不知道如何适应它。 感谢您的帮助!
总之,我需要在“connect_main”函数中调整“obtain_max_id”函数,以提取每个 URL 所需的信息。
【问题讨论】:
-
您的问题不清楚。您到底在寻找什么?
-
如何完成整个过程,但是对于每个 URL,当您完成提取数据后,对以下 URL 执行相同操作(instagram.com/explore/tags/plebiscito/… 步骤如下: URL - 提取数据 Next url.. . URL - 提取数据 ....成功@Quirk
-
我更新了我的问题,请查看。 @Quirk