【问题标题】:Goutte / Web Scraping - How to intercept and download a fileGoutte / Web Scraping - 如何拦截和下载文件
【发布时间】:2017-02-23 02:19:43
【问题描述】:

首先,在这里提前感谢您的帮助,非常感谢!

我已成功让 Goutte 进行身份验证、点击 URL、更改选择字段并单击提交按钮。

页面然后重新加载,并在完成加载时将文件下载到客户端。

如何在 Goutte 中截取这个文件?我已经阅读了尽可能多的 doco,但似乎找不到答案。然后我想基本上点击这个文件,遍历它并保存在本地。

根据文件类型,我想遍历它,或者保存在本地。

谢谢:-)

【问题讨论】:

    标签: web-scraping goutte


    【解决方案1】:

    要做到这一点并不容易。在我的情况下,我打开文件所在的 URL(经过身份验证)然后服务器提供文件(作为 Page 的对象),之后您可以获取页面的内容。

    // $url contains the path to the file.
    $session->visit($url);
    $page = $session->getPage();
    $saved = file_put_contents($targetFilePath, $page->getContent());
    

    就我而言,我正在下载 zip 文件。在您的情况下,可能将其保存在临时位置,检测类型然后将其移动到任何所需的目录。 希望这会有所帮助。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2015-08-07
      • 1970-01-01
      • 1970-01-01
      • 2012-01-11
      • 2022-01-19
      相关资源
      最近更新 更多