【问题标题】:How many threads do I need for web scraper?网络爬虫需要多少线程?
【发布时间】:2021-03-03 14:23:26
【问题描述】:

我要编写一个使用代理的网络scraper。阅读了有关 std::thread 和 std::async 的信息后,我不确定在通过慢速代理下载内容时内核会做什么。如果线程数量与内核数量相等,或者我可以使用额外的大量线程,它们就不会挂起 RAM,等待轮到它们获得一些 cpu 时间。

如果我应该使用更多的线程然后有 cpu 核心,我如何定义最佳线程数量?

【问题讨论】:

  • ‘Scrapper’的意思是扔掉的人。我想你的意思是“刮板”
  • 好的,感谢您的指正!

标签: multithreading


【解决方案1】:

如何定义最佳线程数?

您可以尝试不断增加线程数,直到您的抓取工具的性能(例如每秒处理多少个网站)停止增长。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2014-02-15
    • 2011-12-11
    相关资源
    最近更新 更多