【发布时间】:2019-07-25 23:27:26
【问题描述】:
我抓取股票数据。我刮了以下内容:
opening price、stock price、volume traded、shares in issue
我抓取的网站也有一些其他可用的衍生数量。通过派生,我的意思是这些可以从上面的数量计算出来。其中包括:
value traded、market cap、price change
虽然后者可以被抓取到我的数据库中,然后稍后再读取,但我也可以编写在请求时动态计算它们的方法。因此,与其将它们写入数据库并稍后读取,我可以只使用像
这样的方法calculate_value_traded()、calculate_market_cap() 和 calculate_price_change()
我的问题是,更有效的方法是什么?在实践中如何确定“更高效”?我知道这可能取决于写入/读取的数据量以及计算的性质,但我想知道如何进行基准测试以提高资源效率并最终降低成本?
我查看的是使用的内存、带宽、I/O 还是什么?我需要衡量什么才能最终选择一个而不是另一个?
【问题讨论】:
-
您正在使用许多不同种类的资源。您可能没有想到并且在这里最重要的是您银行帐户中的美元数量。那种能够以饱和下一个数据的速率为您提供该数据的数据服务和网络管道需要花费 很多 的资金。因此,如果您对此进行了修补并且似乎没有任何区别,那么您就找到了真正的瓶颈。
标签: database performance computer-science processing-efficiency memory-efficient