【发布时间】:2020-08-07 19:36:31
【问题描述】:
我正在尝试使用 div id 在亚马逊上导入卖家评分列表。这是代码:
=importxml("https://www.amazon.com/sp?_encoding=UTF8&marketplaceID=ATVPDKIKX0DER&seller=A2JWZOZUWVCPDC", "//[@id='feedback-content']")
返回#N/A。我确认内容不是由 Javascript 创建的。如有任何指导,我将不胜感激。
编辑
@player0 的解决方案在美国亚马逊上运行良好,但在其他亚马逊市场上,第二列有错误。
在 Amazon CA 上,5 个反馈中只有 3 个出现在错误的行中。
亚马逊英国也有同样的问题。包括卖家回复(“我们发货...”)。它是不需要的,但在第 3 列中会很好。
下图左边是实际结果,右边是预期结果。
B4中的CA公式:
=ARRAYFORMULA(REGEXEXTRACT(QUERY(ARRAY_CONSTRAIN(IMPORTDATA(
"https://www.amazon.ca/sp?_encoding=UTF8&marketplaceID=A2EUQ1WTGCTBG2&seller=A1FLFF2FVHQO18&sshmPath="), 3000, 1),
"where Col1 contains 'a-text-quote' and Col1 matches '.*</span>$'", 0), ">(.*)</"))
B12 中的英国公式:
=ARRAYFORMULA(REGEXEXTRACT(QUERY(ARRAY_CONSTRAIN(IMPORTDATA(
"https://www.amazon.co.uk/sp?_encoding=UTF8&marketplaceID=A1F83G8C2ARO7P&seller=A10B9ILJZU6LK2"), 3000, 1),
"where Col1 contains 'a-text-quote' and Col1 matches '.*</span>$'", 0), ">(.*)</"))
我为 Col1 contains 和 Col1 matches 尝试了其他几个 div 和 id,但总是收到错误。任何额外的帮助将不胜感激。
【问题讨论】:
标签: xpath web-scraping google-sheets google-sheets-formula google-sheets-importxml