【发布时间】:2019-02-13 04:12:35
【问题描述】:
我正在尝试使用 GitHub API 来制作一个有据可查的开源 Java 库列表。为此,我浏览了 GitHub API 文档并制作了这个简单的 curl。
curl -G https://api.github.com/search/repositories?q=language:Java+stars:%3E=500+library+java+in:readme > output1.txt
它的输出是一个巨大的 txt 文件,其中包含有关找到的所有存储库的信息。在此示例中,共有 736 个匹配项。但是,上面命令中的文件非常不可读,所以我决定使用jq 进行一些解析,结果如下:
curl -G https://api.github.com/search/repositories?q=language:Java+stars:%3E=500+library+java+in:readme \
| jq ".items[] | {name, description, language, watchers_count, html_url}" > parsedOutput1.txt
在此之后,我得到了大约 30 个存储库,而不是 736 个结果,这对我的目的来说是不可接受的。
在 GitHub 搜索框中搜索:language:java stars:>=500 java library in:readme 给我同样的 736 个结果。我真的不知道我做错了什么,所以我可以使用帮助。
【问题讨论】:
标签: github pagination github-api jq