【发布时间】:2019-08-01 08:04:12
【问题描述】:
我正在 Google Cloud Kubernates 服务上部署我的集群。它已经有几个节点。此外,我需要来自 Google Cloud 的带有 GPU 的服务器才能使其与我的集群一起使用。 GPU 实例持续处理传入的流量(带宽应高达 1Gb/s)并将结果发送到集群节点(带宽应大于传入带宽)。
项目中对我来说最关键的事情:
1) 集群内这些节点之间的带宽;
2)节点与GPU服务器之间的带宽;
3) GPU 服务器与世界之间的带宽;
4) 节点与世界之间的带宽。
下载和上传时,每个节点的最小适当带宽为 1 Gb/s。当我进行速度测试时,它显示同一节点同时下载速度100-680 Mb/s和上传速度67-138 Mb/s(截图如下彼此间隔 30 秒)。所以目前的带宽太小而且不稳定。但我需要从 1 Gb/s 开始的稳定带宽。
我试图在 Google Docs 中找到有关带宽的任何技术规范或定价。但是,技术规范中只有 CPU/GPU/RAM/Disk,没有带宽。并且文档上只有每月流量定价。
TL;DR:
如何为每个集群节点、GPU 实例和任何其他 Google Cloud 虚拟机设置稳定的 1 Gb/s 或更多带宽?
Google Cloud 中是否有提供超过 1 Gb/s 带宽的服务?
Google Cloud 中是否有任何解决方案/服务如何处理大互联网流量?
附:速度测试通过:
npx speedo-cli
【问题讨论】:
-
每个虚拟机的带宽随着vCPUs the instance has的数量而增加。还要注意,如果进程需要写入磁盘,那么磁盘网络带宽也是一个限制因素
-
@PatrickW,感谢您的回复。在帖子中的屏幕截图中,您可以看到在具有相同 vCPU 数量的同一 VM 上的不同速度测试结果。带宽不稳定,可能在 12.29 MB/s 到 85.2 MB/s 之间变化。对此有何影响?如何获得稳定的最大带宽?在您发送的链接上,他们说他们给我们每个 vCPU 2 Gbps。但这里甚至低于 1 Gbps。
标签: google-cloud-platform gpu google-kubernetes-engine bandwidth