【发布时间】:2022-08-03 21:31:30
【问题描述】:
我一直在为 Vertex AI 部署一些自定义训练模型,但最近,自动缩放功能在后来的端点上无法正常工作。基本上,尽管有流量,端点不会自动缩放。
我有一个按预期工作的旧端点,所以我将相同的模型部署到具有相同配置的不同端点(相同的机器规格、相同的 GPU、最少 1 台机器、最多 3 台机器、60% 的自动缩放阈值),创建它自己的任务队列,然后同时向两个端点发送相同的请求。
较旧的端点按预期工作,根据传入的流量向上和向下扩展。另一方面,较新的机器一直卡在一台机器上。
我可以力量如果我将阈值降低到 15-20%,它会扩大规模,并且随着请求的进入它会扩大规模。但是,一旦完成处理请求,它就不会缩小规模,即使在几个小时没有任何交通。
那么,考虑到旧端点确实在相同流量下按预期扩展和缩减,是什么阻止了新端点随着流量的增加而扩展呢?也许更重要的是,如果我强迫它扩大规模,是什么阻止它缩小规模?
标签: artificial-intelligence endpoint vertex