【问题标题】:Automate the date parameter while deplying the model on AWS Wrangler在 AWS Wrangler 上部署模型时自动执行日期参数
【发布时间】:2022-01-18 04:39:04
【问题描述】:

我在本地机器上构建了一个 XGBoost 模型,它获取训练数据并在测试数据集上验证模型。但是,由于训练数据是每月创建的,因此我对日期值进行了硬编码。训练数据是根据我传递的日期参数创建的。例如,jan = dt(2021,1,1)。

我现在必须自动化该过程,因为模型必须部署在 AWS 上,并且应该每月运行一次,而无需编辑代码。我应该如何将日期参数传递给 AWS Wrangler,以便流程自动化,并且代码将每月在新数据集上执行一次。

【问题讨论】:

    标签: amazon-web-services date amazon-sagemaker aws-data-wrangler


    【解决方案1】:

    一种方法是将 Data Wrangler 流导出到 SageMaker 管道(这可以通过 Data Wrangler UI 完成)。假设您的数据集在 S3 中,导出的 Flow 将生成一个定义 SageMaker 管道的笔记本,该管道可以将 S3 URI 作为输入并通过 Data Wrangler Steps 运行它。 您可以将 SageMaker Pipeline 配置为按计划运行,并通过 SageMaker Pipeline 的执行参数为每次执行传递新的 S3 URI。

    另一种方法是使用此 AWS 博客 - https://aws.amazon.com/blogs/machine-learning/schedule-an-amazon-sagemaker-data-wrangler-flow-to-process-new-data-periodically-using-aws-lambda-functions/ 中所述的 Lambda 函数。

    我在 AWS 工作,我的意见是我自己的。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2012-02-18
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2021-01-28
      • 1970-01-01
      相关资源
      最近更新 更多