【问题标题】:S3 presigned URL works 90 minutes after bucket creationS3 预签名 URL 在创建存储桶后 90 分钟有效
【发布时间】:2019-06-09 18:06:12
【问题描述】:

我们生成预签名 URL,以便用户将文件直接上传到 S3 存储桶。运行集成测试,我们发现了一个失败的测试,其中对预签名 URL 的 HTTP PUT 请求产生了SignatureDoesNotMatch 错误响应。令人惊讶的是,相同的代码使用另一个存储桶运行良好。我们一直在尝试导致测试失败的原始存储桶,当它突然开始工作而没有任何实际代码更改时,我们感到很惊讶。

我们注意到,在我们创建存储桶后大约两个小时,测试成功运行。由于我们位于 UTC+0200,我们怀疑该问题与该时差和/或某些时钟同步问题有关。我们开始确认我们的怀疑,即相同的预签名 URL 在足够的时间过去后会突然起作用。剧透:确实如此!

以下代码创建一个全新的存储桶,生成一个适合文件上传的预签名 URL (ClientMethod='put_object'),并尝试使用 requests 库 HTTP PUT 一些数据。我们每 60 秒重试一次 PUT 数据,直到在创建存储桶后 5419 秒(或 90 分钟)最终成功。

注意:即使之后删除了存储桶,运行相同的脚本(使用相同的存储桶名称)现在也会立即成功。如果您想重新确认此行为,请确保第二次使用不同的存储桶名称。

import logging
import time

import boto3
import requests

from botocore.client import Config

logger = logging.getLogger(__name__)

# region = "eu-central-1"
# region = "eu-west-1"
# region = "us-west-1"
region = "us-east-1"
s3_client = boto3.client('s3', region_name=region, config=Config(signature_version='s3v4'))


if __name__ == "__main__":
    bucket_name = "some-globally-unique-bucket-name"

    key_for_file = "test-file.txt"

    # create bucket
    if region == "us-east-1":
        # https://github.com/boto/boto3/issues/125
        s3_client.create_bucket(Bucket=bucket_name, ACL='private')
    else:
        s3_client.create_bucket(Bucket=bucket_name, ACL='private',
                                CreateBucketConfiguration={'LocationConstraint': region})
    creation_time = time.time()

    # generate presigned URL
    file_data = b"Hello Test World"
    expires_in = 4 * 3600
    url = s3_client.generate_presigned_url(ClientMethod='put_object', ExpiresIn=expires_in,
                                           Params={'Bucket': bucket_name, 'Key': key_for_file})

    time_since_bucket_creation = time.time() - creation_time
    time_interval = 60
    max_time_passed = expires_in
    success = False
    try:
        while time_since_bucket_creation < max_time_passed:
            response = requests.put(url, data=file_data)
            if response.status_code == 200:
                success = True
                break

            if b"<Code>SignatureDoesNotMatch</Code>" in response.content:
                reason = "SignatureDoesNotMatch"
            else:
                reason = str(response.content)

            time_since_bucket_creation = time.time() - creation_time
            print("="*50)
            print(f"{time_since_bucket_creation:.2f} s after bucket creation")
            print(f"unable to PUT data to url: {url}")
            print(f"reason: {reason}")
            print(response.content)
            time.sleep(time_interval)
    except KeyboardInterrupt:
        print("Gracefully shutting down...")

    if success:
        print("YAY! File Upload was successful!")
        time_since_bucket_creation = time.time() - creation_time
        print(f"{time_since_bucket_creation:.2f} seconds after bucket creation")
        s3_client.delete_object(Bucket=bucket_name, Key=key_for_file)

    # delete bucket
    s3_client.delete_bucket(Bucket=bucket_name)

我们使用 AWS EKS 集群运行集成测试,我们在其中创建一个集群以及一些数据库、S3 存储桶等,并在测试完成后拆除所有内容。必须等待 90 分钟才能使 URL 预签名生效。

我的问题
我做错了什么吗?
这是预期的行为吗? 是否有可接受的解决方法?
有人可以使用上面的代码确认这种行为吗?

编辑
根据 cmets 中的“Michael - sqlbot”的建议,我更新了代码以在“us-east-1”区域中创建一个存储桶。奇怪的if 声明是必要的,正如here 所记录的那样。我能够证实 Michael 的怀疑,即“us-east-1”无法重现该行为。

如果感兴趣,错误情况下返回的XML:

<?xml version="1.0" encoding="UTF-8"?>
<Error>
    <Code>SignatureDoesNotMatch</Code>
    <Message>The request signature we calculated does not match the signature you provided. Check your key and signing method.</Message>
    <AWSAccessKeyId>REDACTED</AWSAccessKeyId>
    <StringToSign>AWS4-HMAC-SHA256
    20190609T170351Z
    20190609/eu-central-1/s3/aws4_request
    c143cb44fa45c56e52b04e61b777ae2206e0aaeed40dafc78e036878fa91dfd6</StringToSign>
    <SignatureProvided>REDACTED</SignatureProvided>
    <StringToSignBytes>REDACTED</StringToSignBytes>
    <CanonicalRequest>PUT
    /test-file.txt
    X-Amz-Algorithm=AWS4-HMAC-SHA256&amp;X-Amz-Credential=REDACTED%2F20190609%2Feu-central-1%2Fs3%2Faws4_request&amp;X-Amz-Date=20190609T170351Z&amp;X-Amz-Expires=14400&amp;X-Amz-SignedHeaders=host
    host:some-globally-unique-bucket-name.s3.eu-central-1.amazonaws.com

    host
    UNSIGNED-PAYLOAD</CanonicalRequest>
    <CanonicalRequestBytes>REDACTED</CanonicalRequestBytes>
    <RequestId>E6CBBC7D2E4D322E</RequestId>
    <HostId>j1dM1MNaXaDhzMUXKhqdHd6+/Rl1C3GzdL9YDq0CuP8brQZQV6vbyE9Z63HBHiBWSo+hb6zHKVs=</HostId>
</Error>

【问题讨论】:

  • 首先——这绝对是出乎意料的......但是:“即使之后删除了存储桶,运行相同的脚本(使用相同的存储桶名称)现在也会立即成功。” i> 什么意思,立马成功?您的意思是,如果您重新创建具有相同名称的存储桶,它会立即工作吗?请使用两个新的存储桶名称测试您的代码,一个在 us-east-1 中,一个在 us-east-2 中。有什么区别吗?我有一个理论——关于不应该发生的事情——但如果正确,us-east-2 将显示相同的错误行为,而 us-east-1 不会。
  • (请注意,如果是时钟问题,欧盟/美国的时差不会改变任何东西。所有 S3 地区都使用 UTC,而不是该地区的本地时间。但我不认为这是时间问题. SignatureDoesNotMatch 不应该基于时钟错误而被抛出。还有其他例外。)
  • @Michael-sqlbot 是的,我的意思是当我再次删除并重新创建存储桶时,它会立即工作。请记住,这仍然是在初始存储桶创建 90 分钟之后。我也能够证实你的理论:我无法在 us-east-1 中重现这种行为。
  • 正如@JohnRotenstein 所暗示的那样,使用generate_presigned_post 在创建存储桶后立即工作。但是,这似乎不适用于分段上传,因为必须使用 PUT 请求来上传每个单独的部分。

标签: python amazon-s3 boto3


【解决方案1】:

这是你遇到的:

临时重定向是一种错误响应,它向请求者发出信号,表明他们应该将请求重新发送到不同的端点。由于 Amazon S3 的分布式特性,请求可能会临时路由到错误的设施。这很可能在创建或删除存储桶后立即发生。

例如,如果您创建一个新存储桶并立即向该存储桶发出请求,您可能会收到临时重定向,具体取决于该存储桶的位置限制。如果您在美国东部(弗吉尼亚北部)AWS 区域创建存储桶,您将看不到重定向,因为这也是默认的 Amazon S3 终端节点。

但是,如果在任何其他区域中创建存储桶,则在传播存储桶的 DNS 条目时,对存储桶的任何请求都会转到默认终端节点。默认端点使用 HTTP 302 响应将请求重定向到正确的端点。临时重定向包含指向正确设施的 URI,您可以使用该 URI 立即重新发送请求。

https://docs.aws.amazon.com/AmazonS3/latest/dev/Redirects.html

请注意,最后一部分——您可以用来立即重新发送请求——不是很准确。您可以 -- 但如果请求使用签名版本 4,则重定向到新主机名将导致 SignatureDoesNotMatch 错误,因为主机名将不同。回到签名版本 2 的旧时代,存储桶名称包含在签名中,但端点主机名本身没有,因此重定向到不同的端点主机名不会使签名无效。

如果 boto 做正确的事情并使用正确的区域端点来创建签名 URL,这一切都不是问题——但由于某种原因,它使用“全局”(通用)端点——这会导致 S3在存储桶生命周期的前几分钟发出这些重定向,因为 DNS 尚未更新,因此请求错误路由到 us-east-1 并被重定向。这就是为什么我怀疑 us-east-1 不会表现出这种行为。

这应该是默认行为,但它不是;仍然,似乎应该有一种更清洁的方法来执行此操作,自动通过配置...可能有...但我没有在文档中找到它。

作为一种解决方法,客户端构造函数接受endpoint_url 参数,这似乎可以达到目的。事实证明,s3.${region}.amazonaws.com 是每个 S3 区域的 valid endpoint,因此可以从区域字符串构造它们。

s3_client = boto3.client('s3', region_name=region, endpoint_url=('https://s3.' + region + '.amazonaws.com'), config=...)

S3 的长期用户可能会怀疑所有 地区都支持这一点的说法,但在撰写本文时它是准确的。最初,一些地区以前使用破折号而不是点,例如s3-us-west-2.amazonaws.com 并且在那些较旧的地区仍然有效,但现在所有地区都支持上述规范形式。

【讨论】:

    猜你喜欢
    • 2019-01-27
    • 1970-01-01
    • 2019-01-30
    • 2020-05-26
    • 2015-11-22
    • 2019-11-16
    • 2021-09-09
    • 2020-04-05
    • 2019-07-14
    相关资源
    最近更新 更多