05:03AWS Machine Learning Blog@Dan FergusonAWS 宣布 Amazon SageMaker AI 异步推理(Async Inference)现支持在 InvokeEndpointAsync API 的请求体中直接发送推理负载(inline payload),无需预先上传至 S3。这一功能简化了工作流,减少了与 S3 的交互步骤,并降低了延迟。用户可在请求正文中放入不超过 2MB 的数据,适用于轻量级推理场景。AI产品SageMaker异步推理inline payloadInvokeEndpointAsync推理优化1 个信源在谈推荐理由:AWS SageMaker 异步推理现在可以直接在请求里传数据,不用先传 S3 了,省一步操作。原文