主要来源AWS Machine Learning Blog
查看原文事件专题 ·官方一手
Amazon SageMaker AI Async Inference 支持行内请求载荷
AWS 宣布 Amazon SageMaker AI 异步推理(Async Inference)现支持在 InvokeEndpointAsync API 的请求体中直接发送推理负载(inline payload),无需预先上传至 S3。这一功能简化了工作流,减少了与 S3 的交互步骤,并降低了延迟。用户可在请求正文中放入不超过 2MB 的数据,适用于轻量级推理场景。
当前结论
AWS SageMaker 异步推理现在可以直接在请求里传数据,不用先传 S3 了,省一步操作。
2 个信源38° AI 热度最后更新 2026/6/17 20:56:36
证据链
2 个信源相关来源 1marktechpost
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。