主要来源AWS Machine Learning Blog
查看原文事件专题 · 官方一手
Amazon SageMaker AI Async Inference 支持行内请求载荷
AWS 宣布 Amazon SageMaker AI 异步推理(Async Inference)现支持在 InvokeEndpointAsync API 的请求体中直接发送推理负载(inline payload),无需预先上传至 S3。这一功能简化了工作流,减少了与 S3 的交互步骤,并降低了延迟。用户可在请求正文中放入不超过 2MB 的数据,适用于轻量级推理场景。
当前结论
AWS SageMaker 异步推理现在可以直接在请求里传数据,不用先传 S3 了,省一步操作。
2 个信源38° AI 热度最后更新 2026/6/17 20:56:36
证据链
相关来源 1marktechpost
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。