亚马逊云服务在 bedrock 上对比 openai 模型成本与效果
Beyond the price per token: Choosing the right OpenAI model on Amazon Bedrock for your workload
亚马逊云服务分享了一个工具,帮你对比 openai 模型在 bedrock 上的成本和效果,不是只看单价,而是看实际产出。
这篇文章分享了一个开源基准测试工具,用于衡量在亚马逊 bedrock 平台上使用 openai 模型时,每百万令牌的成本、正确答案的成本以及基于评分标准的交付质量。
Beyond the price per token: Choosing the right OpenAI model on Amazon Bedrock for your workload
Comparing models on dollars per million tokens misses what production workloads actually pay for: outcomes. This post shares an open-source benchmarking harness that measures cost per correct answer, agent trajectory cost, and rubric-graded deliverable quality across OpenAI models on Amazon Bedrock.