Beyond the price per token: Choosing the right OpenAI model on Amazon Bedrock for your workload

发生了什么
Comparing models on dollars per million tokens misses what production workloads actually pay for: outcomes. This post shares an open-source benchmarking harness that measures cost per correct answer, agent trajectory cost, and rubric-graded deliverable quality across OpenAI models on Amazon Bedrock.
摘要按规则整理自下方来源原文