AWS 官方博客发布基准测试,对比 Qwen3-Coder-30B 与 Nemotron-3-Nano-30B 在 G5、G6、G6e、G7 实例上的推理性能。结果显示 G7 在吞吐、延迟和成本上均有优势,并介绍了 SageMaker AI 的推理推荐功能。
AWS 基准测试:G7 实例在 SageMaker AI 上提升 LLM 推理性价比