行业新闻

NVIDIA 与 AWS 合作推动 AI 规模化生产

NVIDIA 与 AWS 合作推动 AI 规模化生产

NVIDIA 与 AWS 联合优化 AI 基础设施,降低大规模生产部署的延迟和成本。

大规模部署 AI 系统面临低延迟推理、快速向量搜索(一种高效查找相似数据的技术)和 GPU 性价比等挑战。NVIDIA 与 AWS 合作,通过 Amazon OpenSearch 和 EC2 提供基础设施,帮助企业减少运营复杂性,加速 AI 落地。

正文摘录

NVIDIA 与 AWS 合作,将 AI 大规模投入生产 大规模构建 AI 系统要求严苛:需要低延迟推理、快速向量搜索、强劲的 GPU 性价比,以及能随规模增长而不倍增运维复杂性的基础设施。 NVIDIA 与 Amazon Web Services (AWS) 的最新合作解决了上述每一个约束。借助 Amazon OpenSearch 和 Amazon EC2,NVIDIA AI 基础设施为企业提供了更实用的路径,将 AI 大规模部署到生产环境。 搭载 NVIDIA RTX PRO 4500 Blackwell Server Edition GPU 的 EC2 G7 实例扩展了 AI、图形、视频和数据分析工作负载的计算层;而 NVIDIA cuVS 库通过将 GPU 加速的向量索引设为 OpenSearch Serverless 的默认选项,加速了检索层。此外,AWS 在 NVIDIA GB300 上获得了 NVIDIA Exemplar Cloud 认证,客户可以放心,其训练工作负载获得了峰值优化性能。 NVIDIA RTX PRO 4500 Blackwell Server Edition 多工作负载 GPU 驱动全新 Amazon EC2 G7 实例 Amazon EC2 G7 实例将 NVIDIA RTX PRO 4500 Blackwell Server Edition GPU 引入 AWS,用于 AI 推理、图形、空间计算和 GPU 加速的数据分析——这是一种专为生产工作负载设计的新实例类型,无需客户管理 GPU 平台的运维负担即可获得高性能。

阅读原文(blogs.nvidia.com)→

行业新闻Josiah Byers2026-06-24原文

相关内容