AWS と NVIDIA、エージェント型 AI およびフィジカル AI 向けにさらなる 200 万基の GPU と次世代インフラを提供へ
NVIDIA

顧客需要の加速に伴い、両社は AI スタック全体での統合を深化させ、NVIDIA Vera CPU、高度なネットワーク、Nemotron オープン モデル、およびフィジカルAI 技術を AWS に導入
[画像:
https://prcdn.freetls.fastly.net/release_image/12662/651/12662-651-1b0b7fba7192e1d3f3973bffad3e8a6b-1600x900.jpg?width=536&quality=85%2C75&format=jpeg&auto=webp&fit=bounds&bg-color=fff ]
Amazon.com, Inc. (NASDAQ: AMZN) のグループ企業である Amazon Web Services (AWS) と NVIDIA (NASDAQ: NVDA) は本日、AI インフラに対する世界的な需要の急増と加速に対応するため、戦略的な取り組みを大幅に拡大すると発表しました。AWS 上での NVIDIA アクセラレーテッド コンピューティングの急速な導入実績を基盤とし、両社は AWS のグローバル インフラ全体に新たに 200 万基の NVIDIA GPU を導入する計画です。さらに、AI ファクトリー、CPU、ネットワーキング、オープン モデル、データ処理、ロボティクスにわたる分野で連携を深め、顧客がかつてない規模で AI の開発と展開を加速できるようにする共同開発による AI ソリューションを提供していきます。
AI ワークロードは、モデルのトレーニングや実行から、データの処理やインデックス化、そしてインテリジェントなアプリケーションの駆動に至るまで、急速に拡大しています。顧客は、試験的な導入から本番環境へと移行し、エージェント型 AI、科学的発見、企業業務の自動化、ロボティクスといった領域でワークロードを拡大させています。そのため、より幅広いモデルの選択肢や、より高速なデータ パイプライン、そしてフィジカル AI のような新たなユースケースに対応する機能が求められています。また、ミッション クリティカルなワークロードに対して最高水準のセキュリティと信頼性を維持しつつ、自社のイノベーションのスピードに追随できるインフラであるという確信も必要としています。
最先端の研究機関、グローバル企業、スタートアップ、政府機関から急増する需要に応えるため、AWS と NVIDIA は 16 年にわたる共同イノベーションの成果を基盤として、AI コンピューティング能力を拡張し、両社で共同開発した新しいソリューションをより迅速に顧客へ提供しようとしています。この協力関係の拡大の一環として、両社は以下の取り組みを進めています。
- 2027 年から 2028 年にかけて、AWS のグローバル インフラ全体に NVIDIA GPU をさらに 200 万基展開- NVIDIA Vera CPU ベースのインフラを AWS に導入- NVIDIA NVLink Fusion(TM) を、NVIDIA 独自の広帯域メモリ (NVHBM) で拡張- 連邦政府および国家安全保障関連のワークロードを実行するための、セキュアな AWS インフラ上の 10 万基の GPU を含む AI ファクトリーを米国政府向けに構築- セキュリティと信頼性を強化するため、NVIDIA プラットフォームを AWS Nitro System および Elastic Fabric Adapter (EFA) と統合- Amazon Bedrock および Amazon SageMaker での NVIDIA Nemotron(TM) オープン モデルのサポートを継続し、顧客にオープン モデルの選択肢をさらに提供- NVIDIA cuDF および cuVS CUDA-X(TM) ライブラリを活用して Amazon EMR および Amazon OpenSearch でのデータ処理とベクトル インデックス作成を高速化し、より迅速かつコスト効率の高い分析や AI アプリケーションを実現- Amazon Robotics による NVIDIA のフィジカル AI プラットフォームの採用を通じてロボティクス ワークロードをさらに進化させ、倉庫の自動化や次世代ロボットにおけるイノベーションを加速
AWS の CEO である Matt Garman 氏は次のように話しています。「顧客は、自身の AI ワークロードに最適なツールを自由に選択できることを望んでおり、それらすべてがシームレスに連携して機能するという確実性も求めています。そのため、私たちは NVIDIA との連携を深め、AWS を NVIDIA の AI 技術を実行するのに最適な環境とすることに注力してきました。ネットワークやセキュリティから展開に至るまでインフラ全体のパフォーマンスを最適化しています。今回の協力関係の拡大により、最先端の研究機関や企業、政府機関は、AWS 上で AI を構築および展開するための選択肢をさらに広げることができます」
NVIDIA の創業者/CEO であるジェンスン フアン (Jensen Huang) は次のように述べています。「NVIDIA と AWS は、AI 時代の偉大な成長エンジンの 1 つを築き上げました。その需要はあらゆる予測を上回る勢いで推移しています。私たちは 16 年にわたり、クラウド上での NVIDIA コンピューティングを共に拡大してきました。そして今、GPU、CPU、ネットワーキング、オープン モデル、ソフトウェアといったフルスタック全体にわたりパートナーシップを拡大し、AWS と NVIDIA にしか実現できない前例のないペースと規模で、エージェント型 AI やフィジカル AI を現実のものにしようとしています。この拡大は、AWS 上で NVIDIA のプラットフォームを利用したいという顧客の需要を反映したものです」
AI コンピューティング能力の大幅な拡大
AWS は、多岐にわたる AI および機械学習ワークロードを支えるため、あらゆるクラウド プロバイダーの中で最も幅広い GPU ベースのインスタンスを提供しています。AWS は NVIDIA GTC 2026 において、2026 年から 100 万基以上の NVIDIA GPU を追加導入する
計画を発表しました。それ以降、需要は当初の予想を上回る水準で推移しています。AWS は 2027 年から 2028 年にかけて、AI ファクトリーを含む AWS のグローバル インフラ全体に、NVIDIA Blackwell Ultra、Rubin、および Rubin Ultra GPU をさらに 200 万基追加展開する計画です。この追加のコンピューティング能力は、エージェント型 AI や科学的発見から、企業の業務自動化、フィジカル AI に至るまで、顧客の多様なワークロードを支えることになります。さらに AWS は、
Amazon EC2 G7 インスタンス向けの NVIDIA RTX PRO(TM) 4500 Blackwell Server Edition GPU を含め、NVIDIA Blackwell の提供能力を拡大します。G7 インスタンスは、前世代の G6 インスタンスと比較して、4.6 倍の AI 推論性能と 2.1 倍のグラフィックス性能を提供します。AWS は、RTX PRO 4500 を搭載したコンピューティング インスタンスを提供する最初の主要なクラウド プロバイダーとなります。また、AWS と NVIDIA は NVIDIA Spectrum(TM) ネットワーキングの分野でも協力し、GPU クラスター間での大規模な AI トレーニング ワークロードに向けたネットワーク性能のさらなる最適化に取り組んでいます。
AWS における NVIDIA Vera CPU のサポート
AWS と NVIDIA は、Vera CPU をベースとしたインフラを AWS に導入すべく取り組んでいます。これにより、高速化されたインフラに加え、高性能な CPU 演算を必要とするエージェント型 AI ワークロードをサポートするための新たな選択肢が提供されます。次世代 AI 向けに専用設計された Vera は、AWS のカスタム シリコンからパートナー各社の最新アクセラレータや CPU に至るまで、極めて幅広いコンピューティングの選択肢を提供するという AWS の戦略を補完するものです。
NVHBM と NVIDIA NVLink Fusion を活用したヘテロジニアス AI インフラ
AWS は re:Invent 2025 において、次世代 Trainium チップで NVIDIA NVLink Fusion 高速チップ間インターコネクト技術をサポートすることを発表しました。NVIDIA と Amazon 傘下の Annapurna Labs は、メモリ サプライヤーとの連携により、このサポートを
NVIDIA の新しいカスタム高帯域幅メモリ (NVHBM) 技術にも拡大しています。これにより、Trainium はより高速かつ電力効率に優れたメモリを利用できるようになります。NVLink Fusion との組み合わせにより、Annapurna Labs は NVIDIA のカスタム メモリ技術とスケールアップ アーキテクチャを活用して、AI ワークロードの性能と効率を向上させると同時に、共通のラックスケール アーキテクチャ内で Trainium と GPU をシームレスに統合することが可能になります。
最高レベルのセキュリティで連邦政府の AI を推進
政府機関は、国家安全保障上の要件に対応するため、安全な AI インフラを必要としています。AWS と NVIDIA は、連邦政府および国家安全保障に関わるワークロード向けに、AWS の安全なインフラ上で 10 万基の GPU を提供する計画を含む、NVIDIA の AI スタックを導入した AI ファクトリーを構築する予定です。この連携により、AWS と NVIDIA は国家安全保障のための連邦政府 AI 推進の中核を担うことになり、政府機関はインパクト レベル 6 (IL6) 以上の機密レベルが求められるワークロードにおいて、大規模な AI 展開が可能になります。
今回の新たな取り組みは、AWS と NVIDIA 間の高度な技術的統合という基盤の上に成り立っており、すでに以下のような成果を顧客にもたらしています。
- AWS Nitro System と EFA によるセキュリティと信頼性の向上 - 今回の連携拡大に伴い、NVLink Fusion を活用するものを含め、NVIDIA GPU ベースおよび Trainium ベースのすべての EC2 インスタンスは、AWS Nitro System を基盤として構築され、EFA を介して相互接続されます。GPU アクセラレーション対応および Trainium ベースの EC2 インスタンスは、今後も Nitro System を基盤として構築され、EFA を通じてスケール アウトされます。Nitro と EFA は、AWS が NVIDIA GPU の導入規模を拡大し、新たな相互接続技術を統合していく中でも、顧客が大規模な本番環境の AI ワークロードにおいて必要とするセキュリティ、信頼性、ネットワーク パフォーマンスを確実に維持できるよう支援します。- AWS 上の NVIDIA Nemotron モデル - 顧客に最も幅広い AI モデルの選択肢を提供するという AWS の取り組みの一環として、NVIDIA のオープン モデル群 Nemotron が利用可能になりました。Amazon Bedrock ではフル マネージドかつサーバーレス モデルとして提供されるほか、独自のインフラ上での展開やファイン チューニングを希望する顧客向けには Amazon SageMaker でも利用可能です。この統合により、顧客は AWS のセキュリティ、拡張性、運用ツールを活用しながら、NVIDIA の最新オープン モデルを利用できるようになります。- GPU アクセラレーションによるデータ処理とベクトル インデックス作成 - データ量の増大に伴い、特徴量エンジニアリング、大規模 ETL、リアルタイム分析などのワークロードでは、さらなる高速処理が求められています。AWS と NVIDIA は、Amazon EC2 G7 インスタンスと NVIDIA cuDF ライブラリを活用し、Amazon EMR 上で GPU アクセラレーションによるデータ処理を実現するために協力しています。これにより、CPU ベースの構成と比較して、最大 3.7 倍の処理速度と 30% 優れたコスト パフォーマンスを実現します。また、AI アプリケーション、RAG (検索拡張生成) パイプライン、セマンティック検索などによりベクトル データベースのレコード数が数十億規模に達する中、インデックスの構築とチューニングがボトルネックとなっています。Amazon OpenSearch Service における GPU アクセラレーション対応のベクトル インデックス作成機能は、インデックス構築処理を専用 GPU にオフロードすることで、最大 9 倍の高速化とコストの 4 分の 1 への削減を実現します。この機能は、マネージド クラスターと Amazon OpenSearch Serverless の双方で利用可能です。- ロボティクス向けフィジカル AI - Amazon Robotics は NVIDIA と協力し、NVIDIA Jetson(TM) プラットフォーム、NVIDIA Omniverse(TM) ライブラリ、NVIDIA Isaac(TM) オープン ロボティクス開発プラットフォームを含む、NVIDIA のフルスタック フィジカル AI プラットフォームを統合した次世代ロボットの開発を加速させています。両社の協力関係は、シミュレーション、合成データ生成、ロボットのトレーニング、ルート最適化、機能安全、Real-to-Sim (現実環境とシミュレーション環境の整合性) 検証など多岐にわたり、これらはすべて GPU アクセラレーション対応の Amazon EC2 インスタンス上で実行されます。AWS と NVIDIA は協力して、大規模なシミュレーション、多様なトレーニング データ、継続的な実環境での検証といった、ロボティクス ワークロードに求められる能力の向上を支援しています。
※本発表資料は米国時間 2026 年 8 月 26 日に発表された
プレスリリースの抄訳です。
Amazon Web Services について
アマゾン ウェブ サービス(AWS)は、お客様を起点に考え、イノベーションの速度、オペレーショナルエクセレンス、そして長期的視点を行動規範としています。20 年近くにわたり、AWS はあらゆる規模・業界の組織がクラウドコンピューティングと生成 AI を活用できるよう、テクノロジーを民主化してきました。その結果、史上最も急成長しているエンタープライズ向けテクノロジービジネスを築いてきました。現在、数百万に及ぶお客様が AWS を信頼し、イノベーションの加速、ビジネスの変革を通じて、未来を形成しています。最も包括的な AI ケイパビリティとグローバルなインフラストラクチャを備えた AWS は、ビルダーが大きなアイデアを実現できるよう支援しています。詳細については aws.amazon.com をご覧いただくか、@AWSNewsroom をフォローしてください。
NVIDIA について
NVIDIA (NASDAQ: NVDA) は AI とアクセラレーテッド コンピューティングの世界的なリーダーです。
プレスリリース提供:PR TIMES
記事提供:PRTimes