NVIDIAは9月15日から17日にかけて、米カリフォルニア州サンタクララで「AI Infra Summit 2026」を開催した。同社でハイパースケール・HPC担当バイスプレジデントを務めるイアン・バック氏が基調講演に登壇し、AIエージェントが本格的に普及する中でデータセンターの効率を測る新たな指標として「トークン毎ワット(tokens per watt)」を重視する方針を打ち出した。
講演では、次世代プラットフォーム「Vera Rubin」と電力効率技術「DSX MaxLPS」が中心テーマとして紹介された。NVIDIAによれば、Vera Rubinを用いたシステムはエージェント型ワークロードにおいて、従来世代のアーキテクチャと比べメガワットあたりのスループットを最大30倍に高められるという。処理能力あたりの消費電力を抑えることで、AIサービス事業者のトークン生産コスト低減や収益性向上につながるとしている。
協業に関する発表も相次いだ。半導体スタートアップのd-Matrixは、NVIDIAの相互接続技術「NVLink Fusion」を通じて自社の推論アクセラレータ「Raptor」とNVIDIAの「Vera」CPUを組み合わせ、大規模環境における超低遅延の推論基盤を構築すると発表した。またクラウド事業者のLambdaは、NVIDIAの「DSX MaxLPS」技術の導入によりワットあたりの処理性能を23%改善したことを明らかにした。
今回のサミットには前年の2倍以上となる8000人以上が参加したとされ、GPU単体の性能競争から、電力効率や周辺インフラを含めた「AIファクトリー」全体の設計競争へと業界の関心が移りつつあることを印象づけるイベントとなった。
出典: NVIDIA(公式ブログ)



