チップおよび半導体

エージェント型AIワークロード向けに設計されたVeraプロセッサの出荷をNVIDIAが開始

NVIDIAは、エージェント型AIモデルに伴う調整、ツール呼び出し、コンテキスト検索のタスクを想定して設計されたVeraプロセッサシステムのAWS、Oracle Cloud Infrastructure、Anthropic、OpenAI、SpaceXAIへの出荷を開始した。同社によると、このプロセッサは専用のOlympusコア88基を搭載し、メモリ帯域幅は毎秒1.2テラバイトに達するが、価格の詳細や広範な商用提供の時期は明らかにされていない。

2026-08-27
1 分で読めます
13 閲覧数
فريق تحرير certi.news
エージェント型AIワークロード向けに設計されたVeraプロセッサの出荷をNVIDIAが開始

NVIDIAはAIエコシステムのパートナーへのVeraシステムの出荷を開始した。これは、同社の専用中央処理プロセッサが発表段階から、クラウドプロバイダーやモデル開発研究所での評価・導入段階へ移行したことを示す。納入先にはAWSとOracle Cloud Infrastructureに加え、Anthropic、OpenAI、SpaceXAIが含まれる。NVIDIAはこの内容を2026年5月18日に公開し、2026年8月27日に更新しており、Veraの出荷が拡大する規模で進んでいると説明した。

GPUだけでは実行できない機能向けのプロセッサ

NVIDIAはVeraを同社初の専用中央処理プロセッサであり、エージェント型AIワークロード向けに最初から構築されたものと位置づけている。同社によると、こうしたワークロードはGPUによるモデル実行にとどまらず、分離された環境の実行、ツール呼び出し、実行ステップの管理、長いコンテキストからの情報検索、システムコンポーネント間のデータ転送なども含む。

NVIDIAの仕様によると、Veraは同社が設計したOlympusコアを88基搭載し、メモリ帯域幅は毎秒1.2テラバイトに達する。NVIDIAは、エージェント型AIワークロードにおいて、Veraが同社の使用する基準と比較してコア当たり最大1.8倍の性能を実現すると説明している。また、アクセラレーターと統合された構成により、従来型の構成と比べて電力効率が2倍高くなる可能性があるとしている。これらは同社が示した数値であり、記事では試験方法や比較に使用した競合システムの詳細は示されていない。

誰がシステムを受け取り、何を評価しているのか

AWSは、両社が発表した16年間にわたる協力関係の拡大の一環として、シアトルの拠点で最初のVeraサーバーと最初のVera Rubin GPUシステムを受け取った。発表された計画には、NVIDIA製GPUを200万基追加することと、Veraを基盤とする構成をAWSに導入することが含まれている。

Oracle Cloud Infrastructureは、2026年から数十万基のVeraプロセッサを導入する計画だと述べ、NVIDIAをVeraをハイパースケール規模で導入する最初のクラウドプロバイダーと表現した。記事では、詳細なスケジュールや、これらのシステムが利用可能になるクラウドリージョンに関する情報は示されていない。

SpaceXAIは、強化学習ワークロードとエージェントベースのシミュレーション経路向けにプロセッサを評価している。また、AnthropicとOpenAIは初期納入の一環としてシステムを確認した。Anthropicは、計算能力の拡大がモデルの成長を加速させる可能性があると述べたが、記事では独立した試験結果を公表していない。

NVIDIAのプラットフォームにおけるVeraの位置づけ

NVIDIAはVeraを単独のプロセッサとしてではなく、Rubin GPU、BlueField-4 DPU、Spectrum-Xネットワーク、MGXラックアーキテクチャを含むエコシステムの一部として提供している。Vera Rubin NVL72システムでは、Veraが2基のRubin GPUのホストプロセッサとして動作し、第2世代のNVLink-C2Cを介して、統合メモリアーキテクチャの下でGPUに接続される。

実際には、NVIDIAは中央処理プロセッサが、GPUの継続的な活用を制限する可能性のある制御、調整、データ転送の処理を担うことに期待を寄せている。これはクラウド運用者やエージェント型モデルの開発者にとって重要である。こうした補助処理の高速化は、推論速度だけでなく、応答時間や各タスクの実行コストにも影響する可能性があるためだ。

依然として不明確な点

出荷開始は、Veraが大手パートナーの実システムに移行したことを示すが、それだけであらゆるエージェントワークロードにおける広範な実用上の優位性を証明するものではない。情報源は主としてNVIDIAの仕様と主張に依拠しており、サーバー価格、商用提供の条件、顧客が公開した比較結果については触れていない。また、OCIによる将来的な大規模導入の発表はあくまで公表された計画であり、Veraの実際の有効性を判断するには、さまざまなモデル、ツール実行経路、クラウドアーキテクチャを通じた独立した評価が必要になる。

ニュースの出典
NVIDIA AI Blog
原文を開く ↗
ف
著者

فريق تحرير certi.news

同じカテゴリー

おすすめ記事

すべてのニュースを見る