Amazon Web Services (AWS) ve NVIDIA, 26 Ağustos 2026’da teknik ortaklıklarını genişlettiklerini açıkladı. Buna göre 2027 ve 2028 yıllarında AWS’nin küresel altyapısı genelinde NVIDIA’dan iki milyon ek grafik işlem birimi dağıtılması planlanıyor. Bu adım, iş birliğinin yalnızca bulut GPU’larının sağlanmasıyla sınırlı kalmayıp işlemcileri, ağları, açık modelleri, veri işlemeyi ve robot teknolojilerini de kapsıyor.
Plan, AWS’nin NVIDIA GTC 2026 konferansında 2026’dan itibaren bir milyondan fazla GPU ekleme niyetini açıklamasının ardından geldi. Şirketler, talebin önceki beklentileri aştığını belirtti. Yeni kapasite; aracı yapay zekâ, bilimsel keşif, kurumsal otomasyon, fiziksel yapay zekâ ve robot teknolojileri dâhil olmak üzere çeşitli iş yüklerinde kullanılacak.
AWS müşterileri için daha geniş donanım seçenekleri
AWS, müşterilere açık hesaplama seçenekleri sunmayı; NVIDIA birimlerini AWS tarafından tasarlanan Trainium birimleriyle birleştirmeyi veya her iki türü birlikte kullanmayı amaçlıyor. Genişleme kapsamında, aracı yapay zekâ ve pekiştirmeli öğrenme iş yükleri için yüksek performanslı CPU kapasitesi sağlamak üzere NVIDIA Vera işlemcilerine dayalı bir altyapının AWS’ye dâhil edilmesi üzerinde de çalışılıyor.
Şirketlerin belirttiğine göre Vera; kod yürütme, araç kullanımı, yalıtılmış ortamların çalıştırılması, analizler, veri hatları ve sistem bileşenleri arasındaki koordinasyon gibi görevleri hedefliyor. İşlemci, hızlandırılmış sistemler için ana makine birimi olarak veya yapay zekâ fabrikalarında bağımsız bir işlemci olarak kullanılabilecek.
Trainium’un NVIDIA teknolojileriyle bağlanması
İş birliği, gelecek Trainium nesillerinde çipler arasında yüksek hızlı bağlantı için NVLink Fusion teknolojisine desteği de kapsıyor. Amazon’a bağlı Annapurna Labs, bellek tedarikçileriyle iş birliği içinde Trainium’un daha hızlı ve enerji açısından daha verimli belleğe erişmesini sağlaması beklenen özel yüksek bant genişlikli bellek teknolojisi NVHBM üzerinde NVIDIA ile çalışacak.
NVHBM ile NVLink Fusion’ın bir araya getirilmesi; raf düzeyinde Trainium ile NVIDIA birimlerini ortak bir altyapıya entegre ederken yapay zekâ iş yüklerinde ölçeklenebilirliği ve performansı iyileştirmeyi amaçlıyor. Şirketler ayrıca büyük ölçekli model eğitimi sırasında GPU birimlerini daha verimli biçimde bağlayan ağ teknolojileri üzerinde de iş birliği yapıyor.
Kamu sektörü için özel altyapı
AWS ve NVIDIA, ABD hükümeti için AWS’nin güvenli altyapısı üzerinde 100.000 GPU içeren yapay zekâ fabrikaları kurmayı planlıyor. Bu fabrikalar, ulusal güvenlik iş yüklerini ve Impact Level 6 (IL6) ile üzerindeki sınıflandırılmış devlet görevlerini destekleyecek. Duyuruda bu bölüm için ayrı bir takvim veya fabrikaların operasyonel dağılımına ilişkin ayrıntılar belirtilmiyor.
Pratikte ne değişiyor?
Bu adım, yapay zekâ bulut altyapısındaki rekabetin yalnızca GPU birimlerinin sayısıyla değil; işlemcilerin, belleğin, ağların, yazılımların ve güvenlik seviyelerinin entegrasyonuyla da ilgili olduğunu gösteriyor. Müşteriler çeşitli donanım seçeneklerinden ve NVIDIA ile AWS bileşenleri arasındaki daha derin entegrasyondan yararlanıyor. Ancak açıklanan kapasitenin büyüklüğü, hemen kullanılabilir bir kapasiteyi değil, geleceğe yönelik bir taahhüdü temsil ediyor.
AWS, mevcut entegrasyonların AWS Nitro System içinde GPU ve Trainium tabanlı EC2 bulut sunucularının yanı sıra Elastic Fabric Adapter üzerinden bağlantı, ayrıca Amazon Bedrock ve Amazon SageMaker üzerinde Nemotron modelleri sağladığını belirtiyor. Şirket ayrıca Amazon EMR üzerinde GPU ile hızlandırılmış veri işlemenin Apache Spark işlem hızında 3,7 kata kadar artış ve maliyete göre performansta %30 iyileşme sağladığını; Amazon OpenSearch Service üzerindeki hızlandırılmış vektör dizininin ise karşılaştırmalı yapılandırmalara kıyasla 9 kata kadar daha hızlı ve dörtte bir maliyetle dizinleme sunduğunu ifade ediyor. Amazon Robotics, depo otomasyonunu geliştirmek için Jetson, Omniverse ve Isaac platformlarını kullanıyor.