Nvidia(NVDA)'nın yeni nesil yapay zeka hızlandırıcısı Rubin Ultra'nın amiral gemisi bellek konfigürasyonunun 192GB HBM4 seviyesine düşebileceği iddia edildi. Bu rakam, piyasada daha önce konuşulan 1TB seviyesindeki yüksek bant genişlikli bellek (HBM) yapılandırmasından belirgin şekilde düşük ve yapay zeka veri merkezlerinin bellek, güç ve paketleme tasarımını da etkileyebilir.
SemiAnalysis, Rubin Ultra'nın 8 katmanlı (8-hi) HBM4 tabanlı 192GB konfigürasyonla geleceğini öne sürdü. Bu rakam, ilk incelemelerde konuşulan 1TB HBM'in oldukça altında kalıyor; ayrıca standart Rubin'in 288GB'lık kapasitesinin de altında. Tom's Hardware ise Nvidia'nın Rubin Ultra için 192GB veya 256GB bellek konfigürasyonlarını test ettiğini aktardı.
Değişikliğin merkezinde HBM yapılandırması yer alıyor. SemiAnalysis'e göre, 4 çekirdekli (die) tasarıma dayanan Rubin Ultra planı iptal edilince HBM küp sayısı 8'e indi, katman yüksekliği de 16'dan 8'e düştü. Ayrıca 32Gb çekirdek kullanan HBM4E yerine 24Gb çekirdek tabanlı HBM4 kullanılan bir yapı öne sürüldü.
Nvidia, resmi teknoloji blogunda standart Rubin GPU'nun en fazla 288GB HBM4 ve 22TB/sn bant genişliği sunduğunu açıkladı. Bu ölçüte göre 192GB'lık konfigürasyon, kapasite açısından standart Rubin'in gerisinde kalıyor. Tom's Hardware, Nvidia'nın “hesaplama, ağ ve belleği optimize ederek daha fazla GPU ve yapay zeka sisteminin devreye alınmasını sağladığını” belirttiğini aktardı.
Bu gözlem Güney Kore'nin yarı iletken tedarik zincirini de yakından ilgilendiriyor. HBM, yapay zeka sunucularının maliyetini ve tedarik takvimini doğrudan etkileyen bir bileşen. TokenPost daha önce Rubin Ultra maliyetinde bellek payının yarıyı aşabileceğine dair bir analizi aktarmıştı. Bellek kapasitesini düşürme kararı, basit bir performans geri adımından çok HBM tedariği, güç tüketimi ve paketleme verimini birlikte dengeleme çabası olarak yorumlanabilir.
Yapay zeka veri merkezlerinde artık yalnızca tek bir GPU'nun performansı değil, rack ölçeğinde ölçeklenebilirlik ve ağ yapılandırması da önem kazanıyor. Nvidia, Rubin platformunda NVLink 6, Spectrum-6 Ethernet ve CPO tabanlı ağ yapılandırmasını birlikte sunmuştu. TokenPost daha önce Vera Rubin platformunun büyük ölçekli yapay zeka fabrikalarını desteklemek için kullandığı CPO tabanlı switch mimarisini haber yapmıştı.
SemiAnalysis, ilerleyen dönemde 8 katmanlı HBM4E'ye yükseltilmiş bir versiyonun da gelebileceğini öne sürdü. Ancak Rubin Ultra'nın nihai ürün özellikleri ve uygulama zamanlaması Nvidia'nın resmi açıklamasıyla doğrulanmayı bekliyor.
Yorum 0