Marvell Technology(MRVL), 260 hatlı CXL anahtarıyla yapay zeka altyapısında bellek ve depolama darboğazlarını azaltmaya yönelik stratejisini paylaşacak. Büyük dil modellerinde(LLM) bağlam işleme kapasitesi arttıkça veri merkezlerindeki baskı yalnızca işlem gücünden çıkıp bellek kapasitesi, bant genişliği ve veri taşıma mimarisine yayılıyor.
Marvell, 5-7 Ağustos’ta (Kore saatiyle) ABD’nin Kaliforniya eyaletindeki Santa Clara’da düzenlenecek Future of Memory and Storage 2026 etkinliğinde yapay zeka altyapısına yönelik bellek ve depolama sunumları ile paneller gerçekleştirecek. Programda ‘ölçeklenebilir yapay zeka altyapısı için veri depolama inovasyonu’, ‘bellek merkezli dönem: CXL ve ölçeklenebilir yapay zeka altyapısının geleceği’ ve ‘genel amaçlı CXL-PNM: bellek yoğun yapay zeka iş yüklerinde bellek duvarını aşmak’ başlıkları yer alıyor.
Etkinliğin ana temalarından biri ‘AI bellek duvarı’ olacak. LLM’ler büyüdükçe ve bağlam pencereleri uzadıkça önceki bağlamı saklayan KV önbelleğine duyulan ihtiyaç da artıyor. KV önbelleği, yapay zeka modelinin önceki konuşma veya bağlam bilgisini yeniden hesaplamadan kullanmasını sağlayan veri katmanı olarak çıkarım hızı ve maliyet üzerinde doğrudan etkili oluyor.
Marvell, 17 Mart’ta yeni nesil CXL anahtarı Structera S 30260’ı duyurdu. Raf ölçeğinde bellek havuzlamasını destekleyen 260 hatlı ürün, CPU, GPU ve XPU gibi hızlandırıcıların sunucu dışındaki ayrıştırılmış bellek kaynaklarına erişebilmesi için tasarlandı. Ürün CXL 3.0’ı destekliyor ve en yüksek toplam bant genişliği saniyede 4 terabayta ulaşıyor.
Rishi Chugh(Rishi Chugh) Marvell veri merkezi anahtarlama birimi başkan yardımcısı ve genel müdürü, “AI bellek duvarını aşmak için temel bir mimari değişim gerekiyor” dedi. Bu açıklama, belleğin tek tek sunuculara sabitlenmiş bir kaynak olmaktan çıkıp raf içinde paylaşılabilen ve dağıtılabilen bir kaynağa dönüşmesi gerektiğine işaret ediyor.
Marvell’in yayımladığı ürün açıklamasında Structera S 30260’ın 16 veya 32 CPU/GPU ile 48 terabayta kadar paylaşımlı belleği desteklediği belirtildi. Şirketin kendi testlerinde 16 terabaytlık bellek havuzu 8 GPU ve 2 CPU sunucusu tarafından paylaşıldığında çıkarım işlem hacmi 4,8 kat arttı, ilk token üretim süresi ise %82,7 azaldı.
Depolama da yapay zeka altyapısının ölçeklenmesinde bir diğer önemli eksen haline geldi. NVIDIA(NVDA), BlueField-4 tabanlı CMX Context Memory Storage Platform ile uzun bağlamlı çıkarım için kullanılan KV önbelleğine flash tabanlı bir depolama katmanı sunuyor. NVIDIA, uzun bağlam ve aracı tipindeki iş yüklerinde sürdürülebilir saniye başına token işleme kapasitesi ile enerji verimliliğini en fazla 5 kat artırmayı hedeflediğini açıkladı.
Marvell ve NVIDIA yapay zeka altyapısı alanındaki iş birliğini de genişletiyor. İki şirket 31 Mart’ta NVLink Fusion temelinde AI factory ve AI-RAN ekosistemlerinde birlikte çalışacaklarını duyurdu. Marvell özel XPU’lar ve NVLink Fusion uyumlu scale-up ağ çözümleri sağlayacak; iki şirket ayrıca silikon fotonik teknolojilerinde de iş birliği yapacak.
Bu duyurular kripto varlıklar veya token ihracından çok yapay zeka veri merkezlerine yönelik yarı iletken, bellek ve depolama altyapısına odaklanıyor. Bununla birlikte, Bitcoin(BTC) madenciliği şirketlerinin mevcut elektrik ve tesis altyapılarını kullanarak yapay zeka ve yüksek performanslı hesaplama alanlarına yönelme eğilimiyle kesişen bir tarafı bulunuyor. Belirli bir kripto varlık fiyatı veya token talebiyle doğrudan bağlantı ise doğrulanmış değil.
Structera S 30260 için müşteri örneklemesinin 2026’nın 3. çeyreğinde başlaması planlanıyor. Mevcut Structera S 20256 CXL 2.0 anahtarı ise üretim aşamasına geçti.
Yorum 0