Back to top
  • 공유 Paylaş
  • 인쇄 Yazdır
  • 글자크기 Yazı tipi Boyutu
URL kopyalandı.

Nvidia(NVDA) Groq 3 LPX üretimi doğrulandı, yılın ikinci yarısında sevkiyat bekleniyor

Sunum sahnesinin yanında sergilenen raf tipi yapay zeka hızlandırıcı modeli / TokenPost.ai

Nvidia(NVDA), yapay zeka (AI) çıkarım hızlandırıcısı Groq 3 LPX'i, Vera Rubin platformunun düşük gecikmeli işlem birimi olarak tanıttı. Tek bir rafta 256 LPU ve çip üzerinde 128GB SRAM barındıran bu yapı, çıkarım tarafında öne çıkan bir tasarım sunuyor.

Nvidia, 16 Mart'ta (yerel saatle) yayımladığı basın bülteninde, Vera Rubin platformunu oluşturan yedi çipin üretim aşamasına geçtiğini duyurdu. Bu bileşenler arasında Vera CPU, Rubin GPU, NVLink 6 anahtarı, ConnectX-9 SuperNIC, BlueField-4 DPU, Spectrum-6 Ethernet anahtarı ve Groq 3 LPU yer alıyor.

Groq 3 LPX, eğitimden çok çıkarım sürecine odaklanan bir donanım. Çıkarım, yapay zeka modelinin aldığı girdiye karşılık yanıt üretme aşamasını ifade ediyor; sohbet botları ve ajan tabanlı yapay zeka hizmetlerinde yanıt gecikmesi ile enerji verimliliği bu aşamanın en kritik performans ölçütleri arasında sayılıyor.

Şirketin paylaştığı Groq 3 LPX rafı, sıvı soğutmalı 32 adet 1U hesaplama tepsisinden oluşuyor. Her tepside 8 LPU bulunuyor, rafın tamamında ise 256 LPU yer alıyor.

Nvidia'nın açıklamasına göre her LPU 500MB SRAM ve saniyede 150TB SRAM bant genişliği sağlıyor. Raf düzeyinde ise çip üzerinde 128GB SRAM, saniyede 40PB SRAM bant genişliği, saniyede 640TB ölçeklenebilir bant genişliği ve FP8 işlemlerde 315PFLOPS performans rakamları paylaşıldı.

Nvidia, teknik blogunda Vera Rubin NVL72'nin büyük modellerdeki girdi işleme ve 'attention' hesaplamalarını üstlendiğini, Groq 3 LPX'in ise çıktı üretim sürecindeki gecikmeye duyarlı bölümü tamamladığını belirtti. Şirketin verdiği rakamlara göre iki donanımın birlikte kullanılması, trilyon parametreli modellerde megavat başına çıkarım işlem hacmini en fazla 35 kata kadar artırabiliyor.

Bu rakam Nvidia'nın kendi paylaştığı performans göstergesi; gerçek veri merkezi ortamında model yapısı, enerji koşulları, ağ mimarisi ve soğutma tasarımına göre değişebilir. Gelişme, yapay zeka altyapısındaki rekabetin tekil çip performansından raf düzeyinde sistem tasarımına kaydığını gösteriyor.

Çin kaynaklı haberlerde Groq 3 LPX'in çıktı hızının saniyede 3400 token olduğu aktarıldı; ancak Nvidia'nın basın bülteni ve teknik blogundaki ana tablolarda bu rakam doğrudan yer almıyor. Haberin ağırlık noktasını doğrulanmış raf düzeyi teknik özellikler ile üretim ve tedarik takvimi oluşturuyor.

Groq 3 LPX'in öne çıkmasının arkasında yapay zeka hizmetlerinin maliyet yapısı var. Büyük ölçekli modelleri işleten şirketler, hem eğitim için gereken işlem gücünü hem de kullanıcı taleplerini gerçek zamanlı karşılayan çıkarım maliyetini düşürmek zorunda.

Yapay zeka veri merkezlerinde genellikle GPU, CPU, ağ donanımı, bellek ve soğutma sistemleri tek bir bütün olarak çalışıyor. Çıkarım aşamasında darboğaz oluştuğunda pahalı işlem donanımı yeterince verimli kullanılamıyor, enerji ve veri taşıma maliyetleri de artıyor.

Nvidia'nın stratejisi de tam bu noktaya odaklanıyor. Şirketin Groq çip üretimini ve müşteri tedarikini hızlandırdığına ilişkin daha önceki haberlerde de vurgulandığı gibi, düşük gecikmeli çıkarım altyapısı, yapay zeka fabrikası kurma yarışının önemli bir ayağı haline geliyor.

Ancak Çin'e yönelik LPU tedariki konusu ayrı değerlendirilmeli. Nvidia daha önce Çin pazarında LPU satmadığını ve Çin'e özel bir LPU ürününün yol haritasında bulunmadığını açıklamıştı.

Nvidia CEO'su Jensen Huang(Jensen Huang), GTC 2026 açılış konuşmasında Groq çiplerinin üretimde olduğunu ve yılın ikinci yarısında, yaklaşık üçüncü çeyrekte sevkiyatın başlayabileceğini söyledi. Nvidia, Groq 3 LPX'in bu yılın ikinci yarısında Vera Rubin yapay zeka fabrikalarında kullanılabileceğini belirtti.

Türkiye ve bölgedeki pazarlarda ise bellek, sunucu, ağ ve soğutma bileşenleri tedarik zincirleriyle olası bağlantı merak konusu. Gerçek etkinin boyutu, Groq 3 LPX'in sevkiyat hacmi ve müşteri tarafından benimsenme hızı netleştikten sonra değerlendirilebilecek.

<Telif hakkı ⓒ TokenPost, yetkisiz çoğaltma ve yeniden dağıtım yasaktır >

Popüler

Diğer ilgili makaleler

Yorum 0

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.

0/1000

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.
1