LLM Token Index zirvesinden %52 gerilerken GPU kiralama ücretleri yükseldi. Bu tablo, yalnızca token fiyatlarına bakarak yapay zekâ talebinde yavaşlama olduğu sonucuna varmayı zorlaştırıyor.
Silicon Data, 24’ünde LLM Token Index’in 28 Mayıs’taki 2,07 dolardan 21 Eylül’de 1 dolara gerilediğini açıkladı. Endeks, API kullanıcılarının 1 milyon token işlemek için gerçekte ödediği fiyatı kullanım miktarına göre ağırlıklandırıyor.
LLM Token Index, token kullanımını veya yapay zekâ hizmetlerine yapılan toplam harcamayı doğrudan ölçmüyor. Bu nedenle yalnızca fiyat değişimlerine bakarak model kullanımını ya da yapay zekâ sektörünün kârlılığını değerlendirmek zor.
Silicon Data ayrıca endeksin ocaktan mayıs ayındaki zirveye kadar %67 yükseldiğini belirtti. Son düşüş tek başına zayıflık işareti gibi görünse de yıl başından bu yana fiyat hareketlerinde hem yükseliş hem de gerileme görüldü.
Son düşüş, daha fazla görevin ucuz ve hızlı modellere kaymasıyla açıklandı. Yapay zekâ araştırma laboratuvarlarının orta seviye modelleri art arda piyasaya sunması da kullanıcıların seçeneklerini artırdı.
Token fiyatı, modelin performansını ve kullanım amacını tek başına yansıtmıyor. Silicon Data, yalnızca endekse bakarak model değişimini daha verimli yapay zekâ ajanlarının görev dağılımından ayırmanın zor olduğunu ifade etti.
Aynı fiyat düşüşü, kullanımın azalmasından veya talebin daha ucuz modellere kaymasından kaynaklanabilir. Bu nedenle token başına fiyat ile toplam token kullanımının ayrı ayrı izlenmesi gerekiyor.
Buna karşılık GPU kiralama piyasasında fiyatlar yükseldi. Süper ölçekli olmayan bulut sağlayıcılarında H200 kiralama ücreti, haziran ayındaki saatlik ortalama 2,87 dolardan (yaklaşık 3.918 won) 24’ünde 3,29 dolara (yaklaşık 4.491 won) çıktı.
H200 kiralama ücreti 19 Eylül’de saatlik 3,32 dolara (yaklaşık 4.532 won) kadar yükseldi. Bu belirli bir tarihteki fiyat olsa da haziran ortalamasıyla karşılaştırıldığında kiralama ücretlerindeki artış eğilimi görülüyor.
B200 kiralama ücreti 24’ü itibarıyla saatlik 5,76 dolar (yaklaşık 7.862 won) oldu ve aynı döneme göre %7 arttı. Yıl başıyla karşılaştırıldığında artış %31’e ulaştı.
Nisan sonunda piyasaya çıkan B300’ün kiralama ücreti de o tarihten sonra %44 yükseldi. H200, B200 ve B300 dahil farklı GPU nesillerinde kiralama ücretlerinin artması, token fiyatlarıyla hesaplama kaynaklarının maliyetlerinin aynı yönde hareket etmeyebileceğini gösterdi.
Silicon Data’nın göstergeleri, yapay zekâ modellerini çalıştırmak için gereken hesaplama kaynaklarının fiyat hareketini ortaya koyuyor. Token fiyatları ve GPU kiralama ücretleri ayrı endekslerle hesaplandığından hizmet kullanım fiyatı ile hesaplama kaynaklarının maliyeti birbirinden ayrılarak incelenebiliyor.
TokenPost daha önce, yapay zekâ modeli çağrı talebi artsa bile token harcamalarındaki artışın kullanım artışının altında kalabileceğini bildirmişti. Ortalama fiyatın düşmesi hâlinde çağrı sayısı artsa da toplam harcama aynı oranda yükselmeyebilir.
Silicon Data, 24’ünde yayımladığı analizde yapay zekâ ajanlarının geniş ölçekte kullanılması hâlinde toplam tokenların daha büyük bölümünün ucuz ve hızlı modeller tarafından işlenebileceğini öngördü. Bu durumda token fiyatları düşerken toplam token kullanımı önemli ölçüde artabilir.
Silicon Data, aynı analizde yüksek katma değerli görevlerin hâlâ en gelişmiş modellere yoğunlaşabileceğini belirtti.
Silicon Data, yapay zekânın yaygınlaşmasıyla hesaplama talebinin azalmak yerine artma ihtimalinin bulunduğunu ifade etti.
Bununla birlikte yalnızca GPU kiralama ücretlerindeki artışa bakarak yapay zekâ talebinin toplam boyutu kesin olarak belirlenemez. Söz konusu göstergeler belirli GPU’lar ile token fiyatlarındaki değişimleri ortaya koyuyor; gerçek kullanım miktarını ve şirketlerin harcamalarını doğrudan hesaplamıyor.
Yorum 0