AMD'nin (AMD) kendi geliştirdiği yapay zeka çıkarım motoru ATOM, şirket içinde kaynak dağılımı tartışmasının odağına oturdu. SemiAnalysis(SemiAnalysis), AMD'de bazı orta kademe yöneticilerin müşteri talebi sınırlı kalan ATOM projesine 20'den fazla mühendis atadığını öne sürdü.
SemiAnalysis, iddiayı 27'sinde saat 14.01'de (Kore saatiyle) yayımlanan bir X gönderisinde dile getirdi. Paylaşımın orijinal saat dilimi (UTC-8 olarak belirtiliyor) itibarıyla 27'sinde saat 13.01'i gösteriyordu; bu da Kore saatinden 1 saat geride.
SemiAnalysis, AMD içindeki mühendislerin bu sorunu dışarıya bildirdiğini belirtti. Bu kişiler, geliştirme kaynaklarının ATOM yerine Meta(Meta) ve xAI'nin kullandığı SGLang ve vLLM gibi çıkarım motorlarına ayrılması gerektiğini savundu.
ATOM, AMD'nin yapay zeka çıkarım motorunu ifade ediyor. Haberde geçen ATOM, kripto para Cosmos(ATOM) ile karıştırılmamalı.
SemiAnalysis, aralarında kıdemli mühendislerin ve AMD Fellow'larının da bulunduğu düzinelerce AMD çalışanının kendisiyle gizlice iletişime geçtiğini aktardı.
Bu kişiler, şirket içi politika ve bazı orta kademe yöneticilerin desteği nedeniyle endişelerini içeride tartışmanın 'zor' olduğunu anlattı. SemiAnalysis, ATOM'a atanan mühendislerin aslında vLLM ve SGLang gibi müşteri odaklı çıkarım motorlarının geliştirilmesinde görevlendirilmesi gerektiğini savundu.
Tartışmanın özünde, AMD'nin yapay zeka çip rekabetinin yalnızca donanımla değil yazılım ekosistemiyle de ölçülmesi yatıyor. Büyük dil modeli (LLM) çıkarımı, grafik işlem birimi (GPU) performansının yanı sıra istek zamanlamasını, önbellek yönetimini, çoklu GPU kullanımını ve açık kaynak çerçeve optimizasyonunu bir arada gerektiriyor.
SemiAnalysis, AMD'nin iç geliştirme kaynaklarının gerçek müşterilerin kullandığı çıkarım motorlarından çok kendi motoruna ayrıldığını iddia etti. Bu durum, ATOM'un fiili kullanım alanı ile açık kaynak çıkarım motoru desteğinin önceliği konusunda bir tartışmaya dönüştü.
SemiAnalysis'in kendi değerlendirmesi de farklı değil. Şirket, geçen haziran ayında yayımladığı bir analizde ATOM'un tek düğüm performansında bazı avantajlar gösterdiğini ama gerçek iş yüklerinin gerektirdiği özelliklerden yoksun olduğunu belirtmişti.
SemiAnalysis, ATOM'un üretim ortamında neredeyse hiç token işlemediğini, AMD'nin vLLM ve SGLang gibi açık kaynak çıkarım motorlarına verdiği desteğin de yetersiz kaldığını savundu. Gerçek müşterilerin kullandığı motorlar ile şirketin kendi motoru arasındaki öncelik sorunu, içeride hoşnutsuzluğu büyüttüğü aktarıldı.
AMD tarafının buna karşı Alibaba'nın (Alibaba) Qwen(Qwen) tabanlı kullanım örneğini gerekçe gösterebileceği yönünde haberler de çıktı. Ancak SemiAnalysis, yaptığı ek doğrulamada bu örneğin Alibaba'nın kurumsal iş biriminde sınırlı bir uygulamaya yakın olduğunu, Qwen'in asıl ekibinin ATOM kullandığı bir yapı olmadığını öne sürdü.
Yapay zeka çıkarım pazarında müşteri tercihini yalnızca çipin işlem gücü değil, geliştirici ekosistemi ve fiili kullanım örnekleri de etkiliyor. Nvidia(NVIDIA) ile sürdürülen yapay zeka hızlandırıcı rekabetinde de yazılım desteğinin kapsamı, donanım tedarik gücüyle birlikte değerlendiriliyor.
TokenPost daha önce AMD'nin Anthropic(Anthropic) ile AMD Instinct MI450 serisi GPU'ları AMD Helios rack-scale çözümüne yerleştirmek üzere stratejik bir ortaklık duyurduğunu aktarmıştı. O dönemki açıklamada ROCm yazılım geliştirmesini hızlandıracak çok yıllı bir iş birliği de yer almıştı.
Bu tartışma Türk okuyucular için de sadece iç kurumsal bir mesele değil. Yapay zeka altyapı maliyetleri ve GPU kullanım oranları, çıkarım motorlarının kararlılığına, dağıtım kolaylığına ve açık kaynak ekosistem desteğinin düzeyine göre değişebiliyor.
SemiAnalysis, müşterilerin fiilen kullandığı çıkarım motorlarına daha fazla mühendis ve iç GPU geliştirme kaynağı ayrılması gerektiğini savundu.
Yorum 0