Alibaba(BABA), Qwen4'ün resmi sürümünden önce yeni nesil mimariyi kullanan Qwen3.8-Flash-Next modelini Kore saatiyle 27 Ağustos'ta gece yarısı (00.00) tanıtacak.
BlockBeat'in aktardığına göre, ModelScope üzerinde Qwen3.8-Flash-Next için bir tanıtım sayfası yayına girdi. Yayın zamanı Çin saatiyle 26 Ağustos 23.00 olarak belirtildi; bu da Kore saatiyle 27 Ağustos 00.00'a denk geliyor.
Yeni model, Qwen4'ü çalıştıracak yeni nesil mimariye dayanan çok modlu (multimodal) bir ‘karma uzman’ (Mixture of Experts - MoE) modeli olarak tanıtıldı. Bu, Qwen4'ün resmi lansmanı anlamına gelmiyor; daha çok, geliştiricilerin ve topluluğun yeni yapıyı Qwen4 model ailesinden önce test edebileceği bir ‘teknik önizleme’ niteliğinde.
Çok modlu yapı, yalnızca metni değil görsel gibi farklı veri türlerini birlikte işleyebilen model mimarisini ifade ediyor. Karma uzman modelleri ise tüm parametreleri her seferinde kullanmak yerine, göreve göre yalnızca gerekli kısımları devreye sokarak büyük modellerin işlem maliyetini ve yanıt hızını dengelemeyi amaçlıyor.
Alibaba'nın burada öne çıkardığı şey ürün adından çok mimari. Şirketin, resmi Qwen4 çıkmadan yeni mimariyi paylaşarak sonraki model ailesi için geliştirme ortamını ve doğrulama sürecini öne çekmeyi hedeflediği yorumlanıyor.
BlockBeat, Alibaba'nın daha önce Qwen3-Next modelinde ‘Gated DeltaNet’ ile standart dikkat (attention) mekanizmasını birleştiren hibrit bir yapı sunduğunu, bu tasarımın ardından Qwen3.5 serisinin de aynı mimariyi sürdürdüğünü aktardı. Yeni duyuru da önce mimariyi paylaşıp ardından sonraki ürün ailesine yayma eğiliminin bir parçası olarak öne çıkıyor.
Alibaba'nın model tanıtım hızı da dikkat çekiyor. BlockBeat'e göre şirket, bu ayın başında 2,4 trilyon parametreli Qwen3.8-Max'i tanıttıktan sonra bir ay dolmadan yeni nesil mimarisini duyurdu.
TokenPost daha önce Alibaba'nın Qwen3.8 serisi modellerini açık kaynak olarak yayımladığını aktarmıştı. O haberde Qwen3.8-27B, 27 milyar parametreli, yerleşik çok modlu ‘yoğun’ (dense) bir model olarak tanıtılmıştı.
Yoğun modeller tüm parametreleri tutarlı biçimde kullanan bir yapıya sahipken, karma uzman modelleri belirli uzman ağlarını seçerek devreye alıyor. Dağıtım kolaylığı açısından yoğun modeller, büyük ölçekli model işletim verimliliği açısından ise karma uzman yapısı öne çıkarılıyor.
Açık model ekosisteminde geliştiriciler yalnızca performans göstergelerine değil; lisansa, ağırlıkların (weights) paylaşım biçimine, çıkarım (inference) maliyetine, uzun bağlam işleme kapasitesine ve çok modlu destek düzeyine de bakıyor. Qwen3.8-Flash-Next'in gerçekte hangi lisans, ağırlık ve karşılaştırma (benchmark) sonuçlarını sunacağı, 27 Ağustos'taki tanıtımın ardından netleşecek.
Yorum 0