Tencent(Tencent) bünyesindeki Hunyuan post-training ekibinden bir ismin WeChat'in WeLM ekibine geçmesiyle, uygulamanın yapay zeka ajanı çalışmalarının hangi yöne evrildiği daha net görülüyor. WeChat artık sohbet botunun ötesine geçip, uygulama içi işlevleri ve mini programları doğal dille çalıştırabilen bir yapay zekaya odaklanıyor.
动察 Beating adlı kaynağın aktardığına göre, Tencent Hunyuan'da kıdemli araştırmacı olarak görev yapan Can Xu kısa süre önce WeChat'in WeLM ekibine geçerek büyük dil modeli ar-ge çalışmalarını üstlendi. Yao Shunyu'nun Hunyuan büyük dil modeli ar-ge sorumluluğunu devralmasından önce, Hunyuan LLM post-training sürecinin bir kolunu yöneten kişi olarak tanıtılıyor.
Post-training, ön eğitimi tamamlanmış büyük dil modelinin talimat takibi, diyalog ve araç kullanımı gibi gerçek servis amaçlarına uyacak şekilde ince ayarlandığı aşama. WeChat'in yapay zekayı uygulama içi işlev çağrıları ve mini program kontrolüyle bağdaştırabilmesi için, modelin kullanıcı niyetini anlayıp çok adımlı süreçleri yönetebilmesi gerekiyor. Bu geçişin ajan araştırmasıyla birlikte okunmasının nedeni de bu.
Can Xu'nun ismi Microsoft(MSFT) tarafından yürütülen WizardLM projesiyle de anılıyor. Microsoft Research'ün WizardLM makale sayfasında Can Xu, yazar listesinin başında yer alıyor; makale Evol-Instruct yöntemiyle mevcut talimatların daha karmaşık talimat verisine dönüştürülmesini anlatıyor. 动察 Beating de Can Xu'nun uzun süredir sentetik veri, talimat eğitimi ve büyük dil modeli post-training konularında çalıştığını belirtti.
WeChat'in iş ilanları da aynı yöne işaret ediyor. Yayımlanan ilanlarda WeLM ekibinin akıl yürütme optimizasyonu ve ajan araştırması için personel aradığı, genel amaçlı Long-Horizon LLM Agent eğitim stratejisini kapsayan pozisyonların da bulunduğu görülüyor. Bu da uzun görevleri çok adıma bölerek yürüten ajan yeteneğinin, model eğitimi aşamasında ele alınacağı anlamına geliyor.
Ürün tarafında da hareketlilik var. WeChat'in resmi geliştirici kanalı 8 Haziran'da yayımladığı geliştirici erişim kılavuzunda, WeChat AI'ın iç test aşamasında olduğunu ve mini program geliştiricilerinin otomatik mod ile geliştirme modu üzerinden WeChat AI ekosistemine erişebildiğini duyurdu. Otomatik modda platform, mini programın kaynak kodunu ve ekranlarını analiz ederek yapay zekanın doğrudan işlem yapmasına izin veriyor. Geliştirme modunda ise geliştiriciler ayrı işlevler oluşturuyor, bunlar değerlendirme ve incelemeden geçtikten sonra yapay zeka tarafından çağrılabiliyor.
WeChat'in kendi yapay zeka asistanı Xiaowei de küçük ölçekli test aşamasına girdi. Tencent müşteri hizmetleri, Xiaowei'nin metin veya sesli komutlarla WeChat'in temel işlevlerini çalıştırabildiğini ve mini programları çağırabildiğini açıkladı. Açıklanan bilgilere bakılırsa Xiaowei, ayrı bir uygulamadan çok, WeChat içindeki işlevleri doğal dille birbirine bağlayan bir giriş noktası gibi konumlanıyor.
Model araştırmaları da paralel yürüyor. Tencent WeChat AI ekibinin paylaştığı Hidden Decoding deposuna 7 Temmuz'da WeLM-HD4-80B ve WeLM-HD4-617B sonuçlarının eklendiği belirtiliyor. Bu depo, aynı transformer iskeletini korurken token başına gizli hesaplama miktarını artıran bir yaklaşımı tanıtıyor.
Buradaki dikkat çekici nokta, Çin'deki büyük platformların yapay zekayı ayrı bir servis olarak değil, mevcut mesajlaşma ve mini program ekosistemi içine yerleştirmesi. Yayınımız daha önce Çinli yapay zeka şirketlerinin temel model rekabetinde kalmayıp ağırlığı çalıştırma katmanına kaydırdığı gelişmeyi aktarmıştı. Şu an için doğrulanabilen kısım, WeChat'in WeLM, post-training ve ajan eğitim stratejisini birlikte ele aldığı noktasında.
Doğrulanan kaynaklar: BlockBeats orijinal haberi, Microsoft Research WizardLM, Tencent Hidden Decoding GitHub, IT之家 WeChat AI geliştirici kılavuzu haberi, IT之家 Xiaowei haberi
Yorum 0