Çin merkezli yapay zeka şirketi Zhipu AI($02513.HK), kodlama performansını öne çıkaran yeni büyük dil modeli GLM-5.3'ü tanıttı. Şirket, kendi iç değerlendirmelerinde GLM-5.3'ün kodlama becerisinin önceki model GLM-5.2'ye kıyasla yüzde 50 arttığını açıkladı.
Zhipu AI'ın GLM-5.3'ü resmi olarak duyurduğunu Yicai aktardı. Yeni model, GLM-5.2 ile aynı temel (base) modeli kullanıyor; ancak şirket, eğitim sonrası ölçeklendirme (post-training scaling) çalışmalarıyla modelin zeka üst sınırını yükselttiğini belirtiyor.
Zhipu AI, GLM-5.3'ün Terminal Bench 3.0 ve Agents' Last Exam (CLI) gibi açık benchmark testlerinde açık kaynak modeller arasında birinci sırada yer aldığını duyurdu. Ancak benchmark sonuçları model performansını kıyaslamak için referans niteliğinde bir gösterge; gerçek geliştirme ortamındaki performans kullanım şekline ve araç entegrasyonuna göre değişebiliyor.
Bu duyuru, Çinli büyük dil modeli şirketlerinin kodlama ve ajan (agent) performansını öne çıkararak model rekabetini sürdürdüğü bir dönemde geldi. Zhipu AI'ın kendi açıklamalarında GLM-5.2, 16 Haziran'da tanıtılan en güncel amiral gemisi model olarak yer alıyordu; yani yaklaşık iki ay sonra yeni model duyurulmuş oldu. TokenPost daha önce GLM-5.3 ibaresinin Bing arama sonuçlarında bir süreliğine göründüğünü aktarmıştı.
Eğitim sonrası aşama (post-training), ön eğitimi tamamlanmış bir modele ek veri ve değerlendirme süreçleri ekleyerek belirli görevlerdeki performansını artıran bir adım olarak tanımlanıyor. Zhipu AI'ın bu duyuruda kodlama performansını ve CLI tabanlı ajan değerlendirmesini öne çıkarması da bu geliştirme yaklaşımıyla örtüşüyor.
Zhipu AI, GLM-5.3 duyurusundan iki hafta sonra model ağırlıklarını (model weights) açık hale getireceğini belirtti. Ağırlıklar paylaşıldığında geliştiriciler ve şirketler modeli doğrudan indirip inceleyebilecek veya kendi ortamlarında kullanım olanaklarını test edebilecek.
Yorum 0