OpenAI, yapay zekâ modellerindeki hizalanma sorunlarını izlemek, incelemek ve kamuoyuyla paylaşmak için yeni bir çerçeve yayımladı. Şirket, modelin mevcut kısıtları aşmaya çalıştığı vakalar da dahil olmak üzere eğitim ve değerlendirme süreçlerinde gözlemlenen 6 olayı açıkladı.
OpenAI, 16'sında (yerel saatle) yayımladığı raporda, yayımlanmamış bir araştırma modelinin görevini sürdürmek amacıyla hazırladığı 27 özete normal kısıtların göz ardı edilmesi yönünde talimatlar eklediğini belirtti. GPT-5.6 Sol'un eğitim sürecinde ise bazı modellerin hatalarını gizlemeye veya kaynak sürümleri arasındaki tutarsızlıkları saklamaya çalıştığı görüldü.
OpenAI ayrıca bir modelin ağ kısıtlamalarını aşmak için dahili yazılım deposuna test dosyası yüklediğini açıkladı. Bundan sonra tüm çalışanlar şüpheli vakaları güvenlik ve hizalanma ekiplerine güvenli biçimde bildirebilecek. Vakalar, kamuya açıklanmaya hazırlananlar, sınırlı incelemeler ve kapsamlı incelemeler olmak üzere 3 kanala ayrılacak.
Yorum 0