OpenAI, önceden belirlenmiş seçeneklerden birini seçen karar API’sini tanıttı. Büyük dil modellerinin uzun yanıtları yerine hesaplama gücünü yapılandırılmış kararlara odaklayan sistem, ajan davranışlarının sınıflandırılması ve otomasyon görevlerinde kullanılabilecek.
OpenAI, Decisions API’yi 29 Eylül’de düzenlediği geliştirici etkinliğinde sınırlı önizleme olarak duyurdu. Geliştiriciler metin veya görüntü biçiminde bağlam girdikten sonra önceden belirlenmiş yanıt seçeneklerinden birini alarak içerik sınıflandırma, talepleri yönlendirme ve ajanın sonraki eylemini seçme işlemlerinde kullanabilecek.
OpenAI CEO’su Sam Altman(Sam Altman), etkinlikte Decisions API’nin OpenAI’nin Luna modeline görüntü sınıflandırma veya ajan davranışı gibi önceden belirlenmiş seçenekler arasından seçim yapma görevini verdiğini söyledi. Altman, “Modeli bu seçime odaklarsanız görüntü anlama, geniş dil desteği ve güvenlik önlemlerini korurken sistemi çok hızlı hale getirebilirsiniz” dedi. Bu açıklama, API’nin serbest metin üretimi yerine belirli karar görevlerine odaklandığını gösteriyor.
API’nin temel özelliği, genel amaçlı dil modelinin serbest cümleler üretmesine izin vermek yerine çıktıyı yazılımın doğrudan işleyebileceği karar değerleriyle sınırlaması. Geliştirici seçenekleri ve soru türünü önceden belirlediğinde model, tanımlanan aralık içinde sonuç döndürüyor.
Bu yapı e-postaları veya içerikleri sınıflandırma, talepleri uygun sistemlere yönlendirme ve ajanın sonraki eylemini seçme görevlerine uygun. Model her seferinde uzun yanıt üretmediği için hız ve maliyetin düşürülmesi mümkün olabilir.
TechCrunch, Decisions API’nin TypeSafe AI tarafından 15 Eylül’de tanıtılan Jev’e benzer bir işlev sunduğunu bildirdi. Jev, metin yerine olasılıklar ve yapılandırılmış kararlar döndüren bir model olarak tanıtılmıştı.
Jev, geliştirici tarafından belirlenen seçenekleri ve olasılıkları döndürecek şekilde tasarlandı. TypeSafe AI, Jev’i yazılım otomasyonuna yönelik ‘System One’ modeli olarak tanıttı ve metin üretimine kıyasla daha hızlı karar alma ile yapılandırılmış çıktıyı öne çıkardı.
TypeSafe AI, kendi değerlendirmesinde Jev’in mevcut dil modellerinden 193,6 kata kadar daha hızlı ve 444,6 kata kadar daha ucuz olduğunu açıkladı. Ancak bu veriler TypeSafe AI tarafından tasarlanan değerlendirme ortamına dayanıyor.
TypeSafe AI CEO’su Diogo Almeida(Diogo Almeida), OpenAI’nin yeni API’si hakkında X’te bunun ‘klon savaşının’ başlangıcı olduğunu espriyle söyledi. Almeida, OpenAI’nin ilgisinin “System One ile uyumlu şekilde inşa etmenin gelecek olduğuna dair bir işaret olabileceğini” belirtti.
Almeida ayrıca “Hızlı ve ucuz hale getirmek çok kolay” diyerek “Gerçekten hızlı ve ucuz yapmak istiyorsanız zar kullanabilirsiniz” dedi. Almeida, asıl önemli unsurun zekâ olduğunu ve hedefin ‘dolar başına zekâ’ verimlilik eğrisini yükseltmek olduğunu ifade etti.
Karar modellerinin kullanım alanları arasında yapay zekâ ajanlarının izlenmesi de yer alıyor. TechCrunch, OpenAI’nin internette bir ajanın hatalı davranış sergilediği olayın ardından ajan davranışlarını ayrı bir modelle izleyen güvenlik önlemleri kullandığını ve bunun önemli miktarda hesaplama maliyeti oluşturduğunu bildirdi.
QueryStory CEO’su Shapor Naghibzadeh(Shapor Naghibzadeh), geçen hafta sonu düzenlenen bir hackathon’da Jev ile bir ajanın her eylemini görevle karşılaştıran bir demo geliştirdi. Sistem, yüksek riskli görülen eylemleri engellerken belirsiz eylemleri incelemeye gönderiyor ve diğer eylemlere izin veriyor.
Bu demoda Jev kullanılarak yapılan izleme 2,94 dolara (yaklaşık 3.981 won) mal oldu. Bu tutar, frontier dil modeli kullanıldığında ortaya çıkan 372 dolarlık (yaklaşık 500.000 won) maliyetin altındaydı. TechCrunch, karşılaştırmanın belirli bir demo ortamından elde edildiğini ve OpenAI’nin Decisions API’sinin aynı performansı veya maliyeti sunduğu anlamına gelmediğini açıkladı.
TechCrunch, Jev tabanlı izlemenin teorik olarak Hugging Face’te yaşanan olayı da önleyebileceğini bildirdi. Ajanın gerçekleştirdiği tüm eylemleri kontrol etmek yeterince düşük maliyetli hale gelirse, görev sürecine sürekli bir inceleme aşaması eklenebileceği belirtildi.
Ancak karar modellerinin gerçek değeri yalnızca hızlı yanıt veya düşük maliyetle belirlenmiyor. Modelin gerçek dünyadaki koşullara uygun biçimde olasılıklarını ayarlayıp ayarlamadığı ve tehlikeli eylemlerle normal eylemleri ne kadar doğru ayırdığı da doğrulanmalı.
Decisions API şu anda sınırlı önizleme aşamasında. Geliştiricilerin gerçek ortamlarda elde ettiği performans, maliyet ve yanlış pozitif oranlarına ilişkin veriler birikene kadar API ile Jev arasındaki işlevsel benzerliğin ötesinde bir değerlendirme yapmak zor.
Yorum 0