Back to top
  • 공유 Paylaş
  • 인쇄 Yazdır
  • 글자크기 Yazı tipi Boyutu
URL kopyalandı.

OpenAI Codex'e 'Kalıcı Mod' Testi: Lansman Tarihi Henüz Belli Değil

Terminal oturumu ayarlayan bir dizüstü bilgisayar ve el / TokenPost.ai

OpenAI, kodlama ajanı Codex için uzun süreli çalışmayı hedefleyen bir kalıcı mod (Persistent mode) test ediyor. Kullanıcı durdurana kadar görevi sürdüren ve iş bittikten sonra takip görevleri de oluşturabilen bir yapı değerlendiriliyor.

WIRED, OpenAI'ın bu ayarı Codex CLI kod tabanına eklediğini ve bir OpenAI sözcüsünün özelliğin test edildiğini doğruladığını bildirdi. OpenAI, bu özelliği henüz geniş çapta kullanıma sunmadığını ve hemen çıkarma planı olmadığını açıkladı.

Testin özü, kodlama yardımcı aracının iş birimini kısa yanıtlardan uzun soluklu görevlere genişletmekte yatıyor. Şimdiye kadar kodlama ajanları kullanıcının talep ettiği işi yapıp sonucu döndüren araçlara yakındı; kalıcı mod ise görev durumunu devralıp bir sonraki adıma taşımaya odaklanıyor.

Şu anda Codex; uygulama, entegre geliştirme ortamı (IDE) uzantısı ve CLI üzerinde hedef ve başarı ölçütü belirlenen hedef modunu (Goal mode) sunuyor. OpenAI, bu özelliğin resmi olarak sunulduğunu 21 Mayıs'taki sürüm notlarında duyurdu.

Kalıcı mod bu sürecin bir sonraki adımı olarak okunuyor. Çünkü Codex, kullanıcının talebini işleyip görevi bitirmekle kalmıyor; oturum sınırlarını aşarak devam ettirebileceği takip görevleri de üretebiliyor.

WIRED'ın incelediği kod açıklamasında, görev bitse bile ajanın işinin bitmediğine dair bir talimat yer alıyor. Bu da kodlama ajanlarının tek komut yürüten araçlardan kalıcı görev yöneticisine benzer bir yapıya doğru dönüştüğünü gösteriyor.

OpenAI, yılın başından bu yana Codex'i uzun süreli görev platformuna dönüştürüyor. 2 Şubat'ta yayımlanan Codex uygulaması tanıtım yazısında, otomatik zamanlamaya göre arka planda çalışan otomasyonları (Automations) duyurdu; 14 Mayıs'ta ise mobil uygulamada aktif görevleri takip edip onaylama özelliğini tanıttı.

11 Haziran'da Ona (Ona) satın alımını duyuran OpenAI, Codex'e güvenli, kalıcı çalışma ortamı ve müşteri kontrollü bulut yürütme özelliği ekleyeceğini açıkladı. Bu adım, kodlama ajanlarının gerçek iş süreçlerinde kullanılabilmesi için yalnızca model performansının değil; çalışma ortamı, yetki onayı ve iş kayıtlarının da birlikte gerekli olduğu değerlendirmesine dayanıyor gibi görünüyor.

Bu değişim, yapay zeka ajanları arasındaki rekabetin model performansından kurumsal sistemlere kaydığı eğilimle örtüşüyor. Ajanların kurumsal iş süreçlerinde kullanılabilmesi için soruları yanıtlama becerisinden çok; görev durumunu koruma, gerektiğinde insan onayı alma ve yürütme sonuçlarını takip etme yeteneği önem kazanıyor.

Codex dışında da kalıcı otomasyon talebi büyüyor. OpenAI, 25 Ağustos'taki sürüm notlarında ChatGPT Work'teki zamanlanmış görevlerin Gmail, Slack ve GitHub güncellemelerine tepki verebildiğini yazdı.

Tepkiler ise karışık. GitHub'daki openai/codex deposunda açılan #35601 numaralı konuda, mevcut otomasyon araçlarının aynı oturumu periyodik olarak uyandırıp sürdürme yönteminin sınırları olduğu belirtildi.

#34657 numaralı konuda ise kalıcı bir hedefin 37 saatten uzun süre çalıştığı ve planı tekrar tekrar yinelediği kaydedildi. Bu da uzun çalışma süresinin her zaman kaliteli çıktı anlamına gelmediğine dair bir soru işareti oluşturuyor.

Güvenlik konusu da masada duruyor. OpenAI, 26 Ağustos'ta yayımladığı güvenlik dokümanında, modelin yeterli koruma önlemi olmadan güçlü, kalıcı ve iş birlikçi biçimde çalışması durumunda birden fazla bilgisayar sisteminde açık bulup bunları istismar edebileceğini belirtti.

Kalıcı ajanlar hem bir verimlilik aracı hem de denetim sistemleri için bir sınav haline geliyor. Çünkü ne kadar uzun süre çalışan bir ajan olursa, görev sınırlarının bulanıklaşması ya da yetki sınırlarının gevşemesi ihtimali de o kadar artıyor.

Dolayısıyla bu testin asıl anlamı 'sürekli çalışan yapay zeka' fikrinden çok, kontrol mekanizmalarında saklı. Codex'teki bir sonraki değişim, kullanıcının işi ne kadarına kadar devredeceğinin, hangi anda durdurulacağının ve hangi görevin onaylanması gerektiğinin ürün içinde ne kadar net ayrıştırılacağına bağlı.

Lansman tarihi henüz belirlenmedi. OpenAI, kalıcı modu test ettiğini doğruladı; ancak özelliği geniş çapta dağıtma ya da hemen piyasaya sürme planı olmadığını belirtti.

<Telif hakkı ⓒ TokenPost, yetkisiz çoğaltma ve yeniden dağıtım yasaktır >

Popüler

Diğer ilgili makaleler

Yorum 0

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.

0/1000

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.
1