Back to top
  • 공유 Paylaş
  • 인쇄 Yazdır
  • 글자크기 Yazı tipi Boyutu
URL kopyalandı.

%75'e kadar maliyet düşüşü: TrueForge tanıtıldı

Maliyet karşılaştırma tablosu ve örnek notların bulunduğu bir geliştirici çalışma masası / TokenPost.ai

TrueFoundry, açık kaynaklı ajan altyapısı 'TrueForge'u duyurarak kurumsal yapay zeka ajanı görevlerinin maliyetini aynı modelle yaklaşık yüzde 30, açık kaynaklı model kullanıldığında ise yaklaşık yüzde 75'e kadar düşürdüğünü açıkladı.

Şirket, 19'unda (yerel saatle) TrueForge'u tanıtırken ürünü 'satıcıdan bağımsız bir çalıştırma katmanı' olarak öne çıkardı. TrueFoundry, TrueForge'u büyük dil modellerinin (LLM) gerçek işleri yürütmesini sağlayan; model çağırma, araç bağlantısı, sandbox çalıştırma, onay süreçleri, bağlam yönetimi ve oturum durumunu tek çatı altında toplayan bir çalışma zamanı olarak tanımlıyor.

TrueForge; sohbet arayüzü, HTTP API, TypeScript SDK ve gömülebilir arayüz SDK'sı biçiminde sunuluyor. Proje deposunda bir benchmark klasörü ve MIT lisansı bulunuyor.

Ayrıntılı karşılaştırmada, 14 kurumsal görevde Claude Managed Agent ile TrueForge kıyaslandı. Aynı Opus 4.8 modeli kullanıldığında Claude Managed Agent ortalama 10,7 görevi tamamladı ve tek çalıştırma maliyeti 11,8 dolar oldu.

Aynı Opus 4.8 koşulunda TrueForge de ortalama 10,7 görevi tamamlarken tek çalıştırma maliyeti 8,6 dolar olarak ölçüldü. GLM-5.2 modeliyle çalışan TrueForge ise ortalama 11,7 görev tamamlayıp tek çalıştırma başına 3,0 dolar maliyet gösterdi.

TrueFoundry, ölçümlerin aynı araçlar, aynı sistem promptu ve her seferinde yeni oturum koşuluyla n=3 tekrarın ortalaması alınarak yapıldığını belirtti. Sonuçların bağımsız bir LLM değerlendiricisi tarafından puanlandığı ifade edildi.

Maliyet farkı yalnızca model fiyatlandırmasından kaynaklanmıyor. Aynı model karşılaştırmasında bile maliyetlerin değişmesi, ajan döngüsünün ne kadar az ve ne kadar hafif çalıştığının da maliyet yapısını etkilediğini gösteriyor.

Ajan altyapıları, geliştiricinin yalnızca prompt gönderdiği araçlardan farklı işliyor. Dosya okuyan, dış araçları çağıran, gerektiğinde insan onayını bekleyen ve uzun süreli görev durumunu koruyan bir katman söz konusu.

Bu gelişme, temel model rekabetinin ötesine geçip ağırlığın gerçek iş yürütme katmanına kaydığı eğilimle örtüşüyor. Kurumsal yapay zeka ajanlarında yalnızca model performansı değil; araç erişim kapsamı, bağlam kurgusu, yeniden deneme yöntemi ve onay akışı da işletim maliyetini ve kontrol düzeyini birlikte belirliyor.

TokenPost daha önce, kurumsal yapay zeka ajanı denemelerinde çalıştırma yapısının görev başına maliyeti değiştirebildiği bir örneği de haberleştirmişti. O haberde Writer, Palmyra X6'nın görev başına maliyetini yüzde 52 düşürdüğünü açıklamıştı.

TrueFoundry'nin tanıtım sayfası TrueForge'u '%50 daha düşük maliyet' ifadesiyle özetliyor. Ancak ayrıntılı karşılaştırma, aynı model kıyaslamasında yaklaşık yüzde 30, GLM-5.2 kıyaslamasında ise en fazla yaklaşık yüzde 75 gibi koşula bağlı farklı rakamlar veriyor.

Tek bir rakamı bağlamından koparıp okumak gerçek koşulları gözden kaçırabilir. Aynı modelin mi kullanıldığı, açık kaynaklı modele mi geçildiği, görev başına araç çağrısı sayısı ve bağlam uzunluğu gibi etkenlere göre maliyet tasarrufu değişebiliyor.

TrueForge deposu, yayınlanmasının hemen ardından GitHub'da yaklaşık 1900 yıldız ve 129 fork topladı. Geliştirici camiasındaki ilk ilginin gerçek olduğu görülüyor, ancak bu durum doğrudan satışa dönüşeceği veya kurumsal kullanımın hızla yaygınlaşacağı anlamına gelmiyor.

Karşılaştırmada DevRev'in kamuya açık Enterprise-Bench L1-L2 verileri kullanıldı. İlgili depo, 2026 yılının Temmuz ayında yayınlanan, 14 kurumsal yapay zeka ajanı görevinden oluşan bir karşılaştırma seti olarak tanımlanıyor.

Şu anki tasarruf oranları TrueFoundry'nin kendi yayınladığı karşılaştırma sonuçlarına dayanıyor. Gerçek müşteri ortamlarında model seçimi, bağlam uzunluğu, araç çağrısı sayısı, sandbox kullanımı ve trafik örüntüsüne göre maliyetler farklılaşabilir.

<Telif hakkı ⓒ TokenPost, yetkisiz çoğaltma ve yeniden dağıtım yasaktır >

Popüler

Diğer ilgili makaleler

Yorum 0

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.

0/1000

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.
1