Back to top
  • 공유 Paylaş
  • 인쇄 Yazdır
  • 글자크기 Yazı tipi Boyutu
URL kopyalandı.

DeepSeek API'de Kesinti Giderildi: V4 Flash Ajan Token Kullanımının Yüzde 70'ini Aldı

Sunucu odasının önünde hesap makinesi ve GPU rafları / TokenPost.ai (illustration)

DeepSeek(DeepSeek) API'si, 4'ünde (yerel saatle) sabah saatlerinde yaşanan geçici performans düşüşünün ardından yeniden çalışır hale geldi. Ajan (agent) görevlerinde V4 Flash modelinin kullanım payının yüksek olduğu bu dönemde, model performansının yanı sıra API işletim istikrarı da önemli bir değişken olarak öne çıktı.

DeepSeek, hizmet durumu sayfasında API performans sorununu çözdüğünü ve hizmeti yeniden başlattığını duyurdu. Şirket, aksaklığın tam olarak ne zaman başladığını, etki alanını ve hata oranını açıklamadı.

DeepSeek, 31 Temmuz'da V4 Flash API'sinin resmi sürümünü açık beta aşamasına geçirdiğini duyurmuştu. Resmi API dokümantasyonuna göre V4 Flash, Responses API formatını varsayılan olarak destekliyor ve Codex'e uyumlu şekilde ayarlanmış durumda.

Hugging Face(Hugging Face) model kartına göre V4 Flash, toplam 284 milyar parametreye ve 13 milyar aktif parametreye sahip bir uzman karışımı (Mixture of Experts, MoE) modeli. Bağlam uzunluğu 1 milyon token seviyesinde ve model ağırlıkları MIT lisansıyla kamuya açık şekilde paylaşıldı.

OpenRouter(OpenRouter), 30 Haziran'da yayımladığı blog yazısında, 2026 yılının 1 Ocak-14 Haziran döneminde 450 trilyon tokenin üzerindeki istek kayıtlarını analiz ettiğini açıkladı. Mayıs ayı sonu itibarıyla DeepSeek'in ajan iş yükü tokenleri arasında V4 Flash'ın payı yüzde 70 olarak ölçüldü. En düşük fiyatlı uç nokta (endpoint) maliyeti, 1 milyon token başına girdi için 0,09 dolar, çıktı için 0,18 dolar olarak paylaşıldı.

Geliştirici topluluğunda hız ve istikrar konusunda endişeler dile getirildi. Çinli geliştirici forumu LINUX DO'da paylaşılan bir kullanıcı ölçümüne göre, NVIDIA NIM üzerinde test edilen V4 Flash'ta 5 istekten yalnızca 1'i başarılı oldu ve çıktı hızı saniyede 12,8 token olarak kaydedildi. Bu veri resmi bir aksaklık istatistiği değil, bireysel bir kullanıcının test sonucu.

Yapay zeka API'leri; işlem botları, zincir üstü (on-chain) veri özetleme, geliştirme ve müşteri destek otomasyonu gibi alanlarda kullanılabiliyor. Çağrı gecikmelerinin veya hataların artması, bu altyapı üzerine kurulu hizmetlerin kalitesini de etkileyebilir.

TokenPost daha önce Çin menşeli yapay zeka modellerinin açık ağırlıklı (open-weight) yayılımı ve kullanım artışını haber yapmıştı. DeepSeek'teki bu son performans düşüşünün belirli bir kripto hizmetinde kesintiye yol açıp açmadığı doğrulanmadı.

<Telif hakkı ⓒ TokenPost, yetkisiz çoğaltma ve yeniden dağıtım yasaktır >

Popüler

Diğer ilgili makaleler

Yorum 0

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.

0/1000

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.
1