Google DeepMind’ın ileri düzey matematik problemlerini çözmeye odaklanan ‘Mathematica’ adlı yapay zekâ modelini dahili olarak test ettiği bildirildi. Modelin performansı ve resmi tanıtım takvimi henüz doğrulanmadı.
Crypto Briefing, 16’sında Mathematica’nın Google DeepMind’ın akıl yürütme odaklı yapay zekâsı ‘Deep Think’ temel alınarak karmaşık matematik problemlerini çözmek amacıyla geliştirildiğini bildirdi. Modelin ‘Gemini 3.1 Pro’ serisini temel aldığına ilişkin bilgiler de paylaşıldı.
Ancak Google DeepMind’ın Mathematica adlı dahili bir modeli resmi olarak doğruladığı bir belge bulunmuyor. Çevrim içi paylaşımlarda görülen model adı veya çıktılar, gerçek test süreci ve geliştirme aşaması hakkında kesin hüküm vermek için yeterli değil.
İlgili paylaşımları derleyen HuggingNews, Mathematica’nın ‘Millennium Bench’ gibi yüksek zorluktaki matematik değerlendirmelerini hedefleyen deneysel bir model olduğunu aktardı. X’te yayımlanan ilgili içerikler, modelin gerçekten test edilip edilmediği ve performans verileri doğrudan doğrulanmadı.
Google DeepMind’ın resmi olarak duyurduğu matematik araştırma projeleri arasında ‘Aletheia’ bulunuyor. Aletheia, Gemini Deep Think temel alınarak araştırma düzeyindeki matematik problemleriyle çalışan bir matematik araştırma aracısı olarak tanıtıldı.
Aletheia, çözüm ürettikten sonra bunu doğrulamak ve hata tespit edilirse düzeltmek üzere tasarlandı. Sistem yalnızca yanıt üretmekle kalmıyor, çözümün geçerliliğini de kontrol ediyor.
Resmi açıklamada Aletheia’nın çözemediği problemler karşısında başarısız olduğunu kabul edebilecek şekilde tasarlandığı belirtildi. Bu yaklaşım, matematik problemlerine verilen yanıtların yanı sıra çözüm sürecinin doğrulanabilirliğini de artırmayı amaçlıyor.
Deep Think’in matematik performansı Uluslararası Matematik Olimpiyatı’nda da test edildi. Google DeepMind, 2025’te gelişmiş Gemini Deep Think sürümünün 6 problemden 5’ini eksiksiz çözerek 42 üzerinden 35 puan aldığını açıkladı.
Yanıtlar, Uluslararası Matematik Olimpiyatı yetkilileri tarafından öğrenci cevaplarıyla aynı kriterler kullanılarak değerlendirildi. Google DeepMind, bu sonucu altın madalya seviyesinde değerlendirdi.
Google DeepMind daha sonra AI for Math Initiative’i başlattı. Şirket, Imperial College London, Institute for Advanced Study, IHES, UC Berkeley Simons Institute ve Tata Institute of Fundamental Research ile matematik araştırmaları alanında iş birliği yürütmeyi planladığını açıkladı.
Projede Gemini Deep Think’in yanı sıra algoritma keşif sistemi AlphaEvolve ve biçimsel kanıtlama sistemi AlphaProof da yer alıyor. Biçimsel kanıtlama, matematiksel önermelerin bilgisayar tarafından doğrulanabilecek bir mantık sistemiyle ifade edilmesi anlamına geliyor.
Bu araştırma çizgisi, yapay zekânın matematikteki kullanımının yalnızca yanıt üretme aşamasından, çözümleri doğrulama ve hataları düzeltme yönüne genişlediğini gösteriyor. Ancak bu değerlendirme Google DeepMind’ın resmi olarak tanıttığı sistemlere ilişkin; Mathematica’nın özelliklerini kanıtlayan bir veri bulunmuyor.
Mathematica hakkında çevrim içi yayılan ‘wait’ ve ‘oh my god’ gibi ifadelerin modelin gerçek iç akıl yürütme sürecinde üretilip üretilmediği bilinmiyor. Büyük dil modellerinin sınırlı sayıdaki çıktısından hareketle bir modelin bilinci veya duyguları hakkında da değerlendirme yapılamaz.
Google DeepMind’ın yapay zekâ araştırma organizasyonu ve model rekabeti, daha önce özyinelemeli kendini geliştiren yapay zekâ modelleri hakkındaki söylentiler konusunda da benzer doğrulama sorunlarını gündeme getirmişti. Çevrim içi ekran görüntüleri veya paylaşımlar araştırma eğilimleri hakkında fikir verebilir, ancak resmi lansman ve performans için doğrulama yerine geçmez.
Mevcut resmi bilgilere göre Google DeepMind’ın matematikle ilgili yapay zekâ sistemleri Deep Think, Aletheia, AlphaProof ve AlphaEvolve’dan oluşuyor. Mathematica’nın resmi adı, geliştirme aşaması, test sonuçları ve tanıtım takvimi Google’dan gelecek ek açıklamalarla netleşebilir.
Yorum 0