Ne oldu?
OpenAI, henüz kullanıma sunmadığı dahili bir frontier model tarafından üretilen 722 matematik makalesini GitHub'da kamuoyuyla paylaştı. Çalışmalar, önem düzeylerine göre filtrelenerek 372 sonuç ailesi altında toplandı.
Model yaklaşık 4 bin problem üzerinde çalıştı
OpenAI'a göre model değerlendirme sürecinde yaklaşık 4 bin matematik problemiyle karşı karşıya bırakıldı. Şirket, ortalama bir sonucun üretilmesi için harcanan hesaplama gücünün yaklaşık üç saatlik ChatGPT Pro düşünme kapasitesine denk geldiğini söylüyor.
Doğrulama süreci sürüyor
Bağımsız Advisory Group on Mathematics and Artificial Intelligence (AGMAI) değerlendirmesine göre çalışmalar, matematikte çözümü uzun süredir bilinmeyen yüzlerce açık probleme yönelik sonuçlar içeriyor. Ancak OpenAI da sonuçların farklı doğrulama aşamalarında olduğunu ve henüz resmileştirilmemiş bazı çalışmaların hata içerebileceğini açıkça belirtiyor. Kanıtların önemli bir bölümü, matematiksel ispatların mantıksal geçerliliğini bilgisayar yardımıyla kontrol eden Lean sistemiyle doğrulandı; tüm çalışmalar için bu doğrulama henüz tamamlanmadı.



