İçeriğe geç
Sıfırıncı Dakika
Son haberler

OpenAI, yapay zekânın ürettiği 722 matematik çalışmasını yayınladı

Yapay ZekâYeni1 dk okuma
OpenAI, yapay zekânın ürettiği 722 matematik çalışmasını yayınladı

Kısaca

OpenAI, henüz kullanıma sunmadığı dahili bir frontier modelin ürettiği 722 matematik makalesini 372 sonuç ailesi altında GitHub'da yayınladı. Bağımsız AGMAI grubunun değerlendirmesine göre çalışmalar uzun süredir açık olan yüzlerce probleme yönelik sonuçlar içeriyor, ancak matematik topluluğu tarafından doğrulanmaları gerekiyor. OpenAI bazı kanıtların Lean ile kontrol edildiğini, koleksiyonun eksi

  • Dahili frontier model tarafından üretilen 722 matematik makalesi
  • 372 sonuç ailesi altında GitHub'da kamuya açık koleksiyon
  • Yaklaşık 4 bin problem üzerinde değerlendirme
  • Ortalama sonuç için ~3 saatlik ChatGPT Pro düşünme kapasitesine denk hesaplama
  • Kanıtların bir bölümü Lean ile biçimsel doğrulama
  • 10 problem için akıl yürütme özeti ve hesaplama tahmini paylaşımı

Ne oldu?

OpenAI, henüz kullanıma sunmadığı dahili bir frontier model tarafından üretilen 722 matematik makalesini GitHub'da kamuoyuyla paylaştı. Çalışmalar, önem düzeylerine göre filtrelenerek 372 sonuç ailesi altında toplandı.

Model yaklaşık 4 bin problem üzerinde çalıştı

OpenAI'a göre model değerlendirme sürecinde yaklaşık 4 bin matematik problemiyle karşı karşıya bırakıldı. Şirket, ortalama bir sonucun üretilmesi için harcanan hesaplama gücünün yaklaşık üç saatlik ChatGPT Pro düşünme kapasitesine denk geldiğini söylüyor.

Doğrulama süreci sürüyor

Bağımsız Advisory Group on Mathematics and Artificial Intelligence (AGMAI) değerlendirmesine göre çalışmalar, matematikte çözümü uzun süredir bilinmeyen yüzlerce açık probleme yönelik sonuçlar içeriyor. Ancak OpenAI da sonuçların farklı doğrulama aşamalarında olduğunu ve henüz resmileştirilmemiş bazı çalışmaların hata içerebileceğini açıkça belirtiyor. Kanıtların önemli bir bölümü, matematiksel ispatların mantıksal geçerliliğini bilgisayar yardımıyla kontrol eden Lean sistemiyle doğrulandı; tüm çalışmalar için bu doğrulama henüz tamamlanmadı.

Şeffaflık ve akademik yayın tartışması

OpenAI, 10 farklı problem için kısaltılmış akıl yürütme özetleri, hesaplama gücü tahminleri ve denenen problem sayıları gibi bilgileri de paylaştı. Örnekler arasında π sayısının irrasyonellik ölçüsü, Mahler varsayımları, Kaplansky'nin doğrudan sonluluk varsayımı ve üç boyutlu relativistik Vlasov-Maxwell sistemi yer alıyor. AGMAI ise yapay zekâ şirketlerinden sonuçları mümkün olduğunca akademik kanallardan yayınlamalarını, kullanılan model, maliyet ve yöntem konusunda daha şeffaf olmalarını ve matematiksel keşifleri pazarlama aracına dönüştürmemelerini istiyor.

Bundan sonra ne olacak?

OpenAI, yeni biçimsel doğrulamalar tamamlandıkça GitHub deposunu güncelleyeceğini ve yapay zekâ kaynaklı önemli matematiksel sonuçların anlaşılması için atölye, konferans ve özel programları finanse edeceğini açıkladı. Şirket ayrıca bu çalışmaları üreten dahili modeli sorumlu biçimde kullanıma sunmak için çalıştığını belirtiyor.

Neden önemli?

Yapay zekânın bilimsel üretimde geldiği noktayı ve bu üretimin nasıl doğrulanacağı tartışmasını tek haberde görmek isteyen okurlar için önemli bir eşik.

Kaynaklar

İlgili haberler