OpenAI matematikte yeni bir eşik mi aştı? 722 çalışma birden yayımlandı
OpenAI'ın 6 Ekim'de yayımladığı yeni araştırma paketinde, yapay zekânın açık matematik problemleri üzerindeki performansını test etmek amacıyla yaklaşık 4 bin problem üzerinde çalıştırıldığı belirtildi.
Şirket, mevcut matematik testlerinin gelişmiş modeller için artık yeterince zorlayıcı olmaması nedeniyle daha karmaşık ve açık araştırma problemlerine yöneldiğini açıkladı.
722 ÇALIŞMA, 372 SONUÇ AİLESİ
OpenAI'ın GitHub üzerinden yayımladığı koleksiyonda toplam 722 matematik çalışması yer alıyor.
Çalışmalar 372 farklı sonuç ailesi altında sınıflandırıldı. Aynı aile içinde ana sonuçların yanı sıra alternatif ispatlar, sonuçların farklı uygulamaları ve tamamlayıcı çalışmalar da bulunabiliyor.
Şirket, bu nedenle yayımlanan 722 çalışmanın 722 ayrı matematik probleminin çözüldüğü anlamına gelmediğinin altını çiziyor.
MODEL YAKLAŞIK 4 BİN PROBLEMLE TEST EDİLDİ
OpenAI'ın verdiği bilgilere göre henüz kamuya açıklanmayan bir iç yapay zekâ modeli yaklaşık 4 bin matematik problemi üzerinde değerlendirildi.
Ortaya çıkan sonuçlar daha sonra önem ve benzerliklerine göre sınıflandırılarak 372 sonuç ailesi altında toplandı.
Şirket, çoğu sonuç için kullanılan hesaplama gücünün ortalama olarak yaklaşık üç saatlik ChatGPT Pro "thinking" süresine denk geldiğini belirtti.
BAZI SONUÇLAR BİLGİSAYARLA DOĞRULANDI
Yayımlanan çalışmaların önemli bir bölümünde Lean adı verilen matematiksel doğrulama sistemi kullanıldı.
Lean, matematiksel ispatların bilgisayar tarafından adım adım kontrol edilmesini sağlayan bir sistem olarak biliniyor.
OpenAI, koleksiyondaki birçok çalışmanın bilgisayar tarafından doğrulanabilen formal ispatlara sahip olduğunu ancak tüm çalışmaların henüz bu aşamadan geçmediğini açıkladı.
OPENAI'DAN ÖNEMLİ UYARI
Şirket, yayımlanan sonuçların tamamının kesin olarak doğru kabul edilmemesi gerektiğini de açıkça belirtti.
OpenAI'ın açıklamasına göre özellikle henüz formal olarak doğrulanmamış bazı çalışmalarda hata bulunması mümkün.
Şirket, matematik topluluğunun incelemeleri sonucunda ortaya çıkabilecek hataların düzeltilmesi için çalışmaların yeni sürümlerinin yayımlanacağını duyurdu.
DÜNYANIN ZOR MATEMATİK PROBLEMLERİ DE LİSTEDE
Yayımlanan araştırmalar arasında sayı teorisi, cebir, istatistiksel fizik, kuantum sistemleri ve bilgisayar bilimleri gibi farklı alanlarda çalışmalar bulunuyor.
Koleksiyonda Riemann zeta fonksiyonu, Mahler varsayımları, Kaplansky'nin doğrudan sonluluk varsayımı ve üç boyutlu relativistik Vlasov-Maxwell sistemi gibi ileri düzey matematik konularında üretilen sonuçlar da yer alıyor.
MATEMATİKÇİLER ŞİMDİ SONUÇLARI İNCELEYECEK
OpenAI, çalışmaların yayımlanma biçimi konusunda Institute for Advanced Study bünyesindeki bağımsız Matematik ve Yapay Zekâ Danışma Grubu ile görüş alışverişinde bulunduğunu açıkladı.
Yayımlanan yüzlerce sonucun gerçek matematiksel öneminin ve doğruluğunun ise bağımsız matematikçiler tarafından yapılacak incelemeler sonucunda daha net ortaya çıkması bekleniyor.
OpenAI'ın bu hamlesi, yapay zekânın yalnızca bilinen problemleri çözmekten çıkıp