OpenAI, yapay zekanın ürettiği 722 matematik çalışmasını yayınladı

OpenAI, yapay zekanın matematik alanındaki ilerlemesini gösteren yeni bir çalışma koleksiyonunu kamuoyuyla paylaştı. Şirket, henüz kullanıma sunmadığı dahili bir frontier model tarafından üretilen 722

OpenAI, yapay zekanın matematik alanındaki ilerlemesini gösteren yeni bir çalışma koleksiyonunu kamuoyuyla paylaştı. Şirket, henüz kullanıma sunmadığı dahili bir frontier model tarafından üretilen 722 matematik makalesini, toplam 372 sonuç ailesi altında GitHub'da yayınladı.

Bağımsız Advisory Group on Mathematics and Artificial Intelligence'ın (AGMAI) değerlendirmesine göre yayınlanan çalışmalar, matematik alanında çözümü uzun süredir bilinmeyen yüzlerce açık probleme yönelik sonuçlar içeriyor. Ancak çalışmaların matematik topluluğu tarafından incelenmesi ve doğrulanması gerektiğini belirtelim. OpenAI da koleksiyondaki sonuçların farklı doğrulama aşamalarında olduğunu ve henüz resmileştirilmemiş bazı çalışmaların hata içerebileceğini açıkça ifade ediyor.

Model yaklaşık 4 bin problem üzerinde çalıştı

OpenAI'ın aktardığına göre model, değerlendirme sürecinde yaklaşık 4 bin matematik problemiyle karşı karşıya bırakıldı. Bu çalışmaların sonuçları önem düzeylerine göre filtrelenerek 372 aile ve 722 makaleden oluşan mevcut koleksiyon ortaya çıkarıldı. Şirket, ortalama bir sonucun üretilmesi için kullanılan hesaplama gücünün yaklaşık üç saatlik ChatGPT Pro düşünme kapasitesine denk geldiğini belirtiyor.

OpenAI ayrıca modelin matematiksel sonuçlara nasıl ulaştığını daha şeffaf hale getirmek amacıyla 10 farklı problem için kısaltılmış akıl yürütme özetleri, kullanılan hesaplama gücüne ilişkin tahminler ve denenen problem sayıları gibi bilgileri de paylaştı. Bu örnekler arasında π sayısının irrasyonellik ölçüsü, Mahler varsayımları, Kaplansky'nin doğrudan sonluluk varsayımı ve üç boyutlu relativistik Vlasov-Maxwell sistemi gibi matematiğin farklı alanlarından problemler bulunuyor.

Matematiksel kanıtların bir kısmı Lean ile doğrulanıyor

OpenAI, yayınlanan kanıtların önemli bir bölümünü Lean adlı matematiksel doğrulama sistemiyle de kontrol etti. Lean, oluşturulan bir matematiksel ispatın mantıksal olarak geçerli olup olmadığının bilgisayar tarafından kontrol edilmesini sağlıyor. Bununla birlikte koleksiyondaki tüm çalışmaların henüz Lean doğrulamasına sahip olmadığını söyleyelim.

OpenAI, yeni biçimsel doğrulamalar tamamlandıkça GitHub deposunu güncellemeye devam edeceğini belirtiyor. Şirket ayrıca sonuçların büyük bölümünün aynı standart prosedürle üretildiğini, ancak bazı istisnalar bulunduğunu ifade ediyor. Örneğin Riemann zeta fonksiyonunun sıfırsız bölgesi üzerine yapılan çalışmalardan biri farklı bir süreçle elde edildi. Bu çalışmanın metni de okunabilirliği artırmak amacıyla insan tarafından düzenlendi.

Matematik dünyasında yapay zeka tartışmaları devam ediyor

OpenAI, paylaşım sürecini Princeton'daki Institute for Advanced Study bünyesinde oluşturulan bağımsız AGMAI grubuyla yaptığı görüşmeler doğrultusunda şekillendirdiğini belirtiyor. GitHub deposunda makalelerin nasıl güncelleneceğine ve nasıl kaynak gösterileceğine ilişkin kurallar da yer alıyor.

Ancak AGMAI'ın yaklaşımı yalnızca yapay zekanın matematikteki yeteneklerine odaklanmıyor. Grup, yapay zeka şirketlerinden matematiksel sonuçları mümkün olduğunca akademik kanallar üzerinden yayınlamalarını, kullanılan model, hesaplama maliyeti ve yöntemler konusunda daha fazla şeffaflık sağlamalarını istiyor. Ayrıca matematiksel keşiflerin modelleri pazarlamak için kullanılan bir araç haline getirilmemesi gerektiğini savunuyor. Bu nedenle OpenAI'ın paylaştığı 722 çalışma, yapay zekanın matematiksel akıl yürütme becerisinin geldiği noktayı gösterirken, yapay zeka tarafından üretilen bilimsel sonuçların nasıl doğrulanacağı, yayınlanacağı ve akademik literatüre nasıl dahil edileceği konusunda da dikkat çekici bir örnek olarak karşımıza çıkıyor.

OpenAI önümüzdeki dönemde yapay zeka tarafından elde edilen önemli matematiksel sonuçların anlaşılmasını desteklemek amacıyla atölye çalışmaları, konferanslar ve özel programlar da finanse edeceğini açıkladı. Şirket aynı zamanda bu çalışmaları üreten dahili modeli sorumlu bir şekilde kullanıma sunmak için çalışmalar yürüttüğünü belirtiyor.

Haberin devamını kaynağında oku

Yükleniyor...