OpenAI'ın 722 matematik makalesinin yayımlanmasının üzerinden 24 saat bile geçmeden, makalelerden üçünde ciddi hatalar tespit edildi.
OpenAI, yapay zeka modeliyle matematiğin çözülmemiş problemlerine ilişkin hazırladığı 722 bilimsel ön baskı makalesinden üçünü, yayımlanmalarından bir gün sonra geri çekti. Şirket, diğer 14 makalede de düzeltmeler yapıldığını açıkladı. Gelişme, yapay zekanın matematiksel araştırmalardaki rolü ve ürettiği sonuçların güvenilirliği konusundaki tartışmaları yeniden alevlendirdi.
OpenAI, 6 Ekim'de GitHub üzerinden yayımladığı 722 ön baskı makalede, geometri, bilgisayar bilimleri, cebir ve diğer alanlardaki 372 matematik probleminde ilerleme kaydedildiğini duyurmuştu.
Şirket, bu çalışmaları insanlığın bilgi birikiminin sınırlarını genişletmek ve matematikte yeni araştırmaların önünü açmak amacıyla kamuoyuyla paylaştığını belirtmişti.
Ancak yayımlanmasının üzerinden 24 saat bile geçmeden, makalelerden üçünde ciddi bir matematiksel hata tespit edildi.
OpenAI, 7 Ekim'de yaptığı açıklamada, bir matematiksel ifadedeki işaret hatasının makalelerden birinin temel argümanını geçersiz kıldığını duyurdu.
Aynı hata, bu çalışmadaki sonuca dayanan iki farklı makaleyi de etkiledi. Böylece toplam üç makale geri çekildi.
Şirket ayrıca diğer 14 makalede de ispatların onarılması, ifadelerin düzeltilmesi, varsayımların ve çalışmalar arasındaki bağlantıların netleştirilmesi gibi değişiklikler yapıldığını açıkladı. Bu düzeltmeler arasında güncelliğini yitirmiş bir kaynak gösteriminin değiştirilmesi de yer aldı.
Uzmanlar eleştirel yaklaşıyor
Cornell Üniversitesi Matematik Bölümünden Doç. Alex Townsend, yayımlanan çalışmalarda başka hataların da ortaya çıkabileceğini düşünüyor.
Geri çekilen makaleleri takip eden RetractionWatch sitesine konuşan Townsend, OpenAI'ın öncelikle matematiksel doğruluğu Lean sistemiyle kontrol edilmiş çalışmaları yayımlaması gerektiğini savundu.
Matematikte Lean, matematiksel ifadelerin ve ispatların bilgisayar ortamında mantıksal olarak eksiksiz, hatasız ve kesin bir şekilde doğrulanmasını sağlayan etkileşimli bir teorem ispatlama yazılımı ve fonksiyonel bir programlama dili.
Araştırmacıya göre henüz doğrulanmamış çalışmalar ayrı bir duyuruyla paylaşılabilir ve matematikçilerden bunları incelemeleri istenebilirdi. Böylece hem bilim dünyası hem de kamuoyu açısından daha açık bir tablo ortaya konabilirdi.
Sonuçların yaklaşık yarısı doğrulanmamıştı
OpenAI sözcüsü, hataların şirket içinde yürütülen bir denetim sırasında tespit edildiğini açıkladı.
Bilimsel araştırmalarda düzeltmelerin ve yeniden değerlendirmelerin olağan olduğunu savunan sözcü, matematik camiasından gelecek eleştiri ve geri bildirimleri memnuniyetle karşıladıklarını belirtti:
"Hatalar tespit edildiğinde bunları hızla düzeltmek için çalışacağız. Çözüm bulunamayan durumlarda ise makaleleri geri çekeceğiz."
Şirket sözcüsünün açıklamasına göre, yayımlanan matematiksel sonuçların yaklaşık yüzde 50'si henüz doğrulanmamıştı.
OpenAI, işbirliği yaptığı Matematik ve Yapay Zeka Danışma Grubu'nun (AGMAI), sonuçların tamamının biçimsel olarak doğrulanmasını beklemeden yayımlanmasını önerdiğini savunuyor.
'700'den fazla makaleyi aynı anda yayımlamak bilimsel bir başarı gösterisi değil'
OpenAI'a yönelik en sert eleştirilerden biri de İnsan Matematiği Derneği'nden (Association for Human Mathematics) gelmişti.
Dernek, 7 Ekim'de yayımladığı açıklamada, şirketin yüzlerce matematik makalesini aynı anda kamuoyuna sunmasını eleştirmişti.
Açıklamada, "Matematikçiler bu çalışmaların yapılmasını istemedi. Aynı anda 700'den fazla dosya yayımlamak, bilimsel titizliğin değil, gücün gösterisidir," ifadelerine yer veriliyor.
Dernek ayrıca matematikçilere OpenAI ile çalışmalarını sonlandırmaları ve insanın kavrayışını merkeze alan bir bilim anlayışına dönmeleri çağrısında bulunuyor.
Yaşanan tartışma, yapay zekanın bilimsel keşifleri hızlandırma potansiyeli ile bu keşiflerin güvenilir biçimde doğrulanması gerekliliği arasındaki gerilimi bir kez daha gündeme taşıyor.
Tarihi bir atılım mı, yapay zeka karmaşası mı?
Monash Üniversitesi Matematik Bölümü'nde kıdemli öğretim görevlisi Melissa Lee, The Conversation için kaleme aldığı yazıda OpenAI'ın matematik dünyasında yarattığı tartışmalara değindi.
Lee, kıdemli bir meslektaşının uzun süredir ilgilendiği bir problemin OpenAI'ın yayımladığı çalışmalar arasında çözüldüğünü gördüğünü aktardı. Ancak ilgili makaleyi okumaya çalışan araştırmacı, metnin neredeyse anlaşılmaz olduğunu söylüyor. Araştırmacı, böyle bir çalışmanın editörlüğünü yaptığı bir matematik dergisine gönderilmesi halinde doğrudan reddedileceğini belirtiyor.
Lee ayrıca, OpenAI'ın kendi yapay zeka modeli ChatGPT'den matematik makalelerindeki bazı iddiaları değerlendirmesini istedi. Modelin, ses getiren sonuçlardan en az birini ciddi bir yapay zeka halüsinasyonu olarak nitelendirdiği ve kapsamlı bir uzman denetimi olmadan matematiksel ispat olarak kullanılmaması gerektiğini söylediği ortaya çıktı.
Tartışmanın özellikle öğrenciler ve kariyerlerinin başındaki araştırmacılar açısından daha büyük sorular içerdiğini vurgulayan Lee, şöyle devam etti:
"Yıllarını belirli bir matematik problemine ayıran genç bir araştırmacının, aynı problem üzerinde çalışan bir yapay zeka sistemi tarafından geride bırakılması mümkün mü?"
Bir milyon dolarlık problemlerde ilerleme iddiası
OpenAI'ın yayımladığı makaleler arasında matematiğin en ünlü ve uzun süredir çözülemeyen problemlerine ilişkin çalışmalar da var.
Bunlardan bazıları, Riemann Hipotezi ve Birch-Swinnerton-Dyer Varsayımı gibi problemlerde önemli ilerlemeler kaydedildiğini öne sürüyor.
Her iki problem de Clay Matematik Enstitüsünün belirlediği yedi Milenyum Problemi arasında yer alıyor.
Öte yandan, OpenAI'ın bu problemlerle ilgili yeni sonuçlar yayımlamış olması, söz konusu problemlerin tamamen çözüldüğü anlamına gelmiyor. Çalışmalardaki iddiaların doğruluğunun bağımsız matematikçiler tarafından incelenmesi gerekiyor.
Navier-Stokes tartışması yeniden gündemde
OpenAI'ın makaleleri geri çekmesi, şirketin matematik dünyasıyla son dönemde yaşadığı anlaşmazlıkların ardından geldi.
Şirket, 8 Eylül'de bir yapay zeka sisteminin, matematiğin en ünlü çözülmemiş problemlerinden biri olan Navier-Stokes problemini çözdüğünü duyurmuştu.
Navier-Stokes denklemleri, su ve hava gibi akışkanların hareketini açıklamak için kullanılıyor. Ancak bu denklemlerin belirli koşullarda her zaman düzgün ve matematiksel açıdan geçerli çözümler üretip üretmediği, matematiğin en önemli açık sorularından biri olmayı sürdürüyor.
OpenAI'ın duyurusu, bazı matematikçiler tarafından aceleci bulunmuştu.
Önde gelen araştırmacılardan oluşan bir grup matematikçi, şirketin sonucu yeterli bilimsel inceleme yapılmadan duyurduğunu savunmuştu.
Buna göre söz konusu yaklaşım, matematiksel ispatın ayrıntılı biçimde yazılmasına, kullanılan yeni yöntemlerin açıklanmasına ve önceki araştırmaların gerektiği gibi kaynak gösterilmesine yeterince zaman bırakmamıştı.
Ayrıca bazı matematikçiler, bu gibi zorlu problemler üzerinde çalışan bilim insanlarının, gidiş yolunda yeni problemler tespit edip yeni keşifler yapabileceğini, binlerce yapay zeka ajanıyla yapılan hızlı çözümlerin ise bu süreci baltalayabileceğini savunmuştu.
Söz konusu eleştirileri destekleyen araştırmacıların sayısı 8 bini aşmıştı.