OpenAI, salı günü, kurum içinde kullanılan ve kamuya açık olmayan bir yapay zekâ modelinin ürettiği 722 matematik el yazmasını, 372 “sonuç ailesi” altında toplayarak yayımladı. Şimdi gözler, bu paylaşımın yeni açıklanan yayın ilkelerine ne kadar uyduğunu değerlendirecek matematik camiasında.
Öne çıkanlar:
- OpenAI, kamuya kapalı bir dahili modelin ürettiği 722 el yazmasını 372 aile halinde GitHub’da yayımladı.
- Bağımsız matematikçi danışma grubu, rolünün ne sonuçlara not vermek ne de OpenAI sürecini onaylamak olduğunu vurguladı.
- Şirket, bilgisayar destekli biçimde resmen denetlenmemiş bazı sonuçlarda hata ya da sorun olabileceğini kabul ediyor.
OpenAI'nin matematik hamlesi
Şirket, koleksiyonu kamuya açık bir GitHub deposunda, her makalenin nasıl güncelleneceği ve nasıl atıf yapılacağına dair kurallarla birlikte paylaştı. Depoda, ana sonucu; tamamlayıcı argümanlar, sonuçlar ya da alternatif ispatlarla birlikte gruplayan “aileler” temelinde düzenlenmiş 372 aile içinde 722 el yazması listeleniyor. OpenAI, modele yaklaşık 4.000 problem sunduğunu, sadece “yeterince kayda değer” bulduğu çıktıları sakladığını belirtiyor.
Şirket verilerine göre, her bir sonuç ortalamada yaklaşık üç saatlik ChatGPT Pro hesaplama süreci gerektirdi. İspatların önemli bir kısmı, matematiksel ispatların bilgisayar tarafından doğrulanmasına imkân veren Lean adlı programlama dilinde de sunuluyor.
OpenAI, Lean ile biçimsel kontrolü yapılmamış sonuçlarda hata veya tutarsızlık olabileceğine özellikle dikkat çekiyor.
Danışma grubundan temkinli mesaj
İleri Araştırmalar Enstitüsü (Institute for Advanced Study) çatısı altında, ücret almadan görev yapan dokuz matematikçiden oluşan Matematik ve Yapay Zekâ Danışma Grubu, yayımladığı açıklamada, rolünün ne ortaya çıkan sonuçları notlandırmak ne de OpenAI’nin sürecine kefil olmak olduğunu yineledi. Gruba göre, şirketin kendi tavsiyelerine ne ölçüde uyduğunu değerlendirecek tek merci, geniş matematik camiası.
29 Eylül tarihli tavsiyelerde; yapay zekâ laboratuvarlarının önceki çalışmaları açıkça kaynak göstermesi, ispatları klasik akademik makale üslubunda yazması, kullanılan girdileri (prompt), akıl yürütme özetlerini ve hesaplama maliyetlerini açıklaması isteniyor. Öneriler, sonuçların ayrıca hiçbir yapay zekâ laboratuvarının kontrolünde olmayan akademik arşivlerde saklanmasını da şart koşuyor. OpenAI, GitHub dışında topluluk tarafından barındırılan alternatifleri hâlâ araştırdığını ve büyük yapay zekâ sonuçlarına odaklanacak çalıştayları fonlayacağını söylüyor.
Harvard Üniversitesi matematik profesörü ve grup üyesi Melanie Matchett Wood, eylülde yaptığı açıklamada, yapay zekâ kaynaklı matematik çıktılarının “çoğu zaman intihal içerdiğini” ve çoğunlukla bunların arkasında sorumluluk üstlenen bir insan bulunmadığını uyarmıştı. Şirkete konuşan bir sözcü de, yayımlanan yeni sonuçların önemli bir kısmının OpenAI bünyesindeki matematikçiler tarafından bile henüz tam olarak anlaşılmadığını ayrı bir röportajda kabul etti.
OpenAI’nin Navier–Stokes gerilimi
Bu paylaşım, OpenAI ile matematikçiler arasındaki bir aylık gerilim döneminin ardından geldi. Şirket, 8 Eylül’de, Navier–Stokes Milenyum Ödülü problemini çözdüğünü duyuran bir açıklama yaptı; bu da, New York Üniversitesi’nden matematikçi Tristan Buckmaster ile katkı ve öncelik tartışmasını tetikledi.
Üç gün sonra, 25 Fields Madalyası sahibi matematikçi, ünlü açık problemlerin yapay zekâ için kıyas ölçütü (benchmark) olarak kullanılmasına karşı bir bildiriye imza attı. OpenAI ise 21 Eylül’de, modelin 100’ün üzerinde başka problemi de çözdüğünü açıkladı.
Sıradaki Haber: AMD, Yapay Zekâ Talebindeki Patlamanın 2027'de Çip Arzını ‘Kayda Değer Ölçüde’ Artıracağını Öngörüyor

