OpenAI виклала у відкритий доступ 722 математичні праці ШІ. Тепер їх мають оцінити математичні спільноти

Mathematicians must judge 722 math manuscripts that an unreleased OpenAI model produced and the company posted publicly (Image: Shutterstock)
Mathematicians must judge 722 math manuscripts that an unreleased OpenAI model produced and the company posted publicly (Image: Shutterstock)

OpenAI у вівторок оприлюднила 722 математичні рукописи, згруповані у 372 «родини» результатів, згенеровані внутрішньою, ще недоступною публічно моделлю ШІ. Оцінити їхню якість і відповідність новим рекомендаціям щодо публікацій тепер мають професійні математики.

Головне:

  • OpenAI виклала на GitHub 722 рукописи у складі 372 родин результатів, усі створені внутрішньою моделлю, до якої немає публічного доступу.
  • Незалежна консультативна група математиків наголосила, що її участь не означає ані схвалення результатів, ані підтримки підходу OpenAI.
  • Компанія попереджає, що результати без формальної машинної перевірки можуть містити помилки.

Публікація математичних результатів OpenAI

Компанія оприлюднила зібрання результатів у публічному репозиторії GitHub, додавши правила оновлення та цитування кожної роботи. У репозиторії перелічено 722 рукописи, об’єднані у 372 родини: кожна родина включає основний результат разом із допоміжними міркуваннями, наслідками або альтернативними доведеннями. За словами OpenAI, моделі поставили близько 4 000 задач і зберегли лише ті відповіді, які всередині компанії визнали достатньо значущими.

За оцінкою OpenAI, на виведення кожного результату модель у середньому витрачала близько трьох годин обчислень рівня ChatGPT Pro. Значна частина доведень супроводжується реалізацією в Lean — мовою програмування, що дає змогу формально перевірити математичний доказ на комп’ютері.

Водночас OpenAI визнає: там, де формальної перевірки в Lean немає, результати можуть містити неточності чи помилки.

Також читайте: Північнокорейська Lazarus провела через китайських відмивачів $1 млрд викрадених коштів, стверджує ZachXBT

Обережність консультативної групи

Консультативна група з математики та штучного інтелекту — дев’ять незалежних, неоплачуваних математиків при Інституті перспективних досліджень — у своїй заяві підкреслила, що її роль не полягає в рецензуванні наведених результатів чи схваленні процесів OpenAI. На думку групи, лише широка математична спільнота здатна оцінити, наскільки компанія дотрималася наданих їй рекомендацій.

Ці рекомендації, оприлюднені 29 вересня, зобов’язують лабораторії ШІ:

  • належним чином посилатися на попередні роботи;
  • оформлювати доведення у форматі традиційних наукових статей;
  • розкривати використовувані підказки для моделі (prompts), стислий виклад міркувань та обчислювальні витрати.

Окремо наголошується, що результати мають зберігатися у наукових репозиторіях, які не контролюються жодною лабораторією ШІ. OpenAI у відповідь заявила, що продовжує шукати варіанти розміщення матеріалів на платформах, керованих науковою спільнотою, а також фінансуватиме воркшопи, присвячені значущим результатам ШІ.

Професорка математики Гарвардського університету та членкиня групи Мелані Матчетт Вуд ще у вересні застерігала, що вихідні дані ШІ в математиці «часто містять плагіат» і зазвичай не мають жодної людини, готової взяти на себе відповідальність за ці тексти. Представник OpenAI окремо визнав, що багато з нових результатів поки що залишаються незрозумілими навіть для внутрішніх математиків компанії.

Конфлікт навколо результатів OpenAI з рівняннями Нав’є — Стокса

Поточний реліз став продовженням напруженого місяця у відносинах OpenAI із математичною спільнотою. 8 вересня компанія заявила, що її модель запропонувала розв’язання задачі тисячоліття щодо рівнянь Нав’є — Стокса, за яке передбачено премію в $1 млн. Це спричинило суперечку щодо пріоритету та авторства з математиком Нью-Йоркського університету Трістаном Бакмастером.

Уже за три дні 25 лауреатів медалі Філдса підписали декларацію проти використання відомих відкритих проблем як бенчмарків для тестування ШІ. На цьому тлі OpenAI 21 вересня заявила, що модель нібито розв’язала понад 100 інших задач.

Читайте далі: AMD заявляє, що попит на ШІ такий високий, що «суттєво» підвищить постачання чипів у 2027 році

Alexey Bondarev profile photo

Alexey Bondarev

Олексій Бондарєв — керівник відділу контенту в Yellow.com. Він спеціалізується на ґрунтовних матеріалах формату Research та Learn, зосереджених на аналітичних звітах, галузевому контексті та глобальних силах, що формують криптоіндустрію: від епохи ШІ й технологій безпеки до фінтех-інновацій. Він переконаний, що все цифрове невдовзі витіснить усе аналогове, і наполегливо працює над тим, щоб це стало реальністю.

Відмова від відповідальності та попередження про ризики: Інформація, надана в цій статті, призначена лише для освітніх та інформаційних цілей і базується на думці автора. Вона не є фінансовою, інвестиційною, правовою чи податковою консультацією. Криптоактиви є надзвичайно волатильними та піддаються високому ризику, включаючи ризик втрати всіх або значної частини ваших інвестицій. Торгівля або утримання криптоактивів може не підходити для всіх інвесторів. Думки, висловлені в цій статті, належать виключно автору(ам) і не представляють офіційну політику чи позицію Yellow, її засновників або керівників. Завжди проводьте власне ретельне дослідження (D.Y.O.R.) та консультуйтесь з ліцензованим фінансовим фахівцем перед прийняттям будь-яких інвестиційних рішень.
Останні новини
Показати всі новини
Схожі новини
Схожі дослідницькі статті
Схожі навчальні матеріали
OpenAI виклала у відкритий доступ 722 математичні праці ШІ. Тепер їх мають оцінити математичні спільноти | Yellow