OpenAI у вівторок оприлюднила 722 математичні рукописи, згруповані у 372 «родини» результатів, згенеровані внутрішньою, ще недоступною публічно моделлю ШІ. Оцінити їхню якість і відповідність новим рекомендаціям щодо публікацій тепер мають професійні математики.
Головне:
- OpenAI виклала на GitHub 722 рукописи у складі 372 родин результатів, усі створені внутрішньою моделлю, до якої немає публічного доступу.
- Незалежна консультативна група математиків наголосила, що її участь не означає ані схвалення результатів, ані підтримки підходу OpenAI.
- Компанія попереджає, що результати без формальної машинної перевірки можуть містити помилки.
Публікація математичних результатів OpenAI
Компанія оприлюднила зібрання результатів у публічному репозиторії GitHub, додавши правила оновлення та цитування кожної роботи. У репозиторії перелічено 722 рукописи, об’єднані у 372 родини: кожна родина включає основний результат разом із допоміжними міркуваннями, наслідками або альтернативними доведеннями. За словами OpenAI, моделі поставили близько 4 000 задач і зберегли лише ті відповіді, які всередині компанії визнали достатньо значущими.
За оцінкою OpenAI, на виведення кожного результату модель у середньому витрачала близько трьох годин обчислень рівня ChatGPT Pro. Значна частина доведень супроводжується реалізацією в Lean — мовою програмування, що дає змогу формально перевірити математичний доказ на комп’ютері.
Водночас OpenAI визнає: там, де формальної перевірки в Lean немає, результати можуть містити неточності чи помилки.
Також читайте: Північнокорейська Lazarus провела через китайських відмивачів $1 млрд викрадених коштів, стверджує ZachXBT
Обережність консультативної групи
Консультативна група з математики та штучного інтелекту — дев’ять незалежних, неоплачуваних математиків при Інституті перспективних досліджень — у своїй заяві підкреслила, що її роль не полягає в рецензуванні наведених результатів чи схваленні процесів OpenAI. На думку групи, лише широка математична спільнота здатна оцінити, наскільки компанія дотрималася наданих їй рекомендацій.
Ці рекомендації, оприлюднені 29 вересня, зобов’язують лабораторії ШІ:
- належним чином посилатися на попередні роботи;
- оформлювати доведення у форматі традиційних наукових статей;
- розкривати використовувані підказки для моделі (prompts), стислий виклад міркувань та обчислювальні витрати.
Окремо наголошується, що результати мають зберігатися у наукових репозиторіях, які не контролюються жодною лабораторією ШІ. OpenAI у відповідь заявила, що продовжує шукати варіанти розміщення матеріалів на платформах, керованих науковою спільнотою, а також фінансуватиме воркшопи, присвячені значущим результатам ШІ.
Професорка математики Гарвардського університету та членкиня групи Мелані Матчетт Вуд ще у вересні застерігала, що вихідні дані ШІ в математиці «часто містять плагіат» і зазвичай не мають жодної людини, готової взяти на себе відповідальність за ці тексти. Представник OpenAI окремо визнав, що багато з нових результатів поки що залишаються незрозумілими навіть для внутрішніх математиків компанії.
Конфлікт навколо результатів OpenAI з рівняннями Нав’є — Стокса
Поточний реліз став продовженням напруженого місяця у відносинах OpenAI із математичною спільнотою. 8 вересня компанія заявила, що її модель запропонувала розв’язання задачі тисячоліття щодо рівнянь Нав’є — Стокса, за яке передбачено премію в $1 млн. Це спричинило суперечку щодо пріоритету та авторства з математиком Нью-Йоркського університету Трістаном Бакмастером.
Уже за три дні 25 лауреатів медалі Філдса підписали декларацію проти використання відомих відкритих проблем як бенчмарків для тестування ШІ. На цьому тлі OpenAI 21 вересня заявила, що модель нібито розв’язала понад 100 інших задач.
Читайте далі: AMD заявляє, що попит на ШІ такий високий, що «суттєво» підвищить постачання чипів у 2027 році

