OpenAI во вторник открыла доступ к 722 математическим рукописям, объединённым в 372 «семейства результатов» и созданным внутренней, пока не выпущенной моделью ИИ. Теперь математическому сообществу предстоит решить, насколько выпуск соответствует новым рекомендациям по раскрытию таких работ.
Ключевое:
- OpenAI выложила на GitHub 722 рукописи в составе 372 семейств, все они созданы внутренней моделью, недоступной широкой публике.
- Независимая консультативная группа математиков заявила, что её участие не означает одобрения ни результатов, ни процесса их получения.
- Компания признала, что часть результатов без формальной компьютерной проверки может содержать ошибки.
Публикация математических результатов OpenAI
Компания опубликовала этот массив работ в открытом репозитории GitHub, установив правила для доработки и цитирования каждой рукописи. В репозитории указаны 722 рукописи, сгруппированные в 372 семейства: в одно семейство входят основной результат и сопутствующие рассуждения, следствия или альтернативные доказательства. По словам OpenAI, модели было поставлено около 4 000 задач, а сохранены только те результаты, которые компания сочла достаточно значимыми.
На получение каждого результата в среднем уходило примерно три часа вычислений уровня ChatGPT Pro, уточнили в OpenAI. Для многих доказательств подготовлены версии на языке Lean — это формальный язык, позволяющий компьютеру автоматически проверять корректность математических доказательств.
В OpenAI подчёркивают, что результаты, не снабжённые такой формальной проверкой, потенциально могут содержать проблемы.
Читайте также: Lazarus из КНДР прогнал украденный $1 млрд через китайских отмывателей, утверждает ZachXBT
Осторожность консультативной группы
Advisory Group on Mathematics and Artificial Intelligence — группа из девяти независимых, работающих без оплаты математиков при Институте перспективных исследований — в своём заявлении подчеркнула, что её роль не заключается ни в оценке корректности полученных результатов, ни в одобрении процедур OpenAI. По мнению группы, только широкое математическое сообщество может судить о том, насколько компания действительно последовала её рекомендациям.
Эти рекомендации, опубликованные 29 сентября, обязывают лаборатории ИИ корректно ссылаться на предшествующие работы, оформлять доказательства в стиле классической научной статьи и раскрывать используемые промпты, сводки рассуждений и вычислительные затраты. Кроме того, результаты, по замыслу авторов, должны размещаться в академических репозиториях, которые не контролируются самими AI‑компаниями. OpenAI заявляет, что продолжает искать варианты размещения материалов в репозиториях под управлением сообщества, альтернативных GitHub, и намерена финансировать семинары по ключевым результатам ИИ.
Мелани Мэтчетт Вуд (Melanie Matchett Wood), профессор математики Гарварда и член группы, ещё в сентябре предупреждала, что математические тексты, генерируемые ИИ, «часто содержат плагиат» и при этом за них обычно не готов отвечать ни один человек. Представитель OpenAI отдельно признал, что многие из новых результатов пока не до конца понятны даже штатным математикам компании.
Спор вокруг результата OpenAI по Навье–Стоксу
Публикация корпуса рукописей последовала за месяцем напряжения между OpenAI и математическим сообществом. 8 сентября компания заявила, что её модель нашла решение задачи Навье–Стокса — одной из задач тысячелетия с призом в $1 млн. Это спровоцировало конфликт по поводу приоритета с математиком Нью-Йоркского университета Тристаном Бакмастером (Tristan Buckmaster).
Уже через три дня 25 лауреатов медали Филдса подписали декларацию против использования знаменитых открытых проблем в качестве бенчмарков для ИИ. 21 сентября OpenAI дополнительно заявила, что модель решила более 100 других задач подобного уровня.
Читайте далее: AMD заявляет, что спрос на ИИ настолько высок, что «существенно» нарастит поставки чипов в 2027 году

