**오픈AI(OpenAI)**가 화요일 비공개 내부 AI 모델이 작성한 수학 논문 원고 722편을 372개 결과군(result family)으로 묶어 한꺼번에 공개했다.
이제 이 결과물이 새로운 공개 가이드라인을 충실히 따랐는지, 그리고 수학적으로 의미가 있는지는 전적으로 수학계가 판단해야 할 과제가 됐다.
핵심 포인트:
- 오픈AI는 대중이 사용할 수 없는 내부 모델이 만든 논문 원고 722편(372개 패밀리)을 깃허브에 게시했다.
- 수학자 9인으로 구성된 독립 자문단은 “결과나 절차를 보증하는 역할이 아니다”라고 선을 그었다.
- 회사는 형식 검증(컴퓨터 체크)이 없는 일부 결과에는 오류가 존재할 수 있다고 인정했다.
오픈AI의 수학 결과 공개
오픈AI는 수학 결과물을 공개 깃허브(GitHub) 저장소에 게시하면서, 각 논문을 어떻게 수정·인용해야 하는지에 대한 규칙도 함께 제시했다.
해당 저장소에는 722편의 원고가 372개 패밀리로 정리돼 있다. 한 패밀리는 주요 정리(main result)와 그에 딸린 보조 논증, 파생 결과, 대안적 증명 등을 묶어 놓은 구조다.
오픈AI는 내부 모델에 약 4,000개의 문제를 제시한 뒤, 그 가운데 “충분히 의미가 있다”고 자체 판단한 결과만 선별해 남겼다고 밝혔다.
회사 설명에 따르면, 각 결과를 도출하는 데 평균적으로 챗GPT 프로(ChatGPT Pro)의 연산(“생각”) 시간이 약 3시간가량 사용됐다. 많은 증명은 형식 증명 언어인 Lean으로도 함께 작성돼 있어, 컴퓨터를 이용한 자동 검증이 가능하다.
다만 오픈AI는 Lean 등 형식 검증이 붙지 않은 결과들에는 오류나 허점이 존재할 수 있음을 인정했다.
관련 기사: 북한 라자루스, 중국 세탁책 통해 10억달러 세탁했다고 ZachXBT 주장
자문단 “보증 아냐”…수학계에 공 넘겨
고등연구소(Institute for Advanced Study)에 소속된 수학·AI 자문단인 Advisory Group on Mathematics and Artificial Intelligence는 9명의 무급 수학자로 구성돼 있다. 이들은 성명에서, 자신의 역할은 “오픈AI 결과에 대한 판정도, 회사 절차에 대한 승인도 아니다”라고 못 박았다.
실제로 오픈AI가 자문단 권고를 얼마나 성실히 이행했는지에 대한 평가는 “더 넓은 수학 공동체만이 내릴 수 있다”고 덧붙였다.
이 자문단은 9월 29일 낸 권고문에서, AI 연구소들을 향해 다음과 같은 기준을 제시했다.
- 선행 연구 인용을 명시적으로 할 것
- 증명을 전통적인 학술 논문 형식에 가깝게 작성할 것
- 프롬프트, 추론 요약, 계산(컴퓨팅) 비용을 투명하게 공개할 것
- 결과물을 특정 AI 연구소가 통제하지 않는 학술 저장소에 탑재할 것
오픈AI는 깃허브 외에 커뮤니티가 직접 운영하는 대안 저장소를 모색 중이라고 밝히며, 주요 AI 수학 결과를 주제로 한 워크숍에 재정을 지원하겠다고도 말했다.
하버드대 수학과 교수이자 자문단 일원인 **멜라니 매쳇 우드(Melanie Matchett Wood)**는 9월 인터뷰에서, AI가 생성한 수학 결과물은 “종종 표절을 포함하고”, 그 내용에 대해 “책임을 지겠다고 나서는 사람이 거의 없다”고 경고한 바 있다.
오픈AI 대변인 역시 별도의 인터뷰에서, 이번에 공개한 수많은 결과 가운데 상당수는 “회사 내부 수학자들조차 아직 충분히 이해하지 못하고 있다”고 인정했다.
내비에–스토크스 해법 논란의 연장선
이번 대규모 공개는 지난 한 달 동안 오픈AI와 수학계 사이에서 이어진 긴장 국면의 연장선상에 있다.
오픈AI는 9월 8일, 밀레니엄 난제 가운데 하나인 내비에–스토크스 방정식 문제에 대한 “해결책”을 제시했다고 발표해 큰 파장을 일으켰다. 이 과정에서 뉴욕대 수학자 **트리스탄 버크마스터(Tristan Buckmaster)**와의 공로·우선권 논쟁이 벌어지며 논란이 증폭됐다.
사흘 뒤에는 필즈상 수상자 25명이 공동 성명을 내, 유명 미해결 문제를 AI 성능 벤치마크로 사용하는 관행에 반대 입장을 표명했다. 그럼에도 오픈AI는 9월 21일, 해당 모델이 “100개가 넘는 다른 난제들”도 해결했다고 주장했다.

