오픈AI, 비공개 AI가 쓴 수학 논문 722편 전면 공개…이젠 수학계가 ‘진짜 값어치’를 판단한다

Mathematicians must judge 722 math manuscripts that an unreleased OpenAI model produced and the company posted publicly (Image: Shutterstock)
Mathematicians must judge 722 math manuscripts that an unreleased OpenAI model produced and the company posted publicly (Image: Shutterstock)

**오픈AI(OpenAI)**가 화요일 비공개 내부 AI 모델이 작성한 수학 논문 원고 722편을 372개 결과군(result family)으로 묶어 한꺼번에 공개했다.
이제 이 결과물이 새로운 공개 가이드라인을 충실히 따랐는지, 그리고 수학적으로 의미가 있는지는 전적으로 수학계가 판단해야 할 과제가 됐다.

핵심 포인트:

  • 오픈AI는 대중이 사용할 수 없는 내부 모델이 만든 논문 원고 722편(372개 패밀리)을 깃허브에 게시했다.
  • 수학자 9인으로 구성된 독립 자문단은 “결과나 절차를 보증하는 역할이 아니다”라고 선을 그었다.
  • 회사는 형식 검증(컴퓨터 체크)이 없는 일부 결과에는 오류가 존재할 수 있다고 인정했다.

오픈AI의 수학 결과 공개

오픈AI는 수학 결과물을 공개 깃허브(GitHub) 저장소에 게시하면서, 각 논문을 어떻게 수정·인용해야 하는지에 대한 규칙도 함께 제시했다.
해당 저장소에는 722편의 원고가 372개 패밀리로 정리돼 있다. 한 패밀리는 주요 정리(main result)와 그에 딸린 보조 논증, 파생 결과, 대안적 증명 등을 묶어 놓은 구조다.
오픈AI는 내부 모델에 약 4,000개의 문제를 제시한 뒤, 그 가운데 “충분히 의미가 있다”고 자체 판단한 결과만 선별해 남겼다고 밝혔다.

회사 설명에 따르면, 각 결과를 도출하는 데 평균적으로 챗GPT 프로(ChatGPT Pro)의 연산(“생각”) 시간이 약 3시간가량 사용됐다. 많은 증명은 형식 증명 언어인 Lean으로도 함께 작성돼 있어, 컴퓨터를 이용한 자동 검증이 가능하다.

다만 오픈AI는 Lean 등 형식 검증이 붙지 않은 결과들에는 오류나 허점이 존재할 수 있음을 인정했다.

관련 기사: 북한 라자루스, 중국 세탁책 통해 10억달러 세탁했다고 ZachXBT 주장

자문단 “보증 아냐”…수학계에 공 넘겨

고등연구소(Institute for Advanced Study)에 소속된 수학·AI 자문단인 Advisory Group on Mathematics and Artificial Intelligence는 9명의 무급 수학자로 구성돼 있다. 이들은 성명에서, 자신의 역할은 “오픈AI 결과에 대한 판정도, 회사 절차에 대한 승인도 아니다”라고 못 박았다.
실제로 오픈AI가 자문단 권고를 얼마나 성실히 이행했는지에 대한 평가는 “더 넓은 수학 공동체만이 내릴 수 있다”고 덧붙였다.

이 자문단은 9월 29일 낸 권고문에서, AI 연구소들을 향해 다음과 같은 기준을 제시했다.

  • 선행 연구 인용을 명시적으로 할 것
  • 증명을 전통적인 학술 논문 형식에 가깝게 작성할 것
  • 프롬프트, 추론 요약, 계산(컴퓨팅) 비용을 투명하게 공개할 것
  • 결과물을 특정 AI 연구소가 통제하지 않는 학술 저장소에 탑재할 것

오픈AI는 깃허브 외에 커뮤니티가 직접 운영하는 대안 저장소를 모색 중이라고 밝히며, 주요 AI 수학 결과를 주제로 한 워크숍에 재정을 지원하겠다고도 말했다.

하버드대 수학과 교수이자 자문단 일원인 **멜라니 매쳇 우드(Melanie Matchett Wood)**는 9월 인터뷰에서, AI가 생성한 수학 결과물은 “종종 표절을 포함하고”, 그 내용에 대해 “책임을 지겠다고 나서는 사람이 거의 없다”고 경고한 바 있다.
오픈AI 대변인 역시 별도의 인터뷰에서, 이번에 공개한 수많은 결과 가운데 상당수는 “회사 내부 수학자들조차 아직 충분히 이해하지 못하고 있다”고 인정했다.

내비에–스토크스 해법 논란의 연장선

이번 대규모 공개는 지난 한 달 동안 오픈AI와 수학계 사이에서 이어진 긴장 국면의 연장선상에 있다.
오픈AI는 9월 8일, 밀레니엄 난제 가운데 하나인 내비에–스토크스 방정식 문제에 대한 “해결책”을 제시했다고 발표해 큰 파장을 일으켰다. 이 과정에서 뉴욕대 수학자 **트리스탄 버크마스터(Tristan Buckmaster)**와의 공로·우선권 논쟁이 벌어지며 논란이 증폭됐다.

사흘 뒤에는 필즈상 수상자 25명이 공동 성명을 내, 유명 미해결 문제를 AI 성능 벤치마크로 사용하는 관행에 반대 입장을 표명했다. 그럼에도 오픈AI는 9월 21일, 해당 모델이 “100개가 넘는 다른 난제들”도 해결했다고 주장했다.

다음 기사: AMD, AI 수요 폭증에 “2027년 반도체 공급 크게 늘 것” 전망

Alexey Bondarev profile photo

Alexey Bondarev

알렉세이 본다레프는 Yellow.com의 콘텐츠 총괄입니다. 그는 분석 리포트, 업계 맥락, 그리고 AI 시대와 보안 기술부터 핀테크 혁신에 이르기까지 암호화폐를 형성하는 더 큰 흐름에 초점을 맞춘 심층 리서치 및 학습 콘텐츠를 전문으로 합니다. 그는 모든 디지털이 조만간 모든 아날로그를 앞지르게 될 것이라고 믿으며, 그것을 현실로 만들기 위해 노력하고 있습니다.

면책 조항 및 위험 경고: 이 기사에서 제공되는 정보는 교육 및 정보 제공 목적으로만 제공되며 저자의 의견을 바탕으로 합니다. 이는 재정, 투자, 법적 또는 세무 조언을 구성하지 않습니다. 암호화폐 자산은 매우 변동성이 크고 높은 위험에 노출되어 있으며, 여기에는 투자금 전부 또는 상당 부분을 잃을 위험이 포함됩니다. 암호화폐 자산의 거래나 보유는 모든 투자자에게 적합하지 않을 수 있습니다. 이 기사에 표현된 견해는 저자(들)의 견해일 뿐이며 Yellow, 창립자 또는 임원의 공식적인 정책이나 입장을 나타내지 않습니다. 투자 결정을 내리기 전에 항상 자신만의 철저한 조사(D.Y.O.R.)를 수행하고 면허를 가진 금융 전문가와 상담하십시오.
오픈AI, 비공개 AI가 쓴 수학 논문 722편 전면 공개…이젠 수학계가 ‘진짜 값어치’를 판단한다 | Yellow