
더팩트
서울대 총장 후보 강준호·최해천·이재영 3인 압축

위키트리

오픈AI가 아직 공개하지 않은 최첨단 모델이 만들었다는 수학 논문 722편을 한꺼번에 내놨다. 관련 논문을 묶은 '결과 계열(result families)'은 372개다. 오랜 미해결 문제의 해법과 진전이 담겼다는 것이 회사 측 설명이다.
더 버지(The Verge)에 따르면 이 결과물은 수학계를 놀라게 했고 동시에 불안하게 했던 일련의 성과를 잇는 것이다. 연구 윤리와 학술 행동을 둘러싼 논란도 함께 커지고 있다.
더 버지는 독립 자문단 AGMAI(Advisory Group on Mathematics and Artificial Intelligence)의 설명을 인용해 이번 공개에 '수백 개'의 미해결 질문에 대한 해법이 들어 있다고 전했다. 엔가젯(Engadget)은 오픈AI가 깃허브(GitHub)에 해법과 진전을 담은 원고 722편을 올렸다고 보도했다.
회사가 직접 꼽은 핵심 결과는 4차원 가키야 추측(Kakeya conjecture)의 해법이다. 엔가젯에 따르면 주요 컴퓨터 알고리즘의 개선과 리만 가설(Riemann hypothesis) 쪽의 진전도 포함됐다. The Decoder는 각 결과가 미해결 문제를 풀거나 상당한 진전을 이룬 것으로 제시된다고 전했다.
생성 방식도 공개됐다. 오픈AI는 거의 모든 논문이 AI 에이전트 한 개에 프롬프트 한 번을 준 결과로 나왔다고 사이언티픽 아메리칸에 밝혔다. The Decoder는 일부는 여러 번 시도가 필요했다고 덧붙였다. 결과 하나에 평균적으로 챗GPT 프로 '씽킹' 사용 약 3시간에 해당하는 연산이 들었다는 것이 오픈AI 주장이다.

The Decoder는 이 방식이 내비어-스토크스 문제 풀이와 크게 대비된다고 짚었다. 같은 모델이 내놓은 내비어-스토크스 해법은 에이전트 1만 개와 수백만 달러 규모의 연산이 필요했고 몇 주째 공식 검토 중이다.
와이어드는 이 문제가 밀레니엄 난제라고 전했다. 오픈AI 대변인 린지 매캘럼은 와이어드에 “8월 28일(현지시각) 새 내부 모델 훈련을 시작했다”며 이 모델이 내비어-스토크스 문제 외에 “오랜 미해결 문제 100개 넘게” 풀었다고 밝혔다. 오픈AI는 9월에도 같은 취지로 “대부분의 수학 분야에 걸쳐 100개 넘는 오랜 미해결 문제를 해결했다”고 말했다.
오픈AI는 논문과 함께 추론 과정 요약, 연산 추정치, 모델이 시도한 문제 수 통계도 내놨다. 상당수 증명에는 기계 검증이 가능한 증명 언어 린 형식화가 붙었고 더 추가될 예정이다. AI가 쏟아내는 결과의 양이 수학계의 수작업 검토 능력을 넘어설 수 있다는 현실적 이유에서다.
AGMAI는 9월 말 첫 권고안을 냈다. AI 연구소가 수학적 결과를 신속하게, 가능하면 기존 학술 채널로 공개하라는 내용이다. 사용한 모델명과 프롬프트, 연산 비용 공개도 요구했다. 또 결과 공개를 모델 홍보 수단으로 삼지 말라고 촉구했다. 이런 관행이 수학계에 상당한 피해를 준다는 이유다.
The Decoder에 따르면 오픈AI는 프린스턴 고등연구소 소속 자문단과 협의했고 권고를 느슨하게 따랐다. 자문단에는 필즈상 수상자 티머시 가워스 등이 포함돼 있다. 오픈AI는 문제별 연산 시간과 사용한 프롬프트를 공개하지 않았다. The Decoder는 평균 연산 비용만 공유했다고 전했다.
오픈AI는 이번에 깃허브 저장소에 결과를 올리며 논문 수정과 인용 규약을 함께 뒀다고 밝혔다. 자문단 지침에 맞는 커뮤니티 운영 대안도 계속 검토 중이라고 했다. 향후 공개에서는 인용과 수학적 설명, 결과 제시 방식을 개선하겠다는 약속도 내놨다. The Decoder에 따르면 회사는 AI 결과물을 이해하기 위한 워크숍과 학회도 지원할 계획이다. 다만 오픈AI는 자문단이 결과를 어떻게 알릴지는 조언할 수 있어도 결과를 만들지 여부나 속도는 조언할 수 없다는 선을 미리 그었다.
와이어드는 오픈AI가 8월에 수학자 약 40명을 불러 모았다고 전했다. AI가 이 분야에서 인간을 앞지를 경우를 논의하는 자리였다. 참석자들에 따르면 회사는 수백 개의 오랜 문제를 풀었다고 시사하면서 한꺼번에 공개하지 않겠다고 안심시켰다. 매캘럼은 이 약속을 회사가 “알지 못한다”고 말했다.
노스웨스턴대 수학자 브리나 크라는 참석자 반응이 “흥분과 두려움이 섞인 것”이었다고 회고했다. 그는 블로그나 트윗 대신 수학자들이 소화하고 활용할 수 있는 논문 형태로 공개해 달라고 요청했다고 말했다. 이어 “그 의견은 무시된 모양”이라고 했다. 와이어드는 오픈AI가 화요일 깃허브에 수백 건의 결과를 올릴 계획이라고 관계자들에게서 들었다고 전했다.
검증 문제도 남는다. MIT 수학자 앤드루 서덜랜드는 사이언티픽 아메리칸에 “모델이 공개되고 다른 사람들이 결과를 재현하기 전까지는 단일 에이전트로 문제를 한 번에 푼다는 주장은 미검증으로 봐야 한다”고 말했다. The Decoder는 린 형식화가 논리적 정확성은 검증해도 결과가 수학적으로 의미 있고 독창적인지는 판단하지 못한다고 설명했다.
The Decoder에 따르면 필즈상 수상자 25명은 ‘수학에서 AI의 심각한 불일치(A Severe Misalignment of AI in Mathematics)’라는 공개서한에서 AI 업계와 수학의 목표가 어긋난다고 경고했다. 문제 풀이는 개념적 이해와 통찰이라는 진짜 목표의 도구이자 대용물일 뿐이라는 것이다. 참 명제를 대량 생산하면 새 아이디어가 자랄 토양을 해칠 수 있다고도 주장했다.
가워스는 1~2십 년 안에 수학 문헌이 엄청나게 늘어나도 이를 진정으로 이해하는 인간 공동체는 남지 않을 수 있다고 경고했다. 필즈상 수상자 테런스 타오는 젊은 수학자 교육에서 인간적 측면을 강조하고 AI 도구 사용을 엄격히 제한해야 한다고 말했다.
와이어드가 전한 가장 두드러진 갈등은 9월 밀레니엄 난제 건이다. 오픈AI가 경쟁사가 해법에 다가선다는 “소문”을 듣고 수천 개 에이전트를 투입했다는 것이다. 뉴욕대 교수 트리스탄 벅마스터는 앤트로픽 직원 레번 알푀게(Levent Alpöge)와 개인적으로 협업해 문제의 한 요소를 풀어 가던 작업을 오픈AI가 앞질렀다고 비판했다. 두 사람은 연구를 발표하지 않았고 오픈AI 도구를 활용하던 중이었다. 와이어드는 수학자들이 양사의 기업공개를 앞둔 과시 경쟁에 수학이 이용되고 있다고 느낀다고 전했다.

관심 없음
{카테고리}에 관심 없음