OpenAI 내부 모델, 리만 가설 관련 결과 공개
- •OpenAI, 이름을 밝히지 않은 내부 모델의 원고 722편을 공개하며 리만 가설 관련 결과 주장
- •약 4,000개 문제에서 나온 원고는 372개 계열로 구성됐으며 밀레니엄 난제는 하나도 해결하지 못함
- •고등연구소 자문단, 모델명·프롬프트 공개와 수학 결과의 홍보 활용 자제를 권고
OpenAI는 10월 6일 화요일, 이름을 공개하지 않은 내부 모델이 수론의 주요 미해결 문제인 리만 가설과 관련한 결과를 냈다고 밝히고, 모델이 생성한 원고 722편을 온라인에 공개했습니다. 회사는 모델명을 밝히거나 이용할 수 있게 하지 않았습니다. 1859년에 제기된 리만 가설은 소수의 분포를 좌우하는 제타 함수의 영점에 관한 문제입니다.
원고 한 편은 허수축 방향으로 얼마나 높이 올라가도 관련 띠 너비의 7/8 지점 바깥에는 영점이 없다는 고정 폭 경계 결과를 주장합니다. 앞선 연구는 높이가 커질수록 좁아지는 띠 가장자리 부근에서만 영점이 없음을 보였습니다. 두 번째 원고는 다른 방법으로 경계가 11/12인 더 약한 결과를 증명합니다. 완전한 가설은 여전히 풀리지 않았으며, 경계가 1/2까지 도달해야 합니다. 러트거스대 교수이자 수론학자인 알렉스 콘토로비치는 사람이 이 결과를 냈다면 즉시 필즈상을 받았을 것이라고 말했으며, 이 결과가 지겔 영점도 배제한다고 덧붙였습니다. 앤스로픽의 수학자 레번트 알포게는 이를 “수학 역사상 가장 중요한 순간”이라고 불렀습니다. 그는 앞서 OpenAI의 9월 나비에-스토크스 방정식 성과에 대한 공로 주장을 반박한 바 있습니다.
722편의 원고는 ‘계열’ 372개로 묶였습니다. 각 계열은 주요 결과와 그 귀결을 모으며, 때로는 대안 증명도 포함합니다. OpenAI가 접수한 미해결 문제는 약 4,000개로, 공개된 계열 수는 질문 10개당 1개에도 못 미칩니다. 선정된 결과 하나를 얻는 데는 평균적으로 ChatGPT Pro의 추론을 약 3시간 사용한 것과 맞먹는 계산량이 들었습니다. 이번 묶음에서 미해결 밀레니엄 수학 난제 5개 가운데 해결된 문제는 없습니다. 일부 원고에는 정형 언어로 작성해 컴퓨터가 확인할 수 있는 증명인 Lean 형식화가 빠져 있으며, OpenAI는 형식화되지 않은 결과가 “문제를 일으킬 수 있다”고 경고했습니다.
이번 공개를 계기로 AI가 생성한 수학 연구의 공개 방식을 둘러싼 논쟁이 일었습니다. OpenAI는 고등연구소의 독립 자문단과 논의했다고 밝혔습니다. 자문단은 9월 29일 권고에서 연구소들이 모델명과 프롬프트를 공개하고, 수학 결과를 홍보에 이용하지 않으며, 독점 모델로 고급 수학 문제를 시험하지 말라고 촉구했습니다. OpenAI는 신속한 공개와 Lean 형식화, 계산 비용, 제시한 문제 수 공개 등 권고 일부를 따랐습니다. 자문단은 공개가 “인간의 이해 과정이 끝나는 때가 아니라 시작되는 때”라고 밝혔습니다. 네이처는 수학자들이 보고된 진전과 대량 공개 모두에 동요하고 있다고 전했습니다.
블룸버그는 공개 전날 별도로 OpenAI가 MGX와 블랙록이 이끄는 아랍에미리트 국부펀드 컨소시엄으로부터 최소 300억 달러를 조달하기 위해 협상 중이라고 보도했습니다. 투자 전 기업가치는 약 1조 4,000억 달러로 거론됐습니다. OpenAI는 6월 비공개로 기업공개를 신청했지만, 상장은 2027년 이전에는 이뤄지지 않을 것으로 예상됩니다. 샘 알트먼(Sam Altman)은 9월 12일 상장하기에 “좋은” 시기가 아니라고 말했습니다. 깃허브에 공개된 자료는 투자자에게 수익이 아니라 모델의 역량을 보여줍니다.