오픈AI 수학 원고 722편 공개…현재 719편 남아
토포AI로 이 기사 더 깊이 읽기
오픈AI가 공개한 수학 원고 722편 가운데 현재 저장소에는 719편이 남았다. 최상위 결과의 약 42%가 Lean으로 형식화됐지만 전체 결과에 대한 수학계의 평가는 진행 중이다.
오픈AI는 공개문에서 10월 6일 내부 프런티어 모델이 만든 수학 연구 결과를 공개했다고 밝혔다. 공개 저장소는 원고 722편을 372개 결과군으로 묶었고, 모델에 약 4000개의 문제를 제시했다고 설명한다. 저장소 변경 이력에는 원고 3편 철회와 14편 수정이 기록됐다.
원고는 수론·대수기하학·해석학·이론 컴퓨터과학 등 여러 분야를 다룬다. 오픈AI는 일부 증명의 Lean 형식화와 추론 요약 10건, 연산량 추정치도 공개했다. 회사는 결과 하나를 얻는 데 평균적으로 ChatGPT Pro의 ‘생각’ 기능 약 3시간에 해당하는 연산량을 썼다고 설명했다. 모델 이름과 모델 자체는 공개하지 않았다.
Lean은 수학적 명제를 형식 언어로 나타내고, 증명 단계가 논리 규칙에 맞는지 컴퓨터로 검사하는 도구다. 오픈AI 저장소는 현재 최상위 결과의 약 42%가 형식화됐다고 밝힌다. 저장소 변경 이력에는 10월 7일 기준 형식화 수가 719개 가운데 300개로 기록돼 있다.
형식화 비율이 전체 원고의 정확성을 뜻하지는 않는다. Lean은 입력된 형식 명제의 증명 절차를 검사하지만, 그 명제가 논문이 주장하는 결과와 일치하는지, 가정과 적용 범위가 적절한지까지 자동으로 판단하지 않는다. 오픈AI도 저장소에서 형식화되지 않은 결과에는 문제가 있을 수 있다고 밝혔다.
검증과 함께 연구 과정의 공개 범위도 쟁점이다. 오픈AI는 공개문에서 독립 자문그룹의 권고를 참고했고, 원고 수정·인용 절차와 일부 방법 정보를 저장소에 올렸다고 설명했다. 다만 모델과 전체 프롬프트는 공개하지 않아 외부 연구자가 같은 조건으로 결과를 재현하기는 어렵다.
수학·인공지능 자문그룹(AGMAI)은 10월 6일 입장에서 이번 공개가 결과를 이해하고 수학 지식에 반영하는 과정의 시작이라고 밝혔다. 자문그룹은 오픈AI와 논의했다는 사실이 결과의 영향력을 판단하거나 공개 절차를 보증한다는 뜻은 아니라고 선을 그었다. 수학자가 AI 기업이 고른 문제의 결과를 검토하는 데 그치지 않고 직접 질문과 접근법을 발전시킬 수 있어야 한다고도 강조했다.
원고 수와 형식화 비율만으로 개별 결과의 중요성이나 학술적 의미를 확정하기는 어렵다. 오픈AI가 원고 722편을 공개했을 당시에도 일부 증명만 Lean으로 형식화됐고, 전체 결과가 검증을 마친 것은 아니었다. 이번에 확인된 변화는 공개 이후 이어진 원고 철회·수정과 일부 증명의 형식화다.

정민석 기자 




댓글 0
불러오는 중…