90년 난제 풀었다던 오픈AI, 수학 연구 372건 공개…수학계 “성능 시험 멈춰라”

2 days ago 11

지난달 24일(현지 시간) 호주 멜버른에서 컴퓨터 화면에 챗GPT가 떠 있는 모습. 사진=게티이미지코리아 오픈AI가 자사 인공지능(AI) 모델이 수학계의 대표 난제인 ‘나비에-스토크스 방정식’을 해결했다고 발표한 데 이어 이번에는 고난도 수학 연구 결과를 대거 공개했다. 이에 수학계에서는 수학 문제가 AI 모델의 성능 측정 도구로 소모돼서는 안 된다는 반발이 나온다.6일(현지시간) 오픈AI는 깃허브를 통해 내부 AI 모델이 만든 수학 연구 원고 722편을 공개했다. 연구 결과는 서로 연관된 논문을 묶어 372개 결과군으로 정리됐다. 분야는 대수학과 정수론, 이론 컴퓨터과학, 수리논리학, 위상수학 등 수학 전반에 걸쳐 있다.오픈AI는 이번 연구에 일반에 공개하지 않은 내부 최상위 AI 모델을 사용했다. 약 4000개의 연구 문제를 모델에 제시했으며 “결과 하나를 얻는 데 평균적으로 해당 모델을 이용한 챗GPT 프로 약 3시간 분량의 추론 연산이 투입됐다”고 설명했다.외부 자문단의 권고를 반영해 10개 결과에는 AI의 추론 과정을 압축한 요약본도 공개했다. 상당수 논문에는 수학적 증명을 컴퓨터로 검증할 수 있는 형식언어 ‘린(Lean)’으로 작성한 검증 자료가 첨부됐다. 다만 모든 결과가 형식 검증을 거친 것은 아니다. 오픈AI는 일부 미검증 결과에는 오류가 있을 수 있으며, 수정이 필요한 경우 공개 저장소를 계속 업데이트하겠다고 밝혔다.● 독립 자문단 “수학 문제로 성능 측정 중단하라” 요구이번 공개는 오픈AI가 ‘나비에-스토크스 방정식’의 해법을 내놨다고 발표한 지 한 달 만이다. 이는 유체의 움직임을 설명하는 방정식의 해가 항상 매끄럽게 유지되는지 묻는 ‘밀레니엄 문제’ 가운데 하나다. 오픈AI는 자사 AI가 해가 깨지는 경우가 있음을 증명했다고 밝혔지만, 수학계 검증은 아직 받지 않은 상태다.AI 기업들은 그동안 국제수학올림피아드(IMO) 문제 등을 모델의 수학 능력을 평가하는 기준으로 활용해왔다. 그러나 기존 평가 문제만으로는 성능을 가늠하기 어려워지면서 최근에는 아직 풀리지 않은 고난도 연구 문제와 수학 난제까지 모델 시험에 사용하고 있다.이 과정에서 수학계의 반발도 커졌다. 미국 프린스턴 고등연구소가 주관하는 독립 ‘수학과 인공지능 자문그룹(AGMAI)’은 지난달 공개한 권고안에서 비공개 독점 모델에 고난도 수학 문제를 넣어 성능을 시험하는 관행을 지지하지 않는다며 중단을 요구했다.자문단은 결과마다 오...

Read Entire Article