[김장현의 테크와 사람] 〈107〉우리만의 '독파모'를 찾아서

4 days ago 14

김장현 성균관대 교수 최근 정부의 '독자 인공지능(AI) 파운데이션 모델', 이른바 독파모 2차 단계평가 결과가 발표되면서 다소 논란이 일었다. 글로벌 AI 성능 평가에서 돋보이는 성적을 낸 모티프테크놀로지스가 다음 단계 진출에 실패하고, 업스테이지·SK텔레콤·LG AI연구원이 3차 평가에 진출한 것이다. 일부에서는 “성능 1위가 왜 탈락했나”라며 의문을 던지고 있으며, 다른 시각에서는 우리가 찾는 것이 꼭 벤치마크 챔피언은 아니라는 반응이 나온다. 모티프 모델은 AI 성능지표인 AAII에서 높은 평가를 받으며 국내 경쟁 모델 가운데 가장 뛰어난 성능을 보였다는 평가를 받았다. 특히 가장 늦게 경쟁에 뛰어들었음에도, 적은 연구 인력으로 독자적인 연구개발 역량을 보여준 점은 우리 AI 생태계에 매우 중요한 자산이라고 하겠다. 독파모 2차 평가는 벤치마크 40점, 전문가 평가 35점, 사용자 평가 25점으로 구성됐으며, 모티프는 사용성·활용성 부문에서 경쟁 팀보다 낮은 평가를 받은 것으로 알려졌다. 과학기술정보통신부는 모티프의 기술력은 인정하면서도 실제 사용자에게 얼마나 편리하게 제공되는지, 산업과 공공 현장에 얼마나 빠르게 적용될 수 있는지에서 상대적으로 뒤졌다고 설명했다. 사실 후발주자가 사용성까지 높은 모델을 만들 정도로 충분한 시간이 있었겠느냐는 시각도 있지만, 이번 논쟁을 통해서 과연 우리가 원하는 독파모는 무엇인가 하는 근본적 질문을 던지게 된다. 모델이 시험 문제를 빠르게 잘 푼다고 해서 곧바로 좋은 AI 서비스가 되는 것은 아니다. 요즘은 오히려 AI모델의 속도보다 안전성 문제가 점점 더 부각되는 흐름이다. 기업의 내부 지식과 안전하게 연결되면서도 적절한 보안성이 유지되는가, 한국어의 맥락을 제대로 이해하는가, 오류가 나도 사람이 검증하고 통제할 수 있는가 등이 중시되고 있다. AI의 경쟁력은 이제 파라미터 수나 벤치마크 점수만이 아니라 서비스 설계, 데이터 거버넌스, 사용자 경험, 도입 비용, 신뢰성과 책임소구 체계의 총합으로 결정된다. 다만 안전성, 성능, 사용성, 상용화 준비도를 평가하는 것이 필요하더라도, 평가시에는 혁신적 후발주자에게 지나치게 불리하지 않도록 해야 한다. 독파모 선발의 단계적 경쟁 방식에는 분명한 장점이 있다. 한정된 GPU, 데이터, 재정 지원을 모든 참여자에게 균등하게 나누기보다, 중간 평가를 거쳐 가능성이 검증된 팀에 집중하는 방식은 속도와 규모가 경쟁력인 AI 개발에 ...

Read Entire Article