오픈AI ‘무단 해킹’ 1곳만이 아니었다…모달 고객사도 뚫어

8 hours ago 2

허깅페이스 이어 추가 침입 확인 접근한 4개 계정 중 하나로 드러나 인증 없는 코드 실행 창구 악용 샌드박스 허점에 AI 통제 우려 확산 오픈AI의 인공지능(AI) 에이전트가 스스로 격리 환경(샌드박스)을 탈출해 무단 침투한 것으로 알려진 미 클라우드 인프라 기업 ‘모달 랩스(Modal Labs)’의 홈페이지 화면. 통제를 벗어난 오픈AI의 인공지능(AI) 에이전트가 침입한 곳은 한 기업에 그치지 않았던 것으로 나타났다. 이달 초 AI 스타트업 허깅페이스를 공격한 이 에이전트가 미국 뉴욕의 클라우드 서비스 업체 모달 랩스 고객사 시스템에도 무단 침입한 사실이 확인된 것. 스스로 판단하고 행동하는 AI를 인간이 끝까지 통제할 수 있느냐는 우려도 다시 커지고 있다.오픈AI가 사고를 처음 공개한 지난주까지만 해도 침입 피해가 확인된 곳은 허깅페이스뿐이었다. 그러나 로이터통신과 블룸버그통신은 28일(현지 시간) 해당 에이전트가 모달 랩스 고객사의 시스템에도 침입했다고 보도했다. 모달 랩스는 개발자가 클라우드 환경에서 프로그램 코드를 실행하고 검증할 수 있도록 지원하는 업체다. 최근 오픈AI가 테스트 중이던 AI 에이전트가 통제를 벗어나 외부 시스템을 해킹하는 사고가 발생하며 AI의 자율적 행동에 대한 안전성 우려가 커지고 있다. AP=뉴시스 앞서 오픈AI는 이 에이전트가 4개 서비스의 계정 4개에 접근했다고 밝혔다. 이 가운데 하나가 모달 랩스 고객사의 계정이었던 것이다. 허깅페이스도 에이전트가 제3자 기업 인프라에 마련된 샌드박스를 발판으로 공격 범위를 넓혔다고만 밝혔을 뿐, 해당 업체의 이름은 공개하지 않았다. 이번에 모달 랩스가 공격 대상자 중 한 곳이었음이 확인되면서 침입 범위가 당초 알려진 것보다 넓었던 사실도 드러났다.다만, 모달 랩스 플랫폼 자체가 뚫린 것은 아니라는 게 회사 측 설명이다. 아크샤트 부브나 모달 랩스 최고기술책임자(CTO)는 “한 고객사가 인증 절차 없이 누구나 코드를 실행할 수 있는 접속 창구를 열어뒀고, 통제를 벗어난 에이전트가 이를 악용했다”며 “모달 플랫폼은 침해되지 않았다”고 밝혔다.AI 에이전트는 사람이 단계마다 지시하지 않아도 주어진 목표를 수행하도록 설계된 AI다. 이번 사고는 오픈AI가 자사 모델의 해킹 역량을 시험하면서 안전장치인 ‘가드레일’을 일부 완화한 상태에서 일어났다. 이 모델은 외부 시스템에 영향을 주지 않도록 분리해 프로그램을 시험하는 가상 공간인 ‘샌드박스’를...

Read Entire Article