ai전자신문 IT (ETNews)· 7/27/2026, 3:46:11 AM7.0

“오픈AI, 'AI 에이전트 외부 해킹' 1주일 동안 몰랐다”

오픈AI가 자사 인공지능(AI) 모델들이 통제를 벗어나 외부 사이트를 며칠 동안 해킹한 사실을 알아차리지 못했다고 로이터 통신이 복수의 소식통을 인용해 26일(현지시간) 보도했다. 조사에 정통한 소식통들에 따르면 오픈AI는 위협이 차단되고 미국 연방수사국(FBI)에 신고된 후에야 이를 알아차린 것으로 나타났다. 지난 21일 오픈AI는 최신 모델 'GPT-솔 5.6' 등이 사이버 공격 능력을 시험하던 중 격리된 샌드박스 환경을 벗어나 인터넷에 접속, 오픈소스 AI 플랫폼 허깅페이스의 로그인 정보를 탈취해 서버를 해킹하는 사고를 일으켰다고 공개했다. 하지만 두 소식통에 따르면 이들 모델은 지난 9일께 격리된 테스트 환경에서 탈출을 시도했다. 허깅페이스에 대한 해킹은 이틀 뒤인 11일 시작돼 13일까지 이어졌다고 허깅페이스 공동 창업자 토마스 울프는 밝혔다. 오픈AI가 해킹의 범인이 자사 모델들이라는 것을 알아차리는 데는 며칠이 더 걸렸다. 오픈AI와 허깅페이스가 이 사건을 두고 처음 연락한 것은 사건이 터진 지 한참 뒤인 20일께였다고 소식통들은 전했다. 허깅페이스는 이번 해킹 사건의 타임라인을 정리해서 공개할 준비를 하고 있다고 울프는 말했다. 이번 사태는 오픈AI가 최첨단 모델 'GPT-5.6 Sol'과 미공개 모델을 기반으로 작동하는 AI 에이전트의 사이버 보안 능력을 테스트하던 중 시작됐다. 오픈AI는 당시 성명에서 “이번 해킹은 전례가 없는 일”이라며 “AI 안전 분야에서 정말 중요한 이정표가 될 사건”이라고 밝혔다. 몇몇 사이버 보안 전문가들은 오픈AI가 AI 에이전트에 대한 통제력을 잃은 것에 대해 회사의 안전 관리 절차에 심각한 의문이 제기된다고 지적했다. 선두 AI 기업들이 더 뛰어나고 더 빠른 모델을 내놓으려고 경쟁하는 와중에 까다롭고 비용이 많이 드는 보안 조치에 기꺼이 돈을 쓸 의지가 있는지 물어야 한다”고 말했다. 정현정 기자 iam@etnews.com

View original (전자신문 IT (ETNews)) →