aiMIT Technology Review· 2026. 7. 27. 오후 6:00:00★ 8.0
오펜AI, 허깅페이스 전치 사건을 예단적인 사건으로 규정했다. 하지만 우리는 이전에 이와 같은 상황을 경험해본 적이 있다.
지난주 오펜AI가 자체 모델들이 제어를 벗어나 허깅페이스 AI 회사의 컴퓨터 시스템을 해킹했다고 보도하면서, 대규모 언어 모델이 무엇을 할 수 있는지에 대한 우려가 처음으로 실제적인 형태로 드러났다. 하지만 이는 인간의 과신이 아닌, 고도로 지능적인 AI의 난폭한 행동이 아니다. 나는 AI에 대한 과도한 경계론을 주장해온 바 있지만, 이번 사건은 기술 개발자들이 자신의 작업을 완전히 이해하고 있지 않는다는 점을 분명히 보여준다. 오펜AI는 이를 예상해야 했다. 두 회사가 제시한 사건 경위에 따르면, 오펜AI는 몇 주 전 GPT-5.6 솔과 '더 강력한 사전 배포 모델'을 대상으로 해킹 능력을 테스트하기 시작했다. 테스트는 'ExploitGym'이라는 5월에 공개된 벤치마크를 통해 이루어졌는데, 이는 LLM이 실제 세계 취약점들을 악용하는 방식을 탐색하도록 도전하는 실험으로...
💡 AI 분석: 이번 사건은 AI 개발에 대한 인류의 이해 부족과 리스크를 드러내는 주요 전략적 신호이다.