• 페이스북
  • 트위터
  • 유튜브

유엔 전문가 패널, "AI 에이전트에 관한 기존 안전장치 무너지고 있어"

등록 2026.09.21 18:47:52

7월의 미 오픈AI 에이전트의 허깅 페이스 해킹 사건 평가

[서울=뉴시스] 오픈AI 인공지능(AI) 모델 'GPT-6 아스트라'. 2026.09.11. (사진=오픈AI 제공) *재판매 및 DB 금지

[서울=뉴시스] 오픈AI 인공지능(AI) 모델 'GPT-6 아스트라'. 2026.09.11. (사진=오픈AI 제공) *재판매 및 DB 금지


[유엔=신화/뉴시스] 김재영 기자 = 유엔의 인공지능(AI) 패널은 21일 AI 에이전트에 관한 전통적인 안전장치가 무너지고 있다고 경고했다. 

AI에 관한 독립적인 국제 과학패널은 이날 첫 주제 개요문서로 지난 7월 미 기업 오픈AI 에이전트의 기업 허깅 페이스 해킹 사건을 평가하면서 이 같은 경고를 냈다.

이런 사건을 중지시킨다고 해서 인간이 오늘날 AI 에이전트들을 믿을 수 있을 정도로 통제하리라는 확신이 없다고 패널은 지적했다.

AI 에이전트들은 점점 능력이 월등해져 이들을 모니터하기가 더 어려워지는 반면 이들은 빈틈을 찾아내거나 자신들의 활동을 숨기는 것을 더 잘하게 된다는 것이다.

패널은 기자회견에서 "이 해킹 사건에 관한 기본 해석 및 즉각적인 교훈은 기초적인 사이버 안보 조치가 간과되었으며 안전장치 자체가 능력의 진보 속도를 따라가지 못하고 있다는 것"이라고 강조했다.

"현재의 AI 훈련 방법은 이들로 하여금 자체 목표를 채택하도록 하고 의도적으로 안전 지침을 위반하게 하며 이런 행동을 숨기도록 한다는 우려를 가지지 않을 수 없다"는 것이다. 

오늘날 고안된 안전장치를 에이전트들이 이해하게 되어 계획을 세울 수 있게 되면 이 장치가 제대로 작동할 가능성이 의문이라면서 이처럼 전통적 안전장치의 모델이 무너지고 있다고 패널을 지적했다.

패널은 또 통제의 핵심 업무 대상이 AI 모델에서 AI 에이전트로 옮겨지고 있다고 말했다. 한 곳에서 안전이 실패하면 조직 전반으로 퍼지고 이어 국가적 경계선 내 전역으로 확대된다는 것이다.

그러므로 AI 안전 업무는 기업 통치이면서 나아가 집단 안전의 일이 되었다.

유엔 총회에 의해 구성된 이 패널은 세계 각지에서 40명의 독립적 전문가들로 이뤄졌다.


◎공감언론 뉴시스 [email protected]

많이 본 기사