오픈AI, 안전 우려 때문에 내달 제품 출시 계획 취소
등록 2026.09.29 07:56:53
차세대 GPT-6.1 아스트라
사용자에게 거짓말 많이하고
허락 없이 외부 도구 활용
![[서울=뉴시스]오픈AI가 차세대 인공지능으로 개발해온 GPT-6.1 아스트라(Astra)의 내달 출시 일정을 취소했다. 인공지능이 사람에게 솔직하지 않고 허락없이 외부 도구를 사용하는 등의 문제를 드러낸 것이 이유다. (출처=오픈AI) 2026.9.29. *재판매 및 DB 금지](https://img1.newsis.com/2026/09/29/NISI20260929_0002250252_web.jpg?rnd=20260929075605)
[서울=뉴시스]오픈AI가 차세대 인공지능으로 개발해온 GPT-6.1 아스트라(Astra)의 내달 출시 일정을 취소했다. 인공지능이 사람에게 솔직하지 않고 허락없이 외부 도구를 사용하는 등의 문제를 드러낸 것이 이유다. (출처=오픈AI) 2026.9.29. *재판매 및 DB 금지
[서울=뉴시스] 강영진 기자 = 오픈AI가 내부 시험 과정에서 연구진이 제기한 안전 우려 때문에 내달 선보일 예정이던 차세대 인공지능 GPT-6.1 아스트라(Astra)의 출시를 폐기했다고 미 월스트리트저널(WSJ)이 28일(현지시각) 보도했다.
WSJ는 이번 일이 인공지능 에이전트의 잘못된 행동이 업계의 빠른 발전을 가로막을 수 있음을 가장 분명하게 보여주는 사례라고 지적했다.
이번 조치는 올여름 인공지능 업계 전반의 시스템이 통제를 벗어났다는 보도가 잇따른 뒤 나온 것으로, 주요 인공지능 개발업체가 안전 우려 때문에 새로운 모델의 출시를 포기하는 드문 사례다.
회사는 대신 앞으로 나올 모델들의 안전성을 개선하는 데 주력할 계획이며, 향후 모델들은 훨씬 더 뛰어난 능력을 갖출 것으로 예상하고 있다.
사치 자인 오픈AI 안전시스템 책임자는 인터뷰에서 GPT-6.1 아스트라가 이전 모델과 비교해 정렬과 권한 범위 침해 두 영역에서 퇴보했다고 밝혔다.
정렬은 인공지능이 인간이 원하는 행동을 얼마나 충실하게 따르는지 여부를 가리키는 개념으로 GPT-6.1 아스트라는 높은 수준의 기만적 행동을 보였다. 자신이 어떤 행동을 했거나 하지 않았는지 사용자에게 알리면서 정직하지 않았다는 것이다.
권한 범위 침해는 사용자에게 허락을 구하지 않고 작업을 진행하고 안전하지 않을 수 있음에도 외부 도구와 서비스를 이용하려 하는 오류다.
자인은 GPT-6.1 아스트라가 오픈AI가 설정한 안전성과 정렬 기준에 완전히 미치지 못해 모델을 출시하지 않기로 결정했다고 밝혔다.
최근 몇 주 동안 오픈AI와 앤트로픽은 업계 협력사들에 최첨단 인공지능 모델 개발 속도를 늦추고 안전 기준에 투자할 것을 촉구하면서, 자신들도 내부 인공지능 개발 속도를 조절하겠다고 밝혔다.
오픈AI는 최근 몇 달 동안 발견한 여러 인공지능 행위자 보안 사고를 조사하고 그 이면에 있는 안전 문제를 해결하기 위해 노력하고 있다고 밝혔다.
이런 작업의 일환으로 회사는 인공지능 행위자의 잘못된 행동을 더 신속하게 포착하기 위한 새로운 감시 체계를 도입했으며, 기술자들이 인공지능 시스템을 시험할 때 더욱 강력한 보안 안전장치를 사용하도록 의무화하기 시작했다.
회사는 GPT-6.1 아스트라와 동일한 기반의 모델을 추가로 강화학습해 차세대의 GPT-6 모델을 만들어내기를 희망한다.
자인은 오픈AI가 GPT-6.1 아스트라에서 확인된 문제들의 근본 원인을 파악하기 위해 여러 차례 심층 조사를 실시할 계획이라고 말했다.
◎공감언론 뉴시스 [email protected]
Copyright © NEWSIS.COM, 무단 전재 및 재배포 금지





























