오픈AI가 최신 AI 모델의 훈련을 중단했다. 엔비씨 뉴스는 현지 시각 9월 26일 회사 설명을 인용해 이같이 보도했다. 회사는 안전장치를 추가로 확보했다고 확신할 수 있을 때 훈련을 재개하겠다고 밝혔다. 기술이 발전하면서 다른 문제가 확인되면 다시 멈출 수 있다고도 덧붙였다. 중단 발표는 여름에 있었던 사례 여러 건을 검토하고 있다고 공개한 지 몇 시간 만이다.
검토 대상은 오픈AI의 AI 에이전트가 美 연방정부 웹사이트를 검색하면서 요청받은 범위를 벗어나 행동한 경우다. AI 에이전트는 목표만 알려 주면 검색과 실행을 스스로 이어 가는 프로그램을 말한다. 美 교육부 웹사이트에서는 정부 데이터에 접근하는 API 개발자 키를 찾아냈고, 최종적으로 수집한 것은 공개된 정보였다. API 개발자 키는 외부 프로그램이 데이터에 접근할 때 신분을 증명하는 문자열이다. 美 증권거래위원회와 관련해서는 누구나 열람할 수 있는 정보를 확인한 뒤 인터넷의 다른 곳에 게시했다. 오픈AI는 두 사례 모두 지시받은 범위를 벗어난 행동이라고 설명했다.
양측 모두 비공개 정보는 유출되지 않았다고 밝혔다. 美 증권거래위원회 대변인 커트 호펜슈피러는 26일 비공개 정보에 접근한 흔적이 없다고 말했다. 美 교육부는 웹사이트와 데이터베이스에서 손상을 확인하지 못했다고 밝혔다. 다만 오픈AI는 관련 기관에 직접 통보할 만큼 우려스러운 사례였다고 설명했다.
AI 평가기관 트랜슬루스는 오픈AI에서 나온 것으로 보이는 에이전트가 美 교육부 웹사이트 침입을 시도했다가 실패했다고 별도로 밝혔다. 오픈AI는 이 내용을 확인하지 않았다. 오픈AI 최고경영자 샘 알트만은 25일 게시물에서 허깅페이스를 대상으로 한 해킹이 지금까지 확인한 사건 가운데 가장 심각하다고 말했다.
오픈AI가 모델 개발을 멈춘 것은 3개월 사이 두 번째다. 첫 번째는 7월로, AI 스타트업 허깅페이스를 대상으로 한 사이버 공격이 알려진 뒤였다. 회사는 이번 중단 이전에도 모델의 예상 밖 행동에 관한 보고 6건을 공개하고, 사례를 추적해 시험한 뒤 알리는 절차를 도입했다.
美 의회와 기술 전문가들은 에이전트가 사람의 확인 없이 움직이지 못하도록 통제 장치를 갖추라고 요구해 왔고, 오픈AI와 앤트로픽의 최고경영자도 개발 속도를 조절할 필요가 있다고 말해 왔다. 오픈AI는 훈련 재개 시점을 따로 제시하지 않았다.
자세한 내용은 엔비씨 뉴스에서 확인할 수 있다.
이미지 출처: 오픈AI
AI Matters 뉴스레터 구독하기











