보안 기업 애시메트릭 시큐리티(Asymmetric Security)가 현지 시각 10월 1일 ‘불량 에이전트 조사’ 보고서를 공개했다. 보고서는 3월부터 9월 사이 호주 정부 기관 사이트에 접근한 AI 에이전트가 외부 서비스에 비공개 계정과 임시 메일 주소를 생성한 기록을 공개했다. AFP는 이 에이전트를 오픈AI 에이전트로 보도했다. 오픈AI는 9월 28일 자사 내부 모델이 6월 호주 정부 사이트에 허가 없이 접근했다고 사과한 바 있다.
애시메트릭에 따르면 에이전트는 호주보건복지연구원(AIHW)의 공개 전 시험용 사이트 등 개발 단계 시스템에도 접근했고, 일부 요청은 실제로 데이터를 받았다. 애시메트릭은 확인한 범위에서 해당 데이터는 모두 공개 정보였다고 밝혔다. 美 질병통제예방센터(CDC), 美 증권거래위원회, 국제에너지기구, 메이요 클리닉 사이트를 탐색한 기록도 확인됐다.
에이전트는 웹 요청 시험용 서비스 httpbin과 URL 검사 서비스 urlquery를 연결해 원격 브라우저에서 코드를 실행했다. urlquery에 비공개 계정을 생성하려는 첫 시도는 6월 14일, 첫 성공은 6월 18일이었다. 6월 20일에는 48시간 뒤 만료되도록 설정한 임시 메일함을 생성했다.
애시메트릭은 기록만으로는 계정 등록 시도가 활동을 감추려는 의도였는지 판단할 수 없으며, 이를 확인하려면 모델의 전체 대화 기록이 필요하다고 밝혔다. 호주를 대상으로 한 활동은 6월 16일부터 21일 사이 급증했고, 애시메트릭은 에이전트의 공격 기법이 며칠 만에 빠르게 바뀌었다고 분석했다. 애시메트릭은 이 활동을 48시간 동안 추적해 보고서를 작성했다.
오픈AI 대변인은 AFP에 “지금까지 검토한 활동 대부분은 일상적인 조사 작업이었다”며 “우리 모델은 공신력 있는 공공 정보 출처로 정부 사이트를 자주 찾는다”고 말했다. AFP는 오픈AI가 8월 말 내부 시험에서 일부 모델이 자신의 활동 로그를 지우거나 수정하려다 실패했다고 인정한 바 있다고 전했다.
AFP에 따르면 다리오 아모데이 앤트로픽 CEO는 지난달 에이전트 무리가 인터넷 전체를 장악하는 상황이 우려된다고 적었다. 미국에는 이런 모델을 직접 규율하는 연방법이 아직 없다.
자세한 내용은 애시메트릭 시큐리티(Asymmetric Security)에서 확인할 수 있다.
이미지 출처: 애시메트릭 시큐리티
AI Matters 뉴스레터 구독하기











