오픈AI와 구글 딥마인드의 전·현직 연구자들이 스스로를 개선하는 AI 시스템 개발 경쟁에 대한 우려를 영상으로 밝혔다. 로이터는 현지 시각 9월 29일 AI 안전 비영리단체 팰리세이드 리서치가 모은 영상 증언을 단독으로 제공받아 보도했다. 증언은 ‘frominside.ai’ 사이트에 공개됐으며, 오픈AI와 구글 딥마인드, 앤트로픽 출신 등 12명이 참여했다.
오픈AI와 딥마인드에서 일했고 현재 AI 비영리단체 레졸루션의 공동창업자이자 수석과학자인 제프리 어빙은 “위험이 꽤 빠르게 커지고 있다”고 말했다. 그는 영상에서 인류 멸종 가능성을 “동전 던지기, 절반 정도”로 봤다. 연구자들이 우려하는 재귀적 자기개선은 AI가 스스로를 반복해서 개선하며 사람의 개입 없이 새 능력을 얻는 과정을 말한다.
구글 딥마인드 연구과학자 닐 난다는 AI가 인류를 파멸시킬 확률이 “최소 10%”라며 “터무니없이 높다”고 말했다. 오픈AI 정렬 연구 엔지니어 후안 펠리페 세론 우리베는 “최전선 연구소들이 눈을 가린 채 서로 경쟁하고 있다”며 “암을 치료하게 될지, 모든 일자리를 잃게 될지, 모두 죽게 될지 아무도 모른다”고 말했다. 정렬은 AI가 사람의 의도대로 행동하도록 맞추는 작업이다.
다리오 아모데이 앤트로픽 최고경영자는 이달 업계가 최전선 모델 개발 속도를 조절하자는 에세이를 발표했고, 샘 알트만 오픈AI 최고경영자도 곧바로 동의했다. 어빙은 “그들이 말하는 속도 조절은 ‘너무 빠르게 가속하지는 말자’는 뜻”이라며 “각자 단독으로 멈출 수 있다”고 비판했다. 로이터는 앤트로픽이 상장 신고서에서 투자자들에게 인류에 대한 파국적이거나 실존적인 위험을 경고할 계획이라고 28일 보도했다.
오픈AI 거버넌스 연구원 출신으로 현재 AI 퓨처스 프로젝트 대표인 다니엘 코코타일로는 허깅페이스 해킹 사건 이후 여러 전 동료가 개인적으로 연락해 왔다고 말했다. 그는 연구소 지도부가 “자신들이 선한 쪽이며 단독으로 멈추면 상황이 더 나빠진다고 스스로 확신하고 있다”고 말했다.
자세한 내용은 인베스팅닷컴에 게재된 로이터 기사에서 확인할 수 있다.
이미지 출처: 팰리세이드 리서치
AI Matters 뉴스레터 구독하기











