오픈AI가 9월 21일 프런티어 AI 국제 기술 표준을 미국이 주도해 마련하자고 제안하는 글을 공식 블로그에 게시했다. 샘 알트만 최고경영자가 9월 24일 유엔 안전보장이사회에서 브리핑하기 사흘 전이다.
오픈AI는 이 글에서 재귀적 자기 개선(RSI)을 중심에 놓았다. AI 시스템이 다음 세대 AI를 개발하는 작업을 점점 더 많이 담당하면서 성능 향상이 스스로 반복되는 과정을 가리킨다. 오픈AI는 “완전 자율 RSI는 오늘 일어나고 있지 않으며, 안전하게 수행할 수 있다는 것이 확인되기 전까지 추진해서는 안 된다”고 적었다. 적절한 주의 없이 진행하면 사람이 이해하지 못하는 연구 과정을 감독하지 못한 채 AI 개발에 대한 실질적 통제를 잃을 수 있다는 설명이다. 회사는 7월 허깅페이스 사고가 RSI의 직접적 결과는 아니지만, 안전장치와 정렬 연구가 확보되지 않을 때 훨씬 심각해질 수 있는 위험을 미리 보여 준 사례라고 언급했다. 정렬은 AI를 사람의 의도와 가치에 맞추는 작업이다.
오픈AI가 국제 표준이 필요한 이유로 제시한 문제는 단편화와 집단행동, 불균등한 역량이다. 나라마다 평가 항목과 보고 요건, 사고 정의가 달라지면 증거를 비교하기 어렵고 국경을 넘는 위험에 대응하기 어려워진다. 각국이 따로 움직이면 어느 나라도 원하지 않는 결과가 나올 수 있으며, 프런티어 개발 역량과 전문성이 세계에 고르게 분포하지 않은 상황이 두 문제를 키운다는 것이다.
구체적 방안으로는 호주와 캐나다, 독일, 프랑스, 케냐, 일본, 한국, 싱가포르, 인도, 영국에 이미 설립된 AI 안전연구소 네트워크를 활용해 美 AI 표준혁신센터(CAISI)와 각국 산업 단체를 통해 표준을 정하는 방식을 제시했다. 오픈AI는 이렇게 제정된 기술 표준이 허가나 출시 전 의무 심사, 승인 요건은 아니라고 명시했다. 각국 정부가 자국 법제에 반영할지 스스로 결정하면 된다는 것이다. 표준 제정 과정에는 오픈웨이트 개발사와 폐쇄형 모델 개발사, 독립 전문가, 학계가 함께 참여해야 하며, 특정 기업이나 국가, 사업 모델에 유리하게 설계돼서는 안 된다고 덧붙였다.
공통 측정과 사고 보고 항목으로는 RSI와 관련된 진전의 평가, 자동화된 AI 연구에 대한 인간 감독의 기준, 사고 분류와 추적·보고 체계를 꼽았다. 회사는 중요 인프라 운영자와 각국 정부가 국가 안보 우려와 새로 발견된 취약점을 공유할 보안 통신 경로를 두는 일도 중요하다고 적었다. 미국과 중국의 대화 역시 긍정적인 조치이며 예정된 회담 시점이 적절하다고 평가했다.
자세한 내용은 오픈AI에서 확인할 수 있다.
이미지 출처: 오픈AI
AI Matters 뉴스레터 구독하기











