비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

오픈AI, 학습 단계부터 외부 기관에 모델 접근 허용…”인간의 생각에 반박할 수 있어야 한다”

2026.09.23. 12:00:37
조회 수
74

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

오픈AI가 현지 시각 9월 22일 제3자 안전 평가에 관한 우선순위와 원칙을 공식 블로그에 게재했다. 학습과 평가, 배포 전 과정에서 독립 평가 기관에 깊은 수준의 접근을 제공하겠다는 내용이며, 작성자는 라마 아마드다.

그동안 업계 표준은 개발이 끝난 모델을 출시 직전에 검증하는 방식이었다. 오픈AI는 이 접근이 평가 기관으로 하여금 회사의 가정에 반박하고, 회사가 놓쳤을 수 있는 위험을 찾아내며, 안전장치의 효과에 대해 독자적인 결론에 도달할 수 있게 해야 한다고 적었다.

오픈AI가 외부 기관에 요청하려는 검토 대상은 네 영역이다. 첫째, 회사가 “이 모델은 안전하다”고 말할 때 그 근거가 실제로 맞는지 확인하는 작업이다. 모델을 학습시킬 때, 성능을 시험할 때, 사내에서 쓸 때, 외부에 공개할 때를 모두 확인한다. 둘째, 위험한 요청을 막는 장치가 실제로 작동하는지 확인하는 작업이다. 모델 자체에 적용한 제한, 이용자 계정을 차단하는 장치, 보안 장치, 모델이 지시를 벗어나는지 감시하는 장치가 대상이다. 셋째, 화학·생물 무기와 해킹, AI가 스스로 성능을 높이는 능력처럼 오픈AI가 위험하다고 분류해 둔 항목을 회사가 제대로 시험하고 있는지 확인하는 작업이다. 시험 문제가 너무 쉬워지지는 않았는지, 합격선을 적절히 정했는지도 함께 확인한다. 넷째, 모델이 실제로 사고를 일으켰을 때 무슨 일이 있었는지 외부가 직접 조사하는 작업이다. 오픈AI는 허깅페이스 사고를 동일 예로 들었다.

원칙으로는 평가 착수 전 범위와 검증 대상 주장을 사전 등록할 것, 법적·보안·지식재산 제약 안에서 비례적 접근을 제공할 것, 방법론과 판단 기준을 공개할 것, 이해 상충을 공개하고 보상 구조가 결과에 영향을 주지 않도록 할 것, 평가 기관이 편집 독립성을 유지하되 기업의 비공개 요청이 있으면 그 사실과 평가에 미친 영향을 함께 적을 것 등이 제시됐다.

블룸버그는 오픈AI가 METR, 레드우드 리서치와 이 평가를 논의하고 있다고 보도했다. 학습 단계까지 범위를 넓히는 이유로는 모델이 자신이 평가받는 상황임을 알아차리는 능력이 언급된다. 완성된 모델만 시험하면 놓치는 신호를 학습 과정 기록에서 확인할 수 있다는 것이다.

이번 발표는 지난 9월 18일 전문가들이 공개서한을 통해 개발사에 소속된 평가자가 독립성을 유지할 수 있는지 문제를 제기한 뒤에 공개됐다.

자세한 내용은 오픈AI에서 확인할 수 있다.

이미지 출처: 오픈AI




AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
2/1
엔비디아 아이작 ROS 5.0 공개…AI 에이전트가 로봇 개발 환경 설정을 대신한다 AI matters
알파벳 인트린식, 로봇 팔 제어 스택 아파치 2.0으로 배포…ROSCon서 인트린식 코어 공개 AI matters
코그넥스, 뎁스 카메라 기업 리얼센스 6,770억 원에 인수…로봇 인식 시장 진입 AI matters
웨이모, 내슈빌서 13~17세 단독 탑승 허용…청소년 계정 적용 두 번째 도시 AI matters
사이러, 5,420억 원 추가 투자…AI 에이전트 보안 ‘신뢰 계층’ 구축 AI matters
하이디, 4,610억 원 신규 펀딩…임상 기록 AI에서 ‘케어 파트너’로 확장 AI matters
스노클 AI, 4,750억 원 규모 펀딩…기업가치 4조 7,500억 원 AI matters
중국, 딥시크·문샷 AI 조사…”사용자 데이터 클로드 유출” AI matters
영국 의회, 오픈AI·앤트로픽·구글 딥마인드·메타 소환…”AI 규제, 미래 대비 안 돼” AI matters
트럼프-시진핑 만찬에 나델라·젠슨 황·알트만…테크 CEO 총출동 (1) AI matters
오픈AI 수학 성과 주장에 수학자들 “그 연구는 부정행위다”…게브루·벤더 기고 AI matters
애스트로포지, 지구와 교신하지 않는 우주선을 AI가 제어한다…2027년 자율 비행 시험 AI matters
AMD, 기존 트랜스포머를 장문 모델로 전환하는 제브라-하이로 공개…KV 캐시 최대 98% 감소 AI matters
메타 뮤즈의 전화 예약, 실제로는 콜센터 상담원이 걸었다…사내 시험에서 확인 AI matters
오픈AI 모델 채점 계약직, AI로 채점하다 해고…적발 단서는 반복어·엠대시·빠른 완료 AI matters
시스코 탈로스 “운영자 없이 작동하는 AI 악성코드 첫 확인”…추적 도구 CAIRN 오픈소스 공개 AI matters
UN 안보리, 23일 AI 회의 소집…오픈AI·앤트로픽·딥시크 한자리에 AI matters
오픈AI, 학습 단계부터 외부 기관에 모델 접근 허용…”인간의 생각에 반박할 수 있어야 한다” AI matters
오픈AI, GPT-6 솔·루나 공개…API 가격 절반으로 인하하고 오류는 전작의 절반 AI matters
앤트로픽 클로드 오퍼스 5.5 공개…오퍼스 5보다 작업 비용 40% 낮추고 출력 속도 30% 높여 AI matters
이 시간 HOT 댓글!
1/4