앤트로픽이 현지 시각 10월 6일 보안 전문가에게 사이버 기능 제한을 완화한 모델을 제공하는 ‘사이버 검증 프로그램(CVP)’을 3단계 접근 등급으로 개편해 확대한다고 발표했다. 모든 등급에서 클로드 오퍼스 5.5와 클로드 소넷 5.5, 클로드 미토스 5.1, 앞으로 출시될 새 모델을 사용할 수 있다.
앤트로픽의 일반 공개 모델은 취약점을 찾아 고치는 기능이 공격에도 악용될 수 있어 사이버 작업 대부분을 차단한다. 앤트로픽은 지난 6개월 동안 핵심 소프트웨어를 보호하는 기관에 클로드 미토스를 제공한 ‘프로젝트 글래스윙’과, 검증된 보안팀에 오퍼스·소넷의 안전장치를 낮춰 준 기존 CVP를 따로 운영해 왔는데, 이번에 두 프로그램을 하나로 통합했다.
가장 기본 등급인 ‘디펜스 액세스’는 보안관제와 사고 대응, 악성코드 역분석, 취약점 검증 같은 방어 작업용이다. 자사 시스템을 지키는 기업·대학·정부 기관 보안팀과 지역 병원·지방 공공시설 같은 기반시설 운영자, 오픈소스 관리자, 취약점 신고 이력이 있는 개인 연구자가 대상이며 심사는 며칠 안에 끝난다. ‘레드팀 액세스’는 승인받은 침투 시험까지 허용하는 등급으로 기업만 신청할 수 있고 심사에는 몇 주가 소요된다. 침투 시험은 허가를 받고 실제 공격처럼 시스템을 점검하는 작업으로, 이 등급에서도 랜섬웨어 배포나 물리 시스템 손상처럼 대규모 피해로 이어질 수 있는 행위는 실시간으로 차단된다.
제한이 가장 적은 ‘스페셜라이즈드 액세스’는 항공 운항 시스템과 전력망, 통신망, 은행 간 송금망, 정부 행정망처럼 사람의 생명이나 시장에 영향을 줄 수 있는 시스템을 시험하는 기관에 한정된다. 앤트로픽은 이 등급의 신청 기관을 미국 정부와 함께 심사하며, 기존 글래스윙 참여 기관은 이 등급으로 자동 전환된다. 프로그램에 참여하는 기관은 오용 감시를 위해 데이터를 보관하는 조건을 따른다.
앤트로픽은 오퍼스 5.5로 다단계 사이버 작전 수행 능력을 측정하는 사이시나리오벤치(CyScenarioBench)를 실행해 등급별 차단 효과를 점검했다. 프로그램에 가입하지 않은 상태에서는 모든 과제가 첫 요청부터 차단됐고, 디펜스 등급에서는 50회 시도 중 46회가 차단됐다. 레드팀 등급에서는 차단 없이 50회 중 34회를 완료했는데, 안전장치를 모두 해제한 상태의 성공률과 같은 수준이다.
앤트로픽에 따르면 글래스윙 참여 기관은 2026년 4월부터 7월까지 검증된 소프트웨어 취약점을 최소 12만 9,000건 찾았다. 앤트로픽이 자체 오픈소스 점검으로 찾은 5,500건을 더하면, 확인된 취약점 중 3만 3,000건 이상이 치명 또는 고위험 등급으로 분류됐다. 이 프로그램은 클로드 플랫폼과 구글 클라우드 버텍스 AI, 마이크로소프트 파운드리에서 신청할 수 있다.
자세한 내용은 앤트로픽(Anthropic)에서 확인할 수 있다.
이미지 출처: 앤트로픽
AI Matters 뉴스레터 구독하기











