구글에서 선호하는 출처로 추가

앤스로픽, 사이버 AI 3단계 심사…차단 기준·평가 결과 공개

토포AI로 이 기사 더 깊이 읽기

취약점 점검 도식을 살피는 보안 연구자의 손 / TokenPost.ai (mono)

앤스로픽이 사이버 보안용 AI 모델 접근을 방어 업무, 승인된 침투 테스트, 핵심 안전 시스템 시험 등 세 단계로 나눴다. 사용자의 자격과 허가된 작업 범위에 따라 심사와 안전장치를 달리하는 방식이다.

앤스로픽은 10월 6일(현지시간) 사이버 검증 프로그램(CVP)을 개편했다고 밝혔다. 기존 CVP와 프로젝트 글래스윙(Project Glasswing)을 통합하고, 클로드 오퍼스 5.5·클로드 소넷 5.5·클로드 미토스 5.1 등 지정 모델을 세 등급에 따라 제공한다. 취약점을 찾고 고치는 기능은 공격에도 악용될 수 있어 일반 모델에는 보수적인 안전장치를 적용해 왔다고 회사는 설명했다.

디펜스 액세스는 보안 운영, 사고 대응, 악성코드 역공학, 취약점 분석과 검증을 위한 등급이다. 기업·비영리단체·대학·정부기관 보안팀과 오픈소스 유지관리자, 취약점 제보 이력이 있는 개인 연구자가 신청할 수 있다. 앤스로픽은 신청에 며칠 안에 답하는 것을 목표로 제시했다.

레드팀 액세스는 허가받은 시스템을 대상으로 침투 테스트와 모의 공격을 수행하는 조직에 열려 있다. 개인 연구자는 신청할 수 없으며, 심사 중인 조직은 요건을 충족하면 디펜스 액세스를 이용할 수 있다. 랜섬웨어 배포, 물리 시스템 손상, 대규모 장애를 일으킬 수 있는 행위는 이 등급에서도 차단된다.

전문 액세스는 전력망·통신망·은행 간 이체망·항공기 운항 시스템처럼 사람의 생명이나 시장에 영향을 줄 수 있는 안전 시스템을 시험하는 일부 검증 조직에 한정된다. 앤스로픽은 미국 정부와 함께 신청 조직을 심층 심사한다고 밝혔다. 기존 프로젝트 글래스윙 참여 조직은 현재 모델에 한해 재승인 없이 이 등급으로 전환된다.

이번 개편은 모델 기능을 일괄적으로 풀거나 막는 대신, 사용자의 자격과 허가된 작업에 맞춰 통제 수준을 나눈 것이다. 앞서 앤스로픽이 사이버 검증 프로그램과 미토스급 접근 확대 계획을 발표한 데 이어, 이번에는 등급별 신청 대상과 차단 기준, 평가 결과를 구체화했다.

앤스로픽은 자체 평가 도구 사이시나리오벤치(CyScenarioBench)로 안전장치를 시험했다. 클로드 오퍼스 5.5는 디펜스 액세스 평가에서 50회 시도 중 46회 차단됐고, 레드팀 액세스에서는 차단 없이 50개 과제 중 34개를 완료했다. 이는 회사가 공개한 자체 평가 결과다.

취약점 발견 실적도 앤스로픽이 공개한 집계다. 회사는 프로젝트 글래스윙 참여자들이 2026년 4~7월 검증된 소프트웨어 취약점 최소 12만9000건을 찾았고, 자체 오픈소스 스캔으로 4~10월 5500건을 추가 확인했다고 밝혔다. 이 가운데 3만3000건 이상은 심각 또는 높은 등급으로 분류됐다.

집계는 파트너 33곳의 일부 보고와 오픈소스 협력 자료를 바탕으로 했다. 패치 현황을 공개한 파트너는 절반에 못 미쳤다.

따라서 공개된 발견 건수만으로 실제 수정 속도나 보안 개선 정도를 판단하기는 어렵다. 이번 개편은 접근 권한을 작업별로 구분하는 기준과 회사 자체 평가를 공개했지만, 취약점이 분류·공개·패치되는 과정과 현장 성과를 보여주는 자료는 별도로 필요하다.

오늘의 스탬프 0명이 오늘 찍었어요
오늘의 스탬프 0명이 오늘 찍었어요

0

    불러오는 중…

    토큰포스트 앱 다운로드 QR 코드 QR 코드 스캔하고
    ios, Android 앱
    다운로드 하기