앤트로픽의 제한형 보안 AI 모델 클로드 미토스 5가 지캐시 프로토콜을 감사했지만 추가로 심각한 버그를 발견하지 못했다. 가상자산 업계의 AI 보안 모델 접근권 격차가 부각된 가운데 실제 프로토콜 감사 사례가 확인됐다.
앤트로픽(Anthropic)은 6월 9일 클로드 페이블 5(Claude Fable 5)를 일반에 제공하고 클로드 미토스 5(Claude Mythos 5)는 프로젝트 글래스윙(Project Glasswing) 파트너와 일부 연구자에게 제한 제공한다고 밝혔다. 두 모델은 같은 기반 모델을 사용하지만 미토스 5에는 일부 사이버 보안 안전장치가 적용되지 않는다.
앤트로픽은 미토스 5를 “세계에서 가장 강한 사이버 보안 능력을 가진 모델”이라고 설명했다. 일반 이용자는 같은 능력에 더 강한 안전장치를 적용한 페이블 5를 사용하는 구조다.
안전장치는 보안 연구 과정에서 정상적인 요청까지 차단할 수 있다. 앤트로픽은 페이블 5의 안전 분류기가 방어 목적일 가능성이 있는 요청도 막는 오탐을 일으킬 수 있다고 인정했다.
가상자산 업계에서는 코드 결함이나 키 관리 실수가 곧바로 온체인 자금 이동으로 이어질 수 있다. 파이어블록스(Fireblocks)는 2월 보고서에서 디지털 자산 환경에서는 공격자가 한 번만 성공해도 자금 이동을 되돌리기 어렵다고 설명했다.
앤트로픽은 6월 2일 프로젝트 글래스윙 확대 발표에서 약 50개 초기 파트너가 클로드 미토스 프리뷰를 활용해 고위험 또는 치명적 보안 결함 1만 개 이상을 찾았다고 밝혔다. 참여 대상을 약 150개 조직으로 확대할 계획이지만 각 조직은 보안 요건을 충족해야 한다.
가상자산 프로젝트를 대상으로 한 활용 사례도 나왔다. 주코 윌콕스(Zooko Wilcox) 지캐시(Zcash) 창립자는 6월 12일 X에서 실디드랩스(Shielded Labs)의 요청으로 앤트로픽이 미토스를 이용해 지캐시 프로토콜을 감사했으며 추가로 “심각한 버그”를 발견하지 못했다고 말했다.
이번 감사 결과가 지캐시 프로토콜의 안전성을 보장하거나 기존 보안 감사를 대체한다는 의미는 아니다. 감사 범위와 코드 버전, 프롬프트 구성 등 세부 기술 조건은 공개되지 않았다.
본지는 앞서 지캐시 업그레이드와 미토스 관련 검증 논란을 보도했다. AI를 이용한 보안 검증에서는 모델의 결과뿐 아니라 점검 대상과 실행 환경, 사람의 후속 검증도 함께 살펴야 한다.
오픈AI(OpenAI)도 제한 접근 방식을 채택했다. 오픈AI는 5월 7일 GPT-5.5와 GPT-5.5-Cyber를 ‘신뢰된 사이버 접근’ 체계로 제공한다고 밝혔다. 일반 방어 업무에는 GPT-5.5를 제공하고 더 허용적인 GPT-5.5-Cyber는 검증된 소수 파트너의 전문 업무에 지원한다.
오픈AI 데이브레이크(Daybreak) 자료에서 GPT-5.5-Cyber는 CyberGym 단일 모델 평가 85.6%, ExploitGym 39.5%, SEC-bench Pro 69.8%를 기록했다. AI 에이전트의 실제 인프라 접근에서는 평가 환경의 권한 설정이 결과에 직접 영향을 준다.
바이낸스는 준비금 증명 페이지에서 사용자 자산을 1대1로 보유한다고 설명한다. 다만 준비금 증명은 지갑 잔고와 부채 포함 여부를 보여주는 장치로, 고성능 AI 보안 모델의 이용 권한과는 별개의 보안 지표다.
고성능 보안 모델의 제한 제공은 검증된 조직에 더 넓은 기능을 허용하면서도 오용 위험을 통제하려는 구조다. 앤트로픽은 프로젝트 글래스윙 참여 대상을 약 150개 조직으로 확대하되 보안 요건을 충족한 조직에만 접근권을 제공할 예정이다.

