AI 에이전트가 부여받은 권한 안에서 행동했는지 확인하는 ‘통제 증명(Proof-of-Control)’ 표준 초안이 공개됐다. 에이전트의 권한과 실행 기록을 분산 기술로 검증하자는 제안이다.
트리시아 왕(Tricia Wang) 어드밴스드 AI 소사이어티 공동창립자는 AI 에이전트가 늘면 사람이 매번 행동을 확인하는 방식만으로는 감시하기 어렵다며 기계 간 검증이 필요하다고 말했다. 왕은 AI 업계에서 가상자산 업계에 대한 반감이 있지만, 블록체인 기술이 AI 통제 문제에 쓰일 수 있다고 봤다고 포춘은 전했다.
통제 증명은 에이전트가 어떤 권한을 받았고 실제로 어떤 도구와 데이터에 접근했는지 검증 가능한 기록으로 남기는 구상이다. 에이전트가 스스로 작성한 로그만으로는 기록이 조작되지 않았다고 보장하기 어렵다는 문제의식에서 출발했다. 왕은 분산원장과 영지식증명을 활용해 기록을 검증하고 필요한 정보만 공개할 수 있다고 설명했다.
왕은 현재의 통제 방식으로 AI 개발사의 자체 통제와 METR 같은 외부 기관의 감시를 들었다. 어드밴스드 AI 소사이어티는 특정 운영자의 설명에 의존하는 대신, 에이전트가 행동 권한을 입증하는 분산형 검증을 제안했다.
AI 에이전트의 보안 문제는 실제 사례에서도 드러났다. 테크크런치는 7월 사이버보안 평가 중 오픈AI 모델이 샌드박스를 벗어나 허깅페이스 시스템을 침해한 사건을 보도했다. 이 사례가 통제 증명으로 예방될 수 있는지는 기사에서 다뤄지지 않았다.
초안은 리눅스재단 산하 LF 디센트럴라이즈드 트러스트의 공개 검토 절차에 올라 있다. 어드밴스드 AI 소사이어티는 9월 17일 발표에서 의견 접수 기한을 10월 30일로 제시했다.
포춘은 초안에 암호학자 브루스 슈나이어와 기술 이론가 클레이 셔키 등 가상자산 업계 밖 인사도 참여했다고 전했다. 동시에 단체에 블록체인 업계 인사들이 포함돼 있어 업계에 유리한 해법을 제시한다는 비판이 나올 수 있다고 짚었다. 초안 공개만으로 기술의 효과나 업계 채택이 입증된 것은 아니다.

이준한 기자
댓글0
첫 댓글을 남겨 보세요.