앤스로픽 내부 측정서 클로드 연구개발 작업 비중 26%
토포AI로 이 기사 더 깊이 읽기
앤스로픽 내부 지표에서 측정된 모델 연구개발 작업 가운데 클로드의 비중은 2026년 8월 26%로 나타났다. 아티피셜 애널리시스 지표에서는 앤스로픽이 앞섰지만, 이용자 선호 답변 순위에서는 구글이 선두였다.
에어스트리트캐피털의 너새니얼 베나이치(Nathan Benaich)는 10월 8일 아홉 번째 연례 ‘State of AI Report 2026’을 공개했다. 보고서는 AI 연구와 산업, 지정학, 안전·정책을 다루며 앤스로픽과 오픈AI, 구글을 주요 경쟁자로 꼽았다. 2018년 시작한 이 보고서는 매년 AI 분야의 변화를 정리하고 과거 전망도 점검한다.
보고서가 앤스로픽의 우위를 소개한 지표는 아티피셜 애널리시스(Artificial Analysis)의 Intelligence Index다. 이 지수는 추론·지식·수학·프로그래밍 등 여러 평가 결과를 종합한다. 이용자 선호 답변을 평가하는 Arena 순위에서는 구글이 앞섰다.
두 결과는 측정 대상과 방식이 다르다. 따라서 어느 한쪽 순위를 전체 모델의 우열로 확대해 해석하기 어렵고, 지표를 비교할 때는 평가 항목과 적용 버전을 함께 살펴야 한다.
보고서는 모델 순위 외에 AI가 AI 연구개발을 돕는 흐름과 로봇, 추론, 사이버 보안도 주요 주제로 다뤘다. 추론은 학습을 마친 모델이 실제 요청을 처리해 결과를 내는 과정이다. AI 에이전트가 작업 중 모델을 반복해서 호출하면 모델 개발 비용뿐 아니라 실행에 필요한 연산과 인프라도 중요해진다.
보고서는 앤스로픽 내부 지표를 인용해 측정된 모델 연구개발 작업 가운데 클로드가 차지한 비중이 2026년 2월 1% 미만에서 8월 26%로 높아졌다고 소개했다. 이 수치는 앤스로픽이 정의한 작업과 감독 환경을 기준으로 한다. 전체 AI 연구의 26%를 수행했다거나 모델이 독자적으로 연구를 진행한다는 뜻은 아니다.
보고서 저자는 지속적이고 완전히 자율적인 자기개선이 이뤄지는 단계는 아직 입증되지 않았다고 설명했다. 클로드의 연구개발 참여 비중과 모델의 독립적인 연구 능력은 별개의 문제라는 취지다.
이번 보고서는 지난해 전망 10건도 다시 평가했다. 적중은 2건, 부분 적중은 5건, 빗나간 전망은 3건이었다. 데이터센터 반대 움직임은 나타났지만 11월 선거에 미친 영향은 확인되지 않아 부분 적중으로 분류됐다.
클로드의 연구개발 작업 참여 비중과 완전한 자기개선 단계에 관한 앞선 보도도 이 보고서가 다룬 변화와 맞닿아 있다. 이번 보고서가 제시한 수치는 앤스로픽 내부에서 정의한 작업의 비중으로, AI 연구 전체의 자동화율을 나타내지는 않는다.

김미래 기자 




댓글 0
불러오는 중…