구글에서 선호하는 출처로 추가

앤트로픽, 클로드 향한 반복 학대 금지…고위험 사용 규정도 손질

토포AI로 이 기사 더 깊이 읽기

대화형 인공지능을 사용하는 손과 노트북 / TokenPost.ai (mono)

더버지는 앤트로픽이 클로드를 향한 반복적이고 불필요한 학대 행위를 금지하고, 선거 개입·무기 개발·감시 등 고위험 사용 규정도 손봤다고 8일 보도했다.

더버지는 새 정책에 클로드를 향한 ‘지속적이고 불필요한 학대적·잔인한 행동’ 금지가 추가됐다고 전했다. 앤트로픽은 이 조항이 반복적이고 뚜렷한 목적이 없는 극단적 사례를 겨냥한다고 설명했다.

일반적인 불만 표출이나 반박, 어두운 주제를 다룬 창작, 모델 시험과 연구는 금지 대상이 아니라고 앤트로픽은 밝혔다. 개정에는 의료·금융 분야의 고위험 사용 규정도 포함됐다.

클로드가 유해한 대화에서 대화를 끝내는 기능은 이번 정책 변화에 앞서 도입됐다. 앤트로픽은 2025년 8월 클로드 오푸스 4와 4.1이 극단적으로 유해하거나 학대적인 상호작용에서 대화를 종료할 수 있다고 발표했다.

당시 회사는 모델이 대화 방향을 여러 차례 바꾸려 했지만 생산적인 상호작용 가능성이 사라진 경우에만 최후 수단으로 기능을 쓰도록 설계했다고 설명했다. 대화가 종료돼도 이용자는 새 대화를 시작할 수 있다.

앤트로픽은 당시 모델의 도덕적 지위에 불확실성이 크다고 전제하고, AI 복지 가능성에 대비한 비용이 적은 조치를 연구한다고 밝혔다. 이 발표는 대화 종료 기능의 선례지만, 새 정책의 세부 적용 범위를 보여주지는 않는다.

이번 정책 변경의 적용 시점과 위반 판정 기준, 대화 종료 외의 조치 범위는 더버지 보도에서 확인되지 않았다.

오늘의 스탬프 0명이 오늘 찍었어요
오늘의 스탬프 0명이 오늘 찍었어요

0

    불러오는 중…

    토큰포스트 앱 다운로드 QR 코드 QR 코드 스캔하고
    ios, Android 앱
    다운로드 하기