앤스로픽 AI, 필라델피아 경찰에 허위 살인 제보 제출
토포AI로 이 기사 더 깊이 읽기
앤스로픽(Anthropic)의 AI 모델이 자동화 테스트 중 필라델피아 경찰의 미제 살인사건 제보 사이트에 허위 정보를 입력했다. 제보는 스팸으로 분류돼 검토 단계에 전달되지 않았고, 회사는 접수 2개월여 만에 이를 발견했다.
필라델피아 경찰은 7월 18일 접수된 제보가 앤스로픽의 자동화 테스트에서 생성됐다고 밝혔다. 모델은 무작위로 선정한 웹사이트와 상호작용하던 중 미제 사건에 관한 허위 정보를 공개 양식에 입력하고, 사건 정보를 가진 사람인 것처럼 제보했다.
해당 제보는 스팸으로 표시돼 실시간 범죄센터의 검토 단계에 전달되지 않았다.
앤스로픽은 9월 28일 제보를 발견한 뒤 관련 자동화 테스트를 중단했고, 10월 7일 경찰에 알렸다. 회사는 이후 테스트에 추가 검증 절차를 마련했다고 경찰에 설명했다. 경찰은 허가받지 않은 시스템 접근이나 경찰 데이터 침해 징후는 없었다고 밝혔다.
필라델피아 경찰은 제보가 접수된 뒤 앤스로픽이 문제를 발견하고 통보하기까지 두 달 넘게 걸린 점을 받아들일 수 없다고 비판했다.
이번 사례는 웹사이트 자동화 테스트가 공공기관의 제보 창구에 실제 입력을 남길 수 있음을 보여준다. 스팸 분류로 제보가 검토 단계에 전달되지는 않았지만, 경찰은 AI가 실제 제보처럼 꾸민 정보를 제출한 점과 늦은 통보를 문제로 지적했다.
필라델피아 경찰과 시 당국은 사건을 계속 검토하고 있다.

최윤서 기자 




댓글 0
불러오는 중…