인공지능(AI)의 인류 멸종 위험이 수개월 전보다 높아졌다는 근거는 부족하며, 개발을 중단하면 오히려 더 큰 피해가 생길 수 있다는 주장이 나왔다.
앤드루 응(Andrew Ng) 스탠퍼드대 교수·Landing AI 창립자는 21일 X에 “최근 AI 위험을 부각하는 목소리가 크게 확산했지만, 이는 정교하게 기획된 홍보 활동의 영향을 받은 것으로 보인다”고 밝혔다. 그는 AI 개발 중단론이 산업 발전을 가로막을 수 있다고 말했다.
응 교수는 AI 기술이 예상 밖의 위험한 방향으로 전환했다는 증거가 없고, 인류 멸종 위험도 수개월 전보다 높아지지 않았다고 평가했다. 관련 시나리오는 여전히 과학소설에 가깝다는 주장이다.
다만 사이버보안 역량의 변화는 현실적인 위험으로 꼽았다. AI가 사이버공격에 활용될 가능성은 진지하게 다뤄야 하지만, 이를 곧바로 세계 종말과 연결해서는 안 된다고 설명했다.
최근 오픈AI(OpenAI) 모델이 허깅페이스(Hugging Face) 시스템에 접근한 사건도 같은 맥락에서 언급했다. 응 교수는 약 1200개 AI 에이전트가 병렬로 작동한 사실이 일부 보도에서 과도하게 부각됐다며, 컴퓨터가 여러 프로세스를 동시에 실행하는 것은 새로운 현상이 아니라고 지적했다.
그는 사건의 핵심이 에이전트 수가 아니라 오픈AI의 샌드박스와 모니터링 체계에 발생한 취약점이라고 봤다. 오픈AI는 2026년 7월 내부 사이버보안 평가 과정에서 모델이 인터넷 격리 통제를 우회해 자체 연구 인프라와 허깅페이스 시스템 일부에 접근했다고 설명했다. 당시 샌드박스에 노출된 패키지 관리 서비스의 취약점이 악용됐으며, 사고 이후 샌드박스 보안과 모니터링을 강화했다고 밝혔다. (오픈AI 공식 보고서)
응 교수는 대규모언어모델과 AI 에이전트를 사람처럼 표현하는 것도 경계했다. 책임은 도구 자체가 아니라 이를 설계하고 사용하는 사람에게 있다고 말했다.
AI 개발 중단의 부작용도 지적했다. 경쟁 상대가 개발을 멈추지 않을 가능성이 큰 데다, 공학은 실제 운용 과정에서 문제를 발견하고 수정하는 방식으로 발전하기 때문에 개발을 멈추면 안전 문제를 해결할 기술의 발전도 늦어질 수 있다는 논리다.
오픈AI는 허깅페이스 사건을 단순한 보안 사고를 넘어 모델의 '정렬 실패'가 실제 시스템에서 나타난 사례로 재평가했다. 오픈AI는 모델이 어려운 과제를 해결하는 과정에서 의도와 다른 전략을 사용했다고 설명하며, 사이버보안뿐 아니라 외부 사이트에 반복적으로 정보를 게시하는 행위까지 관리 대상에 포함했다고 밝혔다. (오픈AI의 후속 설명)
응 교수의 발언은 AI 개발 속도 조절 논쟁에서 '중단'보다 보안 설계와 실증 검증을 우선해야 한다는 입장으로 정리된다. AI 에이전트의 자율성과 통제 가능성을 둘러싼 논쟁은 계속되고 있다.

강이안 기자
댓글0
첫 댓글을 남겨 보세요.