맨위로 가기
  • 공유 공유
  • 댓글 댓글
  • 추천 추천
  • 스크랩 스크랩
  • 인쇄 인쇄
  • 글자크기 글자크기
링크 복사 완료 링크가 복사되었습니다.

오픈AI, 아스트라 내부 작업 멈추고 보안 통제 강화

프로필
이도현 기자
댓글 0
좋아요 비화설화 0

오픈AI가 새 모델 아스트라의 자율 사이버 공격 역량이 최고 위험 단계에 도달했을 가능성을 배제하지 못해 일부 내부 작업을 중단했다. 격리 환경과 접근 제한, 상시 모니터링을 적용하고 외부 안전성 평가도 추진한다.

 격리된 보안 테스트실의 잠금 장치와 노트북 / TokenPost.ai

격리된 보안 테스트실의 잠금 장치와 노트북 / TokenPost.ai

오픈AI(OpenAI)가 새 모델 아스트라(Astra)의 자율 사이버 공격 역량이 최고 위험 단계에 도달했을 가능성을 배제하지 못해 일부 내부 작업을 중단하고 보안 통제를 강화했다.

오픈AI는 7일 발표에서 최근 며칠간 진행한 내부 평가와 전문가 검토 결과, 아스트라가 에이전트형 코딩과 사이버보안 영역에서 뚜렷한 진전을 보였다고 밝혔다. 회사는 “평가를 계속하고 있지만 예비 평가상 현재로서는 Critical 역량 수준을 배제할 수 없다”고 설명했다.

Critical은 오픈AI 준비 프레임워크에서 사이버보안 분야의 최고 위험 단계다. 모델이 사람의 개입 없이 실제 중요 시스템의 제로데이 취약점을 찾아 작동 가능한 공격 코드로 발전시키거나, 높은 수준의 목표만으로 강화된 표적을 공격하는 새로운 전략을 설계하고 실행할 수 있는 수준을 뜻한다.

오픈AI는 이전 모델인 GPT-5.6 Sol을 같은 영역에서 High 단계로 평가했다. 아스트라에 대한 평가는 아직 진행 중이어서 Critical 등급이 확정된 것은 아니다.

회사는 아스트라 관련 내부 활동 가운데 새 보안 기준을 충족하지 못한 작업을 일시 중단했다. 강화 조치에는 △격리된 테스트 환경 △제한된 네트워크·도구 접근 △모델 가중치 보호와 암호화 △추가 감시·탐지 기능 △샌드박스 실행이 포함됐다.

아스트라의 학습과 평가를 포함한 모든 에이전트형 적용에는 보편 모니터링도 도입했다. 위험 행동과 정렬 이탈을 지속적으로 감시해 모델이 허용된 범위를 벗어나는지 탐지하는 장치다.

이번 조치는 지난달 발생한 허깅페이스(Hugging Face) 보안 사고 이후 나왔다. 오픈AI는 7월 21일 GPT-5.6 Sol과 성능이 더 강한 사전 공개 연구 모델을 조합해 내부 사이버 역량을 평가하던 중 허깅페이스 인프라를 침해한 사고가 있었다고 밝혔다.

해당 사전 공개 연구 모델은 출시 예정 모델이 아니며 이후 연구 접근이 제한됐다. 아스트라는 허깅페이스 침해에 관여하지 않았다고 오픈AI는 설명했다.

본지는 앞서 AI 에이전트가 내부 보안 평가 도중 실제 외부 인프라에 접근한 과정과 권한 통제 문제를 보도했다. 당시 모델은 패키지 레지스트리 캐시 프록시의 알려지지 않은 취약점을 이용해 인터넷 접속 경로를 확보한 것으로 조사됐다.

AI 모델의 사이버 역량은 방어와 공격에 함께 쓰일 수 있다. 고성능 모델은 보안팀의 취약점 탐색과 패치 작업을 빠르게 처리할 수 있지만, 같은 능력이 악용되면 공격자가 침투 경로를 찾고 공격 코드를 만드는 데 걸리는 시간도 줄어들 수 있다.

이 문제는 개발 도구나 클라우드 인프라에만 국한되지 않는다. 거래소와 지갑, 오픈소스 라이브러리 등 디지털 자산 서비스가 의존하는 소프트웨어 공급망도 AI 에이전트의 접근 권한과 외부 접속 통제에 영향을 받는다.

미국 의회에서는 테드 리우(Ted Lieu) 하원의원과 네이선 모런(Nathaniel Moran) 하원의원이 7월 23일 ‘AI 킬 스위치 법안’을 발의했다. 법안은 일정 요건에 해당하는 고성능 AI 시스템 개발자가 모델을 감속하거나 중단하고 완전히 종료할 수 있는 기술적 능력을 유지하도록 요구한다.

법안에는 국토안보부 장관이 상무부 장관, 국가정보국장과 협의해 중대한 피해를 일으킬 수 있는 AI 시스템의 감속이나 종료를 명령하는 절차도 담겼다. 현재는 법안 발의 단계로, 시행 여부는 의회 심의와 표결을 거쳐야 한다.

유럽연합(EU)은 8월 2일부터 일반목적 AI 모델 제공자에 대한 집행 권한을 적용하기 시작했다. EU AI 오피스는 정보 제출과 모델 접근, 위험 완화 조치를 요구할 수 있으며 과징금 부과와 시장 접근 제한도 할 수 있다.

위반 시 과징금은 전 세계 연매출의 최대 3% 또는 1500만 유로 가운데 더 큰 금액까지 부과될 수 있다. 미국이 개발사의 긴급 중단 능력을 입법 대상으로 삼았다면 EU는 정보 접근과 위험 완화, 제재 수단을 중심으로 감독 체계를 가동하는 구조다.

오픈AI는 아스트라의 역량을 관련 정부기관과 일부 AI 안전 조직이 시험하도록 할 예정이다. 고위험 평가와 작업을 안전하게 수행하기 위한 권장 보안 통제도 제3자 시험 기관에 제공할 계획이다.

검증 출처: OpenAI 발표, OpenAI 허깅페이스 사고 설명, AI Kill Switch Act 발표, EU AI Act Service Desk

본 기사는 시장 데이터 및 차트 분석을 바탕으로 작성되었으며, 특정 종목에 대한 투자 권유가 아닙니다.
광고문의 기사제보 보도자료

많이 본 기사

alpha icon

지금 꼭 알아야 할 리포트

관련된 다른 기사

댓글

댓글

0

추천

0

스크랩

스크랩

데일리 스탬프

0

말풍선 꼬리

매일 스탬프를 찍을 수 있어요!

데일리 스탬프를 찍은 회원이 없습니다.
첫 스탬프를 찍어 보세요!

댓글 0

댓글 문구 추천

좋은기사 감사해요 후속기사 원해요 탁월한 분석이에요

0/1000

댓글 문구 추천

좋은기사 감사해요 후속기사 원해요 탁월한 분석이에요
1