구글에서 선호하는 출처로 추가

오픈AI, GPT-5.6 출시로 AI 상용 경쟁 격화

오픈AI, GPT-5.6 출시로 AI 상용 경쟁 격화 / 연합뉴스

오픈AI가 새 인공지능 모델 GPT-5.6을 일반 시장에 공식 출시하면서, 미국 정부의 사전 검증 절차를 거친 첨단 인공지능이 본격적인 상용 경쟁 단계로 들어섰다.

오픈AI는 9일(현지시간) GPT-5.6을 솔, 테라, 루나 등 3개 세부 모델로 나눠 내놓는다고 밝혔다. 이 모델은 도널드 트럼프 행정부의 첨단 인공지능 모델 사전 검증 행정명령에 따라 지난달 26일 일부 기관에 먼저 공개된 뒤 약 2주 만에 일반에 풀렸다. 생성형 인공지능의 영향력이 커지면서, 미국 정부가 안전성과 잠재 위험을 먼저 점검하려는 흐름이 실제 출시 절차에 반영된 사례로 볼 수 있다.

샘 올트먼 최고경영자는 이날 미 경제방송 CNBC 인터뷰에서 하워드 러트닉 상무장관, 스콧 베선트 재무장관, 숀 케언크로스 국가사이버국장 등과 의견을 조율했고 그 과정에서 많은 변경 사항이 반영됐다고 설명했다. 다만 무엇이 구체적으로 바뀌었는지는 공개하지 않았다. 그는 정부가 새 모델을 시험하면서 잠재적 문제를 찾고 있다며, 절차가 이해하기 쉽고 공정하며 신속하다면 수용할 수 있다는 입장을 밝혔다. 이는 앞서 오픈AI가 정부 승인 절차가 장기적인 표준이 돼서는 안 된다고 선을 그었던 것과 비교하면 다소 유연해진 태도로 읽힌다.

성능 면에서 최상위 모델인 솔은 주요 경쟁 모델과 비슷한 수준의 경쟁력을 보였다. 터미널 환경 코딩 능력을 재는 터미널-벤치 2.1에서는 88.8%를 기록해 앤트로픽의 클로드 미토스5 88%를 소폭 웃돌았고, 솔 울트라는 91.9%를 기록했다. 사이버보안 역량을 측정하는 사이버짐에서도 84.5%로 미토스5의 83.8%를 넘어섰다. 최근 실무형 인공지능의 핵심 지표로 떠오른 에이전트의 마지막 시험(ALE·복합 업무를 얼마나 자율적으로 수행하는지 보는 평가)에서는 52.7%를 기록해 클로드 페이블5 40.5%, 오퍼스4.8 45.2%보다 높은 점수를 받았다. 반면 소프트웨어 개발 실전 능력을 가늠하는 SWE-벤치 프로에서는 64.6%에 그쳐 미토스5 80.3%, 클로드 오퍼스4.8 69.2%보다 낮았다. 분야별로 강점과 약점이 엇갈린 셈이다.

시장 평가도 빠르게 반영됐다. 인공지능 모델 평가기업 아티피셜 애널리시스는 GPT-5.6 솔에 59점을 줘 페이블5 60점에 이어 2위로 평가했고, GPT-5.6 테라는 55점으로 오퍼스4.8 56점 다음인 4위에 올렸다. 이에 따라 전날 4위에 진입했던 스페이스XAI의 그록4.5는 하루 만에 6위로 밀렸다. 오픈AI는 이날 기업과 전문가가 업무 현장에서 활용할 수 있는 인공지능 에이전트 도구 챗GPT 워크도 함께 공개했다. 이는 앤트로픽의 클로드 코워크, 마이크로소프트의 코파일럿 코워크와 정면 경쟁할 가능성이 크다. 한편 올트먼 최고경영자는 오픈AI가 미국 정부에 지분 5%를 제공하는 방안을 제시했다는 최근 보도에 대해서는 부정확한 내용이 많다고 밝혔고, 연내 기업공개 추진 여부에는 확답하지 않았다. 이 같은 흐름은 앞으로 인공지능 산업이 단순한 모델 성능 경쟁을 넘어 규제 적응력, 실무 활용도, 기업용 생태계 구축 능력을 함께 겨루는 방향으로 이어질 가능성이 크다.

오늘의 스탬프 0명이 오늘 찍었어요
오늘의 스탬프 0명이 오늘 찍었어요

0

    불러오는 중…

    토큰포스트 앱 다운로드 QR 코드 QR 코드 스캔하고
    ios, Android 앱
    다운로드 하기