맨위로 가기
  • 공유 공유
  • 댓글 댓글
  • 추천 추천
  • 스크랩 스크랩
  • 인쇄 인쇄
  • 글자크기 글자크기
링크 복사 완료 링크가 복사되었습니다.

딥시크 API 복구…V4 플래시가 에이전트 토큰 70% 차지

프로필
김하린 기자
댓글 0
좋아요 비화설화 0

딥시크 API가 4일 오전 일시적인 성능 저하를 겪은 뒤 복구됐다. 에이전트 작업에서 V4 플래시가 높은 사용 비중을 차지하면서 API 운영 안정성이 주요 변수로 떠올랐다.

 서버실 앞 계산기와 GPU 랙이 놓인 장면 / TokenPost.ai (illustration)

서버실 앞 계산기와 GPU 랙이 놓인 장면 / TokenPost.ai (illustration)

딥시크(DeepSeek) API가 4일 오전 일시적인 성능 저하를 겪은 뒤 복구됐다. 에이전트 작업에서 V4 플래시가 높은 사용 비중을 차지하는 가운데 모델 성능뿐 아니라 API 운영 안정성도 주요 변수로 부각됐다.

딥시크는 서비스 상태 페이지에서 API 성능 저하 문제를 해결하고 서비스를 복구했다고 밝혔다. 장애의 정확한 시작 시각과 영향 범위, 오류율은 공개하지 않았다.

딥시크는 지난 7월 31일 V4 플래시 API의 공식 릴리스를 공개 베타로 전환했다. 공식 API 문서는 V4 플래시가 리스폰스 API 형식을 기본 지원하며 코덱스(Codex)에 맞춰 조정됐다고 설명했다.

허깅페이스(Hugging Face) 모델 카드에 따르면, V4 플래시는 전체 파라미터 2840억 개와 활성 파라미터 130억 개를 갖춘 전문가혼합(MoE) 모델이다. 컨텍스트 길이는 100만 토큰이며 모델 가중치는 MIT 라이선스로 공개됐다.

오픈라우터(OpenRouter)는 6월 30일 블로그에서 2026년 1월 1일부터 6월 14일까지 450조 토큰이 넘는 요청 로그를 분석한 결과를 공개했다. 5월 말 기준 딥시크의 에이전트 워크로드 토큰 가운데 V4 플래시가 차지한 비중은 70%였다. 최저가 엔드포인트 비용은 100만 토큰당 입력 0.09달러(약 129원), 출력 0.18달러(약 257원)로 제시됐다.

개발자 커뮤니티에서는 속도와 안정성에 대한 우려가 나왔다. 중국 개발자 포럼 LINUX DO에는 엔비디아 NIM에서 V4 플래시를 시험한 결과 요청 5건 가운데 1건만 성공했고 출력 속도는 초당 12.8토큰이었다는 이용자 측정값이 게시됐다. 공식 장애 통계가 아닌 개별 이용자의 시험 결과다.

AI API는 거래 봇과 온체인 데이터 요약, 개발·고객지원 자동화 등에 활용될 수 있다. 호출 지연이나 오류가 늘어나면 이를 기반으로 운영되는 서비스의 품질에도 영향을 줄 수 있다.

본지는 앞서 중국 AI 모델의 오픈웨이트 확산과 사용량 증가를 보도했다. 딥시크의 이번 성능 저하가 특정 크립토 서비스 장애로 이어졌는지는 확인되지 않았다.

본 기사는 시장 데이터 및 차트 분석을 바탕으로 작성되었으며, 특정 종목에 대한 투자 권유가 아닙니다.
광고문의 기사제보 보도자료

많이 본 기사

alpha icon

지금 꼭 알아야 할 리포트

관련된 다른 기사

댓글

댓글

0

추천

0

스크랩

스크랩

데일리 스탬프

0

말풍선 꼬리

매일 스탬프를 찍을 수 있어요!

데일리 스탬프를 찍은 회원이 없습니다.
첫 스탬프를 찍어 보세요!

댓글 0

댓글 문구 추천

좋은기사 감사해요 후속기사 원해요 탁월한 분석이에요

0/1000

댓글 문구 추천

좋은기사 감사해요 후속기사 원해요 탁월한 분석이에요
1