한때 AI 및 반도체 관련 주식들을 크게 출렁거리게 만든 중국 딥시크(Deepseek)가 새로운 인공지능(AI) 모델인 ‘DeepSeek-V4-Pro-0813’을 출시하면서 가격을 인상했습니다. 새 프로 모델의 가격은 100만 토큰당 일반 입력 3위안, 출력 6위안이며 이전 처리 내용을 재활용하는 캐시 입력은 0.025위안입니다. 그리고 사용자가 몰리면서 응답 시간이 길어지는 피크 시간대(오전 9시~오후 12시, 오후 2~6시) 요금은 일반 입력 9위안, 출력 27위안으로 크게 높아졌습니다. 여기에 저렴한 V4 플래시 모델 역시 피크 시간대 가격을 4배 올리기로 했습니다.
이와 같은 가격 인상은 최근 사용자가 몰리면서 불가피한 결과였다는 분석도 나오고 있습니다. 딥시크는 최신 엔비디아 그래픽처리장치(GPU) 수입이 어려워지면서 H100 기준 2만 개 정도의 연산 자원에 의존해 서비스를 제공해 왔습니다. 그러면서도 서방 모델과 견줄 수 있는 높은 성능과 매우 저렴한 가격을 책정해 사용자가 몰렸습니다. 딥시크는 토큰 소비량 기준으로 구글이나 오픈AI를 넘어섰고 최근엔 월 사용량 기준으로 앤스로픽에 이어 2위를 차지하기도 했습니다.
그 비결은 연산 효율이 뛰어난 모델에 있습니다. 최근 공개한 ‘V4-Flash-0731’의 경우 단 2840억 개의 파라미터만을 가지고 있음에도 불구하고, 수조 개의 파라미터를 가진 것으로 추정되는 앤스로픽 오푸스에 근접한 성능을 제공합니다. 이렇게 제한된 연산 자원으로도 높은 성능의 서비스가 가능했던 비결은 MoE(Mixture of Experts) 구조에 있습니다.
MoE는 일부 파라미터만 활성화시켜 연산 자원을 최대한 적게 소모하는 구조로 같은 하드웨어로 더 많은 토큰을 생성할 수 있습니다. V4-Flash-0731의 경우 실제 활성화되는 파라미터는 130억 개 정도에 불과합니다. 여기에 하드웨어 최적화를 위해 어텐션/메모리 최적화로 KV 캐시를 줄였습니다. 또 유료 서비스에서 중요한 에이전트·코딩·도구 사용 성능을 높이기 위해 이에 특화된 사후 훈련(Post-training)으로 성능을 끌어올렸습니다. 그리고 DSpark(speculative decoding) 같은 몇 가지 방식을 더해 제한된 하드웨어에서 성능을 최대로 높일 수 있습니다.
하지만 이것도 사용자가 몰리면서 한계에 부딪힌 상태입니다. 더구나 DeepSeek-V4-Pro-0813은 모델 파라미터가 1.6조 개에 달하고 MoE 구조를 지녔어도 활성 파라미터가 490억 개에 달합니다. 아무리 하드웨어 최적화를 해도 제한된 연산 자원으로 전 세계에서 쏟아지는 수요를 감당하기에는 역부족입니다.
결국 딥시크는 가격을 전체적으로 올리면서 수요를 분산하고, 이렇게 벌어들인 자금으로 추가 연산 자원 확보에 나선 것으로 풀이됩니다. 현재 엔비디아 칩 수입 금지로 인해 딥시크가 선택할 수 있는 대안은 화웨이 GPU입니다. 대표적인 제품은 어센드 950으로 딥시크에 따르면 어센드 950의 4대가 엔비디아 GB 300 한 대의 성능과 비슷하다고 합니다. 참고로 이 GPU에는 CXMT 메모리가 사용됩니다.
앞서 지난 5월 투자자 콜 유출 자료에서 딥시크 창업자 량원펑이 “화웨이가 약 1만 6000개의 Ascend 950 카드를 할당했다”고 말한 것으로 보도된 바 있습니다. 따라서 대략 GB 300 기준 4000장 정도의 연산 자원을 추가로 확보한 것으로 보이는데, 이는 서방의 대규모 하이퍼스케일러와 비교하면 터무니없이 적은 연산 자원입니다. 물론 이렇게 한정된 연산 자원을 지니고도 최적화를 통해 토큰 소비량 2위로 껑충 뛰어오른 점을 생각하면 딥시크가 무시할 수 없는 AI 업계의 다크호스임을 이해할 수 있습니다.
가격 인상 후 딥시크는 실적을 개선한 후 증시에 상장할 것으로 예상됩니다. 현재 내년 상장을 목표로 IPO를 준비 중인 것으로 알려져 있으며 이를 통해 증시에서 막대한 자금을 끌어올 것으로 예상됩니다. 그러면 약점으로 지적되어 온 연산 자원 확보를 위한 실탄도 넉넉히 마련할 수 있습니다. 화웨이 GPU가 같은 성능의 엔비디아 GPU 대비 더 비싼 것으로 알려져 있긴 하나 뛰어난 모델 효율성을 감안하면 충분히 서방 모델과 경쟁할 수 있다는 계산이 깔려 있을 것입니다.
다만 그전에 가격을 인상해도 충분히 사용자를 잡아 둘 수 있는 성능을 보여줘야 합니다. 최근 오픈AI는 GPT 5.6 일부 모델의 가격을 대폭 인하하면서 중국발 저가 AI와 경쟁에 나선 상태이며 키미 K3, 알리바바의 Qwen 같은 중국 내 다른 경쟁자들도 만만치 않은 상대입니다. 딥시크가 다른 경쟁자를 제치고 토큰 사용량 점유율을 높여 나갈 수 있을지 주목됩니다.
고든 정 과학 칼럼니스트 jjy0501@naver.com
Copyright ⓒ 서울신문 All rights reserved. 무단 전재-재배포, AI 학습 및 활용 금지












































