공지
[공지] Divided by Zero 멤버십 전환 안내 ☕️

딥시크, 엔비디아 쿠다(CUDA) 탈출?

2026.10.06 | 조회 69 |
0
|

Divided by Zero에 오신 걸 환영합니다. IT테크, 스타트업 그리고 자본시장에 대한 2차적 사고를 공유합니다.

2025년 2월 딥시크가 오픈소스 위크라는 이름으로 닷새 동안 도구 다섯 개를 풀었습니다. 전부 엔비디아 GPU용이었죠.

그리고 지난 9월 30일, 딥시크가 같은 도구들을 다시 내놨습니다. 이번엔 화웨이 어센드(Ascend) 칩용입니다.

첨부 이미지

딥시크가 위챗 공식 계정으로 화웨이 어센드용 인프라 구성요소 여섯 개를 오픈소스로 공개했습니다. 그 중 핵심이 딥GEMM-어센드(DeepGEMM-Ascend)입니다. 딥시크 모델 연산의 대부분을 차지하는 행렬 곱셈을 처리하는 라이브러리인데, 엔비디아용 딥GEMM과 같은 API를 그대로 씁니다. 개발자가 쓰던 명령어를 바꾸지 않고 화웨이 칩으로 옮겨갈 수 있다는 뜻이죠.

나머지 도구들도 엔비디아 생태계 구성요소와 하나씩 짝을 이룹니다.

역할엔비디아 생태계딥시크 어센드 버전
프로그래밍 언어 계층CUDATileLang
행렬 연산 가속cuBLASDeepGEMM-Ascend
칩 간 통신NCCLDeepEP-Ascend

화웨이 엔지니어들이 개발에 깊이 참여했고, 두 회사가 어센드 950 칩 128개짜리 슈퍼노드를 같이 최적화했습니다. 딥시크는 통신 라이브러리가 물리적 대역폭 한계의 90~95%까지 나왔다고 밝혔습니다. 다만 외부에서 재현한 결과는 아직 없습니다.

쿠다=해자

이게 왜 중요할까요? 엔비디아의 진짜 해자가 칩이 아니라 소프트웨어이기 때문입니다.

엔비디아 연간 보고서 기준으로 쿠다(CUDA)와 관련 도구를 쓰는 개발자가 750만 명이 넘습니다. 쿠다는 엔비디아 GPU를 프로그래밍하는 플랫폼인데, 지난 15년여 동안 AI 코드 대부분이 이 위에서 쓰였습니다. 다른 칩이 아무리 싸고 빨라도 코드를 다시 짜야 한다면 옮기기 어렵죠.

딥시크가 한 일은 그 전환 비용을 깎는 겁니다. 정확히는 딥시크 방식으로 짠 코드에 한해서죠. 딥시크 오픈소스 도구로 모델을 돌리던 팀이라면 엔비디아에서 화웨이로 넘어가는 일이 훨씬 가벼워졌습니다.

화웨이

9월 4일 블룸버그 보도로는 딥시크가 내몽골에 짓는 데이터센터에 화웨이 어센드 950DT를 최소 16만 장 깔 계획입니다. 알려진 화웨이 칩 클러스터 중 최대 규모가 될 수 있는 물량이죠.

용도는 일단 추론입니다. 모델을 돌리고 사용자 질문에 답하는 데 쓰고, 학습은 기존 엔비디아 칩으로 계속한다는 거죠. 그런데 량원펑(梁文锋) 창업자가 투자자들에게 학습에도 화웨이 칩을 더 쓰겠다고 말했다는 보도가 이어졌습니다.

량원펑은 지금 가장 큰 모델 규모를 학습하려면 엔비디아 GB300이 약 5만 장, 화웨이 칩으로는 약 20만 장이 필요하다고 봤습니다. 엔비디아 칩 하나에 화웨이 칩 넷. 시기로는 화웨이가 2년쯤 뒤처져 있다고 봤습니다.

칩이 네 배면 전력도, 냉각도, 공간도 대략 네 배입니다.

이 비율대로면 16만 장은 GB300 4만 장분이죠. 량원펑이 프론티어급 학습에 필요하다고 말한 5만 장의 80%입니다. 추론용으로 주문했다는 클러스터가 그의 계산으로는 학습용 클러스터에 근접한 규모라는 겁니다.

공급

문제는 화웨이가 그만큼 만들 수 있느냐입니다.

고대역폭 메모리 같은 부품 부족 때문에 올해 어센드 950DT 생산량은 20만~30만 장 수준으로 예상됩니다. SMIC의 7나노·6나노급 생산 능력도 묶여 있죠. 딥시크 계획 하나가 화웨이 연간 생산량의 53~80%를 차지하는 셈입니다.

5월 투자자 통화 녹취록이 유출됐는데, 거기서 량원펑은 화웨이가 처음 배정해준 물량이 어센드 950 약 1만 6,000장이었다고 말했습니다. 인터넷 대기업들은 10만 장 넘게 받을 수 있었다고요. 블룸버그는 딥시크가 화웨이 배정을 늘리고 앞당기도록 베이징 당국에 설득을 요청했다고 보도했습니다. 전체 물량이 다 들어오는 데 1년 넘게 걸릴 수 있다는 관측도 있습니다.

엔비디아는?

당장 엔비디아 실적에 미치는 영향은 크지 않습니다. 화웨이는 이 칩을 당분간 중국 안에서만 팔 계획이고, 엔비디아는 이미 이번 분기 중국 데이터센터 매출을 0으로 잡아두고 있으니까요. 없는 매출을 더 잃을 수는 없죠.

영향은 더 길게 보면 나타납니다. 지금까지는 수출 규제가 풀리면 중국 개발자들이 엔비디아로 돌아올 거라는 가정이 있었습니다. 쿠다로 짠 코드가 거기 있으니까요. 그런데 코드가 화웨이 칩에서도 같은 API로 돌아가기 시작하면 그 가정이 약해집니다.

중국 AI 스택에서 마지막까지 엔비디아에 묶여 있던 게 소프트웨어였습니다. 딥시크가 그 고리 하나를 풀었죠.

남은 제약은 이제 하드웨어 쪽입니다. 성능은 네 배 차이가 나고, 공급은 한 회사 주문이 연간 생산의 절반 넘게 차지할 만큼 빠듯합니다. 량원펑은 화웨이가 몇 년 안에 엔비디아를 따라잡을 수 있다고 봤는데, 그 몇 년 동안 소프트웨어가 먼저 준비돼 있으면 칩이 따라왔을 때 옮겨가는 데 걸리는 시간은 거의 없을 겁니다. 엔비디아가 중국을 다시 열 기회가 온다면, 그때 돌아갈 고객이 얼마나 남아 있을까요?

다가올 뉴스레터가 궁금하신가요?

지금 구독해서 새로운 레터를 받아보세요

이번 뉴스레터 어떠셨나요?

Divided by Zero 님에게 ☕️ 커피와 ✉️ 쪽지를 보내보세요!

댓글

의견을 남겨주세요

확인
의견이 있으신가요? 제일 먼저 댓글을 달아보세요 !

다른 뉴스레터

© 2026 Divided by Zero

IT테크, 스타트업 그리고 자본시장에 대한 2차적 사고를 공유합니다

메일리 로고

도움말 오류 및 기능 관련 제보

서비스 이용 문의admin@team.maily.so 채팅으로 문의하기

메일리 사업자 정보

메일리 (대표자: 이한결) | 사업자번호: 717-47-00705 | 서울특별시 송파구 위례광장로 199, 5층 501-2-31호

이용약관 | 개인정보처리방침 | 정기결제 이용약관 | 라이선스