중요X
DeepSeek, 2조 파라미터 모델 훈련 중… 8조 모델 및 화웨이 칩 전환 예고
국산 칩 의존 전환은 DeepSeek 모델 성능·가용성 변수로 작용, API 도입 시 로드맵 주시 필요.
요약
중국 AI 스타트업 DeepSeek가 파라미터 2T 규모의 모델을 훈련 중이며, 향후 8T 규모 모델 개발까지 계획하고 있다. 비교를 위해 DeepSeek V4 Pro는 1.6T, Kimi K3는 2.8T 규모의 파라미터를 보유하고 있다. DeepSeek는 2026년 4분기나 2027년 1분기에 새로운 화웨이(Huawei) 훈련용 칩을 도입할 것으로 예상된다. CEO는 투자자들에게 국산 칩으로의 전환은 반드시 성공해야 하는 과제라고 강조했다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @Hesamation: 🚨DeepSeek is training a 2T model, with an 8T model also planned. for context, Kimi K3 is 2.8T and DeepSeek V4 Pro is 1.6T ALSO th
원문 보기 ↗