DeepSeek
DeepSeek V3
총 671B 파라미터 중 활성 37B의 MoE (전문가 혼합) 모델. 약 560만 달러의 저비용 학습으로 GPT-4o급 성능을 달성해 업계에 충격을 주었습니다.
인기도 #65 MIT mixture-of-expertsfunction-callingjson-mode
📊 벤치마크
MMLU (상식) 88.5
HumanEval (코딩) 82.6
GSM8K (수학) 89.3
lmsysElo 1318
💰 가격
$0.27 input / $1.1 output (USD/M)
📄 컨텍스트 창
128,000 tokens
📅 출시일
2024년 12월 26일
🔗 접근
api · open-source · self-host
⚙️ 주요 능력
- ▸mixture-of-experts
- ▸function-calling
- ▸json-mode
- ▸multilingual
📦 상세 정보는 원본
이 페이지는 빠른 비교용 요약입니다. 공식 정보는 다음 원본을 확인하세요.