NVIDIA
Qwen3.6 35B-A3B NVFP4
NVIDIA가 Qwen3.6 35B-A3B를 NVFP4로 양자화한 MoE (전문가 혼합) 모델입니다. 활성 파라미터 약 3B와 최대 262K 컨텍스트를 제공해 NVIDIA GPU에서의 고효율 추론에 적합합니다.
인기도 #65 Apache 2.0 mixture-of-expertsNVFP4 quantizationmultimodal
📊 벤치마크
💰 가격
$0 input / $0 output (USD/M)
NVFP4 양자화 오픈소스 가중치, 자체 호스팅 비용 별도
📄 컨텍스트 창
262,144 tokens
📅 출시일
2026년 5월 27일
🔗 접근
open-source · self-host · huggingface
⚙️ 주요 능력
- ▸mixture-of-experts
- ▸NVFP4 quantization
- ▸multimodal
- ▸long-context
- ▸NVIDIA-optimized
📦 상세 정보는 원본
이 페이지는 빠른 비교용 요약입니다. 공식 정보는 다음 원본을 확인하세요.