모두의 AI
NVIDIA 로고
NVIDIA

Qwen3.6 35B-A3B NVFP4

NVIDIA가 Qwen3.6 35B-A3B를 NVFP4로 양자화한 MoE (전문가 혼합) 모델입니다. 활성 파라미터 약 3B와 최대 262K 컨텍스트를 제공해 NVIDIA GPU에서의 고효율 추론에 적합합니다.

인기도 #65 Apache 2.0 mixture-of-expertsNVFP4 quantizationmultimodal

📊 벤치마크

💰 가격
$0 input / $0 output (USD/M)
NVFP4 양자화 오픈소스 가중치, 자체 호스팅 비용 별도
📄 컨텍스트 창
262,144 tokens
📅 출시일
2026년 5월 27일
🔗 접근
open-source · self-host · huggingface

⚙️ 주요 능력

  • mixture-of-experts
  • NVFP4 quantization
  • multimodal
  • long-context
  • NVIDIA-optimized
📦 상세 정보는 원본

이 페이지는 빠른 비교용 요약입니다. 공식 정보는 다음 원본을 확인하세요.