AI/ML 온디바이스 2026.07.23 ⭐ 8/10
LM Studio
**데스크톱 로컬 LLM GUI** — llama.cpp + Apple MLX 백엔드 통합으로 GGUF/MLX/BitNet 1.58 모델을 1-click 실행. BitNet 1.58b 7B를 M2 Max 64GB에서 ~25 tok/sec, M3 Max 128GB에서 ~55 tok/sec. 'Bring Your Own Model' 정책, OpenAI 호환 로컬 서버 내장 → 로컬 IDE/Cursor/Roo Code 통합. 2026-03 LM Studio Hub 출시로 팀 단위 모델 카탈로그·공유 가능.
코딩·문서 분석·이미지 인식을 로컬 Mac/Windows/Linux에서 1-click 실행. BitNet 1.58b 7B 모델을 M2 Max 64GB에서 ~25 tokens/sec, M3 Max 128GB에서 ~55 tokens/sec. 'Bring Your Own Model' 정책으로 모든 GGUF/MLX 모델 즉시 실행. 2026년 3월 'LM Studio Hub' 출시 — 팀 공유 모델 카탈로그.