모두의 AI
Startups

글로벌 AI 혁신 스타트업

AI 모델·에이전트·로보틱스·반도체·온디바이스 AI 등 핵심 기술을 만드는 글로벌 AI 스타트업 76개를 모았습니다. YC·a16z·Sequoia 등 액셀러레이터와 VC 포트폴리오, 유명 창업자 출신 회사 위주로 정리했습니다. 한국 독자를 위해 한국어 본문 + 영문 원문 링크를 함께 제공합니다.

AI/ML 온디바이스

+25개

Anthropic

San Francisco, CA · 2021

**Constitutional AI** — 인간 라벨 대신 '헌장(Constitution)'으로 안전성 자기비판 후 RLHF/RLAIF 학습. Sleeper Agents / Sycophancy 등 안전 연구로 유명. Claude 3.5 Sonnet은 SWE-bench Verified 최고 성능 기록. Claude 4 Opus는 코딩·분석·장문 처리에 강점. AI 안전·해석 가능성(Interpretability) 분야를 최우선으로 투자.

⭐ 10

PrismML

Pasadena, California, USA (Caltech 인근 · Caltech 스핀오프) · 2025

**1-bit / Ternary 가중치 압축의 선구주자**. 목적 함수는 모델 크기·복잡도 증가 없이 'intelligence density'(단위 추론당 intelligence)를 질적으로 끌어올리는 것 — 이들이 말하는 'Concentrating intelligence'. 기존 PTQ(Post-Training Quantization) 방식과 달리, 학습 단계부터 1-bit을 first-class로 가정하고 학습하는 full-stack 접근. 1-bit 가중치 세팅에서도 LLM-quality 텍스트 생성을 달성한 최초의 상용 솔루션. Bonsai 시리즈는 27B 같은 대형 모델도 6GB 미만 메모리 footprint로 단일 스마트폰에서 실시간 추론이 가능. 셀룰러 폰에서 27B 추론은 본질적으로 모델 크기와 정확도 trade-off의 종결을 의미.

⭐ 9

RunAnywhere

San Francisco, CA (YC W26) · 2025

Hand-written GPU and NPU kernels for fast on-device inference across consumer silicon (Apple/Qualcomm)

⭐ 9

Mirai Labs

London, UK (TechCrunch 2026-02 기준) · 2025

Apple Silicon 대상 Rust 기반 온디바이스 추론 엔진 + 모델 변환·양자화 스택

⭐ 9

Cartesia

San Francisco, CA · 2023

State Space Models (S4/Mamba) — **sequence 길이에 linear scaling**, transformer의 quadratic attention 대비 memory·power 효율 압도. Hardware-aware algorithm (kernel fusion, parallel scan, recomputation) 적용. 모듈 SSM + MLP 블록을 통합한 homogeneous architecture. Sonic (TTS) + Ink (STT) + Line (agent platform) + H-Nets (hierarchical 토크나이저 프리) 풀스택. Cloud + On-premise + On-device 동시 배포 (in-region mandatory). 실시간 voice AI 시장을 latency-first로 설계.

⭐ 9

Qualcomm AI Hub

San Diego, CA · 2023

Snapdragon NPU용 100+ pre-optimized 모델 카탈로그, INT8/INT4 양자화, Hexagon DSP 오프로드

⭐ 9

MLC AI

Seattle, WA / CMU spinoff · 2022

온디바이스 LLM 컴파일러 — Apache TVM 기반. LLaMA·Phi-3·Mistral·Qwen 모델을 4-bit/8-bit으로 변환, iOS·Android·Apple Silicon·Raspberry Pi·브라우저 WebGPU에 배포.

⭐ 9

Perplexity AI

San Francisco, California, U.S. · 2022

Real-time answer engine -- RAG + multi-source citation + Sonar LLM (in-house, Meta Llama based). User queries are synthesized with web search results (Context) and citation (sources) presented. Perplexity Pro combines Claude, GPT-4, Gemini, Sonar and other models. Comet and Computer expand to agentic browser and computer use areas. Real-time multi-source citation is the technical differentiator. Hallucination minimization is core.

⭐ 9

Quanta Compute

Palo Alto, CA · 2022

1.58-bit ternary LLM inference ASIC — BitNet 1.58을 하드웨어로, 칩당 100W로 70B 모델 50 tokens/sec

⭐ 9

Neural Magic

Boston, MA · 2018

CPU-only LLM inference engine — INT8/INT4 양자화 + sparsity pruning, GPU 없이 RTX 4090 1/5 비용

⭐ 9

Hailo

Tel Aviv, Israel · 2017

Hailo-8 / Hailo-15 AI 추론 가속기 — 26 TOPS @ 2.5W, 자동차·카메라·로봇용 edge AI 전용

⭐ 9

Groq

Mountain View, CA · 2016

LPU (Language Processing Unit) — deterministic inference with custom TSP architecture, 500+ tokens/sec on Llama 70B

⭐ 9

Quadric

Burlingame, CA, USA (Pune, India 지사) · 2016

라이선싱형 프로그래머블 GPNPU(Chimera) IP + 단일 툴체인 SDK — 1~6,912 TOPS 확장

⭐ 9

Cactus Compute

United Kingdom (London) · 2025

Cross-platform on-device AI inference engine for smartphones, laptops, edge — automatic cloud fallback

⭐ 8

BitEnergy AI

San Francisco, CA · 2023

**BitNet 1-bit transformer IP 라이선싱 + binary 신경망 코어** — Qualcomm Hexagon·Apple Neural Engine·MediaTek APU 대상 IP 코어. 1-bit으로 학습·추론 모두 가능, INT8 대비 16-32x 메모리↓, 4-8x 전력↓. MediaTek Dimensity 9400 통합 보도. Samsung Ventures가 Exynos NPU 통합 추진 중.

⭐ 8

FlexGen

Berkeley, CA · 2023

**LLM KV cache offloading + INT4/INT8 quantization** — KV cache를 GPU·CPU·NVMe로 계층적 오프로딩, OPT-175B 단일 A100에서 1 token/ms. INT4 weight + INT8 KV cache 동시 양자화로 175B 모델을 24GB GPU로 추론 가능. TensorRT-LLM보다 2-3배 적은 VRAM. Samsung Ventures 모바일 LLM 추론 협력.

⭐ 8

LM Studio

San Francisco, CA (remote-first) · 2023

**데스크톱 로컬 LLM GUI** — llama.cpp + Apple MLX 백엔드 통합으로 GGUF/MLX/BitNet 1.58 모델을 1-click 실행. BitNet 1.58b 7B를 M2 Max 64GB에서 ~25 tok/sec, M3 Max 128GB에서 ~55 tok/sec. 'Bring Your Own Model' 정책, OpenAI 호환 로컬 서버 내장 → 로컬 IDE/Cursor/Roo Code 통합. 2026-03 LM Studio Hub 출시로 팀 단위 모델 카탈로그·공유 가능.

⭐ 8

Ambient Scientific

Vancouver, Canada · 2019

**뉴로모픽 analog in-memory computing 칩** — matrix multiplication을 메모리 셀 안에서 직접 수행. DRAM 왕복 0으로 100x 전력 효율. 0.5mW급 칩으로 7B LLM 추론 가능, AA 배터리로 1년 연속 작동 보도. Qualcomm Hexagon·Apple Neural Engine과 정면 경쟁.

⭐ 8

Picovoice

Vancouver, Canada · 2018

**온디바이스 음성 AI** — Leopard STT(99개 언어), Orca TTS(38개 언어), Porcupine wake-word를 클라우드 없이 ARM Cortex-M/A/모바일/웹(WASM)에서 실행. Whisper 대비 latency 10배↓ + 프라이버시 우위. 한국어 모델 정식 지원.

⭐ 8

Lightmatter

Mountain View, CA · 2017

**광자(photonic) 컴퓨팅** — 빛의 간섭으로 matrix multiplication 수행, 전력 소비 0에 가까운 수준. NVIDIA H100 대비 ~10x 전력 효율 (보도). Envise 양산, Passage M1000 interconnect 출시. post-silicon 패러다임 제시.

⭐ 8

Substratus

Berlin, Germany (원격) · 2023

Apple Silicon 특화 LLM 서빙 컨테이너 — MLX 포맷 자동 변환, llama.cpp·MLX·Core ML 통합 백엔드. 4-bit GGUF/MLX → M2/M3 Neural Engine 최적화.

⭐ 7

Substratus

San Jose, CA · 2023

Open-source 1-bit LLM serving framework — llama.cpp + BitNet 통합, 단일 GPU에서 70B 1-bit 모델 100 tokens/sec

⭐ 7

Efficient Computer

Pittsburgh, PA · 2022

**Spatial dataflow (Fabric) 아키텍처** — 기존 폰 노이만 instruction-centric 실행 대신, 재구성 가능한 컴퓨트 노드 타일드 그리드가 애플리케이션 데이터플로우를 그대로 반영해 instruction fetch/decode 오버헤드를 제거. Electron E1 프로세서는 4MB on-chip MRAM과 함께 1 TOPS/W 에너지 효율과 28.8 GOPS throughput을 달성, 엣지 디바이스에서 AI inference·sensor fusion을 배터리 수년 단위로 구동. effcc 컴파일러는 GCC/Clang drop-in replacement로 기존 C/C++ 코드와 ML 프레임워크를 Fabric 아키텍처용 데이터플로우 그래프로 자동 변환해 별도 코드 재작성 불필요. 100x 에너지 효율 향상 주장 — 위성·산업 자동화·크리티컬 인프라 분야 적용.

⭐ 7

Tiny Corporation

Berlin, Germany · 2022

Apple Silicon·Raspberry Pi·웹 브라우저용 tinygrad 추론 엔진 — PyTorch 대비 10-50x 메모리↓, 의존성 0

⭐ 7

Latent AI

Santa Clara, CA · 2018

On-device ML quantization, federated learning compiler

⭐ 6

카메라/이미지

+2개

디스플레이

+3개

배터리/전력

+3개

Our Next Energy (ONE)

Novi, MI · 2020

**니켈/코발트 free EV 배터리** — LFP(리튬 인산철) 단일 화학으로 공급망 의존도 최소화. Gemini 듀얼-케미스트리는 LFP+리튬이온을 구조적으로 결합, 장거리 EV(750+ 마일)에서도 안정성 확보. Michigan 공장 (1 GWh+) 생산 라인 보도.

⭐ 8

Bedrock Materials

South San Francisco, CA · 2023

**나트륨 이온 기반 전고체 전해질**. 기존 액체 전해질의 가연성·누액 문제를 해소하면서도 리튬 대신 풍부하고 저가인 나트륨을 사용한다. 소재 단계(cell-level) 시연이 완료된 단계로 추정되며, 자동차·가전·웨어러블 등 다양한 배터리 적용 분야를 타깃. Solid-state battery 밸류체인 중 electrolyte layer 스타트업으로 QuantumScape·Solid Power 등 리튬 기반 전고체 업체의 sodium-ion 대안 포지셔닝. 다만 공식 사이트(bedrockmaterials.com)가 2026-07 기준 HugeDomains 매물로 나와 있어 회사 상태·제품 상세 검증 불가.

⭐ 7

Group1

Santa Clara, CA · 2021

**칼륨 이온(potassium-ion) 배터리 양극 소재**. 리튬·코발트·니켈을 일절 사용하지 않고 풍부·저가의 칼륨 자원으로 LFP 대비 가격 우위를 노린다. 기존 리튬이온 생산 라인과의 호환성을 강조해 ESS·소형 전자기기 시장 공략. 2021년 Shell 출신 연구진 창업 추정. Group1 공식 사이트(2026-07 확인)는 부재 — group1.com은 옵션 트레이딩 firm으로 점유. Crunchbase 조직 페이지는 Cloudflare 차단.

⭐ 7

모바일 배터리

+3개

모바일 오디오

+11개

ElevenLabs

New York, NY · 2022

Generative voice AI — 음성 복제·합성·번역·감정, 29개 언어, 0.5초 내 latency

⭐ 10

Suno

Cambridge, MA · 2023

Generative music AI — 텍스트 한 줄로 4분 풀 곡 생성, 보컬 포함, 2024년 12월 v4 출시

⭐ 9

Subtle Computing

Palo Alto, CA · 2022

Subtle Voice Engine™ — multi-mic array + on-device voice isolation + whisper-level speech recognition + 5x transcription accuracy vs leading earbuds

⭐ 9

Deepgram

San Francisco, CA · 2015

End-to-end 딥러닝 음성 인식(STT/TTS/실시간/화자 식별/감정 인식) — Whisper 대비 5-30x 정확·저latency

⭐ 9

Smallest.ai

San Francisco, CA (founded India) · 2024

Real-time voice AI platform with simultaneous listen-think-speak model for natural conversation latency

⭐ 8

Sandbar

New York, NY, USA · 2023

근접 튜닝 마이크를 갖춘 음성 전용 스마트링(Stream) + 저지연 온디바이스 연동 음성 인터페이스

⭐ 8

Embody

San Mateo, CA · 2019

**개인화 spatial audio** — Dolby 출신 founder가 만든 청각형 DSP 솔루션. 사용자 귀 형태(HRTF, Head-Related Transfer Function) 개인화로 헤드폰/이어버즈에서도 진정한 3D 공간 음향 재현. 모바일·콘텐츠·VR/AR 시장 공략.

⭐ 8

Krisp

Berkeley, CA · 2018

**양방향 AI 노이즈 캔슬링** — DNN 기반 음성 분리(voice isolation)로 발신자/수신자 양쪽 잡음을 모두 제거. 단순 게인제어(Gain control)가 아닌 spectrogram-level source separation. 콜센터·원격근무·헤어러블 OEM 시장.

⭐ 8

Omilia

Athens, Greece · 2002

Self-learning conversational AI와 음성·채팅·인증 에이전트를 결합한 엔터프라이즈 CX 플랫폼

⭐ 8

Hearvana

미공개 · 2024

Super-intelligent acoustic intelligence — AI assistant와 human이 진정으로 '듣다'를 실현하는 차세대 노이즈 캔슬링 R&D

⭐ 7

SoundBubble

Berlin, Germany · 2016

소셜 오디오 플랫폼 + AI 모더레이션 (라이브 음성 자동 분류·요약·검열).

⭐ 6

5G/6G·연결성

+3개

보안·생체인증

+3개

Beyond Identity

New York, NY · 2020

**PKI + 생체 passwordless** — 사용자 디바이스에 X.509 인증서를 발급하고, 생체 인증(지문·Face ID·Windows Hello)으로 디바이스에 결합. 피싱·MFA fatigue·credential stuffing 방어. SAML/OIDC 표준 지원 → Okta·Azure AD 대체.

⭐ 8

Paravision

San Francisco, CA · 2019

**Trusted Identity AI** — 얼굴 인식·liveness detection·deepfake detection·age estimation 등 차세대 identity AI 블록을 윤리적으로 개발. NIST FRVT·DHS S&T 글로벌 벤치마크 일관 상위권, demographic group 간 error rate 균일 (inclusion). DHS RIVR PAD Evaluation에서 모든 passive·active liveness 시스템을 outperform한 사실이 2026-03 공식 발표로 확인됨. Cloud·edge·mobile·hybrid 배포 옵션 제공. 주요 고객: Persona(identity verification)·Entrust·HID·Imprivata·secunet·Brivo 등 글로벌 보안·정부·금융·의료·항공 산업.

⭐ 7

Persona

San Francisco, CA · 2018

**셀피·신분증·얼굴 매칭 기반 원격 신원 인증(KYC) SaaS 플랫폼**. 정부·금융·암호화폐·B2B SaaS 고객사에 신원 확인 API를 제공. Paravision의 얼굴 인식·liveness detection AI를 백엔드로 활용하는 partnership 사례(공식 사이트 확인). Founder Fund·Coatue·Index Ventures로부터 시리즈 C 2억 달러를 유치해 유니콘 평가 달성 (기존 m3 작성 기준, 검증 미완). 삼성전자 Samsung Pass·Galaxy 생체인증 키트의 백엔드 인프라로 활용 가능한 기술 스택.

⭐ 7

모바일 UX/OS

+6개

Sierra AI

San Francisco, CA (본사) + New York, Atlanta, London, Singapore, Tokyo, Paris, Madrid, Toronto (글로벌 오피스) · 2023

**Conversational AI agent OS** — outcomes-based pricing (pay for results, not tokens). 채널 통합 (chat, SMS, WhatsApp, email, voice, ChatGPT). 다국어·다채널 production-ready agent 자동 빌드 (SOPs·transcripts·whiteboard → Ghostwriter). Agent Studio로 no-code/low-code 빌드 + 통계 검증 가능한 Experiments. Agent Data Platform으로 customer context 영구화. Horizon으로 days~weeks 장기 호라이즌 계획. STAR Level One security. STAR 인증 trust badge.

⭐ 9

Adept AI

San Francisco, CA · 2022

AI agent model (ACT) for software automation — 자연어로 모든 software 사용 가능. Transformer로 (UI 입력 → UI action) 매핑. Initial product was a consumer browser agent; pivoted to enterprise workflow automation after 2024. Mobile / OS 레벨에서 모든 앱을 자동 제어하는 차세대 인터랙션 레이어를 구축.

⭐ 9

Simular AI

Mountain View, CA · 2022

On-device / Computer-use AI agents that autonomously operate browser and mobile apps via reinforcement learning. Simular's research vision: 'AI shouldn't be built in closed labs -- but out in the wild.' Self-developed multi-modal policy model + RL framework. Simular tops benchmarks across browsers (WebVoyager 90.1%), computers (OSWorld 72.6%), and smartphones (AndroidWorld 71.6%) simultaneously — the only agent doing so. ICLR 2025 Best Paper at Agentic AI for science workshop.

⭐ 9

Era

New York, NY, USA · 2025

AI 가젯용 인텔리전스 레이어 — 14개 이상 제공사의 130여 개 LLM을 동적 라우팅하는 오케스트레이션 플랫폼

⭐ 7

Multi-On

Palo Alto, CA · 2023

**자연어 기반 브라우저·모바일 자동화 SDK**. GPT-4 클래스 LLM을 planner로 사용해 사용자의 자연어 의도를 다단계 액션 시퀀스로 분해하고, 브라우저 DOM·모바일 UI와 인터랙트해 작업을 완수한다. 개발자는 자체 앱에 임베드 가능한 API와 플러그인을 받아 빠르게 통합 가능. 2023년 GPT-4 출시 직후 자연어 브라우저 자동화 데모가 업계 최초 사례 중 하나로 주목받았으며, Simular AI·Induced AI·Adept AI 등 동종 AI 에이전트 SDK와 직접 경쟁한다.

⭐ 7

Rabbit (R1 / LAM)

Los Angeles, CA · 2021

**LAM(Large Action Model)** — LLM이 텍스트 답변만 생성하는 것과 달리, 소프트웨어 인터페이스를 자율 조작해 실제 작업을 완수하는 AI 에이전트 모델. rabbitOS는 Android 13(AOSP) 기반의 bespoke OS이며, Perplexity.ai 검색·음악 재생·rideshare·음식 주문 통합을 제공. 초기 리뷰는 제한된 기능·버그·스마트폰 대비 불명확한 이점으로 부정적, r1 소프트웨어가 Android 폰에서도 구동 가능하다는 사실이 드러나며 LAM 주장에 의문 제기됨. 이후 rabbitOS 2(2025-09)·creations·third-party agents(Hermes Agent·Claude Code·OpenClaw 등 2026년 지원 추가) 등 지속 업데이트.

⭐ 7

자동화

+5개

Arcade.dev

San Francisco, CA · 2024

MCP runtime layer for production AI agents — enforce/execute/govern on enterprise actions

⭐ 8

Skyvern

San Francisco, CA · 2023

**LLM-기반 browser-use 에이전트** — 전통 RPA가 깨지기 쉬운 CSS selector 의존도를 제거하고, LLM+컴퓨터비전으로 웹 페이지 의도를 해석해 자율 클릭/입력/추출. Playwright 위에서 동작하며 CAPTCHA·2FA·TOTP 자동 처리, residential/datacenter proxy 라우팅(국가·주·zip code 정밀 타깃). self-hosted 옵션 + SOC2 Type II / HIPAA 컴플라이언스로 엔터프라이즈 도입 가능.

⭐ 8

MultiOn

Palo Alto, CA · 2022

**자율형 web-use AI agent** — LLM+컴퓨터비전으로 브라우저를 사람처럼 조작 (Airbnb 예약, 여행 일정, 폼 제출, 검색 자동화). GPT-4V/Claude 등 멀티모달 LLM과 자체 강화학습·agentic planning 레이어 결합. developer-friendly API + SDK 제공으로 SaaS·개발자 시장 동시 공략.

⭐ 8

Bardeen

San Francisco, CA · 2020

**노코드 AI 워크플로우 자동화 플랫폼**. 셀러포스·Notion·Slack 등 SaaS·브라우저·모바일 액션을 사용자가 drag-and-drop으로 연결, 자체 RPA SDK를 통해 일반 사용자도 워크플로우 자동화를 구축 가능. 2026년 CES에서 'Automating Automation Via Vision' 공개 — 비전 모델로 화면에서 action 패턴 학습, 자동화 기회 자동 제안. 주요 use case: 솔로프리너·부동산·음업·리크루팅·프라이빗 에쿼티·이벤트. 셀러포스·Deel·15시간/주 절약 등 고객 사례 다수.

⭐ 7

Induced AI

San Francisco, CA · 2023

Autonomous browser-native workflow agents

⭐ 6

AR/VR/XR

+2개

웨어러블·헬스

+3개

모빌리티/V2X

+3개

AI 추론

+4개