모두의 AI
📚 입문 가이드

Apple Intelligence 2026 H1 — AFM 3·Foundation Models·온디바이스 AI 전체 지도

2024년 WWDC 출시 이후 2025-2026 진화 정리. AFM 3 family, Foundation Models framework, Private Cloud Compute, Apple Silicon NPU 통합. 한국 독자용.

⏱️ 14분 입문 📅 2026-07-19

Apple Intelligence는 단순한 “AI 기능 추가”가 아니라 “개인 정보를 디바이스 밖으로 반출하지 않는 AI 인프라” 라는 새 카테고리를 만든 OS-레벨 변화입니다. 이 가이드는 Apple Intelligence의 핵심 아키텍처·2026 H1 진화·Samsung Galaxy AI와의 전략 비교를 정리합니다.

1. Apple Intelligence의 본질

종단 통제형 (Walled Garden) 전략

  • 디바이스 우선: 모든 일반 작업은 온디바이스 3B 모델 (AFM-on-device)로 처리
  • 서버 보조: 복잡한 작업은 Private Cloud Compute (PCC) — Apple Silicon 서버에서 실행, 사용자 데이터 영구 저장 안 함
  • 개발자 접근: Foundation Models framework (2025 WWDC 공개) — 앱에서 AFM 직접 호출 가능
  • Apple Silicon 수직 통합: A18/A19 (ANE 16-core) + M4 (NPU 38 TOPS) — 하드웨어↔OS↔AI 통합

주요 약속

  • 프라이버시: 사용자 데이터를 Apple이 읽지 않음 (서버 처리도 PCC 격리)
  • 오프라인 우선: Wi-Fi 없어도 대부분 작업 가능
  • 낮은 지연: 디바이스 추론 200ms 미만 (Apple NPU)

2. AFM 3 — Apple Foundation Models 패밀리

모델 계보 (2026 H1 시점)

모델크기용도위치
AFM-on-device~3B dense decoder-only일반 작업 (요약, 글쓰기, 시리)디바이스
AFM-on-device LoRA3B + adapter앱별 fine-tune (사진, 음악 등)디바이스
AFM-server-small~20B복잡한 멀티모달 추론PCC
AFM-server-large~70B MoE고급 코딩·연구PCC (Apple Silicon 서버)
AFM-server-pro~200B+(2026 후반 출시 예정)PCC

핵심 최적화

  • `4-bit 미만 양자화 (일부 레이어 2-bit)
  • KV-cache 37.5% 절감 — Apple NPU 메모리 효율
  • LoRA 어댑터 — 앱별 specialize, 베이스 모델은 단일
  • Speculative decoding — 3B 모델이 20B 모델 출력을 빠르게 검증

3. Apple Silicon — Neural Engine (ANE) 진화

세대NPU TOPSAFM 지원
A17 Pro202335 TOPS제한적 (iOS 17)
A18 / A18 Pro202438 TOPSAFM-on-device 풀
M4202438 TOPSMac용 AFM
A19 / A19 Pro202550+ TOPS (예상)AFM 3 + 멀티모달
M5202550+ TOPSMac Pro

TOPS는 단순 비교 수치 아님: ANE는 Apple이 직접 디자인한 추론 가속기로, 메모리 계층·캐시·지연 최적화가 Qualcomm NPU와 다름.

4. Private Cloud Compute (PCC) — 신뢰의 인프라

Apple의 가장 차별화된 결정. 핵심:

  • 데이터 비휘발성: PCC 서버도 사용자 데이터를 디스크에 저장 안 함
  • 공개 검증 가능: PCC 서버 바이너리·펌웨어를 독립 연구자가 감사 가능
  • Apple Silicon만 사용: Intel/AMD 기반 서버 없음 (수직 통합)
  • Trusted Execution Environment: 요청 처리 중 메모리 암호화

비판론: “Apple이 검증 안 받으면 무의미” — Apple은 2024-2025 두 차례 보안 감사 보고서 공개로 대응.

5. 2026 H1 진화 타임라인

시점이벤트
2024-06Apple Intelligence 첫 발표 (iOS 18.1 베타)
2024-09iPhone 16 (A18) 출시 — AFM-on-device 풀 지원
2024-12ChatGPT 통합 (애플이 OpenAI에 의존하는 영역 한정)
2025-06WWDC 2025 — Foundation Models framework 공개 (개발자)
2025-10Apple M5 칩셋 출시
2026-Q1AFM 3 family (5 모델) 공개
2026-Q2한국어 공식 지원 (예상)

6. 경쟁 비교 — Apple vs OpenAI vs Anthropic vs Google

차원AppleOpenAIAnthropicGoogle
추론 위치디바이스 + PCC클라우드클라우드디바이스 + 클라우드
프라이버시 모델데이터 비휘발서버 학습서버 학습옵트인
NPU자체 설계 (ANE)N/AN/ATensor TPU
모델3B~70B (2026)GPT-5.6 (다중)Claude 4.5 (단일)Gemini 3 Pro/Flash
개발자 APIFoundation ModelsOpenAI APIAnthropic APIGemini API
가격디바이스 가격토큰당 종량제토큰당 종량제토큰당 종량제

Apple의 차별점: 온디바이스 우선 + PCC 보조. 즉 사용자가 무료(디바이스 비용 외) + 개발자는 Foundation Models로 무료 호출 (분당 rate limit 내). 단, Apple이 모델을 완전히 통제 → 외부 의존 0.

7. 한국어 사용자 관점

지원 현황 (2026 H1)

  • iOS 18.x: 한국어 시스템 프롬프트 완벽 지원
  • 시리: 한국어 대화 — 자연스러운 문장·문화적 맥락 이해
  • 이메일·메모 요약: 한국어 자동 요약 품질 양호
  • Image Playground: 한국어 텍스트→이미지 (제한적, 영어보다 어색)

추천 설정

  1. iPhone 15 Pro 이상 — AFM-on-device 지원 (8GB RAM 최소)
  2. iOS 18.1+ 업데이트 필수
  3. Private Cloud Compute 활성화 — 설정 → Apple Intelligence → “확장된 Siri 및 처리” 켜기
  4. ChatGPT 통합 (선택) — 복잡한 작업만 외부 위임

비용

  • Apple Intelligence 자체 = 무료 (디바이스 가격에 포함)
  • ChatGPT 통합 시 OpenAI 토큰 비용은 Apple이 부담 (2025 계약에 따라)

8. 결론 — 한국어 사용자가 얻는 것

  1. 프라이버시 보장: 일상 작업 (이메일 요약, 시리, 사진 검색) 모두 디바이스 내 처리
  2. 오프라인 사용 가능: 비행기·지하철·해외에서도 작동
  3. 빠른 응답: 200ms 미만 추론 (디바이스 NPU 가속)
  4. 무료: 구독료·토큰 비용 0

9. 더 읽을거리

10. 자주 묻는 것

Q. iPhone 14에서 AFM 작동하나? A. ❌. AFM-on-device는 A17 Pro 이상 필요. iPhone 14 (A15) → 클라우드 추론만.

Q. 한국어는 2026에 정식 지원되나? A. 부분. 시리·요약·이메일은 이미 한국어 지원. AFM 3의 한국어 fine-tune 상태는 WWDC 2026에서 발표 예정.

Q. ChatGPT 통합은 유료? A. 사용자 무료. Apple이 OpenAI와 분담. ChatGPT Plus 구독자만 추가 기능 사용 가능.

Q. 개발자도 Apple Intelligence 사용 가능한가? A. ✅ Foundation Models framework (iOS 18.2+) — Swift API로 AFM 직접 호출. 일일 rate limit 있음.

Q. 삼성 갤럭시 AI와 비교하면? A. /papers/에서 “Samsung Galaxy AI 전략 분석” 해설 참조. 핵심 차이: Apple은 종단 통제 + 온디바이스, 삼성은 다중 파트너 + 하이브리드 클라우드.