Nativ은 Apple Silicon Mac에서 오픈 언어·비전·코드 모델을 로컬로 실행하는 macOS 앱이다. 단순 채팅 앱이 아니라 모델 라이브러리, 성능 대시보드, 로컬 API 서버, 코딩 에이전트 연동을 한 데 묶은 개발자용 로컬 AI 워크스페이스에 가깝다.
왜 필요한가
로컬 LLM 도구는 크게 두 갈래로 나뉜다. Ollama·llama.cpp 같은 서버형 런타임은 가볍지만 사용자가 모델·엔드포인트·로그를 직접 다뤄야 한다. LM Studio 같은 데스크톱 앱은 편하지만 내부 구현이나 서버 확장이 닫혀 있는 경우가 많다. Nativ은 SwiftUI 네이티브 앱과 MLX 기반 서버를 모두 오픈소스로 제공해, Mac 사용자가 로컬 모델을 앱처럼 쓰면서도 API 서버와 개발자 도구로 확장할 수 있게 한다.
GitHub 기준 ★263, MIT 라이선스다.
핵심 기능
| 기능 | 설명 |
|---|---|
| 로컬 채팅 | 스트리밍 응답, 마크다운, 코드 하이라이트, 이미지 입력, 대화 기록 |
| 모델 라이브러리 | Hugging Face 캐시와 호환 모델 탐색, 다운로드, 선택, 삭제 |
| 성능 분석 | 요청 수, 토큰 사용량, time-to-first-token, decode 속도, 메모리 압박, 열 상태 확인 |
| 로컬 API | OpenAI 호환 Chat Completions·Responses·Models·이미지·오디오 엔드포인트와 Anthropic Messages 엔드포인트 |
| 코딩 도구 연동 | Codex, Claude Code, Pi, Hermes, OpenCode를 로컬 모델 endpoint에 연결 |
| 개발자 화면 | 서버 상태, endpoint URL, 로그 검색, 런타임 세부 정보 |
| 추론 제어 | 샘플링, thinking budget, 구조화 출력, KV cache 양자화, prefix caching, speculative decoding |
동작 구조
Nativ 앱은 SwiftUI 프런트엔드와 NativServerKit을 통해 번들된 mlx-vlm 서버를 관리한다. 모델은 Apple unified memory와 Metal을 활용하는 MLX 런타임 위에서 실행되고, 외부 도구는 localhost API로 접근한다.
Nativ SwiftUI app
-> NativServerKit
-> bundled mlx-vlm server
-> MLX runtime
-> local models on Apple unified memory기본 서버 주소는 http://127.0.0.1:8080이다. 모델을 선택한 뒤 OpenAI 호환 방식으로 호출할 수 있다.
curl http://127.0.0.1:8080/v1/chat/completions \
-H 'Content-Type: application/json' \
-d '{
"model": "your-model-id",
"messages": [{"role": "user", "content": "Why is the sky blue?"}],
"stream": false
}'어디에 맞는가
- Mac 기반 개발자: Codex·Claude Code 같은 코딩 에이전트에 로컬 모델을 붙여 비용 없이 실험하고 싶을 때
- 프라이버시 민감 작업: 문서·코드·이미지를 클라우드 API에 보내기 어렵지만 온디바이스 추론은 허용되는 경우
- 로컬 모델 평가자: 모델별 토큰 속도, 메모리 사용량, 첫 토큰 지연을 한 화면에서 비교하려는 경우
- MLX 생태계 사용자: Apple Silicon의 unified memory를 활용해 Gemma, Cohere, Liquid AI 등 오픈 모델을 앱 형태로 다루고 싶을 때
주의할 점
Nativ은 Apple Silicon 전용에 가깝다. 실행에는 Apple Silicon Mac과 macOS 26 이상이 필요하고, 빌드에는 Xcode macOS 26 SDK, XcodeGen, Python이 필요하다. 또한 추론은 로컬에서 수행되지만 모델 다운로드와 첫 빌드 의존성 설치에는 네트워크가 필요하다. 완전 오프라인 워크플로를 원하면 필요한 모델과 런타임을 미리 준비해야 한다.
관련 문서
- local-slm — 내 컴퓨터에서 실행하는 소형 언어 모델 개요
- unified-memory — 로컬 LLM 하드웨어에서 용량과 속도를 가르는 메모리 구조
- claude-code-tutorial-local-models — Claude Code를 로컬 모델로 실행하는 방법
- opencode-tutorial-local-ai-coder — Ollama와 Qwen으로 로컬 AI 코딩 환경 구축
참고 자료
- Nativ — Local AI for your Mac — Nativ 공식 사이트 (2026-07-21 확인)
- Blaizzy/nativ — GitHub 공식 저장소