AI Sparkup

최신 AI 쉽게 깊게 따라잡기⚡

Nativ – Apple Silicon Mac에서 오픈 모델을 로컬로 실행하는 AI 앱

Nativ은 Apple Silicon Mac에서 오픈 언어·비전·코드 모델을 로컬로 실행하는 macOS 앱이다. 단순 채팅 앱이 아니라 모델 라이브러리, 성능 대시보드, 로컬 API 서버, 코딩 에이전트 연동을 한 데 묶은 개발자용 로컬 AI 워크스페이스에 가깝다.

왜 필요한가

로컬 LLM 도구는 크게 두 갈래로 나뉜다. Ollama·llama.cpp 같은 서버형 런타임은 가볍지만 사용자가 모델·엔드포인트·로그를 직접 다뤄야 한다. LM Studio 같은 데스크톱 앱은 편하지만 내부 구현이나 서버 확장이 닫혀 있는 경우가 많다. Nativ은 SwiftUI 네이티브 앱과 MLX 기반 서버를 모두 오픈소스로 제공해, Mac 사용자가 로컬 모델을 앱처럼 쓰면서도 API 서버와 개발자 도구로 확장할 수 있게 한다.

GitHub 기준 ★263, MIT 라이선스다.

핵심 기능

기능설명
로컬 채팅스트리밍 응답, 마크다운, 코드 하이라이트, 이미지 입력, 대화 기록
모델 라이브러리Hugging Face 캐시와 호환 모델 탐색, 다운로드, 선택, 삭제
성능 분석요청 수, 토큰 사용량, time-to-first-token, decode 속도, 메모리 압박, 열 상태 확인
로컬 APIOpenAI 호환 Chat Completions·Responses·Models·이미지·오디오 엔드포인트와 Anthropic Messages 엔드포인트
코딩 도구 연동Codex, Claude Code, Pi, Hermes, OpenCode를 로컬 모델 endpoint에 연결
개발자 화면서버 상태, endpoint URL, 로그 검색, 런타임 세부 정보
추론 제어샘플링, thinking budget, 구조화 출력, KV cache 양자화, prefix caching, speculative decoding

동작 구조

Nativ 앱은 SwiftUI 프런트엔드와 NativServerKit을 통해 번들된 mlx-vlm 서버를 관리한다. 모델은 Apple unified memory와 Metal을 활용하는 MLX 런타임 위에서 실행되고, 외부 도구는 localhost API로 접근한다.

Nativ SwiftUI app
  -> NativServerKit
  -> bundled mlx-vlm server
  -> MLX runtime
  -> local models on Apple unified memory

기본 서버 주소는 http://127.0.0.1:8080이다. 모델을 선택한 뒤 OpenAI 호환 방식으로 호출할 수 있다.

curl http://127.0.0.1:8080/v1/chat/completions \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "your-model-id",
    "messages": [{"role": "user", "content": "Why is the sky blue?"}],
    "stream": false
  }'

어디에 맞는가

  • Mac 기반 개발자: Codex·Claude Code 같은 코딩 에이전트에 로컬 모델을 붙여 비용 없이 실험하고 싶을 때
  • 프라이버시 민감 작업: 문서·코드·이미지를 클라우드 API에 보내기 어렵지만 온디바이스 추론은 허용되는 경우
  • 로컬 모델 평가자: 모델별 토큰 속도, 메모리 사용량, 첫 토큰 지연을 한 화면에서 비교하려는 경우
  • MLX 생태계 사용자: Apple Silicon의 unified memory를 활용해 Gemma, Cohere, Liquid AI 등 오픈 모델을 앱 형태로 다루고 싶을 때

주의할 점

Nativ은 Apple Silicon 전용에 가깝다. 실행에는 Apple Silicon Mac과 macOS 26 이상이 필요하고, 빌드에는 Xcode macOS 26 SDK, XcodeGen, Python이 필요하다. 또한 추론은 로컬에서 수행되지만 모델 다운로드와 첫 빌드 의존성 설치에는 네트워크가 필요하다. 완전 오프라인 워크플로를 원하면 필요한 모델과 런타임을 미리 준비해야 한다.

관련 문서

참고 자료



AI Sparkup 구독하기

최신 게시물 요약과 더 심층적인 정보를 이메일로 받아 보세요! (무료)