OfflineTTS는 텍스트 음성 변환, 음성 전사, 자막 생성, ebook-to-audio를 브라우저 안에서 처리하는 무료 오디오 도구다. 핵심은 업로드 우선 SaaS가 아니라 WebGPU·WASM 기반 로컬 실행을 지향한다는 점이다.
제공 워크플로
| 영역 | 기능 |
|---|---|
| TTS | Kokoro, Kitten, Piper, Supertonic 기반 음성 생성 |
| STT | Whisper 기반 99개 언어 전사 |
| 자막 | SRT, VTT 내보내기 |
| 문서 오디오 | EPUB, PDF, TXT를 음성으로 변환 |
| 크리에이터 | YouTube, TikTok, faceless channel용 voice-over |
영어 TTS와 Whisper STT는 모델을 받은 뒤 오프라인 동작을 지원한다. 출력은 WAV, MP3, TXT, SRT, VTT 등 실무에서 바로 쓰는 형식을 중심으로 한다.
언제 유용한가
- 회의·인터뷰 파일을 클라우드에 올리지 않고 전사하고 싶을 때
- 짧은 영상 자막을 빠르게 만들고 싶을 때
- EPUB/PDF/TXT 읽을거리를 듣기 자료로 바꾸고 싶을 때
- API key나 가입 없이 로컬 브라우저에서 TTS 품질을 실험하고 싶을 때
대규모 배치 처리나 팀 협업형 대시보드가 필요하면 전용 SaaS가 더 편할 수 있다. OfflineTTS의 장점은 무료, 로컬 처리, 즉시 내보내기다.
관련 문서
- whisper-cpp — 로컬 Whisper 음성인식
- moonshine-voice — 실시간 음성 에이전트용 STT·TTS 툴킷
- supertonic — 온디바이스 다국어 TTS 모델
- omnivoice — 다국어 오픈소스 TTS 모델
참고 자료
- Private AI Audio Tools – Free TTS, STT, Subtitles, Ebook Audio — OfflineTTS (2026-07-20 확인)