로컬 AI가 영상에서 바로 만들어 드립니다
Wave Subs는 영상의 대사를 인식해 SRT / ASS 자막을 만들고 내 언어로 자동 번역합니다. 모든 작업이 내 컴퓨터 안에서 끝납니다 — 인터넷 불필요, 완전 무료.
완전 오픈소스·완전 무료·인앱 결제 없음

자막 편집기: 텍스트 수정, 타이밍 조정, 아무 줄이나 클릭해 그 대사 듣기
자막 사이트를 뒤질 필요도, 영상을 올릴 필요도, 계정을 만들 필요도 없습니다.
MKV, MP4, MOV, TS 모두 지원. 내장 자막 트랙이 있으면 자동으로 찾아 바로 사용합니다.
whisper.cpp가 내 컴퓨터에서 대사를 인식하고 언어를 자동 감지. 타이밍은 실제 말하는 순간에 맞춰 보정(장편 6편의 공식 자막으로 조정).
내 언어로 번역해 SRT 또는 ASS로 영상 옆에 저장. 어떤 플레이어든 읽습니다. 품질 판정도 함께.

내 언어로 번역해 SRT 또는 ASS로 영상 옆에 저장. 어떤 플레이어든 읽습니다. 품질 판정도 함께.

29개 대상 언어: 한국어, 영어, 일본어, 중국어(간체·번체), 프랑스어, 독일어, 스페인어, 포르투갈어, 러시아어, 태국어, 베트남어, 인도네시아어, 말레이어 등. 기본은 로컬 Qwen3 모델 — 무료, 오프라인. OpenAI 호환 API도 연결 가능.

텍스트 수정, 타이밍 조정, 추가·삭제·병합, 실행 취소, 자동 저장. 아무 줄이나 클릭하면 그 대사를 바로 들을 수 있습니다 — 브라우저가 못 여는 HEVC, DTS도 내장 ffmpeg가 디코딩. 품질 검사 결과는 클릭하면 해당 줄로 이동.

폴더를 끌어다 놓으면 모든 파일에 같은 설정. 필요한 파일만 자막 트랙·오디오 트랙·엔진을 따로 지정. 완료된 줄마다 품질 판정.
온라인 자막 도구는 영상 전체를 올리라고 합니다. Wave Subs는 아무것도 보내지 않습니다.
모델은 앱 안에서 원클릭으로 내려받고, 앱이 내 컴퓨터 메모리에 맞춰 각 모델을 "적합 / 사용 가능 / 실행 불가"로 표시합니다. 같은 규칙을 표로 정리했습니다.
| 모델 | 다운로드 | 사용 메모리 | 품질 | 속도 | Mac 권장 메모리 | Windows PC 권장 메모리 |
|---|---|---|---|---|---|---|
| Tiny | 75 MB | 0.5 GB | ●○○○○ | ●●●●● | 8 GB | 16 GB |
| Base | 142 MB | 0.7 GB | ●●○○○ | ●●●●● | 8 GB | 16 GB |
| Small | 466 MB | 1.2 GB | ●●●○○ | ●●●●○ | 8 GB | 16 GB |
| Medium | 1.5 GB | 2.6 GB | ●●●●○ | ●●○○○ | 16 GB | 24 GB |
| Large v3 Turbo | 1.6 GB | 2.2 GB | ●●●●◐ | ●●●●○ | 16 GB | 24 GB |
| Large v3 | 3.0 GB | 4.5 GB | ●●●●● | ●○○○○ | 16 GB | 24 GB |
| 모델 | 다운로드 | 사용 메모리 | 품질 | 속도 | Mac 권장 메모리 | Windows PC 권장 메모리 |
|---|---|---|---|---|---|---|
| Qwen3 1.7B | 1.8 GB | 2.5 GB | ●●○○○ | ●●●●● | 16 GB | 24 GB |
| Qwen3 4B | 2.4 GB | 3.5 GB | ●●●○○ | ●●●●○ | 16 GB | 24 GB |
| Qwen3 8B | 4.9 GB | 6 GB | ●●●●○ | ●●●○○ | 16 GB | 24 GB |
| Qwen3 14B | 9.0 GB | 10.5 GB | ●●●●◐ | ●●○○○ | 24 GB | 32 GB |
| Qwen3 32B | 19.7 GB | 22 GB | ●●●●● | ●○○○○ | 32 GB | 48 GB |
| 내 컴퓨터 | 인식 | 번역 | 비고 |
|---|---|---|---|
| Mac 8 GB | Small 또는 Large v3 Turbo | Qwen3 1.7B | 충분히 사용 가능. Turbo는 8 GB에서도 돌지만 다른 앱은 닫아 두세요 |
| Mac 16 GB | Large v3 Turbo | Qwen3 8B | 기본 추천. 품질과 속도의 균형점 |
| Mac 32 GB | Large v3 | Qwen3 14B | 최고의 인식 품질, 더 정확한 번역 |
| Mac 48 GB 이상 | Large v3 | Qwen3 32B | 최고의 번역 품질, 속도는 느림 |
| Windows PC 16 GB | Large v3 Turbo | Qwen3 4B | CPU 전용. 같은 모델도 Apple Silicon보다 수 배 오래 걸림 |
| Windows PC 32 GB | Large v3 Turbo | Qwen3 8B | 큰 모델도 돌지만 시간을 넉넉히 |
버전 1.0.1. ffmpeg와 whisper.cpp가 내장되어 설치 후 바로 사용.
brew install --cask jason-jm/wavesubs/wavesubsscoop bucket add wavesubs https://github.com/jason-jm/scoop-wavesubs && scoop install wavesubs첫 실행 시 음성 인식 모델 다운로드를 안내합니다(이후 인터넷 불필요). 오픈소스 라이선스: THIRD-PARTY-LICENSES.
MKV, MP4, MOV, TS, AVI 등 일반 형식 모두. 브라우저가 못 여는 HEVC, DTS, TrueHD도 내장 ffmpeg가 모두 디코딩합니다. 오디오 파일도 됩니다.
인식은 whisper가 지원하는 약 100개 언어를 자동 감지. 번역 대상 29개, 인터페이스 32개 언어.
인식·정렬·번역·편집·내보내기 모두 로컬. 네트워크는 첫 모델 다운로드와, 직접 설정한 경우의 클라우드 번역에만 씁니다.
M 시리즈 칩에서 Large v3 Turbo로 약 3~6분, 로컬 번역에 몇 분 추가. 시즌 전체를 일괄로 걸어 두세요.
현재 미지원. 로컬 인식이 Apple Silicon의 Metal 가속에 의존해 Intel에서는 실용적이지 않습니다.