영상
자막
Whisper는 바로 여기, 사용자의 브라우저에서 돌면서 영상 자신의 오디오로부터 자막을 씁니다. 아무것도 업로드되지 않고 계정도 필요 없습니다.
어떤 영상에든 자막을, 어디에도 올리지 않고.
OpenSubs는 음성을 전사하고, 번역하고, 스타일을 입히고, 화면에 구워 넣습니다 — 전부 브라우저 안에서. 영상 파일은 절대 기기를 떠나지 않습니다. 갈 곳이 없기 때문입니다.
계정 없음. 업로드 없음. 워터마크 없음. 오픈 소스.
Whisper는 바로 여기, 사용자의 브라우저에서 돌면서 영상 자신의 오디오로부터 자막을 씁니다. 아무것도 업로드되지 않고 계정도 필요 없습니다.
위의 네 단계를 조금 더 자세히. 명시적으로 다르게 고르지 않는 한, 모두 사용자 기기에서 돕니다.
Whisper는 브라우저에서, 기기에 GPU가 있으면 GPU에서 돕니다. 40 MB에서 250 MB 사이의 모델을 고르세요. 한 번만 내려받고 이후에는 캐시됩니다. 가져오는 것은 모델뿐이고 — 오디오는 그대로 남습니다.
Chrome 내장 번역은 기기에서 무료로 동작합니다. 긴 대화에서 더 나은 결과를 원하면 Claude, OpenAI, DeepL 키를 직접 가져오거나 저희 것을 크레딧으로 쓰세요.
깔끔한 방송용 캡션부터 대담한 소셜 스타일까지 열두 가지 프리셋, 모두 사용자 자신의 영상 위에서 미리 볼 수 있습니다. 말하는 순간에 맞춰 단어가 커지고 빛날 수 있습니다.
자막이 픽셀에 들어간 완성 MP4를 브라우저에서 WebCodecs로 내보냅니다. 아니면 .srt, .vtt, .ass를 가져가 다른 곳에서 쓰세요.
위의 페이지는 아무것도 설치할 필요가 없습니다. 이것들은 설치가 필요하지만, 대신 페이지가 못 하는 일을 합니다 — 탭에서 이미 재생 중인 영상에 자막을 넣거나, 브라우저 없이 두 시간짜리 파일을 굽는 일. 전부 같은 Rust 엔진이므로 출력은 동일합니다.
탭에서 재생 중인 화면 위에, 재생하면서 자막을 만들어 얹습니다. Chrome, Edge, Firefox 지원. 아직 스토어에는 없습니다 — 빌드는 직접 불러오는 .zip입니다.
macOS, Windows, Linux용. 긴 파일과 일괄 처리를 위해. 굽기에 ffmpeg를 쓰므로 ass 필터가 포함된 빌드가 필요합니다 — macOS에서는 brew install ffmpeg-full. 빌드에는 서명이 없습니다.
파일당 명령 하나, 스크립트와 CI를 위해. 같은 엔진, 같은 프리셋, 같은 출력. 소스에서 빌드하세요. 데스크톱 앱과 마찬가지로 ffmpeg가 필요합니다.
엔진, 웹 앱, 확장 프로그램, 데스크톱 앱, 커맨드 라인이 한 저장소에 있습니다. 이 페이지의 말을 믿는 대신, 기기에서 도는 것을 직접 읽어 보세요.
현재 빌드는 릴리스 후보입니다. 기능은 완성되었고 테스트도 마쳤습니다. 버전 번호는 아직 정식 릴리스 과정을 거치지 않았다는 뜻일 뿐입니다.
대부분의 자막 도구는 영상을 올리고, 처리하고, 지우겠다고 약속합니다. OpenSubs는 반대로 만들어졌습니다.
파일은 object URL로 읽혀 브라우저가 디코딩합니다. 이 제품에는 업로드 엔드포인트가 없으므로 영상 유출은 하지 않겠다고 약속할 성질의 것이 아닙니다 — 애초에 불가능합니다.
자막 텍스트, 그것도 클라우드 번역기를 고른 경우에만. 기기 내 옵션은 아무것도 보내지 않으며, 그것이 기본값입니다.
본인 API 키를 가져오면 브라우저에서만 쓰이고, 저장되지 않으며, 저희에게 전송되지 않고, 디스크에도 기록되지 않습니다.
그러니까 거의 전부입니다. 저희가 사용자를 대신해 돈을 쓰는 부분에만 과금하고, 버튼을 누르기 전에 가격을 알려 드립니다.
아니요. OpenSubs는 파일을 브라우저에서 바로 읽고, 전사, 스타일, 굽기 — 모든 단계가 사용자 기기에서 돕니다. 영상이 서버로 전송되는 일은 없습니다. 기기를 떠날 수 있는 것은 자막 텍스트뿐이고, 그것도 클라우드 번역 옵션을 선택했을 때뿐입니다.
아니요. 전사, 기기 내 번역, 스타일, 자르기, 굽기, 모든 내보내기가 계정 없이 로그인 없이 됩니다. 계정은 저희 백엔드의 클라우드 번역에 비용을 낼 때만 필요합니다.
Whisper를 로컬에서 돌립니다 — transformers.js가 구동하는 ONNX 가중치를, 가능하면 WebGPU로, 아니면 WebAssembly로. 모델은 고른 것에 따라 40 MB에서 250 MB까지이며 한 번만 내려받고 이후에는 브라우저가 캐시합니다. 가져오는 것은 모델뿐이고, 오디오는 기기에 남습니다.
네. 자막은 libass — ffmpeg가 쓰는 바로 그 렌더러 — 를 WebAssembly로 컴파일한 것으로 그리고, WebCodecs로 다시 MP4에 인코딩합니다. 미리보기에서 보이는 것이 그대로 픽셀에 들어가며, 오디오는 손대지 않고 복사됩니다.
기기에서 도는 것은 전부 무료이고 앞으로도 그렇습니다. 저희에게 비용이 들지 않기 때문입니다. 유료인 것은 저희 백엔드에서의 번역 하나뿐이며, 크레딧 1,000개에 5달러입니다. 작업 가격은 실행 전에 표시되고, 청구되는 금액은 정확히 그것이며, 실패한 작업은 요금이 없습니다.
20개입니다. 간체 중국어, 번체 중국어, 일본어, 한국어, 스페인어, 포르투갈어, 프랑스어, 독일어, 이탈리아어, 러시아어, 아랍어, 힌디어, 인도네시아어, 태국어, 베트남어, 튀르키예어, 폴란드어, 네덜란드어, 우크라이나어를 포함합니다. 비라틴 문자용 글꼴이 함께 들어 있어 중국어와 아랍어 자막도 빈 네모가 아니라 제대로 구워집니다.
첫 방문 이후에는 대체로 가능합니다. 음성 모델은 처음 내려받은 뒤 브라우저가 캐시하며, 클라우드 번역을 제외한 모든 것이 로컬에서 동작합니다.
네, AGPL-3.0입니다. 같은 엔진 — 자막 분할, 줄바꿈, 읽기 속도 제한, 스타일 프리셋, ASS 작성기 — 이 브라우저용으로는 WebAssembly로, 데스크톱 앱과 커맨드 라인 도구용으로는 네이티브 바이너리로 컴파일되므로 셋 다 동일한 출력을 냅니다.