在浏览器里运行的免费 AI 字幕生成器

给任何视频加字幕,无需上传到任何地方。

OpenSubs 转写语音、翻译它、设定样式,并把它压进画面 — 全部在你的浏览器里完成。视频文件永远不会离开你的机器,因为它根本无处可去。

无需账号。不上传。没有水印。开源。

给你的视频加字幕

视频

字幕

Whisper 就在这里、在你的浏览器里运行,从视频自己的音频写出字幕。什么都不上传,也不需要账号。

四个步骤,没有一步在服务器上。

上面那四步的细节。除非你明确另作选择,否则每一步都在你自己的机器上运行。

功能

免费

转写语音

Whisper 在你的浏览器里运行,机器有 GPU 时就用 GPU。挑一个 40 MB 到 250 MB 之间的模型;它只下载一次,之后就有缓存了。只有模型会被下载 — 音频原地不动。

免费

翻译成 20 种语言

Chrome 内置的翻译在你的设备上运行,不花一分钱。自带 Claude、OpenAI 或 DeepL 密钥可在长对白上得到更好的结果,也可以用我们的、按点数付费。

免费

设定样式,并直接看到效果

十二种预设,从干净的广播字幕到醒目的社交风格,每一种都直接叠在你自己的素材上预览。字词可以随着说出而放大和发光。

免费

压进视频

导出一个字幕已经在像素里的成品 MP4,在浏览器中用 WebCodecs 编码。或者取走 .srt.vtt.ass 拿到别处用。

同一个引擎,另外三个地方也能用。

上面那个页面什么都不用装。这几个要装,作为回报它们能做页面做不到的事 — 给标签页里正在播放的视频加字幕,或者不经浏览器直接压制两小时的文件。它们全都是同一个 Rust 引擎,所以输出完全一致。

免费

浏览器扩展

在标签页里正在播放的画面上叠加字幕,边播边生成。支持 Chrome、Edge 和 Firefox。尚未上架商店 — 构建产物是一个你自行加载的 .zip

获取扩展

免费

桌面应用

macOS、Windows 和 Linux,适合长文件和批量处理。它调用 ffmpeg 来压制,因此需要一个带 ass 滤镜的构建 — 在 macOS 上用 brew install ffmpeg-full。这些构建未签名。

下载

免费

命令行

每个文件一条命令,适合脚本和 CI。同一个引擎、同一套预设、同样的输出。请从源码构建;它和桌面应用一样需要 ffmpeg

阅读源码

AGPL-3.0

全部开源

引擎、网页应用、扩展、桌面应用和命令行是同一个仓库。与其相信本页面的说法,不如直接读一读在你机器上运行的东西。

在 GitHub 上查看

当前版本为候选发布版。它们功能完整并已测试;版本号只是说它们还没走完稳定版发布流程。

这里说的「隐私」,是指根本没有服务器可以上传。

大多数字幕工具会上传你的视频、处理它,然后承诺删除它。OpenSubs 的做法正好相反。

视频不会移动

文件通过 object URL 读取,由你的浏览器解码。本产品里没有上传接口,所以素材外泄不是一件我们需要承诺不做的事 — 它根本不可能发生。

唯一可能离开的东西

字幕文本,而且仅当你选了云端翻译器时。设备端选项什么都不发送,而它是默认选项。

你的密钥留在标签页里

自带 API 密钥,它只从你的浏览器使用,绝不保存、绝不发给我们、也绝不写入磁盘。

凡是在你机器上运行的,全都免费。

而那几乎就是全部。只有在我们替你花了钱的地方我们才收费,而且在你按下按钮之前就会告诉你价格。

点数
$5  1,000 点数
  • 在我们后端的云端翻译
  • 不用别家的密钥,也不用别家的账号
  • 任务价格在运行前就会显示
  • 你被扣掉的就是那个数,绝不会更多
  • 任务失败不计费
  • 点数永不过期

开始之前。

我的视频会被上传到什么地方吗?

不会。OpenSubs 直接在你的浏览器里读取文件,每一步 — 转写、样式、压制 — 都在你自己的机器上运行。视频永远不会被发到服务器。唯一可能离开你机器的是字幕文本,而且仅当你选择某个云端翻译选项时。

需要账号吗?

不需要。转写、设备端翻译、样式、裁剪、压制以及所有导出,都无需账号、无需登录即可使用。只有当你选择为我们后端上的云端翻译付费时才需要账号。

它是如何从语音生成字幕的?

它在本地运行 Whisper — 由 transformers.js 驱动的 ONNX 权重,有 WebGPU 时用它,否则用 WebAssembly。模型只下载一次,视你选哪个从 40 MB 到 250 MB 不等,之后由浏览器缓存。只有模型会被下载;音频留在你的机器上。

它能把字幕压进视频文件本身吗?

可以。字幕由 libass 绘制 — 就是 ffmpeg 用的那个渲染器 — 编译成 WebAssembly,再用 WebCodecs 编码回 MP4。你在预览里看到的就是最终落进像素里的样子,音频则原样复制通过。

它要多少钱?

在你机器上运行的一切都是免费的,而且永远免费,因为它们不花我们的钱。唯一收费的选项是在我们自己后端上的翻译,1,000 点数 5 美元。任务价格在运行前就会显示,你被扣掉的就是那个数,任务失败不计费。

它能翻译成哪些语言?

二十种,包括简体中文、繁体中文、日语、韩语、西班牙语、葡萄牙语、法语、德语、意大利语、俄语、阿拉伯语、印地语、印尼语、泰语、越南语、土耳其语、波兰语、荷兰语和乌克兰语。非拉丁文字的字体已经打包在内,所以中文和阿拉伯语字幕能正确压制,而不是压出一排空方块。

它能离线使用吗?

第一次访问之后,基本可以。语音模型首次下载后由浏览器缓存,除云端翻译外的一切都在本地运行。

它是开源的吗?

是的,采用 AGPL-3.0。同一个引擎 — 字幕分段、断行、阅读速度限制、样式预设、ASS 写出器 — 既编译成 WebAssembly 给浏览器用,也编译成原生二进制给桌面应用和命令行工具用,所以三者的输出完全一致。