AI 本地自动字幕生成器

完全在浏览器本地离线运行的 AI 语音识别工具。使用 WebGPU/WASM 技术,自动为视频和录音生成高精度 SRT/VTT 字幕,100% 保护您的隐私。

Workspace

AI 本地自动字幕生成器

基于 WebGPU 的纯本地离线语音识别工具。
全本地处理,不上传任何文件,永久免费。自动为视频/录音生成带时间轴的 SRT/VTT 字幕。

拖拽或点击上传音视频文件

支持 MP4, WebM, MP3, WAV 等格式。
处理全程在您的浏览器内完成,绝对安全。

工具介绍

AI 本地自动字幕生成器是基于 HuggingFace transformers.js 的纯前端离线语音识别工具。它可以将视频或音频中的人声自动识别并生成带有精确时间戳的字幕文件。

最大亮点:所有的 AI 计算完全在您的浏览器本地(显卡/CPU)运行!不上传任何文件,永久免费。

首次加载说明

  • 当您第一次使用本工具时,浏览器会自动下载约 40-80MB 的基础语音模型。

  • 下载完成后,模型将被缓存在浏览器中,下次打开可「秒进」。

  • 强烈建议在 Wi-Fi 环境下进行首次加载。


使用步骤

  1. 上传一个包含人声的视频或音频文件(支持 MP4 / MP3 / WAV 等)

  2. (首次)等待模型下载与初始化完成

  3. 在左侧播放器上方选择要生成的「语言」或任务(可以原语言转写,也可以翻译成英文)

  4. 点击「开始生成」,耐心等待进度条走完(取决于设备性能与视频长度)

  5. 生成完成后,右侧将展示字幕,支持预览及点击定位

  6. 点击「导出 SRT」下载标准格式的字幕文件,即可用于剪辑软件(如剪映、PR)


隐私与安全

100% 绝对安全!无论您的视频长短,都不会上传到任何远程服务器。断网状态下(如果模型已缓存),本工具依然可以正常工作。

讨论 0

请 登录 后参与讨论

暂无评论,成为第一个分享观点的人吧。