首页 / 详情
Site icon

WhisperSubTranslate

基本信息

WhisperSubTranslate 网站截图预览

工具详情

WhisperSubTranslate 实用指南

一、平台介绍

  • 类型:本地桌面工具(Windows)
  • 技术架构:基于 Whisper.cpp(语音识别) + 翻译模型
  • 核心特点:
  1. 100% 本地运行(可离线),无需联网即可使用
  2. 无需账号 / 无需上传视频,隐私安全有保障
  3. 开源(GPL-3.0),源代码公开
  • 核心定位:实现 “视频 → 自动字幕(SRT)→ 多语言翻译” 的一体化工具

二、主要功能

  • 字幕生成(核心功能)从视频音频中识别字幕(Speech-to-Text)
  • 支持 100+ 种语言 的语音识别
  • 字幕翻译离线翻译:内置 Hy-MT2 模型,无需网络
  • 在线翻译:可接入以下服务配置 API
  • MyMemory(免费)
  • DeepL
  • OpenAI
  • Gemini
  • 本地化优势视频文件不上传云端,数据不出本地
  • 支持完全离线处理流程
  • 所有处理数据均保存在本地
  • 实用功能扩展自动模型下载(无需手动配置环境)
  • 队列处理(支持批量任务)
  • 字幕时间轴修复(针对长视频同步优化)
  • GPU / CPU 性能自动适配

三、适用人群

适合以下用户使用:

  1. 🎬 视频创作者(如 YouTube / B站 UP 主)
  2. 🎓 外语学习者(用于观看外语课程或教材)
  3. 🎧 字幕翻译人员(用于本地化工作)
  4. 🧑‍💻 技术用户(希望避免折腾 Python 或命令行)
  5. 🔐 注重隐私者(不希望上传视频至第三方服务器)

👉 特别推荐场景:长视频(如课程、访谈、会议录音)的字幕制作与多语言处理。

四、免费 / 付费情况

  • 软件本身费用完全免费 + 开源
  • 无订阅制、无需注册账号
  • 可能产生的额外费用(可选)若选择使用“在线翻译 API",需自行承担对应服务商的费用:
  1. MyMemory:免费使用,但有调用次数限制
  2. DeepL:提供少量免费额度,超出后按量收费
  3. OpenAI:付费模式,按 Token 数量计费
  4. Gemini:提供免费或低价额度(推荐低成本方案)
  • 定价参考说明翻译 API 需自行申请 Key 并遵循其官方定价

五、如何使用

  • 下载与安装进入项目 Releases 页面下载 ZIP 压缩包
  • 解压后直接运行 .exe 程序即可启动
  • 生成字幕将视频文件拖入软件界面
  • 选择识别模型(推荐 large-v3-turbo)
  • 点击开始,自动生成 .srt 格式字幕
  • 翻译字幕(可选)选择翻译模式:本地模型(离线)或配置 API(在线高质量)
  • 导出文件输出标准的 SRT 格式字幕
  • 字幕可直接用于 VLC、各类剪辑软件等播放器

六、注意事项

  • 功能边界限制❌ 不支持提取视频中已有的字幕轨道
  • ❌ 不支持识别画面中的文字(无 OCR 功能)
  • 硬件性能要求大模型需要一定的内存与显存(建议 2GB~8GB+)
  • 若无 GPU 也能运行,但速度会相对较慢
  • 翻译限制说明免费 API 存在调用额度上限
  • 处理长视频时建议优先选择 Gemini / DeepL 或本地模型
  • 长视频同步问题可能出现的字幕漂移现象
  • 解决方案:使用 Sync 模型 进行时间轴修复

七、一句话总结

本地 AI 字幕工具(识别 + 翻译) 免费、离线、无上传风险,非常适合长视频字幕制作与多语言处理。

评论

暂无评论