首页
/
WhisperSubTranslate
基本信息
- 工具类别: 开源&免费
- 收录时间: 2026-08-21
- 访问次数: 57
- 评分: 5.0
- 官网: https://github.com/Blue-B/WhisperSubTranslate
工具详情
WhisperSubTranslate 实用指南
一、平台介绍
- 类型:本地桌面工具(Windows)
- 技术架构:基于 Whisper.cpp(语音识别) + 翻译模型
- 核心特点:
- 100% 本地运行(可离线),无需联网即可使用
- 无需账号 / 无需上传视频,隐私安全有保障
- 开源(GPL-3.0),源代码公开
- 核心定位:实现 “视频 → 自动字幕(SRT)→ 多语言翻译” 的一体化工具
二、主要功能
- 字幕生成(核心功能)从视频音频中识别字幕(Speech-to-Text)
- 支持 100+ 种语言 的语音识别
- 字幕翻译离线翻译:内置 Hy-MT2 模型,无需网络
- 在线翻译:可接入以下服务配置 API
- MyMemory(免费)
- DeepL
- OpenAI
- Gemini
- 本地化优势视频文件不上传云端,数据不出本地
- 支持完全离线处理流程
- 所有处理数据均保存在本地
- 实用功能扩展自动模型下载(无需手动配置环境)
- 队列处理(支持批量任务)
- 字幕时间轴修复(针对长视频同步优化)
- GPU / CPU 性能自动适配
三、适用人群
适合以下用户使用:
- 🎬 视频创作者(如 YouTube / B站 UP 主)
- 🎓 外语学习者(用于观看外语课程或教材)
- 🎧 字幕翻译人员(用于本地化工作)
- 🧑💻 技术用户(希望避免折腾 Python 或命令行)
- 🔐 注重隐私者(不希望上传视频至第三方服务器)
👉 特别推荐场景:长视频(如课程、访谈、会议录音)的字幕制作与多语言处理。
四、免费 / 付费情况
- 软件本身费用完全免费 + 开源
- 无订阅制、无需注册账号
- 可能产生的额外费用(可选)若选择使用“在线翻译 API",需自行承担对应服务商的费用:
- MyMemory:免费使用,但有调用次数限制
- DeepL:提供少量免费额度,超出后按量收费
- OpenAI:付费模式,按 Token 数量计费
- Gemini:提供免费或低价额度(推荐低成本方案)
- 定价参考说明翻译 API 需自行申请 Key 并遵循其官方定价
五、如何使用
- 下载与安装进入项目 Releases 页面下载 ZIP 压缩包
- 解压后直接运行
.exe程序即可启动 - 生成字幕将视频文件拖入软件界面
- 选择识别模型(推荐 large-v3-turbo)
- 点击开始,自动生成 .srt 格式字幕
- 翻译字幕(可选)选择翻译模式:本地模型(离线)或配置 API(在线高质量)
- 导出文件输出标准的 SRT 格式字幕
- 字幕可直接用于 VLC、各类剪辑软件等播放器
六、注意事项
- 功能边界限制❌ 不支持提取视频中已有的字幕轨道
- ❌ 不支持识别画面中的文字(无 OCR 功能)
- 硬件性能要求大模型需要一定的内存与显存(建议 2GB~8GB+)
- 若无 GPU 也能运行,但速度会相对较慢
- 翻译限制说明免费 API 存在调用额度上限
- 处理长视频时建议优先选择 Gemini / DeepL 或本地模型
- 长视频同步问题可能出现的字幕漂移现象
- 解决方案:使用 Sync 模型 进行时间轴修复
七、一句话总结
本地 AI 字幕工具(识别 + 翻译) 免费、离线、无上传风险,非常适合长视频字幕制作与多语言处理。
暂无评论