Skip to content

Repository files navigation

AI 翻译配音

AI 翻译配音(VoxOver)是一个本地优先的视频转录和字幕翻译工具。它会从视频中提取音频,用 Whisper 生成带时间轴的字幕,再通过 Ollama 或 DeepSeek 翻译,最后输出字幕文件与带字幕视频。

当前主分发形态为原生 macOS App(SwiftUI + Python pipeline)。

功能

  • 上传视频后自动提取 16 kHz 单声道音频。
  • 使用 Whisper 转录字幕,支持多种模型。
  • 支持 Ollama 本地模型和 DeepSeek API 两种翻译后端。
  • 支持软字幕与硬字幕输出。
  • 输出文件按任务分组,便于管理。

安装使用

从 Release 安装原生 App

  1. 在 GitHub Releases 下载最新的原生 DMG(例如 VoxOver-2.0.0-native-arm64.dmg)。
  2. 打开 DMG,将 VoxOver.app 拖入 Applications。
  3. 首次启动应用。

建议提前安装 ffmpeg:

brew install ffmpeg

如果使用 Ollama,需要先启动 Ollama 并准备好模型。

从源码运行 Web 管线

python3 -m venv .venv
. .venv/bin/activate
pip install -r requirements.txt
python app.py

启动后默认地址为 http://127.0.0.1:7860

原生构建

原生项目位于 macos-app/

常用命令:

cd macos-app
./build_native_dmg.sh --adhoc

产物默认在 macos-app/dist/

配置

复制配置模板后按需修改:

cp config.example.yaml config.yaml

config.yaml 不应提交到 Git。

输出文件

默认输出目录为 outputs/,包括:

  • .srt 字幕文件
  • 带软字幕轨的视频
  • 硬烧录字幕视频

许可

MIT

About

No description, website, or topics provided.

Resources

Stars

1 star

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages