AutoSubs 详细部署与使用教程

AutoSubs 是一款本地优先的AI字幕生成工具,支持独立运行或直接集成到 DaVinci Resolve、Adobe Premiere Pro 和 After Effects 中。所有 AI 转录和说话人识别均在本地完成,无需上传数据至云端,保障隐私安全 。

本教程将指导您完成安装、配置和基本使用。


1. 系统要求与下载

支持平台

AutoSubs 支持主流操作系统,请根据您的系统选择对应的安装包 :

平台 安装包
🪟 Windows AutoSubs-windows-x86_64.exe
🍎 macOS (Apple Silicon) AutoSubs-Mac-ARM.pkg
🍎 macOS (Intel) AutoSubs-Mac-Intel.pkg
🐧 Linux (Debian/Ubuntu) AutoSubs-linux-x86_64.deb
🐧 Linux (Fedora/openSUSE) AutoSubs-linux-x86_64.rpm

下载方式

  1. 直接下载:访问项目 Releases 页面,下载对应系统的安装包。

  2. macOS Homebrew:在终端执行以下命令安装:

    1
    brew install --cask auto-subs

2. 安装步骤

Windows

双击下载的 .exe 文件,按提示完成安装。

macOS

双击下载的 .pkg 文件,按提示完成安装。

Linux (以 Debian/Ubuntu 为例)

打开终端,执行以下命令 :

1
2
3
4
5
6
# 下载最新 .deb 包
wget https://github.com/tmoroney/auto-subs/releases/latest/download/AutoSubs-linux-x86_64.deb
# 使用 apt 安装
sudo apt install ./AutoSubs-linux-x86_64.deb
# 若遇到依赖错误,可尝试以下命令修复
sudo dpkg -i AutoSubs-linux-x86_64.deb && sudo apt -f install

对于 Fedora/openSUSE,下载 .rpm 文件后,使用系统自带的包管理器打开即可。


3. 首次启动与模型管理

安装完成后,启动 AutoSubs。

  1. 模型下载:首次使用特定转录模型时,AutoSubs 会从网络下载模型文件。您可以在 Model Manager 中查看、下载或删除模型 。
  2. 模型选择:AutoSubs 内置了多种模型,您可以根据准确度、语言、硬件资源选择 :
    • Whisper:通用性最强,支持100+语言。large-v3 准确度最高 (★★★★),但需要约10GB内存。
    • Parakeet / Canary:NVIDIA出品,支持25种欧洲语言,速度快且准确 (★★★★)。
    • Cohere:针对14种主要语言优化,准确度最高 (★★★★),模型约2GB。
    • GigaAM:俄语及中亚语言(哈萨克语、乌兹别克语等)的专用模型,准确度极高 (★★★★) 。

建议:对于英语内容,可选择 whisper small.enmedium.en,在速度和准确度间取得平衡。中文、日文等可选择 whisper mediumsense-voice 模型。


4. 快速上手:独立模式

此模式无需剪辑软件,可直接为音视频文件生成字幕。

  1. 启动 AutoSubs,点击选择或拖拽一个音频/视频文件。
  2. 在设置面板中:
    • Model:选择已下载的转录模型。
    • Language:选择音频语言,或设为 auto 自动检测。
    • Translate:可选择将非英语语音翻译为英语字幕。
  3. 点击 Transcribe 按钮开始转录。
  4. 转录完成后,您可以在编辑器中:
    • 编辑文本:修正识别错误。
    • 编辑说话人:查看和修改自动识别的说话人标签及颜色 。
    • 调整时间轴:微调字幕出现时间。
  5. 点击 Export,将字幕导出为 SRT、纯文本格式,或直接复制到剪贴板 。

5. 深度集成:DaVinci Resolve 模式

AutoSubs 可以直接在 DaVinci Resolve 内部工作,将字幕无缝发送回时间线 。

重要前提:AutoSubs 不支持 Mac App Store 版本的 DaVinci Resolve。请从 Blackmagic Design 官网 下载安装 。

使用步骤

  1. 打开 DaVinci Resolve。
  2. 在顶部菜单栏,依次点击 Workspace → Scripts → AutoSubs。这将打开 AutoSubs 界面(可能以独立窗口形式出现)。
  3. 在 AutoSubs 中,选择您的时间线或特定的音频源
  4. 像独立模式一样,选择模型、语言等设置。
  5. 点击 Transcribe
  6. 编辑并确认字幕和说话人样式。
  7. 点击 Send to Resolve,字幕将作为新的字幕轨道或 Fusion 文本,按照您设定的样式(颜色、轮廓、位置)添加到时间线上 。

6. 集成:Adobe Premiere Pro / After Effects

AutoSubs 通过内置的 CEP 扩展与 Adobe 软件通信 。

使用步骤

  1. 启动 AutoSubs 桌面应用。
  2. 打开 Adobe Premiere Pro 或 After Effects。CEP 扩展应自动加载。
  3. 在 AutoSubs 中选择 Adobe Integration 选项。
  4. 您可以从 Premiere Pro 时间线导出音频进行转录,或将生成的字幕导入为 Premiere Pro 的字幕轨道或 After Effects 的文字图层

7. 进阶与命令行模式

对于高级用户,AutoSubs 也提供了命令行界面 (CLI)。具体用法和完整参数,请参考项目文档中的 CLI Guide


8. 常见问题与提示

  • Resolve 中找不到脚本:请确认您安装的是官网版 DaVinci Resolve,而非 Mac App Store 版本 。
  • 转录速度慢:尝试使用更小的模型(如 tinybase),或确保您的系统满足模型的内存要求 。
  • 模型下载失败:检查网络连接,或从 Model Manager 手动重试。
  • GPU 加速:Windows 用户需安装 Vulkan SDK,macOS 用户则自动使用 Metal 加速,Linux 用户需启用 Vulkan 支持 。

通过以上步骤,您应该能够成功部署并开始使用 AutoSubs。这是一个功能强大且不断发展的项目,如需了解更多技术细节或进行二次开发,可以查阅其 GitHub 仓库 中的 CONTRIBUTING.mdCLI.md 文档。