KrillinAI 是一个功能强大的 AI 视频翻译与配音工具,支持从下载、字幕翻译到 TTS 配音的全链路自动化。它的部署方式非常灵活,覆盖了从“开箱即用”到“开发者构建”的全场景。

下面为您梳理出四种主要的部署和使用路径,您可以根据自己的技术背景和需求选择。


📋 部署方式速览

方式 适用人群 特点 操作复杂度
1. 桌面版 (推荐) 所有用户,特别是新手 图形界面,配置内置,下载即用 ⭐ 极简
2. 非桌面版 (Web UI) 喜欢网页操作或需远程访问的用户 Web 界面,需手动编辑配置文件 ⭐⭐ 简单
3. Docker 部署 熟悉容器化,追求环境一致性的用户 一键启动,隔离环境 ⭐⭐ 中等
4. 源码与 CLI 开发者、AI Agent 集成 完全控制,支持脚本化和自动化编排 ⭐⭐⭐ 复杂

🚀 方式一:桌面版(最简单、最推荐)

这是官方为普通用户设计的图形界面版本,所有配置都可以在软件内完成,无需手动编辑配置文件。

  1. 下载安装包

    • 访问项目的 GitHub Releases 页面
    • 下载文件名中包含 desktop 的最新版本,对应你的操作系统(如 KrillinAI_1.0.0_desktop_Windows_x86_64.exeKrillinAI_1.0.0_desktop_macOS_arm64)。
  2. 运行软件

    • Windows: 双击 .exe 文件即可运行。

    • macOS: 由于应用未签名,双击可能无法直接打开。请按照以下步骤操作:

      1. 打开“终端”(Terminal)。

      2. 使用 cd 命令进入你下载文件所在的目录。

      3. 执行以下命令移除隔离属性并赋予执行权限(注意:将 KrillinAI_1.0.0_desktop_macOS_arm64 替换为你下载的实际文件名):

        1
        2
        sudo xattr -cr ./KrillinAI_1.0.0_desktop_macOS_arm64
        sudo chmod +x ./KrillinAI_1.0.0_desktop_macOS_arm64
      4. 现在可以双击运行,或继续在终端执行 ./KrillinAI_1.0.0_desktop_macOS_arm64 启动。

  3. 开始使用

    • 启动后,直接在图形界面中配置你的 API 密钥(如 OpenAI、阿里云等)和各项参数,然后导入视频即可开始处理。

🌐 方式二:非桌面版 (Web UI)

此版本提供一个 Web 界面,适合作为服务器端服务运行。需要手动编辑配置文件

  1. 下载可执行文件

    • Releases 页面 下载文件名 不包含 desktop 的版本(如 KrillinAI_1.0.0_Linux_x86_64KrillinAI_1.0.0_macOS_arm64)。
  2. 创建配置文件

    • 在可执行文件同级目录下,创建一个名为 config 的文件夹。
    • config 文件夹中,创建一个名为 config.toml 的文件。
    • 从项目源码的 config 目录中获取 config-example.toml内容,复制粘贴到你新建的 config.toml 文件中。
    • 根据文件内的注释,必须填写必要的配置,特别是 [llm](大语言模型)和 [transcribe](语音识别)部分的 API 密钥和参数。
  3. 赋予执行权限并启动

    • macOS/Linux:

      1
      2
      3
      4
      # 添加执行权限
      chmod +x ./KrillinAI_1.0.0_macOS_arm64 # 替换为你的文件名
      # 启动服务
      ./KrillinAI_1.0.0_macOS_arm64
    • Windows: 在命令行中直接运行 .exe 文件。

  4. 访问 Web 界面

    • 服务启动后,在浏览器中访问 http://127.0.0.1:8888(端口号可在配置文件中修改)即可开始使用。

🐳 方式三:Docker 部署

适合喜欢容器化部署的用户,可参考项目中的 Docker 部署说明

核心步骤通常是:

  1. 准备配置文件:同样需要准备 config.toml 文件(参考方式二)。
  2. 运行容器:使用 Docker 命令或 docker-compose.yml 启动容器,并将配置文件和数据目录挂载到容器内。

🛠️ 方式四:从源码与命令行 (CLI)

适合开发者或需要将 KrillinAI 集成到自动化流程(如 AI Agent)中的用户。

  1. 环境准备:安装 Go 语言环境(版本需支持项目中 go.mod 的要求)。

  2. 克隆与编译

    1
    2
    3
    git clone https://github.com/krillinai/KrillinAI.git
    cd KrillinAI
    go build -o build/krillinai-cli ./cmd/cli
  3. 使用 CLI 分阶段处理:编译后,你可以使用 ./build/krillinai-cli 命令,通过不同的子命令(如 subtitle, tts, render-horizontal)来执行视频处理流水线的不同阶段。具体参数请参考项目 README.md 中的 CLI 使用说明。


🔧 配置核心要点(所有方式通用)

无论使用哪种方式,理解以下核心配置有助于你顺利运行:

  • 语音识别 (Transcribe):在 [transcribe] 部分选择 provider.name
    • openai (云端,需 API Key):速度快,效果好。
    • fasterwhisper (本地,推荐 model="large-v2"):免费,模型会自动下载。
  • 大语言模型 (LLM):在 [llm] 部分配置,用于翻译。兼容 OpenAI API 格式的服务(如 DeepSeek、Gemini、本地部署的模型等)。
  • TTS 配音 (可选):在 [tts] 部分配置。支持阿里云、OpenAI TTS 等。如使用语音克隆,需选择阿里云。

💡 常见问题

  • macOS 无法打开:请参照方式一中的步骤,使用终端命令移除隔离属性。
  • 配置文件不生效:确保文件名是 config.toml,且位于正确的 config 文件夹内,并检查文件格式(TOML)是否正确。
  • 本地模型下载慢:首次使用 FasterWhisper 等本地模型时,会自动下载模型文件,请耐心等待。