MoneyPrinterTurbo 是一个一站式 AI 短视频生成工具。您只需提供视频主题关键词,它就能自动生成视频脚本、匹配素材(或 AI 生成素材)、生成字幕和背景音乐,并合成高清短视频。它支持多种 AI 模型服务、语音合成和素材来源。


1. 系统要求

1.1 硬件要求

项目 最低配置 推荐配置
CPU 4 核 6-8 核
RAM 4 GB 8 GB
GPU 非必须(主要依赖云端服务) 4 GB 显存及以上(用于本地 Whisper 转录等)

1.2 软件前提

  • Python:版本 3.11 或更高(推荐 3.11)。
  • Git:用于克隆仓库。
  • FFmpeg:用于视频处理。如果自动下载失败,需手动安装并配置。
  • (可选)Docker:用于容器化部署。

1.3 API 密钥

您需要至少一个 大语言模型(LLM)提供商 的 API 密钥,用于生成视频脚本和关键词。支持 OpenAI、Anthropic Claude、Google Gemini、DeepSeek、Kimi (Moonshot)、阿里云通义千问、MiniMax 等,以及 OneAPI、LiteLLM 等聚合平台。您可以直接在 WebUI 的设置中配置这些密钥,无需手动编辑配置文件。


2. 部署方式

项目提供了多种部署方式,以适应不同用户的需求。

2.1 方式一:Docker 部署(推荐,环境隔离)

这是最简便、环境最干净的方式。

  1. 克隆并准备配置

    1
    2
    3
    4
    git clone https://github.com/harry0703/MoneyPrinterTurbo.git
    cd MoneyPrinterTurbo
    # 首次启动前,复制示例配置为 config.toml(供容器挂载)
    cp config.example.toml config.toml
  2. 启动容器

    1
    docker compose -f docker-compose.release.yml up

    说明docker-compose.release.yml 会直接拉取 GitHub Container Registry 上的预构建镜像 (ghcr.io/harry0703/moneyprinterturbo:latest)。如果需要本地构建,请使用 docker compose up

  3. 访问服务

    • WebUI:打开浏览器访问 http://127.0.0.1:8501
    • API 文档:访问 http://127.0.0.1:8080/docs

2.2 方式二:Windows 一键启动包(最简单)

适合没有 Python 环境的 Windows 用户。

  1. GitHub Releases 下载一键启动包。
  2. 解压到本地路径(路径中不要有中文、空格或特殊字符)。
  3. 双击 update.bat 更新到最新代码。
  4. 双击 start.bat 启动服务。
  5. 服务启动后会自动打开浏览器(如页面空白,请使用 Chrome 或 Edge 浏览器)。

2.3 方式三:手动部署(适用于 macOS / Linux / 开发者)

  1. 克隆代码

    1
    2
    git clone https://github.com/harry0703/MoneyPrinterTurbo.git
    cd MoneyPrinterTurbo
  2. 创建虚拟环境并安装依赖(推荐使用 uv):

    1
    2
    3
    4
    5
    6
    7
    8
    9
    # 使用 uv(推荐)
    uv python install 3.11
    uv sync --frozen

    # 或使用传统的 venv + pip
    python3.11 -m venv .venv
    source .venv/bin/activate # Linux/macOS
    # .venv\Scripts\activate # Windows
    pip install -r requirements.txt
  3. 启动 WebUI

    • macOS / Linux

      1
      sh webui.sh
    • Windows

      1
      .\webui.bat
    • 如需允许局域网内其他设备访问,可设置环境变量后启动(例如 MPT_WEBUI_HOST=0.0.0.0 sh webui.sh)。

  4. 启动 API 服务(可选)

    1
    2
    3
    4
    # 使用 uv
    uv run python main.py
    # 或激活虚拟环境后
    python main.py

2.4 方式四:纯命令行(CLI)

无需浏览器,直接在命令行生成视频:

1
2
3
4
5
# 生成完整视频
uv run python cli.py --video-subject "人工智能如何改变日常生活"

# 查看所有命令行参数
uv run python cli.py --help

3. 首次配置与使用

3.1 配置 API 密钥(关键步骤)

  1. 启动 WebUI 后,在界面中找到 “设置”“基础设置” 区域。
  2. 选择您想使用的 LLM Provider(如 OpenAI),并填写对应的 API KeyBase URL(如使用代理或聚合平台)。
  3. 根据需要,配置 语音合成(TTS)素材来源(Pexels/Pixabay 需要免费 API Key)的设置。
  4. 保存设置。

3.2 生成视频

  1. 在 WebUI 主界面,输入您想生成的视频主题关键词
  2. 选择视频尺寸(竖屏 9:16 或横屏 16:9)、语音音色等参数。
  3. 点击 “生成视频” 或类似按钮。
  4. 系统将自动完成:脚本生成 → 素材匹配/AI生成 → 语音合成 → 字幕生成 → 视频合成。
  5. 生成完成后,您可以在指定目录找到视频文件,或直接在界面预览。

4. 高级配置

4.1 使用 AI 生成素材(而非库存素材)

项目支持接入 WaveSpeed AI 等文生视频模型(默认 Seedance),根据脚本关键词直接生成全新画面。您需要在设置中配置相应的 API。

4.2 自定义字幕字体与背景音乐

  • 字体:将字体文件放入 resource/fonts 目录,即可在设置中选择。
  • 背景音乐:将音乐文件放入 resource/songs 目录。

4.3 配置语音合成 (TTS)

支持 Provider 包括:

  • 免费:Edge TTS (Azure TTS V1,无需 API Key)
  • 付费/云端:Azure TTS V2、ElevenLabs、Google Gemini TTS、SiliconFlow TTS 等。在 WebUI 中选择并填入对应凭证。

4.4 字幕生成模式

config.toml 中可切换:

  • subtitle_provider = "edge":使用 TTS 时间戳,速度快,默认。
  • subtitle_provider = "whisper":使用本地 faster-whisper 转写,更准确。首次使用需下载模型(约 3GB)。

4.5 自动发布到社交媒体

config.toml[app] 部分配置 upload_post_enabled 和相关密钥,生成后可自动发布到 TikTok、Instagram 和 YouTube Shorts。


5. 常见问题排查

问题 可能原因 解决方案
WebUI 页面空白 浏览器不兼容 使用 ChromeEdge 浏览器。
RuntimeError: No ffmpeg exe FFmpeg 未自动下载或未找到 1. 手动从 ffmpeg.org 下载并安装。 2. 在 config.toml 中设置 ffmpeg_path = "你的ffmpeg路径"
LLM 调用失败或返回错误 API 密钥无效、余额不足或 Provider 配置错误 检查 WebUI 设置中的 API Key 和 Base URL。确认 Provider 账户状态正常。
素材下载失败 Pexels/Pixabay API 密钥未配置或达到请求限制 在设置中配置有效的 API 密钥(免费申请)。检查网络连接。
Whisper 模型下载失败 网络无法访问 Hugging Face 1. 手动从 Hugging Face 下载模型文件,放入 models/ 目录。 2. 参考文档中的手动下载步骤。
OSError: [Errno 24] Too many open files 系统文件打开数限制过低 在 Linux/macOS 中执行 ulimit -n 10240 提高限制。

6. 总结

MoneyPrinterTurbo 是一个功能强大、部署方式灵活的 AI 视频生成工具。

核心部署路径

  1. 零门槛体验:使用 Windows 一键启动包Google Colab
  2. 隔离环境部署:使用 Dockerdocker compose -f docker-compose.release.yml up)。
  3. 开发者/手动部署:克隆仓库 → 配置 Python 环境 (uv sync) → 启动 WebUI (sh webui.sh)。
  4. 无界面使用:通过 CLI (cli.py) 或 API 集成。

最关键的一步是配置正确的 LLM API 密钥,这是生成脚本和素材关键词的基础。建议从 WebUI 开始,通过图形界面完成所有设置并生成第一个视频,熟悉流程后再探索 CLI 或 API 等高级用法。生成第一个视频的成本主要来自 LLM API 调用和可选的素材/AI 生成服务。

项目地址:https://github.com/harry0703/MoneyPrinterTurbo