16
我是noob~
当前还没有回复,欢迎成为第一个参与讨论的人。
一站式 AI 短视频生成工具
只需提供视频主题或关键词,即可自动生成视频脚本、匹配素材、生成字幕和背景音乐,并合成高清短视频。
WebUI

API

功能特性 🎯
提供 AI Agent、WebUI、API 和 CLI 四种使用方式,代码按控制器、服务和模型等职责分层
支持 AI 自动生成视频脚本,也可以使用自定义脚本
支持多种 高清视频 尺寸
竖屏 9:16,1080x1920
横屏 16:9,1920x1080
支持 批量视频生成,可以一次生成多个视频,然后选择一个最满意的
支持 视频片段时长 设置,方便调节素材切换频率
支持 多语言视频脚本 生成
支持 Edge TTS、Azure Speech、SiliconFlow、Google Gemini、小米 MiMo、ElevenLabs、Chatterbox 和 Fish Audio 语音合成,可实时试听
支持 字幕生成,可调整字体、位置、颜色、大小、描边和背景样式
支持 背景音乐,可随机选择或使用指定音乐,并调整音量
支持使用自己的 本地素材,也可从 Pexels、Pixabay 和 Coverr 获取可免费使用的高清素材
支持 AI 生成素材:接入 WaveSpeed AI 文生视频模型(默认 Seedance),按脚本关键词直接生成全新画面,不再受限于库存素材
支持 Kimi / Moonshot AI、OpenAI、Anthropic Claude、Google Gemini、DeepSeek、阿里云通义千问、Microsoft Azure OpenAI、火山引擎方舟、xAI Grok、MiniMax、小米 MiMo 等主流模型服务,并兼容 Cloudflare AI Gateway、魔搭 ModelScope、AIHubMix、AIML API、EvoLink、Ollama、OneAPI、LiteLLM、Groq、Pollinations AI 等统一网关、聚合平台和本地运行环境
支持一键 跨平台发布,生成完成后可自动上传至 TikTok、Instagram 和 YouTube Shorts
支持将生成设置导出和导入为预设文件,并在设置弹窗中备份和恢复所有 API Key


| 项目 | 最低配置 | 推荐配置 | 理想配置 |
|---|---|---|---|
| CPU | 4 核 | 6 到 8 核 | 8 核及以上 |
| RAM | 4 GB | 8 GB | 16 GB 及以上 |
| GPU | 非必须 | 4 GB 显存及以上 | 8 GB 显存及以上 |
faster-whisper、批量生成或更重的本地处理链路,GPU 会明显提升速度uv 进行本地部署如果你的 AI Agent 支持读取 Skill 文档并操作本地终端,可以直接发送下面这段话。Agent 会自动完成安装、配置和视频生成;只有缺少必要的 API Key 时才会向你询问,完成后会返回生成的视频文件路径。目前支持 macOS 和 Windows。
text使用这个 Skill:https://raw.githubusercontent.com/harry0703/MoneyPrinterTurbo/main/docs/skill/SKILL.md 帮我生成一个主题为“人工智能如何改变普通人的日常生活”的视频。
免去本地环境配置,点击直接在 Google Colab 中快速体验 MoneyPrinterTurbo
下载一键启动包,解压直接使用(路径不要有 中文、特殊字符、空格)
下载后,建议先双击执行 update.bat 更新到最新代码,然后双击 start.bat 启动
启动后,会自动打开浏览器(如果打开是空白,建议换成 Chrome 或者 Edge 打开)
textgit clone https://github.com/harry0703/MoneyPrinterTurbo.git
首次启动时,项目会根据 config.example.toml 自动创建 config.toml。大模型 Provider、素材来源和相关 API Key 可以直接在 WebUI 的基础设置中配置。
如果未安装 Docker,请先安装 https://www.docker.com/products/docker-desktop/
Windows 用户可以参考微软的文档:
textcd MoneyPrinterTurbo docker compose -f docker-compose.release.yml up
默认推荐使用
docker-compose.release.yml,它会直接拉取 GitHub Container Registry 上的预构建镜像:ghcr.io/harry0703/moneyprinterturbo:latest。 如果你需要本地重新构建镜像,可以继续使用docker compose up。 首次启动前,请将config.example.toml复制为config.toml,供容器挂载使用。
打开浏览器,访问 http://127.0.0.1:8501
打开浏览器,访问 http://127.0.0.1:8080/docs 或者 http://127.0.0.1:8080/redoc
视频教程
推荐使用 uv 管理 Python 环境和依赖。项目支持 Python 3.11 或更高版本,以下示例使用 Python 3.11。
textgit clone https://github.com/harry0703/MoneyPrinterTurbo.git cd MoneyPrinterTurbo uv python install 3.11 uv sync --frozen
如果你暂时不使用 uv,也可以继续使用 venv + pip
textpython3.11 -m venv .venv source .venv/bin/activate pip install -r requirements.txt
说明:
pyproject.toml 是主依赖定义文件uv.lock 是锁文件,建议默认执行 uv sync --frozenrequirements.txt 仅保留给旧的 pip 安装方式兼容使用注意需要到 MoneyPrinterTurbo 项目 根目录 下执行以下命令
text.\webui.bat
在 CMD 中也可以执行 webui.bat。 webui.bat 会优先使用项目 .venv 或一键包内置 Python;如果没有找到项目 Python,但已安装 uv,会自动切换为 uv run streamlit。 如需允许局域网内其他设备访问 WebUI,可以先执行 set MPT_WEBUI_HOST=0.0.0.0,再运行 webui.bat。
textsh webui.sh
脚本会自动使用项目虚拟环境或 uv,并选择可用的本地端口。如需允许局域网内其他设备访问,可以执行:
textMPT_WEBUI_HOST=0.0.0.0 sh webui.sh
启动后,会自动打开浏览器(如果打开是空白,建议换成 Chrome 或者 Edge 打开)
textuv run python main.py
如果你已经手动激活了虚拟环境,也可以直接执行:
textpython main.py
如果你无法使用浏览器或端口转发,可以直接在命令行生成视频。最简单的完整视频生成命令如下:
textuv run python cli.py --video-subject "人工智能如何改变日常生活"
字幕样式和配音参数按以下优先级取值:命令行显式参数 > config.toml 中 [ui] 保存的 WebUI 设置 > 内置默认值。其余生成设置(如背景音乐、视频数量、 段落数量等)不会自动沿用 WebUI 的保存值。若 WebUI 中选择了上传自备音频, 命令行需要显式传入 --custom-audio-file,因为音频路径不会被保存。
如需查看完整命令、参数说明和使用方法,可以执行:
textuv run python cli.py --help
默认使用免费的 Edge TTS,在 WebUI 中显示为 Azure TTS V1。项目同时支持 Azure TTS V2、SiliconFlow TTS、Google Gemini TTS、小米 MiMo TTS、ElevenLabs TTS、自托管 Chatterbox TTS、Fish Audio TTS,以及无配音模式。
可直接在 WebUI 中选择 Provider 和音色,并按照界面提示填写所需凭据。Edge TTS 不需要 API Key;Azure TTS V2 及其他云端服务需要对应平台的凭据。Edge TTS 音色可查看:音色列表。
当前支持两种字幕生成方式:
faster-whisper 转写音频,适用于需要更准确字幕时间轴的场景。首次使用时需要下载模型。在 config.toml 中修改 subtitle_provider 即可切换模式。Whisper 默认使用约 3 GB 的 large-v3;如需更小、更快的模型,可以使用约 1.6 GB 的 large-v3-turbo:
text[app] subtitle_provider = "whisper" [whisper] model_size = "large-v3-turbo"
首次使用 Whisper 时,程序会自动从 Hugging Face 下载模型。如果当前网络无法自动下载,可以从 Hugging Face 手动下载
whisper-large-v3。
下载并解压后,将整个目录放到 .\MoneyPrinterTurbo\models,最终路径应为 .\MoneyPrinterTurbo\models\whisper-large-v3:
textMoneyPrinterTurbo ├─models │ └─whisper-large-v3 │ config.json │ model.bin │ preprocessor_config.json │ tokenizer.json │ vocabulary.json
用于视频的背景音乐,位于项目的 resource/songs 目录下。
当前项目里面放了一些默认的音乐,来自于 YouTube 视频,如有侵权,请删除。
用于视频字幕的渲染,位于项目的 resource/fonts 目录下,你也可以放进去自己的字体。