一个主题,5分钟出短视频成片?MoneyPrinterTurbo AI短视频生成完整实战指南
【免费下载链接】MoneyPrinterTurbo利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.项目地址: https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo
输入一个主题,5 分钟后你就能拿到带旁白、字幕、背景音乐的竖屏成片——这是开源的 AI 短视频一键生成工具MoneyPrinterTurbo替你完成的事。文案、找素材、配音、剪辑全由它自动跑完,你只需给一个话题和两个 API Key。
最小部署路径:克隆、配置、启动
要准备两样东西:一个免费的PexelsAPI Key(版权免费素材网站,素材从这里来),一个能用的大模型 Key(负责写文案,国内用deepseek直连最省事)。
git clone https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo cd MoneyPrinterTurbo cp config.example.toml config.toml conda create -n mpt python=3.11 && conda activate mpt pip install -r requirements.txt sh webui.shWindows 上把最后一条换成双击webui.bat。config.toml只需改这几处:
pexels_api_keys = ["你的PexelsKey"] llm_provider = "deepseek" deepseek_api_key = "你的APIKey"启动成功后浏览器会自动打开8501端口的 Web 界面;想走 REST API(HTTP 接口)入口,另开终端执行python main.py,访问 http://localhost:8080/docs 即可在线调试。国内部署也可以直接docker-compose up,省掉 Python 环境和ImageMagick(图片处理组件)的手动安装。
🎬 动手:生成第一条竖屏短视频
最省事的入口是 Web 界面,参数全部可视化:
- 在“视频主题”填一个话题,比如
金钱的作用,文案区留空,大模型会替你写好 - 画面比例选
9:16竖屏,语音选zh-CN-XiaoxiaoNeural,可点试听按钮先听音色 - 字幕保持开启(默认 edge 模式),背景音乐随机,片段时长 5 秒
- 点“生成视频”,等 2~5 分钟,成片落在
storage/tasks/<task_id>/final-1.mp4
走 API 的话,一个 POST 提交任务:
curl -X POST http://localhost:8080/api/v1/videos \ -H "Content-Type: application/json" \ -d '{"video_subject":"金钱的作用","video_aspect":"9:16","voice_name":"zh-CN-XiaoxiaoNeural","video_count":2,"subtitle_enabled":true}'完成后用task_id查询,videos字段返回可播放的成片地址:
curl "http://localhost:8080/api/v1/tasks/<task_id>?with_media=true"在线文档页里每个接口都能直接点开试:
一次点击背后发生了什么:6 步生成流水线
整条流水线由 任务编排模块 驱动,每步的中间产物(文案、音频、字幕、素材、成片)都落在storage/tasks/<task_id>/下,方便单独复用:
| 步骤 | 做什么 | 你能调什么 |
|---|---|---|
| 文案生成 | 大模型按主题写口播文案 | video_script:填了就用你自己的文案 |
| 关键词抽取 | 从文案反向抽出 5 个搜素材的词 | video_terms:手动指定搜索词 |
| 语音合成 | Edge TTS(微软免费在线语音合成)朗读文案 | voice_name音色、voice_rate语速 |
| 字幕生成 | 用语音时间戳产出字幕文件 | subtitle_enabled开关、subtitle_provider模式 |
| 素材下载 | 去Pexels/Pixabay搜视频,按目标分辨率过滤 | video_source来源、video_aspect尺寸 |
| 剪辑合成 | MoviePy(Python 视频处理库)拼接片段,叠字幕和背景音乐 | video_clip_duration、video_concat_mode、bgm_volume |
两个容易被忽略的环节,直接决定成片质量。一是关键词抽取:素材和文案搭不搭,取决于从文案里抽出的那 5 个搜索词,抽偏了就手动指定video_terms兜底。二是字幕模式:默认 edge 直接复用 语音服务 返回的词级时间戳,快且零配置;whisper 模式识别更稳,但首次要下载约 3GB 的 large-v3 模型,edge 生成失败时也会自动切到 whisper 兜底。
常被调动的参数速查
| 参数 | 默认值 | 改动后效果 |
|---|---|---|
subtitle_provider | edge | 换成 whisper 字幕更稳但更慢 |
video_source | pexels | 换成 pixabay 切换素材源,多 Key 自动轮询 |
video_clip_duration | 5 | 每段更短,画面切换节奏更快 |
voice_name | zh-CN-XiaoxiaoNeural | 换音色,需和文案语言一致 |
video_count | 1 | 填 2 一次出两条随机拼接的候选版本 |
bgm_volume | 0.2 | 调大背景音乐音量,bgm_file可固定resource/songs里的曲目 |
max_concurrent_tasks | 5 | 调高同时生成视频的任务数 |
🔧 常见报错速查
| 现象 | 原因 | 解法 |
|---|---|---|
AttributeError: 'str' object has no attribute 'choices' | 大模型调用失败,SDK 把错误字符串当响应返回,多为网络问题 | 换 deepseek/moonshot 等国内直连服务商,或给 OpenAI 配openai_base_url代理 |
RuntimeError: No ffmpeg exe could be found | ffmpeg 自动下载失败,通常网络受限 | 手动下载 ffmpeg,在config.toml的[app]里把ffmpeg_path指到本地路径 |
ImageMagick 安全策略拦截@/tmp/... | 发行版默认在policy.xml禁止@临时文件读写 | 编辑policy.xml,将pattern="@"条目的rights="none"改为rights="read\|write" |
OSError: [Errno 24] Too many open files | 合成时并发打开文件数超过系统上限 | ulimit -n 10240调高文件描述符上限后重跑 |
进阶一步:状态持久化与轻量用法
任务状态默认存在内存(内存任务管理器),重启即丢;config.toml里把enable_redis设为 true 后切换到 Redis 任务管理器,可跨实例共享,并发由max_concurrent_tasks封顶。
stop_at参数也是个实用设计:流水线能在文案、关键词、音频、字幕、素材任意一步停下,“只生成音频”“只生成字幕”这类轻量 API 就是靠它实现的,把它当纯文案或配音工具用时可省掉最耗时的素材下载。README 的“后期计划”还列了 GPT-SoVITS 配音、更多素材来源、视频转场强化、自动上传 YouTube 等方向,可持续跟进。
准备好 Pexels Key 和 DeepSeek Key 后,从克隆到第一条成片出炉,全程大约 5 分钟。
【免费下载链接】MoneyPrinterTurbo利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.项目地址: https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考