MoneyPrinterTurbo 完整教程:一个主题生成高清短视频,5 步做出第一个成片
【免费下载链接】MoneyPrinterTurbo利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.项目地址: https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo
假设你手里只有一个选题"为什么不建议睡前刷手机",接下来要做的全部事情就是:把这句话填进输入框,点一次生成按钮。几分钟后,你会拿到一支带解说、带字幕、带背景音乐的竖屏短视频,画面来自无版权素材库,可以直接发出去。这件事背后就是 MoneyPrinterTurbo——一个开源的 AI 短视频生成工具,输入主题或关键词,自动完成文案、素材、配音、字幕到成片合成的全流程。
🧾 它能替你干掉的活
与其说它"功能丰富",不如直接列出它自动完成的动作:
- 把一句话主题扩写成完整视频文案,支持中文、英文,也能直接填自己写好的文案
- 从文案里自动提炼搜索关键词,去 Pexels 或 Pixabay 拉取高清无版权视频片段
- 把文案合成为语音解说,并顺带产出带时间戳的字幕数据
- 按时间轴把素材、配音、字幕对齐,渲染出成片:竖屏 9:16(1080x1920)或横屏 16:9(1920x1080)
- 叠加背景音乐,支持随机选曲、指定本地文件、调节音量
- 一次任务批量生成多个版本,供你挑效果最好的那条
- 全程无需剪辑软件,成片是标准 mp4,拿到即发布
⚙️ 它是怎么转起来的
整个任务是一条流水线,由 任务调度模块 按顺序驱动,核心就三块,理解了这三块就理解了整个项目:
- 文案与关键词(app/services/llm.py):主题先交给大模型生成文案,再从文案里反推出几个搜索关键词。大模型是可插拔的,OpenAI、DeepSeek、Moonshot、通义千问、Gemini、Azure 等都能接,切换只改配置。
- 素材匹配(app/services/material.py):拿关键词调 Pexels/Pixabay 的搜索接口,下载片段并缓存在本地,重复的素材下次直接复用。
- 合成渲染(app/services/video.py、voice.py、subtitle.py):TTS 把文案读成音频并记录每个词的起止时间,素材按配音时长切成短片段,再用 ffmpeg 把画面、声音、字幕、音乐压成一条时间轴输出。
也就是说,你看到的"一键生成",本质是"大模型写词 → 搜索 API 找画面 → 渲染引擎对齐"这三步的自动化串联。
🚶 跟我走一遍:从零到第一个成片
按 Windows 手动部署的路径走,macOS/Linux 同理,全程只需几条单行命令。
- 拉取代码:
git clone https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo - 装依赖:
pip install -r requirements.txt(另外按系统装一个 ImageMagick,Windows 记得选静态库版本) - 改配置:把
config.example.toml复制一份改名config.toml,填两个东西——pexels_api_keys(素材密钥)和llm_provider对应的模型密钥 - 启动 Web 界面:项目根目录执行
webui.bat(Windows)或sh webui.sh(macOS/Linux),浏览器会自动打开 - 输入主题、选视频尺寸,点生成,等几分钟下载成片
如果不想手动装环境,Docker 方式更省事:装好 Docker 后进入项目目录执行docker-compose up,然后浏览器访问 8501 端口就是 Web 界面,8080 端口/docs是 API 文档。
🎛️ 把效果调出来的几个关键旋钮
配置项很多,但真正影响成片观感的就这几个,按"你想解决什么问题"来找:
| 想解决的问题 | 去动哪里 |
|---|---|
| 字幕切分不准、节奏错位 | config.toml里把subtitle_provider从edge改成whisper,质量更稳,代价是需要一个约 3GB 的模型文件 |
| 画面切换太快(或太拖) | 调整视频片段时长设置(默认单片段约 5 秒),片段越短节奏越快 |
| 背景音乐不合适 | 把想要的音频放进resource/songs目录,生成时指定该文件,并把背景音乐音量调到不压过人声 |
| 解说声音不合口味 | 查 声音列表 挑发音人;配置了 Azure 密钥后还能多 9 种更真实的音色 |
| 字幕样式与品牌不符 | 字体、位置、颜色、大小、描边都可在界面里调;自有字体放进resource/fonts即可被选中 |
一个实用顺序建议:先用默认的edge字幕跑一条看效果,只有确实在意字幕精度时再上whisper,省得白等 3GB 下载。
🎯 谁用起来最划算
- 自媒体日更账号:一个选题丢进去一次生成 3~5 条,挑数据最好的版本发布,把"日更"从剪辑活变成挑选活。
- 企业营销 / 培训团队:产品卖点、知识讲解这类"有脚本有画面"的内容最适合它,内部可以按 API 文档 写个小脚本接进现有的内容生产流程,批量出片。
- 不想部署的个人用户:国内已有平台基于该项目提供免费在线服务(如 README 中提到的录咖),不想折腾环境可以直接在线用,部署只是可选项。
❓ 常见问题与踩坑提示
Q1:报RuntimeError: No ffmpeg exe could be found?ffmpeg 正常会自动下载,自动下载失败时,手动下载 ffmpeg 后在config.toml里设置ffmpeg_path指向实际路径即可。
Q2:生成音频或下载素材时报"maybe the network is not available"?这是访问不了境外服务的典型表现,需要代理环境。国内用户更省心的做法是把llm_provider换成 DeepSeek 或 Moonshot,国内直连,注册即有可用额度。
Q3:必须装独立显卡吗?不需要。官方建议最低 4 核 CPU、8GB 内存即可,跑edge字幕和 ffmpeg 渲染完全够用;显卡只在你想上whisper大模型时才有意义。
Q4:whisper模型下不下来?whisper模式要拉一个约 3GB 的模型,网络不通时手动下载模型目录,放到项目下的models/whisper-large-v3路径,程序会优先读本地文件。
Q5:没有 OpenAI 密钥能用吗?能。配置里支持g4f这类免费方案,也支持 Moonshot、DeepSeek 等国内可直连的提供商,详见 配置文件说明。更多报错可查 官方 FAQ。
写在最后
MoneyPrinterTurbo 的价值不在某一项单点能力,而在于把"文案—素材—配音—字幕—渲染"整条链路串成了可以重复执行的流程。想动手的话,从上面的 5 步开始即可,遇到问题优先查 README 和 官方文档。
【免费下载链接】MoneyPrinterTurbo利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.项目地址: https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考