Text-To-Video-AI .env 配置全解析:一文读懂全部 API Key 与参数设置
2026/9/6 11:00:14 网站建设 项目流程

Text-To-Video-AI .env 配置全解析:一文读懂全部 API Key 与参数设置

【免费下载链接】Text-To-Video-AIGenerate video from text using AI项目地址: https://gitcode.com/gh_mirrors/te/Text-To-Video-AI

Text-To-Video-AI 是一个开源的 AI 视频生成工具,输入一段文字描述,它就能自动完成脚本撰写、语音配音、字幕生成、背景音乐与画面合成。而Text-To-Video-AI .env 配置就是整个流程的"总控制台":所有 API Key、模型选择与画面参数都在这里设置。如果你刚接触这个项目,最容易被.env里一大串变量搞晕。本文一次讲清每个变量的作用与配置方法,帮你快速跑通第一条 AI 生成的视频。

为什么 .env 是 Text-To-Video-AI 的配置核心

项目启动时会通过 utility/config.py 自动加载根目录下的.env文件,并做一次全量配置校验:哪个 API Key 缺失、哪个参数写错了,都会在启动时直接报错,而不是等你生成到一半才失败。

git clone https://gitcode.com/gh_mirrors/te/Text-To-Video-AI cd Text-To-Video-AI pip install -r requirements.txt cp .env.example .env

复制 .env.example 为.env后,按下面的分组逐项填写即可。

必备 API Key:Pexels 与 Muapi 二选一

这是唯一强制要求的配置项。后台视频素材来自 Pexels 素材库,AI 生成的 B-roll 则走 Muapi 服务,两个至少要填一个:

PEXELS_API_KEY=你的Pexels密钥 MUAPI_API_KEY=你的Muapi密钥

其中PEXELS_API_KEY决定能否使用免费素材库的 B-roll 画面;如果只填MUAPI_API_KEY,则走 AI 文生视频(见下文 Muapi 章节)。校验逻辑位于 utility/config.py:两者都为空时会直接终止程序。

LLM_PROVIDER 三选一:OpenAI / Groq / Gemini 模型配置

LLM_PROVIDER决定由哪个大模型来写视频脚本,支持openaigroqgemini三种:

LLM_PROVIDER=openai OPENAI_API_KEY=你的OpenAI密钥 OPENAI_MODEL=gpt-4o

选 Groq 或 Gemini 时,把对应的GROQ_API_KEY/GROQ_MODEL(默认llama3-70b-8192)或GEMINI_API_KEY/GEMINI_MODEL(默认gemini-2.5-flash)填上即可。注意:一旦选定 provider,对应的 API Key 与模型名缺一不可,这是新手最容易踩的坑。

配音与字幕识别的 API Key 配置

TTS_PROVIDER:免费 EdgeTTS 与高级 ElevenLabs

语音配音支持edgetts(免费)和elevenlabs(需付费密钥)两种:

TTS_PROVIDER=edgetts EDGETTS_VOICE=en-AU-WilliamNeural

EdgeTTS 无需密钥,只需指定音色,例如en-US-JennyNeural(美音女声)、en-GB-RyanNeural(英音男声)。切换到 ElevenLabs 则必须填ELEVENLABS_API_KEYELEVENLABS_VOICE_ID,示例音色 ID 可直接参考 .env.example 中的注释。

STT_PROVIDER:Whisper 本地识别与 Deepgram 精准字幕

字幕时间轴由语音识别生成,whisper免费本地运行,deepgram云端识别更精准:

STT_PROVIDER=whisper DEEPGRAM_API_KEY=你的Deepgram密钥 # 仅使用 deepgram 时需要

视频画面参数:横竖屏快速切换

VIDEO_ORIENTATION控制输出画幅:portrait输出 1080x1920 竖屏,适合抖音、快手、YouTube Shorts、Instagram Reels;landscape输出 1920x1080 横屏,适合传统视频平台:

VIDEO_ORIENTATION=portrait

字幕样式参数:字体、颜色、位置自由定制

这组参数让你的字幕既醒目又不抢戏,默认值开箱即用:

CAPTIONS_ENABLED=true CAPTION_FONT_SIZE=100 CAPTION_FONT_COLOR=white CAPTION_FONT_FACE=Arial-Bold CAPTION_STROKE_WIDTH=3 CAPTION_STROKE_COLOR=black CAPTION_POSITION=bottom_center

CAPTION_POSITION支持centertopbottombottom_centerbottom_leftbottom_right六种位置;颜色可选whiteyellowcyanredgreenbluemagenta。想要"爆款短视频"的综艺感字幕,把字号调大、描边加粗即可。

Muapi 视频模型参数:从 Veo 到 Sora 一键切换

填好MUAPI_API_KEY后,还可以用MUAPI_VIDEO_MODEL切换底层 AI 视频模型,覆盖当下主流大厂模型:

MUAPI_BASE_URL=https://api.muapi.ai MUAPI_API_KEY=你的Muapi密钥 MUAPI_VIDEO_MODEL=veo3-fast-text-to-video

支持的模型包括 Google Veo(veo3-fast-text-to-video等)、xAI Grok(grok-imagine-text-to-video)、字节 Seedance(sd-2-t2v)、Wan(wan2.7-text-to-video)、Kling(kling-v3.0-pro-text-to-video)、Vidu、OpenAI Sora(openai-sora-2-pro-text-to-video)、MiniMax Hailuo 等十余个,完整清单见 .env.example。调用逻辑封装在 utility/muapi_client.py 中,换模型只需改一行配置。

渲染引擎参数:MoviePy 与 Remotion 主题选择

最后两个参数决定成片的"包装"方式:

RENDER_ENGINE=remotion REMOTION_THEME=flat-motion-graphics

RENDER_ENGINE可选moviepy(传统快速合成)或remotion(React 合成,画面更精致);使用 Remotion 时REMOTION_THEME提供clean-professionalflat-motion-graphicsminimalist-diagramanime-ghibli四种风格主题,切换逻辑见 utility/render/render_engine.py 与 utility/render/remotion_renderer.py。

常见配置报错与排查方法

启动时报Configuration validation failed时,错误信息会逐条列出问题,最常见的三种:

  • Missing required API key:对应服务的密钥没填,补上即可;
  • Invalid LLM_PROVIDER:只接受openai/groq/gemini,注意拼写;
  • Invalid VIDEO_ORIENTATION:只接受portrait/landscape

全部参数检查通过后,运行python app.py "你的视频主题"即可开始生成,输出文件为rendered_video.mp4。建议对照 .env.example 逐项核对,一次配置好,后面就能反复出片了。

【免费下载链接】Text-To-Video-AIGenerate video from text using AI项目地址: https://gitcode.com/gh_mirrors/te/Text-To-Video-AI

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询