今天给大家演示一个家庭教育短视频内容自动生成 Coze 工作流。这个工作流融合了大语言模型、文本分镜设计、语音合成和时间线编排等环节,从输入书籍标题到生成完整的口播音频,实现了自动化的内容生产。通过该流程,用户能够直观体验到如何将家庭教育类书籍内容快速转化为适合短视频传播的脚本与配音,极大提升内容创作效率。
文章目录
- 工作流介绍
- 核心模型
- Node节点
- 工作流程
- 大模型应用
- 生成视频前置结构节点
- 口播稿生成节点
- 文案分割节点
- 文本分镜设计节点
- 文本关键词挖掘节点
- 使用方法
- 应用场景
- 开发与应用
工作流介绍
本工作流的核心在于利用大语言模型生成内容,再结合文本分段、语音合成和音频时间线处理,实现完整的短视频文案到口播音频的流水线式生产。其优势在于多节点的协作:从内容生成、分割、再到音频处理,每一步都实现了自动化和标准化,最终输出可直接应用于短视频制作。
核心模型
工作流中大模型的应用范围覆盖了文案生成、口播稿编写、分段处理、分镜脚本设计与关键词提取等多个阶段。通过不同模型的组合,确保生成内容既有创意又符合短视频传播的语言风格。
| 模型名称 | 说明 |
|---|---|
| 通义千问·Max | 用于生成前置结构与故事要点,提炼书籍卖点与痛点 |
| DeepSeek-R1 | 用于生成口播稿与文案分割,保证文风生动自然 |
| 豆包·1.6·深度思考·多模态 | 用于分镜设计,输出符合拍摄节奏的分镜脚本 |
| 豆包·1.5·Pro·32k | 用于文本关键词提取,提升字幕与信息浓度 |