Podcastfy:如何 3 步把文章和图片变成双人对话播客
【免费下载链接】podcastfyAn Open Source Python alternative to NotebookLM's podcast feature: Transforming Multimodal Content into Captivating Multilingual Audio Conversations with GenAI项目地址: https://gitcode.com/GitHub_Trending/po/podcastfy
Podcastfy 是一个开源 Python 工具,能把网页、PDF、图片甚至 YouTube 视频,变成两个人聊天的多语言播客音频。它的最大亮点,是 NotebookLM 播客功能的免费开源平替:代码完全在你手里,风格、语言、声音都能自己定。
🎙️ 先认识它:内容喂进去,播客播出来
先说你能得到什么:你给它资料,它还你一期播客。
- 输入很杂:链接、PDF、纯文本、图片都行。它自动读懂内容,写成对话稿,再合成语音,全程不用你动笔。
- 和闭源工具不同:NotebookLM 这类工具只能点点按钮;Podcastfy 是代码库,你能在 Python 里调用它、批量跑任务、把播客接进自己的网站或工作流。
- 图片也能"说话":丢进两幅画,它会生成一期讲解这两幅画的对话播客,见下图这张项目示例输入图。
🔊 最快上手:4 步用 Podcastfy 生成第一集
目标很直接:十几分钟后,你手里多出一个 MP3。
第 1 步:准备环境
确认电脑有 Python 3.11 以上版本,以及 ffmpeg(处理音频的命令行工具,可随 pip 安装)。
第 2 步:一条命令安装
pip install podcastfy第 3 步:填好 API key
打开项目自带的 config.yaml,填入你常用大模型的 API key(比如 OpenAI)。声音引擎默认用 OpenAI,也可以换 Gemini 多说话人、ElevenLabs,或完全免费的 Edge 引擎。
第 4 步:生成第一集
在 Python 里这样调用:
from podcastfy.client import generate_podcast audio = generate_podcast(urls=["网页链接1", "网页链接2"])不想写代码也行,命令行一条指令搞定:
python -m podcastfy.client --url 链接1 --url 链接2跑完后,两个 AI 主持人就开始对着你的内容聊天了。
✨ 最值得上手的 4 类场景
- 内容创作者:一份内容,两种消费方式。把博客和长文转成播客,触达那些爱听不爱读的听众。
- 教育工作者:把讲义、课件变成对话音频,学生通勤路上就能"听课",对阅读有障碍的学生尤其友好。
- 研究人员:把论文和图表讲成对话,帮更广泛的听众听懂复杂内容,也能顺手产出工作的音频摘要。
- 无障碍需求:视觉障碍或阅读困难的人,从此多了一条"听"的通道。
🚀 进阶玩法:Podcastfy 的本地模型、Docker API 与生态
想把它变成生产力工具时,这几样值得解锁:
| 玩法 | 你能得到什么 |
|---|---|
| 本地大模型 | 接入 156+ 个开源模型,内容不出内网,隐私可控 |
| 长/短播客 | 2~5 分钟短片,或 30 分钟以上长播客,都能生成 |
| Docker API | 用 Dockerfile_api 打包成服务,你的网页就能调它生成播客 |
| 周边生态 | OpenNotebook、SurfSense、OpenPod、Podcast-llm 等项目已把它集成进自己的产品 |
现在就去终端里跑通你的第一集,剩下的交给好奇心。
【免费下载链接】podcastfyAn Open Source Python alternative to NotebookLM's podcast feature: Transforming Multimodal Content into Captivating Multilingual Audio Conversations with GenAI项目地址: https://gitcode.com/GitHub_Trending/po/podcastfy
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考