跳过论文上传:Academic Figure Generator快捷生成模式与图生图二次编辑实战技巧
【免费下载链接】academic-figure-generatorAI 驱动的学术论文配图生成平台。上传论文 → AI 分析内容生成 Prompt → 一键生成高质量科研配图,还有配套的skill可在主流agent中使用项目地址: https://gitcode.com/gh_mirrors/ac/academic-figure-generator
Academic Figure Generator是一个 AI 驱动的学术论文配图生成平台,上传论文后 AI 自动分析内容、生成 Prompt,并一键生成高质量科研配图。而在完整流程之外,它还隐藏了两个效率神器:快捷生成模式(跳过论文上传,直接文字出图)和图生图二次编辑(对已有配图下达文字指令进行局部修改)。本文带你 10 分钟掌握这两大功能,让科研配图从"小时级"压缩到"分钟级" ⚡
两种模式怎么选?
先看标准工作流与快捷模式的差异:
| 维度 | 项目工作流 | 快捷生成模式 |
|---|---|---|
| 入口 | 项目空间(上传论文) | 独立"直接生成"页面 |
| 前置步骤 | 上传 PDF/DOCX/TXT → AI 解析 → 生成 Prompt | 无,直接输入描述 |
| 适用场景 | 完整论文配图规划 | 已有明确想法、快速出图、测试风格 |
| 速度 | 较长(含解析环节) | 极快,输入即生成 |
当你已经知道自己要画什么(比如照着某篇顶会论文的架构图思路画一张自己的版本),就不必走"上传论文 → 等待解析 → 审阅 Prompt"的完整链路,快捷生成模式正是为此设计的。
快捷生成:5 分钟出图的完整步骤
快捷生成页面的源码位于 frontend/src/pages/Generate.tsx,页面逻辑非常直白,按下面四步操作即可:
① 打开"直接生成"页面
启动平台后(后端http://localhost:8000,前端http://localhost:5173),在顶部导航进入"直接生成"路由(/generate),页面副标题写着:"跳过文档解析环节,直接输入您的需求即刻生成学术配图"。
② 填写配图描述
在"配图描述"文本框中写入想要生成的图。例如:
绘制一个基于 Transformer 的跨模态融合架构图,包含视觉编码器和文本编码器两个分支,中间层通过自注意力机制交互,最后输出分类结果……
③ 选择画幅比例
支持三档:16:9 宽屏、4:3 标准、1:1 方形。正文配图推荐 16:9,双栏跨栏大图可选 4:3。
④ 点击"生成配图",等待下载
点击按钮后,前端每 3 秒轮询一次生成状态(/images/{id}/status),状态变为completed后自动加载预览图,可一键"下载高清原图"。
🔍 后端细节:POST /images/generate-direct接口在 backend/app/api/v1/images.py 中实现。值得注意的是,如果你没有绑定具体项目,后端会自动创建或复用名为"直接生成"的默认项目来归档这些图片——也就是说快捷生成的结果不会丢失,稍后可以在项目列表中找回。
上图即为平台实际生成的 PMST 预测网络架构图,信息密度与分区布局都达到了顶会论文的呈现水准。
写好描述的 3 个技巧(决定成图质量)
快捷模式省掉了"AI 读论文写 Prompt"环节,描述质量就完全由你自己把控。参考平台配套的 Agent Skill(academic-figure-prompt/SKILL.md),一条高质量的学术配图描述应包含四层信息:
- 全局描述:图的类型(architecture / pipeline / module detail / comparison)+ 主题 + 整体布局方向(如 left-to-right 多阶段流水线);
- 分区细节:用
=== ENCODER ===这样的分区标签,逐区描述模块框、内部子结构、嵌入缩略图、公式与维度标注——每个模块框内都要有内容,不允许留白占位框; - 全局标注:箭头上的维度标注(如
R^(120×6))、反馈环路、图例位置; - 风格规格:填入具体色值。Skill 内置 8 套预设学术配色(Okabe-Ito 色盲友好标准、Teal+Amber 现代风、Minimal Grey 极简风等),直接抄色值最稳妥。
宁可描述过长过细,也不要简化省略——学术配图的价值在于精准传达复杂信息 📐
图生图二次编辑:不改描述,只改结果
第一次生成的图整体不错,但某个模块配色想换掉、想加一条反馈环路?不必重新生成整张图,直接用图生图编辑:
① 在项目空间找到最新生成的图片卡片
图片完成生成后,卡片底部会自动出现一个"输入改图需求..."的输入框(实现见 frontend/src/pages/ProjectWorkspace.tsx)。
② 输入文字指令,回车即提交
在输入框里写清楚修改点,按Enter或点击发送按钮。常见改图指令示例:
- "将整体配色换成深海军蓝 + 珊瑚橙,保持 IEEE 期刊风格"
- "在 Stage 2 和 Stage 4 之间增加一条虚线跳接箭头"
- "把右下角图例移到底部居中,字号缩小一号"
③ 等待新图生成,原图保留
后端接口POST /images/{id}/edit在 backend/app/api/v1/images.py 中实现:它以原图为参考图(可选再上传一张外部参考图),连同你的文字指令和原 Prompt 一起提交给 NanoBanana API,生成一张新的图片记录——原图不会被覆盖,可以无限次迭代编辑、随时回滚。
像上面这张时频域信号处理流程图,其细节(FFT 缩略图、维度标注、分区标签)正是反复迭代"生成 → 改图指令 → 再生成"打磨出来的典型产物。
进阶组合:Skill 生成描述 + 快捷模式出图
如果你不想手写描述,可以安装项目自带的 academic-figure-prompt Skill 到 Claude Code / Cursor 等 AI 编程助手中,让 Agent 帮你产出"四层结构"的超长英文描述,再粘贴到快捷生成页面一键出图。这样既跳过了论文上传,又保住了顶会级的提示词质量,是"懒人工作流"的最优解 ✨
常见问题与注意事项
- 生成是异步的:请求返回
202后即进入后台任务,页面自动轮询状态,无需刷新;失败时会展示具体错误原因,可修改描述重试。 - API Key 必填:出图依赖
NANOBANANA_API_KEY,未配置时接口会直接返回 400 提示,配置参考 README.md 中的"环境变量参考"一节。 - 图片落盘位置:所有生成图保存在
backend/data/目录下,按项目归档,元数据存于 SQLite(backend/data/app.db)。 - 比例与清晰度:快捷模式默认走高分辨率通道,项目工作流中还可在生成前指定
1K/2K/4K分辨率与配色方案。
总结
| 需求 | 推荐路径 |
|---|---|
| 整篇论文系统配图 | 项目工作流:上传论文 → AI 生成 Prompt |
| 已有清晰想法、快速出图 | 快捷生成模式(/generate) |
| 微调已生成图片 | 图生图二次编辑(图片卡片底部输入框) |
| 描述写不好 | 先用 Skill 生成详细英文描述,再粘贴出图 |
把"写完论文还要画图"的痛点,交给"上传 → 确认 → 下载"甚至"输入 → 生成"的两步流程——这就是 Academic Figure Generator 想给你的体验 🎯
【免费下载链接】academic-figure-generatorAI 驱动的学术论文配图生成平台。上传论文 → AI 分析内容生成 Prompt → 一键生成高质量科研配图,还有配套的skill可在主流agent中使用项目地址: https://gitcode.com/gh_mirrors/ac/academic-figure-generator
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考