PaperBanana: The AI Expert for Automating Academic Illustration

简介
Paper Banana 是一个面向科研人员的 AI 学术插图生成工具,源自 Google 与北京大学合作的开源项目 PaperVizAgent。用户输入研究方法描述和图注说明,系统通过检索参考图例、规划内容与风格、渲染图像并进行自评迭代的多个专门智能体协作,生成可直接用于论文的方法示意图和统计图表。
主要功能
- 方法图生成:根据论文方法部分的文字描述自动绘制流程图、架构图和示意图,用于展示模型结构或实验流程。
- 统计图绘制:将数据和分析结果转化为符合学术出版习惯的统计图表。
- 参考驱动风格控制:检索已有高质量论文插图作为参考样例,通过上下文学习匹配学术界的常见绘图风格。
- 迭代自评优化:由评审类智能体对生成结果进行语义准确性和视觉质量检查,多轮修正后输出成品。
特色优势
项目完全开源(PaperBananaBench 基准基于 NeurIPS 2025 论文构建),作者明确声明不用于商业目的。相比通用图像生成模型,它针对学术插图场景做了专门优化,输出内容更贴合论文的语义要求,减少研究者手工绘图和反复调图的时间。
适用人群
需要为论文、会议海报、答辩幻灯片或教学材料制作插图,但缺乏设计经验或不擅长绘图软件的研究人员、研究生和高校教师,尤其是人工智能与计算机领域的作者。


