让 AI 在对话中连续画图(Flow2API MCP)
为解决对话中难以连续修图的问题,我将 Flow2API 封装为 MCP 工具并加上本地缓存。这让 Agent 能在对话里直接引用历史图片,实现多轮连续画图与微调。
- MCP
- Flow2API
- 图像生成
- 本地缓存
从单次文生图到连续对话修改
直接使用 AI 画图 API 时,最直接的痛点是无法在对话中连续修改:文生图容易,但想让 Agent 把刚生成的图“改为水墨风格”、或者“引用几轮前上传的参考图微调”时,Agent 无法直接获取已生成的图片状态。
为了解决连续修改和回看历史的问题,我把 Flow2API 的生成接口与本地图片缓存封装成了一套 MCP 服务。
本地缓存与 MCP 工具
图生图需要将图片传回给模型。如果让 Agent 反复上传图片不仅麻烦,不同客户端对附件的处理也不一致。
我的做法是:
- 服务运行在本地,自动保存生成的图片历史;
- 封装
generate(生成)、history(历史追溯)与cache(本地缓存)三类 MCP 工具; - 在 Cherry Studio 等客户端中,Agent 可以自发读取本地缓存目录中的图片,从而在对话里直接执行“基于上一张图修改”或“引用历史效果微调”的操作。
开源仓库与适用限制
项目已在 GitHub 开源:
目前工具主要在 Cherry Studio 中进行了完整测试。由于不同 LLM 对工具说明的理解存在差异,有时需要搭配系统提示词;若需要远程部署,则需要将本地文件读取修改为可访问的图片 URL 链接。