Comic Builder · AI Science-Popularization Comic Generator
把"量子纠缠/相对论/进化论"一句话变成 6 格可阅读的科普漫画
Comic Builder 是一款把"一句话主题"工业化生产为多格科普漫画的 AI 工具。基于 baoyu-comic 技能构建:先用 LLM 把需求解析为内容分析 + 6 段分镜脚本,再为每格生成图像 Prompt,逐格调用图像生成 API,最后把所有分镜拼合成一张完整漫画。整套生成进度通过 SSE 实时回推到前端,6 格典型任务 1-3 分钟内可出图。适合把抽象的科学/工程/商业概念,转成可发版的视觉内容。
Comic Builder 聚焦「6 格视觉科普漫画」;yanxuan-story 聚焦「9 步短篇故事」;novel-writing 聚焦「30 步长篇创作」——三者构成"长文 → 短文 → 视觉"的内容工业化矩阵。


把"生成漫画"拆成可独立观察、可独立重跑、可独立排错的 9 个工程步骤,让"一句话出漫画"不是黑盒。
拿到需求后第一步不是出图,而是先让 LLM 提炼主题、知识点结构、概念关系、叙事节奏——内容分析合格后才进入分镜,避免"画完再改设定"的工程浪费。
分镜脚本只描述"这一格讲什么/谁在做什么/镜头/对白",图像 Prompt 由独立的 prompt 生成器根据分镜 + 角色 + 画风统一派生——分镜可读、Prompt 可复刻、风格可统一。
按 1→6 逐格调用图像生成 API,每格完成后立即回推到前端做"已完成第 N 格(1XXX KB)"展示,任一格失败可单独重跑,不必从头再来。
所有分镜生成完成后由 PIL 自动拼合为一张完整漫画,统一字号、统一分镜边框、统一画风——6 格交付物就是一张可发布的 PNG/JPG,不再依赖外部排版。
把"专业知识"翻译成"大众能看懂的视觉内容"长期面临 6 大共性痛点,每一条都会拉低传播与转化。
传统科普文章动辄 3000-5000 字,对大众不友好;短视频虽短但信息密度低、复看成本高;漫画是公认的最佳折中却难批量生产。
找插画师出 6 格漫画需 1-2 周/单稿、千元以上报价;改稿沟通成本高、画风难统一,多主题连载几乎不可能。
直接用通用图像模型出漫画,角色每格长相/服装/姿态漂移、对白与画面错位、画风不一致,成品难以发版。
同一角色在 6 格中要保持形象/服装/道具一致(XiaoAi + 戴怀表的橘猫 Guangsu),通用模型做不到逐格保真,只能单格凑合。
一次出 6 格常需 1-3 分钟,用户看不到进度、不知道卡哪一格、不能单独重跑——"点一下等 3 分钟"体验差、不敢重试。
生成单格后还要手工拼合、调整字号边距统一分镜边框,1-2 小时后期工程;批量生产时这一步就是最大瓶颈。
从「一句话需求」到「6 格可发版漫画」,全链路 9 个步骤每步独立运行、独立可观测、可单独重跑。
支持任意 OpenAI 兼容的 LLM + 图像生成 API(默认 agnes-ai agnes-2.5-pro + agnes-image-2.1-flash),Key 留在浏览器本地不落盘,换模型只改 Base。
「把《量子纠缠》做成 6 格科普漫画。角色:14 岁初中女生 + 戴怀表的橘猫。画风:清新」。需求越具体生成越稳,支持「要素」+「要求」两段式提示。
默认 6 格适合科普/概念讲解;可调 2/4/8/12 格适配不同主题与平台调性,格数与排版自动适配。
内置多种画风枚举(ligne-claire 干净线条、童书风、扁平插画、复古水彩等),按主题选画风,避免每格风格漂移。
LLM 先输出「内容分析」(主题拆解 + 知识点列表 + 角色清单 + 叙事弧线),再拆为 N 段「分镜脚本」(每格画面/对白/镜头),结构化后再走 Prompt。
按分镜 + 角色档案 + 画风自动派生 6 个高质量图像 Prompt(包含角色外观一致性约束 + 画风关键词 + 镜头语言),可单独复制到任意图像模型验证。
6 格按 1→N 顺序逐格调用图像 API,每格完成后通过 SSE 推送「增量第 N 格完成(XXX KB)」到前端;任一格失败可单独重跑该格。
全部单格生成完成后由 PIL 自动拼合为 1 张完整漫画,统一字号、统一分镜边框、统一画风;产物直接可发版、可下载、可二次编辑。
内置「相对论核心概念 / 量子纠缠入门 / 进化论简史」等 3 个快捷示例,一键填充「漫画需求」即跑即出图,降低首次使用门槛。
从「一句话需求」到「6 格完整漫画」的 9 步全链路工程流程:每步独立提示词/独立日志/独立可重跑。
把"AI 出漫画"从一次性 Demo 升级为可工程化、可复用的视觉科普生产线。
难度不在"单格出图",而在于把"内容→分镜→Prompt→增量生成→拼合"串成可观测、可重跑、可统一风格的工业化流水线。
「分镜脚本」只描述"这格讲什么/谁在做什么/对白",图像 Prompt 由独立生成器按分镜派生——分镜可读、Prompt 可复刻、画风可统一,避免通用模型的"AI 味"与对白错位。
6 格按 1→N 逐格生成,每格独立回推「增量第 N 格完成(XXX KB)」到前端;任一格失败可单独重跑该格(不必全量重试),生成过程完全可观测。
从需求中提取「角色档案」(XiaoAi + Guangsu 等)与「画风」(ligne-claire 等)作为统一约束注入每个 Prompt,让同一角色在 6 格中保持形象一致——解决通用模型角色漂移痛点。
PIL 自动按统一画布/字号/分镜边框拼合为 1 张完整漫画,产物保存到 outputs/<task_id>/,可下载、可二次编辑——把"AI 出的 6 张图"升级为"可发版的 1 张漫画"。
把技术能力转化为可量化、可复用的业务价值。
该产品的介绍内容已基于内部资料整理上线,以下为后续可继续深化的方向:
浏览贤码智能在其他领域的 AI 产品与解决方案