给自己看的小说配插画:模板货架、改法与模型搭配
给小说配插画,难的从来不是「画一张好看的图」,是画出来的图和正文对不上。这篇按资源手册的写法整理 Foreverse 已上架的官方媒体模板:144 张场景模板合集加 4 张视频风格模板的关键条款节选、每张标注什么书适合、改模板时哪三处能动哪两处别碰,以及 Seedream、GPT Image、Nano Banana 三家生图模型各自配什么活(2026-07-18 对照官方文档核实)。

试过给自己在读的小说配图的人,大概都收获过同一种失望:划选一段雨夜巷战,点配图,出来一张构图居中、 皮肤发塑料光的通用美图——好看,但跟正文没关系。问题不在模型,在提示词的分工没拆开: 画什么,你的正文已经写好了;怎么画,才是需要你(或者模板)补的那一层。 这篇是媒体侧的资源手册,文字续写模板在姊妹篇,两边不重复。
一段正文是怎么变成插画提示词的?
在 Foreverse 阅读器里选中一段、点配图(多模态页有可交互的演示), 实际发给模型的请求分两层:场景层是你的选区正文, 提供主体、动作、环境和情节拍点;风格层是模板,钉死画风、光影、构图和禁止项。 生成前有费用确认,生成后插画直接嵌回选区所在的位置,长按可以保存、重画或删除。 不选模板时走内置的「场景画面提示词」默认档:它按图片和视频分轨,视频轨按运镜公式组织, 所以哪怕一个模板不装,选区配图也能用。模板解决的是下一个层次的问题:让全书的插画长成同一种风格。
官方模板货架上有什么?
Foreverse 上架到 App 内社区的 23 个官方提示词包里,媒体侧占 9 个:5 个场景模板合集共 144 张 (X 精选女主视觉 30 张、X 精选男主视觉 30 张、X 精选运镜友好视频 24 张、国乙男主视觉图片 30 张、国乙男主视觉视频 30 张), 加 4 张单张视频风格模板(人物特写微演技、古风氛围空镜、单拍动作场面、动漫番剧感)。 全部免费,带「官方」标签,条目页标了来源出处。另有「日系柔光厚涂」这类风格包装包,管统一画风。 挑的时候按书对号:
国乙男主两个包(图片走国乙卡面、韩漫、Live2D 质感,视频带呼吸感微动)给女频现偶和乙女向; X 精选男主包给男频都市。拿法很短:社区页筛「提示词模板」,下载导入, 再从阅读器配图召唤单的模板入口就能选到。
模板拿来之后,哪里能改、哪里别碰?
导入即归你,能改。安全的改位有三处:画风词(比如把「厚涂」换成「水彩」)、负面清单 (出图老带路灯就把 street lamp 加进 Negative)、构图指令(近景改远景)。 别碰的有两处:一是场景占位符 {{selected_text}} 这类花括号变量,App 靠它填入你的选区,删了模板就断了; 二是模板里的安全条款:禁真人肖像、禁品牌 logo、禁未成年形象那几行是每张官方模板的标配, 它们同时保护你的出图通过率和你自己。手抄到别的工具时,占位符要替换成你自己粘贴的正文。
哪个模型配哪种活?
官方媒体包的条目页都带一行「适配模型」提示,公开口径是:写实批量首选 Seedream, 速度快、批量便宜,但出图要检查有没有混入 logo 和文字杂物;GPT Image 家族禁词执行最可靠, 画面里要出现可读文字(招牌、书法)也是它最稳;Nano Banana 长在创意合成和参考图一致性。 我们在 2026 年 7 月 18 日对照过三家的公开文档:字节 Seed 团队的官方发布文写明推理速度比上代快十倍以上、2K 出图只要数秒、一次可接受十余张参考图;OpenAI 现役旗舰是 gpt-image-2,官方提示词指南建议画内文字用引号钉死、难词逐字母拼写;Google 的Nano Banana 文档明确 Pro 档支持 2K/4K 输出,并且提示词写成叙事描述比关键词堆砌效果好。这一条对配图场景是天然利好, 因为小说正文本来就是叙事描述。视频模板的适配面是可灵、Veo、通义万相、Vidu、Seedance, 动作拍失败率偏高,模板注明了建议用高档位模型。
模板管不了的一件事
风格模板能让一百张插画像同一个画师画的,做不到让同一个角色在一百张里长同一张脸。 脸的一致性要靠参考图,Foreverse 的做法是确认制:角色的参考图集只收你亲手确认的图, 生成产物不自动晋升,全部视觉输出对着同一套参考画。原理和实测数字在讲伴侣自拍的那篇里。 另一件模板不管的事是批量:给整章场景自动配背景是剧场模式的领域, 读完一章自动画好漫画是连载漫画册的领域,与单张配图是三条链。 这份手册收在这里:先用默认档跑通第一张,再从 144 张里挑三张试同一段正文, 风格差异会替你说明模板到底值不值得装。
常见问题
模板正文是英文的,中文小说能用吗?
能。模板只负责画风、构图、光影这一层,你的中文选区正文会原样填进模板的场景占位符,一起发给生图模型;主流生图模型对中文场景描述的理解可用。画风条款用英文,是因为这批模板整理自英文社区的高热提示词,条款本身不需要你读懂才能用。介意的话,日系柔光厚涂包的核心条款就是中文写的,可以从它入手。
不下载任何模板,选区配图能用吗?
能。召唤单里有内置的「场景画面提示词」默认档,按图片和视频分轨组织,不挑模板也能出图。模板是升级选项:默认档管「把这段画出来」,模板管「画成什么风格」——同一段正文,套电影感人像模板和套古风空镜模板出来是两张完全不同的图。
一张插画要花多少钱?
取决于你配置的图像模型。BYOK 模式按你供应商的牌价直连计费,应用不加价;官方渠道按量扣积分。每次生成前有确认步骤,生成后模型、费用、耗时都记进 API 请求记录,可以逐笔核对。想控制成本,可以给图片单独设一个便宜的默认模型,文字续写和配图各走各的。
怎么让同一个角色每张图长得一样?
别指望提示词。文字描述能收敛画风,收敛不了具体的脸,这是当前生图模型的共同边界。可靠的做法是给角色建参考图:Foreverse 里角色的参考图集只收你手动确认过的图,生成产物不会自动混进去,后续的插画、自拍、时刻卡都对着同一套参考图画。细节在讲脸部一致性的那篇里。
有想法或问题?来 Discord 聊聊 →