参考图和文字提示词,到底谁负责什么?AI 漫画别再写反了
分清参考图与文字提示词的职责:用资产锁定视觉身份,用正文控制关系、动作、场景和故事结果。
一句话回答
在 AI 漫画中,参考图更适合约束角色脸、发型、体型、服装轮廓和关键道具外观;文字提示词更适合描述当前身份、关系、动作、场景、情绪和故事结果。两者冲突时会增加漂移风险。不要用长篇文字重新发明已经由参考图确定的外观,也不要期待一张参考图自动说明剧情。
| 方法速查 | |
|---|---|
| 核心问题 | 你上传了角色图,却又在文字里写了另一种发色和服装;或者只给一张漂亮参考图,就期待系统自动理解完整剧情 |
| 写作公式 | 参考图锁定“长什么样” + 文字控制“现在是谁、在哪里、做什么、结果如何” |
| 先做什么 | 脸、发型、身体比例和稳定标记不需要每次重新发明。 |
| 生成前检查 | 参考图只承担稳定视觉信息 |
产品实操
不要让系统猜,把参考和剧情要求明确绑定
先选择真实资产,再写场景任务。引用负责外观,正文负责这一幕如何发生。

选择需要的资产
只带入当前场景真正会出现的角色或道具,减少无关信息对构图的干扰。
写清可见动作
不要只写抽象情绪或关系,说明人物能被画出来的动作、距离和反应。
指定结果画面
告诉系统最后必须保留的表情、物件、信息或悬念,再开始生成。
你上传了角色图,却又在文字里写了另一种发色和服装;或者只给一张漂亮参考图,就期待系统自动理解完整剧情。很多人遇到这种结果后,会继续往提示词里堆画质词、镜头词和外貌描述。文字变长了,真正需要解决的关系却仍然没有写清。
在 AI 漫画中,参考图更适合约束角色脸、发型、体型、服装轮廓和关键道具外观;文字提示词更适合描述当前身份、关系、动作、场景、情绪和故事结果。两者冲突时会增加漂移风险。不要用长篇文字重新发明已经由参考图确定的外观,也不要期待一张参考图自动说明剧情。
先记住这条公式
参考图锁定“长什么样” + 文字控制“现在是谁、在哪里、做什么、结果如何”
这条公式的重点不是让提示词更专业,而是让每句话都有明确工作:参考信息负责锁定,动作信息负责表演,结果信息负责收束。系统不必在多个可能答案之间猜测,创作者也更容易判断下一次应该改哪里。
为什么常见写法容易失败?
信息很多,但关系不清楚:
参考图里是黑色短发和白色夹克。文字:她拥有金色长发,穿红色长裙,在办公室保持参考图一致。
改成可以直接被画出来的指令:
沿用 @苏禾 的脸、黑色短发和白色夹克。她此刻是夜班咖啡师,在关店后的办公室发现一封没有署名的辞职信,并立刻锁上门。
两段文字的区别不在长度。后一段明确了主语、动作、对象、状态变化和视觉结果。它让人物不再只是“出现在画面里”,而是开始承担故事任务。
1. 把永久身份交给参考图
脸、发型、身体比例和稳定标记不需要每次重新发明。
保存标准角色资产后,创作时直接点选。重复手写很容易出现细小冲突,也增加后续维护成本。
2. 把当前任务交给文字
参考图不会自动告诉系统角色在这部故事里要做什么。
当前身份、人物关系、动作目标、压力和结尾结果,都需要在正文中明确。
3. 冲突时先决定谁是准绳
不要同时要求互相矛盾的发色、服装和年龄。
如果确实要换造型,应选择对应造型参考或明确这是一次有原因的变化,而不是让系统同时满足两个版本。
4. 场景参考不能替代角色参考
构图、环境与角色身份是不同控制维度。
一张场景图可以帮助说明空间,但不能自动锁定角色脸。重要人物仍应使用自己的资产引用。
把这套方法放进 StarVeil AI
- 先处理稳定外观。需要重复出演的角色或关键道具,先保存为资产;不要在每次创作时重新发明一套描述。
- 输入 @ 并从菜单点选。只有被点选后显示为标签的角色或道具,才真正带入对应参考。直接输入同名文字不等于完成引用。
- 再写当前场景任务。参考负责外观,正文负责身份、关系、动作、状态变化和结尾结果。不要让两层信息互相冲突。
- 生成后按目标检查。先检查本篇强调的核心问题,再检查角色、文字和连续性;重要偏差修复后再继续下一幕。
这套顺序的好处,是把问题放回正确的位置。脸和服装不对,回到角色资产;物件轮廓不对,检查道具引用;动作、关系或故事重点不对,修改场景正文。你不必每次推翻全部输入。
短篇、小故事和连载应该怎么调整?
| 形式 | 写作重点 | 控制范围 |
|---|---|---|
| 短篇漫画 | 一个情境、一个主要动作、一个反应或包袱 | 删除不影响当前成品图的背景与支线 |
| 小故事 | 4–6 个相连时刻,每张卡只完成一次变化 | 角色最多 3 个,保持贯穿卡片的状态与道具 |
| 连载漫画 | 当前一幕推进一个新结果,并留下下一问题 | 继承上一幕已经发生的服装、伤势、关系和物件后果 |
不要因为系统允许更多角色或道具,就把选择上限全部用满。短篇和连载虽然最多可选 8 个角色、一次最多带入 4 个道具参考,但单个画面的清晰度通常来自更少、更明确的任务。
生成前检查清单
- ☐ 参考图只承担稳定视觉信息
- ☐ 正文没有与参考图冲突的外貌要求
- ☐ 当前身份与动作已用文字说明
- ☐ 角色和场景参考没有混为一谈
- ☐ 输入框中能看到真实资产标签
如果其中一项无法回答,不要急着生成。先补上缺失的关系或结果,通常比增加“高清、精致、电影感”等形容词更有效。
什么时候应该停下来重写?
当你需要用三句话解释“模型应该懂我的意思”时,正文通常还没有把画面任务写清。把解释改成一个可见动作、一处状态变化或一张结尾画面;如果是角色或道具外观问题,则回到资产引用检查,而不是继续重写剧情。
完整的角色与道具引用方法见角色和道具引用实操教程。接下来可以阅读角色参考图完整检查清单,把这套方法带进更长的创作流程。