复杂提示结构和顺序:
- 字符计数 (1girl, 2girls),角色名称(如果是现有角色,如初音未来)
- 描述输出的自然语言,句子之间用句号分隔
- 标签列表
- 最后的质量标签(通常只是“杰作”)
简单提示示例:
1girl, hatsune miku, angel, masterpiece, general
结果: 基本,但富有创意的解读
复杂/上采样提示(使用 TIPO):
1girl, hatsune miku.
一幅描绘长白发和翅膀的女孩的插图。她穿着带红色蝴蝶结的校服,耳朵上戴着一副耳机。翅膀在她身后展开,营造出一种运动和活力的感觉。插图的整体风格受动漫启发。
solo, skirt, feathered wings, necktie, smile, very long hair, collared shirt, long hair, headset, blue eyes, aqua necktie, looking at viewer, black footwear, black skirt, twintails, grey shirt, bare shoulders, detached sleeves, full body, zettai ryouiki, closed mouth, miniskirt, sleeveless, boots, thighhighs, shirt, standing, wing collar, aqua hair, sleeveless shirt, pleated skirt, angel wings, absurdly long hair, wings, black thighhighs,
masterpiece, general.
结果: 更详细、一致的结果,特定元素(翅膀、校服细节等)被更精确地呈现
带有这个负面提示:
worst quality, comic, multiple views, bad quality, low quality, lowres, displeasing, very displeasing, bad anatomy, bad hands, scan artifacts, monochrome, greyscale, twitter username, jpeg artifacts, 2koma, 4koma, guro, extra digits, fewer digits, jaggy lines, unclear
更新 11/2:在提示的开头(或许是结尾!)的潜在助手!
(masterwork, x, y, z, masterpiece, best quality, hyper-detailed, 8k uhd::1.4),
x = 图像类型,即草图、照片、肖像、漫画页等。
y = 角色名称
z = 艺术家(如果指定)
(后面跟着角色计数(1girl, 2girls),角色描述,地点,动作,其他细节)
示例:
(masterwork, portrait, princess midna, fan no hitori, award-winning, masterpiece, best quality, hyper-detailed, 8k uhd::1.4), 1girl, large breasts, blue eyes, skinny, slim, sexy, gaunt, smile, blue textured bodysuit, cleavage, fur trim, outdoors, castle, looking at viewer, anime coloring, shiny skin,Cinematic Light,
负面提示:lowres, worst quality, bad quality, bad anatomy, sketch, jpeg artifacts, signature, watermark, artist name, old, oldest
步骤:26, baseModel: SDXL, 数量:4, 宽度:832, 高度:1216, 种子:2455922073, 草稿:false, nsfw:true, 工作流:txt2img, Clip skip:2, CFG scale:6, 采样器:Euler a, fluxMode:undefined
最近我一直在玩这个,想分享一些我学到的东西。
概述
我的测试揭示了与其他模型类型(如Pony)之间的几个关键差异:
- 文本生成通常更干净
- 背景显示更好的连贯性
- 概念识别 = 意外强大
- 水印显著减少
- 重要的是,负面提示往往表现更好
- 此外,我可以确认,正如其他人发现的那样,风格和角色训练似乎产生更可靠的结果
主观上,我发现我更喜欢这个模型生成的图像,而不是像Pony那样的东西。此外,我发现它更容易使用,并能快速获得更好的图像。
最佳设置
基于测试和官方文档:
- CFG范围:4.5-7.5(最佳范围在5.5左右)
- 推荐采样器:Euler A
- 步骤:20+(推荐24)
有效的提示结构
正如我上面提到的,你确实需要比大多数其他模型更仔细地调整提示,至少在这个时间点(Illustrious XL v0.1)。因此,你需要在正面提示中包含质量标签,并且需要一个相当全面的负面提示才能使其良好工作。
提示结构
核心结构
- 角色计数(1girl, 2girls等)
- 角色名称(如果有)
- 质量标签
- 身体特征和服装
- 姿势和解剖细节
- 环境/背景
- 附加质量/风格标签
根据论文,他们的实际示例质量标签要简单得多:
- “杰作”
- “一般”(作为 可选 的安全工作图像评分标签)
- “超高分辨率”
- “最新”
从技术上讲,根据Illustrious论文,这些就是你生成良好图像所需的全部。我在自己的测试中也证实了这一点。
然而,我发现这些提示标签与上述标签结合使用时,可以产生相当一致的结果:
完美质量,最佳质量,绝对引人注目,
以及更现实/详细的图像:
完美质量,最佳质量,绝对引人注目,环境光遮蔽,光线追踪,
- 环境光遮蔽/光线追踪特别有助于2.5D/半现实风格
负面提示
经过大量实验,我发现这个组合在平均情况下几乎每次都能获得最佳效果:
lowres, (bad), bad anatomy, bad hands, extra digits, multiple views,fewer, extra, missing, text, error, worst quality, jpeg artifacts, low quality, watermark, unfinished, displeasing, oldest, early,chromatic aberration, signature,artistic error, username, scan
或作为更简短的替代:
lowres, worst quality, bad quality, bad anatomy, sketch, jpeg artifacts, signature, watermark, artist name, old, oldest
完整提示示例/生成数据
以下是几个示例,展示我90%的提示是如何构成的:
1girl, felici4, anatomically correct, proper proportions,
long white hair, large breasts, domino mask, black lips, athletic build,
well-defined standing pose, dynamic pose,
detailed urban environment, night scene, city lights,
glowing blonde hair, blue eyes, looking at viewer, shining skin,
from below angle, professional lighting,
masterpiece, best quality, absurdres, newest
-or-
完美质量,高质量,杰作,绝对引人注目,环境光遮蔽,光线追踪,felici4, 1girl, 长发, 白发, 大胸部, (面具), 多米诺面具, 蓝眼睛, 黑色嘴唇, 瘦, 发光的金色头发, 彩虹内发, 看着观众, 闪亮的光滑肌肤, 完美的大胸部, (鸡皮疙瘩:1.1), solo, 过多的汗水, ((从下方))
lowres, (bad), bad anatomy, bad hands, extra digits, multiple views,fewer, extra, missing, error, worst quality, jpeg artifacts, low quality, watermark, unfinished, displeasing, oldest, early,chromatic aberration, signature,artistic error, username, scan
步骤:24, baseModel: SDXL, 数量:4, 宽度:832, 高度:1216, 种子:1934634232, 草稿:false, nsfw:true, 工作流:txt2img, Clip skip:2, CFG scale:5.5, 采样器:Euler a,
1girl, ashley_grah4m, anatomically correct, proper proportions,
neon lighting, glowing blonde hair, rainbow inner hair, blue eyes,
well-defined pose, standing pose, balanced pose,
detailed environment, professional lighting, clear composition,
looking at viewer, seductive expression,
masterpiece, best quality, absurdres, newest
-or-
杰作,最佳质量,ashley_grah4m, 1girl, neon, 发光的金色头发, 彩虹内发, 蓝眼睛, 看着观众, 诱人的表情
lowres, (bad), bad anatomy, bad hands, extra digits, multiple views,fewer, extra, missing, text, error, worst quality, jpeg artifacts, low quality, watermark, unfinished, displeasing, oldest, early,chromatic aberration, signature,artistic error, username, scan
步骤:24, baseModel: SDXL, 数量:4, 宽度:832, 高度:1216, 种子:1115576560, 草稿:false, nsfw:true, 工作流:txt2img, Clip skip:2, CFG scale:5.5, 采样器:Euler a,
创建有效的背景
根据论文发现和测试,背景需要特别关注:
背景提示的结构:
- 环境基础:
详细环境,[地点类型], 清晰的构图
- 建筑元素:
[材料类型], [结构元素], [装饰元素]
- 照明和气氛:
[时间], [照明类型], [气氛效果]
背景组合示例:
室内场景:
奢华的房间,详细的建筑,大理石地板,华丽的家具,
水晶吊灯,高大的窗户,装饰性柱子,
温暖的环境光,柔和的阴影,体积光
户外城市:
详细的城市景观,现代建筑,玻璃建筑,
城市街道,城市细节,商店前面,
夜景,霓虹灯,街灯,环境光遮蔽
自然环境:
详细的风景,起伏的山丘,茂密的森林,
岩石突起,流动的水,详细的植物,
黄金时段的光线,气氛雾霭,动态云彩
完整示例:
1girl, sprThja, anatomically correct, proper proportions, full body, toned figure, large breasts, black hair, long flowing hair, rabbit ears, dark alluring eyes, confident smile, standing pose, well-defined pose, balanced pose, looking at viewer, purple leotard, deep cleavage, purple leggings, purple gloves, yellow cape, detached collar, luxurious detailed room, marble floor, ornate furniture, detailed architecture, night scene, professional lighting, warm ambient lighting, soft shadows, clear composition, masterpiece, best quality, absurdres, newest
背景最佳实践:
- 从广泛的环境定义开始
- 添加特定的建筑或自然元素
- 包括材料描述
- 定义照明和气氛
- 保持与角色照明的一致性
- 使用环境质量标签
改善背景的技巧:
- 添加深度指示(前景、中景、背景)
- 包括气氛效果
- 指定清晰的光源
- 在室内场景中使用建筑细节
- 添加环境上下文
- 保持与角色姿势的一致透视
常见背景问题:
- 角色与背景之间的照明不一致
- 透视不匹配
- 中景缺乏细节
- 与角色的整合不良
- 缺少环境上下文
解决方案:
- 使用一致的照明描述
- 添加特定的透视标签
- 包括深度和距离标记
- 指定材料和纹理细节
- 使用建筑或自然锚定元素
已知问题
- 多个竞争的风格标签往往会产生不一致的结果
- 需要特定的提示才能良好工作
最佳实践
- 使用上述提示!
- 从最小参数开始
- 特别注意照明描述
- 监控CFG对输出质量的影响
我自己的训练示例
如果你想尝试一下,这里是我在各种Illustrious合并以及Illustrious本身上训练的一些模型:
关于角度/照明的额外帮助
从上面,
从下方,
特写,
肖像,
POV,
鸟瞰,
广角镜头,
等距,
(+视角,视情况而定)
电影灯光,
好莱坞照明,
背光,
轮廓光,
柔光,
强光,
戏剧性光,
电影风格对比,
柔和阴影,
强烈阴影,