首页 / Prompt词库 / 正文
Prompt词库

Flux Prompt 完全指南:快速掌握提示词技巧,告别模糊畸变与风格偏离

chuanbook chuanbook
发布于 2026 年 10 月 07 日
阅读 约27分钟
浏览 5
评论 0

1.1 Flux Prompt 是什么

我第一次打开 Flux 的界面时,脑子里冒出的第一个念头是:这玩意到底在“读”我的什么?后来生成失败了几十次才慢慢摸清楚,Flux.1 本质上是一个基于大规模图文对训练出来的扩散模型,它把你的文字描述当作一种“视觉意图”的压缩包,然后在噪声里一步步解压成图像。你写下的每一句话,它不会像搜索引擎那样逐字匹配,而是整体理解语义,再映射到它见过的海量视觉概念上。提示词在这里的角色更像是一份创意简报,不是代码指令。

Flux 的提示词输入方式其实非常直白,就是一段文字,你用自然语言写也行,堆关键词也行。但它的生成逻辑有一个很关键的点:它会在整个文本序列上做注意力分配,你前面写的词和后面写的词之间会互相影响。我试过把“红色裙子”写在开头和写在结尾,生成结果的色彩饱和度居然有肉眼可见的差别,排在越靠前的位置,模型给的注意力权重往往越高。理解这一点之后,我调整了写提示词的习惯,把最核心的视觉元素放在前面。

生成逻辑里还有一个容易被忽略的东西:Flux 对“关系描述”的理解比早期模型强很多。你写“一只猫坐在钢琴上”,它不会只画一只猫再画一架钢琴然后硬拼在一起,它能理解“坐在……上”这个空间关系。这让我意识到,Flux Prompt 不是标签的堆砌,而是在用语言构建一个场景。你描述得越像在跟一个画师沟通,它给你的结果就越接近你脑子里的画面。

1.2 Flux prompt guide 的核心结构

我刚开始写提示词的时候完全是凭感觉,想到什么写什么,结果就是画面要么缺胳膊少腿,要么风格飘忽不定。后来我逼着自己整理了一个框架,把提示词拆成几个可替换的模块,情况才好转。这个框架大致包含:主体、动作、环境、构图、镜头、光照、色彩、材质、风格和参数。不是每张图都要写满,但脑子里有这张清单,就知道哪里缺了东西。

主体和动作是画面的骨架。主体写清楚“谁”或“什么”,动作写清楚“在做什么”,这两项决定了图像的基本内容。我一开始经常只写主体不写动作,生成出来的人像就跟蜡像一样杵在那儿。环境是给主体一个落脚的地方,室内还是室外,森林还是街道,环境描述直接影响画面的空间感和氛围。构图和镜头是很多人会跳过的一层,但我发现写不写差别很大。你写“全身镜头”还是“特写”,写“低角度仰拍”还是“俯视”,Flux 真的会给你不同的透视和画面裁剪。

光照和色彩放在一起说,因为它们经常互相配合。光照决定了画面的情绪基调,是柔和的窗光还是硬朗的闪光灯,色彩则控制整体的色相倾向。材质和风格是提升画面质感的两个杠杆。材质描述能让金属看起来像金属,皮肤看起来有毛孔,风格词则让画面统一在某种审美体系里。参数是最后一道调整,长宽比、步数、引导系数这些东西不直接描述画面内容,但它们决定了提示词被“执行”的力度和方式。我习惯把参数当作微调旋钮,而不是创意的来源。

1.3 自然语言描述与关键词标签的取舍

有一段时间我特别迷信关键词堆叠,觉得写得越多模型越懂我。后来发现 Flux 对自然语言的响应其实相当好,你写“阳光透过树叶洒在石板路上,形成斑驳的光影”比写“阳光,树叶,石板路,斑驳,光影”出来的结果更有层次。自然语言的好处是它能传达关系和氛围,可读性也强,你回头看自己的提示词知道自己在写什么。关键词标签的优势在于细节密度高,适合快速锁定某些具体特征,比如“赛博朋克,霓虹灯,雨夜,反射”这种组合,模型能很快抓到风格方向。

我的实际做法是混合使用。主体和场景用自然语言描述,保证语义连贯;风格和材质用关键词补充,提高命中率。比如“一个穿着红色风衣的女人走在雨夜的街道上,霓虹灯倒影在湿漉漉的柏油路面,电影感,浅景深,35mm 胶片色调”。前半句是自然语言,后半句是标签,两者配合起来效果比我单用任何一种都好。关键在于平衡,自然语言负责“讲清楚”,标签负责“补细节”。

控制精度这件事跟提示词长度不是线性关系。我试过写三百个词的提示词,结果模型反而抓不住重点,画面元素互相打架。后来我把提示词控制在五十到一百个词之间,只保留真正影响画面的描述,生成成功率反而高了。细节密度要服务于控制精度,写得多不等于控得准。有些词写进去模型根本不理解,或者理解成了别的东西,这种词就是噪音,删掉比留着好。

1.4 提示词权重、否定描述与修饰层级

Flux 支持用括号和数字来调整权重,比如 (red dress:1.3) 就是让红色裙子这个概念的注意力增强百分之三十。我一开始不太敢用权重,怕调乱了,后来发现适度加权确实能解决一些问题。人物脸部特征不够明显的时候,给面部描述加一点权重,五官就清晰了。背景太抢戏的时候,给背景词降权,主体就突出来了。但权重不能滥用,我试过给七八个词同时加权,结果画面直接崩了,模型不知道该听谁的。

否定描述在 Flux 里的表现跟一些其他模型不太一样。你写“不要模糊”,模型不一定能理解“模糊”的反面是什么,它可能反而把“模糊”这个概念激活了。我的经验是尽量用正面描述替代否定描述,想要清晰就写“锐利对焦,高细节”,而不是写“不模糊”。否定描述在某些版本里确实有效,但需要测试,不同版本对否定词的处理逻辑有差异。我一般只在排除特定元素的时候用否定描述,比如“没有文字”来防止画面里冒出乱码。

修饰层级这个概念是我自己总结的,意思是提示词里的描述有主次之分。核心主体是第一层,动作和环境是第二层,风格和氛围是第三层,参数是第四层。写提示词的时候如果层级混乱,模型就不知道哪个信息更重要。我见过有人把风格词写在主体前面,结果模型把风格当成了主体来渲染。把层级理顺之后,语义冲突少了很多,画面也稳定了。过度堆叠的反面不是写得少,而是写得有序。

1.5 Flux Prompt 与其他主流图像模型提示词的差异

我用过一段时间 Midjourney,也折腾过 Stable Diffusion,转到 Flux 之后最直观的感受是语言理解能力上了一个台阶。Midjourney 对风格词特别敏感,你写“吉卜力风格”它马上给你那个味道,但你要是写一段复杂的场景描述,它有时候会漏掉一些细节。Flux 在理解长句和复杂关系方面明显更强,你写“一个人站在镜子前,镜子里反射出他背后的窗户”,它能把这个空间关系画对。Stable Diffusion 的提示词更像是在跟一个标签系统打交道,你得用它的语言说话,Flux 则更接近日常表达。

风格响应方面,Flux 不像 Midjourney 那样一写风格词就强烈偏移,它会把风格融入画面而不是覆盖画面。这既是优点也是缺点。优点是风格和内容能更好地融合,缺点是如果你想要那种特别鲜明的风格化效果,可能需要加权重或者配合 LoRA 来强化。细节还原上,Flux 对材质和光照的表现在我看来是目前第一梯队的,皮肤纹理、金属反光、布料褶皱这些细节,它给出来的结果比大多数模型更经得起放大看。

这些差异意味着你不能把在其他模型上用的提示词直接搬过来。我在 Midjourney 里习惯用的那种短促、高密度的风格词堆叠,放到 Flux 里效果会打折扣。反过来,Flux 喜欢的那些带有空间关系和光影描述的长句,在 Midjourney 里可能被忽略。换模型就得换写法,这个学习成本是省不掉的。

1.6 不同 Flux 版本对提示词的响应特点

Flux 现在有几个版本在跑,Pro、Dev、Schnell 是我用得比较多的。Pro 版本对提示词的理解最细腻,你写复杂的场景描述它基本都能还原,适合出成图或者商业项目。但 Pro 的速度慢,成本也高,不适合拿来快速试错。Dev 版本是我日常用得最多的,它在质量和速度之间有个不错的平衡点,对提示词的响应也很稳定,大部分场景下跟 Pro 的差距没有价格差距那么大。

Schnell 版本的速度非常快,适合批量生成或者快速看构图方向。但它对提示词的响应比较“粗”,你写很细节的描述它可能只抓到主干,细节部分会自己发挥。我一般用 Schnell 来测试构图和大致氛围,确定方向之后再换 Dev 或者 Pro 来细化。不同版本对同一个提示词的解读会有差异,比如同样写“电影感光照”,Pro 给你的可能是那种精心布置的棚拍光,Schnell 可能就给你一个高对比度的硬光。了解这些差异之后,我会根据版本特点调整提示词的写法和预期。

还有一个实际问题是,不同版本对否定描述和权重的支持程度也不一样。Pro 对权重的响应比较线性,你加多少它给多少。Schnell 对权重的敏感度低一些,有时候加了跟没加差不多。这些细节在跨版本使用的时候需要留意,不能一套提示词打天下。

1.7 Flux prompt guide 的常见误区

我踩过的最大的坑就是过度依赖堆词。刚开始那会儿觉得写得越多越好,把能想到的形容词全塞进去,结果生成出来的画面元素互相打架,主体都被淹没了。Flux 不是垃圾桶,你扔进去的东西它不会照单全收,它会尝试理解,理解不了的就变成噪音。删掉那些可有可无的修饰词之后,画面反而干净了。堆词的本质是用数量掩盖描述能力的不足,但 Flux 不吃这一套。

忽略构图是另一个我经常犯的毛病。早期我写提示词只关注“画什么”,不关注“怎么画”。主体、环境、风格都写了,就是没写镜头和构图,结果出来的画面构图很随机,有时候主体被切掉一半,有时候视角很奇怪。后来我养成了写提示词时至少加一句构图或镜头描述的习惯,比如“中景,平视视角”或者“广角,低角度”,画面可控性一下就上去了。构图描述不需要很复杂,但得有。

参数与提示词不匹配这个问题比较隐蔽。你写了一个适合竖构图的肖像提示词,但长宽比设成了横构图,出来的画面就会很别扭。你写了一个需要高细节的场景,但步数设得很低,细节根本出不来。我现在的做法是写完提示词之后检查一遍参数,长宽比是不是和画面内容匹配,步数和引导系数是不是和提示词的复杂度匹配。参数不是独立于提示词之外的设置,它们是提示词的执行环境,环境不对,提示词再好也白搭。

2.1 Flux prompt examples:写实人像与摄影风格提示词示例

我拍人像的时候喜欢用 Flux 来模拟真实摄影的效果。写过最满意的一条提示词是这样的:“一位三十岁左右的女性肖像,面容平静,眼角有细微的笑纹,身穿米色宽松针织衫,坐在靠窗的木椅上,窗外是模糊的绿色植物,柔和的侧光从左边照进来,皮肤有自然纹理,浅景深,85mm镜头,f/1.8,胶片颗粒感,写实摄影”。这条提示词生成出来的人像皮肤质感很真实,不是那种塑料磨皮感。关键点在于我写了“皮肤有自然纹理”和“胶片颗粒感”,这两个词把画面的质感拉到了摄影的范畴里。

有段时间我忽略了光照描述,只写“女性肖像,漂亮,写实”,结果出来的人像光线很平,像证件照。后来我加上了具体的光源方向和质感,比如“柔和的侧光”“窗户光”“逆光轮廓”,画面立刻有了立体感。我还试过用“伦勃朗光”这种专业术语,Flux 也能理解,它会给你那种经典的侧脸三角光。人像提示词里,镜头和光圈数值也很有用,“85mm f/1.8”能带来自然的背景虚化,比单纯写“背景模糊”效果好得多。

摄影风格方面,我经常混搭一些胶片型号的描述。写“Portra 400 色调”和“柯达胶片”,Flux 会给画面加上微微的暖色和柔和的对比。写“黑白摄影,高对比,颗粒”就是另一种味道。有一次我写“宝丽来风格人像,边缘暗角,暖黄色调”,生成的照片真的像从老相册里翻出来的。这些风格词不需要堆很多,一两个就够,堆多了反而会让画面显得脏。我的经验是,写实人像类提示词要把重点放在光线、皮肤质感和镜头参数上,风格词点到为止。

2.2 风景、建筑与室内设计场景的提示词示例

风景照是我测试 Flux 空间理解能力的好方式。我写过一条:“黄昏时分的海边悬崖,一座白色现代别墅嵌在岩石中,大落地窗反射着金色晚霞,海面有长曝光带来的平滑质感,广角镜头,低角度仰拍,冷暖对比强烈”。生成出来的画面里,别墅和悬崖的融合非常自然,晚霞的暖色和海水的冷色形成了层次。我特意写了“长曝光”,Flux 把海浪处理成了雾状,这个细节让我挺惊喜的。风景提示词里,时间和天气描述很重要,“黄昏”“清晨薄雾”“雨后”这些词能直接改变画面的情绪。

建筑和室内设计场景需要更多关于材质和光线的描述。我做过一个室内设计的项目,提示词是:“北欧风格客厅,浅色橡木地板,灰色布艺沙发,圆形木质茶几,大落地窗,午后阳光斜射进来,在墙上投下窗框阴影,室内摄影,24mm广角,柔和阴影,高细节”。出来的图直接可以用作参考。我发现在室内场景里写“窗框阴影”这种具体的光影效果,Flux 的还原度很高。如果你只写“阳光”,它可能给你一个很泛的光照,写清楚光从哪里来、落在哪里,画面就真实了。

还有一次我尝试写一个复杂的建筑外观:“扎哈·哈迪德风格的流线型美术馆,白色曲面混凝土,坐落在城市广场上,黄昏蓝调时刻,建筑内部透出暖黄色灯光,倒影池,超广角,对称构图”。Flux 把曲面和灯光的对比表现得很到位。建筑类提示词里,建筑师名字或者风格流派可以作为风格锚点,但不要只写名字,还要描述具体的形态和材质,不然模型可能给出一个很泛的结果。我通常会把“谁设计的”和“长什么样”结合起来写。

2.3 插画、动漫、概念艺术与游戏美术的提示词示例

插画和动漫风格是我玩得最多的方向。有一条我反复用的提示词:“动漫风格,一个穿着机械铠甲的少女站在废墟城市上,红色围巾随风飘动,背后是巨大的满月,赛璐璐上色,粗轮廓线,低角度,动态构图,高对比”。这条出来的画面很有张力,围巾的飘动和月亮的巨大尺幅形成了视觉冲击。动漫提示词里,“赛璐璐上色”“粗轮廓线”这类工艺描述比单纯写“动漫风格”更精准。我还试过写“90年代复古动漫,颗粒感,低饱和度”,出来的效果就像老番截图。

概念艺术和游戏美术方向,我经常写一些宏大场景。比如:“科幻概念艺术,巨大外星生物骨架横跨沙漠,探险队微小剪影走在骨架下方,黄沙漫天,灰蓝色天空,宽银幕,电影感,体积光”。Flux 对“微小剪影”和“巨大骨架”的尺度对比理解得很好,画面比例很震撼。概念艺术提示词里,尺度感是关键,写清楚大小的对比关系,模型就能把空间感做出来。我还会加一些“氛围图”“场景概念”这类词来引导风格。

游戏美术方面,我试过写“等距视角的奇幻村庄,茅草屋顶,石板路,NPC 小人,鲜艳色彩,游戏资产风格,干净背景”。Flux 给出的画面很像游戏里的场景截图。等距视角这个词对镜头控制很有效,写上去之后透视关系就对了。我还喜欢用“手绘纹理”“低多边形”这些词来区分不同的游戏美术风格。插画类提示词的一个心得是,风格词和内容词要平衡,风格词太多画面会变成纯粹的装饰画,内容词太多又失去了风格辨识度。我一般把风格词放在提示词的中后段,内容描述放在前面。

2.4 产品、电商与商业广告视觉的提示词示例

产品图我帮朋友做过几次,效果出乎意料地好。一条香水广告的提示词:“一瓶透明玻璃香水放在白色大理石台上,背后是柔和的粉灰色渐变背景,侧逆光勾勒瓶身轮廓,瓶身有细微水珠,微距镜头,商业摄影,高调,干净,锐利”。生成出来的图直接可以当电商主图。产品提示词里,“侧逆光”和“微距”是关键,它们能突出产品的质感和细节。我试过不加“商业摄影”这个词,画面就会偏艺术感,加了之后整体更符合广告调性。

电商场景里,运动鞋的提示词我也写过:“一只白色运动鞋悬浮在深色背景中,周围有动态飞溅的彩色粒子,霓虹灯光从底部打亮,产品特写,高对比,锐利对焦,超现实”。Flux 把鞋子的悬浮感和粒子效果做得很棒。电商提示词要注意背景的干净程度,写“干净背景”“纯色背景”能避免画面出现杂乱元素。我还会写“产品居中”“正面视角”来控制构图。有时候为了展示多个角度,我会用“多角度展示”这个词,但 Flux 对多角度的处理有时不太稳定,可能会画出奇怪的拼接。

商业广告视觉方面,我尝试过写“高端护肤品广告,白色乳液瓶放在冰块上,水滴凝结在瓶身,冷色调,蓝色背景,灯光从上方照射,极简构图”。出来的画面很有高级感。广告类提示词里,材质和光线是核心,写清楚“玻璃”“金属”“水滴”这些材质词,再配合具体的光照方向,画面就能达到商业级别。我还发现 Flux 对“极简”“留白”这些词响应不错,写上去之后构图会自动变得干净。

2.5 海报、字体、Logo 与文字渲染类提示词示例

文字渲染是 Flux 的一个亮点,也是我踩坑最多的地方。我做过一张电影海报,提示词是:“电影海报,标题‘STELLAR’粗体无衬线字体,白色文字居中,背景是深空星云,竖向构图,极简,电影感”。Flux 把“STELLAR”这几个字母渲染得相当准确,没有拼错。但我也失败过很多次,比如写“海报上写着‘欢迎来到未来’”,Flux 可能会画出一些看起来像汉字的乱码。我的经验是,文字类提示词要尽量简短,用英文单词或者简单的字母组合成功率更高。如果非要渲染中文,最好把文字内容放在引号里,并且加上“清晰文字”这样的描述。

Logo 设计我也试过。提示词:“极简 Logo,字母‘M’由两条曲线组成,金色,黑色背景,矢量风格,干净边缘”。Flux 给出的图形挺有设计感。Logo 提示词的关键是描述几何形状和构成方式,不要只写“一个 Logo”,要写清楚它由什么元素组成。我试过写“圆形 Logo,内部有山的轮廓,蓝色和白色,扁平设计”,出来的结果也可以直接用作初稿。

海报类提示词里,版式描述会影响文字的位置。我写过“标题在顶部,副标题在底部,中间是主视觉”,Flux 真的会把文字放在对应的位置。但它的文字排版能力有限,复杂的长句或者多行文字容易出错。我的做法是先用 Flux 生成主视觉和简单文字,复杂的文字部分后期用设计软件加上去。这样效率更高,也更可控。文字渲染类提示词,我的建议是把它当作辅助工具,不要指望它完美处理所有文字。

2.6 多主体、复杂叙事、分镜与连续画面的提示词示例

多主体场景考验的是 Flux 对空间关系的理解。我写过一个:“两个人在雨中争吵,男人背对镜头,女人指着远处的出租车,街灯昏黄,水洼倒影,中景,电影感”。画面里两个人的位置和动作关系都很合理。写多主体提示词的时候,我习惯用“左边”“右边”“前面”“后面”这样的方位词来明确位置。写“一个男人和一个女人”容易让模型把两个人叠在一起,写“男人在左,女人在右”就清晰多了。动作和互动也要写清楚,比如“面对面”“背对背”“互相看着”。

复杂叙事方面,我试过用四格漫画的形式。提示词:“四格漫画,左上:英雄从天空落地,右上:敌人转身面对他,左下:能量爆发光芒四射,右下:城市远景俯瞰,粗线条,动作漫画风格”。Flux 真的画出了四格,每一格的内容也基本对应。分镜提示词需要把每一格的内容写清楚,用“左上”“右上”“左下”“右下”来定位。但 Flux 对分镜的理解还不是特别稳定,有时候格子会合并或者顺序错乱。我通常会多生成几次,挑最接近的一张。

连续画面是另一个有趣的尝试。我想要一组风格统一的角色插画,就用了相同的种子和几乎相同的提示词,只改变动作描述。比如第一张写“女孩站在森林入口,背影”,第二张写“女孩走进森林,回头张望”。Flux 给出的两张图风格和角色一致性很高,像是一个故事的两个瞬间。连续画面的关键是保持主体描述和风格词完全不变,只调整动作和场景的细微变化。种子参数也要固定,不然风格会飘。这种用法适合做绘本或者故事板。

2.7 示例拆解方法:从生成结果反推主体、风格、镜头与光照描述

有时候我看到一张满意的图,会想知道它是怎么写出来的。我养成了一个习惯,就是拿一张图反推它的提示词。方法很简单,先问自己四个问题:画面里有什么?什么风格?什么镜头?什么光线?比如我看到一张很有电影感的女性肖像,画面是特写,背景虚化,光线从侧面来,皮肤有质感。我会反推出这样的描述:“女性特写,侧光,浅景深,85mm镜头,胶片质感,电影感”。这么写出来的提示词,往往能复现出七八成相似的效果。

拆解的时候要注意区分“画面元素”和“风格元素”。画面元素是主体、动作、环境,这些是内容层面的东西。风格元素是材质、光照、色彩、镜头,这些是视觉层面的东西。我一般先把内容层写清楚,再加上视觉层的描述。举个例子,我看到一张赛博朋克城市夜景,反推内容层:“未来城市街道,霓虹灯,雨夜,行人打伞”。视觉层:“广角,低角度,冷蓝色调,霓虹反射,电影感,高对比”。组合起来就是一个完整的提示词。

这种反推方法对我提升写提示词的能力帮助很大。我经常拿自己生成的图做练习,先遮住提示词,只看图,然后在纸上写一遍反推的提示词,再对比原提示词,看看差在哪里。差得多的往往是镜头和光照描述,这两个部分最容易被忽略。多练几次之后,我看一张图就能大概判断出它的镜头焦段和光源方向。这个能力在创作时很有用,你脑子里有画面,就能快速用语言把它描述出来。

2.8 反面示例分析:模糊、畸变、风格偏离与文字错误的提示词成因

模糊是最常见的翻车现场。我写过一条“一个人站在森林里,超清晰,不要模糊”,结果出来的人脸是糊的。我后来才明白,“模糊”这个词出现在否定描述里,反而激活了模糊的概念。修正方法是把否定词删掉,直接写“锐利对焦,高细节,清晰纹理”。还有一次我写“柔和的雾气”,结果画面整体都模糊了。雾气本身就会带来模糊感,如果还要清晰的主体,就得写“主体清晰,背景有薄雾”。模糊的成因往往是描述矛盾,你既要清晰又要雾,模型就不知道该听谁的。

畸变问题通常跟长宽比和镜头描述有关。我试过用竖构图的长宽比去生成一个广角风景,结果画面被拉伸得很奇怪。还有一次写“鱼眼镜头”但没写清楚,Flux 给了个畸变非常夸张的结果。修正方法是检查长宽比和镜头描述是否匹配。人像用 2:3 或 3:4,风景用 16:9 或 21:9。写“广角”的时候加一个具体的焦段,比如“24mm”,畸变就会可控很多。如果画面出现了肢体扭曲,可以试试降低引导系数,让模型少一点“自由发挥”。

风格偏离的原因经常是风格词堆得太多。我写过“赛博朋克,蒸汽朋克,废土,极简,水彩”,结果出来一个四不像。这些风格互相冲突,模型只能随机选一个方向。修正方法是只保留一个主导风格,其他风格词作为辅助。文字错误的原因更简单,Flux 对文字的理解能力有限,长句和复杂字符容易出错。我写过“海报上写着‘未来世界欢迎您’”,出来一堆乱码。改成“标题‘FUTURE’英文粗体”就成功了。文字渲染类提示词,越简单越好,能用英文就用英文。

3.1 从需求到 Flux Prompt 的迭代工作流:目标定义、草稿生成、对比测试与收敛

我接一个活儿之前会先问自己:这张图到底用在哪里。是电商主图,还是游戏概念,还是个人头像。用途定了,风格方向就定了。比如电商主图要干净、高细节、光线明确,游戏概念可以暗黑、宏大、带氛围。我会把这个目标写在一张便签上,贴在屏幕边上。这样写提示词的时候不会跑偏。

草稿阶段我从不追求一次到位。我会先写一条最简单的 Flux Prompt,比如“一个女孩站在窗边,自然光,写实”。生成四张图看看大方向。这四张图里可能有一张构图不错,另一张光线好。我把这些优点记下来,再写第二版提示词。第二版会加入具体的光照方向、镜头焦段、材质描述。再生成四张,继续挑。这个过程一般重复三到五轮。

对比测试是我最常用的收敛方法。我会固定种子,只改一个变量。比如只改“侧光”变成“逆光”,其他全不动。这样能清楚看到光照词对画面的影响。如果改了三个词,画面变了,我就不知道是哪个词起了作用。收敛的意思是,我慢慢删掉那些没用的词,留下真正有效的。一条成熟的提示词通常比初稿短很多,但每个词都有明确目的。

3.2 参数协同优化:长宽比、步数、引导系数、种子、采样器与提示词的配合

参数和提示词是绑在一起的。我见过有人写“超广角风景”,却用了 1:1 的长宽比,出来的图两边被裁得很奇怪。风景我一般用 16:9 或者 21:9。人像用 2:3 或者 3:4。竖构图配竖长宽比,横构图配横长宽比。这个匹配关系对了,画面才舒服。

步数我试过从 10 到 50 都跑一遍。Flux 在 20 到 30 步之间细节已经足够,再往上提升很小,时间却翻倍。引导系数我常用 3.5 到 4.5。太低了提示词被忽略,太高了颜色会过饱和,皮肤像塑料。种子我习惯固定一个满意的,然后微调提示词,这样风格不会飘。采样器我用默认的居多,换过几次没发现巨大差异,就不折腾了。

提示词里写“柔和的侧光”,引导系数却给到 7,出来的光会硬得像刀切。参数和提示词要互相配合。我写产品图的时候,引导系数会降到 3.0 左右,让材质自然过渡。写概念艺术的时候,引导系数提到 5.0,让风格更强烈。这些数字不是死的,我会根据生成结果来回调。一般调两三次就能找到平衡点。

3.3 进阶控制方式:参考图、LoRA、ControlNet、局部重绘与扩图中的提示词策略

用参考图的时候,提示词不能和参考图打架。我试过给一张暖色调参考图,提示词却写“冷蓝色调”,结果画面颜色很脏。后来我学乖了,参考图定了色调,提示词就只描述内容和光照方向,颜色交给参考图。参考图的权重也要调,太高了提示词失效,太低了参考图没效果。我一般从 0.5 开始试。

LoRA 我用来固定风格或者角色。每个 LoRA 有触发词,我会把触发词放在提示词开头。权重给 0.6 到 0.8 比较稳。太高了画面会崩,太低了没效果。ControlNet 我用来控制姿势或者边缘。用了 ControlNet 之后,提示词里就不需要写“站姿”“手臂抬起”这类动作词了。反而要写清楚材质、光照、风格。局部重绘的时候,我只描述要改的那块区域。比如改衣服,我就写“红色丝绸衬衫,高细节”,其他部分不动。

扩图是另一个场景。扩图时提示词要描述扩展区域的内容。我写过“左侧扩展出森林,右侧扩展出山脉”,Flux 能理解。但扩图的边缘融合有时会生硬。我的做法是扩图后再用局部重绘修一下接缝。提示词写“平滑过渡,自然融合”会有帮助。这些进阶控制方式让 Flux Prompt 从纯文字变成了多工具协同。我的经验是,工具越多,提示词越要精简,因为控制权已经分出去了。

3.4 提示词模板、片段库与复用策略:建立个人 Flux prompt guide 体系

我建了一个 Markdown 文档,名字就叫“我的 Flux prompt guide”。里面分了好几类:光照片段、材质片段、镜头片段、风格片段、构图片段。每个片段就几个词,比如光照类里有“柔和的侧光”“窗框阴影”“伦勃朗光”“霓虹反射”。写提示词的时候,我从片段库里挑几个拼起来。这样比每次从头想快得多。

模板我也做了几个。写实人像模板是:主体描述 + 动作 + 环境 + 镜头焦段 + 光照 + 皮肤质感 + 风格。风景模板是:时间天气 + 地形 + 主体元素 + 广角/长焦 + 色彩对比 + 氛围。产品模板是:产品 + 材质 + 背景 + 光照方向 + 微距/特写 + 商业摄影。模板不是死的,我会根据具体需求删减或者增加。有时候模板里只留三四个片段,反而效果更好。

复用策略里最重要的一条是记录。我每次生成满意的图,会把提示词、参数、种子都存下来。过一个月再看,能想起当时为什么这么写。我还会给片段库打标签,比如“暖光”“冷光”“高对比”“低饱和”。找起来方便。这个体系帮我省了很多时间,也让我对 Flux Prompt 的理解越来越深。我建议每个经常用 Flux 的人都建一个自己的片段库,哪怕只是个备忘录。

3.5 常见问题排查:模糊、畸变、风格偏离、细节缺失与文字错误

模糊的问题我遇到过太多次。排查顺序是这样的:先看步数够不够,20 步以下容易糊。再看引导系数是不是太低,低于 3.0 模型会自由发挥。再看提示词有没有矛盾,比如写了“薄雾”又写“锐利对焦”,两个词打架。最后看长宽比和分辨率,太小的分辨率放大后也会模糊。我一般把步数提到 28,引导给到 4.0,删掉矛盾的词,模糊就解决了。

畸变通常跟镜头描述和长宽比有关。写“鱼眼镜头”就要接受夸张畸变,不想畸变就别写。写“广角”的时候加个具体焦段,比如“24mm”,比只写“广角”可控得多。人像畸变常见于四肢扭曲,我会降低引导系数,或者加“自然人体比例”这样的词。风格偏离的原因多是风格词堆太多。我写过“赛博朋克,蒸汽朋克,极简”,出来一个四不像。后来我只留一个主导风格,其他风格词作为辅助,问题就少了。

细节缺失和文字错误也有办法。细节缺失一般是提示词不够具体,或者分辨率太低。我会写“高细节,精细纹理,锐利边缘”。文字错误是 Flux 的弱项。我的策略是文字尽量短,用英文大写,加“清晰文字”。长句和中文容易乱码。复杂文字我直接后期加,不跟模型较劲。排查这些问题的时候,我会一次只改一个变量,改完生成四张对比。这样能准确找到原因。

3.6 Flux prompt guide 与 Flux prompt examples 的资源渠道、社区与持续学习路径

我常去的资源渠道有几个。官方文档是基础,里面讲了 Flux 的基本能力和参数含义。Civitai 上有大量别人分享的图片和提示词,我经常去搜“Flux prompt examples”,看别人怎么写。Reddit 的 r/FluxAI 社区很活跃,每天都有新帖子。Discord 上也有官方频道,能直接问开发者问题。YouTube 上有些博主会拆解提示词,看视频比看文字直观。

持续学习我靠的是每日一练。每天花十五分钟,拿一个主题写三条不同的 Flux Prompt,生成出来对比。有时候写“一只猫在窗台上”,有时候写“未来城市下雨”。不追求完美,只求保持手感。我还会把满意的结果和提示词一起存进片段库。每个月回顾一次,看看哪些词经常出现,哪些词从来没用到。这样能慢慢优化自己的词汇库。

社区里有个好习惯是互相拆解。有人发图,我会试着反推提示词,然后看原作者的版本。差在哪里,为什么差。这种练习比单纯看教程有用。我也在社区里回答别人的问题,教别人的过程自己也会更清楚。Flux prompt guide 和 Flux prompt examples 不是一成不变的,模型在更新,社区在进化。保持好奇心,多试多问,进步会很快。

3.7 版权、伦理与商业使用注意事项:模型许可、生成内容归属与风险规避

Flux 的不同版本许可不一样。Pro 版本商用需要付费订阅,Dev 版本可以非商用,Schnell 是 Apache 2.0 许可。我接商业项目之前一定会查清楚用的哪个版本。如果是给客户做图,我会选 Pro 或者确认许可允许商用。生成内容的归属也要看平台条款。有些平台说生成内容归用户,有些说归平台。我一般会保留生成记录和参数,方便证明是自己创作的。

伦理方面我给自己划了几条线。不生成真实名人的肖像用于商业,不生成暴力或者仇恨内容,不生成误导性的新闻图片。有一次客户让我生成一个“像某明星”的头像,我拒绝了,建议用原创角色。风险规避还包括不要用受版权保护的角色名,比如“米老鼠”“皮卡丘”。写了这些词,Flux 可能会生成相似形象,商用会有法律风险。我宁可多花时间写原创描述。

商业使用还要注意不要侵犯商标和设计专利。产品图里如果出现别人的 Logo,即使 Flux 生成的,也可能有问题。我的做法是商业项目里只生成原创元素,或者用客户提供的素材。生成内容如果要用在广告里,我会让法务看一眼。这些注意事项听起来麻烦,但能避免以后的大麻烦。做创作的人,尊重版权也是尊重自己。

3.8 未来趋势:Flux 版本更新、多模态提示词与提示词工程的演进方向

Flux 版本更新很快。我刚开始用 Dev 的时候觉得已经很好了,后来出了 Pro 1.1,细节和文字渲染又上了一个台阶。Schnell 适合快速出草图,Pro 适合最终输出。我猜以后会有更细分的版本,比如专门做人像的,专门做文字的。版本更新意味着提示词策略也要跟着变。以前有效的词,新版本可能不需要了,或者有新的词更有效。我会保持关注官方公告。

多模态提示词是另一个方向。现在可以用参考图加文字,以后可能用视频加文字,或者用语音加文字。我试过用一张草图加提示词生成完整画面,效果不错。未来提示词工程可能不再只是写文字,而是组合多种输入。Flux 对图像的理解能力在增强,写提示词的时候可以更多描述“关系”和“氛围”,而不是“形状”和“颜色”。

提示词工程的演进方向我觉得是自动化和个性化。自动化是指工具帮你优化提示词,比如你写“一个女孩”,工具自动补全光照和镜头。个性化是指模型学习你的偏好,你写几个词它就知道你要什么风格。但人的创意仍然核心。工具再强,也需要有人决定画什么、为什么画。我期待 Flux 以后能理解更复杂的叙事,比如“画出他转身离开时的犹豫”。那一天的提示词会像写小说一样。现在打好基础,以后才能玩得更溜。

赞0
踩0
☆收藏0
版权声明
文章版权声明:除非注明,否则均为ZBLOG原创文章,转载或复制请以超链接形式并注明出处。
分享到
chuanbook

链接已复制到剪贴板