文生图入门:怎么写提示词,才能得到能用的图
「一只猫」和「一只橘猫趴在窗台上,午后阳光,浅景深,胶片质感」——生成的结果天差地别。文生图模型不是读心术,你写多具体,它就给多具体。
提示词四要素
写提示词不用背公式,凑齐四样就够:
- 主体:画什么。越具体越好——「一只橘猫」好于「一只猫」,「戴眼镜的程序员」好于「一个人」。
- 场景/背景:在哪里。「趴在窗台上」「霓虹灯街道」「纯白背景」。
- 风格:什么质感。「水彩」「胶片质感」「3D 渲染」「扁平插画」。不写就默认写实照片感。
- 构图/光线:怎么拍。「特写」「俯视」「午后侧光」「浅景深」。这四项里它对氛围的影响最大。
四要素连成一句自然语言即可,不用堆逗号分隔的关键词——现代模型对自然语句的理解已经很好。
两个模型的区别与选择
工具里内置两个引擎,风格略有差异:
- GPT Image 2:对长提示词、复杂场景描述理解更好,适合「画面里有明确叙事」的需求。
- Nano Banana 2 Lite:速度快、出图轻快,适合快速出草稿和氛围图。
拿同一句提示词各跑一次,你就知道自己的场景更适合谁。
比例跟着用途走
- 社交媒体配图:1:1 或 4:3
- 手机壁纸/故事:9:16
- 博客头图/横幅:16:9
比例在生成前选好,比生成后裁切保留的内容多得多。
迭代,而不是一次到位
第一张图不会完美,也不需要。看哪里不对改哪里:主体不像就加细节描述,氛围不对就调光线词,构图僵就换个视角词。每次只改一个变量,三轮之内基本能收敛到能用的图。
打开图片工具箱的文生图,拿这篇里的四要素写一句试试。