Appearance
最近GPT Image-2火出圈了,随便对输入框输入什么,出来的图就跟思考一样,完全出乎想象。今天把用下来的东西原原本本说一遍。
GPT Image-2是什么
GPT Image-2是OpenAI最新的图像生成模型,直接内置在ChatGPT里,不用下载任何东西,打开网页就能用。
跟之前的DALL·E比,最明显的变化有三个:
- 文字终于不乱了 — 图里的文字清晰度真的上来了
- 能理解更复杂的描述 — 每一个细节都能落到图里
- 可以改图了 — 不只是生图,可以上传一张图局部修改
怎么进去用
普通用户: 登录ChatGPT,新建对话,直接说你想要什么图。
开发者: 走API,model参数选gpt-image-1。
大多数人走第一条就够了。
最关键的部分:提示词
很多人用不好这个工具,不是因为工具差,是因为不知道怎么"说话"。
总结出一个顺手的结构:
主体是谁 → 在做什么 → 在哪里 → 什么风格 → 什么光线
就这五个维度,按顺序填进去。
举个例子:
❌ 普通写法:一只猫坐在窗边(出来的图像图库随便一张)
✅ 换成这样:一只橘色的猫坐在木质窗台上,窗外是下雨的城市,柔和的自然光从侧面打来,胶片摄影风格,温暖色调
同样的主体,出图质量差了不止一个档次。
常用风格词
| 类型 | 推荐词 |
|---|---|
| 摄影风格 | "电影感""胶片质感""商业摄影" |
| 插画风格 | "扁平插画""水彩风""日系漫画" |
| 光线描述 | "黄金时刻光线""柔和散射光""逆光剪影" |
场景提示词模板
场景1:公众号/小红书配图
简洁的[主题]主题插画,[颜色风格]配色,适合社交媒体封面,留有文字空间,[风格]风格示例:简洁的"早起"主题插画,莫兰迪色系配色,适合小红书封面,留有标题文字空间,扁平插画风格
场景2:产品展示图
[产品名称]产品摄影,[背景描述],专业商业摄影风格,高清,白色或渐变背景场景3:头像/人物图
[人物描述],[表情/动作],[背景],[风格],正面视角,高清人像场景4:海报设计
[主题]活动海报,包含文字"[文字内容]",[颜色风格],[设计风格],专业排版场景5:图片局部修改
上传一张图,然后说:
请把图片中的背景换成[新背景描述],保持主体人物不变请把图中人物的衣服颜色改为[颜色],其他部分保持不变
踩过的坑
| 坑 | 提醒 |
|---|---|
| 提示词太短 | "一只猫"出来不是你要的?你得说清楚要什么 |
| 风格词堆太多 | "电影感水彩风像素艺术赛博朋克"全堆一起,出来四不像 |
| 不会用重新生成 | 同样的提示词多生几张,里面总有一张是对的 |
最后
GPT Image-2不是设计师的替代品,有一说一。
但它确实让"我不会设计"这个理由,越来越站不住脚了。
今天就去试一张,从最简单的配图开始,用五维结构写提示词。
