从这张图要完成的任务开始
先描述这张图必须传达什么。一条社交贴文可能需要产品主导画面;一张概念视觉可能需要一个能立住气氛的场景;一个信息图的想法,可能需要让信息和阅读顺序保持清楚。只有当提到受众或渠道有助于解释某个视觉决定时,才把它写进去。提示词越直接地点明这项任务,第一版结果就越容易判断。
GPT Image 2.5 让一份图像需求有了清晰的起点:描述你想做出什么,在需要时带上视觉参考,再对照你本来想验证的那个决定去检查结果。在 YouArt 上,你可以用 Flare 或 Sunburst 在同一个节点里生成并编辑图像,于是一个全新的概念和一次针对性的修改,可以属于同一条创作路径。当第一张图需要的不只是一种模糊的氛围时,就用 GPT Image 2.5。把主体、场景、构图、视觉风格、要呈现的信息,以及那些必须保持不变的细节都定下来。当需求说明点明了承载这个想法的几个部分,一张产品视觉、一个角色方向、一个活动概念,或一张以信息为主的图形,都会更容易评估。
一条好用的 GPT Image 2.5 提示词,会先说明这张图要做的事,再去添加视觉形容词。先讲清楚你要做的是产品场景、海报概念、角色研究、版面,还是别的视觉素材。然后把真正会改变结果的信息交给模型:核心主体、场景、构图、可见的风格,以及画面该承载的任何文字或层级。比如一份产品需求,可以写明商品、受众、光线、背景、机位、字体处理方式和视觉层级。这比笼统地要求一张精致的图更可执行。一份具体的需求说明,能让你判断这次回应解决的是不是对的问题,而不只是给出了一个好看的方向。
先描述这张图必须传达什么。一条社交贴文可能需要产品主导画面;一张概念视觉可能需要一个能立住气氛的场景;一个信息图的想法,可能需要让信息和阅读顺序保持清楚。只有当提到受众或渠道有助于解释某个视觉决定时,才把它写进去。提示词越直接地点明这项任务,第一版结果就越容易判断。
当某个主体、物件、构图或视觉处理需要保持稳定时,就加入参考图,并说明它们各自的作用。在 GPT Image 2.5 模型页上,你最多可以使用 16 张参考图。点明每一张重要图片贡献了什么:产品识别、姿态、色彩关系、版面,或一个视觉方向。比起笼统地要求做一张类似的图,这能给模型一份更好的需求说明。当指令同时区分出哪些可以改变、哪些应当保留时,参考图最能发挥作用。如果瓶身、标签位置、机位和反光很重要,就说出来。然后点明新的环境,或你想尝试的那一处视觉改变。这样结果就有了明确的目标,而不是互相打架的信号。
细致的工作,并不需要挤进一条超载的指令里。先围绕核心决定做出第一张图,再看它与需求之间最要紧的差别在哪里。你可能会发现构图是对的、但光线需要处理,或者主体是对的、但信息层级还不清楚。用这个观察去指导下一次修改,而不是从一个含糊的要求重新开始。
YouArt 上的 GPT Image 2.5 接受图像与文本输入,并输出图像。你可以从一段文字方向生成一张全新的视觉,也可以把一张已有的图带进编辑流程。模型页允许你在同一个节点里选择 Flare 或 Sunburst,默认是 Flare;它还提供五档质量、自定义尺寸,以及 PNG、JPEG 或 WebP 输出。只有在创作需求清楚之后,才去选择控制项。设置可以帮你配置一次运行,但它们替代不了那条告诉画面该呈现什么的指令。把主体、构图、视觉风格和需要保留的要求写在提示词里;再用可用的控制项,让这次运行在尺寸、质量、参考图和输出格式上符合任务的需要。
| 需要做的决定 | 生成前要讲清楚什么 | 它对评估的帮助 |
|---|---|---|
| 起点 | 这份素材是从文字、已有图像,还是两者一起开始 | 让提示词与原始素材保持一致 |
| 视觉方向 | 主体、场景、构图、光线与风格 | 给输出一个具体的创作目标 |
| 参考图的作用 | 哪个主体、版面、产品或处理方式需要保留 | 把需要保留的要求写明确 |
| 修改范围 | 唯一需要改动的那个元素 | 避免一次小改动变成一个新概念 |
| 交付选择 | 想要的尺寸、质量,以及 PNG、JPEG 或 WebP 输出 | 把这次生成与最终用途连起来 |
当一个 AI 图像生成器能帮你更早做出视觉判断时,它才最有用。把第一版结果当成一份可以回应的草稿,而不是终点。拿它和需求对照:主体是否可辨认,场景是否支撑了要传达的信息,构图有没有给重要信息留出足够空间,以及要求的那处改动有没有在不丢掉其余方向的前提下发生?
对于以参考图驱动的编辑,先确定视觉锚点,再写要改什么。点明要保留的物件或主体,描述新的语境,并说明哪些特征不能漂移。像「把背景换成光线柔和的厨房;瓶身、标签位置、机位和反光保持不变」这样的要求,要比笼统地要求改进清楚得多。
接着,你可以把评估过的结果作为下一条指令的基础。如果背景已经成立,就不要在修改标签处理方式时又去动它。如果构图已经被接受,就在调整光线时把它写进需要保留的规则里。这样的顺序让每一次修改都有明确的目的,也更容易看出这张图什么时候可以进入下一步使用。
当提示词里的每一句话都有自己的任务时,图像生成的效果最好。先写交付物和主体。再加上场景与构图。然后描述视觉方向,包括对想要的观感真正重要的光线、材质、配色与质感。如果画面需要文字、标签、标题或某种结构化的信息元素,就说明哪些内容应该出现在图上,以及它们在层级中该处于什么位置。
对于带参考图的视觉,说明每一个重要输入的作用。一张图可能确立产品识别,另一张可能引导配色,还有一张可能确立构图。当这种区分重要时,不要只写一句「把这个当参考」。清楚地分配角色,能减少关于哪些细节应当被带进结果的歧义。
做编辑时,把要求的改动和需要保留的规则分开写。改动应该具体;保留清单应当点名那些已经确认下来的细节。这样 GPT Image 2.5 就能依据一条聚焦的指令工作,而不必去猜画面里哪些部分是可以动的。
用 GPT Image 2.5 把一个清晰的视觉方向,变成一张你可以评估的图。使用 GPT Image 2.5 时,从这份素材需要完成的任务出发,给参考图明确的角色,并且只设置与任务相关的控制项。让 GPT Image 2.5 的每一次修改都回答一个聚焦的问题。当一份清晰的需求需要一张同样清晰的下一张图时,就用 GPT Image 2.5。这种做法,会让创作需求与每一张生成的图、每一个接下来的决定都保持连在一起。
当核心画面可以继续往下探索时,打开 GPT Image 2.5 模型页设置输入与参数,然后从节点生成。如果你想要更多针对这个模型的写法,可以浏览 GPT Image 2.5 提示词,并把其中的视觉方向改写成你自己的主体、参考图与用途。
当项目更适合它既有的参考图工作流与最高 4K 输出时,它依然可用。打开 GPT Image 2。
当你想试另一个方向时,可以考虑的另一个图像模型。打开 Nano Banana Pro。
当设计需要一份透明文件,用在演示、产品页或海报上时。移除图像背景。
一个为这个模型整理的提示词库,可以直接复制使用;每一条都标注了写下它的作者,并配上它生成的图像。浏览 GPT Image 2.5 提示词。
GPT Image 2.5 已在 YouArt 上提供,你的方案与积分余额决定了账号可用的图像工作流。可以按你的创作频率、需要产出的素材数量,以及是否需要共享工作流和团队管理权限来选择方案。
适合爱好者和探索者
适合专业人士
适合高级用户和团队
适合团队和工作室
图像可以非常逼真,因此请负责任地使用 GPT Image 2.5。只使用你有权使用的图像、人物与品牌素材。当素材是生成或经过实质性编辑的、且这一点对受众重要时,请予以说明。不要用这个模型就真实事件误导他人、制作有害的假冒内容,或生成与我们的规则或他人权利相冲突的内容。
良好的创作习惯也会让结果更好。对需要审核的项目,请记录提示词方向、参考素材与主要修改。如果画面里含有产品信息、标签、日期或其他事实性内容,请在发布前核对成品。模型可以帮你把一个视觉概念做出来,但成品的准确性与合理使用,责任仍在创作者。
GPT、GPT Image 和 ChatGPT 是 OpenAI 的商标。YouArt 是独立平台,与 OpenAI 无关联,也未获其背书。
目标不是把所有可能的指令都塞进一次请求里,而是让下一个创作决定变得可见。先从一个聚焦的方向开始,找出结果中偏差最大的地方,再用下一轮去解决那一个点。这样就形成了一套可行的图像创作循环:指挥、评估、精修,并带着更清楚的需求继续往前。
用模型选择器选择 Flare 或 Sunburst,然后补上那些让方向变具体的输入。如果这张视觉从一个想法开始,就写一份清楚的文字需求。如果它从已有的产品、人物、物件或构图开始,就放上相应的参考图,并指明哪些内容应当保留。GPT Image 2.5 在同一个节点里支持图像生成与图像编辑,因此起始素材可以一直是创作决定的一部分。
模型页提供自定义尺寸和格式选择,包括 PNG、JPEG 和 WebP。在选择输出之前,先想清楚这张图会在哪里被评估或使用。一个版面方向需要的画幅,可能和一张产品图不同;而一次修改可能需要保持原图的比例。透明输出需要 PNG 或 WebP,因此当透明是预期结果的一部分时,请选择这两种格式之一。
当一次编辑一次只要求一个决定时,它就更清楚。与其说「改好一点」,不如点名具体的调整:替换背景、更改产品配色、修改标题的处理方式,或调整光线。随后再写上需要保留的元素。这样 GPT Image 2.5 就有了明确的编辑目标,以及一组明确的视觉锚点,可以用在下一轮。
在开始下一轮之前,先看最重要的那项要求。对一张活动视觉,那可能是产品与信息层级;对一个角色概念,那可能是身份、表情或服装;对一张信息复杂的图,那可能是预期的信息是否都在、是否易读。一条简短的评估笔记,比一堆新的风格词更能带来有力的下一条指令。
一旦画面里的某个部分已经成立,就把它写进下一次需要保留的指令里。只有当已确认的主体、姿态、版面、裁切、背景或光线对这次编辑确实重要时,才保留它们。这能帮你从一次探索性的初稿,走进一串脉络清楚的修改。
一份实用的需求说明常常遵循这样的顺序:说出素材类型,确定主体,描述场景,定义构图,再指定视觉处理方式。不是每一次请求都需要用上全部要素。只用那些能帮画面做出预期决定的细节。一张简单的产品图,可能仍然需要物件、台面、光线和裁切;一个叙事场景,则可能还需要动作、时间和衬托元素。
如果一张视觉需要呈现信息,就把信息本身和它在构图中的作用写出来。说明哪一行是标题、它应该放在什么位置,以及它周围有哪些内容应当在视觉上保持安静。生成之后,检查结果里那些重要的信息。把生成出来的视觉当成需要复核的东西,尤其当版面需要特定的文字、标签或某种层级时。