描述画面
描述主体、环境、构图和风格;需要文字时写出准确内容。
GPT Image 2 API 可从文字或参考图生成海报、知识卡片和产品视觉,并支持背景与风格编辑。可在线试用,也可接入应用,适合营销、电商和内容制作。
提供商: OpenAI
类型: 图像生成
接口: /v1/tasks
状态: 已开放
消耗: 查看页面实时价格
GPT Image 2 API 可从文字或参考图生成海报、知识卡片和产品视觉,并支持背景与风格编辑。可在线试用,也可接入应用,适合营销、电商和内容制作。
定价
标准用量
准备生成
配置参数并点击"运行"查看输出结果。
按文生图或图像编辑任务选择 GPT Image 2 的其他路线。
GPT Image 2 是 OpenAI 的文生图模型,适合带文字的海报、结构化知识卡片、产品视觉、角色设计,以及需要明确布局和对象关系的复杂提示词。
组合限制:auto 画幅仅支持 1K;显式传入 background(auto、opaque 或 transparent)时仅支持 1K;1:1 不支持 4K;2K 不支持 5:4、4:5、3:1、1:3、9:21;4K 不支持 1:1、3:1、1:3、9:21。
三步完成一次图片生成。
描述主体、环境、构图和风格;需要文字时写出准确内容。
按需要选择比例、1K/2K/4K 分辨率和自动、不透明或透明背景。
点击运行,等待任务完成后查看图片并下载结果。
下面示例调用 GPT Image 2 文生图模型创建任务。
POST /v1/tasksgpt-image-2/text-to-imagecurl --request POST 'https://api.hiapi.ai/v1/tasks' \
--header 'Authorization: Bearer YOUR_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "gpt-image-2/text-to-image",
"input": {
"prompt": "A clean product photo of a red apple on a white table",
"aspect_ratio": "1:1",
"resolution": "1K",
"background": "auto"
}
}'创建请求会立即返回 taskId;图片在后台异步生成。
透明背景示例:一只红苹果置于透明背景上。 将 background 设为 transparent,并使用 1K 分辨率。
OPENAI · GPT IMAGE 2
GPT Image 2 是 OpenAI 的图像生成与编辑模型:可以从文字开始创作,也可以用参考图延展主体、背景和风格。

MAIN WAYS
两种方式的创作起点不同:可以从文字构思新画面,也可以从参考素材继续编辑。选择最接近当前工作的方式。
从创意描述开始,发展出完整视觉方向:海报、产品场景、知识卡片或编辑图片。在没有参考素材时,先描述主体、信息、环境和层级。
文生图变体是新的视觉想法的开放起点。它可以把活动信息发展成海报方向,把商品概念发展成场景,或把还没有固定画面的编辑主题发展成完整的视觉语言。创作描述从文字开始,因此团队可以先确定主体、信息、构图、环境和情绪,再决定后续是否需要参考素材。
这使它适合创意方向仍在探索的阶段。设计师可以比较克制的产品故事与更有表现力的活动场景;编辑可以观察标题如何改变图片的阅读顺序;品牌团队可以探索同一信息在主视觉、卡片和社交裁切中的不同表现。到了真实主体需要保持连续时,图生图变体可以自然接上参考图编辑。
使用文生图让商品、角色、服装、房间或版式进入新的场景。参考图建立连续性,创意描述说明要改变的背景、氛围、裁切或风格。
图生图变体从已经具有意义的视觉事实开始。商品、角色、版式、服装或环境可以继续成为创作身份的一部分,同时让周围场景发生变化。页面面向参考图编辑:输入图提供连续性,创作描述说明新的背景、风格、气氛或构图。
它适合商品进入季节性环境、角色走进新的故事世界、海报适配新的版式,或目录团队从同一视觉来源发展相关画面。参考图让起点具体,模型则为团队探索新的终点留下空间,同时保留主体的主要视觉特征。
使用图生图KEY FEATURES

01
把标题、标签、日期、优惠信息或短句作为创作描述的一部分。GPT Image 2 可以让信息层级与插画、产品摄影和周围版式一起被探索。
GPT Image 2 会把文字信息纳入画面构图,而不是把它当作最后再贴上的装饰。活动海报可以同时呈现主标题、日期、优惠信息和产品视觉;知识卡片可以把复杂主题组织成清晰层级;菜单、邀请函和社交媒体公告也能让最重要的一句话在画面中拥有明确位置。对于需要让图片承担说明、标注和引导作用的团队,这种能力让视觉方向更容易被具体讨论。
当标题、短句或标签成为构图的一部分,文字渲染就不再只是附加功能。GPT Image 2 可以发展标题主导的海报、带注释的产品故事、信息卡片或编辑封面方向,让团队看到哪些信息应该更大、哪些内容需要归组、观众首先应该看见什么。
02
多张参考图可以承担不同角色:一张确定主体,另一张提供环境,第三张带来色彩或造型方向。这样编辑任务拥有具体起点,也有明确终点。
图生图变体从已有视觉材料开始。参考图可以确定商品外形、角色、服装、房间、姿态或构图结构;GPT Image 2 则让团队继续探索环境、色彩、气氛和周围细节发生变化后的画面,同时保留真正重要的主体关系。
这适合目录延展、季节活动、背景替换、角色发展、编辑改版和设计研究。商品可以从摄影棚进入夏日餐桌,角色可以换到新的环境,已有海报也可以延展成相关尺寸和内容。参考图提供连续性,创作描述说明新的场景应该表达什么。
多张参考图可以分别提供不同信息:一张确定主体,另一张提供环境,第三张带来色彩或造型方向。这样得到的是已知视觉与新想法之间的对话。对于商品换景、角色连续性和有明确起点的编辑任务,图生图比从零描述更自然。它也适合把一次拍摄延展成多个内容触点:目录主图、活动横幅、故事卡片和社交预览可以共享主体,却拥有各自的场景和节奏。

在 HIAPI 如何使用
创建账号并打开 API 密钥页面。
在线检查提示词、画幅、分辨率和背景。
复制 API 快速开始中的请求。
使用任务 ID 查询状态,完成后获取图片。
把生成接入编辑器、目录或内容流程。
围绕同一条发布信息,制作彼此呼应的海报、活动主视觉、落地页首图和社交预告。团队可以比较醒目的公告、克制的编辑构图与移动端裁切,把确定下来的方向延展到活动日历,让不同渠道共享视觉核心。
把同一件商品发展成干净的目录图、季节生活场景、材质细节裁切和用于页面模块的透明素材。相同的视觉方向可以同时服务浏览、比较和购买决策,也为活动页面、邮件首图与商品页提供可复用的内容组件。
从一个概念推进到封面、知识卡片、解释性插图和落地页方向。团队可以先检查信息层级、留白、对象关系与阅读顺序,再进入制作,并把确定的视觉系统应用到专题内容、产品故事和持续更新的栏目中。
保留统一的核心视觉,同时为不同受众调整标题、辅助文字、行动按钮和信息分组。旅宿发布、课程公告或零售促销可以自然适应多种语言,因为版式会跟随每种语言的阅读节奏,而不是把翻译文字作为最后贴上的一块内容。
在 HiAPI,你可以直接在线尝试 GPT Image 2,选择文生图或图生图,调整画幅、分辨率和背景,再查看与下载生成结果。设计师可以用它比较海报和产品视觉方向,内容团队也能围绕文章、活动或商品准备配图。不同画幅可以对应首页横幅、商品卡片和移动端内容,让一次创意探索拥有更多实际出口。团队还可以把同一方向延展为活动页、邮件首图和社交预览,保持内容之间的视觉联系。
需要把图片生成加入自己的产品时,可以使用页面提供的 cURL、Python 和 Node.js 示例。商品编辑器可以增加背景替换,内容后台可以提供文章配图,创作工具可以让用户上传参考图并继续修改。在线体验中确定的提示词和参数可以沿用到 API 请求里。这样,设计师和开发者可以围绕同一张图继续协作,减少从视觉讨论重新翻译成技术字段的过程。
生成通过异步任务完成:提交后取得任务 ID,再查询进度与结果。应用可以在等待期间展示生成状态,让用户继续处理其他内容。文生图用于从想法开始创建新画面,图生图用于延展已有素材,两种方式都能融入现有的内容制作流程,也可以根据团队的发布节奏继续扩展。对于需要反复制作内容的产品,这种连续性尤其适合建立稳定的创作体验,也方便不同成员接手、延续和复用,让创作成果持续服务后续内容。
为兼容旧调用保留的 Beta 线路;新接入建议使用正式 GPT Image 2 模型 ID。
当前线路是纯文生图,不接收参考图。
当前页面展示 1024×1024 与 1:1、16:9、9:16、4:3、3:4;最终可选项以 Playground 参数为准。
按成功生成的图片数量计费;不同分辨率或质量档如有差异,会在页面实时价格中显示。
向 POST /v1/tasks 提交异步任务,model 使用 gpt-image-2/text-to-image@beta,生成参数放在 input 中。

03
以真实主体、地点或知识主题作为视觉世界的中心。官方狼群专题示例把摄影、地图、标签和解释文字放在一起,说明图片既可以营造氛围,也可以服务教育与编辑出版的信息组织。
教育和出版团队可以把课程发展成视觉卡片、章节开场图、历史场景或带清晰信息结构的解释性插图。旅游与酒店团队可以探索目的地故事、菜单公告、房间氛围和活动视觉。娱乐与编辑团队则可以推进角色方向、封面概念、场景研究和需要主体与环境紧密关联的视觉文章。
04
把空间意图说清楚:什么更近、主体在哪里、观众先看什么、文字需要留在哪里。这能把氛围变成可延展到主视觉、卡片和裁切图的视觉系统。
当创作描述说明哪个物体更近、主体位于哪里、周围需要多少空间,以及观众应该先注意什么,画面就拥有了更明确的视觉叙事。活动主视觉可以为标题留出安静区域;产品场景可以用尺度表现细节与质感;角色画面可以让人物所在的环境解释故事气氛。
这些关系不只是装饰风格,也让团队能够具体讨论层级、动势、平衡、对比和视觉焦点。同一个主体可以通过近距离裁切呈现亲密感,通过宽阔环境表达故事尺度,通过意外比例制造趣味,也可以利用充足留白呈现平静。GPT Image 2 让这些选择在概念阶段就变得可见。对课程信息图来说,插图需要服从标题和说明;对产品横幅来说,主体需要与行动文字形成距离;对故事封面来说,人物和环境要一起制造第一印象。对于需要连续发布的内容,清楚的空间关系还能帮助主视觉在横幅、卡片和移动端裁切中保持辨识度。


05
在保留核心视觉想法的同时,为不同语言调整信息、辅助文字、行动按钮和分组。每个本地化版本都可以拥有自己的阅读节奏,而不是贴上的翻译。
同样的能力也适合多语言创意。一次活动可以保留核心视觉想法,同时为不同语言调整标题、辅助文字、行动按钮和信息分组,让每个版本自然适应自己的阅读节奏,而不是把翻译后的文字机械放进原版版式。国际发布、教育、旅游、零售和编辑出版,都可以从这种视觉连续性中获得更完整的内容方向。
透明输出适合需要在不同版式之间移动的主体。商品抠图可以进入目录、落地页、演示文稿或活动组合;图标、贴纸、角色元素、装饰物和小型界面插画也可以放到新的背景上,而不会把完整场景一起带过去。它的价值在于分离:主体成为更大视觉系统里可以重复使用的一部分。
电商团队可以用它搭建商品模块,品牌团队可以发展贴纸和图标系列,教育团队可以制作视觉卡片,创作者可以准备分层社交设计。每个素材都可以拥有自己的轮廓、边缘、姿态和细节,再进入不同上下文,同时保持相同的视觉身份。
GPT Image 2 提供自动、不透明和透明背景选择。环境本身承担叙事时,自动或不透明背景更合适;主体需要进入新的构图时,透明背景则更直接。