
科学信息图
1:1A detailed scientific infographic of an integrated biohybrid artificial photosynthesis platform for solar-to-fuel conversion, with labeled cross-section diagrams, molecular structures, efficiency charts, and process flow annotations
openai/gpt-image-2OpenAI 推出的 GPT Image 2 图像生成 API -- 最高 4K,具备原生推理能力,支持多语言文本渲染和参考图引导编辑。

A detailed scientific infographic of an integrated biohybrid artificial photosynthesis platform for solar-to-fuel conversion, with labeled cross-section diagrams, molecular structures, efficiency charts, and process flow annotations

A photorealistic candid shot of a young man in a light grey Covernat hoodie sitting at station 139 in a premium PC cafe, focused on his laptop screen, soft window light mixing with monitor glow, shallow depth of field

A pixel-perfect recreation of the YouTube homepage UI with a left sidebar showing Home, Shorts, Subscriptions, History, and Explore sections, a top navigation bar with search and profile icon, category filter chips, and an 8-video thumbnail grid with realistic titles, channel names, view counts, and duration stamps
GPT Image 2 是 OpenAI 的旗舰图像生成模型,于 2026 年 4 月发布。它是首批具备内置推理能力的图像模型之一--模型在生成前会规划构图并验证提示词约束。它支持多语言文本渲染,涵盖 CJK、印地语、孟加拉语等文字系统,非常适合全球化创作需求。支持最高 4K 输出,可通过 GPT Image 2 API 访问。
具有精准光照和材质的产品摄影。对真实感和细节要求高的营销和编辑视觉素材。需要清晰内嵌文字的信息图、UI 原型和海报设计。参考图引导编辑--上传最多 4 张图片来控制风格、色调或构图。
所有参数通过运行请求的 input 对象传入。
| Parameter | Required | Description |
|---|---|---|
| prompt | Yes | 图像生成的文本描述(1–4000 字符) |
| aspect_ratio | No | 输出宽高比。默认 1:1。可选:1:1、2:3、3:2、3:4、4:3、4:5、5:4、9:16、16:9、21:9 |
| resolution | No | 输出分辨率。默认 1K。可选:1K、2K、4K(4K 仅支持 16:9、9:16 或 21:9) |
| image_urls | No | 最多 4 张参考图(每张最大 4 MB)用于图到图生成 |
GPT Image 2 对物理描述响应出色。"Matte ceramic vase on a walnut table, soft window light from the left" 始终优于 "a vase on a table"。
4K 输出仅限于 16:9、9:16 和 21:9。要在横版或超宽构图中获得最大细节,请将 resolution: "4K" 与这些比例搭配使用。
提供与目标风格高度匹配的参考图--模型使用它们来引导色调和构图,而不是从差异较大的参考中推断。
十种:1:1、2:3、3:2、3:4、4:3、4:5、5:4、9:16、16:9 和 21:9。默认为 1:1。
支持--可选 1K、2K 和 4K。4K 仅限于 16:9、9:16 和 21:9 比例。
可以。通过 image_urls 上传最多 4 张参考图来引导生成。
GPT Image 2 是 OpenAI 的旗舰模型,具备内置推理能力--在生成前规划构图并验证提示词约束--以及强大的多语言文本渲染能力(包括 CJK)。Nano Banana Pro 是 Google 画质最高的模型,基于 Gemini 3 Pro,支持 4K 输出、11 种宽高比和最多 8 张参考图。追求推理驱动的构图和多语言文本选 GPT Image 2;追求通过 API 实现 4K 和更多参考图引导编辑选 Nano Banana Pro。
GPT Image 2 是新一代旗舰模型,具备内置推理能力和改进的多语言文本渲染。GPT Image 1.5 是上一代模型--功能不错但缺少规划/验证步骤。受益于推理的复杂提示词选 GPT Image 2;不需要推理开销的简单生成选 GPT Image 1.5。
在 Runbase 上有两种方式:使用本页顶部的 Playground,输入提示词和可选的参考图即可即时生成;或通过 POST 请求 /api/v1/runs 调用 API,传入 model: "openai/gpt-image-2" 和包含 prompt(必填)、aspect_ratio、resolution 以及最多 4 个 image_urls 的 input 对象。新账号可获得注册赠送额度进行体验。完整代码示例见 API 标签页。
GPT Image 2 按生成的每张图像计费,分为三个分辨率档位:1K(最低)、2K 和 4K(最高)。当前每张图像的费率见上方定价部分。
它采用按量计费而非免费,但新的 Runbase 账号可获得注册赠送额度,可用于 GPT Image 2 及其他模型。额度用完后,按上方定价部分显示的费率按次付费。