模型

OpenAI: GPT-5.4 Image 2

仅 API 可商用
OpenAI · 商业闭源 · — · 上下文 272K
能做什么
图像生成聊天问答多模态理解内容创作长文档分析
部署门槛
待补充
上下文
272K
token 窗口
参数

01基础参数

参数规模
上下文窗口
272K
输入模态
file / image / text
可生成
image / text
模型系列
开源许可
商业闭源
主要语言
multi

02部署门槛详情

硬件等级 待补充

03Benchmark 评测

待补充

04适用场景

✓ 适用
高精度文字渲染的图像生成、需要保持角色一致性的系列图像创作、基于长文本或上传文件的图文混合内容生成、多语言商业设计素材制作
✗ 不适用
复杂物理谜题或极端密集细节场景、低显存或无API访问权限的本地部署

05部署与限制

⚙ 本地部署建议
该模型仅通过API提供服务,无法本地部署。需通过OpenRouter或OpenAI官方API调用,支持多模态输入输出。
⚠ 已知限制
处理超长或极复杂指令时,图像可能出现过度锐化及伪影。难以应对需要完整物理世界模型的谜题(如折纸、魔方)及极密集重复细节(如细沙粒)。

06详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

OpenAI于2026年4月22日发布的GPT-5.4 Image 2(亦称GPT Image 2)是一款前沿的多模态模型,它融合了GPT-5.4的强大语言能力与新一代图像生成技术。其核心突破在于将推理能力内置于图像生成流程,使得模型在创作前能够进行构思、规划甚至调用工具搜索,从而在理解复杂指令和渲染精确文字方面实现了巨大飞跃。该模型支持文本、图像和文件作为输入,并能同时输出文本与图像,上下文窗口达到272K。

该模型在文生图领域树立了新的标杆,尤其在文字渲染的准确性和多语言支持上表现出色,能够生成包含清晰图表、海报和漫画的专业级作品。其单次生成最多8张连贯图像并保持角色一致性的能力,为故事板、儿童读物和广告物料等专业工作流提供了高效工具。虽然目前仅通过API提供,且在处理极端复杂的物理谜题或超长提示时可能出现过度锐化等问题,但其在多模态理解、逻辑推理及高质量图像生成方面的综合实力,使其在专业内容创作领域具有显著优势。

OpenRouter Provider 比价

共 1 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
OpenAI8.015.0unknown272K

代表价(满血最低):OpenAI 输入 8.0 / 输出 15.0 USD/1M。按 provider 选择可进一步降本。

07官方资源

08同类模型