GPT Image 2.5 图片生成费用详解:Flare 与 Sunburst 两种模式定价解析

简介: OpenAI发布GPT-Image 2.5双模型:Flare(重速度)与Sunburst(重精度),均按token计费——文字输入$5M、图片输入$8M、输出$30M/百万token,缓存另计。单价统一,但实际单图成本因用量而异,官方提供输出token估算器。

OpenAI 为 GPT Image 2.5 Flare 和 Sunburst 公布了相同的 token 单价:文字输入每百万 token 5 美元,图片输入 8 美元,图片输出 30 美元。 缓存输入另有价格。这些是 token 费率,不是每生成一张图都收取的固定费用。

GPT Image 2.5 已在 上架:Flare 和 Sunburst 模型页提供当前价格与 API 调用示例。

本文于 2026 年 9 月 9 日核查。官方当前生图指南已有 GPT Image 2.5 输出 token 计算器,但它只估算部分费用,不能直接把旧版 GPT Image 2 的每张价格套过来。

两个型号的官方单价

计费项目 Flare Sunburst 单位
文字输入 $5.00 $5.00 每百万 token
缓存文字输入 $1.25 $1.25 每百万 token
图片输入 $8.00 $8.00 每百万 token
缓存图片输入 $2.00 $2.00 每百万 token
图片输出 $30.00 $30.00 每百万 token

表内均为美元,来源是 OpenAI 官方型号页。这不代表 或其他网关的实际账单价格,使用哪个平台就应核对哪个平台的费率和计费项目。

图片模型本身输出图片。如果Responses API 让语言模型调用生图工具,外层语言模型的用量还会另外计费。不能把这张表当成多工具对话的完整费用。

一次请求的费用怎么算?

先将实际用量拆成互不重复的计费类别,缓存部分不要再按非缓存输入重复计算:

费用(美元)= (
 非缓存文字输入 token × 5
 + 缓存文字输入 token × 1.25
 + 非缓存图片输入 token × 8
 + 缓存图片输入 token × 2
 + 图片输出 token × 30
) ÷ 1,000,000

以平台对 usage 字段的定义为准。如果某个总输入字段包含缓存 token,需要按其定义扣除缓存部分,再计算非缓存费用。重复提交同一张参考图,也不代表一定能获得缓存折扣。

假设某次请求使用 1,000 个非缓存文字输入 token、2,000 个非缓存图片输入 token 和 4,000 个图片输出 token,没有缓存和其他费用:

项目 计算 费用
文字输入 1,000 × $5 ÷ 1,000,000 $0.005
参考图输入 2,000 × $8 ÷ 1,000,000 $0.016
图片输出 4,000 × $30 ÷ 1,000,000 $0.120
以上项目合计 相加 $0.141

这些用量是为了演示计算而假设的,不是某个分辨率、画质档位或型号的实测报价。

官方计算器包括哪些费用?

官方生图指南提供 2.5 的图片输出 token 和输出费用估算。其范围不包括文字输入、图片输入和流式生成的中间图片,因此它不是一张完整请求的账单。

型号页同时说明:2.5 的 token 费率与 GPT Image 2 相同,但 GPT Image 2 计算器不能估算 2.5 的用量。这并不矛盾,单价相同不代表旧模型的用量估计仍适用于新模型。

记录估算时,保存型号、尺寸、画质、估算日期和排除的项目。做应用预算时还应补齐其他费用,并实际 usage 校验。

单价相同,为什么每张图仍可能花不同的钱?

完成同一个任务,两个模型可能消耗不同数量的 token,也可能需要不同次数的修正。不能凭相同单价断定总价相同,也不能凭 Flare 的速度定位判断它更便宜。

更适合工作流的指标是:

每张可用图片的成本 = 这组尝试实际计费总额 ÷ 达到验收标准的图片数量

例如十次尝试总共花费 $1.41,只有六张能用,每张可用图片就是 $0.235。这也是算术示例,不是实测成功率。把被计费的重试和修正算进去,但不要假设所有失败请求都收费,或所有重试都免费。

多轮改图还可能包含参考图输入和外层语言模型用量。预算应覆盖用户实际完成的流程,而不只是最后下载的那张图。

制定预算前记录什么?

记录平台、准确的模型 ID、尺寸、画质、参考图数量、返回的用量类别和最终验收的图片数。普通任务和困难任务都要覆盖,以区间呈现结果,不把一张特别顺利的图片当成普遍价格。

选型先看 Flare 和 Sunburst 的区别,接入参考 API 教程,已有工作流可使用升级检查清单。本文未运行付费推理基准测试。

官方来源


参考来源

相关文章
|
5天前
|
人工智能 运维 BI
阿里云千问办公QwenWork深度解析:基于Qwen3.8,六大核心能力重构企业全自动化工作流与计费选型指南
传统AI办公工具大多停留在对话问答、文档摘要、简单文案生成层面,只能完成单点碎片化任务,无法自主拆解复杂业务流程,很难串联多工具、多文档、外部业务系统完成端到端完整工作交付。很多企业在落地AI办公的时候,需要组合多款不同工具,来回切换界面,手动复制粘贴中间结果,智能化改造落地门槛居高不下。千问办公QwenWork是整合多款智能体产品能力打造的一体化企业办公智能体平台,底层基座依托Qwen3.8大模型,打通桌面端Agent、云端Agent、企业协同Agent三种运行形态,不再局限简单问答,接收业务目标之后自主拆解任务步骤,调用各类工具,处理文档、表格、浏览器自动化、数据查询,直接输出可交付的办公
1484 0
|
5天前
|
人工智能 自然语言处理 安全
阿里云AI数智鉴密:AI 生成内容如何拿到一张"防篡改的身份证"
隐形水印 + C2PA签名:让AI生成内容“持证上岗”。
1131 0
|
14天前
|
人工智能 自然语言处理 安全
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
本文聚焦阿里云2026年推出的三款自研AI办公产品,清晰拆解千问办公、Qoder Teams、Qoder CN的差异化定位与能力边界:千问办公主打职场全场景提效,支持自然语言指令一键完成PPT生成、数据分析等高频办公任务;Qoder Teams面向程序员团队,深度整合AI代码生成、团队协同与企业知识库能力;Qoder CN则专为金融、政务等强合规场景打造,实现数据不出境与VPC私有化部署。文章同步给出分场景选型指南与最新活动定价,帮助不同类型的企业按需组合产品,实现业务岗、研发岗与强合规场景的AI能力全覆盖。
3779 4
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
|
5天前
|
人工智能 安全 前端开发
刚刚 GPT-6 Astra 发布,全球最强,AGI 时代到来!
OpenAI 正式推出 GPT-6 Astra 模型,带大家看看这次 GPT 有哪些提升,跟 Claude Fable 5.1 有什么差距?AI 编程能力如何?AGI 真的来了么?
633 0
|
2天前
|
SQL 人工智能 前端开发
QoderWake 1.0 正式发布:从桌面里的 Agent,到工作现场的数字员工
QoderWake v1.0正式发布:企业级数字员工团队平台。支持“一句话建岗”,预置10类特训岗位;Waker常驻钉钉/飞书群,@即响应、自动协作、跨任务记忆;具备定时/事件/API多触发方式与统一任务看板;已沉淀27.6万条记忆、12.3万项技能,助力组织实现人机协同增效。
608 0
|
6天前
|
网络协议 Linux iOS开发
【2026实测】Wireshark下载+安装+汉化+使用教程(图文版,巨详细)
Wireshark 是一款免费开源的网络协议分析工具,可实时捕获、解析并可视化数据包,助你诊断网络故障、分析通信协议(如HTTP、DNS、TCP等)。支持Windows/macOS/Linux,含中文界面,新手入门便捷。(239字)