OpenAI o3 将于 2026 年 8 月 26 日从 ChatGPT 退役。在 o3 退役之前,下方列出的 o3 额度费率仍然适用。此项变更不影响 API 访问。更多信息请参阅:模型发布说明。
概览
本文概述了 ChatGPT Business 和 Enterprise/Edu 套餐在灵活的额度定价模式下的现行额度费率。其中涵盖 ChatGPT 模型和功能、ChatGPT for Excel、ChatGPT for PowerPoint、工作空间智能体、ChatGPT 工作以及 Codex。
如需详细了解额度和灵活定价的运作方式,请参阅“Enterprise、Edu 和 Business 套餐的灵活定价”。
如果你的 Enterprise 协议规定用量按美元(而非额度)计费,请使用协议中指定的费率卡,或联系你的 OpenAI 代表。如需了解 Plus 或 Pro 套餐的额度费率,请参阅“在 ChatGPT(免费版/Go/Plus/Pro)中灵活使用额度”。
基于额度的定价方式
具体取决于功能,使用量按以下任一方式衡量:
每条消息、每项任务、每次生成或每分钟连接时长对应固定数量的额度。
每百万输入 Token、缓存输入 Token 和输出 Token 对应的额度。
Token 是 OpenAI 模型处理和生成的小型信息单元。对于基于 Token 的额度费率,总额度用量按以下方式计算:
总额度 =(输入 Token / 1,000,000 × 输入费率)+(缓存输入 Token / 1,000,000 × 缓存输入费率)+(输出 Token / 1,000,000 × 输出费率)
实际额度用量会因模型、任务复杂度、输入规模、缓存输入、输出长度、自动化和快速模式而异。如需了解更多信息,请参阅“什么是 Token?如何计算 Token 数量?”
模型
ChatGPT 消息的额度费率取决于所选选项使用的模型。
| 计费单位 | 额度 (~) | |
|---|---|---|
| 即时 | 1 条消息 | N/A - 无限制 |
| GPT-5.6 Luna | 1 条消息 | N/A - 无限制 |
| GPT‑5.6 Sol | 1 条消息 | 10 额度 |
| GPT-5.6 Sol Pro | 1 条消息 | 50 额度 |
即时对话不限量。“中等”“高”和“极高”采用不同的推理强度,但均使用 GPT-5.6 Sol,每条消息均消耗 10 额度。选择更高的推理强度不会增加每条消息消耗的额度。Pro 使用 GPT-5.6 Sol Pro,每条消息消耗 50 额度。
启用自动推理后,即使仍选择“即时”,ChatGPT 也可能会对请求使用额外的推理。使用 GPT-5.6 Sol 的请求会消耗 10 额度。使用 GPT-5.6 Luna 的请求不会消耗额度。
无限制或几乎无限制的访问权限受滥用保护措施和任何特定模型使用限额的限制。为防止滥用,可能会实施临时限制措施。
ChatGPT 功能
| 功能特性 | 计费单位 | 额度(近似值) |
|---|---|---|
| 智能体模式 | 1 条消息 | 30 额度 |
| 深入研究 | 1 个任务 | 50 额度 |
| 图片 | 1 次生成 | 5 额度 |
| ChatGPT 的语音功能 | 1 分钟 | 5 额度 |
ChatGPT Edu 用户可免费使用以下额度,无需额外付费,也不会消耗积分:
图像:每 24 小时可生成 3 次。
深度研究:每 24 小时可进行 5 次查询。
24 小时周期从首次使用的时间开始计算。例如,如果你在上午 10:00 生成一张图像,在次日上午 10:00 前,还可以再生成 2 张。超出以上限额的使用,将按照上述费率扣除额度。
ChatGPT 工作与 Codex
ChatGPT 工作和 Codex 服务按照 Token 用量计费,以每百万输入 Token、缓存输入 Token、输出 Token 对应的额度为计算标准。
此费率卡适用于:
使用标准 ChatGPT 席位的 ChatGPT Business 用户,以及符合条件的 Business 工作空间中使用 Codex 专属席位的用户。
新老 Enterprise、Edu、健康、Gov 和 ChatGPT 教师版客户。
少数 Enterprise 客户仍需沿用此旧版 Codex 费率卡,直到其工作空间完成迁移。如果你不确定适用哪个费率卡,请联系 OpenAI 销售团队。
对于 ChatGPT Business,标准 ChatGPT 席位会优先使用套餐包含的限额。如果工作空间已购买额度,在达到包含的限额后,符合条件的用量可以继续从共享额度池中扣除。按用量计费的 Codex 专属席位仅包含 Codex 用量,并且从首次使用起就会消耗工作空间额度。
采用灵活定价模式的 Enterprise 和 Edu 工作空间可通过额度扩展用量,并且没有固定的费率限制;未采用灵活定价模式的工作空间仍受其套餐限制。
Ultra 等推理选项不是此费率卡中单独的模型行:Ultra 使用最高级别的推理,并且可能会为符合条件的用户运行额外的智能体,因此额度用量仍取决于所使用的具体模型,以及任务和其运行的任何智能体所产生的 Token 数量。
即将停用的模型:2026 年 8 月 31 日,针对已使用 ChatGPT 登录的用户,GPT-5.4 和 GPT-5.4 mini 将在 Codex 中停用。GPT-5.6 Terra 将代替 GPT-5.4,同时 GPT-5.6 Luna 将代替 GPT-5.4 mini。使用你自己的 API 密钥访问 OpenAI API 和使用 Codex 不受影响。
注意:GPT-5.6 Sol 的优惠定价有效期截至 2026 年 11 月 21 日。该优惠适用于使用已购买额度支付费用的符合条件的用量。套餐内包含的用量、5 小时和每周限制以及旧版额度费率保持不变。
| 模型 | 输入 Token(每 100 万 Token 的额度) | 缓存输入 Token(每 100 万 Token 的额度) | 输出 Token(每 100 万 Token 的额度) |
|---|---|---|---|
| GPT-5.6 Sol | 100 额度 | 10 额度 | 500 额度 |
| GPT-5.6 Terra | 50 额度 | 5 额度 | 300 额度 |
| GPT-5.6 Luna | 5 额度 | 0.5 额度 | 30 额度 |
| GPT-5.5 | 125 额度 | 12.50 额度 | 750 额度 |
| Daybreak Blue | 100 额度 | 10 额度 | 500 额度 |
| Daybreak Red | 312.5 额度 | 31.25 额度 | 1,875 额度 |
| GPT-5.4 | 62.50 额度 | 6.250 额度 | 375 额度 |
| GPT-5.4 mini | 18.75 额度 | 1.875 额度 | 113 额度 |
| GPT-5.3-Codex | 43.75 额度 | 4.375 额度 | 350 额度 |
| GPT-5.2 | 43.75 额度 | 4.375 额度 | 350 额度 |
| GPT-Image-2(图像) | 200 额度 | 50 额度 | 750 额度 |
| GPT-Image-2(文本) | 125 额度 | 31.25 额度 | 250 额度 |
这些费率适用于受支持的 ChatGPT 工作和 Codex 活动,包括本地任务、云任务、自动化、代码审查、自动审核和委派的工作人员。费用基于所用模型以及实际输入、缓存输入和输出 Token 计算。
注意
Codex 不收取缓存写入费用。
Daybreak 访问权限需通过 OpenAI Daybreak/Trusted Access for Cyber 计划获得批准。Daybreak Blue 采用与 GPT-5.6 Sol 相同的费率。Daybreak Red 需要另行审批和配置。
对于使用 GPT-5.6 Sol 的典型 Codex 任务,每项任务可能会消耗 5-30 额度。
快速模式下,对应适配模型的额度消耗速度会加快。请查看速度相关说明,了解相应费率。
代码审查功能默认使用 GPT-5.3-Codex。
自动审核使用 GPT-5.4。
GPT-5.3-Codex-Spark 仅以研究预览版形式向 ChatGPT Pro 用户开放,使用单独的用量限制,并且发布时无法通过 API 密钥获取。如需了解 Plus 和 Pro 套餐的额度费率,请参阅“在 ChatGPT(免费版/Go/Plus/Pro)中灵活使用额度”。
如果你的套餐包含这些功能,Codex、ChatGPT Work、ChatGPT for Excel 和工作空间智能体都会共享同一个智能体用量和额度池。请参阅“Codex 定价和用量限制”。
平均而言,每位开发人员每月 Codex 使用成本约为 100–200 美元,但实际费用差异较大,具体取决于所用模型、并发实例数量、自动化以及快速模式的使用情况。请参阅“合理利用费率限制、管控 Token 消耗的最佳实践”。
ChatGPT for Excel、PowerPoint 和工作空间智能体
注意:工作空间智能体、ChatGPT for Excel/Sheets 和 ChatGPT for PowerPoint 使用基于 Token 的定价。以下费率适用于 Business 和 Enterprise 套餐。
任务和运行不设固定的额度消耗。额度消耗取决于输入 Token 、缓存输入 Token 以及输出 Token 的组合使用情况。最终所消耗的额度会因任务复杂度、输入规模、缓存输入量以及输出长度而有所不同。
示例计算
如果一次 GPT-5.5 工作空间智能体运行使用了 20,000 个输入 Token、80,000 个缓存输入 Token 和 5,000 个输出 Token,则该运行大约会消耗 7.25 额度:
输入:20,000 / 1,000,000 × 125 = 2.5 额度。
缓存输入:80,000 / 1,000,000 × 12.50 = 1 额度。
输出:5,000 / 1,000,000 × 750 = 3.75 额度。
总计:7.25 额度。
ChatGPT for Excel/Sheets
| 模型 | 输入 Token(每 100 万 Token 的额度) | 缓存输入 Token(每 100 万 Token 的额度) | 输出 Token(每 100 万 Token 的额度) |
|---|---|---|---|
| GPT-5.6 | 100 额度 | 10 额度 | 500 额度 |
使用 GPT-5.5 执行典型的 ChatGPT for Excel/Sheets 任务时,每条消息可能消耗 5–20 额度。
ChatGPT for PowerPoint
| 模型 | 输入 Token(每 100 万 Token 的额度) | 缓存输入 Token(每 100 万 Token 的额度) | 输出 Token(每 100 万 Token 的额度) |
|---|---|---|---|
| GPT-5.6 | 100 额度 | 10 额度 | 500 额度 |
使用 GPT-5.5 执行典型的 ChatGPT for PowerPoint 任务时,每条消息可能消耗 10–50 额度。
ChatGPT 工作空间智能体
| 模型 | 输入 Token(每 100 万 Token 的额度) | 缓存输入 Token(每 100 万 Token 的额度) | 输出 Token(每 100 万 Token 的额度) |
|---|---|---|---|
| GPT-5.6 | 100 额度 | 10 额度 | 500 额度 |
搭载 GPT-5.6 的常规工作空间智能体端到端运行,单次大约消耗 5 至 25 额度。
ChatGPT Business 的费率限制说明
标准 ChatGPT Business 席位包含访问 ChatGPT 和 Codex 的权限。ChatGPT 工作、工作空间智能体、ChatGPT for Excel、ChatGPT for PowerPoint 和 Codex 的用量共享同一个智能体用量和额度池。在每项功能的定价生效后,可以使用灵活定价来扩展包含的限额。按使用量计费的 Codex 专属席位仅包含 Codex。参阅“什么是 ChatGPT Business?”,了解更多关于 Business 席位类型(包括 Codex 席位)的信息
ChatGPT 工作遵循与 Codex 相同的使用结构。由于 Codex 示例基于编程任务,ChatGPT 工作的使用方式会因任务而异。
ChatGPT Sites
ChatGPT 站点 (Sites) 已面向 Business 和 Enterprise 客户开放;在受支持的情况下,也支持公开发布。站点也计划在公开测试阶段推出更多付费套餐。定价信息即将公布。
桌面版 ChatGPT 语音
桌面版 ChatGPT 语音使用单独的连接分钟计量器。对于使用额度或按量付费的 ChatGPT Business、Edu 和 Enterprise 客户,语音连接时长预计每分钟约消耗 6 额度。
当语音功能启动 Codex 任务时,该任务也会按上述基于 Token 的费率,使用共享的 Codex 用量和额度池。语音时长和 Codex 任务工作量会分别计量。
如需了解当前套餐额度和更多详情,请参阅桌面版 ChatGPT 语音的定价与使用限制。
监控用量和管理额度
你可以在 Codex 设置中的用量下监控 Codex 和“工作”的用量限制。根据你的套餐和工作空间角色,你也可以在此查看剩余额度、购买额度或管理自动充值设置。如果你无法自行添加额度,请联系你的工作空间所有者或管理员。
实际额度用量会因所用模型、任务规模、输入与输出组合、自动化、快速模式以及并发 Codex 实例数量而异。
旧版费率卡
旧版 ChatGPT 模型
以下费率适用于旧版 ChatGPT 模型,并按每条消息的额度计费。
| 模型 | 计费单位 | 额度(近似值) |
|---|---|---|
| o3 | 1 条消息 | 10 额度 |
| o3-pro | 1 条消息 | 50 额度 |
| GPT-5.3 | 1 条消息 | N/A — 无限制 |
| GPT-5.4 Thinking mini | 1 条消息 | N/A — 无限制 |
| GPT-5.3 Pro | 1 条消息 | 50 额度 |
| GPT-5.3 Thinking | 1 条消息 | 10 额度 |
| GPT-5.4 Thinking | 1 条消息 | 10 额度 |
| GPT-5.4 Pro | 1 条消息 | 50 额度 |
| GPT-5.5 Instant | 1 条消息 | N/A — 无限制 |
| GPT-5.5 Thinking | 1 条消息 | 10 额度 |
一个提示词搭配一条回复,计为单条消息。无限制或几乎无限制的访问权限受滥用保护措施和任何特定模型使用限额的限制。为防止滥用,可能会实施临时限制措施。
旧版 Codex 费率卡
所有套餐的大多数新老客户均已切换至基于 Token 的额度定价模式,请使用上方的 ChatGPT 工作和 Codex 费率卡。少数 Enterprise 客户仍需沿用此旧版费率卡,直到其工作空间完成迁移。如需了解更多信息,请联系 OpenAI 销售团队。
旧版费率卡按照单条消息或单个合并请求 (Pull Request),给出 Codex 用量的平均额度估算值。实际额度用量会受任务体量、模型选择、推理需求影响产生浮动。
| 活动 | 计费单位 | GPT-5.6 Sol | GPT-5.6 Terra | GPT-5.6 Luna | GPT-5.5 Cyber | GPT-5.5 | GPT-5.4 |
|---|---|---|---|---|---|---|---|
| 本地任务 | 1 条消息 | 约 14 额度 | 约 6 额度 | 约 1 额度 | 约 56 额度 | 约 14 额度 | 约 7 额度 |
| 云任务 | 1 条消息 | 不可用 | 不可用 | 不可用 | 不可用 | 不可用 | 约 34 额度 |
| 代码审查 | 1 个 Pull Request(合并请求) | 不可用 | 不可用 | 不可用 | 不可用 | 不可用 | 约 34 额度 |
该平均额度同样适用于旧版 GPT-5.2、GPT-5.2-Codex、GPT-5.1、GPT-5.1-Codex-Max、GPT-5、GPT-5-Codex 和 GPT-5-Codex-Mini。
常见问题解答
我应该使用哪一版费率卡?
如果你的工作空间使用基于额度的灵活定价,请使用本文中的费率。如果你的 Enterprise 协议规定用量按美元计费,请使用协议中指定的费率卡,或参阅这篇帮助中心文章。少数 Enterprise 客户仍需沿用此旧版 Codex 费率卡,直到其工作空间完成迁移。如有疑问,请联系你的 OpenAI 代表或 OpenAI 销售团队。
为什么有些费率是固定的,而其他费率则采用基于 Token 的模式?
部分 ChatGPT 体验会按每条消息、每项任务、每次生成或每分钟消耗固定数量的额度。智能体产品和 Codex 按所使用的输入、缓存输入和输出 Token 计费,这会在模型活动与额度消耗之间建立直接对应关系。
选择更高的 ChatGPT 推理强度是否会提高消息费率?
否。“中”“高”和“极高”采用不同的推理强度,但均使用 GPT-5.6 Sol,每条消息均消耗 10 额度费率。
基于 Token 的定价会如何影响我的额度用量?
影响取决于你的工作负载组合。某些用户看到的额度消耗可能更高,而另一些用户看到的额度消耗可能更低,具体取决于输入、缓存输入和输出的使用量。输出量大的任务和快速模式,通常比轻量任务消耗更多额度。
