OpenAI
页面内容为机器翻译。查看英文原文。

ChatGPT 费率表(企业版 Token 定价)

了解聊天、ChatGPT 工作和 Codex 中 ChatGPT 模型与功能的 Token 费率如何计算。

更新于:3 hours ago
注意:本价目表适用于符合条件的 Enterprise 按 Token 计费协议。对于从按额度计费转出的工作空间,只有在计费模式变更后,才适用这些费率。费率以美元(USD)表示;除非列出了其他计费单位,否则输入、缓存输入和输出 Token 均按每百万 Token 计费。有关适用费率、折扣和其他商务条款,请参阅您的协议。

概述

本价目表涵盖聊天、工作和 Codex 中的模型及功能定价。有关计费模式及其与按额度计费协议的比较,请参阅: ChatGPT Enterprise 按 Token 计费。

采用按额度计费套餐的客户请参阅 ChatGPT 价目表(按额度计费)。如果对您的套餐有疑问,请联系您的 OpenAI 代表。

根据这些 Enterprise 协议,即时档位的用量按适用费率计费,并享有协议中约定的折扣。

什么是 Token?

Token 是 OpenAI 模型处理和生成信息的基本单位。按 Token 计费时,用量分为输入 Token、缓存输入 Token 和输出 Token。总费用的计算方式为:根据所用模型和功能的适用费率,分别计算各类 Token 的费用,再将这些费用相加。您可以 在此了解 Token 的计算方式。

聊天模型

价格单位为美元/百万 Token。

模型输入缓存输入输出
GPT-6 Pro(GPT-6 Astra)$10.00$1.00$50.00
GPT-5.6 Sol$4.00$0.40$20.00
GPT-Rosalind-Research$5.00$0.50$25.00
GPT-5.5$5.00$0.50$30.00
GPT-5.5 Pro$30.00不适用$180.00
GPT-5.3$1.75$0.175$14.00
  • 价格分别按每百万输入、缓存输入和输出 Token 表示。这些费率取代了此前按模型和消息数量计算的 ChatGPT 消息费率。在聊天中发送的消息将按 Token 用量和所用模型计费,从而统一所有产品界面的用量定价。

  • 单个请求的总费用计算如下:费用 =(输入 Token 数 / 1,000,000 × 输入费率)+(缓存输入 Token 数 / 1,000,000 × 缓存输入费率)+(输出 Token 数 / 1,000,000 × 输出费率)

  • 表中列出的 GPT-5.6 费率涵盖以下推理强度档位:即时、中、高,以及极高和 Pro。选择更高的推理强度不会提高费率。

  • GPT-Rosalind-Research 仅适用于部分 Enterprise 套餐。了解更多。

ChatGPT 工作和 Codex 模型

GPT-6.1 Sol、GPT-6 Sol 和 GPT-6 Luna 是用于 ChatGPT 工作和 Codex 的模型。这些模型在聊天中不可用。

注意:GPT-5.6 Sol 的优惠定价至少持续至 2026 年 11 月 21 日。此优惠适用于以美元结算的按 Token 计费用量,不适用于原有计量方式。套餐内用量、5 小时和每周限额以及原有额度费率均保持不变。

价格单位为美元/百万 Token。以下费率适用于标准模式。

模型输入缓存输入输出
GPT-6 Astra$10.00$1.00$50.00
GPT-6.1 Sol$2.00$0.10$10.00
GPT-6 Sol$2.00$0.20$10.00
GPT-6 Luna$0.10$0.01$0.50
GPT-5.6 Sol$4.00$0.40$20.00
GPT-5.6 Terra$2.00$0.20$12.00
GPT-5.6 Luna$0.20$0.02$1.20
GPT-Rosalind-Research$5.00$0.50$25.00
GPT-5.5$5.00$0.50$30.00
Daybreak Blue(GPT-5.6 Sol)$4.00$0.40$20.00
Daybreak Red$12.50$1.25$75.00
GPT-5.3-Codex$1.75$0.175$14.00
GPT-5.2$1.75$0.175$14.00
GPT-6 Astra Law *$12.50$1.25$62.50

这些费率适用于 ChatGPT 工作和 Codex 支持的活动,包括本地任务、云端任务、自动化、代码审查、自动审查以及受委派的执行器。费用根据所用模型以及实际消耗的输入、缓存输入和输出 Token 计算。

图像生成、语音、网页搜索、长上下文、快速模式和区域处理可能产生单独或额外的费用,具体如下所述。

* Astra for Law 仅通过 可信访问向美国部分获选律师事务所开放。

注意:

  • 除非另有说明,价格适用于指定模型支持的所有推理级别(轻量、中、高、极高、Ultra)。

  • 按每百万 Token 的费率计算 Token 费用:

Token 费用 =(输入 Token 数 / 1,000,000 × 输入费率)+(缓存输入 Token 数 / 1,000,000 × 缓存输入费率)+(输出 Token 数 / 1,000,000 × 输出费率)

其他适用的功能费用和附加费用将按下文说明另行加计。

  • 使用 Daybreak 需通过 OpenAI Daybreak/网络安全可信访问计划的审批。在 Daybreak Blue 中使用 GPT-5.6 Sol 时,按 GPT-5.6 Sol 的费率计费。Daybreak Red 需要单独审批和开通。

  • 代码审查使用 GPT-5.3-Codex。

  • 自动审查使用 GPT-5.6 Luna。

  • GPT-Rosalind-Research 仅适用于部分 Enterprise 套餐。了解更多。

功能可用性和费率适用范围

除非相应部分另有说明,在聊天、工作和 Codex 中,凡是可使用所列功能的场景,均适用以下功能费率。单个请求可能同时产生模型 Token 费用和单独的功能费用。

ChatGPT 核心功能

深度研究

价格单位为美元/百万 Token。

模型输入缓存输入输出
o4-mini-deep-research$2.00$0.50$8.00

图像

在 ChatGPT、工作和 Codex 中,凡是可使用 GPT-Image-2.0 的场景,均适用以下图像生成费率。

价格单位为美元/百万 Token。

模型输入缓存输入输出
GPT-Image-2.0(图像)$8.00$2.00$30.00
GPT-Image-2.0(文本)$5.00$1.25-

图像生成用量以 Token 计量,总费用根据输入文本 Token、编辑图像时的输入图像 Token,以及图像输出 Token 计算。图像输出 Token 用量随请求的尺寸和质量而变化;包含参考图像的编辑操作可能需要额外的输入 Token。尺寸更大或质量更高的图像通常会消耗更多 Token,不过 Token 用量也会因分辨率而异。如需估算图像生成费用,请使用图像生成指南中的 计算器。

语音

功能费率
聊天中的语音$0.05/分钟+ 后端模型按 Token 费率另行计费。
桌面端语音$0.05/分钟+ 后端模型按 Token 费率另行计费。

连接时长(分钟)与模型活动分别计量。因此,一次语音会话可能同时产生连接时长费用,以及后端模型和任何受委派执行器的 Token 费用。

网页搜索

功能费率
网页搜索(所有模型)$10.00/千次网页搜索+ 搜索内容 Token 按模型费率另行计费。
网页图像搜索(所有模型)$10.00/千次网页搜索+ 搜索内容 Token 按模型费率另行计费。

适用于 Word、Excel/Sheets 和 PowerPoint 的 ChatGPT

这些功能按所用输入、缓存输入和输出 Token 的数量,以 API 模型费率计费。费率适用于各项功能支持的模型。

标准费率(单位:美元/百万 Token):

模型输入缓存输入输出
GPT-5.6 Luna$0.20$0.02$1.20
GPT-5.6 Terra$2.00$0.20$12.00
GPT-5.6 Sol$4.00$0.40$20.00
GPT-6 Astra$10.00$1.00$50.00

在 GPT-5.6 Sol 可用的情况下,它将作为默认模型。模型的可用性取决于你所在的地区和工作空间设置。工作空间管理员可以启用或禁用各个模型的访问权限。

Codex、ChatGPT 工作、Word、Excel、PowerPoint 和工作空间智能体按本文中相应的模型及功能费率计费;如果你的套餐支持,这些功能将共用智能体用量。

ChatGPT 工作空间智能体

价格单位为美元/百万 Token。

模型输入缓存输入输出
GPT-5.6 Sol$4.00$0.40$20.00

Codex、ChatGPT 工作、ChatGPT for Excel、ChatGPT for PowerPoint 和工作空间智能体的用量,均按本文中适用的模型和功能费率计费。

请注意,如果您的套餐包含这些产品,它们将共用同一份智能体用量。

附加费用和费率倍数

除标准模型费率外,还可能适用以下费用和费率倍数。

功能费率
长上下文输入 Token 数 >272K输入:标准费率的 2 倍缓存输入:标准费率的 2 倍输出:标准费率的 1.5 倍
快速和超快速模式仅限 Codex 和工作模式;更多详情请参阅速度说明。快速模式 — GPT-6.1 Sol、GPT-6 Astra、GPT-6 Sol 和 GPT-6 Luna:在可用的情况下,按标准美元 Token 费率的 2 倍计费(Enterprise 按量付费)。GPT-5.6:在快速模式可用的情况下,按标准费率的 2 倍计费。GPT-5.5:在快速模式可用的情况下,按标准费率的 2 倍计费。GPT-6 Astra 超快速模式:在 Enterprise 按 Token 计费套餐下,按 GPT-6 Astra 标准美元 Token 费率的 6 倍计费。符合条件的 Enterprise 工作空间可在 ChatGPT 工作和 Codex 中使用,具体以工作空间协议为准。与同一模型的标准模式相比,快速模式消耗订阅内用量的速度为 2.5 倍,GPT-6 Astra 超快速模式则为 8 倍。这些倍数描述的是订阅内用量的消耗速度,而非处理速度的提升幅度。
区域处理(数据驻留)有关支持的区域和处理详情,请参阅 您的数据指南。标准费率的 1.1 倍

注意:

  • GPT-5.6 和 GPT-5.5 在工作和 Codex 中支持长上下文。聊天选项卡不支持长上下文。

GPT-6 Astra — Codex 长上下文计费例外

在 Codex 中使用 GPT-6 Astra 时,即使输入超过 272K Token,也不会额外应用长上下文费率倍数。Codex 不对缓存写入收费。

监控用量和管理费用

您可以在 全局管理控制台中监控 Codex 用量。有关速率限制和减少 Token 消耗的信息,请参阅 Codex 定价和用量限额以及 管理 Token 消耗的最佳实践。

实际费用会因所用模型、任务规模、输入与输出的比例、自动化、快速模式以及并发 Codex 实例数而有所不同。

有关工作空间预算和用户限额,请参阅: 管理 ChatGPT Enterprise 和 Edu 中的用量限额和超额用量。

这篇文章对你有帮助吗?