快速回答: GPT-5.5 API 的起价为 每100万个输入代币为$5, 每100万个缓存的输入令牌为$0.50, 和 每100万个产出代币为$30. 该模型支持 1,050,000 个令牌的上下文窗口,并可生成最多 128,000 个输出令牌。需要注意的是,如果提示词的输入令牌数超过 272,000 个,整个会话的计费率将会提高。.
GPT-5.5 专为高要求的编码和专业工作而设计,但其价格并非固定的月费。您的实际成本取决于访问方式、发送和接收的令牌数量、重复输入是否可缓存,以及提示语是否超过了长上下文定价阈值。.
本指南对这些关键要素进行了详细说明。其中阐述了 API 令牌费率、长上下文定价、批量和灵活选项、实际成本示例,以及按聊天套餐付费与按 API 使用量付费之间的区别。.
如果您想使用 GPT-5.5,但又不想为直接 API 账户设置计费和代码,, GPT-5.5 位于 GlobalGPT 上 提供了一种更简便的模型选择途径。它还允许您在同一平台上保留其他人工智能模型,当部分任务仅需使用成本较低的模型时,这一功能便十分实用。.
目录
GPT-5.5 的价格是多少?
OpenAI 列出了 GPT-5.5 每 100 万个文本令牌的定价。该 GPT-5.5 官方型号页面 显示了以下基准率:
GPT-5.5 基准API费率
来源:OpenAI GPT-5.5 模型文档,查阅于 2026 年 8 月 3 日。长提示词和区域化处理可能会改变实际速率。.
| 代币类型 | 每100万枚代币的基础价格 | 涵盖内容 |
|---|---|---|
| 输入 | $5.00 | 您的提示、系统说明、对话记录、文档、工具结果以及经过分词处理后的图像输入。. |
| 缓存输入 | $0.50 | OpenAI 通过提示词缓存识别出的符合条件的重复提示内容。. |
| 输出 | $30.00 | 可见答案令牌以及作为输出计费的模型生成的推理令牌。. |
输出速度是基础输入速度的六倍,因此长篇回答可能会导致账单金额居高不下。相比之下,发送一份大文档但仅要求进行简短分类的工作流,其费用可能低于一个生成超长报告的小提示词。.
请不要将 API 价格与订阅混为一谈。. 上述数字是按使用量计费的 API 费率。这并不意味着 GPT-5.5 套餐的月费为 $5,而且 ChatGPT 订阅套餐也不会自动包含 API 积分。.
GPT-5.5 路线图及出行路线
“GPT-5.5定价”可指三种不同的购买方式。在比较数据之前,请先选择购买方式,因为每种方式对使用量的计算方式各不相同。.
| 前往路线 | 付款方式 | 最适合 | 主要限制 |
|---|---|---|---|
| OpenAI 应用程序接口 | 按计量计费的代币使用费,外加相应的工具费 | 应用程序、自动化流程、代理、生产系统以及需要使用控制功能的开发人员 | 需要进行 API 配置、计费和成本监控 |
| ChatGPT 计划 | 包含特定套餐访问和使用限制的订阅 | 希望使用现成聊天界面的用户 | 可用性和限制可能取决于当前套餐、账户、地区以及功能推出情况 |
| GlobalGPT | 根据 GlobalGPT 当前条款规定的平台计划或积分 | 希望在单一接口中同时使用 GPT-5.5 及其他型号,且无需直接配置 API 的用户 | “Credits”是平台层面的计量单位,不应被视为 OpenAI API 美元 |
标准API处理
标准处理是大多数 API 成本估算的基础。除非您的请求符合其他处理层级的条件或超过了长上下文阈值,否则请使用 $5 输入、$0.50 缓存输入和 $30 输出费率。.
批处理应用程序接口
OpenAI 的批处理 API 专为无需立即返回结果的异步操作而设计。该 官方 API 定价页面 列出了符合条件的批处理任务的折扣令牌费率。对于大型离线评估、文档标注、数据增强或夜间处理等场景,当处理周期较为灵活时,采用这种方式是合理的。.
Flex 处理
Flex 处理模式以牺牲响应时间的一致性和可用性为代价,从而实现更低的价格。它适用于非生产环境或低优先级的任务,这些任务能够容忍较慢的处理速度或偶尔出现的处理中断。.
优先处理与区域处理
优先处理的费用更高,但可获得更高优先级的服务等级。OpenAI还规定,区域处理端点在GPT-5.5基础上需额外支付10%的费用。.
代币如何影响您的GPT-5.5账单
“令牌”是指一段文本或其他模型输入。它与“单词”不同。在将标点符号、格式、代码、表格和特殊字符都计算在内后,英语文本中平均每个单词往往包含多个令牌。.
成本 = (输入代币 / 1,000,000 × 输入费率) + (输出代币 / 1,000,000 × 输出费率)
缓存输入按其独立费率进行计算。工具调用可能会产生额外费用,因此当涉及网络搜索、计算机使用或其他付费工具时,仅凭代币计算得出的结果可能与最终请求费用不符。.
什么算作输入和输出?
- 输入包括提示、系统指令、历史记录、文档、工具结果、结构化数据以及经过分词处理后的图像输入。.
- 输出内容包括生成的回复和可计费的推理令牌。.
- 缓存的输入涵盖了通过提示缓存识别出的符合条件的重复提示内容。.
GPT-5.5 上下文窗口与 272K 定价阈值
GPT-5.5 支持一个 1 050 000 个令牌上下文窗口 和高达 128,000 个输出代币. 上下文窗口是请求可用的全部工作空间,包括输入、相关历史记录、工具结果以及生成的输出。.
当一个 GPT-5.5 提示词包含的输入令牌超过 272,000 个时,整个会话将按 正常输入速率的2倍 和 正常输出率的1.5倍. 按基础费率计算,每100万个输入代币的费用为$10,每100万个输出代币的费用为$45。.
实用提示: 应测量最终组装好的请求(包括检索到的内容和历史记录),而不是最初的文件大小。.
GPT-5.5 成本示例
除非另有说明,这些示例均采用基础 API 费率,且不包括付费工具调用、区域加成以及长上下文系数。.
GPT-5.5 任务成本计算器
选择一个常见的工作负载,然后移动其中一个滑块。计算器会自动应用一个具有代表性的每任务令牌配置文件。.
每项任务的预估数据量:4,000 个输入令牌 + 2,000 个输出令牌。.
100 项任务 × ($0.02 × GPT-5.5 输入 + $0.06 × GPT-5.5 输出) = $8.00
工作负载令牌配置文件仅为编辑估算值,并非对 OpenAI 使用的固定保证。.
| 示例 | 输入 | 输出 | 估计费用 |
|---|---|---|---|
| 简短的专业回答 | 10,000 | 2,000 | $0.11 |
| 大规模文件审查 | 100,000 | 10,000 | $0.80 |
| 在缓存完全命中情况下重复输入100K次 | 100,000 已缓存 | 10,000 | $0.35 |
| 长上下文会话超过 272K | 300,000 | 20,000 | $3.90 |
如何降低GPT-5.5的成本
- 将简单的工作分配给成本更低的模式。.
- 在可行的情况下,请将提示词控制在272K以内。.
- 重复使用稳定的提示词前缀。.
- 设置输出限制。.
- 请使用 Batch 处理异步任务。.
- 按任务跟踪令牌。.
- 单独计算模具费用。.
与 GlobalGPT, 您可以将 GPT-5.5 留作高负荷工作之用,而在更注重速度或使用频率较低的情况下,则可选择其他机型。.
哪些人适合使用 GPT-5.5?
当较差答案的成本高于额外代币的价格时,GPT-5.5 才是最合理的选择。例如:复杂的代码修改、冗长的技术分析、难度较高的专业写作、多步骤工具使用以及处理大篇幅文档等工作。.
对于简单的分类、基础改写、简短摘要,或是具有可预测规则的大量任务,这可能并不必要。.
常见问题
100万个代币对应的GPT-5.5是多少?
API的基础价格为:每100万个输入代币收取$5,每100万个缓存输入代币收取$0.50,每100万个输出代币收取$30。.
GPT-5.5 是否包含在 ChatGPT Plus 中?
模型的访问和使用限制可能会因套餐、账户、地区和发布版本而异。请查看实时套餐页面和您的模型选择器。ChatGPT 订阅与 API 计费是分开的。.
什么是 GPT-5.5 上下文窗口?
OpenAI 指定了 1,050,000 个令牌的上下文窗口和 128,000 个令牌的最大输出。.
为什么在超过 272K 个代币后,GPT-5.5 的价格会更高?
由于处理超大上下文需要更多的计算资源,因此整个会话期间,输入的计费标准为2倍,输出的计费标准为1.5倍。.
ChatGPT 订阅是否包含 API 令牌?
No. ChatGPT 的订阅和 API 使用费用将分别计费。.
GlobalGPT积分与OpenAI API美元是一样的吗?
No. GlobalGPT 积分遵循 GlobalGPT 自身的计划和使用规则。.




