Explicação sobre os preços do GPT-5.5: planos, tokens e contexto

Explicação dos preços do GPT-5.5: Planos, tokens, contexto

Resposta rápida: Os preços da API GPT-5.5 começam em $5 por 1 milhão de tokens de entrada, $0,50 por 1 milhão de tokens de entrada armazenados em cache, e $30 por 1 milhão de tokens emitidos. O modelo suporta uma janela de contexto de 1.050.000 tokens e até 128.000 tokens de saída. O ponto importante a ser observado é que prompts com mais de 272.000 tokens de entrada geram taxas mais altas para toda a sessão.

O GPT-5.5 foi desenvolvido para tarefas exigentes de programação e trabalho profissional, mas seu preço não é um valor mensal fixo. Seu custo real depende de como você o utiliza, de quantos tokens você envia e recebe, se as entradas repetidas podem ser armazenadas em cache e se uma solicitação ultrapassa o limite de preço para contextos longos.

Este guia esclarece esses aspectos. Ele explica as tarifas dos tokens de API, os preços com base no contexto extenso, as opções Batch e Flex, exemplos práticos de custos e a diferença entre pagar por um plano de chat e pagar pelo uso da API.

Se você quiser usar o GPT-5.5 sem configurar o faturamento e o código para uma conta direta da API, GPT-5.5 sobre GlobalGPT oferece uma maneira mais simples de selecionar modelos. Além disso, permite manter outros modelos de IA na mesma plataforma, o que é útil quando um modelo de custo mais baixo é suficiente para parte do trabalho.

Quanto custa o GPT-5.5?

O plano OpenAI apresenta os preços do plano GPT-5.5 para tokens de texto por 1 milhão de tokens. O página oficial do modelo GPT-5.5 apresenta as seguintes taxas básicas:

Taxas básicas da API GPT-5.5

Tokens de entrada$5.00por 1 milhão de tokens
Entrada em cache$0.50por 1 milhão de tokens
Tokens de saída$30.00por 1 milhão de tokens

Fonte: Documentação dos modelos OpenAI e GPT-5.5, consultada em 3 de agosto de 2026. Prompts longos e o processamento regional podem alterar a taxa efetiva.

Tipo de tokenPreço base por 1 milhão de tokensO que está coberto
Entrada$5.00Sua solicitação, instruções do sistema, histórico de conversas, documentos, resultados das ferramentas e imagens inseridas após a tokenização.
Entrada em cache$0.50Conteúdo de prompt repetido elegível que o OpenAI reconhece por meio do armazenamento em cache de prompts.
Saída$30.00Tokens de resposta visíveis, além de tokens de raciocínio gerados pelo modelo, que são cobrados como saída.

A saída é seis vezes maior do que a taxa de entrada básica; portanto, respostas longas podem pesar bastante na conta. Um fluxo de trabalho que envia um documento extenso, mas solicita uma classificação breve, pode custar menos do que um prompt curto que gera um relatório muito longo.

Não confunda os preços da API com uma assinatura. Os valores acima correspondem às tarifas da API com medição de uso. Isso não significa que o plano GPT-5.5 custe $5 por mês, e uma assinatura do plano ChatGPT não inclui automaticamente créditos de API.

Planos e rotas de acesso da linha GPT-5.5

“A ”tarifação GPT-5.5” pode se referir a três formas diferentes de compra. Escolha a forma antes de comparar os números, pois cada uma delas mede o uso de maneira diferente.

Rota de acessoFormas de pagamentoIdeal paraLimitação principal
API da OpenAIUso de tokens medido, mais as taxas aplicáveis às ferramentasAplicativos, automações, agentes, sistemas de produção e desenvolvedores que precisam de controle de usoRequer configuração da API, faturamento e monitoramento de custos
Plano do ChatGPTAssinatura com limites de acesso e uso específicos do planoPessoas que querem uma interface de bate-papo pronta para usoA disponibilidade e os limites podem depender do plano atual, da conta, da região e da fase de implementação
GlobalGPTPlano de plataforma ou créditos de acordo com os termos atuais do GlobalGPTPessoas que desejam ter o GPT-5.5 e outros modelos em uma única interface, sem precisar configurar a API diretamenteOs créditos são uma métrica da plataforma e não devem ser tratados como dólares da API OpenAI

Processamento padrão da API

O processamento padrão é a base para a maioria das estimativas de custo da API. Utilize as taxas de entrada $5, de entrada em cache $0,50 e de saída $30, a menos que sua solicitação se enquadre em um nível de processamento diferente ou ultrapasse o limite de contexto longo.

API em lote

A API de processamento em lote do OpenAI foi projetada para tarefas assíncronas que não exigem uma resposta imediata. A página oficial de preços da API apresenta tarifas com desconto para tarefas em lote elegíveis. Isso pode ser uma boa opção para grandes avaliações offline, rotulagem de documentos, enriquecimento de dados ou processamento noturno, em que o prazo de entrega é flexível.

Processamento Flex

O processamento Flex sacrifica a consistência do tempo de resposta e a disponibilidade em troca de preços mais baixos. Ele é adequado para tarefas que não sejam de produção ou de baixa prioridade, que possam tolerar um processamento mais lento ou, ocasionalmente, indisponível.

Prioridade e processamento regional

O processamento prioritário tem um custo mais elevado, em troca de um nível de serviço de maior prioridade. O documento OpenAI também estabelece que os pontos finais de processamento regionais têm um acréscimo de 10% para GPT-5.5.

Como os tokens afetam sua conta GPT-5.5

Um token é um trecho de texto ou outro tipo de entrada no modelo. Não é o mesmo que uma palavra. Em textos em inglês, costuma haver, em média, mais de um token por palavra, quando se incluem pontuação, formatação, código, tabelas e caracteres especiais.

custo = (tokens de entrada / 1.000.000 × taxa de entrada) + (tokens de saída / 1.000.000 × taxa de saída)

A entrada em cache é calculada com uma tarifa separada. As chamadas de ferramentas podem acarretar cobranças adicionais; portanto, o cálculo dos tokens por si só pode não corresponder ao custo final da solicitação quando há pesquisa na web, uso do computador ou outra ferramenta paga envolvida.

O que se considera entrada e saída?

  • As entradas incluem prompts, instruções do sistema, histórico, documentos, resultados de ferramentas, dados estruturados e imagens após a tokenização.
  • A saída inclui a resposta gerada e os tokens de fundamentação faturáveis.
  • A entrada em cache abrange o conteúdo elegível de prompts repetidos, reconhecido por meio do armazenamento em cache de prompts.

Janela de contexto GPT-5.5 e o limite de preço de 272 mil

O GPT-5.5 suporta um Janela de contexto com 1.050.000 tokens e até 128.000 tokens emitidos. A janela de contexto é o espaço de trabalho total disponível para a solicitação, incluindo a entrada, o histórico relevante, os resultados das ferramentas e a saída gerada.

Quando um prompt GPT-5.5 contém mais de 272.000 tokens de entrada, a sessão completa é cobrada a 2 vezes a taxa de entrada normal e 1,5 vezes a taxa de produção normal. Nas taxas básicas, isso equivale a $10 por 1 milhão de tokens de entrada e $45 por 1 milhão de tokens de saída.

Aviso prático: Avalie a solicitação final montada, incluindo o conteúdo recuperado e o histórico, em vez do tamanho do arquivo inicial.

Exemplos de custos do GPT-5.5

Esses exemplos utilizam as tarifas básicas da API e não incluem chamadas a ferramentas pagas, reajustes regionais e multiplicadores de contexto longo, salvo indicação em contrário.

Calculadora de custos de tarefas GPT-5.5

Escolha uma carga de trabalho comum e, em seguida, mova um controle deslizante. A calculadora aplica automaticamente um perfil representativo de tokens por tarefa.

Redação ou reescrita de textos
Estimativa por tarefa: 4.000 tokens de entrada + 2.000 tokens de saída.
Custo por tarefa$0.08
Volume total de tokens600 mil
Custo total estimado$8.00

100 tarefas × ($0,02 de entrada GPT-5.5 + $0,06 de saída GPT-5.5) = $8,00

Os perfis de tokens de carga de trabalho são estimativas editoriais, e não garantias fixas de uso no formato OpenAI.

ExemploEntradaSaídaCusto estimado
Resposta profissional breve10,0002,000$0.11
Revisão de documentos extensos100,00010,000$0.80
Entrada repetida de 100 mil com acerto total no cache100.000 em cache10,000$0.35
Sessão de contexto longo acima de 272 mil300,00020,000$3.90

Como reduzir os custos do GPT-5.5

  1. Encaminhe os trabalhos simples para um modelo mais econômico.
  2. Sempre que possível, mantenha os prompts abaixo de 272 mil.
  3. Reutilize prefixos de prompt estáveis.
  4. Defina um limite de saída.
  5. Use o Batch para tarefas assíncronas.
  6. Acompanhe os tokens por tarefa.
  7. Custos separados com ferramentas.

Com GlobalGPT, você pode manter o GPT-5.5 disponível para trabalhos exigentes e escolher outro modelo quando a velocidade ou um menor consumo forem mais importantes.

Quem deve usar o GPT-5.5?

A opção GPT-5.5 faz mais sentido quando o custo de uma resposta menos completa é maior do que o preço do token adicional. Exemplos incluem alterações complexas no código, análises técnicas extensas, redação profissional complexa, uso de ferramentas em várias etapas e trabalho com documentos extensos.

Isso pode ser desnecessário para classificações simples, reescritas básicas, resumos curtos ou tarefas de grande volume com regras previsíveis.

Perguntas frequentes

Quanto custa GPT-5.5 por 1 milhão de tokens?

O preço base da API é de $5 por 1 milhão de tokens de entrada, $0,50 por 1 milhão de tokens de entrada armazenados em cache e $30 por 1 milhão de tokens de saída.

O GPT-5.5 está incluído no ChatGPT Plus?

Os limites de acesso e uso dos modelos podem variar de acordo com o plano, a conta, a região e a fase de implementação. Verifique a página do plano atualizada e seu seletor de modelos. As assinaturas do ChatGPT e o faturamento da API são separados.

O que é a janela de contexto do GPT-5.5?

O OpenAI especifica uma janela de contexto de 1.050.000 tokens e uma saída máxima de 128.000 tokens.

Por que o GPT-5.5 custa mais quando ultrapassa 272 mil tokens?

A entrada é cobrada a 2× e a saída a 1,5× durante toda a sessão, pois o processamento de contextos muito grandes exige mais recursos computacionais.

A assinatura ChatGPT inclui tokens de API?

As assinaturas do n.º ChatGPT e o uso da API são cobrados separadamente.

Os créditos GlobalGPT são iguais aos dólares da API OpenAI?

Os créditos do nº GlobalGPT seguem o plano e as regras de uso do próprio GlobalGPT.

Compartilhe a postagem:

Publicações relacionadas