Assinatura e Tarifação
📚 Navegação da Série: O artigo anterior 03 Instalação e Login guiou a configuração do Codex e o login com conta ChatGPT ou chave de API. Este artigo detalha as opções de cobrança — qual assinatura escolher, como os créditos são consumidos, as particularidades das chaves de API e boas práticas para estender a durabilidade de suas cotas.
Muitos dizem que "basta assinar o ChatGPT Plus para usar o Codex sem limites", mas o modelo de tarifação do Codex não se resume a uma simples assinatura mensal.
No início de 2026, logo ao integrar o Codex ao meu fluxo de trabalho, cometi esse erro: presumi que a assinatura Plus de US$ 20 por mês cobria o "uso ilimitado do Codex". No entanto, após dois dias seguidos solicitando refatorações em um repositório legado com dezenas de milhares de linhas, atingi a cota de uso. O terminal CLI exibiu a mensagem de limite de cota atingido. Fiquei confuso, pois havia enviado apenas algumas dezenas de prompts por dia. Mais tarde compreendi: o limite do Codex é baseado no volume de tokens processados por mensagem, não na quantidade bruta de mensagens, meus prompts de alteração de arquivos consumiram muitos recursos por envolverem leitura e escrita de múltiplos arquivos longos.
O ecossistema divide-se em dois modelos tarifários distintos: a autenticação via conta do ChatGPT consome o pacote de assinaturas e cotas locais; já a autenticação via chaves de API consome créditos sob demanda cobrados por tokens consumidos. Misturar esses fluxos confunde iniciantes.
Neste artigo, detalharemos as regras e estruturas desses dois modelos. Compreender as diretrizes tarifárias é mais produtivo do que debater qual assinatura escolher — o mesmo plano Plus pode durar um mês para quem segue boas práticas, ou expirar em dois dias sob prompts ineficientes.
Ao terminar de ler este artigo, você terá:
- Uma tabela comparativa entre os planos do ChatGPT e chaves de API, ajudando a escolher a melhor opção
- Entendimento claro sobre o modelo de cotas das assinaturas e a cobrança sob demanda via chaves de API
- A utilização do comando
/statusna CLI para monitorar as cotas em tempo real - Um conjunto de boas práticas homologadas para economizar tokens em suas tarefas
⚠️ Aviso de atualizações de preços e cotas: Valores, limites e custos de tokens citados baseiam-se na documentação oficial de pricing ativa no momento da escrita deste manual. A OpenAI atualiza tabelas tarifárias continuamente. Sempre verifique o portal oficial para consultar taxas vigentes.
01 Compreendendo os Custos: O que está sendo cobrado?
Direto ao ponto: o assistente do Codex é de uso gratuito; os custos derivam estritamente do processamento de tokens conduzido pelos modelos de IA integrados.
A CLI, as extensões e os aplicativos desktop do Codex não possuem taxas de download ou licenças. Os custos reais ocorrem no acionamento dos modelos GPT integrados — leituras de diretórios, refatorações e interpretações de prompts exigem envio e resposta de dados estruturados para a API da OpenAI. Esse volume de processamento dita o valor da cobrança.
Analogia: aplicativo de corridas gratuito e motoristas parceiros. O download e o cadastro do app são gratuitos, mas ao realizar viagens, você paga pelo deslocamento físico do veículo — quanto mais longa a distância, maior o custo. No Codex, prompts complexos que exigem ler múltiplos arquivos e gerar códigos extensos equivalem a viagens de longa distância.
O consumo de dados é mensurado em tokens (unidades de texto processadas por modelos de linguagem). Pense nos tokens como palavras cobradas em telegramas. Os inputs enviados à IA constituem "tokens de entrada" e os retornos gerados equivalem a "tokens de saída" (estando a taxa de saída sujeita a custos maiores de computação).
Cenários comuns de alto consumo de tokens:
- Solicitar que o agente "leia e refatore um arquivo longo de 2000 linhas" — o arquivo completo é convertido em tokens de entrada enviados no prompt
- Manter uma conversa ativa por dezenas de mensagens — as dezenas de interações anteriores são reenviadas continuamente como contexto no histórico
- Alojar um arquivo
AGENTS.mdprolixo na raiz do projeto — o arquivo de onboarding é incluído como contexto de inicialização em cada nova interação da sessão
Por isso, o consumo final está atrelado ao volume de contexto carregado nas chamadas, e não ao número bruto de prompts enviados. Guardar esse conceito facilita o controle de custos posteriormente.
💡 Resumo em uma frase: A CLI é gratuita; você paga pela computação dos modelos medida em tokens (inputs, outputs e histórico de contextos acumulados).
02 Dois Modelos Tarifários: Assinaturas versus Chaves de API
Definidos os direcionadores de custos, resta saber como efetuar os pagamentos. O Codex divide-se em duas abordagens independentes de cobrança:
| Indicador técnico | Login via Assinatura ChatGPT | Login via Chave de API |
|---|---|---|
| Modelo de cobrança | Mensalidade fixa com cotas inclusas; créditos extras para uso excedente | Sem assinatura fixa; tarifado estritamente por tokens consumidos sob demanda |
| Controle de gastos | Custo previsível com limite de gastos controlado no mês | Valor flutuante conforme consumo; cobranças conhecidas no fechamento do período |
| Recursos em nuvem (Auditorias de repositórios, Slack, GitHub) | ✅ Disponível | ❌ Indisponível na maioria das rotas |
| Acesso a modelos recentes | Acesso imediato no lançamento | Distribuição tardia |
| Cenário de uso ideal | Desenvolvimento individual interativo diário com previsibilidade de custos | Automações, scripts em servidores locais e integração contínua (CI/CD) |
| Método de login | codex login no terminal escolhendo autenticação via conta do ChatGPT | codex login no terminal escolhendo chave de API |
(Fonte: Documentação oficial de pricing e auth do Codex)
A decisão não depende de qual modelo é "mais barato", mas sim do perfil de uso. Detalhamos abaixo:
Assinatura do ChatGPT atende ao desenvolvedor individual. Caso já possua os planos Plus ou Pro, as cotas do Codex estão inclusas no pacote, eliminando a necessidade de registrar cartões extras ou monitorar cobranças dinâmicas. O acesso a integrações de nuvem (como pipelines de auditoria automáticas no GitHub e Slack) exige esse perfil de login.
Chaves de API são indicadas para execuções automatizadas e pipelines de CI/CD. Rodar a CLI em scripts locais tarifará as chamadas diretamente na conta de desenvolvedor do portal da OpenAI, de forma flexível e programática, mas desabilita recursos visuais e retarda o acesso aos modelos mais novos. Para uso diário, priorize o login por assinatura.
Detalhes tarifários das chaves de API: o processamento consome os preços padrão da OpenAI Platform. As tabelas de cotas de assinatura del ChatGPT não se aplicam a essa rota. Consulte as tarifas vigentes em API pricing.
A prática recomendada consiste em: desenvolvimento interativo no terminal usa a assinatura do ChatGPT; execuções secundárias programadas ou pipelines em servidores usam chaves de API.
💡 Resumo em uma frase: Humanos usam a assinatura; sistemas automatizados usam chaves de API. A assinatura garante previsibilidade e recursos visuais; chaves de API agilizam execuções programáticas.
03 Escolhendo a Assinatura do ChatGPT: Plus, Pro, Business ou Enterprise
Mapeamos as opções de planos oficiais do ChatGPT que incluem acesso aos recursos do Codex:

| Plano | Valor mensal (base) | Cota do Codex | Recursos inclusos | Perfil indicado |
|---|---|---|---|---|
| Plus | US$ 20 / mês | Cota padrão base | Acesso via CLI, IDEs, web e mobile; auditorias em nuvem integradas ao GitHub e Slack; modelos recentes | Desenvolvedores independentes e uso pessoal |
| Pro | A partir de US$ 100 / mês | 5 a 20 vezes a cota do Plus | Todos os recursos do Plus; acesso exclusivo a modelos rápidos (versões preview) | Desenvolvedores avançados e uso intensivo diário |
| Business | Faturamento flexível sob demanda | Cota base equivalente ao Plus (expansível via créditos) | Painel corporativo de usuários, instâncias em nuvem expandidas, SSO/MFA, políticas rígidas de privacidade de dados | Equipes de engenharia e startups |
| Enterprise & Edu | Sob consulta comercial | Alocação dinâmica adaptável | Recursos do Business; prioridade de computação, auditorias completas de segurança, residência de dados locais | Grandes empresas e instituições |
(Fonte: Portal oficial de pricing do Codex)
Detalhamento dos perfis de uso de cada plano:
O plano Plus (US$ 20) atende a maior parte das necessidades individuais de desenvolvimento. Fornece acesso às extensões de IDEs, CLI e integrações com GitHub/Slack. A restrição principal reside no limite das cotas mensais de processamento de tokens, detalhado na próxima seção.
O plano Pro (US$ 100+) destaca-se pela ampliação das cotas de processamento (5 a 20 vezes o limite do Plus), além de conceder acesso antecipado a builds rápidas de modelos. É indicado para profissionais que batem frequentemente no teto do Plus e preferem evitar compras de pacotes de créditos extras. Recomenda-se focar primeiro nas práticas de economia de tokens antes de fazer o upgrade.
Os planos Business e Enterprise & Edu são voltados para times e empresas, adicionando recursos de segurança corporativa (como SSO e auditorias), priorização de tráfego e conformidade regulatória. Não são necessários para desenvolvedores individuais.
E quanto aos planos Free e Go?
É comum surgir a dúvida sobre a viabilidade de usar o Codex nos planos Free (Gratuito) ou Go (Entrada).
A documentação oficial do Codex não detalha cotas de uso para contas Free ou Go. O plano Plus de US$ 20 é listado como o requisito mínimo estável de entrada para desenvolvimento comercial. Contas gratuitas podem ter acessos restritos ou bloqueados.
Nossa recomendação para esses cenários:
Analogia: passes livres de academia e mensalidades normais. O passe livre permite conhecer a recepção do espaço, mas o acesso aos treinos e orientações exige a matrícula. O Codex exige o plano Plus ou superior para desenvolvimento local estável.
- Evite basear fluxos de trabalho diários em perfis Free ou Go devido à falta de garantias de cotas na documentação.
- Para testar os recursos sem custos, utilize o portal web de visualização de projetos (Sites), que oferece testes básicos durante fases promocionais.
- Verifique a descrição técnica atualizada de planos no portal de preços chatgpt.com/pricing antes de assinar, evitando guias de terceiros desatualizados.
💡 Resumo em uma frase: Desenvolvedores individuais iniciam no Plus; faça o upgrade para o Pro se bater no teto frequentemente; equipes adotam planos Business. Não conte com suporte estável em contas Free ou Go.
04 Gerenciamento de Limites: Ciclo de 5 horas e pacotes de recarga
Atingir o limite de cotas decorre da incompreensão de como as chamadas são contabilizadas no console local. Detalhamos as regras abaixo:
Cotas calculadas em ciclos móveis de 5 horas
As cotas de processamento dividem-se em Local Messages (interações na CLI) e Cloud Tasks (tarefas em nuvem), ambas compartilhando o mesmo intervalo dinâmico de 5 horas (conforme documentação de pricing). A renovação de cotas ocorre de forma contínua a cada bloco de 5 horas, e não em horários fixos do dia.
O limite de mensagens é exibido como um intervalo dinâmico, não como um número fixo. Por exemplo, a cota do Plus para o modelo GPT-5.5 é descrita como "15 a 80 mensagens a cada 5 horas". Essa variação se justifica pelo seguinte fator:
"A quantidade de mensagens disponíveis depende do modelo utilizado, do escopo e da complexidade da tarefa de programação e se as execuções ocorrem localmente ou em nuvem. Alterações simples consomem poucos recursos da cota; refatorações extensas em grandes bases de código, que exigem processamento de grandes contextos de arquivos, consomem muito mais créditos da cota." (traduzido de documentação oficial de pricing).
Isto explica como um desenvolvedor atinge o limite do Plus rapidamente em refatorações complexas. Interações em scripts enxutos consomem menos recursos do que varreduras em repositórios inteiros.
Comparativo de limites por plano
Limites padrão para o modelo GPT-5.5 em ciclos de 5 horas (apenas para referência conceitual):
| Plano | Volume de mensagens locais no GPT-5.5 (ciclo de 5 horas) |
|---|---|
| Plus | 15 a 80 interações |
| Pro (5x) | 80 a 400 interações |
| Pro (20x) | 300 a 1600 interações |
| Business | 15 a 80 interações (expansível via recarga de créditos) |
(Fonte: Tabela oficial de pricing; o uso de modelos secundários como GPT-5.4-mini eleva esses limites significativamente no mesmo plano.)
A regra de dimensionamento indica: desenvolver tarefas secundárias utilizando modelos leves (como o GPT-5.4-mini) prolonga a duração das cotas da sessão. Abordaremos essa prática na Seção 05.
Esgotamento de Cotas: Compra de Créditos
Se atingir o limite temporário, não é necessário fazer upgrade imediato de plano. O portal oferece a compra avulsa de créditos (credits):
"Usuários dos planos ChatGPT Plus e Pro que atingirem seus limites de cota podem adquirir créditos adicionais para continuar desenvolvendo sem precisar alterar o plano assinado." (traduzido da documentação de pricing).
Analogia: pacotes de dados avulsos de internet móvel. O plano mensal fornece a franquia padrão de dados; caso expire antes do ciclo de renovação, basta adquirir um pacote avulso temporário de dados para continuar navegando sem migrar para assinaturas caras. O mesmo se aplica a equipes nos planos Business.
O consumo de créditos avulsos é mensurado por tokens processados. A tabela de taxas da OpenAI especifica os créditos gastos por milhão de tokens, fornecendo uma estimativa de consumo médio por prompt:
"Uma interação padrão no modelo GPT-5.5 consome em média entre 5 e 45 créditos." (traduzido da tabela de taxas oficial).
Utilize a taxa média de "5 a 45 créditos por mensagem" para planejar seus gastos. Consulte os valores atualizados de taxas por modelo no portal oficial.
💡 Resumo em uma frase: Os limites operam em ciclos de 5 horas e variam de acordo com a complexidade do repositório. Projetos extensos esgotam as cotas mais rápido. Adquira créditos avulsos para continuar desenvolvendo caso atinja o limite.
05 Práticas Recomendadas: Otimização do consumo de tokens
Reduzir o consumo de tokens depende de como estruturamos os prompts e o contexto do repositório. As recomendações abaixo baseiam-se na documentação oficial de otimização de cotas do Codex:
1. Prompts explícitos e escopo delimitado: A documentação oficial orienta a "fornecer instruções precisas, removendo contextos irrelevantes". Instruções vagas forçam o agente a vasculhar múltiplos arquivos do repositório para inferir os requisitos, gerando alto consumo de tokens de entrada. Prefira: "Refatore a função login em src/auth.ts para adicionar validação de e-mail", em vez de prompts genéricos.
2. Mantenha o arquivo AGENTS.md enxuto: A CLI lê as regras do AGENTS.md e as insere como contexto inicial em cada chamada. Para repositórios complexos, fracione o manual criando diretórios com regras locais específicas (colocando pequenos arquivos AGENTS.md nas subpastas) em vez de manter um único arquivo longo na raiz.
3. Gerencie a inicialização de servidores MCP: Cada servidor MCP (protocolo de contexto) ativo anexa suas especificações e descrições na inicialização do prompt. Mantenha ativos apenas os utilitários MCP estritamente necessários para a tarefa atual.
4. Use modelos leves para tarefas básicas: A documentação oficial indica que a adoção de modelos leves prolonga consideravelmente os limites operacionais da sessão. Alterne para versões menores da linha GPT-5.4-mini via comando /model para executar manutenções simples, reservando os modelos avançados para refatorações estruturais.
Guia de referência rápida para otimização de cotas:
| Prática Ineficiente ❌ | Prática Recomendada ✅ | Impacto no consumo |
|---|---|---|
| Prompts vagos (ex: "melhore o código deste arquivo") | Prompts direcionados (ex: "adicione validação de campos na função save em user.ts ") | Reduz a leitura de arquivos desnecessários pelo agente |
Manter arquivos AGENTS.md longos na raiz | Fracionar convenções por diretórios e enxugar o manual | Diminui o volume de tokens injetado a cada prompt |
| Deixar múltiplos servidores MCP ativos | Inicializar ferramentas MCP apenas quando solicitadas | Evita carregar especificações de plugins não utilizados no contexto |
| Executar tarefas simples no modelo mais avançado | Mudar para o GPT-5.4-mini para correções rápidas | Aumenta o limite de chamadas disponíveis na cota do plano |
Dica prática de terminal: use o comando /new para inicializar novas tarefas. O comando limpa o histórico de chat da sessão sem fechar a CLI, evitando reenviar logs de erros de depurações antigas no contexto dos prompts subsequentes.
💡 Resumo em uma frase: A economia de cotas depende de prompts direcionados, arquivos
AGENTS.mdcurtos, controle de plugins MCP, uso de modelos leves para tarefas simples e uso de/newpara redefinir o contexto.
06 Prática: Monitorando o consumo no terminal CLI
Execute os passos a seguir no terminal para validar as configurações de cotas ativas no seu projeto.
Pré-requisito: Certifique-se de que a CLI do Codex esteja configurada e autenticada (conforme Seção 06). Proxies de rede devem estar ativos caso haja restrições locais de acesso aos servidores.
Abra a CLI no diretório do projeto:
codexPasso 1: Consulte as informações da sessão com /status
/statusO comando exibe o modelo ativo, a política de aprovações do sandbox, permissões de gravação de caminhos e consumo de tokens da conversa ativa. O status de cotas restantes também é listado na saída do comando.
"Para verificar as cotas restantes durante uma sessão ativa da CLI do Codex, execute o comando
/status." (traduzido da documentação oficial de pricing).
Valide as chaves do modelo em execução e o volume de cotas disponíveis para evitar bloqueios inesperados durante o desenvolvimento.
Passo 2: Execute um prompt básico e compare o consumo
看看当前目录下有哪些文件,简单说下这个项目是干嘛的Após o retorno da IA, chame novamente o /status para comparar a variação de tokens processados. Esse teste dá uma métrica base de quanto cada interação simples consome das suas cotas.
Passo 3: Alterne o modelo para tarefas secundárias
Use o comando /model para exibir a lista de modelos de linguagem homologados na sua conta:
/modelSelecione uma build leve (como o GPT-5.4-mini) para depurações simples para prolongar as cotas. Também é possível forçar o modelo na chamada inicial do terminal:
codex --model gpt-5.5(Consulte as tags de modelos homologadas no seu perfil por meio de /status antes de rodar o comando).
Passo 4: Acesse o painel web de uso (Assinaturas)
Para consultar o consumo consolidado de múltiplos dispositivos, acesse o dashboard oficial de consumo:
https://chatgpt.com/codex/settings/usage(Fonte: Rota de monitoramento indicada na documentação oficial: Codex usage dashboard.)
Contas utilizando chaves de API: o consumo não é exibido no link acima. Verifique os relatórios no console da OpenAI Platform (platform.openai.com). De todo modo, utilize o
/statuspara monitorar o consumo local.
Adotar essa rotina de auditoria dá controle total dos custos e da eficiência da sua sessão local.
💡 Resumo em uma frase: Monitore o consumo local com
/status, use/modelpara alternar modelos e acompanhe o painel de uso web para controle financeiro total.
07 Resumo
Este capítulo consolidou as regras tarifárias do Codex:
| Conceito central | Definição resumida |
|---|---|
| Direcionadores de custos | A CLI é gratuita; a tarifação deriva do processamento de tokens conduzido pelos modelos (inputs/outputs) |
| Modelos de cobrança | Assinatura do ChatGPT (cotas recorrentes com recargas avulsas); Chaves de API (tarifado sob demanda por token consumido) |
| Planos recomendados | Plus atende ao uso individual diário; migre para o Pro sob alto consumo; Business atende a equipes |
| Cálculo de cotas | Ciclos de 5 horas baseados no tamanho do repositório; esgotamentos são compensados com créditos adicionais |
| Práticas de economia | Prompts direcionados, arquivos AGENTS.md curtos, servidores MCP inativos por padrão, modelos leves e uso de /new |
Mensagem principal a reter: O consumo financeiro está atrelado ao volume de contexto injetado no prompt, e não ao número de mensagens enviadas no chat. Otimizar os arquivos locais e a especificidade do prompt garante economia e durabilidade das cotas.
⚠️ Observação final: Valores de planos, taxas de créditos e limites de cotas descritos neste manual estão substituídos por alterações contínuas pela OpenAI. Sempre consulte pricing e chatgpt.com/pricing para valores atualizados. Funcionalidades de comandos como /status, /model e /new dependem de atualizações da build ativa da CLI.
Alinhados os custos da ferramenta, abordaremos o uso de APIs alternativas e provedores terceiros de modelos. No próximo artigo 05 · Conectando Modelos Nacionais e o DeepSeek, detalharemos como integrar serviços como o DeepSeek ao Codex, eliminando a dependência direta de contas da OpenAI para a execução local.