Suscripción y facturación
📚 Navegación de la serie: El artículo anterior 03 Instalación y login guió la instalación de Codex y el inicio de sesión con cuenta de ChatGPT o API key. Este capítulo detalla los costes: qué plan suscribir, cómo se consume el saldo, el funcionamiento de las API keys y cómo optimizar el uso de tu cuota.
Muchos dicen que «basta con suscribirse a ChatGPT Plus para usar Codex sin pensar», pero a decir verdad, la facturación de Codex no es tan simple como suscribirse y usarlo ilimitadamente.
A principios de 2026, cuando integré por primera vez Codex en mi flujo de trabajo, cometí ese error: pensé que los 20 dólares al mes de Plus eran una especie de «tarifa plana para Codex». Al día siguiente, tras pedirle que realizara una refactorización en un proyecto heredado de decenas de miles de líneas de código, me topé con el límite por la tarde: la CLI me mostró el aviso «la cuota para esta ventana de tiempo se ha agotado». Me sorprendió haber agotado el límite diario con solo unas pocas decenas de preguntas. Más tarde lo entendí: el límite de Codex no se calcula por «número de preguntas», sino por el «volumen de tokens consumidos en cada pregunta»; mis decenas de preguntas consistían en «lectura de archivos grandes + tareas largas», donde cada una consumía el equivalente a diez consultas sencillas.
Para complicarlo más, Codex ofrece dos lógicas de facturación totalmente distintas para la misma herramienta: si inicias sesión con tu cuenta de ChatGPT, sigues el modelo de «suscripción + cuota»; si inicias sesión con tu API key, se te cobra «por token consumido en tiempo real». Al mezclarse ambos esquemas, los principiantes suelen confundirse.
En este artículo explicaremos con detalle ambos esquemas. Comprender las reglas de facturación es mucho más importante que decidir qué suscripción elegir; con una misma cuenta Plus, un usuario experimentado tendrá suficiente para todo el mes, mientras que uno inexperto puede agotar la cuota en dos días.
Al leer este artículo, obtendrás:
- Una tabla comparativa de «Suscripciones de ChatGPT vs API key» para saber qué camino tomar.
- Comprensión de las dos lógicas de facturación (cuota de uso de la suscripción vs pago por token de la API key).
- Cómo usar el comando
/statusen la CLI para comprobar en cualquier momento «cuánta cuota de uso te queda». - Una serie de hábitos recomendados para optimizar el consumo de tokens, logrando realizar el mismo trabajo consumiendo una fracción de los tokens.
⚠️ Los costes y límites están sujetos a cambios: los precios específicos, los límites de cuota y el coste por millón de tokens incluidos en este texto corresponden a un momento específico de la página de tarifas oficial de Codex; OpenAI ajusta los costes y límites con frecuencia, por lo que debes verificar siempre los precios vigentes en el sitio oficial antes de adquirir una suscripción.
01 Conceptos básicos: ¿Por qué estás pagando?
Para ir directo al grano: la herramienta de Codex en sí es gratuita; lo que pagas es la «capacidad de cómputo del modelo» asociada.
Codex es simplemente un ejecutable de terminal (junto con la aplicación de escritorio, la extensión de IDE y la interfaz web), cuya descarga e instalación es gratuita. El coste se genera al consumir los modelos de la serie GPT en segundo plano: cada vez que preguntas, dejas que lea un archivo o dejas que escriba código, el texto se envía a los servidores para ser procesado por el modelo, y este volumen de procesamiento es la unidad de facturación.
Analogía: Codex es una aplicación de taxi gratuita, y el modelo es el vehículo que realiza el trayecto. Instalar la app y registrarse es gratis, pero en cuanto pides un viaje, se te cobrará por cada kilómetro recorrido; cuanto más preguntes, más archivos lea y más tiempo pase analizando, más largo será el «trayecto».
La unidad de medida de este «trayecto» es el token (la unidad mínima en la que el modelo descompone el texto para procesarlo). Analogía: los tokens son el «número de palabras facturables» de tu texto. Al enviar texto al modelo, este se descompone en tokens: lo que envías cuenta como «tokens de entrada» y lo que el modelo responde cuenta como «tokens de salida», siendo los tokens de salida notablemente más caros.
Ejemplos cotidianos de consumo silencioso de tokens:
- Pedirle «lee este archivo de 2000 líneas y aplícale cambios» → el archivo completo se convierte en tokens de entrada.
- Mantener una conversación larga de 50 mensajes → las 49 respuestas anteriores se reenvían al modelo como contexto en cada pregunta.
- Tener un archivo
AGENTS.md(el manual del proyecto) extenso y detallado en la raíz → se incluye en el contexto de cada mensaje enviado.
Por ello, el coste no depende del número de preguntas realizadas, sino del volumen de contexto enviado en cada consulta; esta regla es la clave para optimizar tu consumo.
💡 Resumen en una frase: La herramienta es gratuita; pagas el consumo del modelo medido en tokens (entrada, salida y contexto acumulado).
02 Dos esquemas de facturación: Suscripción de ChatGPT vs API key
Una vez comprendido el pago por tokens, la siguiente pregunta es: ¿a través de qué canal se realiza el pago? Codex ofrece dos vías con diferencias notables; consulta la tabla comparativa:
| Característica | Inicio de sesión con ChatGPT | Inicio de sesión con API key |
|---|---|---|
| Esquema de cobro | Tarifa mensual fija; incluye una cuota de uso, con opción de adquirir créditos si se agota | Sin tarifa mensual; pago por uso real medido en tokens |
| Previsibilidad de coste | Coste fijo controlado y predecible al mes | Variable; pagas lo que consumes, el coste se conoce al final del periodo |
| Funciones en la nube (revisión de código, Slack, GitHub, etc.) | ✅ Disponibles | ❌ No disponibles |
| Acceso a nuevos modelos | Disponibilidad inmediata | Acceso retrasado (los modelos más recientes se habilitan más tarde) |
| Perfil recomendado | Desarrolladores individuales para uso diario intensivo con coste fijo | Scripts automatizados, flujos en CI/CD y entornos compartidos |
| Método de acceso | Ejecutar codex login y autorizar la cuenta en el navegador | Ejecutar codex login y seleccionar el acceso por API key |
(Fuente: documentación oficial de tarifas y autenticación de Codex)
La elección entre ambas vías no depende de «cuál es más barata», sino de «cómo utilizas la herramienta»:
La suscripción de ChatGPT es la opción idónea para la mayoría de los desarrolladores individuales. Si ya dispones de un plan Plus o Pro, Codex está incluido dentro de los límites de la suscripción, evitando configurar tarjetas adicionales o vigilar facturas de consumo; si agotas la cuota de la ventana de tiempo, puedes adquirir créditos adicionales para continuar. Las integraciones en la nube (como las revisiones automáticas en GitHub o la integración con Slack) solo están disponibles a través de esta vía.
Las API keys están diseñadas para automatizaciones e integraciones de sistemas, no para el uso diario interactivo. Se recomienda su uso en entornos de automatización como flujos de CI/CD, donde la CLI se ejecuta de forma desatendida y el coste se factura directamente según el volumen de tokens consumido. La desventaja es que se pierden las funciones en la nube y el acceso a los modelos más recientes se retrasa. Si programas de forma interactiva en tu máquina, utilizar una API key suele resultar menos conveniente y ofrece menos funciones.
Facturación con API key: el consumo se factura en tu cuenta de OpenAI Platform según las tarifas de API estándar, siendo un saldo independiente de las cuotas de suscripción de ChatGPT. Consulta los costes por token en la página de tarifas de la API de OpenAI.
Mi flujo de trabajo: uso la cuenta de ChatGPT para programar de forma interactiva en la terminal, y reservo las API keys para ejecutar tareas automatizadas en CI o scripts desatendidos. Así mantengo los costes organizados y optimizados.
💡 Resumen en una frase: Suscripción para programar interactivamente, API key para automatizaciones; la suscripción ofrece previsión de coste y funciones en la nube, mientras que la API key facilita la automatización con pago por uso real.
03 Selección del plan de ChatGPT: Plus / Pro / Business / Enterprise
Si optas por el acceso mediante suscripción, debes seleccionar un plan. A continuación comparamos los planes oficiales que incluyen el acceso a Codex:

El gráfico compara las capacidades de Codex en los planes Plus, Pro, Business, Enterprise & Edu, y mediante acceso por API key. Detallamos las diferencias:
| Plan | Tarifa mensual (referencia) | Volumen de uso de Codex (relativo) | Características clave | Perfil recomendado |
|---|---|---|---|---|
| Plus | $20/mes | Cuota base | Acceso en web, CLI, IDE y móvil; funciones en la nube (GitHub, Slack) y acceso a modelos recientes | Desarrolladores individuales para proyectos estándar |
| Pro | Desde $100/mes | 5 o 20 veces la cuota de Plus | Todo lo de Plus junto con acceso a un modelo rápido dedicado para desarrollo diario (vista previa) | Desarrolladores intensivos que usan la CLI constantemente |
| Business | Pago por uso (Pay as you go) | Similar a Plus; ampliable mediante créditos | Gestión de miembros del equipo, entornos de nube ampliados, SSO/MFA y privacidad de datos (sin entrenamiento) | Startups y equipos de desarrollo medianos |
| Enterprise & Edu | Consultar con ventas | Tarifas a medida según el volumen de uso | Todo lo de Business junto con prioridad de procesamiento, SCIM/RBAC y auditorías de seguridad | Despliegues a nivel corporativo u organizativo |
(Fuente: página de tarifas oficial de Codex)
Detalles adicionales sobre cada plan:
Plus ($20) es la opción de inicio recomendada. Ofrece acceso a todas las interfaces (web, CLI, extensiones de IDE y móvil), las funciones en la nube y acceso inmediato a los modelos de última generación. El único factor a vigilar es si el límite de cuota es suficiente para tu volumen de trabajo; en proyectos grandes, es posible agotar la cuota rápidamente.
Pro (desde $100) destaca por su volumen de cuota ampliado. La documentación oficial indica que ofrece «entre 5 y 20 veces» la cuota de uso de Plus, además de un modelo de desarrollo rápido optimizado para programación diaria (en fase de vista previa). Es el plan recomendado para quienes agotan la cuota de Plus con frecuencia y prefieren no comprar créditos individuales. En mi caso, preferí optimizar mi consumo de tokens con las prácticas de la sección 05 antes de optar por subir al plan Pro, logrando trabajar cómodamente en el plan Plus. Aprende a optimizar antes de ampliar tu suscripción.
Business / Enterprise & Edu están orientados a organizaciones. Business introduce la gestión de equipos y el pago por uso a nivel de grupo; Enterprise añade cumplimiento de seguridad, prioridad en peticiones y almacenamiento de datos corporativo. No son necesarios para desarrolladores individuales.
¿Qué ocurre con los planes Free y Go?
Muchos se preguntan: ¿se puede utilizar Codex con las cuentas gratuitas (Free) o de acceso básico (Go) de ChatGPT?
La documentación de tarifas no detalla estas opciones. Según las tarifas vigentes, el plan de entrada con acceso oficial garantizado a Codex es ChatGPT Plus ($20); el plan Free solo se menciona para indicar que ciertas capacidades avanzadas no están incluidas de forma gratuita.
Mi recomendación:
Analogía: Es como el acceso de cortesía frente a la suscripción mensual de un gimnasio. El acceso de cortesía te permite ver las instalaciones, pero para usar las máquinas de forma regular necesitas la suscripción. Las capacidades de programación de Codex se reservan para los planes Plus o superiores.
- No consideres los planes Free o Go para programar de forma regular con Codex, ya que no disponen de cuota oficial asignada.
- Para realizar pruebas básicas, la función de previsualización en la web de Codex es gratuita, lo que te permite evaluar la interfaz antes de suscribirte, pero no es equivalente a usar la CLI para programar localmente.
- La disponibilidad en los planes Free y Go está sujeta a cambios de política de OpenAI; consulta las condiciones actualizadas en chatgpt.com/pricing.
💡 Resumen en una frase: Plus es la opción inicial para particulares, Pro para uso intensivo y Business o Enterprise para equipos; los planes Free y Go no garantizan cuota de uso para Codex, por lo que te aconsejamos consultar las condiciones oficiales vigentes.
04 Cálculo de la cuota: Ventana de 5 horas y créditos de ampliación
Esta es la sección que más suele confundir, y la razón por la que agoté mi cuota en dos días al principio. Explicamos el funcionamiento del límite y el uso de los créditos.
Límite calculado en una «ventana rodante de 5 horas»
Las cuotas de uso de Codex se dividen en mensajes locales (Local Messages) y tareas en la nube (Cloud Tasks), las cuales comparten el límite en una ventana rodante de 5 horas. Esto significa que la cuota se mide en periodos de 5 horas en lugar de reiniciarse al final del día. (Los límites semanales también pueden aplicarse según las directivas del servicio).
Además, la cuota de mensajes no es un número fijo, sino un rango. Para el plan Plus, por ejemplo, se indica una cuota de «entre 15 y 80 mensajes locales para GPT-5.5 en un periodo de 5 horas». ¿Por qué varía tanto? La documentación oficial lo explica:
El volumen de mensajes disponibles depende del modelo seleccionado, el tamaño y complejidad de la tarea de programación, y si ejecutas la tarea localmente o en la nube. Las tareas sencillas o pequeños scripts consumen una fracción mínima de la cuota, mientras que las bases de código extensas, tareas de larga duración o sesiones que requieran mantener un contexto de conversación amplio consumirán una cantidad de cuota notablemente mayor por cada mensaje enviado.
Esto aclara por qué agoté mi cuota con unas decenas de mensajes: mis consultas eran complejas y analizaban una gran base de código, por lo que consumieron la cuota rápidamente. En tareas sencillas puedes realizar muchas consultas, mientras que en tareas de refactorización complejas el límite puede alcanzarse con pocos mensajes.
Comparativa de cuotas por plan
Valores de referencia oficiales para el modelo GPT-5.5 en mensajes locales por ventana de 5 horas (sujetos a cambios):
| Plan | Mensajes locales GPT-5.5 / 5 horas (Referencia) |
|---|---|
| Plus | 15–80 mensajes |
| Pro (5x) | 80–400 mensajes |
| Pro (20x) | 300–1600 mensajes |
| Business | 15–80 mensajes (ampliable mediante créditos) |
(Fuente: tarifas oficiales de Codex; los modelos GPT-5.4 o GPT-5.4-mini ofrecen límites de cuota superiores al consumir menos recursos).
Un detalle importante para optimizar el coste: si utilizas modelos más ligeros (como GPT-5.4-mini), tu cuota de mensajes disponibles se multiplicará. Veremos esto en la sección 05.
Créditos de ampliación si agotas la cuota
Si agotas tu cuota de uso, no necesitas cambiar de plan inmediatamente. Puedes adquirir créditos de uso (credits) para continuar trabajando:
Los usuarios de los planes ChatGPT Plus y Pro que alcancen su límite de cuota pueden adquirir créditos adicionales para continuar con su trabajo sin necesidad de contratar un plan superior.
Analogía: Los créditos funcionan como los bonos de datos extra en tu tarifa móvil. Si agotas los datos de tu suscripción mensual, no necesitas cambiar a una tarifa superior permanente; adquieres un bono de datos extra para terminar el mes. En los planes Business, Enterprise y Edu, esto equivale a añadir créditos de espacio de trabajo.
El coste de los créditos se calcula según el consumo de tokens; la página oficial de tarifas indica el coste por millón de tokens consumido. Como referencia de volumen:
GPT-5.5 consume de media entre 5 y 45 créditos por cada mensaje enviado.
Considera esta escala de «5 a 45 créditos por mensaje» como referencia; los costes específicos por millón de tokens y por modelo deben verificarse en la tabla de tarifas vigente de OpenAI.
💡 Resumen en una frase: La cuota de uso se calcula en periodos rodantes de 5 horas y varía según el modelo y la complejidad; si trabajas con bases de código grandes, la cuota se consume más rápido. Si agotas el límite, puedes adquirir créditos de uso adicionales para continuar sin cambiar de plan.
05 Optimizar la cuota: Buenas prácticas oficiales para reducir el uso de tokens
Cambiar a planes superiores no es la única solución; aprender a optimizar el uso de la herramienta es más efectivo. Como vimos en la sección 01, el consumo de cuota está directamente relacionado con el volumen de contexto enviado. A continuación detallamos cuatro recomendaciones oficiales para hacer que tu cuota rinda más:
Primero: Sé específico en tus instrucciones y reduce el contexto innecesario. La documentación oficial aconseja «dar instrucciones precisas a Codex y evitar enviarle archivos o contexto irrelevante». Cuanto más vaga sea la petición, más archivos del directorio intentará analizar para interpretar tu intención, consumiendo tokens. Tras optimizar mis peticiones, empecé a escribir instrucciones como «modifica la función login en src/auth.ts para añadir validación de formato de correo», reduciendo las búsquedas innecesarias del agente.
Segundo: Optimiza el tamaño de tu archivo AGENTS.md. Dado que este archivo contiene las reglas globales del proyecto, se incluye en el contexto de cada mensaje que envías. La documentación oficial aconseja estructurarlo de forma modular en proyectos grandes (creando archivos AGENTS.md específicos en subcarpetas del proyecto) en lugar de mantener un único archivo de cientos de líneas en la raíz. Al reducir mi archivo raíz a unas pocas decenas de líneas, el consumo de tokens por mensaje disminuyó notablemente.
Tercero: Activa solo los servidores MCP necesarios. Cada servidor MCP conectado añade la descripción de sus herramientas al contexto de cada consulta, consumiendo cuota. La documentación sugiere desactivar los servidores MCP que no estés utilizando para optimizar el uso de tokens.
Cuarto: Utiliza modelos ligeros para tareas estándar. La documentación indica que «seleccionar los modelos GPT-5.4 o GPT-5.4-mini permite extender tu cuota de mensajes disponibles». Como vimos en la sección 04, los límites de cuota para estos modelos son significativamente mayores. Para tareas de depuración sencillas o refactorizaciones básicas, cambia al modelo ligero con el comando /model; reserva los modelos avanzados para problemas complejos.
Tabla de hábitos recomendados para optimizar la cuota:
| Práctica ineficiente ❌ | Práctica recomendada ✅ | Beneficio en el consumo |
|---|---|---|
| «Mejora el rendimiento de este proyecto» | «Modifica login en src/auth.ts para validar la entrada» | Evita búsquedas y lecturas de archivos innecesarias |
Mantener un archivo AGENTS.md de cientos de líneas en la raíz | Mantenerlo conciso y usar archivos específicos en subcarpetas | Reduce los tokens de contexto en cada mensaje |
| Tener múltiples servidores MCP conectados constantemente | Conectarlos solo cuando se necesiten y desactivarlos al terminar | Evita añadir descripciones de herramientas irrelevantes |
| Usar siempre el modelo avanzado | Usar GPT-5.4-mini para tareas rutinarias | Multiplica la cantidad de mensajes disponibles |
Un consejo práctico para la CLI: si cambias de tarea o tema, utiliza el comando /new. El comando /new inicia una nueva conversación y «limpia el contexto acumulado» (ver guía de comandos de la CLI); de lo contrario, si mantienes la misma conversación todo el día, cada consulta de la tarde reenviará todos los mensajes de la mañana, consumiendo cuota innecesariamente.
💡 Resumen en una frase: Optimizar la cuota no requiere planes caros, sino aplicar buenas prácticas: instrucciones específicas, modular el archivo
AGENTS.md, limitar los servidores MCP activos, usar modelos ligeros para tareas básicas y reiniciar el contexto con/newal cambiar de tarea.
06 Práctica: Supervisar tu consumo en la CLI
Supervisemos tu consumo ejecutando unas comprobaciones básicas en la terminal para familiarizarte con el uso de la cuota.
Requisitos previos: tener Codex instalado y con la sesión iniciada (mediante suscripción de ChatGPT o API key). Si utilizas cuenta de ChatGPT, recuerda verificar tu conexión de red para la comunicación en la nube; para el acceso local con API key, comprueba la conexión con la API de OpenAI.
Abre la terminal en el directorio del proyecto e inicia Codex:
codexPaso 1: Usar /status para verificar el estado de la sesión. En el prompt de Codex, ejecuta:
/statusEl resultado mostrará el modelo activo, la política de aprobación, los directorios autorizados y el volumen de contexto consumido en la sesión actual. Para los planes de suscripción, la CLI también muestra la cuota restante:
Para comprobar la cuota disponible durante una sesión de la CLI de Codex, puedes ejecutar el comando
/status.
Presta atención a dos parámetros: el modelo activo (para no usar el modelo avanzado en tareas sencillas) y la cuota restante.
Paso 2: Realizar una consulta y comprobar la variación. Envía una instrucción básica:
Enumera los archivos de esta carpeta y explica brevemente qué contiene este proyecto.Una vez completada la respuesta, ejecuta de nuevo /status para comprobar cuánto ha aumentado el consumo de contexto. Esto representa el coste básico de analizar la estructura de un proyecto sencillo; te servirá de referencia para estimar el consumo en tareas mayores.
Paso 3: Cambiar de modelo. Ejecuta /model para ver los modelos disponibles (el comando permite alternar de modelo durante la sesión):
/modelSelecciona un modelo ligero (como GPT-5.4-mini) para las tareas rutinarias de desarrollo para prolongar la duración de tu cuota. También puedes definir el modelo al iniciar la CLI desde la terminal:
codex --model gpt-5.5(Los modelos disponibles en el parámetro --model dependen de los permisos de tu cuenta; puedes consultarlos ejecutando /status).
Paso 4 (Usuarios de suscripción): Consultar el panel de uso web. El comando /status detalla el estado de la sesión actual; para consultar el consumo acumulado de tus dispositivos y la cuota mensual, visita el panel de uso oficial:
https://chatgpt.com/codex/settings/usage(El panel muestra la información centralizada de tu consumo de Codex).
Usuarios de API key: vuestro consumo no se refleja en este panel; podeís consultar la facturación y el uso de tokens en el panel de control de OpenAI Platform (platform.openai.com). No obstante, las prácticas de usar
/statuspara vigilar el contexto y/newpara limpiar la sesión son igualmente recomendadas para optimizar el coste de la API.
Con estas comprobaciones, sabrás cómo supervisar tu consumo y gestionar tu cuota de forma activa.
💡 Resumen en una frase: Usa
/statuspara supervisar la cuota y el contexto → cambia a modelos ligeros con/modelpara ahorrar → consulta el panel web para el consumo global; así mantendrás el control de tus costes de desarrollo.
07 Resumen
En este capítulo hemos detallado la estructura de costes de Codex:
| Concepto | Detalle clave |
|---|---|
| Facturación | La herramienta es gratuita; se factura el consumo de tokens de los modelos |
| Esquemas de cobro | Cuenta de ChatGPT para uso personal (cuotas y créditos); API key para automatizaciones (pago por token consumido) |
| Planes de suscripción | Plus para uso individual general; Pro para uso intensivo; Business y Enterprise para equipos y organizaciones |
| Cálculo de cuota | Basado en una ventana rodante de 5 horas y varía según la complejidad; ampliable mediante créditos de uso |
| Optimización | Instrucciones concisas, modular el AGENTS.md, desactivar MCP inactivos, usar modelos ligeros y limpiar contexto con /new |
La regla principal a recordar: el coste de uso depende del volumen de contexto acumulado en la sesión, no del número de preguntas realizadas. Aplicar buenas prácticas de optimización de contexto, supervisar el uso con /status y reiniciar la sesión con /new te permitirá trabajar con presupuestos reducidos y optimizar tu cuota de desarrollo.
⚠️ Nota sobre precios: recordamos que los costes de suscripción, límites de cuota y tarifas de tokens pueden variar; consúltalos en la página de tarifas oficial de Codex o en chatgpt.com/pricing. Los comandos y parámetros de la CLI deben consultarse con codex --help según la versión instalada.
Una vez comprendidos los costes e instalada la herramienta, si resides en regiones con limitaciones de acceso a los servicios de OpenAI o prefieres utilizar modelos locales de menor coste, el próximo capítulo 05 · Conectar modelos de terceros como DeepSeek te guiará para integrar APIs de proveedores como DeepSeek, Kimi o GLM en Codex, permitiéndote ejecutar el agente sin depender de una cuenta de OpenAI.