Skip to content

Conociendo Codex y sus cuatro entradas

📚 Navegación de la serie: Este es el primer artículo introductorio del "Tutorial para principiantes de Codex". Sin necesitar ninguna base, empezaremos explicando "qué es exactamente Codex". En el siguiente artículo, <02 Vistazo rápido a los conceptos clave>, aclararemos la terminología de una vez por todas.


Qué es Codex, para qué sirve cada una de sus cuatro entradas y en qué se diferencia realmente de ChatGPT y Claude Code.

Amigos, en este tutorial hablaremos de Codex de OpenAI.

Codex, ¿les suena familiar el nombre? OpenAI ya tenía un modelo antiguo llamado Codex hace un par de años. Si abres su sitio web oficial, te confundirás aún más: ¿por qué hay una App de escritorio, una línea de comandos, una extensión de navegador y también una versión Web en la nube? ¿Cuál es el "Codex original"? ¿Cuál debería instalar?

Para ser sinceros, aquí es exactamente donde Codex confunde más a los principiantes: no es "un solo software", sino el mismo agente de programación de IA (Agent) con cuatro caras diferentes. Si no tienes claro esto, te quedarás atascado pensando "cuál debería descargar".

En este artículo no te enseñaré a instalarlo ni a escribir comandos (eso será en el artículo 03). Solo haré una cosa: explicarte claramente "qué es Codex, de qué se encarga cada una de sus cuatro caras y en qué se diferencia de ChatGPT y Claude Code", para que primero tengas un mapa mental. Una vez que tengas el mapa, sabrás exactamente cuál instalar y usar más adelante.

Después de leer este artículo, obtendrás:

  • Una frase para explicar claramente a otros "qué es Codex", sin dejarte llevar por el nombre.
  • Una tabla comparativa de las cuatro entradas (App de escritorio / CLI / extensión de IDE / Web en la nube), para saber desde cuál deberías entrar tú.
  • Un conjunto de criterios para juzgar: en qué se diferencia Codex de ChatGPT y de Claude Code, para no confundirlos más.
  • Una acción pequeña de coste cero, para comprobar en 30 segundos si tu ordenador lo reconoce.

Las cuatro entradas de Codex: App de escritorio / CLI / extensión de IDE / Web en la nube, interconectadas con la misma cuenta

Esta imagen muestra de un vistazo el núcleo de todo el artículo: la App de escritorio, la CLI de línea de comandos, la extensión de IDE y la Web en la nube son las cuatro caras de Codex: se ven diferentes y se ubican en lugares distintos, pero detrás hay una misma cuenta y un mismo agente Codex conectándolo todo.


01 ¿Qué es exactamente Codex?

Primero, la conclusión: Codex es el "agente de programación de IA" oficial de OpenAI; le das un objetivo y puede leer todo tu proyecto, modificar archivos directamente, ejecutar comandos, ejecutar pruebas y entregarte el trabajo terminado para que lo revises, en lugar de simplemente responderte con un fragmento de código en una ventana de chat.

Seguro que conoces OpenAI, es la empresa que creó ChatGPT. Codex es su herramienta diseñada específicamente para el escenario de "escribir código". Según la documentación oficial, el trabajo que realiza es principalmente de este tipo (estas líneas equivalen a su "lista de capacidades", familiarízate con ellas ahora y las detallaremos en el artículo 02):

  • Escribir código: Tú describes lo que quieres y él genera el código siguiendo la estructura y el estilo que ya tiene tu proyecto, sin lanzarte un fragmento de código aislado.
  • Entender bases de código desconocidas: Al tomar un proyecto antiguo sin documentación, puedes pedirle primero que te "explique la arquitectura de este proyecto", lo cual es mucho más rápido que intentar entenderlo por tu cuenta.
  • Revisar código: Te ayuda a encontrar posibles bugs, casos extremos olvidados y errores lógicos.
  • Depurar y corregir (Debugging): Pásale un mensaje de error y él rastreará la causa raíz a lo largo del código, la localizará y te dará un parche de corrección.
  • Automatizar tareas rutinarias: Tareas repetitivas como refactorizar, añadir pruebas, hacer migraciones o configurar entornos, se pueden delegar con una sola frase.

Aquí hay una diferencia clave en la que los principiantes suelen tropezar, la destacaré por separado:

Analogía: Buscar una receta (ChatGPT) vs. Contratar un chef privado en casa (Codex). Cuando usas ChatGPT para escribir código, es como buscar una receta: te dice "para este plato pon sal, azúcar y saltea por tres minutos", pero el que tiene que mover la sartén eres tú: copiar el código, volver al editor, pegarlo, arreglar los errores, todo es trabajo manual tuyo. Codex es diferente, es como un cocinero que entra directamente en tu cocina: le dices "quiero comer esto" y él mismo busca en la nevera (lee archivos), enciende el fuego (ejecuta comandos) y te sirve el plato terminado en la mesa (modifica el código y pasa las pruebas), tú solo tienes que probarlo y dar tu aprobación.

Esta diferencia llevada a la práctica resulta en una experiencia completamente distinta.

Por ejemplo, un caso propio. En marzo de este año retomé un pequeño web scraper en Python que llevaba aparcado más de medio año, las dependencias estaban caducadas y al ejecutarlo daba un montón de errores. Si fuera antes, tendría que haber copiado los errores uno por uno a ChatGPT, él me diría "podría ser un problema de versión de alguna biblioteca", yo volvería a comprobar, cambiar, ejecutar de nuevo... Habría perdido toda una tarde cambiando de ventana. Esta vez, abrí Codex directamente en el directorio del proyecto y le dije: "este proyecto ya no funciona, busca la causa raíz y arréglalo para que funcione". Él mismo revisó requirements.txt y la pila de errores, localizó dos dependencias incompatibles, cambió los números de versión y lo ejecutó de nuevo para confirmarlo. Fui a servirme un café y al volver, ya me estaba esperando para que revisara el diff.

Con esto se puede comprender el peso de la palabra "Agente (Agent, una IA capaz de ejecutar tareas de forma autónoma)": no está para darte ideas, está para meter las manos y hacer el trabajo por ti.

💡 Resumen en una frase: Codex = el agente de programación de IA oficial de OpenAI; le das un objetivo y él lo ejecuta, no es "una ventana de chat que sabe escribir código".


02 Cuatro caras: un mismo Codex, cuatro entradas

Esto es en lo que Codex es más diferente a muchas otras herramientas y también lo que más suele confundir a la gente, así que nos centraremos en ello.

Al mencionar "línea de comandos" o "terminal", a muchos principiantes les viene de inmediato a la cabeza una ventana negra que los espanta. No te asustes; de hecho, Codex es una de las herramientas de programación de IA más amigables para "los que no quieren tocar la línea de comandos", porque ha creado específicamente una App de escritorio con interfaz gráfica.

Según la documentación oficial, Codex tiene en total cuatro entradas, puedes acceder por cualquiera de ellas:

EntradaCómo se veDónde se ejecutaPara quién / Para qué escenario es ideal
App de escritorio (Codex app)Aplicación independiente, interfaz gráfica, permite ver el diff visualmente, ejecuta múltiples tareas en paraleloEn tu máquina localPersonas que no quieren tocar la línea de comandos, prefieren hacer clic en interfaces y necesitan vigilar varias tareas a la vez
CLI de línea de comandos (Codex CLI)Herramienta de línea de comandos que se usa escribiendo codex en la terminalEn tu máquina localPersonas acostumbradas a la terminal, que necesitan escribir scripts para automatización, o que trabajan en servidores / SSH
Extensión de IDE (IDE extension)Plugin en la barra lateral de VS Code / Cursor / Windsurf / JetBrainsEn tu máquina localPersonas que se pasan el día escribiendo código en el editor
Web en la nube (Codex cloud)Se abre en el navegador desde chatgpt.com/codex , las tareas se ejecutan en el entorno en la nube de OpenAIEn la nubePara dejar una tarea larga en segundo plano, ejecutar múltiples tareas en paralelo y no consumir recursos de tu máquina local

De las cuatro, las tres primeras (App de escritorio, CLI, extensión de IDE) sirven para trabajar en tu propio ordenador: leen los archivos de tu máquina local y ejecutan los comandos de tu máquina local. Solo la cuarta, la Web en la nube, es diferente:

Analogía: Subcontratar el trabajo. Las tres primeras entradas son como si hubieras contratado a un asistente que se sienta en tu escritorio, usando tu ordenador y tus materiales para trabajar, mientras tú lo vigilas todo el tiempo. La Web en la nube, por otro lado, es como subcontratar la tarea a un equipo remoto: haces un pedido desde tu navegador y OpenAI levanta un entorno aislado en su propia nube, hace pull de tu repositorio de GitHub, hace los cambios a puerta cerrada y cuando termina te entrega un diff, o incluso te abre directamente un PR (Pull Request). Sigue funcionando aunque apagues tu ordenador.

Este modelo de "subcontratación" tiene dos ventajas reales: primero, el paralelismo: puedes lanzar tres o cinco tareas de golpe para que se ejecuten simultáneamente sin bloquearse entre sí; segundo, el aislamiento: trastea en su propio sandbox (entorno de pruebas aislado) sin tocar el sistema de tu máquina local, así que si algo sale mal, no te afectará. La combinación que yo más uso es: las pequeñas correcciones las hago vigilando al momento con la App de escritorio o la CLI, y las tareas largas y lentas como "ejecutar toda la suite de pruebas y arreglar los casos que fallen", las lanzo a la nube, las dejo de fondo y vuelvo más tarde a recoger los resultados.

Aquí hay un punto crítico que vale la pena resaltar y recordar bien:

Estas cuatro entradas tienen detrás el mismo Codex, y la configuración se puede compartir en gran medida. Por ejemplo, el AGENTS.md que escribas (archivo de instrucciones del proyecto, que explicaremos en un artículo dedicado) o los Skills (instrucciones y flujos de trabajo reutilizables) que definas; la documentación oficial indica claramente que se pueden reutilizar entre la App de escritorio, la CLI y la extensión de IDE. Lo configuras una vez y lo usas en muchos sitios. Si has usado antes cualquiera de ellas y luego abres otra, todavía podrás ver el historial de proyectos anteriores.

Un consejo amistoso: Si eres principiante, no te compliques pensando "cuál aprender primero". Mi sugerencia es: si le tienes miedo a la línea de comandos, empieza con la App de escritorio (tiene interfaz gráfica, diff visual y es la más segura); si te encanta estar en la terminal, ve directo por la CLI. Más adelante en esta serie, explicaremos detalladamente cada una de las cuatro entradas en artículos separados (artículos 07 a 10). Aquí solo tienes que recordar que es "un mismo Codex, cuatro caras".

💡 Resumen en una frase: Codex tiene cuatro entradas: App de escritorio / CLI / extensión de IDE / Web en la nube. Las tres primeras trabajan en tu máquina local y la Web en la nube subcontrata el trabajo para que se ejecute en la nube, pero en el fondo es el mismo Codex y la configuración se puede compartir.


03 Qué puede hacer y qué no puede hacer

La lista de capacidades ya se mostró en la sección 01. Aquí añadiremos la otra mitad más importante a reconocer: qué no puede hacer. Este punto es más valioso que "lo que puede hacer", porque es donde los principiantes suelen equivocarse.

❌ Cosas que no debes esperar que hagaPor qué
Tomar decisiones técnicas por tiQué arquitectura elegir, si vale la pena refactorizar, cómo priorizar los requisitos: juzgar y decidir es tu trabajo, no se le da bien el diseño de sistemas a nivel global
Garantizar que el código esté 100% libre de bugsLo que te da es una propuesta candidata de alta calidad, no una respuesta absolutamente correcta. Después de modificarlo, tú debes revisarlo (review)
Adivinar requisitos que no has explicado claramenteSi no has dejado clara la lógica de negocio, solo puede intentar adivinar a ciegas. Cuanto más automático sea, más fácil es que se desvíe
Gestionarlo de forma totalmente automática sin que entiendas nadaSi no entiendes qué ha cambiado, no podrás juzgar si está bien o mal; es como conducir con los ojos vendados

El error más fácil de cometer es el segundo. Una vez hice una estupidez: le pedí a Codex que añadiera el manejo de errores en bloque a un proyecto, modificó rápidamente más de diez archivos y, por pereza, hice el commit directamente. Resultó que en dos lugares "tomó la iniciativa" de cambiar la lógica original, y pasaron varios días antes de que descubriera que el comportamiento de una API había cambiado. Desde entonces establecí una regla inquebrantable: para cada línea que modifica, hay que revisar el diff al menos una vez antes de hacer un commit. Por cierto, la guía de inicio rápido oficial de Codex también menciona específicamente esto: antes y después de hacer algo, crea un punto de control con Git (checkpoint, entiéndelo como "guardar partida" de tu proyecto), por si lo estropea, puedas revertirlo con un solo clic. Cuanto antes adquieran los principiantes este hábito, mejor.

La mentalidad adecuada para usar bien Codex se resume en una sola frase:

Deja que Codex ofrezca opciones candidatas de alta calidad, no respuestas absolutamente correctas.

Dicho de forma sencilla: los humanos fijan la dirección, supervisan y toman decisiones; la IA se encarga de ejecutar, analizar y hacer el trabajo repetitivo. Esta es su filosofía de diseño: colaboración, no reemplazo.

💡 Resumen en una frase: Puede leer el proyecto, modificar archivos, ejecutar comandos y hacer el trabajo rutinario, pero tomar decisiones, supervisar y detallar los requisitos siempre será tu trabajo. Es un compañero, no el que te saca las castañas del fuego mientras tú no haces nada.


04 Codex vs ChatGPT vs Claude Code

Las dos preguntas que más hacen los principiantes: "¿Codex y ChatGPT no son de la misma empresa? ¿Cuál es la diferencia?" y "¿En qué se diferencia de Claude Code?". Aclarémoslo de una vez.

En qué se diferencia Codex de ChatGPT

Ambos pertenecen a OpenAI, pero no son en absoluto cosas de la misma dimensión.

Analogía: Oficial de estado mayor vs. Soldado de fuerzas especiales. ChatGPT es como un oficial de estado mayor en el cuartel general: le describes la situación, te da ideas y traza planes, pero él no sale al campo de batalla, la ejecución sigue dependiendo de ti. Codex es como un soldado de las fuerzas especiales que puede saltar en paracaídas directamente a la escena: le das un objetivo, él mismo se infiltra en tu proyecto (lee archivos, ejecuta comandos, modifica código), ejecuta la misión y luego vuelve para informarte.

Dicho de forma sencilla: A ChatGPT le preguntas y él responde, a Codex le das una instrucción y él se pone manos a la obra. Y lo interesante es que: el propio Codex ya está incluido en la suscripción de ChatGPT (según la documentación oficial, cada cuenta de ChatGPT, incluida la de nivel gratuito, incluye un límite de uso de Codex; los niveles de pago Plus / Pro / Business / Edu / Enterprise tienen límites más altos). También puedes conectarlo usando la API key de OpenAI, pagando por el volumen de uso. Para saber exactamente cuánto límite da cada nivel de suscripción y si hay diferencias en las funciones según la forma de inicio de sesión, estos datos cambian rápido, por lo que siempre debes referirte a la página de facturación oficial (hablaremos sobre esto en detalle en el artículo 04).

En qué se diferencia Codex de Claude Code

Estos dos a menudo se comparan. Primero, un jarro de agua fría: no preguntes "cuál es más fuerte". Sus posicionamientos son tan parecidos que determinar cuál es más fuerte dependerá de cómo los uses exactamente. La verdadera diferencia radica en "dónde ponen el foco de su flujo de trabajo":

DimensiónCodex (OpenAI)Claude Code (Anthropic)
OrigenOpenAI, debajo usa la serie de modelos GPTAnthropic, debajo usa la serie de modelos Claude
Entrada más cómodaOficialmente crearon una App de escritorio con interfaz gráfica, amigable para quienes no quieren tocar la línea de comandosNativo de terminal (CLI), tiene las funciones más completas y es donde mejor se entienden los principios subyacentes
Archivo de instrucciones del proyectoAGENTS.mdCLAUDE.md
Cuatro entradasApp de escritorio / CLI / extensión de IDE / Web en la nubeTerminal / plugin de editor / App de escritorio / Web·Móvil
¿Puede modificar archivos y ejecutar comandos?Sí, es un verdadero agente (Agent)Sí, es un verdadero agente (Agent)

¿Lo ves? El esqueleto de ambos es casi el mismo: ambos son agentes de programación "capaces de leer proyectos y ponerse manos a la obra", ambos tienen múltiples entradas tanto locales como en la nube, y ambos usan un archivo de instrucciones de proyecto para ser "entrenados". Las diferencias más evidentes son dos: primero, su linaje es diferente (GPT vs Claude, el modelo que hay detrás es distinto); segundo, su carácter por defecto es diferente. OpenAI promueve fuertemente su App de escritorio con interfaz gráfica para Codex, claramente intentando atraer a los que "no quieren tocar la línea de comandos"; mientras que Claude Code es nativo de terminal y tiene un sabor más marcado a línea de comandos.

Yo mismo uso ambos. Mi división del trabajo es más o menos así: las tareas donde necesito una interfaz gráfica, quiero visualizar los diffs o quiero abrir múltiples líneas de trabajo en paralelo dentro de un proyecto, uso la App de escritorio de Codex. Las tareas donde necesito meterme en la terminal y conectar un montón de scripts y hooks personalizados, se las dejo a Claude Code. Uno complementa al otro en lugar de reemplazarlo.

Nota: Qué modelo es más inteligente, qué precio es más rentable o qué funciones exclusivas ha lanzado cada uno; todo esto cambia rapidísimo y la conclusión de hoy puede estar caducada la semana que viene. Por lo tanto, en este artículo evito deliberadamente dar números definitivos sobre puntuaciones de rendimiento o precios. Si quieres comparar estas cosas, ve directamente a mirar las páginas oficiales de cada empresa.

💡 Resumen en una frase: ChatGPT es el oficial de estado mayor que te da ideas; Codex es el soldado de las fuerzas especiales de OpenAI que se pone manos a la obra. Codex y Claude Code son dos agentes de programación "similares pero de diferentes casas": se parecen en su estructura base, pero difieren en su linaje y carácter por defecto. No elijas solo uno de manera excluyente, asigna el trabajo según la tarea.


05 Manos a la obra: comprueba en 30 segundos si tu ordenador lo reconoce

Dije que en este artículo no enseñaría a instalarlo, pero te dejaré una pequeña acción de coste cero para que compruebes tu entorno (tanto si lo has instalado como si no, puedes ejecutar este comando sin romper nada).

Abre tu terminal (en Mac usa la aplicación "Terminal", en Windows usa PowerShell), escribe esta línea y presiona Enter:

bash
codex --version

Hay dos resultados esperables y ambos son normales:

  • Caso 1: Te salta una serie de números de versión. Felicidades, ya habías instalado la CLI antes, y en el artículo 03 podrás saltar directamente a la parte de "empezar a usarlo".
  • Caso 2: Da un error command not found: codex (en Windows puede ser 'codex' no se reconoce como un comando interno o externo). Es totalmente normal, significa que la CLI aún no está instalada, y esto es exactamente lo primero que solucionaremos en el artículo 03.

Te adelanto un poco cómo es el comando de instalación de la CLI (no te apresures a escribirlo ahora, solo familiarízate con él), la versión oficial original se ve así:

bash
# macOS / Linux: Script de instalación estándar
curl -fsSL https://chatgpt.com/codex/install.sh | sh
powershell
# Windows PowerShell
powershell -ExecutionPolicy ByPass -c "irm https://chatgpt.com/codex/install.ps1 | iex"

Después de instalarlo, escribe codex en la terminal; te guiará para iniciar sesión (con tu cuenta de ChatGPT o tu API key de OpenAI) y luego ya podrás ponerte a trabajar en el directorio actual.

Aviso 1: La de arriba es la forma de instalar la CLI de línea de comandos. Si le tienes miedo a la línea de comandos, el camino de la App de escritorio es el típico de "descargar paquete de instalación, doble clic y seguir la interfaz gráfica" (disponible para macOS / Windows, Linux actualmente sigue en lista de espera). Es igual que instalar cualquier programa normal. En el artículo 03 explicaremos las cuatro entradas por separado, sin saltarnos ningún paso.

Aviso 2: Codex se apoya en el sistema de cuentas de OpenAI / ChatGPT. Para los usuarios en ciertas regiones, la instalación y el inicio de sesión suelen requerir VPN/proxies. Cómo configurar esto exactamente y cómo iniciar sesión lo trataremos de forma dedicada en el artículo 03, así que no entraremos en detalles aquí.

La siguiente imagen aclara la relación "local / nube" de las cuatro entradas. Si no puedes ver la imagen tampoco afecta a la comprensión; con recordar la tabla de arriba es suficiente:

El enrutamiento de las cuatro entradas de Codex: tres entradas locales se ejecutan en local, la entrada de la nube pasa por el sandbox de OpenAI, al final todos van al mismo agente

Lo que quiere decir esta imagen es: las cuatro entradas son "puertas" a través de las cuales le das objetivos a Codex. Las tres primeras puertas llevan a tu máquina local y la última lleva a la nube de OpenAI, pero detrás de la puerta está el mismo Codex.

💡 Resumen en una frase: Un simple codex --version sirve para comprobar si el ordenador lo reconoce. Si da error, no te asustes, esa será la tarea inicial del artículo 03; y si le tienes miedo a la línea de comandos, recuerda que también tienes la opción de la App de escritorio con interfaz gráfica.


06 Conclusión

En este artículo casi no hemos escrito comandos, pero hemos aclarado las cosas más importantes en las que hay que pensar al principio:

  • Qué es: El agente de programación de IA oficial de OpenAI. Tú le das un objetivo y él lee tu proyecto, lo modifica directamente, ejecuta comandos y termina el trabajo. No es una "ventana de chat que sabe escribir código".
  • Sus cuatro caras: Tiene cuatro entradas: App de escritorio, CLI, extensión de IDE y Web en la nube. Las tres primeras trabajan en tu máquina local y la Web en la nube subcontrata el trabajo para que se ejecute en la nube. En el fondo es el mismo Codex y la configuración se puede compartir.
  • Qué puede / No puede hacer: Puede leer código, modificar archivos, arreglar bugs y hacer el trabajo rutinario; pero tomar decisiones, supervisar y completar los requisitos siempre será tu trabajo. Después de que haga cambios, siempre debes revisar el diff.
  • Con quién se compara y cómo: ChatGPT es el oficial de estado mayor; Codex es el soldado de las fuerzas especiales de OpenAI. Codex y Claude Code son agentes similares de diferentes casas, se parecen en su estructura base pero difieren en su linaje y carácter. Asigna el trabajo según la tarea, no elijas solo uno de manera excluyente.

Ahora deberías ser capaz de: explicarle en una frase a un compañero qué es Codex, y también poder juzgar por qué entrada deberías acceder y qué tipo de trabajo deberías delegarle. Esta es la sensación de tener un "mapa mental" que es esencial para los principiantes. Todas las funcionalidades que veremos más adelante se irán añadiendo sobre este mapa.


Siguiente artículo <02 Vistazo rápido a los conceptos clave>: aclararemos de una vez toda la terminología del mundo de Codex: el bucle del agente (agent loop), el contexto (context), AGENTS.md, el modo de aprobación (approval mode), el sandbox, Skills, MCP... Son palabras con las que lidiarás todos los días a partir de ahora. Antes, ve y escribe ese codex --version que mencionamos arriba para ver si estás en el "Caso 1" o en el "Caso 2"; el artículo 03 ofrecerá la solución precisa para cada situación.


Lecturas recomendadas