Tony Wang13 min de lecturaCodex vs Claude Code: lo que 1.828 posts y reseñas dicen que las cifras de usuarios no pueden
OpenAI dice 8M de usuarios entre Codex y ChatGPT Work. Analizamos 1.828 posts y reseñas: la calidad del código fue lo menos discutido.
El 14 de julio de 2026, Thibault Sottiaux de OpenAI publicó que Codex había alcanzado 8 millones de usuarios activos. Fue la tercera cifra así en tres días — 6M el 12 de julio, 7M el 13 de julio, 8M el 14 de julio — y, como las dos anteriores, era explícitamente una cifra combinada de dos productos:
"Hello. We have reached 8M active users across Codex and ChatGPT Work." — @thsottiaux, 14 de julio de 2026
Ayer verificamos el marco de esa cifra: combina Codex con ChatGPT Work, y la línea base de "Claude Code tiene 2M" contra la que se compara es una instantánea antigua y sin fecha. Ese post respondió si la cifra significa lo que decían los titulares. No respondió la pregunta de fondo: ¿está Codex realmente superando a Claude Code?
Así que intentamos responder esa — no desde comunicados de prensa, sino desde corpus que ninguna de las dos empresas controla. Las cifras de usuarios de los proveedores no son falsables por construcción: no puedes auditarlas, reproducirlas ni revisar su denominador. Los posts, comentarios y reseñas de tiendas son independientes, tienen marca de tiempo y son minables. Esto es lo que dicen.
Qué superficies pueden realmente responder esto — medido, no asumido
Codex y Claude Code son herramientas de línea de comandos, así que el instinto es asumir que no existen datos de tiendas. Ese instinto está medio equivocado, y la mitad equivocada es la mitad interesante.
Genuinamente no hay una app de Codex ni una app de Claude Code en ninguna tienda móvil. Pero ambos proveedores publican mucho otro software, y en lugar de asumir que sus listados de tienda son irrelevantes, medimos directamente la señal de agente de código en cada corpus:
| Superficie | Presencia de primera parte | Señal de agente de código (medida) | ¿Utilizable? |
|---|---|---|---|
| iOS App Store | ChatGPT (8.592.629 calificaciones), Claude (199.486) | 1 de 100 reseñas recientes menciona Codex o Claude Code | No — señal ~1% |
| Google Play | ChatGPT, Claude | Los mismos dos productos de chat | No |
| Chrome Web Store | Claude (11M usuarios), ChatGPT search (4M), ChatGPT (2M) — todas de primera parte | 52 de 166 reseñas de la extensión de ChatGPT mencionan Codex (31%) | Sí |
| GitHub | anthropics/claude-code, openai/codex | Ambos repos canónicos | Sí |
| Seis subreddits activos | Discusión directa | Sí |
Las apps móviles son el error de categoría que todos cometen. La app de ChatGPT para iOS tiene 8.592.629 calificaciones y la app de Claude tiene 199.486; esa proporción de 43:1 se cita como evidencia en este debate. Extrajimos 100 reseñas recientes de ambas y exactamente una mencionó un agente de código. Esas calificaciones miden chat de consumo — y ahora podemos decirlo con una cifra en vez de una suposición.
El Chrome Web Store es la sorpresa, y resultó ser donde estaba la historia real.
OpenAI convirtió su extensión de ChatGPT en Codex — y sus usuarios lo notaron
Ambos proveedores operan extensiones oficiales de Chrome, y no son pequeñas:
| Extensión (primera parte) | Usuarios | Calificaciones | Puntuación | 1 estrella | 5 estrellas |
|---|---|---|---|---|---|
| Claude (Anthropic) | 11.000.000 | 1.306 | 2,71 | 53% | 24% |
| ChatGPT search (OpenAI) | 4.000.000 | 1.558 | 3,33 | 40% | 26% |
| ChatGPT (OpenAI) | 2.000.000 | 333 | 3,71 | 28% | 56% |
Esa última fila es la que importa. La extensión ChatGPT de OpenAI fue actualizada el 9 de julio de 2026 — el mismo día en que se lanzó GPT-5.6 Sol — y ya no es realmente una extensión de ChatGPT. Es Codex for Chrome, y reemplazó la barra lateral Atlas para la que sus usuarios la habían instalado. Lo notaron de inmediato:
"this is not ChatGPT for Chrome, this is Codex for Chrome"
"You are retiring Atlas and you are replacing it with this"
De sus 166 reseñas más recientes, 52 mencionan Codex — 31% — lo que hace de este el único corpus de tienda de primera parte con retroalimentación específica de Codex de peso. Su perfil de calificación es marcadamente bimodal: 56% cinco estrellas, 28% una estrella, muy poco en el medio. La gente que quería un agente de código está encantada. La gente que quería recuperar su asistente de navegador no lo está.
Esto importa más allá de una calificación en Chrome, porque es la vista más clara disponible de qué está hecha una cifra combinada de usuarios activos. OpenAI reporta "8M active users across Codex and ChatGPT Work". Algunos de esos usuarios están aquí, en las reseñas de una estrella, habiendo sido movidos a una superficie de Codex que no eligieron. El crecimiento por reemplazo cuenta igual que el crecimiento por adopción en una métrica así — y uno de los dos no es una victoria competitiva sobre Claude Code.
La extensión de Anthropic es más grande y está más enojada
El hallazgo espejo mantiene esto honesto: la extensión Claude de Anthropic tiene la base instalada más grande de las tres (11 millones) y la peor puntuación (2,71), con 53% de reseñas de una estrella. Si las calificaciones de tienda fueran un referéndum sobre qué empresa está ganando, Anthropic estaría perdiendo su propia extensión por goleada.
Pero sus reseñas de una estrella tampoco tratan sobre calidad de código. Tratan sobre logins que se ciclan, permisos que se expanden y tokens:
"This extension was installed by claude without asking me"
"They want us to use more tokens so they can make more money"
"Claude CLI ignores the existence of this plugin completely"
Ambas empresas están siendo castigadas por sus propios usuarios por las mismas cosas: fricción de autenticación, costo y cambios enviados que nadie pidió. Ninguna está siendo castigada por escribir mal código.
El mismo hallazgo, dos veces, en superficies no relacionadas
Corrimos una clasificación de temas sobre ambos corpus de forma independiente — 806 reseñas de extensiones de primera parte y 427 comentarios de Reddit de seis subreddits. El resultado se replica:
| Tema | Reseñas de extensión (de 806) | Comentarios de Reddit (de 427) |
|---|---|---|
| Fiabilidad / bugs | 120 | 21 |
| Auth / login | 111 | no medido |
| Costo / precios / tokens | 59 | 20 |
| Límites de tasa / cuotas | no medido | 17 |
| Flujo de trabajo / usar ambas herramientas | no medido | 22 |
| Cambio de producto forzado | 31 | no medido |
| Privacidad / permisos | 25 | no medido |
| Manejo de contexto | no medido | 17 |
| Velocidad | no medido | 10 |
| Calidad de código | 3 | 5 |
La calidad de código es el tema menos discutido en ambos corpus, y no por poco. Tres menciones en 806 reseñas de tienda. Cinco en 427 comentarios de Reddit. Dos poblaciones sin nada en común — una quejándose de una extensión de navegador, otra sumergida en flujos de trabajo de CLI — coinciden de forma independiente en que aquello de lo que supuestamente trata este debate es lo que nadie menciona.
Lo que sí mencionan es la factura y la fontanería. Eso es coherente para productos con precio de suscripción medida y cuotas que se reinician: el mismo post de los 8M de usuarios anuncia un reinicio del límite de uso en su segunda frase. Cuando ambas herramientas son lo suficientemente buenas como para que la calidad deje de ser el cuello de botella, la discusión se mueve hacia qué cuestan y si te mantienen conectado sin fricciones.
GitHub dice lo opuesto al titular
Ambas herramientas tienen un repositorio público canónico, ambas reciben pushes activos, y ambas tienen un conteo de estrellas que cualquiera puede verificar en segundos.
| Métrica (15 de julio de 2026) | Claude Code | Codex | Líder |
|---|---|---|---|
| Estrellas | 137.890 | 98.105 | Claude Code, 1,41x |
| Forks | 22.235 | 14.628 | Claude Code, 1,52x |
| Issues abiertos | 11.461 | 9.481 | — |
| Repositorio creado | 22 feb 2025 | 13 abr 2025 | — |
| El repositorio contiene | Rastreador de issues + docs | Código fuente completo en Rust, Apache-2.0 | — |
En la única superficie donde ambos productos exponen una cifra pública comparable, Codex no va adelante — justo el día en que los titulares de "Codex está ganando" tocaron su punto máximo.
No vamos a fingir que eso lo resuelve, porque los dos repositorios no son el mismo tipo de objeto. openai/codex es el código fuente real en Rust bajo Apache-2.0: puedes leerlo, hacer fork, enviar parches. Una estrella ahí puede significar "quiero este código". anthropics/claude-code es un rastreador de issues y repositorio de documentación para una herramienta de código cerrado distribuida por npm — una estrella ahí se parece más a un marcador. Son actos distintos, y una comparación cruda los aplana.
La lectura honesta es acotada: Codex no va adelante aquí, lo cual es incompatible con "y ni siquiera está cerca". No es prueba de que Claude Code esté ganando.
También intentamos medir la cadencia de lanzamientos de ambos repositorios, lo cual habría sido genuinamente útil. El endpoint de releases devolvió errores upstream para ambos, así que dejamos ese corte fuera en lugar de adivinar.
En Reddit, los hilos que nombran a ambas herramientas no son comparaciones
Extrajimos los 100 posts más recientes de cada uno de seis subreddits — r/ClaudeCode, r/ClaudeAI, r/OpenAI, r/ChatGPTCoding, r/CodingLLM, r/Claudex — 495 posts, más 427 comentarios.
Primero una nota metodológica, porque es un hallazgo en sí mismo: el endpoint de búsqueda de Reddit no puede aislar este tema. Una consulta por "codex vs claude code" coincide de forma laxa con la palabra "code" y devuelve listas de códigos promocionales de Destiny 2, memes de VS Code y un proyecto de Arduino. Cualquiera que cite conteos de resultados de búsqueda de Reddit en este debate está contando ruido. Fuimos subreddit por subreddit y buscamos coincidencias con nombres de herramientas.
| Subreddit | Posts muestreados | Ventana | Codex nombrado | Claude Code nombrado | Ambos nombrados |
|---|---|---|---|---|---|
| r/ClaudeCode | 100 | 14–15 jul | 12 | 40 | 10 |
| r/ClaudeAI | 100 | 14–15 jul | 6 | 43 | 4 |
| r/OpenAI | 100 | 13–15 jul | 18 | 1 | 0 |
| r/ChatGPTCoding | 100 | 14 feb – 7 jul | 21 | 13 | 5 |
| r/CodingLLM | 92 | nov 2025 – 1 jul | 5 | 8 | 1 |
| r/Claudex | 3 | 9 feb | 2 | 1 | 1 |
| Total | 495 | — | 64 | 106 | 21 |
Veintiuno de 495 posts nombraron a ambas herramientas. Los leímos. Casi ninguno es un veredicto — son preguntas de integración: What's the best way to use both Codex and Claude Code? y Is Codex useful in a Claude Code based workflow?
Las respuestas tratan sobre fontanería, no sobre lealtad. En el hilo best way to use both, los desarrolladores describen enlazar con symlink ~/.claude/skills a ~/.codex/skills, registrar el servidor MCP de Codex de OpenAI dentro de Claude Code, y apuntar ambos agentes al mismo directorio de trabajo. Una respuesta dice simplemente:
"Best way to use: rub them together."
El patrón dominante es una división del trabajo — un agente planifica, el otro implementa o revisa, específicamente porque un segundo modelo detecta lo que al primero se le escapa. Del hilo Codex in a Claude Code workflow:
"It's about how they work together. I use both."
Y, más directo, el comentario que podría servir como tesis de este artículo:
"Stop scoring Codex against Fable head to head."
Qué muestra esto y qué no
Lo que creemos que se sostiene: la calidad de código es el tema menos discutido en dos corpus no relacionados, por un margen amplio. Los usuarios de ambos proveedores se quejan de costo, autenticación y fiabilidad en su lugar. OpenAI convirtió su extensión de ChatGPT en una superficie de Codex el 9 de julio y una fracción visible de sus usuarios está enojada por ello, lo cual es evidencia directa de que el crecimiento combinado de usuarios activos y la adopción competitiva no son lo mismo. En la única métrica pública comparable, Claude Code lidera. Los hilos que mencionan a ambos se inclinan fuertemente hacia la interoperabilidad.
Qué lo limita:
- Las muestras son pequeñas y con ventanas desiguales. 100 posts cubren cerca de un día en r/ClaudeCode y cerca de cinco meses en r/ChatGPTCoding, y no normalizamos por eso. El post más reciente de r/ChatGPTCoding tiene ocho días y pide nuevos moderadores, así que su lentitud refleja la salud de ese subreddit, no de las herramientas.
- Las reseñas de tienda son la fracción más enojada de una base de usuarios. 333 calificaciones frente a 2.000.000 de instalaciones no es una muestra de usuarios; es una muestra de gente lo suficientemente motivada para escribir. La bimodalidad es lo que eso siempre se ve. Lee los temas, no las puntuaciones.
- Los feeds públicos de Reddit tienen un tope de 100 elementos y no exponen puntuaciones, así que no pudimos ponderar por engagement. Cada post cuenta una vez.
- La clasificación de temas está basada en palabras clave, no es semántica. Subcuenta a cualquiera que describa un límite de tasa sin usar las palabras "rate limit", y los dos corpus fueron codificados con conjuntos de temas distintos, así que las columnas de arriba no son estrictamente comparables entre sí. Trata los conteos como una forma, no como un censo.
- Las estrellas de GitHub son una métrica de vanidad, y los dos repos contienen cosas distintas, como se cubrió arriba.
- No pudimos medir la cadencia de lanzamientos — el endpoint falló en upstream para ambos repositorios.
Nada de esto rescata la afirmación de "Codex superó a Claude Code". Significa que nuestra contraevidencia es una forma, no un veredicto — el mismo estándar que la afirmación original nunca cumplió.
La respuesta real
¿Está Codex superando a Claude Code? Según la evidencia disponible para cualquiera fuera de ambas empresas: nadie puede decírtelo, y los desarrolladores que usan ambas herramientas en gran medida dejaron de importarles.
Las cifras de usuarios no pueden responderlo — miden dos productos, en fechas distintas, contra una línea base obsoleta, sin denominador publicado, y al menos parte del crecimiento son usuarios migrados a una superficie de Codex que están calificando con una estrella. Las tiendas móviles no pueden responderlo: revisamos, y la señal es de una reseña de cada cien. La única métrica pública limpia apunta levemente hacia Claude Code, con reservas reales. Y la gente que realmente hace el trabajo no está sosteniendo un referéndum — está 22 comentarios adentro discutiendo cómo hacer que los dos agentes se pasen trabajo entre sí, y mucho más adentro en quejas sobre lo que eso cuesta.
La carrera que se narra no es la carrera que se corre. Ese es el hallazgo.
Fuentes
Metodología
Cada cifra aquí fue extraída mediante las propias APIs de Crawlora el 15 de julio de 2026, en lugar de tomarse de segunda mano: los endpoints de item y reseñas de Chrome Web Store más el dataset de extensiones de Chrome para enumerar los listados de primera parte de cada proveedor, reseñas de App Store, métricas de repositorio de GitHub, posts de subreddit y comentarios de hilo, y el endpoint de posts de X para el anuncio textual de Tibo.
Corpus: 1.828 elementos — 806 reseñas de extensiones de Chrome de primera parte (Claude, ChatGPT, ChatGPT search), 495 posts de Reddit y 427 comentarios en r/ClaudeCode, r/ClaudeAI, r/OpenAI, r/ChatGPTCoding, r/CodingLLM y r/Claudex, y 100 reseñas recientes de iOS de las apps ChatGPT y Claude. Publicamos solo agregados — ningún registro crudo de reseña o comentario.
Reprodúcelo tú mismo en el Playground; las guías cómo hacer scraping de GitHub, cómo hacer scraping de Reddit y cómo hacer scraping de reseñas de App Store recorren las llamadas exactas, y precios cubre el plan gratuito. Para la cifra que originó todo esto, consulta nuestra verificación de la afirmación de 6M/7M. Para el panorama más amplio, consulta web scraping con IA y las mejores herramientas de web scraping con IA.
Preguntas frecuentes
¿Está Codex superando a Claude Code?
Según la evidencia disponible fuera de ambas empresas, nadie puede decirlo. La cifra de 8M de OpenAI combina Codex y ChatGPT Work, no Codex solo, y la cifra de comparación para Claude Code es una instantánea antigua y sin fecha de 2M. En GitHub — la única superficie donde ambas herramientas exponen una métrica pública directamente comparable — Claude Code lidera con 137.890 estrellas frente a las 98.105 de Codex (al 15 de julio de 2026). Parte del crecimiento reportado de Codex son además usuarios movidos a superficies de Codex que no eligieron: OpenAI convirtió su extensión de Chrome de ChatGPT en Codex for Chrome el 9 de julio de 2026, y el 28% de las reseñas recientes de esa extensión son de una estrella.
¿Por qué las reseñas de App Store o Google Play no pueden decidir el debate?
Porque ninguno de los dos agentes de código está presente ahí — y medimos esa brecha en lugar de asumirla. La app de ChatGPT para iOS (8.592.629 calificaciones) y la app de Claude (199.486) son productos de chat de consumo; en 100 reseñas recientes de ambas, exactamente una mencionó un agente de código. Esta señal de aproximadamente 1% es la razón por la que la muy citada proporción de 43:1 dice algo sobre la adopción de chat, pero nada sobre Codex o Claude Code.
¿Tienen Codex y Claude Code extensiones de navegador con reseñas analizables?
Sí, y esa es la superficie que la mayoría pasa por alto. Anthropic publica una extensión Claude (11.000.000 de usuarios, calificación 2,71, 53% de una estrella) y OpenAI publica ChatGPT search (4.000.000 de usuarios, 3,33) y ChatGPT (2.000.000 de usuarios, 3,71). El 9 de julio de 2026, OpenAI convirtió esta última en Codex for Chrome y reemplazó la barra lateral Atlas — 52 de las 166 reseñas más recientes mencionan Codex, lo que hace de este el único corpus oficial de tienda con retroalimentación real sobre Codex.
¿Sobre qué discuten realmente los desarrolladores al comparar Codex y Claude Code?
Sobre costo y cuotas, no sobre calidad de código — y el hallazgo se repite en dos corpus independientes. Entre 427 comentarios de Reddit, la calidad de código fue el tema menos discutido (5 menciones), mientras que costo (20) y límites de tasa (17) sumaron 37 juntos. Entre 806 reseñas de extensiones de navegador oficiales, la calidad de código volvió a quedar última con solo 3 menciones, por detrás de fiabilidad (120), autenticación y login (111) y costo (59).