Tony Wang13 Min. LesezeitCodex vs. Claude Code: Was 1.828 Beiträge und Rezensionen sagen, was Nutzerzahlen nicht können
OpenAI nennt 8 Mio. Nutzer für Codex und ChatGPT Work. Wir haben stattdessen 1.828 Beiträge, Kommentare und Store-Rezensionen ausgewertet.
Am 14. Juli 2026 schrieb Thibault Sottiaux von OpenAI, Codex habe 8 Millionen aktive Nutzer erreicht. Es war die dritte solche Zahl in drei Tagen — 6 Mio. am 12. Juli, 7 Mio. am 13. Juli, 8 Mio. am 14. Juli — und wie die beiden davor war sie ausdrücklich eine kombinierte Zahl für zwei Produkte:
„Hello. We have reached 8M active users across Codex and ChatGPT Work.“ — @thsottiaux, 14. Juli 2026
Wir haben die Einordnung dieser Zahl gestern einem Faktencheck unterzogen: Sie bündelt Codex mit ChatGPT Work, und die Vergleichsbasis „Claude Code hat 2 Mio.“ ist eine veraltete, undatierte Momentaufnahme. Jener Beitrag beantwortete, ob die Zahl das bedeutet, was die Schlagzeilen behaupteten. Er beantwortete nicht die dahinterliegende Frage: Schlägt Codex tatsächlich Claude Code?
Also haben wir versucht, diese zu beantworten — nicht aus Pressemitteilungen, sondern aus Korpora, die keines der beiden Unternehmen kontrolliert. Nutzerzahlen von Anbietern sind konstruktionsbedingt nicht falsifizierbar: Man kann sie weder prüfen noch reproduzieren noch ihren Nenner kontrollieren. Beiträge, Kommentare und Store-Rezensionen sind unabhängig, mit Zeitstempel versehen und auswertbar.
Welche Oberflächen das beantworten können — gemessen, nicht angenommen
Codex und Claude Code sind Kommandozeilen-Tools, also liegt die Annahme nahe, es gebe keine Store-Daten. Diese Annahme ist zur Hälfte falsch, und die falsche Hälfte ist die interessante.
Es gibt tatsächlich keine Codex-App und keine Claude-Code-App in einem der Mobile-Stores. Aber beide Anbieter liefern viel andere Software aus, und statt anzunehmen, ihre Store-Einträge seien irrelevant, haben wir das Coding-Agent-Signal in jedem Korpus direkt gemessen:
| Oberfläche | Präsenz der Anbieter | Coding-Agent-Signal (gemessen) | Nutzbar? |
|---|---|---|---|
| iOS App Store | ChatGPT (8.592.629 Bewertungen), Claude (199.486) | 1 von 100 aktuellen Rezensionen erwähnt Codex oder Claude Code | Nein — Signal ca. 1 % |
| Google Play | ChatGPT, Claude | Dieselben zwei Chat-Produkte | Nein |
| Chrome Web Store | Claude (11 Mio. Nutzer), ChatGPT search (4 Mio.), ChatGPT (2 Mio.) — alle offiziell | 52 von 166 Rezensionen der ChatGPT-Erweiterung erwähnen Codex (31 %) | Ja |
| GitHub | anthropics/claude-code, openai/codex | Beide kanonischen Repos | Ja |
| Sechs aktive Subreddits | Direkte Diskussion | Ja |
Die Mobile-Apps sind der Kategorienfehler, den alle machen. Die ChatGPT-iOS-App hat 8.592.629 Bewertungen, die Claude-App 199.486; dieses Verhältnis von 43:1 wird in dieser Debatte als Beleg zitiert. Wir haben 100 aktuelle Rezensionen beider Apps ausgewertet, und genau eine erwähnte einen Coding-Agenten. Diese Bewertungen messen Consumer-Chat — und das können wir jetzt mit einer Zahl statt mit einer Annahme sagen.
OpenAI machte aus seiner ChatGPT-Erweiterung Codex — und die Nutzer merkten es
Beide Anbieter betreiben offizielle Chrome-Erweiterungen, und sie sind nicht klein:
| Erweiterung (offiziell) | Nutzer | Bewertungen | Note | 1 Stern | 5 Sterne |
|---|---|---|---|---|---|
| Claude (Anthropic) | 11.000.000 | 1.306 | 2,71 | 53 % | 24 % |
| ChatGPT search (OpenAI) | 4.000.000 | 1.558 | 3,33 | 40 % | 26 % |
| ChatGPT (OpenAI) | 2.000.000 | 333 | 3,71 | 28 % | 56 % |
Die letzte Zeile ist die entscheidende. OpenAIs ChatGPT-Erweiterung wurde am 9. Juli 2026 aktualisiert — am selben Tag, an dem GPT-5.6 Sol erschien — und sie ist keine ChatGPT-Erweiterung mehr. Sie ist Codex for Chrome und hat die Atlas-Seitenleiste ersetzt, wegen der ihre Nutzer sie installiert hatten. Sie merkten es sofort:
„this is not ChatGPT for Chrome, this is Codex for Chrome“
„You are retiring Atlas and you are replacing it with this“
Von ihren 166 neuesten Rezensionen erwähnen 52 Codex — 31 % — womit dies das einzige offizielle Store-Korpus mit nennenswertem Codex-spezifischem Feedback ist. Das Bewertungsprofil ist deutlich zweigipflig: 56 % fünf Sterne, 28 % ein Stern, kaum etwas dazwischen. Wer einen Coding-Agenten wollte, ist begeistert. Wer seinen Browser-Assistenten zurückwollte, nicht.
Das ist mehr als eine Chrome-Bewertung, denn es ist der klarste verfügbare Blick darauf, woraus eine gebündelte Nutzerzahl besteht. OpenAI meldet „8M active users across Codex and ChatGPT Work“. Ein Teil dieser Nutzer steht hier, in den Ein-Stern-Rezensionen, verschoben in eine Codex-Oberfläche, die sie nicht gewählt haben. Wachstum durch Ersetzung zählt in einer solchen Kennzahl genauso wie Wachstum durch Adoption — und eines von beiden ist kein Wettbewerbssieg über Claude Code.
Anthropics Erweiterung ist größer und wütender
Der spiegelbildliche Befund hält das ehrlich: Anthropics Claude-Erweiterung hat die größte installierte Basis der drei (11 Millionen) und die schlechteste Note (2,71), mit 53 % Ein-Stern-Rezensionen. Wären Store-Bewertungen ein Referendum darüber, welches Unternehmen gewinnt, würde Anthropic seine eigene Erweiterung deutlich verlieren.
Aber auch dessen Ein-Stern-Rezensionen drehen sich nicht um Code-Qualität. Es geht um Logins in Endlosschleifen, ausufernde Berechtigungen und Tokens:
„This extension was installed by claude without asking me“
„They want us to use more tokens so they can make more money“
„Claude CLI ignores the existence of this plugin completely“
Beide Unternehmen werden von ihren eigenen Nutzern für dasselbe abgestraft: Login-Reibung, Kosten und Änderungen, um die niemand gebeten hat. Keines wird dafür abgestraft, schlechten Code zu schreiben.
Derselbe Befund, zweimal, auf unabhängigen Oberflächen
Wir haben eine Themenklassifikation über beide Korpora unabhängig laufen lassen — 806 Rezensionen der offiziellen Erweiterungen und 427 Reddit-Kommentare aus sechs Subreddits. Das Ergebnis wiederholt sich:
| Thema | Erweiterungs-Rezensionen (von 806) | Reddit-Kommentare (von 427) |
|---|---|---|
| Zuverlässigkeit / Bugs | 120 | 21 |
| Auth / Login | 111 | nicht erhoben |
| Kosten / Preise / Tokens | 59 | 20 |
| Ratenlimits / Kontingente | nicht erhoben | 17 |
| Workflow / beide Tools nutzen | nicht erhoben | 22 |
| Erzwungene Produktänderung | 31 | nicht erhoben |
| Datenschutz / Berechtigungen | 25 | nicht erhoben |
| Kontextverarbeitung | nicht erhoben | 17 |
| Geschwindigkeit | nicht erhoben | 10 |
| Code-Qualität | 3 | 5 |
Code-Qualität ist in beiden Korpora das am wenigsten diskutierte Thema, und zwar deutlich. Drei Erwähnungen in 806 Store-Rezensionen. Fünf in 427 Reddit-Kommentaren. Zwei Gruppen ohne jede Gemeinsamkeit — die einen schimpfen über eine Browser-Erweiterung, die anderen stecken tief in CLI-Workflows — sind sich unabhängig voneinander einig, dass ausgerechnet das, worum es angeblich geht, niemand anspricht.
Stattdessen geht es um die Rechnung und die Verkabelung. Das ist stimmig für Produkte mit nutzungsabhängigen Abos und zurücksetzenden Kontingenten: Derselbe 8-Mio.-Beitrag kündigt im zweiten Satz ein Zurücksetzen der Nutzungslimits an. Wenn beide Tools gut genug sind, dass Qualität nicht mehr der Engpass ist, verschiebt sich der Streit dahin, was sie kosten und ob sie einen einloggen.
GitHub sagt das Gegenteil der Schlagzeile
Beide Tools haben ein kanonisches öffentliches Repository, beide werden aktiv gepflegt, und beide haben eine Sternzahl, die jeder in Sekunden prüfen kann.
| Kennzahl (15. Juli 2026) | Claude Code | Codex | Führend |
|---|---|---|---|
| Sterne | 137.890 | 98.105 | Claude Code, 1,41× |
| Forks | 22.235 | 14.628 | Claude Code, 1,52× |
| Offene Issues | 11.461 | 9.481 | — |
| Repository erstellt | 22. Feb. 2025 | 13. Apr. 2025 | — |
| Repository enthält | Issue-Tracker + Doku | Vollständigen Rust-Quellcode, Apache-2.0 | — |
Auf der einzigen Oberfläche, auf der beide Produkte eine vergleichbare öffentliche Zahl offenlegen, liegt Codex nicht vorn — ausgerechnet an dem Tag, an dem die Schlagzeilen ihren Höhepunkt erreichten.
Wir tun aber nicht so, als wäre die Sache damit entschieden, denn die beiden Repositories sind nicht dieselbe Art von Objekt. openai/codex ist der tatsächliche Rust-Quellcode unter Apache-2.0: Man kann ihn lesen, forken, Patches liefern. Ein Stern dort kann bedeuten „Ich will diesen Code“. anthropics/claude-code ist ein Issue-Tracker und Doku-Repo für ein Closed-Source-Tool, das über npm verteilt wird — ein Stern dort ist eher ein Lesezeichen. Das sind verschiedene Handlungen, und ein roher Vergleich ebnet sie ein.
Die ehrliche Lesart ist eng: Codex liegt hier nicht vorn, was unvereinbar ist mit „und es ist nicht einmal knapp“. Es ist kein Beweis, dass Claude Code gewinnt.
Wir wollten auch die Release-Kadenz beider Repositories messen, was wirklich nützlich gewesen wäre. Der Releases-Endpoint lieferte für beide Fehler, also haben wir diesen Schnitt weggelassen, statt zu raten.
Auf Reddit sind die Threads, die beide Tools nennen, keine Vergleiche
Wir haben die 100 neuesten Beiträge aus jedem von sechs Subreddits gezogen — r/ClaudeCode, r/ClaudeAI, r/OpenAI, r/ChatGPTCoding, r/CodingLLM, r/Claudex — 495 Beiträge plus 427 Kommentare.
Zuerst eine methodische Anmerkung, die selbst ein Befund ist: Reddits Such-Endpoint kann dieses Thema nicht isolieren. Eine Suche nach „codex vs claude code“ trifft unscharf auf das Wort „code“ und liefert Destiny-2-Code-Listen, VS-Code-Memes und ein Arduino-Projekt. Wer in dieser Debatte Reddit-Trefferzahlen zitiert, zählt Rauschen. Wir sind Subreddit für Subreddit vorgegangen.
| Subreddit | Beiträge | Zeitraum | Codex genannt | Claude Code genannt | Beide |
|---|---|---|---|---|---|
| r/ClaudeCode | 100 | 14.–15. Juli | 12 | 40 | 10 |
| r/ClaudeAI | 100 | 14.–15. Juli | 6 | 43 | 4 |
| r/OpenAI | 100 | 13.–15. Juli | 18 | 1 | 0 |
| r/ChatGPTCoding | 100 | 14. Feb. – 7. Juli | 21 | 13 | 5 |
| r/CodingLLM | 92 | Nov. 2025 – 1. Juli | 5 | 8 | 1 |
| r/Claudex | 3 | 9. Feb. | 2 | 1 | 1 |
| Gesamt | 495 | — | 64 | 106 | 21 |
21 von 495 Beiträgen nannten beide Tools. Wir haben sie gelesen. Fast keiner ist ein Urteil — es sind Integrationsfragen: What's the best way to use both Codex and Claude Code? und Is Codex useful in a Claude Code based workflow?
Die Antworten drehen sich um Verkabelung, nicht um Loyalität. Im Thread best way to use both beschreiben Entwickler, wie sie ~/.claude/skills nach ~/.codex/skills symlinken, OpenAIs Codex-MCP-Server in Claude Code registrieren und beide Agenten auf dasselbe Arbeitsverzeichnis richten. Eine Antwort lautet schlicht:
„Best way to use: rub them together.“
Das vorherrschende Muster ist Arbeitsteilung — ein Agent plant, der andere implementiert oder prüft, gerade weil ein zweites Modell fängt, was das erste übersieht. Aus dem Thread Codex in a Claude Code workflow:
„It's about how they work together. I use both.“
Und, deutlicher, der Kommentar, der als These dieses Artikels dienen könnte:
„Stop scoring Codex against Fable head to head.“
Was das zeigt und was nicht
Was aus unserer Sicht hält: Code-Qualität ist in zwei unabhängigen Korpora mit großem Abstand das am wenigsten diskutierte Thema. Die Nutzer beider Anbieter beschweren sich stattdessen über Kosten, Auth und Zuverlässigkeit. OpenAI hat seine ChatGPT-Erweiterung am 9. Juli in eine Codex-Oberfläche verwandelt, und ein sichtbarer Teil der Nutzer ist darüber verärgert — direkter Beleg dafür, dass gebündeltes Nutzerwachstum und Wettbewerbsadoption nicht dasselbe sind.
Was das begrenzt:
- Die Stichproben sind klein und ungleich verteilt. 100 Beiträge decken in r/ClaudeCode etwa einen Tag ab, in r/ChatGPTCoding etwa fünf Monate; wir haben das nicht normalisiert. Der neueste Beitrag in r/ChatGPTCoding ist acht Tage alt und sucht neue Moderatoren — die Trägheit spiegelt den Zustand des Subreddits, nicht die Tools.
- Store-Rezensionen sind der verärgertste Bruchteil einer Nutzerbasis. 333 Bewertungen bei 2.000.000 Installationen sind keine Stichprobe der Nutzer, sondern der Schreibmotivierten. Zweigipfligkeit sieht immer so aus. Lest die Themen, nicht die Noten.
- Reddits öffentliche Feeds sind bei 100 Einträgen gedeckelt und zeigen keine Scores, wir konnten also nicht nach Engagement gewichten.
- Die Themenklassifikation ist schlagwortbasiert, nicht semantisch, und beide Korpora wurden mit unterschiedlichen Themensets kodiert — die Spalten oben sind also nicht streng vergleichbar. Behandelt die Zahlen als Form, nicht als Zählung.
- GitHub-Sterne sind eine Eitelkeitsmetrik, und die beiden Repos enthalten Unterschiedliches.
- Die Release-Kadenz konnten wir nicht messen — der Endpoint lieferte für beide Repositories Fehler.
Nichts davon rettet die Behauptung „Codex hat Claude Code überholt“. Es bedeutet nur, dass unsere Gegenbelege eine Form sind, kein Urteil — genau der Maßstab, den die ursprüngliche Behauptung nie erfüllt hat.
Die eigentliche Antwort
Schlägt Codex Claude Code? Nach den Belegen, die jemandem außerhalb der beiden Unternehmen zur Verfügung stehen: Niemand kann es sagen, und den Entwicklern, die beide Tools nutzen, ist es weitgehend gleichgültig geworden.
Die Nutzerzahlen können es nicht beantworten — sie messen zwei Produkte, an verschiedenen Daten, gegen eine veraltete Basis, ohne veröffentlichten Nenner, und zumindest ein Teil des Wachstums sind Nutzer, die in eine Codex-Oberfläche verschoben wurden, die sie mit einem Stern bewerten. Die Mobile-Stores können es nicht beantworten: Wir haben nachgesehen, das Signal liegt bei einer Rezension von hundert. Die eine saubere öffentliche Kennzahl deutet mild auf Claude Code, mit echten Vorbehalten. Und die Leute, die die Arbeit tatsächlich machen, halten kein Referendum ab — sie stecken 22 Kommentare tief darin, wie die beiden Agenten einander Arbeit übergeben, und noch tiefer in Beschwerden darüber, was das kostet.
Das erzählte Rennen ist nicht das gelaufene Rennen. Das ist der Befund.
Quellen
Methodik
Alle Zahlen hier wurden am 15. Juli 2026 über Crawloras eigene APIs abgerufen, statt aus zweiter Hand übernommen: die Chrome-Web-Store-Endpoints für Item und Rezensionen sowie das Chrome-Extensions-Dataset, um die offiziellen Einträge jedes Anbieters zu ermitteln, App-Store-Rezensionen, GitHub-Repository-Kennzahlen, Subreddit-Beiträge und Thread-Kommentare sowie der X-Post-Endpoint für Tibos Ankündigung im Wortlaut.
Korpus: 1.828 Einträge — 806 Rezensionen offizieller Chrome-Erweiterungen (Claude, ChatGPT, ChatGPT search), 495 Reddit-Beiträge und 427 Kommentare aus r/ClaudeCode, r/ClaudeAI, r/OpenAI, r/ChatGPTCoding, r/CodingLLM und r/Claudex sowie 100 aktuelle iOS-Rezensionen der ChatGPT- und Claude-Apps. Wir veröffentlichen ausschließlich Aggregate — keine Rohdatensätze.
Reproduziere es selbst im Playground; die Anleitungen GitHub scrapen, Reddit scrapen und App-Store-Rezensionen scrapen führen durch die genauen Aufrufe, und die Preise zeigen die Free-Tier-Option. Zur Zahl, die das ausgelöst hat, siehe unseren Faktencheck der 6-/7-Mio.-Behauptung. Zum weiteren Umfeld siehe Web Scraping mit KI und beste KI-Web-Scraping-Tools.
Häufig gestellte Fragen
Schlägt Codex Claude Code?
Nach den außerhalb der beiden Unternehmen verfügbaren Belegen kann das niemand sagen. OpenAIs 8-Mio.-Zahl umfasst Codex und ChatGPT Work zusammen, nicht Codex allein, und die Vergleichszahl für Claude Code ist eine veraltete, undatierte 2-Mio.-Momentaufnahme. Auf GitHub — der einzigen Oberfläche, auf der beide Tools eine direkt vergleichbare öffentliche Kennzahl offenlegen — führt Claude Code mit 137.890 Sternen gegenüber 98.105 von Codex (Stand 15. Juli 2026). Ein Teil von Codex' gemeldetem Wachstum sind zudem Nutzer, die in Codex-Oberflächen verschoben wurden, die sie nicht gewählt haben: OpenAI machte seine ChatGPT-Chrome-Erweiterung am 9. Juli 2026 zu Codex for Chrome, und 28 % der aktuellen Rezensionen dieser Erweiterung sind Ein-Stern-Bewertungen.
Warum können App-Store- oder Google-Play-Rezensionen die Debatte nicht entscheiden?
Weil keiner der beiden Coding-Agenten dort vertreten ist — und wir haben die Lücke gemessen, statt sie anzunehmen. Die ChatGPT-iOS-App (8.592.629 Bewertungen) und die Claude-App (199.486) sind Consumer-Chat-Produkte; in 100 aktuellen Rezensionen beider erwähnte genau eine einen Coding-Agenten. Dieses Signal von rund 1 % ist der Grund, warum das viel zitierte Verhältnis von 43:1 etwas über Chat-Adoption aussagt, aber nichts über Codex oder Claude Code.
Haben Codex und Claude Code Browser-Erweiterungen mit auswertbaren Rezensionen?
Ja, und das ist die Oberfläche, die die meisten übersehen. Anthropic liefert eine Claude-Erweiterung aus (11.000.000 Nutzer, Bewertung 2,71, 53 % Ein-Stern) und OpenAI ChatGPT search (4.000.000 Nutzer, 3,33) sowie ChatGPT (2.000.000 Nutzer, 3,71). Am 9. Juli 2026 machte OpenAI aus letzterer Codex for Chrome und ersetzte die Atlas-Seitenleiste — 52 der 166 neuesten Rezensionen erwähnen Codex, womit dies das einzige offizielle Store-Korpus mit echtem Codex-Feedback ist.
Worüber streiten Entwickler tatsächlich, wenn sie Codex und Claude Code vergleichen?
Über Kosten und Kontingente, nicht über Code-Qualität — und der Befund wiederholt sich in zwei unabhängigen Korpora. Unter 427 Reddit-Kommentaren war Code-Qualität das am wenigsten diskutierte Thema (5 Erwähnungen), während Kosten (20) und Ratenlimits (17) zusammen auf 37 kamen. Unter 806 Rezensionen der offiziellen Browser-Erweiterungen lag Code-Qualität mit nur 3 Erwähnungen erneut auf dem letzten Platz, hinter Zuverlässigkeit (120), Auth und Login (111) sowie Kosten (59).