Tony Wang13 分で読めますCodexとClaude Code:ユーザー数では答えられないことを、1,828件の投稿とレビューが語る
OpenAIはCodexとChatGPT Workで800万ユーザーと発表。私たちは代わりに1,828件の投稿・コメント・ストアレビューを分析しました。
2026年7月14日、OpenAIのThibault Sottiaux氏は、Codexが800万アクティブユーザーに達したと投稿しました。3日間で3回目の数字です(7月12日に600万、7月13日に700万、7月14日に800万)。そして前の2回と同様、これは明確に2製品の合計値でした。
「Hello. We have reached 8M active users across Codex and ChatGPT Work.」 — @thsottiaux、2026年7月14日
私たちはこの数字の枠組みを昨日ファクトチェックしました。これはCodexとChatGPT Workを束ねたものであり、比較対象とされる「Claude Codeは200万」という基準値は、日付不明の古いスナップショットです。あの記事が答えたのは、その数字が見出しの主張どおりの意味なのか、でした。その下にある問いには答えていません。すなわち、Codexは本当にClaude Codeを打ち負かしているのか?
そこで今回は、プレスリリースではなく、どちらの企業も統制していないコーパスから答えを探しました。ベンダーのユーザー数は構造的に反証不可能です。監査もできず、再現もできず、分母も確認できません。投稿・コメント・ストアレビューは独立していて、タイムスタンプがあり、収集可能です。
どの面なら答えられるのか — 仮定ではなく実測
CodexとClaude Codeはコマンドラインツールなので、ストアのデータは存在しないと考えたくなります。その直感は半分外れていて、外れている側が面白いところです。
確かにどちらのモバイルストアにも、CodexアプリもClaude Codeアプリも存在しません。しかし両社は他にも多くのソフトウェアを出荷しており、ストア掲載が無関係だと決めつける代わりに、各コーパスにおけるコーディングエージェントのシグナルを直接測定しました。
| 面 | 公式の存在 | コーディングエージェントのシグナル(実測) | 使えるか |
|---|---|---|---|
| iOS App Store | ChatGPT(8,592,629件の評価)、Claude(199,486件) | 直近レビュー100件中1件がCodexまたはClaude Codeに言及 | いいえ — 約1% |
| Google Play | ChatGPT、Claude | 同じ2つのチャット製品 | いいえ |
| Chrome Web Store | Claude(1,100万ユーザー)、ChatGPT search(400万)、ChatGPT(200万) — すべて公式 | ChatGPT拡張機能のレビュー166件中52件がCodexに言及(31%) | はい |
| GitHub | anthropics/claude-code、openai/codex | 両方とも正式リポジトリ | はい |
| 6つの活発なサブレディット | 直接の議論 | はい |
モバイルアプリは、誰もが犯すカテゴリーエラーです。ChatGPTのiOSアプリには8,592,629件、Claudeアプリには199,486件の評価があり、この43対1という比率がこの議論で証拠として引用されます。私たちは両アプリの直近レビュー100件を取得しましたが、コーディングエージェントに言及していたのはわずか1件でした。これらの評価が測っているのはコンシューマー向けチャットです。今やそれを、仮定ではなく数字で言えます。
OpenAIはChatGPT拡張機能をCodexに変え、ユーザーは気づいた
両社とも公式のChrome拡張機能を運営しており、規模も小さくありません。
| 拡張機能(公式) | ユーザー数 | 評価件数 | スコア | 星1つ | 星5つ |
|---|---|---|---|---|---|
| Claude(Anthropic) | 11,000,000 | 1,306 | 2.71 | 53% | 24% |
| ChatGPT search(OpenAI) | 4,000,000 | 1,558 | 3.33 | 40% | 26% |
| ChatGPT(OpenAI) | 2,000,000 | 333 | 3.71 | 28% | 56% |
重要なのは最後の行です。OpenAIのChatGPT拡張機能は2026年7月9日(GPT-5.6 Solが出荷されたのと同じ日)に更新され、もはや実質的にChatGPT拡張機能ではありません。Codex for Chromeであり、ユーザーがそのために入れていたAtlasサイドバーを置き換えました。ユーザーはすぐに気づきました。
「this is not ChatGPT for Chrome, this is Codex for Chrome」
「You are retiring Atlas and you are replacing it with this」
直近166件のレビューのうち52件がCodexに言及しており(31%)、これはCodex固有のフィードバックが意味のある量で存在する唯一の公式ストアコーパスです。評価分布は明確に二極化しています。星5つが56%、星1つが28%、中間はほとんどありません。コーディングエージェントを望んでいた人は喜び、ブラウザアシスタントを返してほしい人は喜んでいません。
これはChromeの評価という以上の意味を持ちます。束ねられたアクティブユーザー数が何でできているかを知る、最も明快な手がかりだからです。OpenAIは「8M active users across Codex and ChatGPT Work」と報告します。そのユーザーの一部はここ、星1つのレビューの中にいて、自ら選んでいないCodexの面へと移されています。こうした指標では、置き換えによる成長は採用による成長とまったく同じように数えられます。そして一方は、Claude Codeに対する競争上の勝利ではありません。
Anthropicの拡張機能はより大きく、より怒っている
鏡像のような発見が、この分析を公平に保ちます。AnthropicのClaude拡張機能は3つの中で最大のインストール数(1,100万)でありながら、最低のスコア(2.71)で、53%が星1つです。ストア評価がどちらの企業が勝っているかの投票であるなら、Anthropicは自社拡張機能で大敗しています。
しかしその星1つも、コード品質の話ではありません。ループするログイン、増え続ける権限、そしてトークンの話です。
「This extension was installed by claude without asking me」
「They want us to use more tokens so they can make more money」
「Claude CLI ignores the existence of this plugin completely」
両社とも、自社ユーザーから同じ理由で罰せられています。認証の摩擦、コスト、そして誰も頼んでいない変更です。どちらも、悪いコードを書いたことで罰せられてはいません。
同じ発見が、無関係な2つの面で繰り返される
私たちは2つのコーパスに対して独立にテーマ分類を行いました。公式拡張機能のレビュー806件と、6つのサブレディットからのRedditコメント427件です。結果は再現されました。
| テーマ | 拡張機能レビュー(806件中) | Redditコメント(427件中) |
|---|---|---|
| 信頼性 / バグ | 120 | 21 |
| 認証 / ログイン | 111 | 未計測 |
| コスト / 価格 / トークン | 59 | 20 |
| レート制限 / 利用枠 | 未計測 | 17 |
| ワークフロー / 両方使う | 未計測 | 22 |
| 強制的な製品変更 | 31 | 未計測 |
| プライバシー / 権限 | 25 | 未計測 |
| コンテキスト処理 | 未計測 | 17 |
| 速度 | 未計測 | 10 |
| コード品質 | 3 | 5 |
コード品質は両方のコーパスで最も語られないテーマであり、しかも僅差ではありません。 ストアレビュー806件中3件、Redditコメント427件中5件。共通点のない2つの集団(一方はブラウザ拡張機能に不満を言い、他方はCLIワークフローに深く入り込んでいる)が、独立に同じ結論に達しています。この議論が名目上のテーマとしているものこそ、誰も持ち出さないのです。
代わりに持ち出されるのは請求額と配管です。従量制サブスクリプションと定期リセットされる利用枠で価格設定された製品としては、筋の通った構図です。同じ800万ユーザーの投稿は、2文目で利用制限のリセットを告知しています。両ツールとも十分に良く、品質がボトルネックでなくなったとき、議論はコストとログインの話に移ります。
GitHubは見出しと正反対のことを示す
両ツールとも正式な公開リポジトリがあり、活発に更新され、誰でも数秒で確認できるスター数を持っています。
| 指標(2026年7月15日) | Claude Code | Codex | 先行 |
|---|---|---|---|
| スター | 137,890 | 98,105 | Claude Code、1.41倍 |
| フォーク | 22,235 | 14,628 | Claude Code、1.52倍 |
| オープンIssue | 11,461 | 9,481 | — |
| リポジトリ作成 | 2025年2月22日 | 2025年4月13日 | — |
| リポジトリの中身 | Issueトラッカー + ドキュメント | 完全なRustソース、Apache-2.0 | — |
両製品が比較可能な公開数値を出している唯一の面で、Codexは先行していません。しかも「Codexが勝っている」という見出しが最高潮に達したまさにその日にです。
ただし、これで決着したふりはしません。2つのリポジトリは同じ種類のものではないからです。 openai/codex はApache-2.0の実際のRustソースです。読めるし、フォークできるし、パッチも送れます。そこでのスターは「このコードが欲しい」を意味しうる。anthropics/claude-code はnpmで配布されるクローズドソースツールのIssueトラッカー兼ドキュメントリポジトリで、そこでのスターはブックマークに近い。これらは異なる行為であり、単純な比較はその差をならしてしまいます。
誠実な読み方は限定的です。ここでCodexは先行していない。それは「しかも僅差ですらない」とは両立しません。だからといって、Claude Codeが勝っている証拠にもなりません。
両リポジトリのリリース頻度も測ろうとしました。本当に有用だったはずですが、リリースのエンドポイントは両方ともアップストリームのエラーを返したため、推測せずにこの切り口を落としました。
Redditでは、両ツールに言及するスレッドは比較ではない
6つのサブレディット(r/ClaudeCode、r/ClaudeAI、r/OpenAI、r/ChatGPTCoding、r/CodingLLM、r/Claudex)からそれぞれ直近100件の投稿を取得しました。合計495件の投稿と427件のコメントです。
まず方法論上の注意を一つ。これ自体が発見でもあります。Redditの検索エンドポイントはこのトピックを切り出せません。 「codex vs claude code」で検索すると「code」という単語に緩くマッチし、Destiny 2のコード一覧やVS Codeのミーム、Arduinoのプロジェクトが返ってきます。この議論でRedditの検索件数を引用している人は、ノイズを数えています。私たちはサブレディットごとに、ツール名で照合しました。
| サブレディット | 投稿数 | 期間 | Codex言及 | Claude Code言及 | 両方 |
|---|---|---|---|---|---|
| r/ClaudeCode | 100 | 7月14〜15日 | 12 | 40 | 10 |
| r/ClaudeAI | 100 | 7月14〜15日 | 6 | 43 | 4 |
| r/OpenAI | 100 | 7月13〜15日 | 18 | 1 | 0 |
| r/ChatGPTCoding | 100 | 2月14日〜7月7日 | 21 | 13 | 5 |
| r/CodingLLM | 92 | 2025年11月〜7月1日 | 5 | 8 | 1 |
| r/Claudex | 3 | 2月9日 | 2 | 1 | 1 |
| 合計 | 495 | — | 64 | 106 | 21 |
495件中21件が両方のツールに言及していました。読んでみると、ほとんど判定ではありません。統合に関する質問です。What's the best way to use both Codex and Claude Code? や Is Codex useful in a Claude Code based workflow? といったものです。
そして回答は忠誠心ではなく配管の話です。best way to use both のスレッドでは、開発者たちが ~/.claude/skills を ~/.codex/skills にシンボリックリンクし、OpenAIのCodex MCPサーバーをClaude Codeに登録し、両エージェントを同じ作業ディレクトリに向ける方法を語っています。ある返信はこうです。
「Best way to use: rub them together.」
支配的なパターンは分業です。一方のエージェントが計画し、もう一方が実装またはレビューする。2つ目のモデルが1つ目の見落としを拾うからです。Codex in a Claude Code workflow のスレッドより。
「It's about how they work together. I use both.」
そしてより端的な、本稿のテーゼになりうるコメント。
「Stop scoring Codex against Fable head to head.」
何が言えて、何が言えないか
成り立つと考えること: コード品質は無関係な2つのコーパスで、大差をつけて最も語られないテーマです。両社のユーザーは代わりにコスト・認証・信頼性について不満を述べています。OpenAIは7月9日にChatGPT拡張機能をCodexの面に変え、目に見える割合のユーザーがそれに怒っています。これは、束ねられたアクティブユーザーの成長と競争上の採用が同じではないことの直接的な証拠です。
限界:
- サンプルは小さく、期間が不均一です。 100件の投稿はr/ClaudeCodeでは約1日分、r/ChatGPTCodingでは約5か月分に相当しますが、正規化していません。r/ChatGPTCodingの最新投稿は8日前で新しいモデレーターを募集しており、その遅さはツールではなくサブレディットの健全性を反映しています。
- ストアレビューはユーザー層の中で最も怒っている一部です。 200万インストールに対する333件の評価は、ユーザーの標本ではなく、書くほど動機づけられた人の標本です。二極化は常にそう見えます。スコアではなくテーマを読んでください。
- Redditの公開フィードは100件で打ち切られ、スコアも公開されないため、エンゲージメントで重み付けできませんでした。
- テーマ分類はキーワードベースであり、意味論的ではありません。 また2つのコーパスは異なるテーマ集合で分類したため、上の表の列は厳密には同一基準ではありません。数字は形として扱ってください。
- GitHubのスターは虚栄の指標であり、2つのリポジトリの中身も異なります。
- リリース頻度は測れませんでした。 両リポジトリでエンドポイントがアップストリームのエラーを返しました。
これらのどれも「CodexがClaude Codeを追い抜いた」という主張を救いません。私たちの反証も判定ではなく形にすぎない、というだけです。それは元の主張が一度も満たさなかった基準です。
実際の答え
CodexはClaude Codeを打ち負かしているのか? 両社の外部にいる誰にとっても入手可能な証拠に基づけば、誰にも言えません。そして両方のツールを使っている開発者は、ほとんど気にしなくなっています。
ユーザー数では答えられません。異なる日付の2製品を、古い基準値に対して、分母を公開せずに測っており、その成長の少なくとも一部は、星1つを付けているCodexの面へと移されたユーザーです。モバイルストアでも答えられません。実際に確認したところ、シグナルは100件に1件でした。唯一の綺麗な公開指標は、確かな留保付きで、穏やかにClaude Codeを指しています。そして実際に作業をしている人々は、投票などしていません。2つのエージェントに互いの仕事を引き渡させる方法について22件のコメントを重ね、それにかかるコストへの不満はさらに深いのです。
語られているレースは、走られているレースではありません。それが本稿の発見です。
出典
調査方法
本稿の数字はすべて、他の記事から間接的に引用したものではなく、2026年7月15日にCrawlora自身のAPIを通じて直接取得したものです。各ベンダーの公式掲載を列挙するためのChrome Web StoreのアイテムおよびレビューエンドポイントとChrome拡張機能データセット、App Storeレビュー、GitHubリポジトリ指標、サブレディット投稿とスレッドコメント、そしてTibo氏の投稿をそのまま取得するためのX投稿エンドポイントです。
コーパス:1,828件 — 公式Chrome拡張機能のレビュー806件(Claude、ChatGPT、ChatGPT search)、r/ClaudeCode、r/ClaudeAI、r/OpenAI、r/ChatGPTCoding、r/CodingLLM、r/ClaudexからのReddit投稿495件とコメント427件、ChatGPTおよびClaudeアプリの直近iOSレビュー100件。公開するのは集計値のみで、レビューやコメントの生データは公開しません。
自分で再現するにはPlaygroundをお試しください。GitHubのスクレイピング方法、Redditのスクレイピング方法、App Storeレビューのスクレイピング方法の各ガイドが具体的な呼び出し方を説明しており、料金で無料枠を確認できます。発端となった数字については600万/700万という主張のファクトチェックをご覧ください。より広い状況についてはAIによるウェブスクレイピングと最良のAIウェブスクレイピングツールをどうぞ。
よくある質問
CodexはClaude Codeを打ち負かしているのですか?
両社の外部で入手できる証拠に基づけば、誰にも言えません。OpenAIの800万という数字はCodex単体ではなくChatGPT Workとの合計であり、比較対象とされるClaude Codeの数字は日付不明の古い200万というスナップショットです。GitHub(両ツールが直接比較可能な公開指標を出している唯一の面)では、2026年7月15日時点でClaude Codeが137,890スター、Codexが98,105スターで、Claude Codeが先行しています。またCodexの報告された成長の一部は、自ら選んでいないCodexの面へ移されたユーザーです。OpenAIは2026年7月9日にChatGPTのChrome拡張機能をCodex for Chromeに変更し、その拡張機能の直近レビューの28%が星1つです。
なぜApp StoreやGoogle Playのレビューではこの議論を決着できないのですか?
どちらのコーディングエージェントもそこには存在せず、私たちはその差を仮定ではなく実測したからです。ChatGPTのiOSアプリ(8,592,629件の評価)とClaudeアプリ(199,486件)はコンシューマー向けチャット製品であり、両者の直近レビュー100件のうちコーディングエージェントに言及したのはわずか1件でした。この約1%というシグナルこそ、よく引用される43対1の評価比率がチャットの普及について語るだけで、CodexやClaude Codeについては何も語らない理由です。
CodexやClaude Codeに、レビューを収集できるブラウザ拡張機能はありますか?
あります。そしてこれこそ多くの人が見落としている面です。AnthropicはClaude拡張機能(1,100万ユーザー、評価2.71、53%が星1つ)を、OpenAIはChatGPT search(400万ユーザー、3.33)とChatGPT(200万ユーザー、3.71)を提供しています。2026年7月9日、OpenAIは後者をCodex for Chromeに変えてAtlasサイドバーを置き換えました。直近166件のレビューのうち52件がCodexに言及しており、Codexに関する実際のフィードバックを含む唯一の公式ストアコーパスとなっています。
開発者がCodexとClaude Codeを比較するとき、実際に何を論じているのですか?
コード品質ではなく、コストと利用枠です。しかもこの発見は無関係な2つのコーパスで再現されます。Redditのコメント427件では、コード品質が最も語られないテーマ(5件)で、コスト(20件)とレート制限(17件)で合計37件でした。公式ブラウザ拡張機能のレビュー806件でも、コード品質はわずか3件で再び最下位となり、信頼性(120件)、認証・ログイン(111件)、コスト(59件)を下回りました。