Tony Wang10 分で読めますApp Store のレビューは本物か? 500万件を読んでみた
最新の App Store と Google Play のレビュー約500万件を読みました。星バッジは空洞化した中間を隠しています。約80%が星1つか星5つで、最新の iOS 平均はわずか3.15★です。
App Store のレビューは本物なのでしょうか。ほとんどはイエスです。そして、それはあまり面白くない問いだと分かります。私たちは iOS App Store と Google Play で最新のレビュー約496万件を収集しました。内訳は iOS で116万件、Android で380万件で、レビューそのものは本物に見えます。データとの照合に耐えられないのは星バッジのほうです。アプリのアイコンの下に表示される数字は生涯平均であり、生涯平均は良く見えるように設計されています。人々がいま書いているレビューは、より厳しく、より二峰型の物語を語っています。
見出しはこうです。中間は空っぽです。 iOS では最新レビューの43%が星5つ、36%が星1つで、合わせると全レビューの79%が両極端に位置し、星2つから4つの範囲全体は残りの21%を分け合っています。最新の平均は3.15で、人気アプリの多くが表示する4.5以上のバッジをはるかに下回ります。Android はもう少し穏やかですが形は同じで、星5つが62%、星1つが21%、平均3.87、中間にあるのはわずか17%です。
空洞化した中間
こちらが iOS の分布です。ベルカーブでもなく、なだらかな傾斜でもありません。谷を挟んで2本の塔が立っています。
この形はアプリに特有の新しいものではありません。研究者が20年にわたって文書化してきたオンラインレビューの J字型分布です。基礎となった MIS Quarterly の研究の言葉を借りれば「正に偏り、非対称で、二峰型」です。大部分が星5つ、いくらか星1つ、その中間はほとんどありません。Google Play のレビュー8,600件を対象とした独立した学術サンプルでも同じ谷が見つかりました。星5つが42.5%、星2つが8.8%、星1つが20.7%です。「空洞化した中間」は、任意で書かれるレビューの通常の物理法則なのです。
通常ではないのは、私たちの最新の iOS サンプルがどれほど星1つに傾いているかです。
バッジは生涯平均であり、生涯レーティングは高評価寄りになる
アプリの下にある星評価は全期間の平均であり、全期間の平均は構造上お世辞になります。App Store のほぼ全数調査(143万本のアプリにまたがる本物のレビュー6,260万件)によると、生涯の内訳は**星5つが65%、星4つが16%、星3つが6%、星2つが4%、星1つはわずか10%**でした。これが典型的な右に偏った J字で、5つのうち4つの評価が星4つか5つに集まっています。
私たちの最新レビューはその生涯像とはまったく似ておらず、そのギャップこそが物語です。
全期間平均 — バッジ
最新レビュー380万件
最新レビュー116万件
ストア上で星5つのアプリが、今週レビューしている人々からは3件に1件の星1つを得ていることがあります。バッジは嘘をついているわけではなく、あなたがふだん尋ねている問い(「このアプリはいま良いのか」)とは別の問い(「このアプリは生涯を通じてどうだったのか」)に答えているだけなのです。
iOS は Android より厳しい
2つのストアは同じようには振る舞いません。最新の iOS レビューは、最新の Android レビューよりも明らかにネガティブです。
Android の最新レビュー(星5つ62%、平均3.87)は歴史的な生涯の標準に近い位置にあり、iOS のレビュー(星5つ43%、平均3.15)が外れ値です。なぜかは本当に未解明です。候補となる説明には、各ストアがレビューを促すタイミングの違い、評価ダイアログの表示のしかた、最近のレビューの流れを支配しているアプリの違いなどがあります。私たちは原因を突き止めたと主張しているのではなく、ギャップを指摘しているのです。ただ、その方向性はより広い記録と一致しています。ネガティビティバイアスはApp Store のレビュー行動に特有のものとして文書化されており、消費者はネガティブなレビューに不釣り合いなほど動かされます。
なぜ中間が空洞なのか:自慢、不満、そして最新アップデート
いずれもよく研究された2つの力がこの形を生み出します。そのどちらも、アプリそのものが賛否を分けるものである必要はありません。
自己選択。 レビューを書く人はユーザーの無作為なサンプルではありません。わざわざ書く人は不釣り合いなほど大喜びの人(自慢したい)と激怒した人(不満を言いたい)であり、単に満足しているだけの多数派はレビューダイアログを開くことがありません。MIS Quarterly の研究はこれを取得バイアスと過少報告バイアスと呼び、明快な証明を持っています。研究者が無作為なグループに、無作為に割り当てられた同じ製品を強制的に評価させたところ、二峰型のスパイクははるかに低い平均を持つ正規分布へと崩れ、星5つはわずか**3%**でした。あなたが目にする両極端は、誰が声を上げることを選ぶかによるアーティファクトであって、製品が愛されているか嫌われているかの証拠ではありません。
新近性。 そのベースラインに加えて、最新のレビューはイベント駆動です。App Store のレビュー700万件を対象とした研究によると、たった1つの悪いアップデート(クラッシュを引き起こすリリース、強制的な UI リデザイン、削除された機能)がセンチメントの急激で一時的な崩壊を引き起こし、問題が修正されると回復します。生涯平均はほとんどピクリともしませんが、最新レビューのフィードは急降下します。「今週のレビュー」を読むとき、あなたはしばしば直近のリリースの余波を読んでいるのです。
何が星1つのレビューを生むのか
ネガティブな塔は無作為な悪意ではありません。文献の中で、そして人々が実際に打ち込む検索の中で支配的な星1つのテーマは、驚くほど一貫しています。
- アップデート後のバグとクラッシュ — センチメント崩壊の最も一般的なトリガー。
- 強制的な変更: UI のリデザインや削除された機能を全員に一斉に押しつけること。(「アプリはなぜこんなに頻繁にアップデートするのか」「アプリはなぜログアウトさせるのか」が Google のオートコンプリート上位に来るのには理由があります。)
- 価格とサブスクリプション: 以前は無料だった機能がペイウォールの向こうに移されること。
- 広告とアカウント/ログインの問題: 星4つのユーザーを星1つにしてしまう日常的な摩擦。
星はこのいずれに対しても粗雑な道具です。同じ研究によれば星評価とレビュー本文の一致は中程度にとどまり、隣に書かれた意見と一致しない評価が意味のある割合で存在します。理由が知りたいなら本文を読まなければならず、それこそが構造化されたレビューデータセットの用途なのです。
それで、レビューは偽物なのか
これは人々が実際に検索する問い(「App Store のレビューは偽物」「App Store のレビューは本物」)なので、まっすぐな答えに値します。本物のレビューは問題ではありません。そして私たちのデータがその証拠です。 偽のレビューや報酬付きのレビューは、私たちが測定したのとは逆方向に偏ります。同じ App Store 全数調査によると、不正なレビューは星5つが約70%、星1つが0.6%で、疑わしいほど輝かしく、苦情はほとんどありません。**星1つを36%**抱える最新のフィードは、操作工場ではなく、本物の不満を抱えた人間の指紋なのです。
正直な結論は「レビューは偽物だ」ではありません。「星バッジは生涯平均であり、あなたはそれを現在についての評決として読んでいる」です。レビューは本物です。誤解を招くのは要約統計量のほうです。
どう作ったか、そしてどう作り直すか
ここに示したすべての数値は Crawlora の アプリレビューデータセット から得たものです。両ストアの人気上位アプリの最新レビューを、重複排除して1つの REST API 越しに JSON として問い合わせできます。スクレイピングもプロキシもボット対策も管理する必要はありません。同じカタログが私たちの 400万本のアプリデータセット と 毎日の App Store + Google Play チャート を支えています。
市場全体ではなく1つのアプリについて、星の背後にある理由が知りたいですか。無料の App レビューアナライザー は任意のアプリの最新レビューのテーマを要約し、App Store のレビューをスクレイピングする方法 はそのエンドポイントを順を追って解説します。
バッジだけでなく、レビューを読もう
任意のアプリの最新の App Store と Google Play のレビューを、正規化された JSON(星、本文、国、バージョン、参考になった数)として1つの REST API 越しに取得できます。プロキシ、レンダリング、ボット対策は処理済みで、成功課金制です。毎月2,000クレジット無料、カード不要。
よくある質問
App Store のレビューは本物ですか?
本物のレビューは本物です。そして私たちのデータがその証拠です。偽のレビューや報酬付きのレビューは疑わしいほど高評価に偏ります(App Store の全数調査では不正なレビューは星5つが約70%、星1つが0.6%でした)。ですから、私たちの iOS サンプルのように星1つを36%抱える最新のレビューフィードは、操作工場ではなく、本物の不満を抱えたユーザーの指紋です。誤解を招くのはレビューではなく星バッジのほうで、これはあなたが現在についての評決として読みがちな生涯平均なのです。
なぜアプリのレビューはほとんどが星5つか星1つなのですか?
レビューを書くのは任意であり、わざわざ書く人が不釣り合いなほど大喜びの人(自慢する)と激怒した人(不満を言う)だからです。満足している多数派はダイアログを開くことがありません。この「自己選択」が、20年にわたって文書化されてきた J字型の二峰型分布を生みます。私たちの最新レビュー約496万件では、約80%が星1つか星5つに集まり、星2つから4つの中間は空洞です。研究者が無作為なグループに同じ製品を評価させると、そのスパイクは消えます(星5つはわずか3%)。
なぜアプリの最新レビュー平均は星評価より低いのですか?
星バッジは生涯平均であり、アプリの生涯レーティングは高評価寄りになります。6,260万件のレビューを対象とした App Store の全数調査では星5つが65%、星1つはわずか10%でした。最新のレビューはイベント駆動です。バグのあるアップデート、強制されたリデザイン、削除された機能が、全期間平均がならしてしまう一時的な星1つの急落を引き起こします。私たちの最新の iOS サンプルの平均はわずか3.15で、人気アプリの多くが表示する4.5以上のバッジをはるかに下回ります。
iOS と Android のアプリレビューはどちらが厳しいですか?
私たちの最新サンプルでは iOS が明らかに厳しいです。最新の iOS レビューは星5つが43%に対して星1つが36%(平均3.15)である一方、最新の Google Play レビューは星5つが62%に対して星1つが21%(平均3.87)です。なぜ iOS がこれほど大きくネガティブに偏るのかは未解明の問いですが、App Store のレビュー行動に特有のものとして文書化されているネガティビティバイアスと一致しています。
何が星1つのアプリレビューを引き起こしますか?
支配的な星1つのトリガーは、アップデート後のバグとクラッシュ、強制的な変更(UI のリデザインや削除された機能を全員に一斉に押しつけること)、以前は無料だった機能がペイウォールの向こうに移されること、押しつけがましい広告、そしてアカウントやログインの問題です。たった1つの悪いリリースが、修正されるまでアプリの最新レビューのセンチメントを崩壊させることがあります。