米大統領選挙では、ほぼ全ての予測モデリングアルゴリズムが勝者予想を外した。その原因にデータサイエンティストが注意を払わなければ、今後あらゆる予測分析プロジェクトを迷走させてしまう恐れがある。
2016年米大統領選挙の前まで、ほぼ誰もが(Webサイト「FiveThirtyEight」を運営するデータサイエンスの権威ネイト・シルバー氏から、「The New York Times」まで)、ヒラリー・クリントン氏が楽勝する可能性が極めて高いと予想していた。そして彼らのモデルは崩壊した。
こうした予想者の失敗の原因となった問題は、今回の選挙に固有のものではない。分析チームがまた同じ轍(てつ)を踏むと、あらゆる予測モデリングや予測プロジェクトが迷走する恐れがある。その問題には、過信、データの質の低さ、および統計的な可能性を揺るぎない確実性と取り違えていたことが含まれ、これらが複合的な問題となっていた。
「残念なことに、予想者はこうした予想数字を小数点第1位まで求める。すると、科学的な式に基づいているように聞こえるが、実はそうではない」。エール大学医療インフォマティクスセンターでアソシエートリサーチサイエンティストを務めるプラディープ・ムタリク氏はそう語った。同氏は「Quanta Magazine」のために選挙に関するブログを運営している。
「予想者は確実性をアピールしすぎていた。そして面目が丸つぶれになってしまった」とムタリク氏は語る。
Copyright © ITmedia, Inc. All Rights Reserved.
お知らせ
米国TechTarget Inc.とInforma Techデジタル事業が業務提携したことが発表されました。TechTargetジャパンは従来どおり、アイティメディア(株)が運営を継続します。これからも日本企業のIT選定に役立つ情報を提供してまいります。
トラフィック1300%増、生成AIがEコマースを変える
アドビは、2024年のホリデーシーズンのオンラインショッピングデータを公開した。
「ドメインリスト貸し」は何がマズい? サイトの評判の不正使用について解説
「サイトの評判の不正使用」について理解し、正しい対策が取れるにしましょう。
代理店にもAIにも「丸投げ」はダメ 成果報酬型マーケティングを成功させるポイントは?
「成果報酬型マーケティング」を実現する上でインターネット広告業界が直面する課題とは...