AIの偽情報対策【後編】
「正解率99%のAI」でも信じてはいけない? 専門家が指摘する“深い問題”
「99%の正解率」を示すAIモデルがあったとしても、残りの1%の間違いは「偶然のエラー」ではない可能性がある――。専門家がそう指摘する背後にあるのは、AIモデル特有の問題だ。
大規模言語モデル(LLM)は進化を遂げ、人間が書いたものと見分けがつかないほど、自然で完璧な文章を生成できるようになった。その結果、文法の誤りといった従来の手法で偽情報を見抜くことは、もはや不可能に近い。
こうした脅威が深刻化する中、偽情報の検出手法の根本的な見直しが進んでいる。AI(人工知能)技術が生成した偽情報がどのような問題を生んでいるのか、その対抗策として何が有効なのかを、シンポジウムでの議論を基に解説する。
「AIの進化」の裏で加速する3つの問題
併せて読みたいお薦め記事
連載:AIの偽情報対策
偽情報と戦うには
オランダの数学・情報科学研究所であるCentrum Wiskunde & Informatica(CWI)が2025年5月に開催した、偽情報とLLMに関するシンポジウムでは、AI技術による偽情報の脅威が深刻化している3つの領域として、以下が挙げられた。
- コンテンツファーム
- 品質が低いコンテンツを大量に生産すること。
- LLMの発展によって、偽情報を含む文章を大量に自動生成できるようになった。
- LLMの脆弱(ぜいじゃく)性
- LLM自体が持つ、バイアス(偏見)やハルシネーション(幻覚)といった根本的な弱点。
- 新しい脆弱性が見つかると、それを悪用した手口も巧妙になる。
- マイクロターゲティング
- 特定のコンテンツを、特定の興味や思想を持つ人々特定のグループに狙い撃ちで届けること。
- LLMで大量に自動生成した文章を、だまされやすい人々にピンポイントで届けられるようになった。
シンポジウムの主催者の一人であるCWIの研究者、ダビデ・チェオリン氏は、中でもコンテンツファームを最も懸念していると指摘する。「LLMを使って文章を生成することは非常に容易である一方、そうして生成された文章の偽情報を人間が見抜くことははるかに難しい」
ライデン大学(Leiden University)でサイバーセキュリティを教えるトミー・ファン・スティーン氏は、偽情報の検出をますます困難にしている原因は「根本的な非対称性」にあると話す。作成の簡単さと検証の困難さが釣り合っていない点が問題だということだ。「この不均衡を簡単に是正することはできない」と同氏は説明する。
巧妙なコンテンツ生成と精密なターゲティングが結び付くと、偽情報対策はさらに難しくなる。「悪意のあるLLM製文章が、特定のグループを効果的に狙い撃ちできた場合、その行為を見つけて検出することは一層困難になる」とチェオリン氏は述べる。不特定多数ではなく特定のグループに向けて拡散することで、セキュリティ専門家を含む外部の人間が偽情報に気付きにくくなると同時に、偽情報を信じやすい人に向けてより効果的に情報を届けられるようになるからだ。
このような巧妙な偽情報に対処するには、検出方法を根本的に見直す必要がある。チェオリン氏は、単なる精度よりも透明性を重視した、説明可能なAIモデルを提唱する。「精度85%で説明可能なAIモデルと、精度99%でブラックボックスなAIモデルのどちらを選ぶべきか」と問われた同氏は、次の問いを投げ掛けた。「精度99%のブラックボックスなAIモデルを、99%の時間、本当に信頼できるだろうか」
ブラックボックスなAIモデルにおける1%の不正確さは、ランダムな誤差ではなく、AIモデルの構造的なバイアスを示している可能性がある。透明性がなければ、企業はAIモデルにある欠陥を特定したり対処したりできない。透明性の高いAIモデルであれば、不備がある可能性のある領域を特定し、改善策を講じることが可能だ。
この考え方は、AIモデルのバイアスを評価するという、より広範な課題にも通じる。「われわれは現在、AIモデルのバイアスを評価、測定するための基準を検討している。こうした基準は、エンドユーザーがAIモデルから受け取る情報の質を理解する助けになる」(チェオリン氏)
不確実な未来に備える
AI技術が生む偽情報に苦慮している企業に対し、チェオリン氏は基本に立ち返って、従来の技術をうまく活用することの重要性を強調する。
LLMの性能が向上しても、従来の検証手法は依然として有効だ。「回答に利用した情報源を示してくれるLLMを利用する際、エンドユーザーは生成された文章だけではなく、その情報源が本当に使われたかどうかを確認し、その情報源の評判や信頼性、信ぴょう性をチェックすべきだ」とチェオリン氏は語る。
「将来的には、企業、市民、政府機関が一体となった『共同の取り組み』が不可欠だ」とCWIの研究者は述べる。その枠組みの中で、研究者には「問題とリスクを明らかにし、解決策を提案する」という役割を担う。市民がLLMの利点だけではなく、限界も理解できるよう支援することが、極めて重要になるという。
その研究者は次のように話す。「最終的な判断はエンドユーザー自身が下すべきだ。エンドユーザーが文章の内容だけではなく、なぜそれを信頼すべきかを理解するのに役立つ情報を、透明性の高いAIツールを通じて得られるように支援することが不可欠だ」
Copyright © ITmedia, Inc. All Rights Reserved.
本記事は制作段階でChatGPT等の生成系AIサービスを利用していますが、文責は編集部に帰属します。
TechTarget発 グローバルITピックアップ
TechTargetジャパンの記事の一部で生成AIを補助的に活用し、米国Informa TechTargetの記事を翻訳・編集して国内向けにお届けします。編集部による内容の確認を徹底しています。
この記事の著者
関連記事
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
「Excel至上主義」の終わらせ方 丸2日の手作業地獄から情シスと現場を救うには
-
2
取手市がVDIと決別した理由 更改費用「4倍超」を約1.7倍に圧縮
-
3
「Microsoft 365のセキュリティ運用」に関するアンケート
-
4
急増する「AIはこう言ってる」マン 判断を狂わせる「AI忖度」を防ぐには?
-
5
221人調査で分かった「情シス最大のストレス」は?
-
6
「Salesforceのテスト自動化ツール」に関するアンケート
-
7
「データストレージの活用方法」に関するアンケート
-
8
IT製品の導入に関するアンケート「サーバ&ストレージ」編
-
9
「AI時代の統合基盤・エンタープライズAI管理」に関するアンケート
-
10
100億円の「Linux更新」を回避 みずほ銀行が選んだ“おきて破り”のRHEL延命策
ホワイトペーパーランキング PR
-
1
年収2000万「クラウドセキュリティのプロ」になれる資格とは
-
2
セキュリティソフトをすり抜ける標的型攻撃メール、不審メールの見破り方とは?
-
3
Windows Updateの通信集中で回線が逼迫、ネットワーク刷新事例に学ぶ解決策
-
4
財務を戦略的組織へ進化させるAI活用術、4つの主要な障壁と解消方法
-
5
「NAS」「SAN」「DAS」は何が違う? いまさら聞けないストレージの基礎
-
6
“あのファイル転送”で暗躍するノーウェアランサム
-
7
標的型攻撃メールを見破るには? サンプル文面を例に傾向を解説
-
8
商用利用の安全性を確保し大量のコンテンツを高速で生成する、AI活用の秘訣
-
9
マンガで解説、1日で生成AI環境を構築できるワークショップの中身とは?
-
10
Dark AIが台頭する時代の新発想、「より高度なAIで対抗する」具体的方法とは?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー