LLMの限界と“次のAI”【前編】
いまさら聞けないLLMの仕組みと5つの“限界”
生成AIを支える大規模言語モデル(LLM)の進化が目覚ましい。一方で、無視できない幾つかの課題も明らかになってきた。LLMの概要と、根本に存在する5つの課題を解説する。
大規模言語モデル(LLM)の開発が進み、画像やテキストを自動生成するAI(人工知能)技術「生成AI」が社会のあらゆる場面で活躍している。一方、LLMの能力の限界を補う技術の開発も進んでいる。LLMとはそもそも何なのか。どのような“限界”を迎えているのか。
そもそもLLMとは?
LLMは大規模という言葉の通り、膨大な量のテキストデータを使って学習した機械学習モデルを指す。
現在主流のLLMは、深層学習モデル「Transformer」を基に設計されている。Transformerの特徴は、テキストをトークン(言語の最小単位)に変換し、複数のトークンを同時に解析できる点だ。プロンプト(指示)のどの部分に重点を置くべきかを動的に判断する仕組み「アテンションメカニズム」を用いて、文章内の単語やその他のトークンの重要度を判断する。この仕組みは、データを逐次処理することで文章を生成する従来のLLMとは一線を画す。
AIベンダーOpenAIの「GPT」、Anthropicの「Claude」、Meta Platformsの「Llama」といったLLMはいずれもTransformerを採用している。ただし、異なるアプローチを採用したLLMも存在する。AIベンダーMistral AIの「Codestral Mamba」はTransformerではなく「Mamba」というモデルをベースとしている。
LLMには、曖昧な部分も存在する。どれほどのデータ量を使えば「大規模」と言えるのか、明確な基準はない。著名なLLMは、インターネットで公開されている情報をはじめとした大規模なデータを用いて学習していると考えられている。
比較的小規模な学習データのモデルをLLMと呼ぶべきか、あるいは小規模言語モデル(SLM)と呼ぶべきかという点には、議論の余地がある。この点において、LLMという言葉は「ビッグデータ」という言葉に似ており、「どこからが大規模なのか」という明確な線引きは存在しない。
LLMの課題
LLMは、自然言語の指示や内容を解釈し、新たなコンテンツを生成するなどの優れた能力を持つ。言語だけではなく画像や音声、動画といった異なる形式(モダリティー)のデータを理解、処理できる「マルチモーダルLLM」もある。
一方で、LLMには課題や欠点もある。以下がその例だ。
課題1.ハルシネーションが発生するリスクがある
幻覚(ハルシネーション)は、LLMが事実を検証するのではなく、学習データ内の膨大なパターンを元にして、統計的に「最もそれらしい」応答を生成するという仕組みに起因する。この仕組み上、現状のLLMではハルシネーションを完全に防止することは難しい。
課題2.膨大な計算リソースが必要
LLMの中には、計算効率に優れたタイプも存在するが、トレーニングと推論には膨大な計算リソースが必要だ。
課題3.対話内容を長期的に保持できない
LLMは動作の原理上、学習に使用したデータを短期的には記憶できるが、推論中に新たに入力されたデータを保持したり、新しいプロンプトを処理する際に過去に入力されたプロンプトを参照したりすることはできない。「ChatGPT」をはじめとした一部の生成AIツールは、過去のプロンプトを考慮して新しい応答を生成できるが、これは基盤となるLLM自体の機能ではなく、外部の仕組みによって実現している可能性がある。
課題4.継続的な学習ができない
LLMは、自動的に新しい情報を学習し続ける能力を持たない。つまり、LLMの知識を常に最新に保つための信頼性の高い手法は、まだ確立されていない。
課題5.人間のように推論できない
LLMは、人間のような論理的な推論能力を持っていない。学習データとは無関係な情報に対して、論理を組み立てて解釈し、回答できないためだ。LLMは、入力データを自身の学習データ内のパターンと照らし合わせ、それらの関係性に基づいて出力を生成することしかできない。
これらの課題が、特定の場面で足を引っ張る場合がある。ある弁護士が業務での調査でChatGPTを補助的に使用した結果、罰金を科せられた事例が存在する。
公開直後のニュース記事を検索するためにLLMを利用するのもお薦めしない。LLMの知識は、リアルタイムで変化するデータを完全に反映していないためだ。
次回は、LLMに代わる選択肢を紹介する。
TechTarget.AIとは
TechTarget.AI編集部は生成AIなどのサービスを利用し、米国Informa TechTargetの記事を翻訳して国内向けにお届けします。
Copyright © ITmedia, Inc. All Rights Reserved.
本記事は制作段階でChatGPT等の生成系AIサービスを利用していますが、文責は編集部に帰属します。
TechTarget.AI
TechTarget.AI編集部は生成AIなどのサービスを利用し、米国TechTargetの記事を翻訳して国内向けにお届けします。
この記事の著者
関連記事
新着ホワイトペーパー PR
-
製品資料
[株式会社キーエンス] なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは -
製品資料
[株式会社セールスフォース・ジャパン] 「CRMは設計と無関係」は本当か? PLMとの融合で実現する高速開発 -
事例
[日本ヒューレット・パッカード合同会社] AIエージェントの時代にどう備える? 「新たな働き手」を支える3要素とは -
製品資料
[日本ヒューレット・パッカード合同会社] “横並びの自動化”から脱却、AI活用で生産性と競争力を高める秘訣 -
製品資料
[サイボウズ株式会社] AIが「わざわざ使うツール」になっていない? 業務で自然に使う導線にする秘訣
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
なぜ「全社配布Copilot」は使われないのか? 失敗に学ぶAI定着
-
2
法務と開発者で「言葉が通じない」問題 トヨタやソニーが語るOSS管理の真実
-
3
【漫画付き】ひとり情シス協会が明かす、RAG導入でしくじる企業「2つの共通点」
-
4
情シスの約8割が転職や退職を意識 調査で分かった“辞めたくなる最大の理由”
-
5
損保ジャパンはなぜ「COBOL」を捨てなかったのか? 脱メインフレームの真相
-
6
ChatGPTは“検索しまくり”でGeminiは“淡泊”? データが明かすAIの裏側
-
7
情報漏えいはなぜ繰り返されるのか 今すぐ見直すべき「境界」
-
8
BMWも導入 78兆円市場に化ける「フィジカルAI」の衝撃
-
9
「Wi-Fi 7」経由でWindowsが乗っ取られる? 最高権限奪取の恐怖
-
10
「AI活用を前提とした業務PCへの移行」に関するアンケート
ホワイトペーパーランキング PR
-
1
不審メールの経路や見せ方に変化? 2026年夏の3事例から見えた動向と対処方法
-
2
家庭用Wi-Fiルーターの業務利用は危険? 避けるべき理由と具体的な対策
-
3
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
-
4
財務部門がAIを最大限に活用する方法 無駄のない戦略的リーダーシップへの道
-
5
LLMが兵器化? 元FBI高官が鳴らす警鐘とセキュリティツール統合のポイント
-
6
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
7
なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは
-
8
生成AIを開発に導入しても効果が見えない? 実証実験で分かった成果と課題
-
9
経産省DX指針から読み解く、受発注業務デジタル化ロードマップ
-
10
HDDを使わない「SSDオンリー」が無謀なのはなぜ?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー