LLMのリスク管理を考える【前編】
中国製AI「DeepSeek」に冷や水を浴びせた“生成AIの脆弱性”とは?
突如として話題になった中国製AI「DeepSeek」が市場の関心を集める一方で、セキュリティベンダーが同モデルの脆弱性を指摘している。その具体的なリスクとは。
2025年1月27日、中国のAIベンダーDeepSeekは、大規模言語モデル(LLM)「DeepSeek R1」を発表した。そのコスト効率の高さやオープンソースである点が注目を集め、それまで米国一強だったAI市場の勢力図に変化の兆しが見られるなど、AI市場には一時的に混乱が生じた。
しかし、DeepSeekの発表から数日後、セキュリティベンダーPalo Alto Networksの研究者は、DeepSeek R1に特定の脆弱(ぜいじゃく)性があることを明らかにした。その具体的なリスクとは何なのか。
「DeepSeek」の脆弱性が明らかに 具体的なリスクは?
併せて読みたいお薦め記事
DeepSeekのリスクを考察する
Palo Alto Networksの技術チームは、3つの「ジェイルブレーク」(脱獄)技法がDeepSeekのセーフガードを突破したことを明らかにした。ジェイルブレークとは、特定のプロンプト(情報生成のための質問や指示)を入念に作成したり、脆弱性を悪用したりすることで、LLMが備える防御ルールを回避し、モデルが避けるべき出力(バイアスがかかった出力や有害な出力など)を引き出す技法を指す。
本来、大規模言語モデル(LLM)がマルウェア作成などの不正目的に利用されるのを防ぐべきルールが設定されているが、攻撃者がジェイルブレークを使うことで、容易に回避できてしまう可能性がある。Palo Alto Networksによれば、ジェイルブレークを扱うための専門知識はほとんど、もしくは全く必要なかったという。
実証では、サイバー犯罪者が関心を持つ分野に関する具体的なガイダンスをDeepSeekから引き出したという。これには、データの不正取得や、マルウェアの作成に関する指示が含まれた他、即席爆発装置(IED)の製造方法に関する情報も生成可能であることが確認された。
火炎瓶やマルウェアを作成するための情報はインターネット上で簡単に入手できる。一方で、LLMは簡単に使える実用的な情報を整理して出力することができる。「LLMの安全対策が不十分な場合、悪意あるユーザーの参入障壁を下げ、活動が大幅に加速する恐れがある」と同チームは警告する。
次回は、ジェイルブレークの代表的な手法について詳しく解説する。
Computer Weekly発 世界に学ぶIT導入・活用術
米国Informa TechTargetが運営する英国Computer Weeklyの豊富な記事の中から、海外企業のIT製品導入事例や業種別のIT活用トレンドを厳選してお届けします。
Copyright © ITmedia, Inc. All Rights Reserved.
Computer Weekly発 世界に学ぶIT導入・活用術
この記事の著者
関連記事
新着ホワイトペーパー PR
-
製品資料
AI時代の自律的なパートナー 「データエージェント」構築&活用ガイド -
製品資料
使用中のデータを保護して安全な共同開発へ、クラウド時代のデータセキュリティ -
製品資料
“AIによる高速な脆弱性検出”対策を行う、RHELの統合セキュリティ機能とは? -
製品資料
企業ITを支える定番Linuxの運用管理、手動の限界を乗り越える手法とは? -
製品資料
AIとクラウドネイティブの課題を解決する、シンプルで費用対効果に優れた方法
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
「Microsoft 365」が乗っ取られる 跡形もなくMFAを破る手口
-
2
なぜ人はいるのにDXが進まない? ライオンも直面した“老害”レガシーシステム
-
3
「生成AI導入・活用状況」に関するアンケート
-
4
LLMの「過学習」、正しく説明している文章はどれ?
-
5
Azure Red Hat OpenShiftは脱VMware問題の救世主になるか? 技術資料で解説
-
6
“金融レベル”が壁に 東京海上ディーアールが「小さな失敗」を成功につなげた方法
-
7
「HDD終了」は本当か 巨大クラウド2社が下した大容量フラッシュへの決断
-
8
なぜOpenAIやAnthropicのAIは「脱走」したのか 情シスが迫られるエージェント統制
-
9
「業務改善とツール活用」に関するアンケート
-
10
100億円の「Linux更新」を回避 みずほ銀行が選んだ“おきて破り”のRHEL延命策
ホワイトペーパーランキング PR
-
1
属人化や仕様バグはなぜ起きる? AI時代に必須のドキュメント文化の作り方
-
2
「NAS」「SAN」「DAS」は何が違う? いまさら聞けないストレージの基礎
-
3
AIエージェントで多様な日常業務を効率化するための入門ガイド
-
4
財務を戦略的組織へ進化させるAI活用術、4つの主要な障壁と解消方法
-
5
中小企業必見、Microsoft 365でゼロトラストセキュリティを実現する方法
-
6
5分で分かる「AI駆動開発エージェント」 要件定義から設計・実装・テストまで
-
7
動画で知るランサムウェア被害企業のリアル、会計データが無事だった理由とは
-
8
“あのファイル転送”で暗躍するノーウェアランサム
-
9
セキュリティソフトをすり抜ける標的型攻撃メール、不審メールの見破り方とは?
-
10
マンガで解説:「ゼロトラスト」「SASE」の必要性とメリット
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー