さらなる進化を遂げたOpenAIのLLM【後編】
「OpenAI o1」はどう進化した? 気になる信頼性、安全性は?
「OpenAI o1」は、2024年9月にOpenAIが発表したLLM新モデルだ。モデルの実力や、安全面の取り組みと併せて、OpenAI o1を利用する方法を紹介する。
昨今の人工知能(AI)ブームの一因と言えるのが、AIベンダーOpenAIのAIチャットbot「ChatGPT」だろう。ChatGPTは大規模言語モデル(LLM)「GPT」(Generative Pre-trained Transformer)をベースにしており、2024年10月時点では「GPT-3.5」「GPT-4 Omni」(GPT-4o)が標準のLLMとなっている。
2024年9月、OpenAIは新モデル「OpenAI o1」を発表した。OpenAI o1を使いたいエンドユーザーや企業は、どのような方法でOpenAI o1にアクセスできるのか。機能面での制約や、安全面の取り組みと併せて解説する。
「OpenAI o1」の気になる信頼性や安全性は?
併せて読みたいお薦め記事
連載:さらなる進化を遂げたOpenAIのLLM
AI時代のキャリアを考える
2024年10月時点で、プレビュー版の「OpenAI o1-preview」と軽量版モデル「OpenAI o1-mini」が利用可能だ。ChatGPT無償版のユーザーはOpenAI o1にアクセスできない。OpenAI o1を利用する方法は大きく4つある。
- 「ChatGPT Plus」「ChatGPT Team」
- ChatGPTの有償版サービス「ChatGPT Plus」「ChatGPT Team」のユーザーは、2024年9月から「OpenAI o1-preview」「OpenAI o1-mini」を利用可能となっている。ユーザーはモデルを手動で選択できる。
- 「ChatGPT Enterprise」「ChatGPT Edu」
- ChatGPTの教育機関向けプラン「ChatGPT Enterprise」「ChatGPT Edu」のユーザーは、2024年9月からOpenAI o1-previewとOpenAI o1-miniにアクセスできる。
- API
- 開発者はOpenAIのAPI(アプリケーションプログラミングインタフェース)経由でOpenAI o1-previewおよびOpenAI o1-miniにアクセスできるが、2024年10月時点では一部の開発者に限定されている。
- サードパーティー製ツール
- MicrosoftのAI開発ツール「Azure AI Studio」や、GitHub上でLLMを使用できる「GitHub Models」など、複数のサードパーティー製ツールからOpenAI o1-previewおよびOpenAI o1-miniにアクセスできる。
プレビュー段階では制約も
2024年10月時点でOpenAI o1はプレビュー版であり、以下のような制約が存在する。
- Web検索機能、画像を扱うマルチモーダル機能、ファイルアップロード機能などを提供していない。
- API経由での利用には制限があり、関数呼び出し機能や、ストリーミング(リアルタイムのデータ送信)機能が使えない。チャット機能を調整するためのオプションや設定の範囲が限られている。
- OpenAI o1は、従来よりも推論プロセスに長い時間をかけるため、回答に時間がかかる傾向にある。
- ChatGPT PlusおよびChatGPT Teamで利用する場合、2024年9月時点のメッセージ送信回数の上限は、OpenAI o1-previewについては週50回、OpenAI o1-miniは1日50回。
- OpenAI o1-previewのコストは、100万トークン(注)当たり入力15ドル、出力60ドル。OpenAI o1-miniは入力3ドル、出力12ドル。GPT-4oシリーズと比較すると3倍程度高くなっている。
※注:トークンとはテキストデータを処理する際の基本的な単位で、一般的には4文字程度と考えられる。
OpenAI o1で気になる安全面の工夫
OpenAIは、OpenAI o1を提供開始したタイミングで、ドキュメント「OpenAI o1 System Card」を公開した。これは、同社がモデル開発中に実施した安全性およびリスク評価の取り組みについて説明したものだ。具体的には、以下のような内容が含まれる。
- Chain-of-Thought(CoT:思考の連鎖)
- OpenAI o1は、大規模な強化学習により複雑な推論タスクをこなすことができる。回答を導き出す最適なアプローチを、時間をかけて考えるため、生成過程の誤りを認識して、精度の高い回答を出力できるようになった。その結果、ガイドラインやポリシーに沿った、安全性なコンテンツの生成能力が向上した。
- ジェイルブレーク(脱獄)耐性の向上
- OpenAI o1は、「ジェイルブレーク」(脱獄)に対する耐性を大幅に強化している。ジェイルブレークとは、モデルが意図しない使われ方をすることを指す。ジェイルブレーク耐性を測るベンチマーク「StrongREJECT」では、GPT-4oよりも優れたスコアを出している。
- ポリシーの順守
- モデルが安全でないコンテンツを拒否できるかどうかを測定するベンチマーク「Challenging Refusal Evaluation」において、OpenAI o1-previewは0.934の「not-unsafe」(危険ではない)スコアを達成している。これはGPT-4oのスコア0.713を上回るものだ。
- バイアス(偏見)の削減
- 質疑応答(QA)における公正さを測定するベンチマーク「A Hand-Built Bias Benchmark for Question Answering」において、OpenAI o1-previewは明確な答えを持つ質問に対して94%の正答率を記録した。これはGPT-4oの72%を上回る。人種や性別、年齢による判断バイアスもGPT-4oより少ない結果を示した。
- 透明性の確保
- OpenAI o1は回答に至るまでの推論プロセスを要約して生成し、それを基に安全性をチェックできる。10万個のプロンプト(情報を生成するための指示や質問文)をOpenAI o1に渡したところ、事実に基づかない回答の割合はわずか0.79%だったという。その大部分は、意図のある嘘ではなく、推論の誤りによるものだった。
TechTarget発 先取りITトレンド
米国TechTargetの豊富な記事の中から、最新技術解説や注目分野の製品比較、海外企業のIT製品導入事例などを厳選してお届けします。
Copyright © ITmedia, Inc. All Rights Reserved.
TechTarget発 先取りITトレンド
米国TechTargetの豊富な記事の中から、最新技術解説や注目分野の製品比較、海外企業のIT製品導入事例などを厳選してお届けします。
この記事の著者
関連記事
新着ホワイトペーパー PR
-
製品資料
[株式会社MatrixFlow] 「物流リソース最適化」ガイド:人員・配車・傭車を出庫依頼の確定前に決めきる -
製品資料
[株式会社キーエンス] なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは -
製品資料
[株式会社セールスフォース・ジャパン] 「CRMは設計と無関係」は本当か? PLMとの融合で実現する高速開発 -
事例
[日本ヒューレット・パッカード合同会社] AIエージェントの時代にどう備える? 「新たな働き手」を支える3要素とは -
製品資料
[日本ヒューレット・パッカード合同会社] “横並びの自動化”から脱却、AI活用で生産性と競争力を高める秘訣
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
法務と開発者で「言葉が通じない」問題 トヨタやソニーが語るOSS管理の真実
-
2
なぜ「全社配布Copilot」は使われないのか? 失敗に学ぶAI定着
-
3
なぜ「Gemini 4 Argon」は出遅れたのか? Googleが狙う“逆転のシナリオ”
-
4
ChatGPTは“検索しまくり”でGeminiは“淡泊”? データが明かすAIの裏側
-
5
損保ジャパンはなぜ「COBOL」を捨てなかったのか? 脱メインフレームの真相
-
6
情シスの約8割が転職や退職を意識 調査で分かった“辞めたくなる最大の理由”
-
7
「結局使わなくなる」Microsoft 365 Copilotを半年で定着 キリンの3施策
-
8
「Wi-Fi 7」経由でWindowsが乗っ取られる? 最高権限奪取の恐怖
-
9
「中堅・中小企業のネットワーク・セキュリティ運用実態」に関するアンケート
-
10
情報漏えいはなぜ繰り返されるのか 今すぐ見直すべき「境界」
ホワイトペーパーランキング PR
-
1
不審メールの経路や見せ方に変化? 2026年夏の3事例から見えた動向と対処方法
-
2
家庭用Wi-Fiルーターの業務利用は危険? 避けるべき理由と具体的な対策
-
3
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
-
4
財務部門がAIを最大限に活用する方法 無駄のない戦略的リーダーシップへの道
-
5
LLMが兵器化? 元FBI高官が鳴らす警鐘とセキュリティツール統合のポイント
-
6
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
7
なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは
-
8
生成AIを開発に導入しても効果が見えない? 実証実験で分かった成果と課題
-
9
経産省DX指針から読み解く、受発注業務デジタル化ロードマップ
-
10
HDDを使わない「SSDオンリー」が無謀なのはなぜ?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー