加速するGoogleのAI開発【前編】
“思考する”AI「Gemini 2.5 Pro」は「Gemini 2.0」から何が進化した?
2025年3月、Googleは新LLM「Gemini 2.5 Pro」の試験運用版を発表した。同モデルはどのような価値をユーザーにもたらすのか。「Gemini 2.0」からの強化点とは。
各AI(人工知能)ベンダーは次々と新しい大規模言語モデル(LLM)を発表しており、その勢いはとどまる気配がない。中でもGoogleの「Gemini」シリーズは注目されるLLMの一つだ。
Googleは2023年12月に「Gemini 1.0」、2024年2月に「Gemini 1.5 Pro」を発表。同年12月には「Gemini 2.0」を発表し、2025年3月には早くも「Gemini 2.5 Pro」の試験運用版を公開しており、Geminiの革新スピードは加速している。Gemini 2.5 Proはどのような進化を遂げているのか。
「Gemini 2.5 Pro」は「Gemini 2.0」から何が進化した?
併せて読みたいお薦め記事
LLMについて理解を深める
Gemini 2.5 Proは、AI研究開発機関Google DeepMindが開発したLLMであり、2025年3月の登場時点でGoogle史上最も高性能なAIモデルと位置付けられている。Gemini 2.5 Proの発表は、以下のような推論モデルがLLM市場で存在感を強める中での動きと捉えることができる。
- DeepSeekの「DeepSeek-R1」
- OpenAIの「OpenAI o3」
- Anthropicの「Claude 3.7 Sonnet」
特に注目すべきは、Gemini 2.5 Proが「思考モデル」(Thinking Model)として設計されている点だ。高度な推論機能が中核に据えられており、2024年12月に発表された試験運用版の推論モデル「Gemini 2.0 Flash Thinking」の進化版と位置付けられる。
Gemini 2.5 Proは、プロンプト(AIモデルに対する指示)の遂行に必要な手順を段階的に推論するChain-of-Thought(CoT:思考の連鎖)手法を内部で自律的に処理する設計を採用しており、文脈に即したより精度の高い出力が可能となっている。
GoogleはGemini 2.5 Proに対し、強化学習や事後学習などの技術を適用することで、さらなる精度向上を図っている。公開時点のコンテキストウィンドウ(生成AIがやりとりの中で保持できる情報量)は最大100万トークン(テキストデータを処理する際の基本的な単位)で、将来的には200万トークンに拡張する計画だ。
Gemini 2.5 Proのその他の主な強化点は以下の通り。
- 推論能力の強化
- Gemini 2.5 Proの最大の特長は、推論性能が強化されたことだ。Googleによれば、同モデルはLLMの知識と推論能力を測るベンチマークテスト「Humanity's Last Exam」において、OpenAI o3の他、Anthropicの「Claude 3.7 Sonnet」、DeepSeekの「DeepSeek R1」などの競合モデルを上回るスコアを記録している。
- コーディング能力の向上
- Gemini 2.5 Proは、ソースコードの生成および実行機能が強化されており、クラウドサービス「Google Cloud」を中心とする開発環境の利便性向上に大きく貢献している。
- 従来モデルに比べてソースコードの生成、デバッグ、関数呼び出し、ワークフロー自動化などの精度が強化されている。ソースコードの自動生成だけでなく、実行結果の検証や改善提案までできるなど、開発支援における実用性が高まっており、ユーザーインタフェース(UI)デザインを含む視覚的に魅力的なアプリケーションの構築にも役立つ。
- ソフトウェア開発タスクのベンチマークテスト「SWE-Bench Verified」では63.8%のスコアを記録。OpenAIの「GPT-4.5」のスコア(49.3%)を上回った一方で、Claude 3.7 Sonnetのスコア(70.3%)にはわずかに及ばない結果となった。
- 数学・科学分野の能力強化
- 2025年に開催された数学コンテスト「American Invitational Mathematics Examination」(AIME)では、86.7%の正答率を達成した。
- 博士号レベルの科学問題を扱うベンチマークテスト「GPQA」の中でも最も最難関とされる「ダイヤモンド」レベルでは、84%の正答率を達成した。
- マルチモーダル機能の強化
- Gemini 2.0と同様マルチモーダルモデルであり、テキスト、音声、画像、動画、ソースコードといった複数のデータ形式を理解できる。ただし、2025年3月時点では画像、動画の生成機能は実装されていない。
- リアルタイム処理
- 多くの機能強化にもかかわらず、処理遅延は抑制されており、リアルタイム性が求められるアプリケーションや、インタラクティブな対話用途にも十分対応可能だ。
次回は、Gemini 2.5 Proの用途や他サービスとの連携について解説する。
TechTarget発 先取りITトレンド
米国Informa TechTargetの豊富な記事の中から、最新技術解説や注目分野の製品比較、海外企業のIT製品導入事例などを厳選してお届けします。
Copyright © ITmedia, Inc. All Rights Reserved.
TechTarget発 先取りITトレンド
米国TechTargetの豊富な記事の中から、最新技術解説や注目分野の製品比較、海外企業のIT製品導入事例などを厳選してお届けします。
この記事の著者
関連記事
新着ホワイトペーパー PR
-
製品資料
[株式会社キーエンス] なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは -
製品資料
[株式会社セールスフォース・ジャパン] 「CRMは設計と無関係」は本当か? PLMとの融合で実現する高速開発 -
事例
[日本ヒューレット・パッカード合同会社] AIエージェントの時代にどう備える? 「新たな働き手」を支える3要素とは -
製品資料
[日本ヒューレット・パッカード合同会社] “横並びの自動化”から脱却、AI活用で生産性と競争力を高める秘訣 -
製品資料
[サイボウズ株式会社] AIが「わざわざ使うツール」になっていない? 業務で自然に使う導線にする秘訣
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
なぜ「全社配布Copilot」は使われないのか? 失敗に学ぶAI定着
-
2
法務と開発者で「言葉が通じない」問題 トヨタやソニーが語るOSS管理の真実
-
3
【漫画付き】ひとり情シス協会が明かす、RAG導入でしくじる企業「2つの共通点」
-
4
情シスの約8割が転職や退職を意識 調査で分かった“辞めたくなる最大の理由”
-
5
損保ジャパンはなぜ「COBOL」を捨てなかったのか? 脱メインフレームの真相
-
6
ChatGPTは“検索しまくり”でGeminiは“淡泊”? データが明かすAIの裏側
-
7
情報漏えいはなぜ繰り返されるのか 今すぐ見直すべき「境界」
-
8
BMWも導入 78兆円市場に化ける「フィジカルAI」の衝撃
-
9
「Wi-Fi 7」経由でWindowsが乗っ取られる? 最高権限奪取の恐怖
-
10
「AI活用を前提とした業務PCへの移行」に関するアンケート
ホワイトペーパーランキング PR
-
1
不審メールの経路や見せ方に変化? 2026年夏の3事例から見えた動向と対処方法
-
2
家庭用Wi-Fiルーターの業務利用は危険? 避けるべき理由と具体的な対策
-
3
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
-
4
財務部門がAIを最大限に活用する方法 無駄のない戦略的リーダーシップへの道
-
5
LLMが兵器化? 元FBI高官が鳴らす警鐘とセキュリティツール統合のポイント
-
6
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
7
なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは
-
8
生成AIを開発に導入しても効果が見えない? 実証実験で分かった成果と課題
-
9
経産省DX指針から読み解く、受発注業務デジタル化ロードマップ
-
10
HDDを使わない「SSDオンリー」が無謀なのはなぜ?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー