業務で使えるレベルなのか? 編集者が実践
【検証】「Nano Banana Pro」の日本語描画とリーズニング能力を試してみた
Googleが画像生成AIモデル「Gemini 3 Pro Image」(通称:Nano Banana Pro)をリリースした。実際の業務に使えるのかどうか、公式ブログの情報を基に、編集者が実際に試した結果を紹介する。
2025年11月20日、Googleから画像生成AIモデル「Gemini 3 Pro Image」(通称:Nano Banana Pro)がリリースされた。同社の公式ブログによれば、マルチモーダルAIモデル「Gemini 3 Pro」のリーズニング能力を生かし、多言語テキストの描画精度と文脈理解を強化し、インフォグラフィックスや業務資料の作成を支援するとしている。
果たして、その性能はビジネスや実務の現場で耐えられるものなのか。TechTargetジャパン編集部では、日本語テキスト描画とIT記事の要約可視化という2つの観点から、実務レベルでどこまで使えるかを検証した。
Nano Banana Proの概要
Nano Banana Proの基本スペックは以下の通りだ。
正式名称
Gemini 3 Pro Image
アーキテクチャ
Gemini 3 Proを基盤とする画像生成、編集モデル
主な特徴
- 推論能力と世界知識に基づくインフォグラフィックス生成
- 多言語テキストの描画精度向上
- 最大14枚までの画像合成
- 最大5人までの人物の一貫した描写
- 「Google Workspace」や「Vertex AI」、Geminiアプリケーションとの連携
Geminiアプリでは「画像を作成」機能で「思考モード」(Thinking Mode)を選択することで利用できる。
検証1:生成AIの鬼門「日本語テキスト」は正確か
これまでの画像生成AIにおける最大の課題は、「画像内の文字崩れ」だった。特に画数の多い漢字は、意味不明な記号になりがちだ。そこで、文字の正確さとイラストの整合性を確認するため、以下のプロンプトを試行した。
「完売御礼」と書かれた看板を持って、うれし泣きしている柴犬のイラストを描いて
出力された画像が図1だ。
「完売御礼」という複雑な漢字が、崩れることなく正確にレンダリングされている。また、看板を持つ手の構造や、柴犬の「うれし泣き」という感情表現も自然だ。従来の画像生成における“文字崩れ”を知っている人なら、この精度のすごさが分かるはずだ。一方で、特に指示していない背景の文字列は、文字としては認識できるが意味は通っていない。
検証2:複雑なビジネス文脈を「リーズニング」できるか
次に検証したのは、Gemini 3の特徴である「リーズニング」能力だ。単に絵を描くだけでなく、「複雑なテキスト情報を読み解き、適切な構成に変換して可視化できるか」をテストした。
検証手順:
- TechTargetジャパンに掲載されている「AIのサイロ化とガバナンス」に関する専門的なIT記事を読み込ませる。
- 内容を要約した「4コママンガ」の構成案を作成させる。
- その構成を基に画像を生成させる。
まず、提案された構成案が図2だ。
画像に入りきってはいないが「シャドーAI」や「CoE」(センターオブエクセレンス)といった専門用語の相関関係を理解し、起承転結のあるストーリーが構築されている。
さらに、生成された画像が図3だ。
記事の文脈を反映し、ビジネスシーンとして違和感のない構図が生成された。
公式推奨:精度を高めるプロンプティングのコツ
Google公式ブログでは、Nano Banana Proの性能を最大限に引き出すために、以下のポイントが推奨されている。
文字指定には引用符を使う
Google公式ブログでは、画像内に描画するテキストをプロンプト内でクォーテーションで囲む例が多く紹介されている。このことから、画像内に特定のテキストを描画させたい場合、「 」 や" "で囲むことで、AIが「描画すべき文字」として認識しやすくなるようだ。
思考モードの活用
複雑な構図や論理的な整合性が重要な場面では、Geminiの思考モードを選ぶことで、より整合的な画像が期待できるとされている。
実務で使えるレベルに到達?
今回の検証を通して目立ったのは、「ユーザーの指示の意図をくみ取る精度の高さ」だ。
従来のAI画像生成では、意図通りの絵を出すためにプロンプトの試行錯誤(プロンプトエンジニアリング)が不可欠だった。しかし、Nano Banana Proでは、自然な日本語で書いた1回目の指示でも、おおむね意図に沿った構図とテキストを出力できるケースが増えた印象だ。クリエイティブな用途はもちろん、プレゼン資料の作成や概念の可視化など、ビジネスシーンでの活用が大きく広がることは間違いないだろう。
ただ、小さな文字や複雑な書体では、細部が潰れたり誤字が混ざったりする可能性は残るため、インフォグラフィックスや数値を含む図の利用時には、「AIが描いた図だから」とうのみにせず、内容確認のプロセスは引き続き必要だ。
本AIモデルはGeminiのチャットやアプリケーションから利用可能だが、無料版では今回検証したような思考モードや、高解像度での生成枚数に制限がかかる場合があるため注意が必要だ。
Copyright © ITmedia, Inc. All Rights Reserved.
TechTarget ニュースプラス
国内のIT業界ニュースを迅速に報道します。企業動向から導入事例、市場トレンドまで幅広く取り上げ、実務に直結する情報をタイムリーに提供する連載です。
関連記事
新着ホワイトペーパー PR
-
製品資料
[株式会社キーエンス] なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは -
製品資料
[株式会社セールスフォース・ジャパン] 「CRMは設計と無関係」は本当か? PLMとの融合で実現する高速開発 -
事例
[日本ヒューレット・パッカード合同会社] AIエージェントの時代にどう備える? 「新たな働き手」を支える3要素とは -
製品資料
[日本ヒューレット・パッカード合同会社] “横並びの自動化”から脱却、AI活用で生産性と競争力を高める秘訣 -
製品資料
[サイボウズ株式会社] AIが「わざわざ使うツール」になっていない? 業務で自然に使う導線にする秘訣
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
なぜ「全社配布Copilot」は使われないのか? 失敗に学ぶAI定着
-
2
法務と開発者で「言葉が通じない」問題 トヨタやソニーが語るOSS管理の真実
-
3
ChatGPTは“検索しまくり”でGeminiは“淡泊”? データが明かすAIの裏側
-
4
なぜ「Gemini 4 Argon」は出遅れたのか? Googleが狙う“逆転のシナリオ”
-
5
「中堅・中小企業のネットワーク・セキュリティ運用実態」に関するアンケート
-
6
損保ジャパンはなぜ「COBOL」を捨てなかったのか? 脱メインフレームの真相
-
7
「Wi-Fi 7」経由でWindowsが乗っ取られる? 最高権限奪取の恐怖
-
8
情報漏えいはなぜ繰り返されるのか 今すぐ見直すべき「境界」
-
9
情シスの約8割が転職や退職を意識 調査で分かった“辞めたくなる最大の理由”
-
10
【漫画付き】ひとり情シス協会が明かす、RAG導入でしくじる企業「2つの共通点」
ホワイトペーパーランキング PR
-
1
不審メールの経路や見せ方に変化? 2026年夏の3事例から見えた動向と対処方法
-
2
家庭用Wi-Fiルーターの業務利用は危険? 避けるべき理由と具体的な対策
-
3
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
-
4
財務部門がAIを最大限に活用する方法 無駄のない戦略的リーダーシップへの道
-
5
LLMが兵器化? 元FBI高官が鳴らす警鐘とセキュリティツール統合のポイント
-
6
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
7
なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは
-
8
生成AIを開発に導入しても効果が見えない? 実証実験で分かった成果と課題
-
9
経産省DX指針から読み解く、受発注業務デジタル化ロードマップ
-
10
HDDを使わない「SSDオンリー」が無謀なのはなぜ?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー