プロセッサから「AIの民主化」を支援
AIに最適化した「Xeonシリーズ」に、「Gaudi 3」 Intelのデータセンター戦略を解説
プロセッサの開発競争が激化している。IntelはAIに注力する方針を打ち出しており、データセンター向け製品についてもAI用に機能の強化や追加が図られている。
インテル(Intelの日本法人)は2024年6月6日に開催した「インテル AI Summit Japan」で、日本国内における同社のAI(人工知能)技術への取り組みと、それに関連するAIの製品・サービスについて発表した。
同社の松田貴成氏(データセンターテクニカルソリューション グループディレクター)は「インテルのデータセンター向けAIポートフォリオ」と題した講演で、Intelのデータセンター向けの製品やサービスの使い方を紹介。「覚えてもらいたいポイントが2つある。『汎用(はんよう)サーバで稼働する大規模言語モデル(LLM)』と、新たな『クラウド/データセンター向けAIアクセラレータ』だ」と口火を切った。
普通の企業でもAIが身近に? XeonとGaudiはどう進化したのか
1つ目のポイントである汎用サーバとは、Intelが提供しているデータセンター/HPC(ハイパフォーマンスコンピューティング)向けCPU「Xeon」シリーズを搭載したサーバのことだ。
松田氏によると、Xeonシリーズの中でも「第4世代Xeonスケーラブルプロセッサ」(開発コード名:Sapphire Rapids)以降の製品は、業務用AI(人工知能)アプリケーションの運用サーバとして利用できる。テキストや画像などを自動生成するAI技術「生成AI」やそのベースとなる大規模言語モデル(LLM)を運用するためのサーバとしても十分なパフォーマンスを発揮するという。
Xeonシリーズは通常、メールやWeb、動画配信などのサーバに使われている。第4世代以降のXeonシリーズはAI関連の処理を高速化するAIアクセラレーターを内蔵しているため、AI用途にも使えるという。「メールサーバとしての役目を終えたXeonシリーズをAI用のサーバとして再利用すればリソースを有効活用できる」と松田氏は語る。
ただ、AIと一口に言ってもさまざまな種類がある。「例えば業務マニュアルの内容を回答するAIチャットbotであれば、Xeonシリーズで問題なく運用できる」と松田氏は説明した。
松田氏が提示した2つ目のポイントは、Intelが2024年4月に発表した、データセンター向けのAIアクセラレーター「Gaudi」シリーズの最新モデル「Gaudi 3」だ。同社はGaudi 3を2024年後半に提供開始する計画。メインターゲットはAmazon Web Services(AWS)やMicrosoft、Googleといったハイパースケーラー(大規模なクラウドサービスを提供し、巨大なデータセンターを運営する事業者)だ。
Gaudi 3は前世代モデル「Gaudi 2」に比べて4倍の処理速度を実現しているという。半導体ベンダーNVIDIAのGPU(グラフィックス処理装置)である「NVIDIA H100 Tensor Core GPU」(H100)と比較して性能を2024年4月に検証した。Intelの発表によればGaudi 3はH100に比べて、生成AIの学習時間を50%、推論の速度を50%、電力効率を40%改善したという。具体的には以下のLLMで学習や推論時のパフォーマンスを比較したところ、この結果が得られたという。
- OpenAIの「GPT-3 175B」
- Meta Platformsの「Llama 2 7B」
- Meta Platformsの「Llama 2 13B」
- アラブ首長国連邦(UAE)の研究機関Technology Innovation Institute(TII)が開発した「Falcon-180B」
AWSやMicrosoft、Googleといったハイパースケーラーは2024年6月現在、データセンターの消費電力を削減するためのさまざまな取り組みを進めている。それに伴い、半導体ベンダーは自社製品の電力効率改善に力を注いている。Gaudi 3はそうした需要を捉えた製品と言える。
「一般企業では、独自でモデルをトレーニングする『ファインチューニング』にGaudiシリーズを採用するといった用途が考えられる」と松田氏は説明した。
「シリコンだけ」ではない インテルが提供する各サービス
松田氏は、Intelがプロセッサだけでなくデータセンター向けのソフトウェアについても注力していることを強調した。
AI技術の活用やAIモデルの開発に限らず、アプリケーション開発において、実機でのパフォーマンスを事前に確認することは重要だ。しかし、コストを考慮するとテストのためだけにXeonシリーズ、ましてやGaudiシリーズを購入することは現実的ではない。
こうした課題の解決策として Intelは「Tiberデベロッパー・クラウド」を提供している。これはCPUやGPUをはじめとする、Intelの最新のハードウェアを試すことができるクラウドサービスで、AIアプリケーションの開発、実行、テストを支援するシミュレーションツールの役割も果たす。
Intelが提供するXeonシリーズやGaudiシリーズなどのプロセッサは「TensorFlow」「PyTorch」「Caffe」「Apache MXNet」「PaddlePaddle」といったディープラーニングフレームワークに最適化されている。そのため、これらのフレームワークを用いた学習や推論を効率的に実施できるという。
「IntelはAI技術の活用に必要な機能を統合したさまざまなプロセッサを提供している。例えばデータベースやAIアプリケーションが混在するミックスワークロード(複数の種類のコンポーネントが混在するシステム)においては、時としてGPUやアクセラレーターよりCPUが性能を発揮するケースがある。実施するタスクに応じてプロセッサを選定してほしい」と松田氏は語った。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
新着ホワイトペーパー PR
-
製品資料
[株式会社MatrixFlow] 「物流リソース最適化」ガイド:人員・配車・傭車を出庫依頼の確定前に決めきる -
製品資料
[株式会社キーエンス] なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは -
製品資料
[株式会社セールスフォース・ジャパン] 「CRMは設計と無関係」は本当か? PLMとの融合で実現する高速開発 -
事例
[日本ヒューレット・パッカード合同会社] AIエージェントの時代にどう備える? 「新たな働き手」を支える3要素とは -
製品資料
[日本ヒューレット・パッカード合同会社] “横並びの自動化”から脱却、AI活用で生産性と競争力を高める秘訣
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
ChatGPTは“検索しまくり”でGeminiは“淡泊”? データが明かすAIの裏側
-
2
法務と開発者で「言葉が通じない」問題 トヨタやソニーが語るOSS管理の真実
-
3
なぜ「全社配布Copilot」は使われないのか? 失敗に学ぶAI定着
-
4
「IBM iはDXのボトルネック」は誤解 意外と知らない今風モダナイズの効果
-
5
「朝8時にバッチが終わらない」データ爆発の危機をJPX総研はどう乗り越えたか
-
6
「中堅・中小企業のネットワーク・セキュリティ運用実態」に関するアンケート
-
7
損保ジャパンはなぜ「COBOL」を捨てなかったのか? 脱メインフレームの真相
-
8
AI導入後に発覚する「社内文書を読めない」問題 情シスは何を直せばいい?
-
9
情報漏えいはなぜ繰り返されるのか 今すぐ見直すべき「境界」
-
10
情シスの約8割が転職や退職を意識 調査で分かった“辞めたくなる最大の理由”
ホワイトペーパーランキング PR
-
1
不審メールの経路や見せ方に変化? 2026年夏の3事例から見えた動向と対処方法
-
2
家庭用Wi-Fiルーターの業務利用は危険? 避けるべき理由と具体的な対策
-
3
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
-
4
財務部門がAIを最大限に活用する方法 無駄のない戦略的リーダーシップへの道
-
5
LLMが兵器化? 元FBI高官が鳴らす警鐘とセキュリティツール統合のポイント
-
6
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
7
なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは
-
8
生成AIを開発に導入しても効果が見えない? 実証実験で分かった成果と課題
-
9
経産省DX指針から読み解く、受発注業務デジタル化ロードマップ
-
10
HDDを使わない「SSDオンリー」が無謀なのはなぜ?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー