次世代CPU技術解説
サーバ向けCPU市場を制するのはIntel Cascade LakeかAMD Romeか
2019年もIntelとAMDの覇権争いが過熱しそうだ。両社の次世代製品はどのような仕様なのか。どのような市場を狙っているのか。大きく異なるその設計思想を解説する。
2017年、エンタープライズサーバ市場が再び脚光を浴びた。AMDが「EPYC」を携えて戦列に復帰し、Intelの「Xeon」に真っ向勝負を挑んだためだ。
本稿執筆時点で、両社は2019年発売予定の新しいプロセッサの詳細を明らかにし、データセンターを形成する最新トレンドについてそれぞれ考え方を示している。
2017年中盤にEPYCがリリースされてから、状況がやや変わってきた。AMDはDell EMC、HPE、Cisco Systems、Super Micro Computerのエンタープライズシステムに同社のチップを供給するようになり、着実に市場シェアを拡大している。
これに対し、Intelはちょっとした問題に行き当たっているように見える。同社の報告によると、需要を満たすのに十分な数を供給するのが難しく、10ナノメートル製造プロセスの導入もさらに遅れ、2019年にずれ込むという。
想像通り、両社はパフォーマンスを高めるために1ソケット当たりのプロセッサコアを増やしている。ただしその方法はそれぞれ異なる。AMDはマイクロアーキテクチャを刷新して1クロック当たりの命令数(IPC)を増やした。Intelはディープラーニングのワークロードの処理速度向上を目的とした新しい命令を加え、DIMMスロットを使用する「Optane」のサポートを追加した。
Intelが提供するのは「Cascade Lake」というコードネームが付けられた次世代Xeonプロセッサファミリーだ(訳注)。Intelは最上位製品の一つである「Cascade Lake Advanced Performance」(2019年前半正式リリース予定)の詳細も公表している。それによると、最大48コアを誇り、DDR4メモリを12チャネル備えるという。これによりXeonのメモリ容量は倍増する。
訳注:2019年1月7日、サーバ向けの「Cascade Lake-SP」の出荷開始が発表された。
AMDも2019年発売に向けて「Rome」というコードネームが付けられた次世代EPYCを準備している。これは最新の「Zen 2」コアをベースにする。このアーキテクチャは、既存のEPYCファミリーの2倍となる1ソケット当たり最大64コアを誇る。8チャネルのDDR4メモリと128レーンのPCIe(PCI Express)を残したため、新しいチップは第1世代と同じマザーボードソケットに適合する。
とはいえ、PCIeのサポートはPCIe 4.0規格にアップグレードされ、既存のPCIe 3.0の2倍の帯域幅を提供する。NVMe SSDやイーサネットアダプターなど、PCIe 4.0互換機器と併用すれば、スループットがさらに向上する。
内部構造
2つの新しいプロセッサのパッケージ中を見ると、幾つか驚くことがある。Cascade Lake-APとRomeはどちらもマルチチップパッケージ(MCP)だ。つまり相互に内部接続された複数のシリコンチップで構成されている。
Cascade Lake-APは、実質的に24コアのチップを2つ相互に接続する。それは、Cascade Lakeの他のSKU(訳注)がDDR4メモリを6チャネル保持するよう設定されているためだ。このチャネル数は、現世代の「Skylake」マイクロアーキテクチャと同じだ。
訳注:CPUの場合は、同一製品名を動作クロックやキャッシュサイズなどでさらに細分化した種類を指す。例:「Intel Core i9-9900」の場合、「Intel Core i9」が製品(ブランド)名で、「9900」の上1桁(9)がプロセッサの世代、下3桁(900)がSKUナンバー。
2つのチップは1つのUPI(Ultra Path Interconnect)リンクを使って相互接続される。このリンクは、ソケット同士を外部接続するのに使うものと同じタイプだ(Cascade Lake-APは1~2個のソケットをサポートする)。
AMDの既存のEPYCは、4つの独立した「チップレット」で構成される。4つのチップレットは「Infinity Fabric」という高速相互接続でクロスリンクされている。ただしRomeは構成が大きく異なっている。このチップは、I/Oとメモリのコントローラーチップ1つを8つのチップレットで取り囲む構成だ。各チップレットには8つのZen 2コアが搭載される。このように分離した理由は、I/Oとメモリのコントローラーを初代EPYCと同じ14ナノメートルプロセスで製造できるようにするためだ。これに対し、新しいZen 2は7ナノメートル製造プロセスで製造されている。
これらのZen 2コアはアーキテクチャの強化も幾つか行われ、浮動小数点演算ユニットのビット幅が256bitに倍増し、分岐予測機能や命令のプリフェッチが向上している。
その結果、新しいEPYCチップはIPCが初代よりも29%向上した。AMDによると、Zen 2は一操作当たりの電力消費量も半減しているという。
最適化
IntelのCascade Lakeは14ナノメートル製造プロセスをそのまま採用した。そのため次期チップと既存のXeonファミリーにはほとんど違いがないように見えるかもしれない。
Intelは「Spectre」と「Meltdown」の脆弱(ぜいじゃく)性に対抗するため、ハードウェア的な軽減策を追加している。また前述したようにディープラーニングのタスクを高速化するために新しい「Vector Neural Network Instructions」(VNNI)を用意し、DIMM型の「Optane DC Persistent Memory」のサポートも追加している。
Intelによると、VNNI(別名Intel Deep Learning Boost)によってSkylakeファミリーのパフォーマンスが最大17倍向上するという。AVX-512命令セット(訳注)の場合、INT8の畳み込みを3つの個別のステップではなく1つのステップで処理する能力のおかげだ。ただしこれを利用するには、Cascade Lake用に最適化されたアプリケーションコードが必要なのは明らかだ。
訳注:Xeon Phiから採用された命令セットで、エンコーディングや暗号化、ディープラーニングなどの用途でデータ処理のパフォーマンスを向上させる。
Optane DC Persistent Memoryは高レイテンシだが容量が大きいため、DRAMとストレージの間で新しい層が使えるようになる。DIMMフォームファクターでは、128GB、256GB、512GBを利用できる。ただし、最近発売された256GBのDIMMが現時点でのDRAMの最大容量になっている。
Intelは、DRAMとOptaneの組み合わせたCascade Lakeサーバを想定している。Optane DC Persistent Memoryは「App Direct Mode」と「Memory Mode」の2つのモードをサポートする。App Direct ModeはOptane対応のソフトウェアを対象とし、データをDRAMに収容するか、容量の大きいOptaneに収容するかを選択できる。Memory Modeは、DRAMがOptaneのキャッシュとして機能する。プロセッサのメモリコントローラーは、最も頻繁にアクセスされるデータが必ずDRAMに存在するようにする。
ディープラーニング命令やOptaneなど、Intelは特定のワークロードの速度を上げるために最適化を追加する戦略を採っているように思える。Optaneは、インメモリデータベースや分析に効果があることが実証されている。ただし通常は、そうした機能をサポートするように記述したコードが必要になる。
これに対してAMDは、初代のEPYCで行ったように多くのコアを低価格で提供し、1ワット当たりのパフォーマンスを向上させるというコストパフォーマンスの提案を打ち出している。
IntelもAMDも新しいチップの詳しい価格はまだ公表していない。Skylakeの最上位チップは1万ドル(約109万円)を上回る価格設定であり、この価格はEPYCの最上位チップの数倍に相当する。この価格差が今後も続く可能性は高そうだ。
Copyright © ITmedia, Inc. All Rights Reserved.
Computer Weekly日本語版
この記事の著者
関連記事
新着ホワイトペーパー PR
-
製品資料
[株式会社MatrixFlow] 「物流リソース最適化」ガイド:人員・配車・傭車を出庫依頼の確定前に決めきる -
製品資料
[株式会社キーエンス] なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは -
製品資料
[株式会社セールスフォース・ジャパン] 「CRMは設計と無関係」は本当か? PLMとの融合で実現する高速開発 -
事例
[日本ヒューレット・パッカード合同会社] AIエージェントの時代にどう備える? 「新たな働き手」を支える3要素とは -
製品資料
[日本ヒューレット・パッカード合同会社] “横並びの自動化”から脱却、AI活用で生産性と競争力を高める秘訣
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
なぜ「全社配布Copilot」は使われないのか? 失敗に学ぶAI定着
-
2
法務と開発者で「言葉が通じない」問題 トヨタやソニーが語るOSS管理の真実
-
3
なぜ「Gemini 4 Argon」は出遅れたのか? Googleが狙う“逆転のシナリオ”
-
4
損保ジャパンはなぜ「COBOL」を捨てなかったのか? 脱メインフレームの真相
-
5
情シスの約8割が転職や退職を意識 調査で分かった“辞めたくなる最大の理由”
-
6
ChatGPTは“検索しまくり”でGeminiは“淡泊”? データが明かすAIの裏側
-
7
情報漏えいはなぜ繰り返されるのか 今すぐ見直すべき「境界」
-
8
「Wi-Fi 7」経由でWindowsが乗っ取られる? 最高権限奪取の恐怖
-
9
「結局使わなくなる」Microsoft 365 Copilotを半年で定着 キリンの3施策
-
10
「中堅・中小企業のネットワーク・セキュリティ運用実態」に関するアンケート
ホワイトペーパーランキング PR
-
1
不審メールの経路や見せ方に変化? 2026年夏の3事例から見えた動向と対処方法
-
2
家庭用Wi-Fiルーターの業務利用は危険? 避けるべき理由と具体的な対策
-
3
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
-
4
財務部門がAIを最大限に活用する方法 無駄のない戦略的リーダーシップへの道
-
5
LLMが兵器化? 元FBI高官が鳴らす警鐘とセキュリティツール統合のポイント
-
6
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
7
なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは
-
8
生成AIを開発に導入しても効果が見えない? 実証実験で分かった成果と課題
-
9
経産省DX指針から読み解く、受発注業務デジタル化ロードマップ
-
10
HDDを使わない「SSDオンリー」が無謀なのはなぜ?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー