インテルがCTS-2を受注
ベースとなるのはSapphire Rapids
HPC分野では苦戦が続くインテル。米エネルギー省の科学技術計算施設NERSCにあるPerlmutterに加え、Auroraのためのアプリケーション開発に利用されるアルゴンヌ国立研究所のPolarisまでAMD/NVIDIA連合に持っていかれたのは、アプリケーション開発として「本当にいいのか?」という気がしてくる。
実際ALCF(Argonne Leadership Computing Facility)のPolarisのページを見ると下の表が出ているが、いくら似ているとは言え、例えばIntel MPIやMath Libraryなどのわりと肝心なモノが互換性がないのはどうか、という気がしてならない。こうした話はインテルにとっては屈辱モノではあるのだが、CTS-2の受注で一矢報いた格好になる。
CTS(Commodity Technology Systems)の話はまず連載286回で、もう少し詳しい話を連載347回でしているが、要するに技術的に冒険の少ない、確実に稼働する(ただしコストもその分安い)汎用のシステムである。
これの前身は連載347回で紹介したTLCC(Tri-lab Linux Capacity Cluster)で、アルゴンヌ/ロスアラモス/サンディアの3つの国立研究所で共同導入するLinuxクラスターである。
連載347回はTLCC-1とTLCC-2まで触れたが、これに引き続き導入予定だったTLCC-3が、CTS-1に名前を変え、2015年10月にPenguin Computingと契約を締結している。導入は2016年4月からスタートし、2018年9月までに完了しているが、これはそもそもクラスターであって、1つのシステムではない。実際2016年11月のTOP500では以下の7つのシステムがCTS-1として登録されている。
| 2016年11月のTOP500に登録されているCTS-1 | ||||||
|---|---|---|---|---|---|---|
| 順位 | 設置場所 | システム | ||||
| 42位 | LLNL/NNSA | CTS-1 Jade | ||||
| 43位 | LLNL | CTS-1 Quartz | ||||
| 67位 | LANL | CTS-1 Grizzly | ||||
| 85位 | SNL/NNSA | CTS-1 Serrano | ||||
| 86位 | SNL/NNSA | CTS-1 Cayenne | ||||
| 90位 | LANL/NNSA | CTS-1 Fire | ||||
| 91位 | LANL/NNSA | CTS-1 Ice | ||||
| 169位 | SNL | CTS-1 Dark Ghost | ||||
要するに同じ基本構成で、あとはノード数や細かな部分だけをカスタマイズして3つの研究所に導入、適時ネットワークを利用して大規模クラスターを組んだり分散利用したりできるものだ。これは便利に利用されていたが、さすがにXeon E5 v4(Haswell-EP)では性能面での力不足も多く、稼働時間も長くなってきたということでぼちぼち廃止が近くなってきた。
この代替システムとしてNNSAがCTS-2のRFP(プロポーザル要求)を出し、これに複数企業が応募していたわけだが、最終的にDell Technologyがこれを受注することになった。
このCTS-2は2022年中旬から導入が始まり、2025年中に完了予定(これに合わせてCTS-1は順次退役)であるが、このDellのマシンはインテルのSapphire Rapidsをベースとしたものになることが発表された。Ponte Vecchioを絡めない分、確実に納入できるであろうというあたりは、なんとかHPCへの足掛かりを残した格好だ。
ちなみにAMDではなくインテルベースのシステムで受注できた理由であるが、1つには現在のCTS-1上で動くアプリケーションには少なからずIntel MKL(Math Kernel Library:算術演算ライブラリー)を使ったものがあり、これらはインテルロック(AMDのプロセッサーでは動かない)がかかっているあたりも挙げられるかもしれない。ALCFのPolarisページにある表でMath LibraryにIntel MKLの名前が挙がっていないあたり、このあたり根深いものがあることがおわかりいただけよう。
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第885回
PC
TSMCも次世代「CFET」の全貌を披露! Forksheetスキップの背景と、世界最小6T SRAM実証で見えた2030年への布石 -
第884回
PC
Samsungが次世代CFETの試作に成功! IBMの10万ドル方式に対抗する、量産重視な「一括形成プロセス」のリアリティ -
第883回
PC
TSMCのA16プロセスの詳細が判明! 性能向上の主因はトランジスタではなく裏面電源供給(SPR)にあり? -
第882回
PC
IBMが0.7nmチップの製造に成功! 変態的CFET構造NanoStackの凄みと、あまりに高すぎる製造コストの壁 -
第881回
PC
同一周波数で消費電力18%削減! 進化した「Intel 18A-P」はどこが変わったのか? -
第880回
PC
次世代NVLinkの布石か? TSMCの光電融合技術「COUPE」がもたらすAIサーバーの光接続 -
第879回
PC
なぜAIには「光」が必要なのか? NVIDIAが解説するスケールアップネットワークの低遅延・省電力化戦略 -
第878回
PC
もはや銅配線は限界? 3200Gイーサネット実現に立ちはだかる200GT/秒の壁 -
第877回
PC
「不良品ゼロ」と「水冷NG」の狭間で。ルネサスが明かした車載チップレットSoCのリアル -
第876回
PC
このままではメモリーが燃える! HBM4/5世代に向けた電力供給の限界と、Samsungが示すパッケージ協調設計の解 -
第875回
PC
1000A超のAIプロセッサーをどう動かすか? Googleが実践する垂直給電(VPD)の最前線 - この連載の一覧へ












