もう1つのPre-Exascaleシステム
Trinityの後継機「Crossroads」
次がロスアラモス国立研究所/サンディア国立研究所のCrossroadsであるが、これはTrinityの後継である。
このTrinityは過去の連載で触れていないのだが、ローレンス・リバモア国立研究所のSequoiaの次に、ATCのシステムとして構築されたもので、HaswellベースのXeon+Knight LandingベースのXeon Phiの組み合わせ(どちらも9500ノード以上)でピーク42.2PFという処理性能を持つシステムである。
このTrinityが、前ページに掲載したECPのロードマップの画像で“Secure”と書かれていることからもわかるように、これは核関連のアプリケーションを稼働させるためのシステムだが、こちらも2021年中に退役が予定されており、Crossroadsはこれを更新するためのものである。ただ2018年秋に要求仕様書が出ているはずだが、今のところ具体的な動きが見えていない。
Exascaleシステム第1弾の「Aurora」は
インテルのXeon ScalableとXe GPUを採用
Pre-Exascaleの動向を一通り説明したところで、いよいよExascaleの話をしよう。まず第1弾がAuroraであるが、こちらは連載505回でも簡単に紹介した。
将来世代のXeon Scalable(おそらくIce Lakeの次か、ひょっとするとさらにその次)とXe GPUを組み合わせるという話になっており、全体で1EF以上の性能とされる。
ただこの1EFの数え方が、次のFrontierもそうなのだがいまいち怪しい。というのは、これまでピーク性能は通常FP32を前提にしていたのだが、どうもこのExascale世代はFP16に減ってる可能性がある。
FP16で1EFということはFP32で500PFという計算になるから、Summit/SierraやPerlmutterなどよりは性能が高いのだろう。
その第1弾が発表された3月18日から2ヵ月たたずに、ピーク性能で1.5EFのFrontierの契約が発表されたというわけだ。
Exascaleシステム第2弾が「Frontier」
インテルではなくAMD製プロセッサーを採用
さて、現状ではあまりFrontierの情報がない。まずプロセッサーであるが、カスタム版のEPYCが利用される。一方のGPUであるが、これは将来のRadeon Instinctが採用される。
現行世代ではない、という理由は下の画像のとおり。Radeon Insinct同士だけでなく、Radeon InstinctとEPYCの間もInfinity Fabricで接続されると明示されているからだ。
現行世代のRadeon InstinctでもInfinity Fabricで接続可能だが、プロセッサーとの接続はPCIe 4.0となっている。
現実問題として現行のEPYCの場合、Infinity Fabricをプロセッサーの外に出せるのは2ソケット構成で相互接続する時だけで、GPUの接続は想定していない。
同様にRadeon Instinctの方も、PCIeレーンをCCIXで利用することは可能だが、Infinity Fabricでの接続はサポートしていない。おそらくこれが可能になるのは“Next-Gen”、つまりNaviの次以降になるものと思われる。
そもそも先にも書いたがPerlmutterの時点でプロセッサーにはMilanを想定しているわけで、納入が1年遅いFrontierはMilanの次であっても不思議ではない。
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第894回
PC
AMD「Ryzen AI Embedded X100」のリアルタイムAI制御が、Jetsonの弱点であるCPU性能を突く -
第893回
PC
インテル製GPU「Crescent Island」の正体、容量480GBメモリーでエージェント型AIとKVキャッシュ問題に挑む -
第892回
PC
Hot Chipsで明かされた「Wildcat Lake」の全貌 Foverosを捨てMCPを選んだインテルの舞台裏 -
第891回
PC
謎多き次世代Xeon「Diamond Rapids」を解剖、3D Meshの進化と新命令セットAPXがもたらす変革 -
第890回
PC
Samsung「SF2P」の全貌! GAA最大の弱点であるPMOS性能低下を克服し、TSMC追撃へ準備万端 -
第889回
PC
なぜ巨大チップは歪んで壊れるのか? SK HynixのHBM4「MR-MUF」とTSMCのCoWoS-Lを襲う熱膨張の罠 -
第888回
PC
NVIDIA Rubin Ultra開発中止の真相! 180層CoWoS-Lの歪曲トラブルと、急造ラックNVL576に透ける苦肉の策 -
第887回
PC
AIなしではもはや限界 TSMCが明かすメモリー開発にAIが不可欠となった現実 -
第886回
PC
CFETの足を引っ張るPMOSを救え! imecが提案する新絶縁層と、あえて精度を緩める「Notch Alignment」の妙手 -
第885回
PC
TSMCも次世代「CFET」の全貌を披露! Forksheetスキップの背景と、世界最小6T SRAM実証で見えた2030年への布石 -
第884回
PC
Samsungが次世代CFETの試作に成功! IBMの10万ドル方式に対抗する、量産重視な「一括形成プロセス」のリアリティ - この連載の一覧へ











