AMDのMilanにNVIDIAの次世代GPUを組み合わせた
Pre-Exascaleシステムの「Perlmutter」
2017年にAuroraの位置付けが変わった結果として、ロードマップがどう変わったのか? というのが下の画像だ。
画像の出典は、2018年5月のBarbara Helland氏によるHigh Energy Physics Advisory Panel向けの“Advanced Scientific Computing Research”
まず2020年までに、Summitの後継システムであるNERSC-9がローレンス・バークレー国立研究所に設置される。こちらはEdisonのアップグレードという話になっており、Edisonが2019年5月13日に退役するのを受けて設置される。
このNERSC-9はPerlmutterという名前のシステムで、2020年末までにインストール、2021年に運用開始を想定している。
画像の出典は、Katie Antypas, Brian Austin, Brandon Cook氏によるNERSC User Group向けの“NERSC-9”
このPerlmutterがまたおもしろい構成で、AMDのMilan(つまり7nm EPYCの次の世代)にNVIDIAの次世代GPU(Volta-Next)を組み合わせたものになる。
画像の出典は、Katie Antypas, Brian Austin, Brandon Cook氏によるNERSC User Group向けの“NERSC-9”
Volta-nexttについての説明はないのだが、今年3月に行なわれたGTCの最終日にPerlmutterの説明が簡単にあった。
画像の出典は、GTC Silicon Valley 2019における“S9809,Perlmutter- A 2020 Pre-Exascale GPU-accelerated System for NERSC: Architecture and Application Performance Optimization”
ただNVIDIAとしてもまだVolta-nextの詳細は秘密にしておきたいようで、現時点では性能がどの程度かさっぱりわからない。
PerlmutterではおそらくVolta-next同士はNVLINK-3を使って接続され、これとMilan CPUやSlingshotとはPCIeでの接続になるものと思われる。NVLINK-3が実はCCIXと互換だといろいろ変わってくるが、そのあたりは今のところ不明だ。
ちなみに使い方もなかなかおもしろい。従来のXeon Phi用のコードはCPUのみのノード(およそ4000ノード)で処理するが、これがCori(30PF)と同程度であるという。
画像の出典は、Katie Antypas, Brian Austin, Brandon Cook氏によるNERSC User Group向けの“NERSC-9”
一方CPU/GPU混載ノードはおおむねCoriの2倍以上の処理性能となっており、全体としては90~100PF程度の性能になるものと思われる。
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第894回
PC
AMD「Ryzen AI Embedded X100」のリアルタイムAI制御が、Jetsonの弱点であるCPU性能を突く -
第893回
PC
インテル製GPU「Crescent Island」の正体、容量480GBメモリーでエージェント型AIとKVキャッシュ問題に挑む -
第892回
PC
Hot Chipsで明かされた「Wildcat Lake」の全貌 Foverosを捨てMCPを選んだインテルの舞台裏 -
第891回
PC
謎多き次世代Xeon「Diamond Rapids」を解剖、3D Meshの進化と新命令セットAPXがもたらす変革 -
第890回
PC
Samsung「SF2P」の全貌! GAA最大の弱点であるPMOS性能低下を克服し、TSMC追撃へ準備万端 -
第889回
PC
なぜ巨大チップは歪んで壊れるのか? SK HynixのHBM4「MR-MUF」とTSMCのCoWoS-Lを襲う熱膨張の罠 -
第888回
PC
NVIDIA Rubin Ultra開発中止の真相! 180層CoWoS-Lの歪曲トラブルと、急造ラックNVL576に透ける苦肉の策 -
第887回
PC
AIなしではもはや限界 TSMCが明かすメモリー開発にAIが不可欠となった現実 -
第886回
PC
CFETの足を引っ張るPMOSを救え! imecが提案する新絶縁層と、あえて精度を緩める「Notch Alignment」の妙手 -
第885回
PC
TSMCも次世代「CFET」の全貌を披露! Forksheetスキップの背景と、世界最小6T SRAM実証で見えた2030年への布石 -
第884回
PC
Samsungが次世代CFETの試作に成功! IBMの10万ドル方式に対抗する、量産重視な「一括形成プロセス」のリアリティ - この連載の一覧へ











