Tesla K20Xを使ったシステムは
オークリッジ国立研究所で現役稼働中
このTesla K20/K20Xも当然すぐさまHPCに採用されることになった。連載302回で紹介したCRAYのXE6であるが、このCRAY XE6にTesla K20Xを組み合わせたCRAY XK7はオークリッジ国立研究所にTitanというシステム名で納入され、2012年11月のTOP500で見事に1位を獲得する。
このシステムはいまだに現役であり、現時点での最新リストである2014年11月の順位でも2位を確保している代物である。
Titanの構造はCieroに非常に近いが、ノード数は1万8688個で、各々のノードには16コアのOpteron 6274とTesla K20xで構成される。ノード間はCRAYのGemini Interconnectで接続されている。
理論性能が27.1125PFLOPSに対して実効性能は17.59PFLOPSで効率は64.9%とそこそこ。性能/消費電力比はシステム全体で8209KWということで、2.14GFLOPS/Wまで改善している。
まだBlue Gene/Qの3.72GFLOPS/Wにはおよばないが、前回紹介した中国の星雲システムに比べると大幅な改善ができている。
NVIDIAはこれに続き、GK110コアのままメモリー搭載量を増やすとともに動作周波数を引き上げ、さらにTesla K20/K20Xでは13/14 SMXに制限していたものをフルスペックの15 SMXにしたTesla K40を2013年11月に発表。
翌2014年11月には、GK210という若干の改良版のコアを2つ搭載したTesla K80をリリースするに至る。
GK210はGK110と比較するとややシェーダー数が少ない(Tesla K20と同じ13 SMXに制限されている)ほか、動作周波数は定格で562MHz(Boost時に最大875MHz)と下げられているが、内部のレジスター数や共有メモリーの量がGK110に比べると倍になっており、同時に多くのスレッドを実行させられるという特徴がある。
またTesla K40はベースクロック745MHzとやや高めで、それもあってコア1つで235Wなのに対し、Tesla K80は動作周波数を下げた関係で2コアでも300Wに収まっており、性能/消費電力比ではTesla K40をわずかながら上回る結果になっている。
ちなみにNVIDIAの公式資料をベースに計算すると以下のようになる。
GPU | 単精度 | 倍精度 |
---|---|---|
Tesla K40 | 18.26GFLOPS/W | 6.09GFLOPS/W |
Tesla K80 | 18.67GFLOPS/W | 6.23GFLOPS/W |
すでにカード単体レベルではBlueGene/Qの倍近い効率を実現しているわけだが、システムを構築しようとすると他にさまざまな要素が必要になるわけで、普通に作ると中国の星雲システム程度の効率になってしまうのは避けられない。オークリッジ国立研究所のTitanが2GFLOPS/Wを超える効率を誇っているのは、CRAYの高い技術力の成せる技としても良いだろう。
さて、このあたりがNVIDIAの現行製品であり、ここから先は将来製品になるわけだが、そちらに踏み込む前に、次回は少し他社製品を見てみよう。

この連載の記事
-
第813回
PC
Granite Rapid-DことXeon 6 SoCを12製品発表、HCCとXCCの2種類が存在する インテル CPUロードマップ -
第812回
PC
2倍の帯域をほぼ同等の電力で実現するTSMCのHPC向け次世代SoIC IEDM 2024レポート -
第811回
PC
Panther Lakeを2025年後半、Nova Lakeを2026年に投入 インテル CPUロードマップ -
第810回
PC
2nmプロセスのN2がTSMCで今年量産開始 IEDM 2024レポート -
第809回
PC
銅配線をルテニウム配線に変えると抵抗を25%削減できる IEDM 2024レポート -
第808回
PC
酸化ハフニウム(HfO2)でフィンをカバーすると性能が改善、TMD半導体の実現に近づく IEDM 2024レポート -
第807回
PC
Core Ultra 200H/U/Sをあえて組み込み向けに投入するのはあの強敵に対抗するため インテル CPUロードマップ -
第806回
PC
トランジスタ最先端! RibbonFETに最適なゲート長とフィン厚が判明 IEDM 2024レポート -
第805回
PC
1万5000以上のチップレットを数分で構築する新技法SLTは従来比で100倍以上早い! IEDM 2024レポート -
第804回
PC
AI向けシステムの課題は電力とメモリーの膨大な消費量 IEDM 2024レポート -
第803回
PC
トランジスタの当面の目標は電圧を0.3V未満に抑えつつ動作効率を5倍以上に引き上げること IEDM 2024レポート - この連載の一覧へ