G80世代では思った性能が出せず
GPGPU対策に本腰を入れるNVIDIA
GeForce 8800 GTXでは、1.35GHzで動作するSPが最大2.7GFLOPSの性能を出すので、128SPの場合の理論性能は345.6GFLOPSとなる。2007年といえば、インテルは45nmプロセスの「Core 2 Quad」(Yorkfield)を発売した時期である。
やや時期がはずれるが、計算がしやすいということで2008年3月に発売された「Core 2 Extreme QX9770」あたりを例に取ると、3.2GHz動作で4FLOPS/サイクルのコアが4つなので51.2GFLOPSという計算になり、これと比較しても6.75倍高速ということになる。
もっとも実際に使ってみると、そこまでの性能はなかなか出せなかった。実際CUDAでアプリケーションを組んだ結果として指摘されたのは、以下の項目だった。
倍精度演算性能不足
ハードウェアでは単精度演算しか持っていないので、ソフトウェアで倍精度演算を実施させると10倍以上遅くなり、こうなると倍精度演算でも2FLOPSs/サイクル(SSE2で対応)で処理できるCPUとの差がほとんどない。むしろGPUで処理すると遅くなる。
ECCメモリーの非サポート
多数のGPUカードを利用するデータセンターのような構成では、確率的にメモリーエラーによる計算ミスがそれなりの頻度で発生するが、G80ではこれを検出することも訂正することもできない。
共有メモリーの不足
G80では共有メモリーが16KBしかなく、大規模なプログラムではこれでは不十分とされた。また共有メモリーを利用できないアルゴリズムを利用する場合に向けて、きちんとしたキャッシュアーキテクチャーを実装することが要求された。
他にも、複数スレッド間でのAtomic処理(排他制御をきちんと取った共有メモリー上のデータ書き換え)への対応や、複数のアプリケーションやアプリケーション/グラフィック描画の並行動作時の切り替えの高速化が必要。
いずれも小手先の対応では対処できない事柄ばかりで、NVIDIAは対策に本腰を入れることになる。とは言え、これには相応の時間がかかった。
GPGPUは将来有望とはいいつつ、足元の需要のほとんどは既存のGPU向けである。なので、売り上げを立てるためにはまずGPU向けの製品を発売しなければいけない。
G80の世代はその後プロセスを微細化したG90世代になり、さらに基本的な内部構成は変えないままにシェーダー数を増やしたG200世代を2008年に発売する。
ただこのG200世代の中で、次世代のコアであるFermiの要素を部分的に導入したGT212というコアを導入するはずだったのが流れてしまい、ローエンド向けにGT251/216/218というコアを発売した後に、2010年3月ににやっとFermiことGF100ベースのコアを発売するに至る。
GF100に先立ち、2008年に同社はGPGPU向けのラインナップとしてビデオ出力を持たないTeslaシリーズ第一弾となる「Tesla C1060」を発表、11月にはこれを組み合わせたパーソナルスパコンを披露しているが、これはGT200コアをそのまま利用したものであった。
→次のページヘ続く (GPGPUとしては高性能なGF100)

この連載の記事
-
第811回
PC
Panther Lakeを2025年後半、Nova Lakeを2026年に投入 インテル CPUロードマップ -
第810回
PC
2nmプロセスのN2がTSMCで今年量産開始 IEDM 2024レポート -
第809回
PC
銅配線をルテニウム配線に変えると抵抗を25%削減できる IEDM 2024レポート -
第808回
PC
酸化ハフニウム(HfO2)でフィンをカバーすると性能が改善、TMD半導体の実現に近づく IEDM 2024レポート -
第807回
PC
Core Ultra 200H/U/Sをあえて組み込み向けに投入するのはあの強敵に対抗するため インテル CPUロードマップ -
第806回
PC
トランジスタ最先端! RibbonFETに最適なゲート長とフィン厚が判明 IEDM 2024レポート -
第805回
PC
1万5000以上のチップレットを数分で構築する新技法SLTは従来比で100倍以上早い! IEDM 2024レポート -
第804回
PC
AI向けシステムの課題は電力とメモリーの膨大な消費量 IEDM 2024レポート -
第803回
PC
トランジスタの当面の目標は電圧を0.3V未満に抑えつつ動作効率を5倍以上に引き上げること IEDM 2024レポート -
第802回
PC
16年間に渡り不可欠な存在であったISA Bus 消え去ったI/F史 -
第801回
PC
光インターコネクトで信号伝送の高速化を狙うインテル Hot Chips 2024で注目を浴びたオモシロCPU - この連載の一覧へ