「そんないい方法ならば、なぜ今まで実装してこなかったのか?」というと、実装そのものが非常に難しかったからだ。図3で言えば、バッファ「A」はレジスタファイルの数だけ必要だが、「B」と「C」は各ユニットにひとつずつで済む。回路上で物理的に近接した場所に配置できるから、高速にアクセスできる。
ところが図4の方式だと、実行ユニットやメモリーコントローラーとPhysical Register Fileの場所が、物理的に近接しているとは限らないので配線が長くなりがちで、その分レイテンシも増えやすい。さらに、Physical Register Fileの割り付けを管理するポインタへのアクセスが余分に入るから、処理そのものも増える。
これまではこうしたデメリットを考えて採用しなかったわけだが、Sandy Bridgeではこうしたデメリットよりも、消費電力を減らすほうが重要と判断したわけだ。
レジスタのクリアも効率化
なお、Physical Register Fileの実装に合わせて、さまざまなバッファの数も増やされているのも、Sandy Bridgeにおける改良のひとつである。これに合わせて搭載されたのが「Zeroing Idioms」である。これは何かと言えば、「レジスタをクリアする命令を効率化する仕組み」とでも言えばいいだろうか。
x86の場合、レジスタをクリアするために以下のような命令を多用する。
- XOR EAX,EAX
Nehalemまでは、こうした命令を馬鹿正直に実行ユニットで処理していた。しかし、目的はEAXレジスタを「0」にできればいいのであり、XOR命令を実施したいわけではない。そこでこうした命令を「RAT 1」~「Rdy/Sch」の間に検出して、命令を発行せずに直接Physical Register Fileを操作して済ませてしまうのが、Zeroing Idiomsの役割である。これも命令処理の効率化と、消費電力削減に効果的である。
★
以上がSandy Bridge世代の主な改良点である。厳密に言えば64bit命令の効率化(Macro Fusionの対象となる命令の拡充)や、64bit OSの普及に合わせて大量のメモリーを搭載した場合のアクセス性の改善なども図られているが、これらは大きな違いというよりも細かな改良というべきだろう。
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第881回
PC
同一周波数で消費電力18%削減! 進化した「Intel 18A-P」はどこが変わったのか? -
第880回
PC
次世代NVLinkの布石か? TSMCの光電融合技術「COUPE」がもたらすAIサーバーの光接続 -
第879回
PC
なぜAIには「光」が必要なのか? NVIDIAが解説するスケールアップネットワークの低遅延・省電力化戦略 -
第878回
PC
もはや銅配線は限界? 3200Gイーサネット実現に立ちはだかる200GT/秒の壁 -
第877回
PC
「不良品ゼロ」と「水冷NG」の狭間で。ルネサスが明かした車載チップレットSoCのリアル -
第876回
PC
このままではメモリーが燃える! HBM4/5世代に向けた電力供給の限界と、Samsungが示すパッケージ協調設計の解 -
第875回
PC
1000A超のAIプロセッサーをどう動かすか? Googleが実践する垂直給電(VPD)の最前線 -
第874回
PC
AIの未来は「電力」で決まる? 巨大GPUを支える裏面給電とパッケージ革命 -
第873回
PC
「銅配線はまだ重要か? 答えはYesだ」 NVIDIA CEOジェンスンが語った2028年ロードマップとNVLink 8の衝撃 -
第872回
PC
NVIDIAのRubin UltraとKyber Rackの深層 プロトタイプから露見した設計刷新とNVLinkの物理的限界 -
第871回
PC
GTC 2026激震! 突如現れたGroq 3と消えたRubin CPX。NVIDIAの推論戦略を激変させたTSMCの逼迫とメモリー高騰 - この連載の一覧へ











