このページの本文へ

「Oracle CloudWorld 2024」レポート

「Oracle CloudWorld 2024」の主要な新発表を“3つの戦略”でまとめる

分散クラウドからソブリンAIへ、“先行他社とは違う”オラクルOCIの戦略とは

2024年10月18日 11時00分更新

文● 大塚昭彦/TECH.ASCII.jp

  • この記事をはてなブックマークに追加
  • 本文印刷

AIインフラ:13万個のNVIDIA Blackwell GPU搭載クラスタが登場へ

 OCIが注力する2つめの戦略「AIインフラ」について、シャガラジャン氏は「OCIでは大きく6つのイノベーションを実現した」と説明する。

OCIのAIインフラにおける6つの特徴

 たとえば昨年のOCWでは、大量の「NVIDIA H100」GPUを搭載したベアメタルマシンを、高速なRDMA(RoCEv2)ネットワークで接続した「OCI Supercluster」を発表していた。巨大な規模のLLMを開発するAIベンダーでは、このSuperclusterを複数セット利用するケースもあるという。

 今回は、このOCI Superclusterのスケールをさらに拡大する発表が行われた。単一のクラスタで、最大13万1072個の「NVIDIA Blackwell」GPUを搭載し、2.4ゼタFLOPSのピーク性能を実現するというものだ。オラクルでは、ゼタスケールのAIコンピューティングクラスタは「世界初」だとアピールしている。

 なお、GPUサーバーのスケール拡大に合わせて、ネットワーク、オブジェクト/ファイルストレージについても、よりハイパフォーマンスなものがラインアップに追加されている。また、中規模/小規模のAIワークロード向けに「NVIDIA H200」「同 L40S」を搭載したベアメタルインスタンスの提供も発表されている。

OCI Supercluster/AIインフラの特徴

OCIがラインアップするAI向けGPUインスタンスの一覧

 シャガラジャン氏は、すでにUberやxAI、Palantir、Cohereといった多数の顧客企業やAIスタートアップが、OCIのAIインフラ/Superclusterを採用していることを紹介した。現在提供されている最大規模のLLMのうち4つが、OCIのAIインフラを利用して実行されているという。

カテゴリートップへ

本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事

アクセスランキング

  1. 1位

    ITトピック

    IT技術者の4割が「5年後のスキル陳腐化」に危機感/働くシニアは多いが「長く働きやすい」環境ではない日本/トークンコストの成果証明は難しい、ほか

  2. 2位

    データセンター

    AIデータセンターの「電力・冷却課題」打破へ シュナイダーが営業・設計・現場を直結する新組織立ち上げ

  3. 3位

    TECH

    二酸化炭素を資源に変える新触媒、新しい合金を電気で合成

  4. 4位

    デジタル

    ヤマハ、RTX1300の「ひかり電話アダプターモード」を解説する無料ウェビナーを10月15日に開催

  5. 5位

    サーバー・ストレージ

    「身代金を払えば復元できる」は過去の幻想――約束を守らない攻撃者と変容するランサムエコシステム

  6. 6位

    sponsored

    乱立する文書管理をBoxに統合へ、オークネットは基盤整備で「AIをビジネスの武器にする」

  7. 7位

    sponsored

    ルールは作ったが… 現場の「勝手にAI利用」が止まらない! どうやったら防げた?

  8. 8位

    ソフトウェア・仮想化

    Microsoft IQとは? AIエージェントが必要とする理由は? マイクロソフトの担当幹部が解説

  9. 9位

    IoT

    フィジカルAI時代を見据え、NTTドコビジがNaaS基盤を強化 数万台のIoTデバイスをセキュアに管理

  10. 10位

    デジタル

    Zscaler Internet AccessのIKEv2接続例 ヤマハRTX1300でZIA経由の冗長IPsec VPNを構築する方法

集計期間:
2026年09月22日~2026年09月28日
  • 角川アスキー総合研究所