MENU

ニュース

【月間400兆トークン時代】NVIDIA B300で激変!IBM CloudとTogether AIが拓く「オープンAI爆速運用」の全貌

  • URLをコピーしました!

IBMはTogether AIと総額2億4,000万米ドルの複数年契約を締結し、IBM Cloud上にNVIDIA HGX B300システムとNVIDIA Spectrum-X Ethernetを用いた推論専用の大規模クラスターを構築します。提供開始は2027年第1四半期予定です。Together AIはこのクラスターでオープンソース・モデル向け推論サービスを提供し、企業のAIワークロードを高速かつ効率的に本番運用する体制を整えます。NVIDIAによれば、本構成は前世代比で30倍のAIファクトリー処理能力を実現する設計です。IBM Cloudゼネラル・マネージャーのアラン・ピーコック氏は、エージェント型AIを大規模導入する企業ニーズに対し、スケーラブルで経済性に優れたエンタープライズ向けAIインフラを提供すると述べました。

初の推論専用大規模クラスターでトークン効率とコストを両立、エンタープライズ展開を加速

Together AIは、IBMとNVIDIAの製品ロードマップ、迅速なGPU提供能力、低トークンコストの実現力を評価して選定しました。同社はAI Native Cloudとして推論、トレーニング、ファインチューニング、エージェント型ワークフローを提供し、推論サービスは月間400兆トークンを処理しています。シリーズCでは企業価値83億米ドルで8億米ドルを調達し、エンタープライズ市場での拡大を進めています。CEOのVipul Ved Prakash氏は、クローズドモデルの高コストを回避しつつ最先端性能を求める企業に対し、高速で信頼性が高く拡張可能な基盤が鍵と強調しました。NVIDIAのDion Harris氏は、IBM Cloud上のHGX B300とSpectrum-Xにより、リアルタイムAIサービスに必要な性能、効率、拡張性を備えたオープンソースAI導入を支援するとコメントしています。IBMとNVIDIAはインフラとソフトウエア全体で協業を拡大し、GPUネイティブ分析や非構造化データ抽出、オンプレミスとクラウドの両環境、コンサルティングの進展を発表しています。

まずは推論ワークロードの本番要件を洗い出し、必要トークン量とレイテンシ、コスト上限を明確化した上で、IBM Cloud上のクラスター利用計画を立てると移行が進みます。オープンソース・モデルの選定とエージェント型ワークフローの接続点を定義し、既存システムとの連携検証を段階的に行う準備が有効です。将来予測に関する記述は変更の可能性があるため、最新情報の確認が推奨されます。

詳しくは「日本アイ・ビー・エム株式会社」の公式ページまで。 レポート/DXマガジン編集部

シェアはこちらから
  • URLをコピーしました!
  • DXイノベーション大賞2026
  • 週刊SUZUKI
  • DSW

お問い合わせ

取材のご依頼やサイトに関するお問い合わせはこちらから。

問い合わせる