AMDとCerebras、AI推論で提携

Jeremy Waterhouse / Pexels
スーパーコンピューティングハードウェアの統合における重要かつ決定的な一歩として、大規模言語モデルの処理運用コストを根本的に変革することを約束する動きで、半導体およびグラフィックスプロセッサメーカーのAMDと、ウェハー規模のシリコン開発で名高いCerebras Systemsは本日、戦略的な市場技術提携を正式に発表した。この協力の公式発表は、サンフランシスコで開催されたAdvancing AI 2026イベントで行われた。
分離型推論処理アーキテクチャ
両シリコンブランド間の技術協力の中心的な柱は、新しい分離型AI推論プラットフォームの共同開発である。この処理システムは、AMD Heliosサーバーラックの性能とCerebras Wafer-Scale Engine(WSE)プロセッサの高帯域メモリ容量を統合し、推論時のプロンプト実行と応答生成の論理段階を整理する。
実際には、この革新的なアーキテクチャは、複雑な推論ワークロードを、企業データセンター内で物理的に分離された2つの高速実行段階に分割する。第1段階では、プロンプトの初期処理と圧縮(プリフィル段階)および巨大なデータコンテキストウィンドウの管理がAMD Heliosラックに割り当てられる。各ラックには、スループットをサポートするために72基の高性能MI455X GPUが内部に搭載されている。
ウェハー規模シリコンによる高速応答生成
計算運用の第2段階では、極端なメモリ帯域幅と高速バスを必要とする、単語ごとの大規模かつ反復的な応答生成(デコード段階)が、Cerebras Wafer-Scale Engineによって即座に処理される。2026年7月に技術チームによって実施された、1兆パラメータのKimi 2.6モデルを使用した運用モデリングテストでは、Cerebras単独のハードウェア構成と比較して、ワットあたりのトークン数で最大5倍のエネルギー効率が実証された。
インフラストラクチャとチップ市場における競争
この共同シリコンソリューションは、2026年後半にCerebras Cloudサーバー上でAI開発者に商業的に提供される予定である。このインフラストラクチャは、米国およびアジアの大手IT企業からの、エネルギーと処理にかかる運用コストを増加させることなく、ローカル論理アシスタントの速度を最適化したいという高まる需要に応えるものである。
この戦略的ハードウェア提携は、国際IT市場におけるハイパースケールニューラルサーバーの供給をめぐる競争を激化させる。技術協力は、Microsoft、検索エンジンのGoogle、そして開発会社OpenAIのニューラルクラスターなどの競合他社や従来のコンピューティングパートナーの統合クラウドおよびシリコンソリューションと競合する、高度に効率的な代替インフラストラクチャをテクノロジーブランドに提供することを目指している。タスクを分割する能力は、エンタープライズネットワークのスケーラビリティを最適化する。
データセンターにおける高速物理ネットワークスイッチと安定した接続
GPUラックとウェハー規模チップ間の大量データ移動と高速バスの有効化には、安定した物理光接続と高速スイッチが必要である。データトラフィックとローカル接続は、ネットワーク半導体メーカーのBroadcomのような、物理ネットワーク専門の設計者によって設計されたチップとルーターに依存している。ローカルネットワークスイッチのコスト低下は、処理を最適化し、クリーンエネルギー市場におけるパートナー企業のコンピューターの電力消費を削減する。
このコンテンツは私たちのチーム(iatoskill.com)によって作成およびレビューされました。問題がある場合は、こちらからお問い合わせください


