AMDとCerebras、超低遅延の生成AI推論で提携——『Helios』ラックとウエハースケール『WSE』を役割分担、電力あたりの処理を最大5倍に(7月23日発表)
AMDとCerebrasが7月23日、生成AIの“推論”を高速化する技術提携を発表。AMDのHeliosラックが大量処理、CerebrasのウエハースケールエンジンWSEが瞬時の応答を担当し役割分担。電力あたりのトークン生成を最大5倍に。Cerebras Cloudで2026年後半に提供予定。
AIの応答が速く・省エネになれば、チャットや検索など日常のAIがもっと快適になります。電力あたりの処理が最大5倍という効率化は、将来の値下げや高速化につながる可能性があります。
ニュースをやさしく解説
半導体大手のAMDと、巨大な1枚チップ『ウエハースケールエンジン(WSE)』で知られるCerebras(セレブラス)が日本時間7月24日(米国7月23日)、生成AIの“推論”を速くするための技術提携を発表した。推論とは、AIが質問に答えるなど実際に働く処理のことだ。結論から言うと、2社の得意技術を役割分担で組み合わせ、より速く・省エネにAIを動かす仕組みを作る、という話だ。
仕組みはこうだ。AMDの『Helios(ヘリオス)』というラック(棚)規模の装置が、たくさんの複雑な依頼をまとめてさばく“入り口(プロンプト処理)”を担当する。一方、CerebrasのWSEが、答えの文章(トークン)を一瞬で返す“出口(応答)”を担当する。この役割分離(ディスアグリゲーション)により、全体で電力1ワットあたりのトークン生成を最大5倍に高められるという。
発表はAMDのイベント『Advancing AI 2026』で行われ、Cerebrasは自社データセンターにHeliosを導入し、この共同サービスをまず『Cerebras Cloud』で2026年後半に提供する予定だ。私たちに関係するのは、AIの応答が速く・安くなれば、チャットや検索など日常のAIサービスがもっと快適になる可能性があること。
注意点は、これは企業向けのクラウド基盤の話で、一般ユーザーが直接買う製品ではない点だ。出典=AMD公式(IR)/Tom's Hardware。
AIをもっと深く学べる本
ニュースに出てきたAIやカテゴリに近い教材を優先しています。
- スクール無料カウンセリングを見る ↗Winスクール|資格・AI/Pythonに強い個人レッスンAI・Python・Webを本気で学んで仕事・転職につなげたい人向け全国校+オンラインの個人レッスン型スクール。目的別コースを無料カウンセリング・受講相談で相談できます。
- スクール無料個別相談を見る ↗Wannabeアカデミー|3ヶ月でWEBマーケターAIを武器にWEBマーケ・広告運用で副業/転職したい人向け実務課題で学ぶWEBマーケター養成スクール。AI活用が前提の今、需要が高い集客スキルを無料個別相談から確認できます。
- Amazon評価順で探す ↗Amazon|生成AIプロンプト・仕事効率化の本を評価順で探すメール・議事録・資料作成など、毎日の仕事にAIを使いたい人向けプロンプト、業務改善、Office/Google Workspace活用の本をレビュー評価順で確認できます。購入前に内容と対象レベルを確認してください。
広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。