アマゾンAWSとウェーハレベルのAIチップを手がけるCerebrasは先日、両社のチップ製品を組み合わせたハイブリッドAI推論システムをAmazon Bedrockプラットフォーム上に展開すると発表しましたこれにより、最も高速なワークロード処理速度の実現を目指していますこのソリューションは、今後数か月以内に正式に提供される予定です
協業計画によれば、本システムはCerebrasのCS‑3ウェーハレベルAIチップ、アマゾンAWSが自社開発したTrainiumチップ、およびEFAエラスティック・ネットワーク・アダプタを統合します推論処理においては、Trainiumチップが事前埋め込み段階、すなわちプロンプトの解析・理解を担い、一方でCS‑3がデコード段階を担当して出力内容の生成を行います両者はEFAによる高速接続で連携し、協調動作を実現します
この役割分担は、それぞれのチップが持つ強みに基づいています推論の事前埋め込みは並列型のワークロードであり、高い演算性能と適度なメモリ帯域幅が求められますこれはまさにTrainiumチップの得意分野です一方、推論のデコードは基本的に逐次処理のタスクで、演算性能の要求は比較的低いものの、メモリ帯域幅への要求は極めて高くなりますCerebrasのCS‑3ウェーハレベルチップは、この領域で特に優れた性能を発揮します両者を組み合わせることで、それぞれの強みを最大限に活かし、ユーザーに最適な推論体験を提供できるのです
今回の提携は、クラウドサービス事業者とAIチップ企業が計算資源の最適化において重要な一歩を踏み出したことを示しており、将来的な大規模モデルの推論処理における効率向上に向けた新たな道筋を切り拓くものでもあります