AI擴張的下一個瓶頸,正從運算效能轉向電力與資料中心基礎設施。Cerebras Systems($CBRS)以將整片晶圓作為單一處理器的架構,以及自有雲端服務,應對AI基礎設施限制。
Cerebras Systems($CBRS)執行長兼共同創辦人安德魯・費爾德曼(Andrew Feldman)將出席10月13日至15日在美國舊金山舉行的TechCrunch Disrupt 2026。TechCrunch在活動介紹中表示,該場次主題為「AI是否能持續擴張」。
這場討論將聚焦運算需求、電力,以及資料中心和製造基礎設施的限制。費爾德曼的具體發言尚未在活動前公布。
Cerebras成立於2015年,是一家AI半導體企業。公司沒有採用常見的晶粒與GPU組合,而是開發將整片矽晶圓作為單一處理器的「晶圓級」架構,並同時提供在地部署系統與雲端平台。
Cerebras在2026年第二季業績公布時表示,目前已啟用或已簽訂供應合約、預計在2027年底前交付的資料中心容量超過600MW。這項數字同時包含現有容量與簽約後將供應的容量,因此不代表全部電力目前都可使用,也不代表全數為Cerebras專用容量。
Cerebras表示,2026年製造能力將擴大10倍以上,並已 확보 TSMC晶圓供應。公司也強調,晶圓級架構不使用HBM記憶體、CoWoS封裝與3奈米製程。
公司在8月公布的CS-4,是搭載3個WSE-3 Turbo處理器的機架式系統。Cerebras先前公布的CS-4,公司稱其推理速度最高可達傳統GPU系統的30倍,每瓦處理量最高為前一代CS-3的10倍。
上述效能比較以Artificial Analysis與內部基準測試為依據。針對參數量超過10兆的模型,每秒處理超過1000個代幣的數字,是根據2026年8月內部基準測試外推而來,實際結果可能因工作任務、模型與系統配置而異。
Cerebras認為,單獨改善運算裝置難以推動AI基礎設施擴張。公司在CS-4發布文件中表示,運算、電力、冷卻與輸入輸出必須一併設計;新的Nexus機架平台整合電力、輸入輸出與運算模組,零組件數量較前一代減少50%。
Cerebras也正與AMD合作推動分拆推理流程的架構。AMD Helios負責提示處理與高吞吐量工作,Cerebras晶圓級引擎則降低回應生成階段的延遲;雙方共同方案預計在2026年下半年於Cerebras Cloud提供。
與AWS的合作目標是在2027年第一季導入Amazon Bedrock。由此可見,Cerebras正把供應範圍從處理器效能擴大至雲端、資料中心與網路配置整合的系統級方案。
OpenAI在2026年1月表示,將與Cerebras合作,為其平台增加750MW規模的超低延遲AI運算能力。相關容量預計在2028年前分階段導入。
Cerebras表示,計畫在2026年底啟用歐洲首批資料中心容量,並在2027年底前將歐洲總容量擴大至200MW。主要地區包括法國與北歐,部分容量將用於OpenAI工作負載。
成長速度與獲利能力仍需一併觀察。Cerebras 2026年第二季按GAAP計算的雲端與其他服務營收為1億2600萬美元(約1706億韓元),較去年同期增加281%;整體GAAP營收為1億8010萬美元(約2440億韓元),增加74%。不過,GAAP營業利益率為-265%。
AI基礎設施瓶頸正從晶片本身擴大至電力、冷卻、資料中心與網路。正如先前報導指出,NVIDIA將運算能力供應視為AI需求限制,Cerebras的策略也把重點放在取得完整系統,而非單一半導體效能。
Cerebras提出的CS-4效能與資料中心擴張計畫,能否在實際客戶環境中實現,仍待後續出貨與業績公布確認。10月13日至15日舉行的TechCrunch Disrupt 2026,預計將公開費爾德曼對AI擴張的相關看法。
留言 0