超微半導體(AMD)自家「AI推理引擎」ATOM,爆出内部研發資源分配爭議。半導體研究機構SemiAnalysis指控,超微中階主管已將超過20名工程師投入客戶需求有限的ATOM專案。
SemiAnalysis是在27日下午2點01分(韓國時間)發布的X貼文中提出上述質疑。原文時間為東8區標準的27日下午1點01分,比韓國時間晚1小時。
SemiAnalysis表示,超微内部工程師主動向外部爆料此事。這些工程師認為,開發資源應優先投入Meta(META)與xAI都在使用的推理引擎「SGLang」與「vLLM」,而非ATOM。
這裡所稱的ATOM,是超微的AI推理引擎,與加密貨幣Cosmos(ATOM)無關,兩者並非同一項目。
SemiAnalysis稱,有數十名超微工程師以匿名方式聯繫該機構,爆料者中甚至包含資深工程師與超微內部最高技術職級「AMD Fellow」。
據轉述,這些工程師表示,公司内部政治氛圍加上部分中階主管力挺ATOM,讓相關疑慮很難在公司内部公開討論。SemiAnalysis批評,原本應被分配去開發vLLM、SGLang等客戶端推理引擎的工程師,卻被調去支援ATOM。
這場爭議的核心在於,超微的AI晶片競爭力不只取決於硬體本身,也取決於「軟體生態系」的完整度。大型語言模型(LLM)推理不僅仰賴圖形處理器(GPU)效能,還需要請求排程、快取管理、多GPU協調運作,以及開源框架最佳化等環節環環相扣。
SemiAnalysis主張,超微內部開發資源目前偏向自家引擎,而非實際客戶正在使用的推理引擎,這也讓外界對ATOM的實際使用規模、以及開源推理引擎支援優先順序,展開了一波討論。
SemiAnalysis去年6月的分析文章曾提到,ATOM在單一節點效能上確實有部分優勢,但缺乏實際工作負載所需的關鍵功能。
SemiAnalysis指出,ATOM在正式產品環境中處理的token量幾乎趨近於零,超微對vLLM、SGLang等開源推理引擎的支援力度也不足。換句話說,客戶實際採用的引擎與超微自研引擎之間的資源分配落差,正是内部不滿情緒升溫的原因。
外界原本認為,超微方面可能會拿阿里巴巴(BABA)旗下通義千問(Qwen)的採用案例來反駁上述說法。不過SemiAnalysis進一步查證後主張,這其實只是阿里巴巴企業事業部的有限部署,通義千問的主力團隊並未真正採用ATOM。
在AI推理市場中,晶片本身的運算效能之外,開發者生態系與實際部署案例也會左右客戶的選擇。在與輝達(NVIDIA)的AI加速器競爭中,軟體支援的廣度同樣是與硬體供貨能力並列的評估重點。
本站先前報導,超微曾宣布與Anthropic攜手,將把AMD Instinct MI450系列GPU部署於AMD Helios機架級解決方案,達成一項策略合作,當時的合作內容也包含加速ROCm軟體開發的多年期協作。
對台灣讀者而言,這場爭議不只是超微內部的組織問題。AI基礎建設成本與GPU使用效率,往往會隨推理引擎的穩定性、部署便利度,以及開源生態系支援程度而出現差異。
SemiAnalysis主張,超微應把更多工程師與內部GPU開發資源,投入客戶實際採用的推理引擎。這起ATOM爭議是否會促使超微調整資源配置,後續動向值得持續關注。
留言 0