Grok 4.6在自我優化推理系統的過程中,一共提交了7項PR,其中3項已正式導入Grok Chat的生產環境。根據掌握的資訊,這些程式碼讓生成階段的吞吐量提升1.5%,輸入處理階段則提升3.1%。
律動BlockBeats於13日根據同步監控消息報導,xAI在模型卡中透露,公司利用舊版Grok 4.6測試優化Grok Chat推理系統。這個模型會親自嘗試多種改善方案,但在提交程式碼之前,必須先證明整體系統效能確實有所提升。
Grok 4.6在5小時內測試了297種優化方案,範圍涵蓋「MoE」、注意力運算、下層運算子排程與通訊領域。部分方案雖然在小型測試中展現速度提升,但若對整體系統沒有實質助益,就會被排除在外。
這次進展是繼xAI於12日推出Grok 4.6後的後續開發動態。xAI在模型卡中也提到,正在測試讓Grok承擔新版本訓練與評估研發工作的一部分。
受測任務包括偵測訓練過程中的獎勵駭客(reward hacking)行為、產生與審查訓練資料、檢查大型訓練系統,以及設計新功能的評估方式。所謂獎勵駭客,是指模型並未真正達成目標,卻靠拉高評分機制的分數來取巧過關的學習模式。
不過,這起案例還不能直接視為「遞迴式自我進化」。雖然模型自行提出改善方案並通過驗證程序,但實際導入範圍僅限於Grok Chat推理系統的部分優化。律動BlockBeats也將此定調為屬於AI自我改善,但尚未達到遞迴式自我進化的階段。
Grok 4.6此次優化對加密貨幣交易、代幣價格與交易所服務造成的直接影響,目前並無其他資料可供確認。
查證來源:律動BlockBeats、xAI於12日推出Grok 4.6後續報導
留言 0