伊隆·馬斯克(Elon Musk)表示,xAI旗下生成式AI模型Grok 4.6(Grok 4.6)能夠執行遊戲製作實驗代理工作流程「The Gauntlet」。此番發言強調了AI從單純問答工具,進化為可承接長時間任務的代理式應用潛力。
馬斯克在X(前身為Twitter)貼文中表示,Grok 4.6被證實強大到足以執行「Gauntlet循環」(Gauntlet Loops),並喊話「開始製作遊戲吧」。中國區塊鏈與科技媒體深潮TechFlow(TechFlow)報導稱,該貼文於韓國時間15日上午6點29分左右發布,資訊來源標示為馬斯克本人帳號。
Gauntlet循環是馬斯克在此次貼文中與遊戲製作一併提及的代理式工作流程。這番發言凸顯出該模型可用於長時間反覆任務,而非僅止於生成單一回答。
xAI已於12日推出生成式AI模型Grok 4.6。該公司表示,Grok 4.6以Grok 4.5為基礎,聚焦於長時間運行代理、互動式任務與視覺任務。官方說明指出,該模型設計用於維持跨多個步驟的複雜任務,並處理程式碼庫分析或應用程式製作等工作。
官方發布的評測數據也指向同樣方向。xAI表示,Grok 4.6的AA智能指數為61,與GPT-5.6 Sol相同。Cursorbench 3.2得分為69.9%,DeepSWE 1.1得分為65.9%。不過該公司說明,競品模型的數據取自各開發商公開的系統卡或基準測試排行榜。
Grok 4.6已透過Cursor、Grok Build、API、OpenRouter、Vercel與Cloudflare提供服務。價格方面,輸入token每100萬個2美元(約2830韓元)起,輸出token每100萬個6美元(約8490韓元)起。xAI表示,快速版本模型的價格則是上述的兩倍。
此番發言與Grok的觸角正擴展至開發者工具與部署基礎設施的趨勢相呼應。馬斯克的發言與其說是效能基準的公布,不如說更接近產品應用案例的展示。至於Grok 4.6在實際開發環境中究竟能展現多高的完成度與成本效益,仍有待在Cursor、Grok Build、API使用過程中進一步驗證。
留言 0