xAI週三(8/12) 發表Grok 4.6模型 ,主要強化AI代理人長時間執行多步驟工作的能力,可持續研究資料、分析資訊、處理大型程式碼庫,或把產品構想轉化為可運作的應用程式。模型即日起透過Cursor、Grok Build、API,以及OpenRouter、Vercel和Cloudflare等平台供應。
Grok 4.6為xAI的通用AI模型,並非只能用於程式設計或代理工作,只是新版特別加強長時間執行多步驟任務的能力。xAI表示,新模型可自行研究陌生領域、規畫應用程式架構、實作核心功能,再依多輪回饋持續修改,並在工作過程中主動測試及檢查成果。
Grok 4.6接受比Grok 4.5更長的補充訓練,並以Grok 4.5重新產生及篩選推理、軟體工程和知識工作等訓練資料。其代理任務訓練則涵蓋網頁開發、電腦輔助設計及核心最佳化等專業工作。
在xAI公佈的測試中,Grok 4.6於綜合9項評測的Artificial Analysis Intelligence Index取得61分,較Grok 4.5提高5分,追平GPT-5.6 Sol Max,僅落後Fable 5 Max的62分。第三方評測機構 Artificial Analysis認為 ,這使xAI重新回到前沿模型行列。在模擬真實知識工作的GDPVal-AA v2,Grok 4.6取得1,753分,也高於GPT-5.6 Sol Max及Fable 5 Max。
在價格上,Grok 4.6維持Grok 4.5的API定價,每100萬個輸入及輸出Token分別為2美元及6美元,明顯低於同屬前沿模型的GPT-5.6 Sol和Claude Opus 5。後兩者的輸入價格均為5美元,輸出則分別為30美元及25美元;換言之,Grok 4.6輸入價格便宜了60%,輸出價格僅GPT-5.6 Sol的五分之一、Claude Opus 5的約四分之一。