SpaceX推Grok 4.6 馬斯克揚言「客觀上排名第一」 每百萬輸出Token收費6美元起

更新時間:10:02 2026-08-13 HKT
發佈時間:10:02 2026-08-13 HKT

SpaceX(SPCX)旗下SpaceXAI發布Grok 4.6,主打長時間運行的AI代理、編程,以及更複雜的互動和視覺項目。馬斯克更在社交平台X稱,Grok 4.6在「智慧、速度和成本」三方面考量下,「客觀上排名第一」。新模型即日起登陸Cursor、Grok Build及API,亦可經OpenRouter、Vercel和Cloudflare等合作平台使用。

預告Grok 4.7超越所有模型

馬斯克更預告,下一代Grok 4.7將會超越目前所有的模型。他揚言「儘管Anthropic大概很快就會推出更先進的模型,但SpaceX的訓練語料庫是如此強大且獨特,若有任何模型在真實世界的工程能力上能比4.7更出色,我會感到非常震驚」。

Grok 4.6可持續處理複雜任務

SpaceXAI表示,Grok 4.6可持續處理涉及多個步驟的複雜任務,包括資料研究、資訊分析、跨程式碼庫工作,以及將產品構思轉化為可運行的應用程式或工作成果。

部份測試更勝Fable 5 Max

按公司公布的測試結果,新模型在由9項測試組成的人工智能分析指數(Artificial Analysis Intelligence Index)中取得61分,較上一代的56分高,並追平GPT-5.6 Sol Max,僅較最高分的Fable 5 Max低一分。

在個別測試中,新模型於專業知識工作評測取得1,753分,高於Fable 5 Max的1,741分;程式開發評測則取得69.9%,高於GPT-5.6 Sol Max的67.2%。不過,新模型並非在所有項目均領先,在軟件工程及終端操作評測中分別取得65.9%及26%,均落後於兩款主要競爭模型。

更主動測試及驗證自身工作

SpaceXAI表示,Grok 4.6尤其擅長把廣泛的產品構思轉化為首個可運行版本。模型可研究陌生領域、規劃應用程式架構、實現核心互動,並按多輪意見持續修改。

公司指出,Grok 4.6接受較Grok 4.5更長時間的補充訓練,訓練材料包括模型生成的推理及進階技術數據、高質素工程資料,以及經改良的優化器和訓練方案。公司又利用了Grok 4.5重新生成涵蓋科學、科技、工程及數學、軟件工程和知識工作的監督微調數據,再透過模型檢查剔除有問題的推理軌跡。

此外,Grok 4.6亦接受多種代理式強化學習訓練,涵蓋一般編程、內核優化、網頁開發及電腦輔助設計等環境。SpaceXAI稱,新模型在處理較長任務時,會更主動測試及驗證自身工作,再進入下一步流程。

收費方面,Grok 4.6的API定價由每100萬個輸入Token收費2美元、每100萬個輸出Token收費6美元起;另設速度較快的版本,價格為標準版兩倍。

SpaceXAI首周亦會在Grok Build及Cursor提供雙倍使用額度,吸引開發者試用新模型。公司表示,已按模型能力調整安全措施,並進行推出前、推出後及第三方測試。