SpaceX推Grok 4.6 馬斯克揚言「客觀上排名第一」 每百萬輸出Token收費6美元起
SpaceX(SPCX)旗下SpaceXAI發布Grok 4.6,主打長時間運行的AI代理、編程,以及更複雜的互動和視覺項目。馬斯克更在社交平台X稱,Grok 4.6在「智慧、速度和成本」三方面考量下,「客觀上排名第一」。新模型即日起登陸Cursor、Grok Build及API,亦可經OpenRouter、Vercel和Cloudflare等合作平台使用。
預告Grok 4.7超越所有模型
馬斯克更預告,下一代Grok 4.7將會超越目前所有的模型。他揚言「儘管Anthropic大概很快就會推出更先進的模型,但SpaceX的訓練語料庫是如此強大且獨特,若有任何模型在真實世界的工程能力上能比4.7更出色,我會感到非常震驚」。
Grok 4.6可持續處理複雜任務
SpaceXAI表示,Grok 4.6可持續處理涉及多個步驟的複雜任務,包括資料研究、資訊分析、跨程式碼庫工作,以及將產品構思轉化為可運行的應用程式或工作成果。
部份測試更勝Fable 5 Max
按公司公布的測試結果,新模型在由9項測試組成的人工智能分析指數(Artificial Analysis Intelligence Index)中取得61分,較上一代的56分高,並追平GPT-5.6 Sol Max,僅較最高分的Fable 5 Max低一分。
在個別測試中,新模型於專業知識工作評測取得1,753分,高於Fable 5 Max的1,741分;程式開發評測則取得69.9%,高於GPT-5.6 Sol Max的67.2%。不過,新模型並非在所有項目均領先,在軟件工程及終端操作評測中分別取得65.9%及26%,均落後於兩款主要競爭模型。
更主動測試及驗證自身工作
SpaceXAI表示,Grok 4.6尤其擅長把廣泛的產品構思轉化為首個可運行版本。模型可研究陌生領域、規劃應用程式架構、實現核心互動,並按多輪意見持續修改。
公司指出,Grok 4.6接受較Grok 4.5更長時間的補充訓練,訓練材料包括模型生成的推理及進階技術數據、高質素工程資料,以及經改良的優化器和訓練方案。公司又利用了Grok 4.5重新生成涵蓋科學、科技、工程及數學、軟件工程和知識工作的監督微調數據,再透過模型檢查剔除有問題的推理軌跡。
此外,Grok 4.6亦接受多種代理式強化學習訓練,涵蓋一般編程、內核優化、網頁開發及電腦輔助設計等環境。SpaceXAI稱,新模型在處理較長任務時,會更主動測試及驗證自身工作,再進入下一步流程。
收費方面,Grok 4.6的API定價由每100萬個輸入Token收費2美元、每100萬個輸出Token收費6美元起;另設速度較快的版本,價格為標準版兩倍。
SpaceXAI首周亦會在Grok Build及Cursor提供雙倍使用額度,吸引開發者試用新模型。公司表示,已按模型能力調整安全措施,並進行推出前、推出後及第三方測試。
>>>星島網WhatsApp爆料熱線(416)6775679,爆料一經錄用,薄酬致意。
>>>立即瀏覽【生活百答】欄目:新移民抵埗攻略,老華僑也未必知道的事,移民、工作、居住、食玩買、交通、報稅、銀行、福利、生育、教育。
