新闻
Grok 4.5 價格遠低 Fable 5 與 GPT 5.5 基準差距或不再重要
1 分钟阅读
xAI 近日發佈了新一代 AI 模型 Grok 4.5,該模型以數萬張 Nvidia GB300 GPU 訓練,專注於編碼、代理任務與知識工作。基準測試結果呈現混合表現,但價格策略令競爭對手難以匹敵。 基準測試表現 在 Terminal Bench 2.1 測試中,Grok 4.5 得分 83.3%,與 GPT 5.5 的 83.4% 幾乎持平,僅落後 Anthropic 的 Fable 5 一個百分點。然而在 DeepSWE 1.1 上,Grok 4.5 只取得 53%,遠低於 GPT-5.5 的 67% 與 Fable 5 的 70%。在 SWE Bench Pro 上,Grok 4.5 得分 64.7%,較 Opus 4.8 的某配置成績稍低,但遠不及 Fable 5 的 80.4%。xAI 表示訓練中採用大量數據過濾、去重與領域選擇,並以自動評分完成數十萬項軟體工程任務。 價格遠低於對手 Grok 4.5 的定價為每百萬輸入 Token 2 美元、每百萬輸出 Token 6 美元,遠低於 Opus 4.8、GPT-5.5 與 Fable 5。xAI 亦指出,Grok 4.5 在 SWE Bench Pro 任務上使用的 Token 數量比 Opus 4.8 少 4.2 倍,實際輸出速度達每秒 80 Token。綜合低單價與低用量,Grok 4.5 成為此效能等級中最便宜的選擇。此策略類似中國廠商智譜與 DeepSeek 的做法:性能接近,價格取勝。 即日推出歐盟稍後上線 Grok 4.5 已透過 Grok Build、Cursor 與 xAI 控制台提供,並支援 Wor