2026年8月29日星期六

WhaleAgent
Grok 4.6 智能追平 GPT-5.6 售價不變

Grok 4.6 智能追平 GPT-5.6 售價不變

SpaceXAI 發布新旗艦模型 Grok 4.6,在 Artificial Analysis 智能指數取得 61 分,追平 OpenAI 的 GPT-5.6 Sol。英偉達罕有地公開祝賀,確認模型完全在其 GB300 NVL72 平台上訓練及運行。定價維持每百萬輸入 token 2 美元、輸出 6 美元,與上一代 Grok 4.5 完全相同。

事件背景

Grok 4.6 於 2026 年 8 月 12 日推出,定位是長時間運行的代理任務,以及更複雜的互動與視覺工作。模型發布當日已同步登陸 Cursor 編輯器、SpaceXAI 自家的 Grok Build 工具,以及公司的 API。

這是 SpaceXAI 一個多月內的第二次旗艦更新。Grok 4.5 於 7 月 8 日發布,主打編程與代理任務;4.6 沿用同一套定價,把節奏壓縮到一個月出頭一代。以前沿模型的更新頻率而言,這個節奏在業界屬於偏快的一端。

英偉達的表態則是這次發布的另一條線索。英偉達在官方帳號公開祝賀 SpaceXAI,並形容 Grok 4.6「在 GB300 NVL72 與 NVLink 上訓練及運行,帶來卓越效能、穩定性與最低的 token 成本」。晶片供應商為單一客戶的模型發布背書,並不是每次都會發生的事。

數據解讀

  • Artificial Analysis 智能指數:Grok 4.6 得 61 分,與 GPT-5.6 Sol 打平,落後 Anthropic 的 Fable 5 Max 一分(62),高於 Grok 4.5 High 的 56 分
  • DeepSWE v1.1 軟件工程基準:65.9%,由 Grok 4.5 的 54% 大幅提升,但仍落後 GPT-5.6 Sol Max 的 73%
  • GDPVal-AA v2 知識工作評估:以 1753 分排在同類模型首位
  • CursorBench 與 FrontierCode 亦錄得進步
  • 定價:每百萬輸入 token 2 美元、輸出 6 美元,與 Grok 4.5 相同
  • 硬件:英偉達 GB300 NVL72 系統,配 NVLink 互聯

最值得注意的一項不是分數,而是價格。前沿模型每提升一代智能,通常伴隨提價;Grok 4.6 在指數上升五分的情況下把價格按住不動,等於單位智能的成本直接下降。英偉達那句「最低的 token 成本」,說的正是這件事。

對市場的影響

對 SpaceXAI 而言,這一代把公司重新拉回前沿梯隊。61 分與 GPT-5.6 Sol 平手、距離 Fable 5 Max 只差一分,意味著在多數通用任務上,選擇哪一家已經不再是能力差距的問題,而是價格與生態的問題。不過在純軟件工程任務上,DeepSWE 的 65.9% 對 73% 仍是一道實在的距離,寫代碼為主的用戶未必會馬上轉會。

對英偉達而言,這次公開背書的意義大於一次客戶案例。當一個排名前列的前沿模型明確標示自己「在 GB300 上訓練並運行」,等於替英偉達最新一代機櫃做了一次性能證明,而且是由客戶而非供應商說出口。在市場持續質疑 AI 資本開支能否轉化為實際產出的時候,這類具體的性能歸因比財測更有說服力。

對整個行業而言,真正的變量是價格。如果同價升級成為前沿模型的新常態,競爭焦點就會由「誰最聰明」轉向「同一美元買到多少智能」,而這對於大規模部署代理工作流的企業客戶,影響遠比排行榜上的一兩分要大。

來源

No comments yet