返回 EgentHub 觀點列表
6 分鐘閱讀智慧方案股份有限公司

Grok 4.5 全解析:xAI 靠性價比突圍,長鏈任務與辦公文書全面升級

分享這篇

Grok 4.5 xAI 最強模型

目錄


Grok 4 系列問世之後,xAI 的更新步調就明顯加快,最近兩個月不僅頻繁補上新功能,也持續拓展與各類應用的互動方式。到了 2026 年 7 月 8 日,官方一口氣推出號稱史上最強的 Grok 4.5,主攻程式開發、代理式任務與知識工作三大方向。

這一版最鮮明的賣點,就是性價比。EgentHub 長期站在企業導入 AI Agent 的第一線,對於這種同時追求效能與成本的更新格外關注。以下就由 EgentHub 為各位讀者整理本次的更新重點。


重點整理 Takeaway

  • 長鏈任務表現亮眼:在 SWE Marathon 這類長鏈軟體工程測試裡,Grok 4.5 以 29.0% 的解題率領先所有對比模型,Terminal Bench 2.1 也拿下 83.3%。
  • 又快又省是核心主軸:輸出速度達 80 TPS(每秒 80 個 token),Token 效率約為頂尖模型的 2 倍,同一道題最多能少耗 4.2 倍 token。
  • 一句話生出一個 App:無論是 Rust、C/C++ 這類難啃的語言,還是用一句 prompt 直接產出可上線的應用,Grok 4.5 都能勝任。
  • 辦公文書全包辦:它已成為 Grok Build 的預設模型,搭配先前的功能更新,如今能處理多工作表 Excel、原生 PowerPoint 圖形,也寫得出 Word 長文。
  • 定價相當務實:每百萬輸入 token 2 美元、輸出 token 6 美元,再加上少走一半流程的效率,等於同樣一塊錢能換到更多智慧。

真實工程場景的長鏈任務能力

用模型寫 code 最常見的落差是:跑分漂亮的模型,放進真實專案卻不一定交得出對得上的成績。Grok 4.5 這次把火力集中在真實工程任務,訓練資料橫跨程式、科學、工程與數學,更看重實務上的真本事。

從官方釋出的評測數據來看,它的 benchmark 成績如下:

  • SWE Marathon 解題率達 29.0%,領先其他對比模型
  • Terminal Bench 2.1 拿下 83.3%
  • SWE Bench Pro 也有 64.7%

這些測試考驗的是多步驟的軟體工程能力,也就是要它像資深工程師一樣,一步步揪出 bug、修復、再回頭驗證。對使用者來說,這代表它的強項不只是對話互動,而是能實際扛下需要規劃、驗算、反覆修正的硬任務。


又快又省的 Token 效率

當然,能處理長鏈任務並不算稀奇,這已是近期多數模型都具備的本事。Grok 4.5 這一版真正的招牌,還是極高的性價比與效率——這正好命中企業導入 AI Agent 最實際的痛點:在維持品質的前提下降本增效。

Grok 4.5 的輸出速度為 80 TPS,落在快速模型的水準,而整體 Token 效率更達到目前頂尖模型的 2 倍。舉個具體的例子:同樣是 SWE Bench Pro 的任務,Grok 4.5 平均只花約 15,954 個輸出 token 就解決,對照組 Opus 4.8 卻要用上約 67,020 個,等於足足少燒了 4.2 倍。

講白一點,Grok 4.5 就像一位話不多卻很能幹的數位同事,能用同樣的預算完成更多任務,使用者也不必盯著轉圈圈的畫面空等。


一句 prompt 就能生出一個 App

寫程式最磨人的環節,往往是把一個模糊的想法變成真的跑得動的東西。Grok 4.5 在這一點上表現亮眼,官方也展示了不少只靠一句話就完成的作品。

以官方提供的範例來說:

只要對模型說「用 three.js 做一個漂亮的宇宙與太陽系模擬,要能調整時間、有真實運行軌道與星空,HUD 介面要符合現代設計」,它就能直接產出一個結構完整、介面有模有樣的互動應用,還會自動補齊該有的細節,從 prompt 一路做到接近可上線的成品。

對那些不擅長寫程式、腦中卻常冒出點子的人而言,這等於多了一台把構想化為現實的轉換器。

Grok 4.5 一句 prompt 生成應用範例


從 IDE 延伸到辦公文書

xAI 近期不斷強化 Grok 與其他軟體的互動能力,這些累積在 Grok 4.5 身上正式開花結果。如今它已是 Grok Build 的預設模型,能力也從 IDE 一路延伸到 Office。

  • Excel:能一邊上網查資料、一邊跨工作表拉公式,甚至還會貼上便利貼幫你留註記。
  • PowerPoint:懂得用原生圖形畫出複雜的流程圖,也能排出有邏輯的投影片內容。
  • Word:則能產出乾淨又通順的長文。官方也同步上架了 Word、PowerPoint 與 Excel 的外掛。

務實定價下的高性價比

在一眾旗艦模型當中,Grok 4.5 的定價相當有競爭力:每百萬輸入 token 2 美元、輸出 token 6 美元。再搭配前面提到約 2 倍的 Token 效率,整體算下來,等於在同樣的時間與成本內,換到密度更高的智慧。

使用方式上,即日起就能在 Grok Build、Cursor(全方案)與 xAI 官方 console 裡用到,只要拿到 API key,幾行程式碼就能串接。


企業 AI Agent 的新選擇

綜觀這次更新可以發現,Grok 4.5 的定位正逐漸轉向高性能與高性價比。在 AI Agent 慢慢成為標配的今天,模型的性價比與執行效率,往往才是企業能否真正落地的關鍵。

EgentHub 作為企業級 AI Agent 管理平台,支援多模型自由配置,讓你隨時把最新、最划算的模型接進工作流;細緻的 RBAC 權限管理搭配 MCP 串接,則能讓 AI 在合規的前提下真正接手任務;再加上專業 AI 導入顧問全程陪跑,把工具轉化為實際戰力。與其在一波波模型更新中陷入選擇焦慮,不如交給已被市場驗證的 AI Agent 服務商:EgentHub。

覺得這篇有用?分享給朋友

打造企業專屬 Agent