Grok 4.5:xAI 新模型,主打便宜、專為寫程式和 agent
原片講者:Grok
如果你最近有在為 AI 帳單頭痛,這篇值得看完。
2026 年 7 月 8 日,xAI(馬斯克的 AI 公司)宣布了 Grok 4.5,隔天(7 月 9 日)正式公開。它不是拿來跟你哈拉的聊天機器人,而是專門做兩件事:寫程式、建 App(coding),還有自動幫你辦事(agentic)。馬斯克給它的形容是「Opus 等級,但更快、更省 token、更便宜」。
重點在最後那三個字——便宜。這一代 xAI 沒有硬拗自己是全世界最聰明的模型,而是換了一個更務實的打法:同樣的活,讓你花更少的錢。對每天在燒 API 額度的人來說,這反而更有感。
它到底能做什麼
Grok 4.5 的定位很清楚,就是 coding + agent 兩條線。
coding 這邊,它能寫程式、幫你把一個 App 從零建起來,也能塞進你既有的開發流程裡當助手。agentic 這邊,它可以自己拆解任務、一步一步跑完一整套流程,而不是每一步都要你手動下指令。
更實際的是,它現在就能用,而且入口很多:
- grok.com 網頁直接開
- X App(X Premium 與 SuperGrok 訂閱都能用)
- API,模型 id 就是
grok-4.5,文件在 https://docs.x.ai/developers/grok-4-5 - Cursor 裡面選得到
- 它也是 Grok Build 的預設模型
對開發者來說,最重要的是那個 API 和 Cursor 支援——代表你不用改工作習慣,把原本呼叫別家模型的地方換成 grok-4.5,就能直接比較。
一個要先講清楚的地雷:歐盟現在還用不到,要等到 7 月中。如果你人在歐盟或用歐盟區帳號,先別急著遷移,等開放再說。
另外,網路上流傳它的 context window 約 500K,但 xAI 官方沒有正式公布這個數字,所以就當「網傳」看看,別拿去當規格寫進技術文件。
價格便宜到什麼程度
這才是這次真正的主角。官方 API 定價(已驗證):
- 輸入:每百萬 token $2
- 輸出:每百萬 token $6
- cached input 約 $0.50
拿它跟對手的頂級模型比一下就很有感。Claude Opus 4.8 大約是輸入 $5、輸出 $25。也就是說,Grok 4.5 的價格大概只有對手的一半,輸出那一段甚至便宜到四分之一左右。
如果你需要更快的反應,還有一個更快的變體,價格約 $4/$18,一樣比對手便宜。
這個差距在小規模看不太出來,但一旦你在跑 agent、要連續呼叫幾十上百次,或是做大量批次處理,成本是等比例放大的。cached input 只要 $0.50 這點也很關鍵——agent 流程常常會重複帶同一段長 context,能吃到快取的話,實際帳單會比帳面數字更省。
講白一點:如果你的任務不是非最頂尖模型不可,換成 Grok 4.5 很可能省下一半的錢,而結果差不多。 這就是它的整個賣點。
一個誠實提醒:它不是跑分王
這段我得老實說,免得你期待錯方向。
Grok 4.5 不是跑分冠軍。第三方評測機構 Artificial Analysis 的數據顯示,它的 coding 能力大約跟 GPT-5.5 同一級,略低於 Opus 那個檔次。所以請不要把它想成「贏過 GPT-5.5、屌打 Opus」——它沒有,官方自己也沒這樣宣稱。
它真正的主張是 cost-per-task,也就是「完成同一件事的成本」。同樣一份工作,它可能拿到接近的結果,但你付的錢少一半。這是一個很不一樣的價值主張:不是比誰分數高,而是比誰的性價比高。
對很多實際場景來說,這反而更務實。你的 App 不會因為模型多考了三分就賺更多錢,但帳單少一半是實實在在進你口袋的。當然,如果你的任務就是要榨到最後一滴能力(高難度推理、極端邊界情況),那該用頂級模型還是得用——這時候 Grok 4.5 不是最佳解。
所以判斷標準很簡單:你缺的是能力上限,還是成本控制?
誰適合、該怎麼用
根據上面這些,我會這樣分:
很適合換過去的人:
- 每個月 AI API 帳單已經有感的團隊或個人開發者
- 在跑 agent、自動化流程、需要大量重複呼叫的場景(成本被放大,省一半差很多)
- 已經在用 Cursor 的人——直接切
grok-4.5試,零遷移成本 - 做的任務屬於「日常量產」而非「極限難題」,對品質有基本要求但不需要最頂
先別急著全遷的人:
- 人在歐盟(要等 7 月中)
- 任務吃的是模型能力天花板,分數每一分都影響結果
- 對穩定性要求極高、不想當第一批白老鼠的正式產線
最務實的做法不是二選一,而是混搭:把大量、重複、對品質要求中等的活丟給 Grok 4.5 省錢,把真正難、真正關鍵的少數任務留給頂級模型。這樣整體帳單會明顯下降,品質又不會崩。
實測的話,建議你挑一個現在正在花錢的真實流程,把模型換成 grok-4.5 跑一週,直接對比「結果有沒有變差」和「帳單少了多少」。數字會幫你做決定,比任何跑分榜都準。
收尾
Grok 4.5 這一代最聰明的地方,不是它有多聰明,而是 xAI 想通了一件事:大部分人要的不是全世界最強的模型,而是「夠好、又便宜一半」的模型。在 AI 成本開始變成真金白銀的今天,這個切角很可能比多考幾分更打中人心。
官方消息看這裡:https://x.ai/news/grok-4-5;想串 API 的話文件在 https://docs.x.ai/developers/grok-4-5。
我最近在整理一份「各家 AI 模型的實際成本 vs 能力對照表」,把 coding / agent 常用的幾個模型該用哪個、怎麼混搭省錢都列清楚了。想要的話,在下面留言「我要」,我私訊分享給你。