8月12日,xAI先丟出Grok 4.6;隔一天8月13日,Google馬上端出Gemini 3.7 Flash應戰。這已經不是兩家公司第一次這樣互別苗頭了,但這次特別密集——Gemini上一顆3.6 Flash才推出三週,就被自家的3.7 Flash取代,可以感覺到這場AI模型的軍備競賽已經進入按週更新的節奏。
問題是,一般人根本追不上這個速度。上禮拜才搞懂Grok 4.5跟Claude的差異,這禮拜又冒出兩個新名字,到底該選哪一個?這篇文章不打算列一百項規格表讓你看得眼花,而是直接照幾種常見的使用情境,告訴你該挑誰。

這兩顆模型在吵什麼?
簡單說,這是兩種完全不同的產品哲學在對打。Grok 4.6主打「更聰明」,在多項推理與長期任務的Benchmark上分數領先;Gemini 3.7 Flash主打「更快、更便宜」,速度大約是Grok的4倍,價格也便宜超過六成。
一個押注深度思考,一個押注效率與規模,這也是為什麼網路上找不到「誰完勝誰」這種簡單答案——要看你打算拿它做什麼。
規格對決:速度、Context Window、能吃什麼輸入
先看硬數字。Gemini 3.7 Flash的生成速度大約落在每秒274到340個token,依運算配置而定;Grok 4.6大約是每秒85.8個token,速度差距接近4倍。如果你的用途是即時對話或需要快速回應的Agent迴圈,這個差距會很明顯。
Context Window(模型一次能記住的內容長度)方面,Gemini 3.7 Flash提供約104萬token,Grok 4.6則是50萬token,Gemini大了整整一倍。這代表丟一整本書、一份很長的會議記錄,或是一個中大型程式碼庫進去,Gemini比較不容易「忘記」前面講過什麼。
輸入類型上兩者差異也不小:Grok 4.6目前支援文字與圖片;Gemini 3.7 Flash除了文字、圖片,還支援影片、音訊與PDF直接輸入,多模態的覆蓋範圍更廣。

智力對決:Benchmark分數該怎麼看
在Artificial Analysis智能指數(一個綜合多項推理測試的第三方評分)上,Grok 4.6拿下61分,Gemini 3.7 Flash約56分,Grok領先5分。在程式開發相關的GDPVal-AA Elo評分上差距更明顯,Grok 4.6是1753、Gemini 3.7 Flash是1525。
但這不代表Gemini在編碼上完全弱掉——在另一項專門測試長期軟體工程任務的DeepSWE基準上,Gemini 3.7 Flash從前一代的49.0%大幅躍進到65.3%,已經幾乎追平Grok 4.6的65.9%,進步幅度是整輪更新裡最猛的一項。
看Benchmark分數要提醒一件事:這些數字反映的是「跑分表現」,不完全等於「你實際用起來的體感」,尤其中文語境的表現、特定領域的專業知識問答,第三方Benchmark不一定完全捕捉得到,實際用途還是建議自己丟幾個真實案例測一輪。
定價對決:現在便宜不代表明年也便宜
API定價(開發者串接時用)上,Gemini 3.7 Flash目前是每百萬輸入token 0.75美元、輸出3.75美元,這是限時的介紹價,官方已經公告2027年1月起會調漲到1.5美元/7.5美元。Grok 4.6則是固定價2美元/6美元,若單次輸入超過20萬token還會加倍到4美元/12美元。
換算成實際案例,一個100萬輸入加25萬輸出的任務,用Gemini目前價格大約1.69美元,用Grok大約3.5美元,Gemini便宜超過一半。但別忘了這是限時價——等明年漲價後,兩者的價差會明顯縮小,如果你是要簽長約或做大量呼叫的專案,這個時間點的價格變化建議先算進成本規劃裡。
一般消費者用免費聊天介面的話,價格差異感受不到,但額度限制不一樣:Grok免費版透過grok.com或X App登入即可用,但額度有限,約每2小時10次對話、Think推理模式約5次,圖片與影片生成額度更嚴格;Gemini 3.7 Flash則已經悄悄成為Gemini App裡的預設模型之一,免費用戶不用額外訂閱就能在選單裡切換使用(台灣地區的上線時間可能略晚於美國,實際能不能選到請以App內顯示為準)。
情境一:只是想找免費聊天助手
如果你只是想要一個免費、日常對話用的AI助手,兩者其實都能用,差異不大。Gemini 3.7 Flash的優勢是回應速度快、免費額度相對寬鬆;Grok 4.6的優勢是推理深度較好,遇到需要多步驟邏輯的問題可能給出更完整的答案,但免費對話次數有限制。如果你已經習慣用Gemini App或X App其中一個,直接繼續用原本的介面即可,不需要為了追新特地換平台。
情境二:要處理長文件、影片或PDF
這個情境Gemini 3.7 Flash優勢明顯。它的Context Window比Grok大一倍,加上原生支援影片、音訊、PDF輸入,丟一份很長的合約、一支會議錄影或是一本書進去分析,體驗會順暢很多。Grok 4.6目前只吃文字跟圖片,遇到影片或PDF得先自己轉成文字才能餵進去,多一道手續。
情境三:在跑AI Agent做長時間自動化任務
這裡兩邊各有支持者。Grok 4.6的設計強調「自驗證」——會自己檢查子任務有沒有真的完成,對長時間跑的Agent流程來說,這種自我檢查機制能降低任務中途跑偏卻沒被發現的風險。Gemini 3.7 Flash的優勢則是速度快、成本低,同樣預算能跑更多輪測試迭代,適合還在快速試錯階段、需要大量重跑Agent流程找出最佳設定的情況。簡單說:追求穩定可靠選Grok,追求快速迭代選Gemini。
情境四:開發者要用API串進自己的產品
先問自己一個問題:你的產品需要處理多模態內容(影片、語音、長PDF)嗎?需要的話,Gemini 3.7 Flash的輸入類型覆蓋範圍直接省掉你另外接轉檔服務的麻煩。如果你的產品主要是純文字的深度推理應用(例如專業領域問答、複雜邏輯判斷),Grok 4.6的智能指數與編碼Benchmark分數較高,可能更適合。
成本規劃上也要把「介紹價到期」這件事算進去——如果你的產品要簽長期API合約,Gemini現在的價格優勢到2027年1月會縮水,屆時兩者的實際成本差距會比現在看到的數字小很多。
一張表看懂規格總覽
| 項目 | Gemini 3.7 Flash | Grok 4.6 |
|---|---|---|
| 發布日期 | 2026-08-13 | 2026-08-12 |
| 開發團隊 | Google DeepMind | xAI |
| 生成速度 | 約274-340 tokens/秒 | 約85.8 tokens/秒 |
| Context Window | 約104萬 tokens | 50萬 tokens |
| 輸入類型 | 文字、圖片、影片、音訊、PDF | 文字、圖片 |
| AA智能指數 | 約56 | 61 |
| API輸入價(介紹價) | 0.75美元/百萬token | 2美元/百萬token |
| API輸出價(介紹價) | 3.75美元/百萬token | 6美元/百萬token |
| 價格調整時間點 | 2027年1月起調漲至1.5/7.5美元 | 目前無公告調整時間 |
| 免費消費端使用 | Gemini App內建,免額外訂閱 | grok.com/X App,額度有限 |
常見問題 FAQ
Q1:Gemini 3.7 Flash跟前一代3.6 Flash差在哪?
主要差異在程式開發、長文件處理與複雜任務的穩定度,3.6 Flash推出後僅三週就被3.7 Flash取代,顯示Google目前更新節奏非常密集,一般聊天使用的體感差異可能不如開發情境明顯。
Q2:Grok 4.6現在台灣可以直接用嗎?
可以,grok.com在台灣可直接存取,用Email或X帳號註冊即可,不需要額外設定,介面支援繁體中文對話。
Q3:兩個模型哪個比較適合寫程式?
純看Benchmark分數Grok 4.6目前略勝一籌(GDPVal-AA Elo 1753 vs 1525),但Gemini 3.7 Flash在DeepSWE長期工程任務基準上進步幅度很大,兩者差距正在縮小,建議依實際專案語言與框架各測一次再決定。
Q4:免費版有辦法用到這兩個新模型嗎?
Gemini 3.7 Flash已經是Gemini App的可選模型之一,免費帳號不用額外訂閱;Grok 4.6免費版透過grok.com或X App可用,但對話與生圖生影片額度都有限制,用量大的話會很快碰到上限。
Q5:這篇文章的數字之後會不會過時?
會,這類即時新模型比較文的資訊時效性本來就短,尤其定價與免費額度規則常常調整,建議把這篇當作發布當下的快照參考,實際決策前再到Google AI Studio與xAI官網核對最新公告。
Q6:如果我兩個都不想選,還有其他選擇嗎?
有,同一時期市場上還有GLM-5.3、Claude Opus 4.8等模型也在更新,選擇沒有標準答案,取決於你的預算、用途與已經習慣的生態系,不必因為兩顆新模型同時發布就覺得非得馬上換不可。
延伸閱讀


