Gemini 3.7 Flash 比前代首發價低 50%,OpenAI 則以 14 倍速服務迎戰
重點摘要
- ✦Google 推出 Gemini 3.7 Flash 模型,不僅在編碼能力上取得顯著進步,更將定價大幅下調 50%,以高性價比搶攻市場。
- ✦OpenAI 同步預覽 GPT-5.6 Sol Ultrafast 服務,透過 Cerebras 晶片實現高達 14 倍的速度提升,但目前採邀請制。
- ✦這兩大巨頭的最新動向,凸顯 AI 競賽的焦點已從單純的模型智慧,轉向如何為 AI 代理提供即時、高效的運算能力。

在人工智慧領域的激烈競爭中,Google 與 OpenAI 不約而同地在 2026 年 8 月 13 日推出或預覽了其最新的 AI 模型與服務,兩者皆聚焦於提升 AI 代理的運算速度與效率。其中,Google 的 Gemini 3.7 Flash 模型以其前代產品發布三週後,價格即大幅下調 50% 的策略震撼市場;而 OpenAI 則透過其 GPT-5.6 Sol Ultrafast 服務,展現了高達 14 倍的驚人速度提升,預示著 AI 應用將邁入更即時、流暢的新紀元。
Google Gemini 3.7 Flash:效能與價格雙重突破
Google 此次推出的 Gemini 3.7 Flash 被譽為其迄今為止在編碼與 AI 代理方面最為強大的「主力模型」。Google 將這次「智慧」的快速躍升歸功於「卓越的演算法改進」。相較於其前身,Gemini 3.7 Flash 在程式碼品質方面取得了最顯著的進步。根據 Google 提供的基準測試數據,該模型在 FrontierCode 測試中得分達 43.6%,較前代的 34.4% 有所提升;在 DeepSWE 測試中,其表現也從 49.0% 躍升至 65.3%。Google 內部測量結果顯示,這些成績使其超越了 Claude Sonnet 5 和 GPT-5.6 Terra 等競爭對手。此外,Google 的基準測試也揭示了該模型在網頁開發、文件理解以及業務流程自動化等方面的進步。例如,在 Code Arena 網頁開發分數中達到 1,588 Elo,並在企業工作流程的 AutomationBench 中取得 30.4% 的成績。
Gemini 3.7 Flash 可透過 API、AI Studio 和 Antigravity 平台使用。其發布定價為每百萬輸入 token 0.75 美元,每百萬輸出 token 3.75 美元,這比 Gemini 3.6 Flash 剛推出時的價格便宜了 50%。目前,這兩款模型已共享相同的價格點,此優惠價格將持續到今年底。該模型支援高達一百萬個輸入 token(約 75 萬字)和 64,000 個輸出 token,能夠處理文字、圖像、影片、音訊和 PDF 等多種格式,並具備呼叫工具和控制電腦的能力。Google 將其定位為自主系統的「廉價大腦」,旨在以更少的人工干預來規劃任務並完成多步驟工作。
OpenAI GPT-5.6 Sol Ultrafast:速度為王的邀請制體驗
與 Google 同步,OpenAI 也預覽了其 GPT-5.6 Sol Ultrafast 服務,這是一個基於現有 GPT-5.6 Sol 模型的新服務層級,旨在提供極致的運行速度。這項服務由晶片製造商 Cerebras 提供支援,能夠將其最先進的模型運行速度提升高達 14 倍,達到每秒 750 個輸出 token(約 560 字)。OpenAI 將此速度提升視為其在 AI 代理領域的關鍵一步,特別是對於需要即時反應的語音代理應用。
Jane Street 的 AI 工程師 John Crepezzi 在 OpenAI 的發布中表示,Cerebras 提供的速度「讓模型的使用方式變得更多元」。Podium 的產品負責人 Courtland Lykins 也指出,這項速度在其語音堆疊中「無比寶貴」,並強調其速度「徹底改變了通話體驗」。然而,與 Google 的 Gemini 3.7 Flash 不同,OpenAI 的 Ultrafast 服務目前僅限受邀客戶透過 OpenAI API 預覽,並將隨著容量的增長逐步擴大對更多企業的開放。
「這項速度徹底改變了通話體驗。」
AI 競賽焦點轉移:從「最聰明」到「夠快速」
Google 和 OpenAI 同步推出的超高速 AI 模型,共同傳達了一個明確的訊息:AI 的速度已足夠讓 AI 代理的使用者感到驚艷。這場 AI 競賽的重心已從單純追求「誰最聰明」轉變為「誰的速度足以應對代理應用」。Google 的 Gemini 3.7 Flash 已全面開放使用;OpenAI 的 GPT-5.6 Sol Ultrafast 則由 Cerebras 晶片提供加速,目前只向部分受邀 API 客戶預覽。兩者反映的是不同的上線策略,不能只用峰值速度直接判定整體模型能力或實際成本。
儘管兩家公司都朝著速度提升的方向邁進,但其實現方式與普及程度卻大相徑庭。Google 的 Gemini 3.7 Flash 是一款全新且普遍可用的模型,而 OpenAI 的 GPT-5.6 Sol Ultrafast 則是一個針對現有模型的加速服務層級,目前仍處於邀請制階段。



