
Google 和 OpenAI 今天都傳達了相同的訊息:對於使用 AI 代理的人來說,AI 的速度已經足夠令人印象深刻,兩家公司都發布了超快速的模型。
這兩項發布的建構方式不同,而今天只有其中一項實際可供您使用。
Google 推出了 Gemini 3.7 Flash,這是其最新模型,專為軟體編碼和自主商業工作流程而調整。OpenAI 則開放了 GPT-5.6 Sol Ultrafast 的有限預覽,這是一個新的服務層級,其最先進的模型每秒可輸出多達 750 個 token。
Today we're introducing Gemini 3.7 Flash, our most intelligent workhorse model yet for coding and agents.
This model brings substantial gains across software engineering, web development, and complex knowledge work.
Now through the end of the year, Gemini 3.7 Flash is available… pic.twitter.com/RSCBDipjKn
— Google (@Google) August 13, 2026
Gemini 3.7 Flash 是一款普遍可用的模型。它可接收多達一百萬個輸入 token (約 75 萬字),並輸出 64,000 個 token,能處理文字、圖片、影片、音訊和 PDF,並能調用工具和控制電腦。Google 將其定位為自主系統的廉價「大腦」,用於規劃任務並在減少人工干預的情況下完成多步驟工作。
該模型並未犧牲品質來換取速度。它既更強大又更高效,能夠在 2 分 13 秒內完成我們的測試編碼任務,而最新的 Flash 模型則花費了 5 分多鐘。兩者之間的品質差距也相當明顯。
OpenAI 的 Ultrafast 並非一個新模型。它是 GPT-5.6 Sol,也就是 OpenAI 在發布前曾用 AI 紅隊進行強化,以防範提示注入攻擊的模型,現在透過晶片製造商 Cerebras 的支援,以更快的速度運行。它的速度比 GPT-5.6 Sol 自身的標準速度快了約 14 倍。
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed.
Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows. pic.twitter.com/a5dleofiDJ
— OpenAI (@OpenAI) August 13, 2026
Cerebras 的晶圓級晶片每秒可產生多達 750 個 token,約 560 個字,速度之快足以讓語音代理在通話中進行思考。
Google 自己的基準測試表顯示,Gemini 3.7 Flash 在 18 個測試類別中的 11 個類別中領先於 Claude Sonnet 5、GPT-5.6 Terra 和其他模型,包括在 Code Arena 網頁開發中獲得 1,588 的 Elo 分數,以及在企業工作流程的 AutomationBench 中達到 30.4%。這一切都基於 Google 的方法,因此應將其領先視為該公司的聲明。
如同任何 Gemini Flash 模型,它也很便宜。截至年底,每百萬輸入 token 費用為 75 美分,每百萬輸出 token 費用為 3.75 美元,這比 Gemini 3.6 Flash 的原始價格便宜了一半。該首次推出價格將於 12 月 31 日到期,之後將翻倍至 1.50 美元和 7.50 美元,但對於 Google 模型來說仍然很便宜。
OpenAI 尚未公布 Ultrafast 除了客戶引言之外的直接對比分數。Jane Street 的 AI 工程師 John Crepezzi 在 OpenAI 的聲明中表示,Cerebras 的速度「開啟了使用模型的不同方式」。Podium 的產品主管 Courtland Lykins 稱其「在我們的語音堆疊中無價」,並表示其速度「徹底改變了通話體驗」。該層級目前僅限受邀用戶使用。
這次速度的推進,正值各實驗室從「誰最聰明」轉向「誰的速度足以應付代理」之際。Google 的時機選擇很精準。其旗艦模型 Gemini 3.5 Pro 仍然未見蹤影,且未給出發布日期,距離 3.6 Flash 推出已三週,距離 DeepMind 領導層重組、Demis Hassabis 讓位給副手 Koray Kavukcuoglu 也只過了幾天。與此同時,OpenAI 正在租用 Cerebras 的速度,而不是等待其自身的技術堆疊。
Gemini 3.7 Flash 現已在全球 160 多個國家上線;GPT-5.6 Sol Ultrafast 仍採邀請制。