同一天,兩間公司都在說同一件事:模型夠快了。差別是,Google 的東西已經在你手上,OpenAI 的還鎖在名單後面。
Google 週四推出 Gemini 3.7 Flash,鎖定寫程式與自動化工作流程,直接全面開放,目前已在超過 160 個國家上線。這顆模型可吃下最多 100 萬個輸入 token(約 75 萬字),輸出上限 6.4 萬 token,文字、圖片、影片、音訊、PDF 都能處理,還能呼叫工具、操作電腦介面。實測上,它跑完同一個內部編碼測試只花 2 分 13 秒,前一代 Flash 得花超過 5 分鐘,速度差距肉眼可見。Google 自己的評測資料顯示,Gemini 3.7 Flash 在 18 項測試中有 11 項領先 Claude Sonnet 5、GPT-5.6 Terra 等對手,Code Arena 網頁開發項目拿下 1,588 Elo,企業流程測試 AutomationBench 得分 30.4%——這是 Google 自家方法論算出來的數字,領先幅度多少要打折看待。
價格也砍了一半:年底前每百萬輸入 token 0.75 美元、輸出 3.75 美元,是上一代 Flash 原價的一半。這個優惠價到 12 月 31 日就結束,之後會漲回 1.5 美元和 7.5 美元,即便如此,以 Google 的模型來說仍然便宜。
OpenAI 同一天預覽的 GPT-5.6 Sol Ultrafast,其實不是新模型,而是把原本就存在、經過紅隊測試強化過提示注入防禦的 GPT-5.6 Sol,接上 Cerebras 的晶片重新跑一遍。輸出速度最高衝到每秒 750 個 token,換算大約每秒 560 個英文字,比 Sol 原本的速度快了 14 倍。Cerebras 的晶圓級晶片是關鍵——這個速度快到讓語音助理可以在講電話的當下同步思考。問題是,這個版本目前只先開放給 OpenAI API 的一小群客戶,屬於邀請制,還沒公開任何跟其他模型的正面評測數字。
Jane Street 的 AI 工程師 John Crepezzi 在 OpenAI 的發布文裡說,這個速度「讓模型有了不同的用法」;Podium 產品負責人 Courtland Lykins 則說這對他們的語音系統「非常寶貴」,「徹底改變了通話體驗」。這些都是客戶引言,不是公開跑分。
值得一提的是發布的時間點。Google 真正的旗艦模型 Gemini 3.5 Pro 至今沒有發布日期,距離 3.6 Flash 推出已經三週,而且就在 DeepMind 高層改組——Demis Hassabis 讓位給副手 Koray Kavukcuoglu——之後沒幾天。OpenAI 這邊選擇用租來的 Cerebras 算力衝速度,而不是等自家基礎設施跟上。兩邊都在用「快」轉移話題,但只有 Google 把東西真的交到開發者手上。
Gemini 3.7 Flash 現已全面開放;GPT-5.6 Sol Ultrafast 仍為邀請制預覽,尚無公開釋出時間。






