重點摘要:
- 根據內部測試,Gemini 3.8 Flash 縮小了 Google 與 Anthropic 及 OpenAI 之間的編碼能力差距
- 預計本週發布,距 8 月 13 日 Gemini 3.7 Flash 推出不到三週
- 不到兩個月內三次 Flash 更新,顯示 Alphabet 轉向快速微更新策略
重點摘要:

Google 的 Gemini 3.8 Flash 在公司內部 Jetski 編碼平台上進行測試,在 Alphabet 落後於 Anthropic 和 OpenAI 的領域展現出進展,知情人士透露,該模型預計本週公開發布。
「Gemini 3.8 Flash 的內部測試顯示,與 Anthropic 和 OpenAI 相比,編碼性能差距已見縮小,」一位獲悉測試結果的人士表示。Google AI Studio 產品負責人 Logan Kilpatrick 指出,這項改進來自於演算法優化,而非完整的模型重新訓練,與先前 Flash 更新的做法一致。
Gemini 3.8 Flash 的發布距 8 月 13 日推出的 Gemini 3.7 Flash 不到三週,執行長 Sundar Pichai 曾稱 3.7 Flash 是 Google 首週成長最快的模型。早期內部回饋顯示,模型「雜訊」(slop)——即輕量級模型中常見的重複性開場白和迴避性措辭——大幅減少,同時在多輪編碼、快速重構和多步驟代理工作流程方面均有所提升,且首次輸出延遲(time-to-first-token)更低。Google 尚未公布 3.8 Flash 的官方基準測試數據或模型卡。
加速的發布節奏標誌著 Alphabet 的戰略轉變:改以針對性的微更新取代等待數月的大型重新訓練。Gemini 3.6 Flash 於 7 月 21 日推出,約三週後繼之以 3.7 Flash;本週若發布 3.8 Flash 預覽版,將使三次 Flash 版本在不到兩個月內相繼問世。據報公司已取消或延後 Gemini 3.5 Pro,而 Gemini 4.0 仍有待時日。
編碼能力一直是 Google Flash 產品線面臨的最激烈競爭壓力點。Anthropic 的 Claude 和 OpenAI 的 GPT 模型長期在軟體生成基準測試中佔據優勢,而該領域開發者的心智佔有率直接影響雲端採用——在 Gemini 上開發的開發者往往會部署於 Google Cloud。若獨立基準測試證實差距縮小,將強化 Alphabet 在企業 AI 競賽中對抗 Anthropic 和 OpenAI 的競爭地位。
懷疑論者指出,真實世界的開發者基準測試,尤其是長上下文檢索能力和邊緣案例,將是 API 開放後真正的考驗。據一份吹哨人報告稱,Google 已與合作夥伴進行 A/B 測試以改善模型的工具呼叫能力,但公司並未披露編碼比較的測試條件。
Alphabet 股價在那斯達克報 346.59 美元,受 AI 動能席捲通訊服務類股帶動,上漲 1.7%。若編碼能力提升在公開測試中得以維持,可望提振 Google Cloud 的採用率和開發者留存——這對與微軟支持的 OpenAI 及亞馬遜投資的 Anthropic 競爭的業務部門而言,是直接的營收槓桿。市場尚未將此競爭格局轉變納入定價,Alphabet 的估值仍錨定於搜尋業務的韌性,而非 AI 模型的領先地位。若 3.8 Flash 本週如期發布,將是最明確的訊號,表明 Google 打算以速度——而不僅僅是原始能力——來捍衛其開發者基礎。
本文僅供資訊參考,不構成投資建議。