Google 的 Gemini 3.7 Flash 將代幣價格降至每百萬輸入 0.75 美元,為 3.6 Flash 的一半,而旗艦版 3.5 Pro 仍持續延宕。
Google 的 Gemini 3.7 Flash 將代幣價格降至每百萬輸入 0.75 美元,為 3.6 Flash 的一半,而旗艦版 3.5 Pro 仍持續延宕。

Google 的 Gemini 3.7 Flash 將代幣價格降至每百萬輸入 0.75 美元,為 3.6 Flash 的一半,而旗艦版 3.5 Pro 仍持續延宕。
Google 的 Gemini 3.7 Flash 在 3.6 Flash 推出三週後登場,將代幣價格砍半至每百萬輸入代幣 0.75 美元、每百萬輸出代幣 3.75 美元,而旗艦版 3.5 Pro 至今仍未發布。
「Gemini 3.7 Flash 是開發者回饋與演算法創新的直接成果,」Google 資深總監 Tulsee Doshi 表示。她補充,該模型在編碼與代理(agentic)效能上帶來了「實質性的提升」。
基準測試顯示各項指標全面上揚。衡量軟體工程問題解決能力的 DeepSWE v1.1 從 3.6 Flash 的 49% 上升至 65.3%。FrontierCode 1.1 Main 從 34.4% 攀升至 43.6%,而 WebDev Arena Elo 從 1538 提升至 1588。在知識工作方面,GDP.pdf 文件處理從 22% 提升至 34%,AutomationBench 商業工作流程執行則從 17% 躍升至 30.4%。
此次發布正值 Alphabet 在 AI 競爭力上面臨日益沉重的壓力。Google 承諾 Gemini 3.5 Pro 將於 6 月的 I/O 大會上推出,但該模型目前仍在與合作夥伴進行測試。報導指出,Gemini 的編碼能力未能跟上 OpenAI 與 Anthropic 近期的進展,且 Google DeepMind 近期經歷了一場領導層改組,Demis Hassabis 交棒給副手 Koray Kavukcuoglu。
每百萬輸入代幣 0.75 美元、每百萬輸出代幣 3.75 美元的促銷價格,有效期至 2026 年底,為 3.6 Flash 上市時價格的一半。OpenAI 的 GPT 5.6 Luna——其 Flash 等級模型——定價為每百萬輸入代幣 0.20 美元、每百萬輸出代幣 1.20 美元,仍低於 Google 的報價。這股定價壓力反映了隨著開源模型聲勢漸長,整個產業正朝向更便宜的推論成本邁進。
對於建構自主 AI 系統(能規劃任務、使用軟體工具並完成多步驟工作流程)的開發者而言,成本差異相當顯著。一個每月處理 1 億輸入代幣的開發者,使用 Gemini 3.7 Flash 需支付 75 美元,而使用 OpenAI 的 Luna 僅需 20 美元。Google 押注該模型在編碼與代理效能上的提升足以支撐其溢價,儘管 Anthropic 也已為了與開源替代方案競爭而永久調降其 Sonnet 5 模型的價格。
Gemini 3.7 Flash 已於 Gemini API、AI Studio 與 Gemini Enterprise 上線。對個人使用者而言,可用範圍較窄:該模型驅動 Gemini 應用程式中的 Spark 代理,但僅限 AI Pro 與 Ultra 訂閱用戶,而標準聊天機器人介面仍由 3.6 Flash 提供服務。Google 也強調已更新防護機制,針對化學、生物、放射性與核子領域及網路攻擊的濫用風險加以管控,同時支援有益的應用情境。
該公司表示,此模型「思考更加縝密」,在多步驟規劃與工具呼叫上投入更多心力,執行更具紀律性,能在工程工作流程中減少人工監督與重試次數。在 UI 生成方面,該模型展現出高度的設計遵循度,並能基於參考輸入(無論是截圖、圖像或完整的設計系統)達到對等品質。
此事的利害關係遠不止模型基準測試。共同創辦人 Sergey Brin 已敦促核心 AI 團隊聚焦於 Gemini,而該模型最初的兩位技術共同負責人則已離職共同創辦新創公司。執行長 Sundar Pichai 在 7 月的財報電話會議上為 Google 的 AI 策略辯護,反駁公司已在 AI 編碼上落後競爭對手的擔憂。對 Alphabet 而言,具競爭力的 AI 模型對 Google Cloud 的成長軌跡至關重要,而半價的促銷定價可能壓縮短期利潤率,但或許有助於留住那些正考慮改用 OpenAI 更便宜的 Luna 模型的開發者。加速的 Flash 發布節奏——多次版本更新正逐步逼近 4.0——顯示 Google 優先追求階段性勝利,而非冒險推出可能招致與 OpenAI 和 Anthropic 最新模型不利比較的旗艦產品。
本文僅供資訊參考之用,不構成投資建議。