Gemini 3.7 Flash 已在 Buda 上線

更強的程式開發、網頁生成與多步驟工具呼叫,面向高頻 Agent 執行。

Buda Team
返回部落格
Gemini 3.7 Flash 已在 Buda 上線

Gemini 3.7 Flash 已在 Buda 上線。

Google 將它定位為 Gemini Flash 系列中最強的程式開發與 Agent 主力模型。在 Buda 裡,它適合承擔那些既要求速度、又不能只靠簡單生成完成的工作:撰寫程式與除錯、生成網頁介面、處理高密度文件,以及連續執行多次工具呼叫。


這次更新了什麼

現在,你可以直接在 Buda 的模型選擇器中使用 Gemini 3.7 Flash。它將取代 Buda 目前模型列表中的 Gemini 3.6 Flash。

Google 於 2026 年 8 月 13 日發布 Gemini 3.7 Flash,距離 3.6 Flash 只有三週。這次更新很集中:提升軟體工程、網頁開發、知識工作和多步驟 Agent 執行能力。

根據官方模型規格,Gemini 3.7 Flash 支援文字、圖片、音訊和影片輸入,上下文視窗最高為 1,048,576 tokens,最大輸出為 65,536 tokens。它也支援結構化輸出、上下文快取、URL context、Google Search 與 Maps grounding、程式碼執行和函式呼叫;Computer Use 目前屬於 Preview 能力。

對 Buda 使用者而言,重點不是能力清單又變長了,而是同一個快速模型能承擔更完整的執行鏈,減少中途換模型、人工修補和反覆重試。

相比 Gemini 3.6 Flash,提升在哪裡

Google 公布的評測顯示,3.7 Flash 在程式開發、網頁生成、複雜文件和業務自動化上都有明顯提升。

Google 公布的評測Gemini 3.7 FlashGemini 3.6 Flash
FrontierCode 1.1 Main43.6%34.4%
DeepSWE v1.165.3%49.0%
WebDev Arena1588 Elo1538 Elo
GDP.pdf34.0%22.0%
AutomationBench30.4%17.0%

Google 公布的 Gemini 3.7 Flash 相比 Gemini 3.6 Flash 的評測提升

這些是 Google 的官方評測,不代表每個真實任務都會得到相同提升。它們指出的方向很清楚:第一版程式碼更準確,除錯與 issue 解決更強,依照截圖或設計系統還原介面的能力更好,多工具連續執行也更穩定。

Google 也強調,3.7 Flash 遇到阻礙時更能調整路徑,需要時會主動釐清意圖,並願意在多步驟規劃和工具呼叫上投入更多推理。對 Agent 而言,這比單次回答更重要。模型不夠穩定,成本通常不是「答錯一次」,而是多輪重試、人工補洞和工作流程中斷。

Gemini 3.7 Flash 適合做什麼

當任務執行量大,但仍需要真正的推理能力時,可以優先考慮 Gemini 3.7 Flash。

  • 定位問題、檢查相關程式碼、提出修改並執行測試。
  • 根據截圖或設計系統生成可用網頁,再依回饋繼續修改。
  • 閱讀長報告和混合檔案,整理成結構化分析。
  • 在 Browser、Terminal、Drive 和外部服務之間連續呼叫工具。
  • 批次執行研究、分類、起草、監控等重複工作。
  • 一次交付相對完整的初稿或產物,再交由人員審查,而不是每一步都停下等待。

Gemini 3.7 Flash 從上下文、工具執行到人工審查結果的完整執行鏈

它仍然不是所有決策的預設答案。涉及法律、財務、安全和正式環境變更時,工作流程需要明確的審查標準,並保留人工批准。遇到複雜例外,也可以把關鍵步驟升級給更強的深度推理模型。

Credits 與可用範圍

Gemini 3.7 Flash 對 Buda Free 開放,Credit 倍率為 0.2x

它適合承擔高頻、執行密集型 Agent 工作。更實際的做法,是讓合適的模型負責合適的步驟,再把真正需要深度判斷的環節交給更強模型與人工審查。

在 Buda 中使用 Gemini 3.7 Flash

  1. 開啟 Buda 控制台,進入一個 Agent Workspace。
  2. 開啟聊天輸入框裡的模型選擇器。
  3. 選擇 Gemini 3.7 Flash
  4. 向 Agent 提供相關檔案、限制條件、可用工具和驗收標準。
  5. 讓 Agent 完成執行,再由人員審查結果並批准關鍵動作。

Buda 會把上下文與執行過程集中在同一個 Agent Workspace:聊天記錄、Drive 檔案、Browser 活動、Terminal 輸出和工具呼叫都能查看。人不只審查最後一句答案,也能檢查 Agent 為了得到結果具體做了什麼。更多資訊請見 Agent Workspace 文件

更強的執行層,仍然需要人來管理

真正有價值的模型更新,不是讓人更緊張地盯著每一步,而是讓 Agent 更完整地處理日常執行,同時把重要審查點清楚留給人。

Gemini 3.7 Flash 為 Buda 增加了一條更強的執行路線,適合程式開發、網頁生成、文件處理和多工具 Agent 工作流程。Agent 負責調查、建置、呼叫工具和整理證據;人負責確定目標、劃定邊界、處理例外,並批准真正重要的結果。

開啟 Buda,在下一個執行密集型 Agent 工作流程中選擇 Gemini 3.7 Flash。