Gemini 3.7 Flash 已在 Buda 上线

更强的编程、网页开发与多步骤工具调用,面向高频 Agent 执行。

Buda Team
返回博客
Gemini 3.7 Flash 已在 Buda 上线

Gemini 3.7 Flash 已在 Buda 上线。

Google 把它定位为 Gemini Flash 系列里最强的编程与 Agent 主力模型。在 Buda 里,它更适合承担那些既要求速度、又不能只靠简单生成完成的工作:写代码和排错、生成网页界面、处理高密度文档,以及连续执行多次工具调用。


这次更新了什么

现在,你可以直接在 Buda 的模型选择器中使用 Gemini 3.7 Flash。它将替代 Buda 当前模型列表里的 Gemini 3.6 Flash。

Google 于 2026 年 8 月 13 日发布 Gemini 3.7 Flash,距离 3.6 Flash 只有三周。这次更新很集中:提升软件工程、网页开发、知识工作和多步骤 Agent 执行能力。

根据官方模型规格,Gemini 3.7 Flash 支持文本、图片、音频和视频输入,上下文窗口最高为 1,048,576 tokens,最大输出为 65,536 tokens。它还支持结构化输出、上下文缓存、URL context、Google Search 与 Maps grounding、代码执行和函数调用;Computer Use 目前属于 Preview 能力。

对 Buda 用户来说,重点不是能力列表又变长了,而是同一个快速模型能承担更完整的执行链,减少中途换模型、人工修补和反复重试。

相比 Gemini 3.6 Flash,提升在哪里

Google 公布的评测显示,3.7 Flash 在编程、网页开发、复杂文档和业务自动化上都有明显提升。

Google 公布的评测Gemini 3.7 FlashGemini 3.6 Flash
FrontierCode 1.1 Main43.6%34.4%
DeepSWE v1.165.3%49.0%
WebDev Arena1588 Elo1538 Elo
GDP.pdf34.0%22.0%
AutomationBench30.4%17.0%

Google 公布的 Gemini 3.7 Flash 相比 Gemini 3.6 Flash 的评测提升

这些是 Google 的官方评测,不代表每个真实任务都会得到同样的提升。它们传递出的方向比较清楚:第一版代码更准确,排错和 issue 解决更强,按照截图或设计系统还原界面的能力更好,多工具连续执行也更稳定。

Google 还强调,3.7 Flash 遇到阻碍时更会调整路径,需要时会主动澄清意图,并愿意在多步骤规划和工具调用上投入更多推理。对 Agent 来说,这比单次回答更重要。一个模型不够稳,成本往往不是“答错一次”,而是多轮重试、人工补洞和工作流中断。

Gemini 3.7 Flash 适合做什么

当任务执行量大,但又需要真正的推理能力时,可以优先考虑 Gemini 3.7 Flash。

  • 定位问题、检查相关代码、提出修改并运行测试。
  • 根据截图或设计系统生成可用网页,再按反馈继续修改。
  • 阅读长报告和混合文件,整理成结构化分析。
  • 在 Browser、Terminal、Drive 和外部服务之间连续调用工具。
  • 批量执行调研、分类、起草、监控等重复工作。
  • 一次交付相对完整的初稿或产物,再交给人审核,而不是每一步都停下来等待。

Gemini 3.7 Flash 从上下文、工具执行到人工审核结果的完整执行链

它仍然不是所有决策的默认答案。涉及法律、财务、安全和生产环境变更时,工作流需要明确审核标准,并保留人工批准。遇到复杂例外,也可以把关键步骤升级给更强的深度推理模型。

Credits 与可用范围

Gemini 3.7 Flash 对 Buda Free 开放,Credit 倍率为 0.2x

它适合承担高频、执行密集型 Agent 工作。更实际的做法,是让合适的模型负责合适的步骤,再把真正需要深度判断的环节交给更强模型和人工审核。

在 Buda 中使用 Gemini 3.7 Flash

  1. 打开 Buda 控制台,进入一个 Agent Workspace。
  2. 打开聊天输入框里的模型选择器。
  3. 选择 Gemini 3.7 Flash
  4. 向 Agent 提供相关文件、约束条件、可用工具和验收标准。
  5. 让 Agent 完成执行,再由人审核结果并批准关键动作。

Buda 会把上下文和执行过程集中在同一个 Agent Workspace:聊天记录、Drive 文件、Browser 活动、Terminal 输出和工具调用都能看到。人不只审核最后一句答案,也能检查 Agent 为了得到结果具体做了什么。更多信息见 Agent Workspace 文档

更强的执行层,仍然需要人来管理

真正有价值的模型更新,不是让人更紧张地盯着每一步,而是让 Agent 更完整地处理常规执行,同时把重要审核点清楚地留给人。

Gemini 3.7 Flash 给 Buda 增加了一条更强的执行路线,适合编程、网页开发、文档处理和多工具 Agent 工作流。Agent 负责调查、构建、调用工具和整理证据;人负责确定目标、划定边界、处理例外,并批准真正重要的结果。

打开 Buda,在下一个执行密集型 Agent 工作流中选择 Gemini 3.7 Flash。