dev.to #ai新闻
Google Gemini 3.7 Flash 全面上线,覆盖 AI 模式、API 和企业级应用
Google 正式发布 Gemini 3.7 Flash 模型,并已全面覆盖 Gemini API、Google AI Studio、Vertex AI、Gemini Enterprise、Gemini 应用及搜索 AI 模式。该模型支持 100 万 token 上下文,输出可达 64,000 token,并具备可调思考级别。Google 强调其指令遵循和意图理解能力提升,适合编码、智能体工作流和多步任务。开发者可通过多个平台访问,企业需关注定价和治理问题。
Google 已正式发布 Gemini 3.7 Flash 为全面可用(GA)模型,并将其扩展至 Gemini API、Google AI Studio、Vertex AI、Gemini Enterprise、Gemini 应用以及搜索中的 AI Mode。此次发布于 2026 年 8 月 13 日,将该模型定位为此前 3.5 和 3.6 Flash 系列的继任者,Google 强调其在指令遵循、用户意图理解方面表现更强,并在编码、智能体工作流和多步骤任务中响应速度更快。
对于企业开发者而言,其意义更多不在于单一入口,而在于 Google 消费者端和企业端 AI 界面之间更一致的模型层。团队可以在应用开发、托管式企业使用以及面向搜索的用户旅程中评估同一模型系列,同时 Google AI Pro 和 Ultra 订阅用户可在 Gemini Spark 中随部署推进逐步获得访问权限。
Google 官方 Gemini 3.7 Flash 模型文档列出了该 GA 模型的规格和发布定价。该模型支持 100 万 token 的上下文窗口、最高 64,000 token 的输出,以及可调节的思考级别。这些特性使该版本适用于需要处理大量源材料、生成较长回复或在响应速度与推理深度之间取得平衡的工作负载。
Gemini 3.7 Flash 发布带来的变化
核心变化在于广泛可用性。Gemini 3.7 Flash 不再局限于独立的开发者预览版或单一消费产品。Google 通过 Gemini API 及相关开发环境提供该模型,同时将其整合到搜索中的 AI Mode 和 Gemini 应用中。
在 AI Mode 方面,Google 表示 Gemini 3.7 Flash 正在支持的市场中为许多用户取代此前的 Flash 变体。该模型在指令遵循和意图理解方面的优势在搜索场景中尤为重要,因为用户经常提出复合问题、细化请求,或期望回复能够考虑自然语言中表述的约束条件。
在开发者侧,访问范围涵盖 Google AI Studio、Antigravity、Vertex AI 和 Gemini Enterprise。Google 表示这些开发者界面提供相同的核心模型功能集,包括编码和智能体能力、长上下文处理、大输出量以及可调节的思考级别。这为组织提供了多种采用该模型的路径,可根据其偏好的 Google 环境进行选择。
| 界面 | Gemini 3.7 Flash 访问方式 | 相关发布详情 |
|---|---|---|
| Gemini API 和开发者工具 | 通过 Google AI Studio、Antigravity、Vertex AI 和 Gemini Enterprise 提供 | 包含该模型的编码、智能体、长上下文、输出和思考级别能力 |
| 搜索中的 AI Mode | 正在多个市场逐步推出 | 为许多用户取代此前的 Flash 变体 |
| Gemini 应用中的 Gemini Spark | 正在向 Google AI Pro 和 Ultra 订阅用户推出 | 支持地区提供英文支持,Ultra 用户在支持国家/地区可使用 macOS 应用 |
定价设定了明确的评估窗口
Google 已将 Gemini 3.7 Flash 的 introductory 定价设定为截至 2026 年 12 月 31 日,每 100 万输入 token 0.75 美元,每 100 万输出 token 3.75 美元。标准定价在该日期后生效,因此企业应将 introductory 期视为建立工作负载基线的机会,而非永久性成本假设。
输入与输出的区分对智能体系统尤为重要。检索大量上下文、处理文档或维持长工具调用链的应用可能消耗大量输入量。生成详细代码、长分析或多步骤输出的系统则可能更侧重于输出成本。在测试期间同时衡量两方面,比用单一混合 token 估算来评估模型更有意义。
指令遵循是实际的产品主张
Google 的核心质量主张是 Gemini 3.7 Flash 能更好地遵循指令并理解用户意图。对于开发者而言,在模型必须遵循精确输出格式、按顺序执行流程、决定何时使用工具或在多步骤请求中保持约束的工作流中,这一点具有重要意义。
但这不应被解读为移除应用控制的理由。更好的指令遵循可能改善任务执行,但组织仍需测试模型如何处理其提示词、工具、权限和边缘情况。智能体部署尤其应明确模型可以执行哪些操作、可以访问哪些信息,以及哪些环节需要人工审核。
企业采用中的治理问题
此次扩展发布为组织提供了重新审视产品和搜索相关团队模型治理的理由。通过 API 构建的团队可能与评估 AI Mode 信息呈现方式的市场或客户体验团队有不同的评估和审批流程。然而,两者可能受到同一底层模型变更的影响。
实用的评估计划应包括:
- 使用具有代表性的提示词和成功标准来测试对指令敏感的任务。
- 在 introductory 费率下衡量输入和输出 token 的使用量,然后为 2026 年 12 月 31 日之后的定价做好规划。
- 在部署 agentic 工作流之前,审查工具权限和升级路径。
- 检查 AI Mode 和 Gemini 应用的可及性是否符合组织的目标市场、语言和订阅权限。
对于依赖搜索发现的企业来说,AI Mode 的推出还增加了一个可见性方面的考量。对意图理解的改进可能会改变用户提问的方式以及他们评估生成答案的方式。因此,了解品牌、产品或源材料在 AI 驱动的搜索体验中是否被准确呈现,变得非常重要。
随着 AI Mode 采用更新的 Gemini 模型,搜索可见性不再仅仅是一个 SEO 指标,而成为一个产品和治理问题。Scalevise 的 AI Visibility 和 GEO Checker 可帮助团队评估其品牌在 AI 答案环境中的呈现方式,识别来源覆盖方面的差距,并在这些差距影响发现之前优先进行改进。立即开始 AI 可见性扫描。
常见问题解答
什么是 Gemini 3.7 Flash?
Gemini 3.7 Flash 是 Google 面向编码、agentic 工作流和多步骤任务推出的正式可用 AI 模型。Google 将其定位为早期 Gemini 3.5 和 3.6 Flash 系列的继任者。
开发人员可以在哪里访问 Gemini 3.7 Flash?
开发人员可以通过 Gemini API 访问 Gemini 3.7 Flash,包括 Google AI Studio、Antigravity、Vertex AI 和 Gemini Enterprise。
Gemini 3.7 Flash 的费用是多少?
截至 2026 年 12 月 31 日,Google 的 introductory 定价为每 100 万输入 token 0.75 美元,每 100 万输出 token 3.75 美元。标准定价将在该日期之后生效。
Gemini 3.7 Flash 在 Google AI Mode 中可用吗?
是的。Google 正在许多市场将 Gemini 3.7 Flash 推广到搜索中的 AI Mode,在许多用户的使用场景中取代早期的 Flash 版本。
谁可以在 Gemini 3.7 Flash 上使用 Gemini Spark?
Gemini Spark 正在面向 Google AI Pro 和 Ultra 订阅用户,在 Gemini 3.7 Flash 上推出。受支持地区可使用英文版本,受支持国家的 Ultra 用户可通过 Gemini macOS 应用访问。
结论
Gemini 3.7 Flash 让 Google 最新的 Flash 模型在开发人员、企业、订阅用户和搜索用户已经使用的各个场景中均可使用。其正式发布、introductory token 定价、长上下文能力以及对指令遵循的重视,为组织提供了具体的评估基础。下一步是在考虑访问条件、未来定价以及任何 agentic 部署的治理要求的同时,针对真实工作负载测试该模型。