Google发布 Gemini 3.7 Flash 解决问题能力全面增强
Google今日正式发布 Gemini 3.7 Flash,不仅延续了该公司加快发布节奏的路线,更是在上一代模型问世仅三周后便再次带来重大更新。新模型的诞生直接源于开发者反馈与算法创新,相关成果也将在未来继续融入后续模型中。Gemini 3.7 Flash 在软件工程、网页开发以及知识工作领域实现了“显著提升”。

在编程领域,新模型相比 3.6 Flash 在调试与问题解决方面取得了强劲增长。具体来看,DeepSWE v1.1 评估基准得分从 49.0% 飙升至 65.3%,在 FrontierCode 1.1 Main 测试中的表现也从 34.4% 提升到了 43.6%。
在网页开发方面,Gemini 3.7 Flash 能以更少的提示词生成功能更完备的布局和应用。在 Arena.ai 的 WebDev Arena 评估中,上一代模型的 Elo 得分为 1538 分,而本次新模型达到了 1588 分。无论输入参考源是截图、图片还是完整的系统设计,新模型在 UI 生成上都展现出了极高的设计契合度与一致性。
针对金融、法律、生物科学等知识密集型领域,新模型的推理与准确度同样获得突破。在测试复杂文档处理能力的 GDP.pdf 基准测试中,Gemini 3.7 Flash 以 34.0% 对 22.0% 的成绩大幅超越 3.6 Flash;在评估实际业务工作流执行能力的 AutomationBench 测试中,新模型也以 30.4% 的高分领先上一代的 17.0%。
开发者将体验到更具适应性的 Gemini 3.7 Flash,它在面对阻碍时能更好地做出调整,必要时可主动澄清意图,并以更高的忠实度遵循指令。新模型在多步骤规划和工具调用中展现出更严谨的思考能力,这种更具纪律性的执行力意味着更少的精力和人力监督,从而大幅减少工程工作流中的重试成本。

安全防护方面,新模型更新了针对化学、生物、放射性与核(CBRN)以及网络攻击领域的防滥用机制,并在符合生物韧性方法及网络安全计划的前提下,进一步赋能有益的应用场景。
价格方面,截至 2026 年底,Gemini 3.7 Flash 的尝鲜价为输入每百万 Token 0.75 美元、输出每百万 Token 3.75 美元,仅为上一代模型发布时的一半。
目前在 Gemini 应用中,3.7 Flash 已面向 Spark 用户推出(需订阅 AI Pro 或 Ultra)。模型的提升将使个人智能体在知识工作领域效率大增,并改善针对 Google Workspace 应用的工具使用能力。此外,该模型也已同步登陆 Google Antigravity、AI Studio、Android Studio、Gemini Enterprise Agent Platform 以及 Gemini Enterprise 应用。

