谷歌推出Gemini 3.7 Flash,宣称在编程和AI代理领域实现重大飞跃

谷歌推出了 Gemini 3.7 Flash 大型语言模型(LLM),这是其 Flash 系列的新版本,该公司将其描述为迄今为止在编码和 AI 代理领域功能最强大的“主力”模型。 该模型在 Gemini 3.6 Flash 发布仅三周后问世,旨在提升软件工程、网页开发及其他复杂工作流的效率。
据谷歌称,Gemini 3.7 Flash 在调试、问题解决、代码生成和多步骤任务方面较前代产品有了显著提升。 该公司表示,该模型在 FrontierCode 1.1 Main 测试中的得分达到 43.6%,而 Gemini 3.6 Flash 的得分仅为 34.4%;同时,其在 DeepSWE v1.1 测试中的得分也从 49% 提升至 65.3%。
该新模型在网页开发方面的表现也更出色。谷歌表示,Gemini 3.7 Flash 能够使用更少的提示词生成功能更强大的布局和功能更完善的应用程序。此外,无论参考设计是以截图、图片还是完整设计系统的形式提供,该模型对参考设计的遵循度也得到了提升。 在 Arena.ai 的 WebDev Arena 平台上,该模型获得了 1588 的 Elo 分数,而 Gemini 3.6 Flash 的分数为 1538。
» Notebookcheck多媒体笔记本电脑Top 10排名
» Notebookcheck游戏笔记本电脑Top 10排名
» Notebookcheck低价办公/商务笔记本电脑Top 10排名
» Notebookcheck高端办公/商务笔记本电脑Top 10排名
» Notebookcheck工作站笔记本电脑Top 10排名
» Notebookcheck亚笔记本电脑Top 10排名
» Notebookcheck超级本产品Top 10排名
» Notebookcheck变形本产品Top 10排名
» Notebookcheck平板电脑Top 10排名
» Notebookcheck智能手机Top 10排名
» Notebookcheck评测过最出色的笔记本电脑屏幕
» Notebookcheck售价500欧元以下笔记本电脑Top 10排名
» Notebookcheck售价300欧元以下笔记本电脑Top 10排名
谷歌还将 Gemini 3.7 Flash 定位于金融、法律和生物科学等领域的知识密集型任务。在评估处理复杂文档能力的 GDP.pdf 基准测试中,该新模型得分达到 34%,而其前代模型仅为 22%。 在衡量实际商业工作流性能的AutomationBench测试中,Gemini 3.7 Flash的得分达到30.4%,而Gemini 3.6 Flash的得分仅为17%。
该公司表示,该模型的设计还旨在为开发者提供更好的体验。据报道,Gemini 3.7 Flash 在遇到障碍时的适应能力更强,在厘清用户意图、遵循指令、规划多步骤任务以及使用外部工具方面表现更佳。谷歌表示,这应能减少在构建软件代理时对人工干预和反复尝试的需求。
最引人注目的变化之一是定价。截至 2026 年底,Gemini 3.7 Flash 的优惠价格为每 100 万输入令牌 0.75 美元,每 100 万输出令牌 3.75 美元。谷歌表示,这仅为 Gemini 3.6 Flash 原价的一半。 自 2027 年 1 月 1 日起,价格将上调至每 100 万个输入令牌 1.50 美元,每 100 万个输出令牌 7.50 美元。
Gemini 3.7 Flash 还正在集成到 Gemini Spark 中——这是 Google 的一款全天候个人 AI 助手。从今天起,Spark 将使用该新模型来处理知识型工作任务,例如整合文件、起草电子邮件以及更新状态文档。Spark 面向 160 多个国家的 Google AI Pro 和 Ultra 订阅用户开放。
对于开发者而言,可通过 Google Antigravity、Gemini API、Google AI Studio 以及 Android Studio 获取 Gemini 3.7 Flash。企业客户可通过 Gemini Enterprise Agent Platform 和 Gemini Enterprise 应用访问该模型。个人用户在支持该服务的国家/地区,只要订阅了 Google AI Pro 或 Ultra 服务,即可通过 Gemini 应用中的 Spark 访问该模型。














