ESC
AI 1 分钟阅读

谷歌发布 Gemini 3.7 Flash

谷歌发布Gemini 3.7 Flash,距3.6 Flash仅三周。在软件工程、知识工作、网页开发等方面显著提升,编码和文档处理基准大幅领先,输入/输出价格降至3.6 Flash的一半。即日起以每百万token 0.75/3.75美元促销价提供至年底,并已用于Gemini Spark。

来源:Hacker News

本次发布距离 Gemini 3.6 Flash 仅三周,直接源于开发者反馈以及我们期待在未来模型中应用的算法创新。3.7 Flash 在软件工程、知识工作和网页开发工作流方面带来了实质性改进,并且入门价格仅为原版 3.6 Flash 每百万 token 成本的一半。

3.7 Flash 在调试和问题解决等编码任务上较 3.6 Flash 有显著提升。它还在首次通过的代码准确率上更高,并在生成生产级代码方面表现更好,如 FrontierCode 1.1 Main(43.6% vs 34.4%)和 DeepSWE v1.1(65.3% vs 49.0%)所示。

在网页开发方面,3.7 Flash 能用更少的提示生成更实用的布局和功能完整的应用。在 UI 生成方面,该模型基于参考输入(无论是截图、图片还是完整设计系统)表现出高度的设计一致性和同等水平。它在 Arena.ai 的 WebDev Arena 上以 Elo 评分 1588 vs 1538 超越 3.6 Flash。

在金融、法律和生物科学等知识密集型领域,3.7 Flash 提供了更强的推理能力和准确性。在用于测试模型处理复杂文档能力的 GDP.pdf 基准上,它显著优于 3.6 Flash(34.0% vs 22.0%)。它还在 AutomationBench 上超过 3.6 Flash,证明它能更有效地完成真实业务流程(30.4% vs 17.0%)。

从一个简单的文本提示到一款可完整游玩的 3D 游戏。我们使用 Gemini 3.7 Flash 结合 Nano Banana 实时动态生成角色、物品和纹理。

惊艳的交互式落地页一次生成。我们使用 Gemini 3.7 Flash 编排子代理,并借助 Gemini Omni 创建流畅的交互式视差组件。

一个机器人模型正在使用 Gemini 3.7 Flash 进行训练,通过 3 代理图循环中的多模态理解帮助机器人更快学习。

从静态 PDF 到交互式数据故事。观看复杂的年度报告如何被转化为包含实时图表和汇总洞察的沉浸式网页体验。

Gemini 3.7 Flash 提供了比 3.6 Flash 明显更好的开发者体验。它能更好地应对障碍,在需要时澄清意图,并以更高的保真度遵循指令。它思考更仔细,在多步规划和工具调用上投入更多精力。更规范的执行意味着在工程工作流中需要更少的人工监督和重试。

3.7 Flash 即日起至年底提供入门价格[1]:每 100 万输入 token 0.75 美元,每 100 万输出 token 3.75 美元。这一价格加上增强的模型性能,使开发者和客户能够经济高效地扩展生产级 agent。

早期客户反馈突出了 3.7 Flash 的性能和精准度,能够以低成本取得明显优于 3.6 Flash 的结果。

Gemini Spark 已向超过 160 个国家的 Google AI Pro 和 Ultra 订阅用户提供,从今天起将使用 Gemini 3.7 Flash。我们在 I/O 大会上推出了 Spark,作为你全天候运行的个人 AI agent,在你的指导下代表你采取行动。此次模型更新使 Spark 在知识工作方面更加高效,改进了对 Google Workspace 应用的工具使用,为复杂的多技能工作流提供更高的准确性和输出质量。

借助 3.7 Flash,Gemini Spark 可以通过整合文件、起草电子邮件和更新状态文档,更高效地将想法转化为行动。

我们持续努力改进 Frontier Safety 安全防护的覆盖范围和稳健性。Gemini 3.7 Flash 随附 更多信息,请参阅 3.7 Flash 模型卡。