谷歌发布Gemini 3.7 Flash:9项基准超Claude与GPT,代码能力登顶
作者: CBINEWS
责任编辑: 邹大斌
来源: 电脑商情在线
时间: 2026-08-14 13:03
谷歌今日正式发布Gemini 3.7 Flash,这是该公司迄今最强大的入门级AI模型。值得注意的是,它距上一代Gemini 3.6 Flash发布仅三周,但谷歌工程师仍实现了显著的输出质量提升。谷歌表示,Gemini 3.7 Flash在九项基准测试中均超越了Anthropic和OpenAI的同类模型。
其中一项让该模型拔得头筹的评测是FrontierCode 1.1 Main编程基准。它包含100个覆盖多种编程语言的任务,要求模型不仅能产出可运行的代码,还要满足企业软件项目中常见的其他要求——代码在提交前必须通过Bug测试,并遵循项目专属的代码风格指南。
与上一代相比,Gemini 3.7在生成用户界面方面尤为擅长。谷歌称,该模型设计的布局更贴合用户上传的参考图片。Gemini 3.7 Flash单次提示可处理多达100万token的图像、视频与文本,响应最多可包含64000 token的文本。
"Gemini 3.7 Flash带来了比3.6 Flash明显更出色的开发者体验。"谷歌产品管理高级总监图尔西·多希在博客中写道,"它能更好地应对障碍,在需要时澄清意图,并以更高的保真度遵循指令。它会更勤勉地思考,在多步规划和工具调用上投入更多努力。"
除编程外,该模型在其他任务上同样表现出色。在要求神经网络回答商业文档问题的GDP.pdf基准测试中,Gemini 3.7 Flash答对了34%的问题,分别领先Claude Sonnet 5和GPT-5.6 Terra达6个百分点和9.3个百分点。谷歌还表示,Gemini 3.7 Flash可以支撑AI智能体组合运行。
谷歌未公布该模型的架构细节。其模型卡显示,Gemini 3.7 Flash与上一代3.6 Flash基于相同架构,而后者源自采用Transformer混合专家架构的Gemini 3 Pro。定价方面,谷歌将允许开发者以Gemini 3.6 Flash一半的价格接入Gemini 3.7 Flash,优惠持续到今年年底。同时,该模型也将进入今年3月推出的消费级AI智能体Gemini Spark,使其能够浏览网页并在谷歌其他服务中执行操作。
