2026-08-17 08:47:38
icon loading...

谷歌在上一个Gemini模型发布仅三周后,又推出新模型——价格减半

摘要
谷歌Gemini模型发布节奏惊人:每三周一次重大升级,性能提升显著本次发布内容8月13日,谷歌发布了Gemini 3.7 Flash,该公司称其为“迄今最智能的编码与智能体工作模型”。此次升级距离Gemini 3.6 Flash仅隔三周,谷歌将其定位为开发者反馈的直接产物,而非从零开始的基础模型——它是对3.6架构的优

谷歌Gemini模型发布节奏惊人:每三周一次重大升级,性能提升显著

本次发布内容

8月13日,谷歌发布了Gemini 3.7 Flash,该公司称其为“迄今最智能的编码与智能体工作模型”。此次升级距离Gemini 3.6 Flash仅隔三周,谷歌将其定位为开发者反馈的直接产物,而非从零开始的基础模型——它是对3.6架构的优化,而非全新版本。

编码能力的提升成为亮点:在FrontierCode 1.1主要基准测试中,得分从34.4%跃升至43.6%;在DeepSWE v1.1测试中,从49.0%提升至65.3%。在Arena.ai的WebDev Arena基准测试中(该测试基于匿名众包用户偏好投票,而非谷歌自有测试),其Elo评分从1538升至1588。谷歌还表示,该模型在处理真实商业工作流方面效率显著提升,AutomationBench得分从17.0%攀升至30.4%。

降价是另一半故事

在性能提升的同时,谷歌设定了截至2026年底的入门价格:每百万输入token 0.75美元,每百万输出token 3.75美元——仅为3.6 Flash发布时价格的一半。对于在Gemini API上构建产品的开发者来说,更好的基准表现与更低成本相结合,比单一变化更具意义,因为这直接改善了模型在生产环境中的每任务成本效益。

据谷歌DeepMind自身报告,该模型在多个不那么引人注目但实际重要的指标上也有所提升:在知识密集型文档处理基准测试GDP.pdf上表现更佳,在Legal Agent Bench上得分提高2.6分。它支持文本、图像、音频和视频输入,上下文窗口为100万token,并最多返回64,000个输出token,与上一代保持一致。

驱动谷歌后台智能体

Gemini 3.7 Flash立即成为Gemini Spark的运行模型。Gemini Spark是谷歌为160多个国家的Pro和Ultra订阅用户提供的全天候个人AI智能体。Spark旨在持续在后台处理任务——合并文件、起草邮件、更新状态文档——无需每次等待用户提示。谷歌表示,此次升级专门提升了Spark在Google Workspace应用中的工具使用能力,以应对复杂、多技能的工作流。

悬而未决的问题:Gemini 3.5 Pro何在?

此次发布伴随着一个显著的缺失:谷歌旗舰模型Gemini 3.5 Pro——Flash系列的更大版本——仍未推出,尽管该公司在7月表示正在与合作伙伴测试,并将很快推出。有媒体指出,尽管Flash系列模型在基准测试中表现强劲,但谷歌在真正的技术前沿仍落后于Anthropic和OpenAI。这一差距至关重要,因为Flash模型无论多强大,都侧重于速度和成本效率,而非最大原始能力——竞争对手真正密切关注的是高端对比。

发布时间点值得注意,因为谷歌Gemini应用月活跃用户刚刚突破10亿。一个快速、廉价、高效的工作模型是服务如此大规模用户群的合理方式,同时旗舰Pro模型仍在测试中——但这意味着谷歌2026年的主要能力故事仍不完整。

下一步关注点

真正的考验将是Gemini 3.5 Pro最终能否推出,以及推出后与Anthropic和OpenAI顶级产品的对比。在此之前,谷歌每隔几周快速迭代Flash版本的策略,是保持成本与日常可用性竞争力的可靠方式,尽管决定技术前沿对比的旗舰模型尚未确定发布日期。

声明:文章不代表币圈网观点及立场,不构成本平台任何投资建议。投资决策需建立在独立思考之上,本文内容仅供参考,风险自担!转载请注明出处!侵权必究!
币圈快讯
查看更多
回顶部