谷歌发布三款Gemini新模型,3.6 Flash性能提升17%token效率
近日,谷歌在其AI产品矩阵中再添三款重量级新品:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber。这三款模型的发布不仅丰富了谷...
近日,谷歌在其AI产品矩阵中再添三款重量级新品:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber。这三款模型的发布不仅丰富了谷歌的AI工具组合,更在多个关键维度实现了显著突破。
作为本次发布的主力通用模型,Gemini 3.6 Flash在前代基础上进行了全面升级。据谷歌官方数据显示,该模型在token使用效率上实现了17%的显著优化,部分复杂任务场景甚至可达到65%的降幅。这意味着在完成多步骤任务时,3.6 Flash所需的推理与工具调用次数大幅减少,从而提升了整体处理效率。在代码编写、多模态处理、知识类任务等基准测试中,3.6 Flash的表现全面提升,特别是在长周期软件工程(DeepSWE V1.1)测试中,其表现较3.1 Pro提升了49%。
针对不同应用场景,谷歌还推出了两款定位明确的模型。Gemini 3.5 Flash-Lite是一款轻量化高吞吐解决方案,输出速度可达每秒350 token,是3.5系列中速度最快的版本。它在多项智能体、代码评测指标上优于初代Gemini 3 Flash,特别适合大批量文档处理、大规模智能体检索等低延迟高负载业务场景。值得注意的是,这款模型将computer use作为内置工具,进一步增强了其在实际应用中的灵活性。
在网络安全领域,谷歌推出了专门优化的Gemini 3.5 Flash Cyber。这款模型基于3.5 Flash底座微调优化,并配套CodeMender代码安全智能体,擅长识别、验证与修复代码漏洞。根据测试数据,该模型在知名开源项目V8 JavaScript Engine的分析中,共发现55个问题,其中包括10个此前其他AI模型从未发现的安全漏洞。鉴于网络安全领域的特殊性,谷歌决定采取试点准入策略,仅面向政府机构与可信合作伙伴开放使用。
在发布会上,谷歌还透露了其前沿模型的开发进展。旗舰模型Gemini 3.5 Pro目前仍处于合作伙伴内测阶段,预计将在测试完成后逐步对外开放。同时,研发团队已启动规模空前的Gemini 4预训练工作,进展令人振奋。谷歌表示,这些新产品的推出旨在实现效率与性能的最佳平衡,以应对日益激烈的AI市场竞争。
当前,谷歌的Gemini系列模型已在编程、金融等多个任务中表现出色,但面对Anthropic、OpenAI等竞争对手推出的先进模型,以及中国初创公司月之暗面(Moonshot AI)等新兴力量的挑战,谷歌需要持续创新以保持行业领先地位。