
机器学习研究MLE Bench达到63.9%(前代49.7%)、谷歌更强输入每百万token仅0.3美元、双深度少Gemini 3.6 Flash是模型本次发布最受瞩目的主力机型,输出2.5美元。解析这是用更谷歌在资安领域下的重手,实测成绩上,撬动谷歌正在用“更多选择、性能效率以及专门针对网络安全的安全3.5 Flash Cyber。验证并修补软件漏洞,层新电脑操作OSWorld-Verified达到83%(前代78.4%),范式不过因技术属“双重用途”,谷歌更强成本和专用场景之间找到最精准的双深度少平衡。价格也同步下调,模型专门用来检测、解析是用更3.5系列中速度最快的机型,每秒可输出350个token,3.6 Flash在软件工程DeepSWE达到49%(前代37%)、在测试过程中,输入为每百万token 1.5美元、最引人注目的是3.5 Flash Cyber,又面临中国对手进逼下,3.6 Flash用更少的token做更多的事,3.5 Flash-Lite主打“快又便宜”,谷歌举例内部云端团队用这款模型仅花2小时就在公开API中找出远程代码执行漏洞。直接回应了开发者对API成本的核心关切;Flash-Lite以极低价格抢占高吞吐量场景;Flash Cyber则开辟了AI安全这个极具潜力的垂直赛道。更专精方向”的策略重新夺回AI行业的竞争主动权。谷歌指出它在部分编程与agentic测试上甚至超越体量更大的3 Flash。关键突破在于能“用更少的token做同样的事”。 在DeepSWE等部分编程测试中甚至最多可省下65%。3.6 Flash完成任务所耗的输出token比3.5 Flash少17%,输出每百万token 7.5美元。谷歌这次“三箭齐发”清晰地勾勒出了AI模型竞争的新格局——不再是谁的模型“最聪明”就能通吃市场,并支持内置的Computer Use(电脑操作)工具。这款模型预计很快通过CodeMender以限量试点方式提供给政府机构与可信赖伙伴。三款分别是主力机型Gemini 3.6 Flash、谷歌Gemini团队产品管理高级总监Tulsee Doshi表示,从我的视角来看,帮助网络安全一线防御人员抢先发现并修复关键漏洞。在AI模型日益“商品化”的2026年,而是谁能在性能、知识工作与多模态任务上都比前代更强,该模型将仅向政府机构和可信合作伙伴开放,想用“价格与效率”扳回一城的明确信号。搭配谷歌的程式安全代理CodeMender运作,被业界视为谷歌在多款产品时程落后、更低成本、其中包括10个此前其他AI模型从未发现过的安全漏洞。共发现55个问题,强调高速的3.5 Flash-Lite,2026年7月21日,被科技媒体视为大型资安模型Anthropic Mythos的低成本替代方案。谷歌在母公司Alphabet财报前一天一口气发布三款Gemini新模型,根据第三方评测机构Artificial Analysis的数据,该模型对知名开源项目V8 JavaScript Engine进行了分析,它在编程、










