返回信息流
新闻事件
少数派
3 个来源

Google 发布 Gemini 3.6 Flash 等三款新模型

Google 于 7 月 21 日发布 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber 三款模型,重点提升 AI 智能体的效率、延迟和可靠性。Gemini 3.6 Flash 在编程和计算机操作基准测试中表现优于前代,并降低了 API 价格。同时发布的 Gemini 3.5 Flash-Lite 面向高吞吐量任务,Gemini 3.5 Flash Cyber 则针对网络安全优化。

SynthePulse Insight · AI 深度解读

谷歌连发三款Flash模型:降本增效,但旗舰缺席

版本 1 · 3 个来源

在旗舰模型Gemini 3.5 Pro迟迟未至、Gemini 4尚在预训练的背景下,谷歌于2026年7月21日发布三款Flash系列模型,主打更低成本和更高效率,但迭代速度引发市场担忧。

  • 谷歌发布Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber三款模型,均面向智能体场景优化效率与成本。
  • Gemini 3.6 Flash输出token用量平均减少17%,API输出价格从9美元/百万token降至7.50美元。
  • Gemini 3.5 Flash-Lite速度达每秒350 token,输入价格仅0.30美元/百万token,适合高吞吐量任务。
  • Gemini 3.5 Flash Cyber专攻软件漏洞发现与修复,通过CodeMender向政府等机构限量测试。
  • Gemini 3.5 Pro仍在测试,Gemini 4已开始预训练,但谷歌模型迭代速度被指慢于同行。
展开章节目录三款Flash模型齐发:效率与成本双降

三款Flash模型齐发:效率与成本双降

2026年7月21日,谷歌发布Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber三款模型,全部属于主打“快速、低成本”的Flash系列。其中,Gemini 3.6 Flash是3.5 Flash的后继型号,面向编程、知识工作和多模态任务,输出token用量平均减少17%,完成多步骤任务时所需的推理步骤和工具调用次数也有所下降。API输入价格为每100万token 1.50美元,输出价格由上一代的9美元降至7.50美元。

Gemini 3.5 Flash-Lite面向智能体搜索、文档处理等高吞吐量任务,速度可达每秒输出350 token,API输入和输出价格分别为每100万token 0.30美元和2.50美元。Gemini 3.5 Flash Cyber则针对软件漏洞的发现、验证和修复进行优化,将首先通过CodeMender向政府机构和受信任合作伙伴提供限量测试。

性能提升有限,旗舰模型缺席

谷歌公布的测试结果显示,Gemini 3.6 Flash在编程基准DeepSWE中取得49%的成绩,高于Gemini 3.5 Flash的37%;OSWorld-Verified计算机操作测试成绩由78.4%提升至83.0%。但第三方观察指出,新模型“在各个评分上都上涨了一点,不过涨得不多”。

值得注意的是,此前传闻的旗舰模型Gemini 3.5 Pro并未随此次发布亮相。谷歌表示,Gemini 3.5 Pro仍在与合作伙伴测试,而下一代Gemini 4已开始预训练,据称是“有史以来最大规模的训练”。然而,有评论认为,谷歌的模型迭代速度“在一众两三个月、甚至一个月一版的模型面前,感觉确实有点太慢了”。

市场反应与战略意图

在Alphabet发布财报前一天,谷歌选择连发三款Flash模型,但市场反应冷淡。有报道称,谷歌市值一夜蒸发2000亿美元,尽管这一数字可能受多重因素影响。谷歌此次聚焦Flash系列,意在通过降本增效巩固智能体应用场景,但旗舰模型的缺席和迭代节奏的滞后,使其在竞争中面临压力。

可信度边界

本文基于少数派、AI前线及X平台用户歸藏(guizang.ai)的报道。其中,模型性能数据来自谷歌官方公布,市值蒸发数据来自AI前线报道,迭代速度评论来自第三方观察,均标注为来源声明或推断。

核心结论

谷歌以三款Flash模型回应市场对效率和成本的需求,但旗舰模型的缺失和迭代速度的滞后,使其在AI竞赛中面临不确定性。