返回信息流
新闻事件
B标准59
Google DeepMind (X)
1 个来源

Gemini 3.5 Flash-Lite 发布:快速、经济的模型

谷歌发布了 Gemini 3.5 Flash-Lite,这是一款快速且成本效益高的模型,专为重复性任务(如分类工单和数据提取)设计。它在许多智能体和编码基准测试中表现优于 3 Flash,并已在 Gemini App、Google 搜索以及通过 API 在 Google AI Studio 和 Android Studio 中推出。

SynthePulse Insight · AI 深度解读

Google 发布 Gemini 3.5 Flash-Lite:为高频重复任务优化的低成本模型

版本 1 · 1 个来源

Google DeepMind 推出 Gemini 3.5 Flash-Lite,定位为快速、经济高效的模型,专为票务分类、数据提取等重复性用例设计,并已在 Gemini App 和 Google 搜索中上线。

  • Google DeepMind 于 2026 年 7 月 21 日发布 Gemini 3.5 Flash-Lite,主打快速和低成本。
  • 该模型针对票务分类、数据提取等高频重复任务进行了优化。
  • 据称在多项智能体和编码基准测试中表现优于 Gemini 3 Flash。
  • 已在 Gemini App 和 Google 搜索中推出,API 可通过 Google AI Studio 和 Android Studio 访问。
展开章节目录产品定位与目标用例

产品定位与目标用例

Gemini 3.5 Flash-Lite 被描述为“快速、经济高效的模型”,专门用于扩展重复性用例,例如票务分类和数据提取。这表明 Google 正瞄准企业级自动化场景,强调吞吐量和成本效益。

该模型与 Gemini 3.5 Flash 进行了对比演示,但具体性能指标(如延迟、吞吐量)未在公告中披露。

性能声称与基准测试

Google DeepMind 声称,Gemini 3.5 Flash-Lite 在“许多智能体和编码基准测试”中甚至优于 Gemini 3 Flash。这一说法来自官方 X 帖子,但未提供具体基准名称或分数。

值得注意的是,该比较对象是上一代 Gemini 3 Flash,而非同代的 3.5 Flash,暗示 Lite 版本可能在特定任务上牺牲了部分通用能力以换取速度和成本优势。

部署与可用性

Gemini 3.5 Flash-Lite 正在 Gemini App 和 Google 搜索中逐步推出,同时通过 Google AI Studio 和 Android Studio 提供 API 访问。这延续了 Google 将模型直接集成到消费者和企业产品中的策略。

公告未提及定价细节或区域限制,但“成本效益”的表述暗示其定价将低于标准版 3.5 Flash。

可信度边界

所有信息均来自 Google DeepMind 的官方 X 帖子,属于第一方发布。性能声称(优于 Gemini 3 Flash)为官方表述,但缺乏独立验证和具体数据。

核心结论

Gemini 3.5 Flash-Lite 是 Google 在低成本、高吞吐量模型领域的最新尝试,直接对标重复性企业任务。其声称的性能优势需等待第三方基准测试验证,但快速部署到主流产品表明 Google 对其信心较强。

主报道

Google DeepMind (X)

主报道来源