谷歌发布三款轻量化Gemini模型

谷歌正式上线三款轻量化Gemini迭代模型,包括3.6 Flash3.5 Flash-Lite以及3.5 Flash Cyber,并同步开放全球商用API调用。这三款模型采取分层组合方案,旨在精准覆盖企业的轻量化AI落地需求。

  • Gemini 3.6 Flash:定位为主力通用模型,负责复杂多步骤逻辑推理、工程代码开发及多模态图文视频处理等核心业务。
  • Gemini 3.5 Flash-Lite:主打超高并发与低延迟的批量数据处理,适配高频客户问答流水线及海量表单筛查等标准化任务。其百万输入Token定价为0.3美元,输出Token为2.5美元。
  • Gemini 3.5 Flash Cyber:垂直深耕系统安全合规校验与代码漏洞检测,旨在补齐企业AI应用的安全防护短板。该模型目前面向政府机构和信任伙伴进行封闭试点。

性能提升与成本优化

根据谷歌公开的DeepSWE v1.1软件工程专项评测数据,Gemini 3.6 Flash的得分达到49%,高于前代3.5 Flash的37%。同时,该模型在输出冗余Token方面整体缩减了17%。结合官方定价下调,企业常规业务落地的综合成本降幅稳定在30%左右。

旗舰模型Gemini 3.5 Pro延期

尽管轻量化模型已上线,但此前在2026年5月Google I/O大会上预告、原定于6月底上线的旗舰模型Gemini 3.5 Pro至今未能如期发布。该模型主打企业级超长文档解析、超高精度复杂逻辑推理及复杂多模态融合处理能力。

据科技媒体The Information爆料,延期原因是该模型在复杂业务逻辑推理、代码生成及企业行业场景适配等关键能力上未通过谷歌内部的商用标准,目前仍处于紧急迭代阶段。

行业竞争与外部评价

在竞争环境下,Meta首席AI官Alexandr Wang在社交平台X上针对谷歌发表了“gemini who?”的挑衅言论。此前有数据表明,Meta的Muse Spark 1.1在推理能力、代码生成及Agent任务执行等部分关键能力测试中超过了Gemini 3.6 Flash。