SheepNav
新上线今天127 投票

Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 发布:效率与性能全面提升

Google 于 2026 年 7 月 21 日正式发布 Gemini 系列三款新模型:Gemini 3.6 Flash3.5 Flash-Lite3.5 Flash Cyber。这些模型旨在为开发者和企业构建生产级 AI Agent 提供更高的 token 效率、更低的延迟以及更可靠的性能。

Gemini 3.6 Flash:主力模型的全面升级

作为 3.5 Flash 的直接继任者,3.6 Flash 在编码、知识工作及多模态任务上实现了显著提升。根据 Artificial Analysis Index 的数据,其输出 token 使用量相比 3.5 Flash 减少了 17%,而在 Datacurve 的 DeepSWE 等基准测试中,token 节省幅度最高可达 65%,同时每次输出 token 的成本更低。这意味着开发者可以用更少的资源完成更多任务,尤其适合需要大量推理和代码生成的场景。

3.5 Flash-Lite:速度与成本的最优解

3.5 Flash-Lite 是 Flash 系列中速度最快、成本效益最高的模型。据 Artificial Analysis Index 统计,其每秒可处理 350 个输出 token,在 Agent 工作流中的表现显著优于上一代 Flash-Lite 模型。对于延迟敏感型应用(如实时对话、代码补全)或大规模部署场景,Lite 版本提供了极具吸引力的选择。

3.5 Flash Cyber:专为网络安全打造

3.5 Flash Cyber 与代码安全 Agent CodeMender 相结合,构成了一个针对网络安全场景的专用解决方案。该模型在保持高效的同时,在安全相关任务上达到了前沿水平,适合漏洞检测、代码审计等专业领域。

未来展望:3.5 Pro 与 Gemini 4

除了本次发布,Google 透露 Gemini 3.5 Pro 正在与合作伙伴进行测试,预计在准备就绪后广泛开放。同时,团队已启动 Gemini 4 的预训练工作,这是迄今为止规模最大的训练项目,表明 Google 在 AI 模型上的长期投入。

行业影响

此次更新延续了 Google 在 Agent 时代的战略:通过细分模型(Flash、Lite、Cyber)满足不同场景需求,同时持续提升效率与性价比。对于开发者而言,3.6 Flash 的 token 节省和 3.5 Flash-Lite 的高吞吐量将直接降低运营成本,而 Cyber 版本则填补了安全领域的专用模型空白。

延伸阅读

  1. 美国威胁制裁中国AI模型,指控知识产权盗窃
  2. 安永数据泄露:客户税务信息遭窃,如何应对?
  3. 美国悄然安装9万架Flock摄像头:它们追踪什么,如何查看你的城市
查看原文