Gemini 3.5 Pro延期,谷歌先推两款轻量模型

2026/07/22 09:36阅读量 3

谷歌于7月21日突击发布Gemini 3.6 Flash和Gemini 3.5 Flash-Lite,分别强化Agent能力和低成本规模化,但旗舰模型Gemini 3.5 Pro仍缺席。新模型在速度和性价比上有所提升,综合智力与上代持平。外界关注谷歌能否保持旗舰竞争力,同时国产模型加速追赶。

事件概述

7月21日,谷歌在未预告的情况下上线两款新模型:Gemini 3.6 FlashGemini 3.5 Flash-Lite。两者均面向实际生产环境,强调更低成本、更高效率,但作为旗舰的 Gemini 3.5 Pro 仍处于延期状态,原计划6月推出,至今未公布正式上线时间。

核心信息

Gemini 3.6 Flash:更便宜、更适合 Agent

  • 定位:面向 Agent 任务的高效模型,强调编码、推理和工具调用能力,同时减少输出 token 以降低成本。
  • 定价:输入 1.50 美元/百万 token,输出 7.50 美元/百万 token(上一代 3.5 Flash 输出为 9 美元)。
  • 性能
    • 在 DeepSWE 代码评测中得分 49%(上一代 37%)。
    • OSWorld-Verified(AI 操作电脑)得分 83%(上一代 78.4%)。
    • MLE Bench(机器学习任务)得分 63.9%(上一代 49.7%)。
    • 综合智力(Intelligence Index)得分为 50,与上一代持平;但平均任务耗时从 2.7 分钟降至 1.3 分钟。
  • 横向对比:在复杂软件工程和知识任务上仍不及 GPT-5.6 Luna、Claude Sonnet 5,但凭借成本优势定位“够用”市场。

Gemini 3.5 Flash-Lite:最快、最轻量

  • 定位:Flash 系列中的轻量版本,牺牲部分能力上限换取极快速度与低成本。
  • 定价:输入 0.30 美元/百万 token,输出 2.50 美元/百万 token(比上一代 3.1 Flash-Lite 未降价)。
  • 性能
    • 生成速度约 350 token/秒,平均任务耗时从 1.6 分钟降至 0.6 分钟。
    • 支持 Computer Use 能力,可操作电脑环境。
    • Terminal-Bench 2.1 得分 54%(上一代 31%);GDM-MRCR v2 长上下文理解 72.2%(上一代 60.1%)。
    • 在 SWE-Bench Pro 和 OSWorld-Verified 上超过早期更大的 Gemini 3 Flash,体现能力下沉。

网络安全专用模型 Gemini 3.5 Flash Cyber

  • 仅通过 CodeMender 平台向政府及可信合作伙伴开放,不在公开 API 中提供。

值得关注:旗舰模型迟到,市场竞争加剧

  • Gemini 3.5 Pro 延迟:原定 6 月上线,据彭博社报道已落后计划数月,谷歌仍在优化编码能力。路透社称其在与合作伙伴测试中,具体时间未定,且 Gemini 4 训练已启动。
  • 市场反应:华尔街视 3.5 Pro 为判断 Google DeepMind 能否跟上 OpenAI 和 Anthropic 的关键指标。谷歌 CEO Sundar Pichai 多次强调成本优势,但旗舰模型缺席让市场质疑其竞争力。
  • 竞争格局:除国外御三家外,GLM-5.2、Kimi K3 等国产模型已进入前沿竞争,进一步压缩谷歌的喘息空间。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。