Gemini 3.5 Pro延期,谷歌先推两款轻量模型
2026/07/22 09:36阅读量 3
谷歌于7月21日突击发布Gemini 3.6 Flash和Gemini 3.5 Flash-Lite,分别强化Agent能力和低成本规模化,但旗舰模型Gemini 3.5 Pro仍缺席。新模型在速度和性价比上有所提升,综合智力与上代持平。外界关注谷歌能否保持旗舰竞争力,同时国产模型加速追赶。
事件概述
7月21日,谷歌在未预告的情况下上线两款新模型:Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite。两者均面向实际生产环境,强调更低成本、更高效率,但作为旗舰的 Gemini 3.5 Pro 仍处于延期状态,原计划6月推出,至今未公布正式上线时间。
核心信息
Gemini 3.6 Flash:更便宜、更适合 Agent
- 定位:面向 Agent 任务的高效模型,强调编码、推理和工具调用能力,同时减少输出 token 以降低成本。
- 定价:输入 1.50 美元/百万 token,输出 7.50 美元/百万 token(上一代 3.5 Flash 输出为 9 美元)。
- 性能:
- 在 DeepSWE 代码评测中得分 49%(上一代 37%)。
- OSWorld-Verified(AI 操作电脑)得分 83%(上一代 78.4%)。
- MLE Bench(机器学习任务)得分 63.9%(上一代 49.7%)。
- 综合智力(Intelligence Index)得分为 50,与上一代持平;但平均任务耗时从 2.7 分钟降至 1.3 分钟。
- 横向对比:在复杂软件工程和知识任务上仍不及 GPT-5.6 Luna、Claude Sonnet 5,但凭借成本优势定位“够用”市场。
Gemini 3.5 Flash-Lite:最快、最轻量
- 定位:Flash 系列中的轻量版本,牺牲部分能力上限换取极快速度与低成本。
- 定价:输入 0.30 美元/百万 token,输出 2.50 美元/百万 token(比上一代 3.1 Flash-Lite 未降价)。
- 性能:
- 生成速度约 350 token/秒,平均任务耗时从 1.6 分钟降至 0.6 分钟。
- 支持 Computer Use 能力,可操作电脑环境。
- Terminal-Bench 2.1 得分 54%(上一代 31%);GDM-MRCR v2 长上下文理解 72.2%(上一代 60.1%)。
- 在 SWE-Bench Pro 和 OSWorld-Verified 上超过早期更大的 Gemini 3 Flash,体现能力下沉。
网络安全专用模型 Gemini 3.5 Flash Cyber
- 仅通过 CodeMender 平台向政府及可信合作伙伴开放,不在公开 API 中提供。
值得关注:旗舰模型迟到,市场竞争加剧
- Gemini 3.5 Pro 延迟:原定 6 月上线,据彭博社报道已落后计划数月,谷歌仍在优化编码能力。路透社称其在与合作伙伴测试中,具体时间未定,且 Gemini 4 训练已启动。
- 市场反应:华尔街视 3.5 Pro 为判断 Google DeepMind 能否跟上 OpenAI 和 Anthropic 的关键指标。谷歌 CEO Sundar Pichai 多次强调成本优势,但旗舰模型缺席让市场质疑其竞争力。
- 竞争格局:除国外御三家外,GLM-5.2、Kimi K3 等国产模型已进入前沿竞争,进一步压缩谷歌的喘息空间。
