谷歌推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新 AI 模型,主打速度与成本效率,服务 AI 智能体开发。与此同时,旗舰模型 Gemini 3.5 Pro 因性能未达内部目标而持续延迟,官方未给出新的发布时间表。
谷歌周二推出三款新 AI 模型——Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber,强调速度和成本效率,面向构建 AI 智能体的开发者。与此同时,备受期待的旗舰模型 Gemini 3.5 Pro 在最初承诺的发布日期过去数月后仍不可用。

谷歌在博客文章中表示,这些新模型是专用工具而非通用旗舰。Gemini 3.6 Flash 被描述为一款“工作马”模型,在编程、知识工作和多模态任务上优于前代,其输出 token 使用量比 3.5 Flash 减少多达 17%。
Gemini 3.5 Flash-Lite 每秒可输出 350 个 token,是谷歌最快的 3.5 级别模型,适用于成本至上的高负载场景。而 3.5 Flash Cyber 是一款网络安全专用模型,搭配谷歌的代码安全智能体 CodeMender,用于识别和修复软件漏洞。与前两款不同,Flash Cyber 初期仅向政府和可信合作伙伴开放。
3.6 Flash 和 3.5 Flash-Lite 即日起通过 Gemini API 在 Google AI Studio、Gemini Enterprise Agent Platform 和消费者端 Gemini 应用中可用。
新模型的发布正值 Gemini 3.5 Pro 长期延迟的背景。谷歌 CEO 桑达尔·皮查伊曾在 5 月的 I/O 大会前向记者表示该模型“将于下月面向所有人推出”,指向 6 月发布,但最终未兑现。
据彭博社报道,延迟源于模型未达到内部目标,尤其在编程性能方面。谷歌在给 9to5Google 的声明中承认正在“与合作伙伴测试 3.5 Pro、升级版 Flash 模型及其他模型”,并“积极推进与美国政府在模型测试和更广泛框架方面的合作”。在周二的博文中,谷歌未给出新时间表,仅表示“准备好后会尽快广泛提供”。
策略清晰:当竞争对手推出越来越大的模型时,谷歌正用针对性强、效率更高的替代方案填补空白。谷歌 Gemini 产品管理高级总监 Tulsee Doshi 将新发布定义为运行 AI 智能体的“效率与能力的甜区”。这种定位能否让等待 Pro 模型 200 万 token 上下文窗口和深度推理能力的开发者满意,仍是未知数。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断