谷歌一次性推出三款全新 Gemini 大模型,完善 Flash 产品线布局,分别为 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 与面向安全场景的 Gemini 3.5 Flash Cyber。本轮发布不再单纯比拼性能上限,全面聚焦 AI Agent 落地最核心的延迟、效率与使用成本,瞄准企业生产级智能体大规模部署需求。
其中 Gemini 3.6 Flash 正式接过主力大旗。作为 Gemini 3.5 Flash 迭代版本,模型强化编程、知识推理与多模态能力,Token 利用率实现优化。测试数据显示,面对复杂多步骤任务,该模型输出 Token 量平均下降 17%,工具调用频次随之减少,有效压低 Agent 整体运行开销。定价同步下调,输入每百万 Token 1.5 美元,输出 7.5 美元。在代码相关基准测试中,新模型减少无效代码迭代,同时升级 CBRN、网络攻击相关安全防护,抵御越狱能力进一步增强。
面向高并发场景,谷歌带来轻量化 Gemini 3.5 Flash-Lite,主打极致吞吐量,输出速度可达每秒 350 Token,适配文档批量处理、智能检索等高频调用业务。价格下探至输入 0.3 美元 / 百万 Token、输出 2.5 美元 / 百万 Token,支持灵活调节推理深度,并且原生搭载 Computer Use 能力,便于打造跨终端自动化 Agent。
垂直赛道方面,Gemini 3.5 Flash Cyber 针对性微调,聚焦漏洞挖掘、验证与自动修复,为网络安全运维提供低成本 AI 方案。目前 Gemini 3.6 Flash、3.5 Flash-Lite 已登陆 API、AI Studio、Android Studio 以及企业 Agent 平台,并陆续嵌入谷歌搜索、Gemini 终端应用。
除此之外,谷歌释放两条重磅长线消息:Gemini 3.5 Pro 仍处在合作伙伴内测阶段;同时正式启动规模空前的 Gemini 4 预训练。
随着各大厂商加速抢占 AI Agent 市场,谷歌本轮差异化产品矩阵布局,意在凭借分层定价与场景化模型,抢夺企业开发者市场,新一轮大模型落地竞争已然升温。