Gemini 3.6 Flash的回答速度比上一代快了近一倍,现场演示时,台下爆发出零星的掌声。谷歌DeepMind团队在7月21日的发布会上没有太多寒暄,直接亮出了三款新模型。
三款新模型齐发
第一款是Gemini 3.6 Flash,谷歌称之为"性能最强的Flash系列模型"。它在多项基准测试中超越了前代Gemini 3.5 Pro,推理能力、代码生成和多模态理解都有明显提升。对于普通开发者和企业用户来说,这意味着更快的响应速度和更精准的输出质量。
第二款模型Gemini 3.5 Flash Cyber定位特殊。它专门服务于网络安全场景,能够自主发现软件漏洞、分析攻击面。谷歌在V8引擎(Chrome和Node.js使用的JavaScript引擎)中进行了实测,结果令人震惊。Cyber模型发现了55个安全问题,其中10个是前所未见的新型漏洞。这款模型目前仅向政府机构和经过严格审核的可信合作伙伴开放。
第三款是Gemini 3.5 Flash-Lite,面向AI Agent场景。它的参数量更小,推理成本更低,适合部署在需要高频调用的代理系统中。谷歌希望这款模型能够成为开发者构建自动化工作流的首选底座。
全线降价17%
新模型的另一个亮点是性价比。三款模型的Token消耗平均减少了17%,直接拉低了调用成本。在AI行业价格战白热化的当下,谷歌这一动作给竞争对手施加了不小的压力。
对于中型企业来说,模型成本的降低意味着AI功能可以更大范围地嵌入到现有产品中。过去因为推理费用过高而被搁置的应用场景,现在有了落地的可能。高性价比策略正在加速AI在各行各业的渗透。
谷歌还同步更新了API调用规则,降低了免费额度的使用门槛。新用户可以在不付费的情况下体验更长时间的模型能力,这被认为是为了争夺开发者生态的主动权。
多面受敌的谷歌
谷歌在AI赛道的处境并不轻松。前方有Anthropic的Claude系列和OpenAI的GPT系列持续迭代,它们在高端推理任务上占据优势。后方有月之暗面Kimi K3的强势崛起,在长文本理解和中文场景中表现抢眼。Meta的开源模型Llama家族也在不断蚕食市场份额。
尽管压力重重,谷歌的差异化路径正在变得清晰。通过细分市场推出专用模型——面向通用场景的Flash、面向安全的Cyber、面向Agent的Lite——谷歌试图用产品矩阵覆盖更多客户需求,在每一个细分战场上都有一款能打的模型。
Gemini 4已在路上
发布会的压轴信息来自谷歌DeepMind的负责人。他透露,下一代旗舰模型Gemini 4已经进入预训练阶段。这意味着谷歌的研发节奏正在加快,新一代模型的参数规模和多模态能力将迎来又一次跃升。
行业分析师认为,Gemini 4的预训练时间点比预期提前了至少一个季度。谷歌显然希望在下一代模型竞赛中抢占先机。过去半年里,GPT-5系列的持续进化让谷歌感受到了紧迫感,加快迭代速度是唯一的应对策略。
从Gemini 3.6 Flash到未来的Gemini 4,谷歌正试图向市场传递一个信号——在AI这场马拉松里,它绝不会掉队。
来源:IT之家