谷歌发布三款轻量级AI模型,加速企业级应用落地

谷歌DeepMind推出三款Gemini Flash新模型,强化轻量化AI部署能力

Google DeepMind正式发布三款面向高效、低成本场景的Gemini Flash系列模型,旨在满足开发者对快速响应与经济性并重的AI智能体需求。尽管备受期待的旗舰型号Gemini 3.5 Pro仍处合作伙伴测试阶段,但Flash系列已率先实现商业化可用。

三款新模型各具定位,覆盖多元应用场景

此次发布的三款模型均属于轻量级“Flash”家族,以更低延迟和更优成本比为设计核心。它们分别针对通用任务、高并发处理及专业安全分析,形成差异化产品矩阵。

通用主力:Gemini 3.6 Flash性能跃升

Gemini 3.6 Flash作为前代3.5 Flash的升级版本,成为面向多领域任务的核心模型。其在文本生成效率上实现显著优化,最大可减少17%的输出token数量,同时在代码生成与逻辑推理方面表现更佳。定价为每百万输入token 1.50美元,输出则为7.50美元。据Hebbia与Harvey等客户反馈,该模型在文档解析、图表理解与报告自动生成任务中展现出卓越适应性。

高并发利器:Gemini 3.5 Flash-Lite成本最优

专为大规模并行请求设计的Gemini 3.5 Flash-Lite是目前最经济的选项,每百万输入token仅需0.30美元,输出端为2.50美元。其每秒可生成高达350个token,适用于需要极致性价比的实时交互系统。该模型现已集成至谷歌开发者平台及各类应用生态中。

安全先锋:Gemini 3.5 Flash Cyber专注漏洞挖掘

面向网络安全领域的专用模型Gemini 3.5 Flash Cyber,依托CodeMender工具链进行深度代码扫描。在对V8 JavaScript引擎的实测中,成功识别出55个已确认漏洞,超越Gemini 3.5 Flash的47个与Anthropic Claude Opus 4.6的36个。该模型目前不对外公开,仅通过有限试点计划向政府机构与受信任合作方提供,旨在提前发现潜在攻击面,防止技术滥用。其目标直指Anthropic的高价网络安全模型Mythos。

旗舰模型迟迟未现,研发进度引发关注

原定六月推出的旗舰版Gemini 3.5 Pro至今仍未发布。内部消息显示,该模型在编码能力方面未能达成预设指标,部分团队甚至面临重构挑战。与此同时,竞争对手OpenAI已上线GPT-5.5与部分GPT-5.6功能,Anthropic亦推出Claude Opus 4.8、Sonnet 5及Fable 5。谷歌虽称3.5 Pro正与伙伴协同测试,预计“很快”上线,但具体时间仍无明确承诺。此外,公司已启动史上规模最大的预训练项目,为下一代模型Gemini 4做准备,但尚属远期规划。

行业趋势转向:按需使用取代盲目追求“更强”

随着Grok 4.5采用任务计费模式,企业选型逻辑正在转变。当前主流不再一味追求模型的绝对智能,而是根据实际工作负载选择具备最佳性价比的专用模型。这一演进反映出大模型应用正从技术竞赛走向工程化落地,强调效率、成本与场景适配性的综合平衡。