谷歌扩充Gemini模型矩阵:推出多款平价新品,正面对标Mythos模型

核心要点 Gemini 3.5 Flash Cyber 主打软件漏洞挖掘与修复功能,初期仅向各国政府及可信合作方开放。 Gemini 3.6 Flash 令牌消耗量最高可降低 17%,单位令牌成本进一步下降;Flash-Lite 面向高并发、轻量化任务场景。 本次新品发布恰逢 Alphabet 财报披露前一日。面对中国竞品快速崛起,谷歌正加快 AI 模型迭代...

核心要点 Gemini 3.5 Flash Cyber 主打软件漏洞挖掘与修复功能,初期仅向各国政府及可信合作方开放。 Gemini 3.6 Flash 令牌消耗量最高可降低 17%,单位令牌成本进一步下降;Flash-Lite 面向高并发、轻量化任务场景。 本次新品发布恰逢 Alphabet 财报披露前一日。面对中国竞品快速崛起,谷歌正加快 AI 模型迭代节奏,提升发布效率与规模化落地能力。 ’ Alphabet 于周二发布三款全新 Gemini 大模型。其中一款产品直面 Anthropic 的优势赛道网络安全领域,也是谷歌迄今为止针对该赛道最有力的竞品方案。近期谷歌 AI 产品线多次延期、行业竞争持续加剧,谷歌希望借助新品展现研发管线进展。 Gemini 3.5 Flash Cyber专为检测、自动修补软件漏洞打造,将通过受限试点计划上线,初期仅面向政府机构与可信合作伙伴开放。谷歌表示,这款专用模型的单位令牌运行成本低于大型通用模型。 借助该产品,谷歌有望缩小与 Anthropic 在自动化代码防御领域的差距 ——Anthropic 此前在这条赛道抢占先发优势,旗下Mythos是业内知名网络安全专用大模型。 同时谷歌推出Gemini 3.6 Flash,编码、多模态、知识类任务性能实现升级;相较前代模型,令牌消耗量最高减少 17%,单位令牌成本更低,可以显著降低大规模算力任务的运行开支。 另一款新品Gemini 3.5 Flash-Lite,是 3.5 系列中速度最快、定价最低的模型,面向海量高并发负载,适用于大型 AI 智能体系统内部的轻量化子任务。 完整的新品矩阵体现谷歌战略思路:依靠更低定价、更高运行效率,弥补多款核心产品发布节奏滞后的短板。 人工智能数据分析机构 Artificial Analysis 数据显示,Gemini Flash 系列当前定价已经低于 Anthropic、OpenAI 以及中国竞品的同类模型。谷歌称,两款新模型中性能更强的 Gemini 3.6 Flash,完成单次任务成本低于 GPT-5.6 Terra Max、Kimi K3、通义千问 Qwen 3.7 Max;而 3.5 Flash-Lite 的成本更是远低于上述模型。 新品上线正值 Alphabet 财报前夕,同时中国本土大模型厂商攻势迅猛。月之暗面 Kimi K3 需求火爆,因算力上限限制,平台不得不暂停新用户注册与 API 接入;阿里巴巴也预热通义千问 Qwen 3.8 Max,宣称综合性能仅次于 Anthropic Fable 5。 火热的市场需求折射出 AI 竞赛的另一面:打造具备竞争力的模型只是挑战之一,企业还需要充足算力支撑大规模对外服务。 谷歌拥有自研芯片、云基础设施,具备软硬件协同设计优势,但自身同样面临算力资源紧张问题。 另有消息称,谷歌正在研发一款专用 AI 芯片,目标将 Gemini 模型运行效率提升最高 10 倍,是谷歌降低 AI 推理成本整体战略的一环。 谷歌云发言人向 回应:“团队持续开展创新研发,力求为客户实现最优性能与运行效率。并非所有研发项目最终都会落地量产,但深度探索是我们全栈技术路线的核心。 通过软硬件原生协同设计,我们能够打造高度适配真实业务负载的一体化系统。” 此前多款产品延期引发市场质疑,谷歌如今进一步公开技术路线规划:Gemini 3.5 Pro 正在合作伙伴内测,后续将全面开放;同时谷歌启动规模空前的 Gemini 4 预训练工程。

查看原文