谷歌发布三款新的 Gemini AI 模型,成本更低

Alphabet 将在周二发布三款新的 Gemini 模型,包括为网络安全设计的 Gemini 3.5 Flash Cyber。此次发布旨在展示产品管线的进展,该管线此前面临延迟以及竞争日益加剧。Gemini 3.5 Flash Cyber 将在初期仅通过有限访问的试点向政府和可信合作伙伴提供服务,以弥补谷歌在网络安全方面的短板;而 Anthropic 已在自动化代码防御领域抢先建立了早期优势。

谷歌推出 Gemini 3.5 Flash Cyber 用于网络安全

Gemini 3.5 Flash Cyber 旨在检测并修补软件漏洞。谷歌表示,该专业化模型的单 token 价格低于更大的模型。该模型在初期仅通过有限访问的试点向政府和可信合作伙伴提供服务。

Gemini 3.6 Flash 和 3.5 Flash-Lite 降低 Token 成本

谷歌正在推出 Gemini 3.6 Flash,它在编码、多模态和知识工作方面表现更优,同时相较于前一代模型最多使用 17% 更少的 token,并且单 token 成本更低。Gemini 3.5 Flash-Lite 是谷歌在 3.5 系列中速度最快、价格最低的模型,面向高频量工作负载以及更大 AI 代理系统中的小型任务而构建。Artificial Analysis 的数据显示,Gemini Flash 已在成本上进一步压低,优于 Anthropic、OpenAI 以及中国竞争对手的可比模型。根据该公司说法,Gemini 3.6 Flash 的每任务成本比 GPT-5.6 Terra Max、Kimi K3 和 Qwen 3.7 Max 更便宜;而 3.5 Flash-Lite 的成本则仅为其一小部分。

谷歌在对标中国 AI 竞争对手中部署 Gemini

此次上线恰逢 Alphabet 财报前夕,同时中国竞争对手势头正劲。Moonshot AI 的 Kimi K3 吸引了足够多的需求,以至于该公司因产能限制而限制新的订阅和 API 访问。阿里巴巴正在预热 Qwen 3.8 Max,并表示其整体表现仅落后于 Anthropic 的 Fable 5。

谷歌为 Gemini 开发定制芯片以提升效率

据报道,谷歌正在开发一种专用芯片,用于让 Gemini 的运行效率最高可提升 10 倍,这是降低提供 AI 服务成本的更广泛推动的一部分。谷歌云发言人在一份对 CNBC 的声明中表示,其团队“不断研究并尝试新的创新,以为我们的用户和客户提供最大性能与效率”。发言人补充道:“尽管并非每个项目都会进入量产,但这种严格的探索是我们全栈方法的核心。”公司表示,通过从零开始共同设计硬件与软件,它能够确保系统已被集成并针对真实工作负载进行高度优化。

谷歌测试 Gemini 3.5 Pro 并启动 Gemini 4 预训练

在围绕延迟的提问之后,谷歌正在为其路线图提供更多可视性。Gemini 3.5 Pro 目前正与合作伙伴一起进行测试,等待更广泛的推出。该公司已经开始为 Gemini 4 进行有史以来规模最大的预训练。

FAQ

谷歌周二发布了哪些新的 Gemini 模型?
谷歌周二发布了三款新的 Gemini 模型:用于网络安全的 Gemini 3.5 Flash Cyber、性能提升且 token 成本更低的 Gemini 3.6 Flash,以及作为 3.5 系列中最快且最便宜的 Gemini 3.5 Flash-Lite。

Gemini 3.6 Flash 相比前一代有哪些改进?
Gemini 3.6 Flash 在编码、多模态和知识工作方面表现更优,同时最多使用 17% 更少的 token,并且单 token 成本也低于前一代模型。

谷歌在做什么来提升 Gemini 的效率?
据报道,谷歌正在开发一种专用芯片,使 Gemini 的运行效率最高可提升 10 倍,作为降低提供 AI 服务成本的更广泛推动的一部分。

免责声明:本页面信息可能来自第三方,仅供参考,不代表 Gate 的观点或意见,亦不构成任何财务、投资或法律建议。数字资产交易风险较高,请勿仅依赖本页面信息作出决策。具体内容详见声明
评论
0/400
暂无评论