谷歌发布 Gemini 3.6 Flash 等三款新模型

Google DeepMind 于 2026 年 7 月 21 日发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型,旨在提升 AI 代理的 token 效率、降低延迟并提高可靠性。
Gemini 3.6 Flash 是主力模型,在编码、知识工作和多模态性能上优于 3.5 Flash。根据 Artificial Analysis Index,其输出 token 消耗减少 17%,在 DeepSWE 等基准测试中最高减少 65%。定价为 $1.50/1M 输入 token 和 $7.50/1M 输出 token,低于 3.5 Flash。3.5 Flash-Lite 是速度最快的 3.5 级模型,每秒输出 350 token,在代理工作流中表现显著提升。3.5 Flash Cyber 与 CodeMender 代码安全代理结合,专注于网络安全应用,提供前沿性能。
此外,Gemini 3.5 Pro 正在与合作伙伴测试,计划在准备就绪后广泛提供。同时,团队已启动 Gemini 4 的预训练,这是迄今为止最雄心勃勃的预训练运行。这些发布基于开发者反馈,旨在使 AI 代理更具成本效益和可扩展性。
关键信息
- Gemini 3.6 Flash 输出 token 消耗比 3.5 Flash 减少 17%,价格更低。
- 3.5 Flash-Lite 每秒输出 350 token,是速度最快的 3.5 级模型。
- 3.5 Flash Cyber 专为网络安全设计,与 CodeMender 代理结合。
- Gemini 3.5 Pro 正在测试中,Gemini 4 预训练已启动。
- 新模型定价:3.6 Flash 输入 $1.50/1M token,输出 $7.50/1M token。
3.6 Flash: Our workhorse model that delivers better coding, knowledge work, and multimodal performance.
3.6 Flash:我们的主力模型,提供更好的编码、知识工作和多模态性能。
Google DeepMind
为什么上榜
新模型降低 token 消耗和成本,直接影响构建 AI 代理的效率和费用。
每天早上,把当日 AI 精选送进你的邮箱
公众号 AI去噪 · 每日一期同步推送
