Gemini 3.6 Flash发布:效率与质量双升
Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber

Google正式推出Gemini 3.6 Flash、3.5 Flash-Lite以及专为安全设计的3.5 Flash Cyber。其中,3.6 Flash作为主力模型,在保持更低成本的同时,输出Token用量减少17%,在DeepSWE等基准测试中表现卓越。3.5 Flash-Lite则以每秒350个Token的极速,成为处理高吞吐任务的首选。此外,3.5 Flash Cyber配合CodeMender,为政府和合作伙伴提供前沿的漏洞检测能力。这一系列更新旨在解决开发者在构建AI Agent时面临的效率、延迟和可靠性挑战,让规模化部署变得更加经济高效。
我们的Flash系列模型旨在找到效率与质量的完美平衡点,从而赋能Agent工作流的规模化落地。
HN 评论区
573- postalcoder
我很好奇 Google 在后台用来训练这些小型模型的 Pro 版本究竟有多大。
纯属无根据的猜测,这些 Flash 版本发布时没有配套的 Pro 模型,可能意味着:1) 模型太大,经济上划不来;2) Google 没有足够的算力来部署这个大模型;3) 他们的大模型存在太多对齐问题,无法向公众开放。
编辑:看起来 https://artificialanalysis.ai/models/gemini-3-6-flash 上已经有基准测试了。它的表现中规中矩。不过,如果要公平地评价 Flash 模型,应该看“智能与任务耗时”以及“智能与输出速度”这两个基准。这是一个非常快的模型。
编辑 2:我偶尔会用 Antigravity,以我的经验,3.5 Flash 是一个被低估的模型,只要你清楚它的强项。它在前端开发方面非常出色(比 gpt 5.5 好得多),而且速度快,是迭代开发的绝佳工具。我预计 3.6 也会如此。
- prtmnth
我的直觉是,Google 正试图将一种快速且相对廉价的 AI 集成到搜索及其产品套件的所有其他界面中。为了实现这一目标,对他们来说,一个既能快速运行又足够准确且成本可控的模型,比推出一个前沿类的重型模型更为重要。
- m_w_
看到这里没有任何与其他模型的对比,有点让人失望——我也不确定这是否推动了技术曲线的发展。3.6 Flash 比 GLM 5.2 更贵,但似乎表现更差,尽管这篇帖子真的细节寥寥(lite?)。
有一段时间,Google 似乎终于开始发力了,但随着时间推移,我对此越来越怀疑。我想我们得看看 3.5 Pro 的表现再说。
- stonewhite
Google 不知何故在 AI 产品上上演了“在成功边缘被击败”的戏码。
他们实际上通过逐步淘汰 AI Ultra 订阅且没有任何恰当的产品跟进,把我及我的公司逼出了 Antigravity。现在 Antigravity IDE 甚至无法从 Google Workspace 获得高级用户订阅,Gemini Enterprise Agent Platform 也无法接入 Antigravity IDE。
Gemini Enterprise Agent Platform 的搭建过程简直糟糕透顶,如果我想限制每位用户的支出,就得为每个用户单独创建项目。如果账单里还有免费额度就无法激活 Anthropic 模型,这简直是个笑话。
我曾是 Google 和 Gemini 的坚定支持者,但他们突如其来的产品决策让我们措手不及,迫使我们直接从 Anthropic/OpenAI 购买价值 200 美元的订阅服务。
- simonw
为 3.6 Flash 和 3.5 Flash-Lite 点赞(Cyber 我目前还无法通过 API 使用。)
https://tools.simonwillison.net/markdown-svg-renderer#url=ht...
- primaprashant
每百万输入/输出令牌的定价:
2.5 Flash: $0.3 / $2.5
3.0 Flash: $0.5 / $3
3.5 Flash: $1.5 / $9
3.6 Flash: $1.5 / $7.5
---
2.5 Flash-Lite: $0.1 / $0.4
3.1 Flash-Lite: $0.25 / $1.5
3.5 Flash-Lite: $0.3 / $2.5
- primaprashant
分享几点信息:
> 除了今天的发布,Gemini 3.5 Pro 目前正在与合作伙伴进行测试,我们计划在准备好后尽快广泛推出。
> 我们已经开始了迄今为止最雄心勃勃的预训练运行,针对 Gemini 4,我们对进展感到兴奋。
- jgbuddy
它既不如 GLM-5.2 智能,价格还更高,而且还是闭源权重的。
- swe_dima
依赖 Google 的模型真让人害怕。
我有一个对价格非常敏感的工作负载,以前运行在 flash 2.5 lite 上,现在该版本已被弃用。
替代方案 3.1 flash lite 贵得多,而且现在也有了 sunset date(停用日期)。
3.5 flash lite 价格更高。
所以价格一直在涨,你除了不断付更多的钱外别无选择。
- b473a
没有提到更新 Jules,它仍然卡在 3.1 Pro 上。我知道这大概是个小众功能,但我真的很喜欢能在手机上给 Jules 下达指令,然后在 15 分钟后审查并合并 GitHub PR 的体验。这对于我在通勤途中无法拿出笔记本电脑时推进一些个人项目非常有帮助。
有人有什么好的替代方案吗?