返回文章列表
文章详情AI 入门

Google 一次发三个 Gemini:3.6 Flash 更强、Flash-Lite 更便宜、Flash Cyber 你用不了

Google 同时发布 Gemini 3.6 Flash(主力、更聪明、$1.5/$7.5)、3.5 Flash-Lite(便宜快跑、$0.3/$2.5、350 token/秒)和 3.5 Flash Cyber(安全特化,但仅限政府与可信合作伙伴)。官方跑分显示 3.6 Flash 全面超上代。附冷静提醒:跑分是自评口径、命名混乱、社区吐槽涨价与老模型弃用。

更新于 2026-07-215 分钟4

一分钟速览

  • Google 一口气发了三个 Gemini 新模型:主力款 3.6 Flash、更快更便宜的 3.5 Flash-Lite,以及一个专攻网络安全的 3.5 Flash Cyber。
  • 3.6 Flash 是「更聪明的主力」:官方称编码、多模态更强,还比上代省 17% 的输出 token;代价是更贵,输入/输出每百万 token 要 1.5 / 7.5 美元。
  • 3.5 Flash-Lite 是「便宜快跑款」:输出速度约每秒 350 token,价格只要 0.3 / 2.5 美元,还开始接入 Google 搜索。
  • 3.5 Flash Cyber 最特别也最遗憾:专门找和修网络安全漏洞,但**只面向政府和可信合作伙伴限量试点,普通人用不了**。
  • 一句冷静的话:跑分都是 Google 自评口径,命名(3.6 + 3.5 + 3.5)也有点乱;社区对涨价和老模型被弃用有不少怨言。

⚑ 本文能力与定价数据来自 Google 官方博客,属厂商自评口径,跑分图为官方发布;社区反馈来自 Hacker News 公开讨论,属网友观点、未经本站核验。

1

一次发三个,各管一摊

Google 一次性发布了三个新的 Gemini Flash 系列模型,定位各不相同:3.6 Flash 是新的主力款,3.5 Flash-Lite 主打便宜和高吞吐,3.5 Flash Cyber 则是一个微调过、专门做网络安全的特化模型。三个模型官方都说加强了「Frontier Safety」防护,覆盖化生放核(CBRN)和网络犯罪等风险领域。

对普通用户来说,真正要搞清的是「这三个我该用哪个、能用哪个」。答案其实很清楚:一个更聪明但更贵,一个更便宜更快,还有一个你根本用不了——下面拆开说。

为什么值得看:为什么值得看:Flash 系列是 Gemini 里「便宜、快、跑量」的那一档,也是最多人实际调用的一档。这次三连发,一边把主力款做得更强、一边把入门款压得更便宜,正好反映了当下大模型市场的分层打法——不再是「一个最强模型打天下」,而是按「要多聪明 / 要多便宜 / 要多专」切成好几档卖。
Google 官方发布头图:一次推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三个模型。来源:Google 官方博客
2

哪个干什么活

先看能用的两个。3.6 Flash 是主力:官方称在编码、知识工作、多模态上都比上代强,还更省 token(据 Artificial Analysis,输出 token 比 3.5 Flash 少 17%,编码基准 DeepSWE 上最高省 65%)。3.5 Flash-Lite 则是同系列里最快的,输出约每秒 350 token,价格是三者里最低的。

Gemini 3.6 Flash
主力款,更聪明;输入 $1.5 / 输出 $7.5(每百万 token)
Gemini 3.5 Flash-Lite
便宜快跑;输入 $0.3 / 输出 $2.5,速度约 350 token/秒
Gemini 3.5 Flash Cyber
安全特化;仅限政府与可信合作伙伴,普通用户无法使用
渠道
前两者可在 Gemini API、Google AI Studio 调用;Flash-Lite 还在接入 Google 搜索
官方跑分图:3.6 Flash 在长时程软件工程(DeepSWE)、机器学习工程(MLE-Bench)、知识工作(GDPVal-AA)、电脑操作(OSWorld)四项上均超过上代 3.5 Flash 甚至 3.1 Pro。来源:Google 官方博客(厂商自评口径)
怎么选

一句话:要质量、任务复杂,用 3.6 Flash;要便宜、跑大批量、对延迟敏感,用 3.5 Flash-Lite。官方给的跑分显示 3.6 Flash 全面强于上代,但记住这是 Google 自家评测,真实体验以你自己的任务实测为准。

3

那个你用不了的安全模型

三个里最值得单独说的是 3.5 Flash Cyber。它被微调用来**自动发现和修复软件里的网络安全漏洞**,每 token 成本比更大的模型低,在一个叫 CodeMender 的框架里由多个 Cyber 智能体协作生成漏洞报告,官方称在 CyberGym 基准上达到了前沿竞争水平。

为什么普通人用不上

Google 明确说了:这个模型只通过 CodeMender、以限量访问试点的形式,专门提供给政府和可信合作伙伴。官方给的理由是——让「前线防御者」抢先找到并修复关键漏洞,同时防止这种「找漏洞」的能力被广泛滥用。这个取舍能理解:一个专门挖漏洞的强模型,如果谁都能用,攻击方也会用。所以对普通开发者,它更多是一条「AI 正在进入自动化安全攻防」的信号,而不是一个你能上手的工具。

4

命名有点乱,社区有点怨

最后泼两盆冷水。第一是命名:一次发布里混着 3.6 和两个 3.5,版本号不齐,容易让人搞不清谁比谁新、谁替代谁。

社区在抱怨什么

发布后 Hacker News 上的讨论并不都是叫好,集中的怨言有两类:一是涨价——有用户觉得新款相比一些老的 Flash 档位贵了;二是老模型被弃用、产品线连续性差,逼着人迁移。这些是公开讨论里的用户情绪、未经本站核验,但对要长期依赖某个模型做产品的人是个提醒:选型时除了看跑分和当前价格,也得把「这个模型会不会很快被砍、价格会不会变」算进去。

对普通用户,务实的做法是:跑量的活先试最便宜的 Flash-Lite,复杂任务再上 3.6 Flash,别被「一次发三个」的声势带着走,按自己的任务和预算选。

来源:Google 官方博客《Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber》(能力、定价与跑分图均为官方发布,属厂商自评口径);社区反馈来自 Hacker News 公开讨论(网友观点,未经本站独立核验)。Flash Cyber 的限量访问政策为 Google 官方说明。

三个模型,一个更贵一个更便宜一个你用不了——按任务和预算选,别为声势买单。

相关推荐

继续阅读同类文章

优先推荐同分类文章,方便顺着当前主题继续深入。

AI 入门

Anthropic 自曝:Claude Code 团队 65% 的代码由 AI 提交,系统提示词砍了 80%

Anthropic 的 Claude Code 团队在公开访谈里摊开内部数字:自己团队 65% 的工程 PR 已由 AI 完成,系统提示词为适配新模型砍掉 80%。更实用的是他们写提示词的最新经验——新模型上别堆示例、别列一堆禁令、别下绝对命令。数字是团队自述口径,但那几条提示词经验谁都能今天就用。

阅读全文
AI 入门

Cursor 智能体集群:一秒 1000 次提交,4 小时用 Rust 重写了个 SQLite

Cursor 公布新一代 AI 智能体集群:峰值每秒约 1000 次提交(旧系统每小时 1000 次),并让一群 AI 只靠 835 页手册、4 小时从零用 Rust 重写 SQLite,多个模型组合跑到 100%。但最有价值的是成本账——「强模型规划+便宜模型干活」比全用 GPT-5.5 便宜约 8 倍。附冷静提醒:这是官方自演示,且 SQLite 很可能在训练数据里。

阅读全文
AI 入门

阿里 Qwen-Image-3.0:主打复杂文字排版,但演示图好看不等于你能用出来

阿里发布第三代图像生成模型 Qwen-Image-3.0,官方主打「实」——一次生成报纸/试卷/九宫格信息图、10px 小字、12 国语言渲染。官方精选示例确实亮眼,但没公开提示词和种子、没有跑分、权重未开放、社区实测褒贬不一。本文分清「官方自评」与「待验证」,冷静看这次图像模型发布。

阅读全文

版权声明

本文由知享整理发布,主要用于信息整理、技术研究、工具体验与经验分享。

文中提到的工具、项目、软件、网站或服务,版权、商标及相关权益均归原作者、开发者或所属公司所有。本站不提供破解、盗版、绕过付费、未授权下载或侵权资源,相关功能、价格、授权方式、服务条款及隐私政策请以官方网站说明为准。

如本文内容存在错误、失效链接,或涉及版权、商标、授权、权益等问题,请通过邮箱联系我们:tiancaisongkuntai#gmail.com。发送邮件时请将 # 替换为 @,并提供相关证明材料,我们会在核实后及时处理。

转载或引用本站内容,请保留原文链接并注明来源。