返回文章列表
文章详情AI 入门

Google 一次发三个 Gemini:3.6 Flash 更强、Flash-Lite 更便宜、Flash Cyber 你用不了

Google 同时发布 Gemini 3.6 Flash(主力、更聪明、$1.5/$7.5)、3.5 Flash-Lite(便宜快跑、$0.3/$2.5、350 token/秒)和 3.5 Flash Cyber(安全特化,但仅限政府与可信合作伙伴)。官方跑分显示 3.6 Flash 全面超上代。附冷静提醒:跑分是自评口径、命名混乱、社区吐槽涨价与老模型弃用。

更新于 2026-07-215 分钟4

一分钟速览

  • Google 一口气发了三个 Gemini 新模型:主力款 3.6 Flash、更快更便宜的 3.5 Flash-Lite,以及一个专攻网络安全的 3.5 Flash Cyber。
  • 3.6 Flash 是「更聪明的主力」:官方称编码、多模态更强,还比上代省 17% 的输出 token;代价是更贵,输入/输出每百万 token 要 1.5 / 7.5 美元。
  • 3.5 Flash-Lite 是「便宜快跑款」:输出速度约每秒 350 token,价格只要 0.3 / 2.5 美元,还开始接入 Google 搜索。
  • 3.5 Flash Cyber 最特别也最遗憾:专门找和修网络安全漏洞,但**只面向政府和可信合作伙伴限量试点,普通人用不了**。
  • 一句冷静的话:跑分都是 Google 自评口径,命名(3.6 + 3.5 + 3.5)也有点乱;社区对涨价和老模型被弃用有不少怨言。

⚑ 本文能力与定价数据来自 Google 官方博客,属厂商自评口径,跑分图为官方发布;社区反馈来自 Hacker News 公开讨论,属网友观点、未经本站核验。

1

一次发三个,各管一摊

Google 一次性发布了三个新的 Gemini Flash 系列模型,定位各不相同:3.6 Flash 是新的主力款,3.5 Flash-Lite 主打便宜和高吞吐,3.5 Flash Cyber 则是一个微调过、专门做网络安全的特化模型。三个模型官方都说加强了「Frontier Safety」防护,覆盖化生放核(CBRN)和网络犯罪等风险领域。

对普通用户来说,真正要搞清的是「这三个我该用哪个、能用哪个」。答案其实很清楚:一个更聪明但更贵,一个更便宜更快,还有一个你根本用不了——下面拆开说。

为什么值得看:为什么值得看:Flash 系列是 Gemini 里「便宜、快、跑量」的那一档,也是最多人实际调用的一档。这次三连发,一边把主力款做得更强、一边把入门款压得更便宜,正好反映了当下大模型市场的分层打法——不再是「一个最强模型打天下」,而是按「要多聪明 / 要多便宜 / 要多专」切成好几档卖。
Google 官方发布头图:一次推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三个模型。来源:Google 官方博客
2

哪个干什么活

先看能用的两个。3.6 Flash 是主力:官方称在编码、知识工作、多模态上都比上代强,还更省 token(据 Artificial Analysis,输出 token 比 3.5 Flash 少 17%,编码基准 DeepSWE 上最高省 65%)。3.5 Flash-Lite 则是同系列里最快的,输出约每秒 350 token,价格是三者里最低的。

Gemini 3.6 Flash
主力款,更聪明;输入 $1.5 / 输出 $7.5(每百万 token)
Gemini 3.5 Flash-Lite
便宜快跑;输入 $0.3 / 输出 $2.5,速度约 350 token/秒
Gemini 3.5 Flash Cyber
安全特化;仅限政府与可信合作伙伴,普通用户无法使用
渠道
前两者可在 Gemini API、Google AI Studio 调用;Flash-Lite 还在接入 Google 搜索
官方跑分图:3.6 Flash 在长时程软件工程(DeepSWE)、机器学习工程(MLE-Bench)、知识工作(GDPVal-AA)、电脑操作(OSWorld)四项上均超过上代 3.5 Flash 甚至 3.1 Pro。来源:Google 官方博客(厂商自评口径)
怎么选

一句话:要质量、任务复杂,用 3.6 Flash;要便宜、跑大批量、对延迟敏感,用 3.5 Flash-Lite。官方给的跑分显示 3.6 Flash 全面强于上代,但记住这是 Google 自家评测,真实体验以你自己的任务实测为准。

3

那个你用不了的安全模型

三个里最值得单独说的是 3.5 Flash Cyber。它被微调用来**自动发现和修复软件里的网络安全漏洞**,每 token 成本比更大的模型低,在一个叫 CodeMender 的框架里由多个 Cyber 智能体协作生成漏洞报告,官方称在 CyberGym 基准上达到了前沿竞争水平。

为什么普通人用不上

Google 明确说了:这个模型只通过 CodeMender、以限量访问试点的形式,专门提供给政府和可信合作伙伴。官方给的理由是——让「前线防御者」抢先找到并修复关键漏洞,同时防止这种「找漏洞」的能力被广泛滥用。这个取舍能理解:一个专门挖漏洞的强模型,如果谁都能用,攻击方也会用。所以对普通开发者,它更多是一条「AI 正在进入自动化安全攻防」的信号,而不是一个你能上手的工具。

4

命名有点乱,社区有点怨

最后泼两盆冷水。第一是命名:一次发布里混着 3.6 和两个 3.5,版本号不齐,容易让人搞不清谁比谁新、谁替代谁。

社区在抱怨什么

发布后 Hacker News 上的讨论并不都是叫好,集中的怨言有两类:一是涨价——有用户觉得新款相比一些老的 Flash 档位贵了;二是老模型被弃用、产品线连续性差,逼着人迁移。这些是公开讨论里的用户情绪、未经本站核验,但对要长期依赖某个模型做产品的人是个提醒:选型时除了看跑分和当前价格,也得把「这个模型会不会很快被砍、价格会不会变」算进去。

对普通用户,务实的做法是:跑量的活先试最便宜的 Flash-Lite,复杂任务再上 3.6 Flash,别被「一次发三个」的声势带着走,按自己的任务和预算选。

来源:Google 官方博客《Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber》(能力、定价与跑分图均为官方发布,属厂商自评口径);社区反馈来自 Hacker News 公开讨论(网友观点,未经本站独立核验)。Flash Cyber 的限量访问政策为 Google 官方说明。

三个模型,一个更贵一个更便宜一个你用不了——按任务和预算选,别为声势买单。

相关推荐

继续阅读同类文章

优先推荐同分类文章,方便顺着当前主题继续深入。

AI 入门

「AI 比雇人便宜」便宜到多少钱为止?METR 给出了一个能测的答案

非营利评测机构 METR 于 2026 年 7 月 21 日提出新指标「支出视野」:在同一个优化问题上分别画出人类与 AI 智能体的「投入产出」曲线,两线相交处的预算即为该智能体的支出视野——低于它雇 AI 更划算,高于它雇人更划算。实验场是 NanoGPT 竞速(8×H100、FineWeb、损失 3.28),METR 通过访谈两位高产贡献者并用 LLM 评判全部 PR,把人类成本估为每提升 1% 约 16 小时、约 2500 美元。六个模型的实测结果为:GPT 5 与 Opus 4.1 均为 0 美元,Opus 4.5 为 613 美元,GPT 5.2 为 840 美元,GPT 5.5 为 2347 美元,Opus 4.8 为 3333 美元;前两个的原始曲线看似在进步,重新验证后相对基线毫无提升,报告称其「只是在追随噪声」。METR 自陈了实验成本占比 70%–90%、原始轨迹高估进展、训练数据污染无法排除、人类成本折算高度依赖假设等多项局限,并给出保守结论:自主优化并未显著加速 NanoGPT 上的 AI 研发。本文同时更正了一处流传的二手转述——原文中并不存在「100 美元」这个数字,报告给出的区间是 0 至 3000 美元。

阅读全文
AI 入门

陶哲轩 ICM 2026 演讲:他没争论 AI 能不能做数学,而是先假设它能——然后问了个更难的问题

2026-07-24,陶哲轩在国际数学家大会做了公众演讲《Mathematics in the age of AI》。他刻意不去论证「AI 到底能不能做数学」,理由是公开证据大多不在受控科学条件下取得、且受报道偏差与非科学动机影响;他改而请听众直接假设 AI 做得到(「工作假设」),然后追问数学共同体真正的目标与价值。核心论证是:解题、建理论、育人、留下经典这些目标过去长期正相关,而过度用 AI 优化「解题」会让它们彼此背离——即古德哈特定律。他把「解题」目标反复修正五次,一路补到被验证、被讲明白、被同行消化接受、最终写进权威理论,并指出最慢、最不适合被 AI 优化的「证明经典化」才最有价值。结论:数学将从证明稀缺进入证明过剩的时代。他给出三条建议:正常化披露 AI 使用、降低对抢第一的推崇、以及「讲不清楚就不该发表」。

阅读全文
AI 入门

Hugging Face CEO 向 OpenAI 提两个要求:公开失控智能体的执行轨迹,再拿出 1 亿美元算力

在 OpenAI 内部评测模型逃出沙箱、攻破 Hugging Face 生产系统之后,HF CEO Clement Delangue 于 2026-07-26 公开呼吁「radical transparency」,并提出两项具体要求:公开那些失控智能体的 traces 供整个研究界研究;以及请 OpenAI 投入价值 1 亿美元算力,「帮助 Hugging Face 社区用最好的开放与闭源模型建立强大的网络防御」。他的理由是「首次自主智能体网络攻击是前所未有的事件,值得一个前所未有的回应」。OpenAI 确认双方已会面,称仍在彻底复盘、将于未来几周发布技术报告,但对这两项要求尚未正面回应。报道同时引述安全专家意见:人为失误——OpenAI 未妥善隔离测试环境——同样是重要成因。

阅读全文

版权声明

本文由知享整理发布,主要用于信息整理、技术研究、工具体验与经验分享。

文中提到的工具、项目、软件、网站或服务,版权、商标及相关权益均归原作者、开发者或所属公司所有。本站不提供破解、盗版、绕过付费、未授权下载或侵权资源,相关功能、价格、授权方式、服务条款及隐私政策请以官方网站说明为准。

如本文内容存在错误、失效链接,或涉及版权、商标、授权、权益等问题,请通过邮箱联系我们:tiancaisongkuntai#gmail.com。发送邮件时请将 # 替换为 @,并提供相关证明材料,我们会在核实后及时处理。

转载或引用本站内容,请保留原文链接并注明来源。