首页财产ai正文 Gemini 3.5 Pro难产,google先交了两张底稿纸 7月21日google忽然上线Gemini 3.6 Flash及3.5 Flash-Lite,前者主打效率,后者速率快,而旗舰模子Gemini 3.5 Pro仍未上线。 2026-07-22 09:11 ·微信公家号:字母榜 袁心玥 袁心玥 AI投资人解读· google上线Gemini 3.6 Flash及Gemini 3.5 Flash-Lite,前者主击柝强代码及Agent能力且成本更低,后者速率更快,虽捐躯部门能力上限但效率晋升。 · Gemini 3.6 Flash未周全领先竞争敌手Gemini 3.5 Flash-Lite比拟上一代未进一步降价Gemini 3.5 Pro发布延迟,编码体现不和预期,市场竞争格式正变。 总结:google新模子于成本及效率上有亮点,但面对竞争压力与旗舰模子延期问题,需存眷其后续体现和对于市场格式的影响。
7月21日,google忽然上线了两个新模子:
Gemini 3.6 Flash及Gemini 3.5 Flash-Lite。
没有一点点防御,也没有一丝挂念,它俩就如许呈现于了Google AI Studio及Gemini的模子选择器里。
这两个模子,一个主击柝强的代码及Agent能力,一个主击柝低成本的年夜范围挪用。
而作为旗舰模子的Gemini 3.5Pro,千呼万唤依然……出不来。
根据此前的规划,3.5 Pro本应于6月份上线,此刻7月都过一泰半了,这款被寄与厚望的模子仍旧没有正式表态。
代表旗舰实力的答卷迟迟不交,google先拿出两张“底稿纸”,是个甚么意思?
3.6 Flash:比上一代自制,不比上一代智慧
google暗示,比拟上一代Flash模子,Gemini 3.6 Flash进一步晋升了编码、推理及东西挪用体现,同时经由过程削减输出token降低运行成本。

Gemini 3.6 Flash的定位是一个面向真实出产情况的高效模子,或者者更直白一点,为Agent办事。
于Agent时代,一次使命可能需要几十轮模子挪用,这象征着模子不仅要智慧,还有必需充足快、充足自制。
Google此前已经经于Gemini 3.5 Flash上强化了这条线路。按照官方API文档,Gemini 3.5 Flash撑持100万token的长上下文,可以一次处置惩罚年夜量信息,同时撑持代码履行、挪用外部东西、搜刮文件等能力,可以或许完成更繁杂、更永劫间的使命。
Gemini 3.6 Flash延续了这条线路,它寻求的其实不是单次回覆的质量,是一个“可以或许负担患上起逐日真实事情”的位置。
Gemini 3.6 Flash的订价以下:
输入:1.50 美元/百万 token
输出:7.50 美元/百万 token
比拟此前Gemini 3.5 Flash每一百万token输入1.5美元、输出9美元的价格,输入成本没有变化,但输出成本进一步降落。
对于在需要年夜量挪用AI的企业来讲,这类成本变化可能比benchmark上的几个百分点晋升越发主要。
别的,google展示的一项内部测试显示,于完成统一使命时,Gemini 3.6 Flash比拟3.5 Flash削减了55.8%的token耗损,同时将使命评分从85分晋升到了100分。
固然,这只是google本身的测试成果,只能申明Google但愿展示的标的目的:
新模子不仅更省,并且可以或许用更少的计较完成一样甚至更好的使命。
于那些被公然的benchmark里,google重要夸大的是代码能力及Agent能力。
于DeepSWE代码评测中,Gemini 3.6 Flash患上分49%,高在上一代的37%。google暗示,新模子可以或许削减无效代码修改及反复履行历程。
于测试AI操作电脑能力的OSWorld-Verified评测中,Gemini 3.6 Flash患上分83%,跨越3.5 Flash的78.4%。
而于面向呆板进修使命的MLE Bench中,Gemini 3.6 Flash患上分63.9%,比拟上一代的49.7%也有较着晋升。

不外,上述数据更多申明Gemini 3.6 Flash比拟上一代有所前进。
假如放到当前年夜模子竞争中横向比力,Google选择的敌手是GPT-5.6 Luna、Grok 4.5及Claude Sonnet 5(这里也能够看出这个产物的定位)。
从成果来看,Gemini 3.6 Flash并无周全领 先,GPT及Claude的模子于繁杂软件工程及常识事情使命上仍旧连结上风。
但这实在也是Flash系列存于的意义:
它纷歧定要成为最强模子,只需要于较着低在旗舰模子成本的环境下,提供够用的能力。

官方测评以外,按照Artificial Analysis的发布前测试,Gemini 3.6 Flash于Intelligence Index上拿到了50分,与Gemini 3.5 Flash持平。
这象征着,假如只看模子综合“智力”,Gemini 3.6 Flash并无甚么进级。

可是呢,它的速率又很好地填补了这一点。
Artificial Analysis还有统计了模子完成Intelligence Index使命所需的平均时间。成果显示,Gemini 3.6 Flash每一项使命平均耗时约1.3分钟,比拟上一代3.5 Flash的约2.7分钟,削减了一半。
与此同时,Gemini 3.5 Flash-Lite的使命完成时间也从上一代3.1 Flash-Lite的约1.6分钟,降落到约0.6分钟。

总的来讲,Gemini 3.6 Flash的进级标的目的实在是效率——更少的token耗损,更低的运行成本,以和更合适持久运行的Agent能力。
对于在习气利用Gemini 3.5 Flash的用户来讲,确凿长短常不错的进级。
3.5 Flash-Lite:更快,但没有上一代自制
然后再来看另外一个模子Gemini 3.5 Flash-Lite。
顾名思义,Flash-Lite是Flash系列中更轻量的版本,比拟Flash,它捐躯了一部门能力上限,换取了更低的成本及更快的速率。

就像前面提到的那样,Gemini 3.5 Flash-Lite的使命完成时间从上一代3.1 Flash-Lite的约1.6分钟,降落到了约0.6分钟。
3.5 Flash-Lite也是3.5系列中速率最快的型号,按照Artificial Analysis测试数据,其天生速率到达约350 token/秒,已经经属在当前主流年夜模子中的高速程度。
Gemini 3.5 Flash-Lite的订价以下:
输入:0.30 美元/百万 token
输出:2.50 美元/百万 token
比拟Gemini 3.6 Flash,输入价格约为1/5,输出价格约为1/3。不外,与上一代Gemini 3.1 Flash-Lite比拟,新模子并无进一步降价。
虽然Gemini 3.5 Flash-Lite因为能力晋升,可以经由过程削减输出量降低部门成本,但综合起来,还有是很难抵消单价上的成本增长。
按照官方文档,比拟上一代Gemini 3.1 Flash-Lite,新模子于差别思索等级(thinking levels)下都有较着晋升。开发者可以按照使命需求调解模子的思索深度。
此外,Gemini 3.5 Flash-Lite还有内置了Computer Use能力,可以帮忙Agent更靠得住地操作电脑情况,完成跨运用使命。
于详细测试中,Gemini 3.5 Flash-Lite比拟上一代模子也有较着晋升:于Terminal-Bench 2.1编程Agent测试中,成就从31%晋升到54%;于测试长上下文理解能力的GDM-MRCR v2中,从60.1%晋升到72.2%;于更切近真实事情场景的GDPval-AA v2使命履行测试中,从642晋升到1140。

值患上留意的是,于一些Agent及代码相干测试中,Gemini 3.5 Flash-Lite甚至跨越了上一代更高定位的Gemini 3 Flash模子。
例如,于SWE-Bench Pro软件工程测试中,Gemini 3.5 Flash-Lite患上分54.2%,高在Gemini 3 Flash的49.6%;于测试AI操作电脑能力的OSWorld-Verified中,Gemini 3.5 Flash-Lite也以74.0%的成就跨越Gemini 3 Flash的65.1%。
这象征着,跟着模子能力不停晋升,已往需要更年夜模子才能完成的部门Agent使命,正于逐渐下沉到更自制、更快速的模子。

趁便一提,除了了前两个面向平凡用户的通用模子,google还有推出了Gemini 3.5 Flash Cyber。
它重要针对于收集安全场景。按照官方文档,于CodeMender体系中,多个Gemini 3.5 Flash Cyber Agent可以协同事情,别离完成差别阐发使命,并终极汇总成一份完备陈诉。于收集安全基准测试CyberGym中,Flash Cyber也到达了靠近前沿模子的体现。

该模子今朝不会公然提供,仅经由过程CodeMender平台向当局及可托互助伙伴开放。
3.5 Pro:google迟迟交不出的旗舰答卷
假如说Gemini 3.6 Flash及Gemini 3.5 Flash-Lite还有可以看做是google对于AI范围化运用的判定,那末Gemini 3.5 Pro则代表着google的模子上限。
但问题于在:这份答卷,到此刻还有没有交出来。
5月I/O的时辰,google暗示Gemini 3.5 Pro将于“接下来一个月摆布”推出,也就是估计于本年6月上线。此刻7月都过了一泰半了。
据彭博社7月16日报导,Gemini 3.5 Pro的发布时间已经经掉队原规划数月。google正于继承优化模子能力,特别是编码体现,但愿到达内部设定的方针。
路透社最新的报导则显示,截至今朝,google仍未宣布详细上线时间,只暗示该模子正于与互助伙伴测试,并将“很快”推出;尚有新闻稿吐露,Gemini 4的练习事情已经经最先了。
而咱们都知道,“很快”就是不确定的意思。
Gemini 1.0发布时就曾经因演示争议遭到质疑;Gemini 1.5 Pro依附百万token上下文短暂扳回场合排场,但随后Claude及GPT系列快速追逐;直到Gemini 3系列发布,google才从头得到“回到前沿竞争”的评价。
如今Gemini 3.5 Pro再次延期,市场存眷的已经经不只是一个模子何时上线,还有有google到底可否连结旗舰模子的竞争节拍问题。
况且google吐露出的编码体现不和预期,其实不是甚么轻易解决的小问题。
跟着Agent最先进入企业事情流,代码能力的主要性迅速晋升。一个模子可否理解繁杂项目、修改真实代码、完成多步调开发使命,已经经成为权衡它是否具有现实出产价值的主要指标。
路透社指出,华尔街正于等候Gemini 3.5 Pro,由于它将成为判定Google DeepMind是否可以或许跟上OpenAI及Anthropic的主要指标。
固然,google其实不是没有动作,此次推出的几个模子,恰申明google正于强化另外一条线路:让AI变患上更自制、更易范围化。
googleCEO Sundar Pichai近期也屡次夸大成本上风,并暗示企业假如将年夜部门AI事情负载迁徙到Gemini模子,可以每一年节省跨越10亿美元。
但问题于在,市场于期待一份证实google模子实力的“答卷”,google交出的倒是两张关在效率及成本的“底稿纸”——很难不让人感觉,google于用Flash系列弥补Pro延迟留下的空档。
成心思的是,于Gemini 3.5 Pro延期的同时,AI竞争格式正于发生变化。
已往,人们会商AI领 先者,重要存眷海外“御三家”:OpenAI、Anthropic及Google DeepMind。
但近来,GLM-5.二、Kimi K3等国产模子也最先进入前沿竞争,并激发了年夜量会商。
前沿模子的追逐速率正于加速,也让google的问题变患上越发紧急,它固然可以继承鼎力大举推出Flash模子,但条件是它的旗舰模子充足给力——只要硬实力充足,自有年夜儒为他辩经。
假如google终极推出一个真正*的旗舰模子,那末Flash线路会成为完备系统的一部门:Pro卖力冲破能力上限;Flash卖力范围化运用。
但若Gemini 3.5 Pro连续掉队,市场极可能会继承追问:google拥有最强AI研究资源,为何却没法不变跑赢竞争敌手?
于Alphabet本周进行第二季度财报德律风集会时,人们极可能会进一步扣问有关Gemini 3.5 Pro的更多细节。
【本文由投资界互助伙伴微信公家号:字母榜授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-lehu乐虎88国际