
A | 当地时间7月21日,谷歌DeepMind发布三款轻量的新模型,主打“更快、更智能、更具成本效益”,但因智能程度没有满足外界的期待,评价两极分化。

B | 与此同时,旗舰模型Gemini 3.5 Pro依然没有露面成为此次焦点,从排行榜来看,谷歌的模型已经排在十名开外。

C | 根据谷歌官方博客,此次发布的三款模型定位不同。

D |
在近日的一次直播互动中,克莱-汤普森被问及生涯中最具意义的一座总冠军奖杯时,毫不犹豫地选择了2022年勇士夺冠。
Gemini 3.6 Flash是主力模型,与上一代相比能使用更少的token,在相同成本下提供更高质量的工作;而Gemini 3.5 Flash-Lite则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini 3.5 Flash Cyber是一种网络安全模型,专为发现和修补关键软件漏洞而构建。
克莱坦言,2022年的冠军之所以特别,正是因为此前两个赛季的经历。
但根据评测来看,此次谷歌的新模型在智能上并不出色。AI模型评测平台Arena.ai的研究显示,Gemini 3.6 Flash 在前端代码竞技场中以1537分排名第12位。
第三方评测机构Artificial Analysis的结论则是,Gemini 3.6 Flash 在智能方面较3.5 Flash没有提升,智能指数得分50,但任务效率有所提高,Gemini 3.6 Flash的平均每任务时间为 1.3 分钟,较上一代减少超过50%,同时每任务成本略有降低。
这意味着,谷歌优化的更多是速度和成本,而不是模型能力本身。“在自己的巅峰时期,却只能坐在那里看比赛,真的一点都不容易。那条康复之路真的非常艰难。
更值得关注的是,在Artificial Analysis最新智能指数排行榜中,谷歌目前已经没有任何一款模型进入前十。”他回忆道,在大约两年半无法正常比赛之后,复出后立即在一支冠军球队中扮演重要角色,“你根本写不出比这更好的故事”。排名靠前的是Anthropic、OpenAI等海外厂商,也包括国内月之暗面的Kimi K3、智谱GLM-5.2等模型。
克莱认为,2022年的那座冠军让全队变得“不朽”。

E | 这与去年Gemini一度站上全球第一梯队形成了鲜明反差。“为了走到那里,我们经历了太多过山车般的起伏,再次举起那座奖杯之前,我们经历了太多。”这番话也让人看到他作为勇士王朝基石之一,对那段从伤病低谷重返巅峰的深刻感触。 除了排行榜,开发者社区的反馈同样出现明显分化。不少开发者用谷歌新模型做任务时未看到很好的表现,“前端能力糟糕、空间推理也很差,我安慰自己这其实不是在高思考水平上运行的,但我不确定。与2015年首冠或2017、2018年的统治级夺冠不同,2022年的冠军被克莱视为对信念与坚持的最终回报。” 有开发者评论道,“谷歌就像龟兔赛跑里的兔子,领先一段时间后就开始睡觉。”也有人直言,Gemini 团队需要引入真正关心交付前沿模型的人。 在关于谷歌新模型发布的评论中,相比Flash模型,大家更关注的是,旗舰模型Gemini 3.5 Pro什么时候发布? 在5月的谷歌I/O 大会上,谷歌发布了Gemini 3.5 Flash,当时曾预告Pro版本已在内部使用,预期一个月内推出。

F | 然而两个月过去了,Gemini 3.5 Pro依然没有公开亮相。据外媒报道,由于模型始终未达到内部预期性能,谷歌推迟了发布计划。

G | 面对外界质疑,谷歌DeepMind技术负责人洛根·基尔帕特里克(Logan Kilpatrick)也在社交媒体上回应称,Gemini 3.5 Pro正在与合作伙伴进行测试,计划在准备就绪后立即广泛提供。

H | 但他未给出具体的时间节点。

I | 与此同时,谷歌在这次博客中提到,团队已经开始着手构建下一代模型,“启动了迄今为止规模最大的 Gemini 4 预训练工作,并对目前的进展感到振奋”。这一表态,也让不少业内人士猜测,谷歌是否正在把更多资源转向下一代模型,而非继续打磨3.5 Pro。 针对现阶段谷歌模型的表现,很多人认为,并不是谷歌的能力不行,而是内部的策略方向问题,优先级放在产品上,而不是像Anthropic、OpenAI等厂商专注将AI做好。 从谷歌这次的更新来看,团队在大模型上的策略似乎是“速度胜过智慧”。

J | 有开发者认为,让任务时间缩短是很好,但停滞的智能意味着他们优先考虑了错误的指标。“创新也需要深度,而不仅仅是秒表”。

K | 不过,也有开发者认为,如果模型是为了赚钱,从这个商业角度看,谷歌是聪明的,毕竟现在新兴公司都是在烧钱运营,一旦钱烧完直接就倒闭,而谷歌是将模型降智节省成本。 相比Anthropic和OpenAI持续围绕模型能力竞争,谷歌拥有Android、Chrome、Workspace、搜索、云服务等庞大的产品生态,因此这一年其AI战略一直更偏向产品落地,而不是单纯追逐模型能力和榜单。

L | 但另一方面,开发者更倾向于将智能作为评价AI公司的第一标准。如果模型能力长期停滞,即便商业化领先,也难免影响开发者生态和市场预期。 遥想去年11月,谷歌发布Gemini 3模型时曾引发业界震动,反超OpenAI、坐稳第一梯队,股价一路飙升。而进入2026年以来,AI竞争的风向再次发生变化。

M | OpenAI依靠持续推出新模型重新夺回行业关注度,Anthropic依旧保持着模型能力领先的位置,而谷歌更多展示的是成本优化和产品整合能力。 截至7月21日收盘,谷歌(GOOGL.US)跌超1%,股价收于347.15美元/股,较5月中旬高点累计回落近15%,当前谷歌总市值约4.2万亿美元,也从全球市值榜第二退居第三,被苹果赶超。 (本文来自第一财经)。
Current article:http://www.rangzhuanhoujuedu.cyou/2tu0ft/5hz2pds.ppt
Published on:10:51:36
相关阅读 消息称苹果北京时间 9 月 9 日召开 iPhone 18 Pro / Max 发布会【仓单】8月26日上期所沪银期货仓单较上一日下降2359千克南宁市发布通告:受洪水影响 部分区域进入紧急防汛期亚马逊在英国推出保险产品比较服务“气”太贵!为过冬,德国人开始抢购电取暖器……Oscars 2026: Vishal Jethwa Comments About Homebound Getting Shortlisted2026年“顺风顺水·跃动长安——顶呱刮盛夏狂欢季”主题即开型体育彩票营销活动开始啦500개 직업군 분석했더니…‘암 사망률’ 1위는 승무원?
热门文章
小米春节即将来临:小米82099元礼券有限,小米手镯35%折扣…
始终以正确政绩观担当作为、履职尽责——树立和践行正确政绩观学习教育取得明显成效
中国三人篮球国家队出征亚洲杯
英伟达被曝大规模收购暗光纤资源
最新文章
2025香港车博会:全新纯电中型SUV 小鹏G7实车亮相
8月26日东方财富财经晚报(附新闻联播)
继C罗之后,B费成为历史上第二位获PFA赛季最佳球员的葡萄牙人美国一航班刚落地机舱惊现长蛇,乘客被吓得惊声尖叫我国在绿色转型中培育新产业、拓展新市场mRNA癌症疫苗不是梦?
人气排行 从流程简化到资金加码 多地完善汽车消费补贴政策Smug Influencer's In-flight Smoking Video Creates Ruckus on Indian Social Media, Probe Launched1至7月,2.06亿人次涌进武林商圈 老商圈解锁AI新玩法Russia, Latin America Finding Ways to Maintain Ties Under Sanctions - Foreign MinistrySpain Tomatina商场里的国风手作课堂乡村茶山的非遗沙龙皮划艇世锦赛中国队再添1银1铜我国科学家新发现46个南极冰下湖
查看所有0条评论>>