[谷歌] 谷歌连发三款"Lite、Flash"模型,但Pro再次缺席
谷歌方面并未详细解释延期原因,但在公布Flash系列的同时,首次正式提及了下一代旗舰模型Gemini 4的进展。团队表示,已经启动了Gemini 4的预训练工作,并称其为“迄今为止最雄心勃勃的预训练工作”。
这在一定程度上表明,谷歌的模型研发管线仍在持续推进,而3.5 Pro的交付节奏可能受内部测试和性能目标的影响。
美国网络科技媒体BI表示,截至Flash系列新模型发布当天,在Artificial Analysis的数学和推理等综合基准测试中,谷歌还没有一款模型进入该排行榜前十名。
新模型开放访问后,开发者社区很快传出了相当数量的负面声音。这些反馈主要集中在3.6 Flash的实际表现上。
有开发者在构建3D金门大桥场景时,反复提示了三次,模型仍持续忽略指令。最终输出质量甚至还不如5个月前发布的Gemini 3.1 Pro。

另一位开发者在Antigravity平台上测试后反馈,木头纹理质量更差,大理石缺乏功能性,在AI游戏测试中同样失利。

有用户给模型布置中等规模任务,两分钟就完成了,但结果被评价为“一个本地4B模型都能比它做得更好”。

还有人将矛头指向了性价比。
有评论指出,3.6 Flash虽然便宜,但在每个编码基准上都表现不佳。相比之下,Kimi K3和GLM 5.2等模型由资本规模远小于谷歌的实验室打造,却交出了更好的成绩。
月之暗面作为Kimi的创建者,估值约300亿美元,与谷歌约4.5万亿美元的市值相差约150倍。开发者对此表达了困惑。
更具体的数据来自Artificial Analysis的评分。
[加西网正招聘多名全职sales 待遇优]
这条新闻还没有人评论喔,等着您的高见呢
这在一定程度上表明,谷歌的模型研发管线仍在持续推进,而3.5 Pro的交付节奏可能受内部测试和性能目标的影响。
美国网络科技媒体BI表示,截至Flash系列新模型发布当天,在Artificial Analysis的数学和推理等综合基准测试中,谷歌还没有一款模型进入该排行榜前十名。
新模型开放访问后,开发者社区很快传出了相当数量的负面声音。这些反馈主要集中在3.6 Flash的实际表现上。
有开发者在构建3D金门大桥场景时,反复提示了三次,模型仍持续忽略指令。最终输出质量甚至还不如5个月前发布的Gemini 3.1 Pro。

另一位开发者在Antigravity平台上测试后反馈,木头纹理质量更差,大理石缺乏功能性,在AI游戏测试中同样失利。

有用户给模型布置中等规模任务,两分钟就完成了,但结果被评价为“一个本地4B模型都能比它做得更好”。

还有人将矛头指向了性价比。
有评论指出,3.6 Flash虽然便宜,但在每个编码基准上都表现不佳。相比之下,Kimi K3和GLM 5.2等模型由资本规模远小于谷歌的实验室打造,却交出了更好的成绩。
月之暗面作为Kimi的创建者,估值约300亿美元,与谷歌约4.5万亿美元的市值相差约150倍。开发者对此表达了困惑。
更具体的数据来自Artificial Analysis的评分。
[加西网正招聘多名全职sales 待遇优]
| 分享: |
| 注: | 在此页阅读全文 |
| 延伸阅读 | 更多... |
推荐: