谷歌新推Gemini 3.6系列模型,Gemini 3.6 Flash口碑为何滑铁卢?
早期实测显示,该模型在前端界面生成与空间推理方面表现极差,被用户戏称为「史上最差」。谷歌「史上最差」AI模型发布!谷歌新模型,上线就被骂「史上最差」了。从前端到空间推理,得到的全是差评。这番言论背后,是开发者对谷歌「版本号游戏」的深层厌恶。据CNBC报道,这是谷歌「有史以来规模最大的预训练项目」。
版本虚高引发众怒
谷歌于近期推出的3.6 Flash模型, 甫一出现便迅速遭受全网范围的群嘲。开发者们经细致观察后发觉, 这款自称为进阶版本的产品, 于前端代码生成方面的状况简直糟糕透顶。不但界面逻辑呈现错乱态势, 而且组件嵌套也极为混乱无序, 导致其根本无法直接投入使用。
Flash系列主打轻量级, 却出现这种低级错误, 甚是讽刺。许多原本指望借此系列快速搭建原型的团队, 只得以换回旧模型。用户在社交媒体上毫不隐晦, 评定其为“史上最差”, 情绪传播迅猛。
空间推理全面退步
不算代码能力欠佳, 3.6 Flash于空间理解方面也展现得差劲。测试表明, 它针对基础的位置关系以及方向判断准确率锐减。甚至有人录制视频逐帧剖析, 发觉生成的物体反射与纹理皆存在显著Bug。
更令人无语的是, 即便开启了高性能模式, 然而效果却依旧差强人意。拿去跟以前的版本作对比, 此次更新不但没有进行提升, 反倒出现了显著的性能后退。这样一种逆向升级的操作, 将长期依赖谷歌模型的技术社区彻底激怒了。
知识截止严重滞后
此外功能有所欠缺, 3.6 Flash的知识储备也遭人质疑。官方称其知识截止时间为2026年3月, 然而实际测试显示, 它对2025年的多数事件都毫无所知。其真实水准好像仍停留在2025年初。
如此严苛的货不对板状况, 致使外界生出这般怀疑, 认定这仅仅是一个尚在进程中的产物。于AI范畴之内而言, 时效性具备极其关键的意义, 知识呈现滞后意味着模型根本没法供给具备价值的即时的数据讯息给用户。那些开发者持有这样的看法, 以存在着这样的缺陷的状态去开展发布行动, 这绝对是对用户所拥有的时间的极大浪费行径。
竞品对比毫无优势
参与到和Meta Muse Spark、GLM以及别的主流模型的横向测评里, 3.6 Flash所获分数表现平常。甚至于在一部分基准测试当中, 它还被旧版本的3.5 Flash给超过了。除了视觉方面、上下文层面存在着些许微弱领先情形外, 整体的竞争力基本就是不存在的状态。
被网友讽刺称, 这等同于以更高的价钱购得了更低效率的服务, 与之相较, 竞争对手不但速度快, 并且稳定可靠, 谷歌此番的操作, 好似对着市场说: 我们能够随意去降低标准, 反正你们也没有别的选择。
3.5 Pro延期真相
在舆论风暴迎面而来之际, 谷歌作出解释表明, 3.5 Pro当下尚未准备妥当, 正全力以赴地开展下一代4.0模型的研发。有传言称, 此乃谷歌经历过超大规模的预训练方面项目, 其进程状况令人心生兴奋之情。然而, 这般说法却极难以让愤怒得以平息下来, 缘由在于3.5 Pro的未到庭使得用户内心有一种被忽略的感受。
不少人觉得, 这是因财报数据而强行去发布未完成品, 在当下算力严峻短缺的情势下, 发布一个逻辑搅乱的模型, 被视作是一种失职行径, 用户期望看到的是能够解决实际问题且真正有用的工具, 并非只是为了有个版本号而呈现的毫无价值的数字废物。
开发者信任危机
谷歌当前这般行为, 正于消耗着开发者长久以来所怀有的信任。大家已然对这种称作“版本号游戏”之类的状况感到厌烦, 更侧重于实际所具备的效用而非那些单纯的营销噱头。倘若持续以牺牲质量为代价来换取发布的节奏, 极有可能会致使失去整个生态给予的支持。
现今, AGI竞赛愈发激烈, 口碑一旦垮塌, 再重建就会极为艰难, 用户开始慎重思考转而投向其他更具稳定性的平台, 谷歌能不能扭转局势, 取决于后续3.5 Pro以及4.0的呈现状况, 还有愿不愿意直面用户的指责。
是觉得谷歌应当先去发布稳定的3.5 Pro, 还是要坚持推进4.0的研发, 你? 欢迎于评论区里面留言展开讨论, 可别忘了点赞以及分享!