AI资讯

智谱GLM-5.3 Flash:性能超越DeepSeek V4,价格颠覆,国产模型新王炸

智能摘要

系列的首个原生多模态模型,它不仅在性能上硬刚全球顶级旗舰,更以极具颠覆性的价格和全国产算力底座,重新改写了行业竞争规则。在核心性能与价格定位上,GLM-5.3-Flash展现了跨越式的性价比。这一突破证明,国产芯片不仅能够完美承载前沿大模型,还能在大规模真实流量下保持稳定与经济。

价格颠覆传统定价逻辑

智谱AI新近发布的GLM – 5.3 – Flash 将大模型价格降至极低点, 每百万Token输入仅需0.8元。至于每百万Token输出需2.8元。缓存命中这部分每百万Token只要0.23元。且此价格约为OpenAI Opus 4.8的四十分之一。

原来使用大模型常常“节俭着用”, 唯恐token消耗过度致使钱包承受不了 , 如今这般的价格水平 , 开发者能够毫无顾忌地去尝试各类别之应用场景 , 切实达成了前沿智能走向平民化之状况。

性能对标顶级旗舰

千万别瞧价格低廉, GLM – 5.3 – Flash的性能绝非凑合之物。它的评分达57分。它超越了上一代旗舰GLM – 5.2。它比V4 Pro正式版还高出4分。

在业内, 关于同类模型的情况, 其中间值大概是39分左右, 而它呢, 直接就使得差距被拉开了18分。这意味着, 当成本出现大幅度下降的状况时, 模型所具备的能力反倒提升到了一个新的层级。

多模态视觉能力突破

GLM – 5.3 – Flash, 属于GLM – 5系列, 是首次出现的原生多模态模型。传统编程大模型, 在评判结果时, 需人类担任裁判角色, 而此模型却能够引入结合视觉编码进入整个循环之中。

进行代码编写、游戏设计或者3D场景搭建之际, 它能够主动去观察渲染所产生的结果以及交互之后给出的反馈。在官方测试期间, 模型依靠自身运行了16个小时, 从毫无基础开始搭建出了一个面积大约为400平方米的具备专业性的厨房场景。

国产算力底座

这款模型背后, 其算力全然源自国产芯片, 于智谱自身的平台之上, 全球的真实线上流量经由国产集群予以承载。

依赖专用做推理的引擎, 还有混合缓存量化以及EPD分离式架构等这类激进优化技术, 成功冲破了内存跟带宽的瓶颈, 这证实国产芯片完全能够支撑前沿大模型的大规模运行。

开源开放策略

当前, GLM – 5.3 – Flash的模型权重, 已经凭借MIT许可证, 于Hugging Face等平台开源, API也同步朝着全球开发者开放, 其门户门槛大幅削减。

这表明, 任意团队, 均能够凭借这个模型, 展开二次开发以及定制工作, 进而促使整个生态, 实现繁荣发展。

行业影响深远

GLM – 5.3 – Flash的现身, 意味着高性能、低成本与国产化适配的交融跨出了关键一步, 于此同时, 大模型行业的竞争规则被再度改写。

如若国产芯片得以承载前沿模型的实际流量, 要是价格并非使用门槛, 更多中小企业以及个人开发者便可运用顶级AI能力。这会引发怎样的改变呢? 欢迎于评论区讲述你的观点。

相关文章