智谱发布原生多模态模型 GLM-5.3 Flash,全程跑在国产芯片上
智谱发布并开源 GLM-5.3 Flash,性能追平顶尖模型但价格极低,且全部算力跑在国产芯片上,让前沿 AI 更便宜、更自主。
智谱开源 GLM-5.3 Flash,这是 GLM-5 系列首个原生多模态模型。它参数 320B,实际激活仅 18B,性能却超越上一代,在 AGI 评测中拿到 57 分,与 Claude Opus 4.8 持平,价格却仅为后者的 1/40。该模型能处理视频配字幕、电影解说、UI 设计稿生成交互应用等任务,且所有训练和推理均在国产芯片上完成,降低了前沿模型的使用成本。
正文摘录
终于,这几天在网上炒得沸沸扬扬的神秘模型「牛来」(Ox Alpha),真身曝光了! 是智谱刚刚发布即开源的 GLM-5.3 Flash,还是 5 系列里首个原生多模态的那种。 其中玩儿得比较多的,便是手搓一个 SpaceX Raptor 猛禽发动机 3D 交互网页。 例如博主 Tim Jayas 时隔几日,用同样的 Prompt 让「牛来」做了两次这个任务后,直接发出了这样的感慨: 巧了,我们刚好也拿到了 GLM-5.3 Flash 的内测资格,也做了同款的项目;在我们输入完 Prompt 之后,全程无需任何操作: 视频地址: https://mp.weixin.qq.com/s/wNQAWeUacfB8a1FkQZeg 从效果对比来看,嗯,无需多言,GLM-5.3 Flash 做出来的 3D 猛禽引擎,更精进了。 例如在 OpenRouter 上,「牛来」首日便冲上了榜首,还刷新了刷新单日 tokens 用量历史纪录: OpenCode 则表示,Ox Alpha 一出世,即终结了 DeepSeek 在 OpenCode 连续 56 天霸榜的纪录: 在模型尺寸方面,GLM-5.3 Flash 仅为 320B ,但在能力上全面超越了体量为 753B 的 GLM-5.2。 除此之外,根据最新的 AA 榜单显示,GLM-5.3 Flash 已经拿下 57 分 ,放眼全球范围内已然是步入前沿之列,并且与 Claude Opus 4.8 得分持平。 在价格方面,GLM-5.3 Flash 的定价是 5.3 版本的 1/10,限时折扣为 1/20 的 GLM-5.3,1/40 的 Opus 4.8,定价低于 DS-V4-Flash。 上面提到的 62T Tokens 都跑在国产卡上!原来老外追了一个月的神秘模型,是头纯血国产牛。