这几天在海外开发者圈子里爆火的「神秘模型」——牛来(Ox Alpha),真身终于曝光了:原来是国产厂商智谱发布的 GLM-5.3 Flash,还是 GLM-5 系列里首个原生多模态模型,发布即开源,而且从头到尾跑在国产芯片上。 据说,这款模型此前在匿名测试阶段,就在 OpenRouter 上冲上了单日调用量榜首、刷新了历史纪录,还终结了 DeepSeek 在 OpenCode 平台连续 56 天的霸榜纪录——当时海外开发者压根不知道它是谁家的,纯粹是觉得好用才一直往里塞提示词。 为什么 320B 的模型能这么能打? 据了解,GLM-5.3 Flash 总参数 320B,实际激活只有 18B,层数也从上一代的 92 层压到 45 层,能力却全面超越了 753B 的 GLM-5.2。根据最新的 AA 榜单,它拿到 57 分,与 Claude Opus 4.8 持平,已步入全球前沿行列。价格更是打到「骨折」:定价只有 GLM-5.3 的 1/10,限时折扣相当于 Claude Opus 4.8 的 1/40,低于 DeepSeek V4 Flash——前沿模型第一次这么「日常消耗品」。 这次它还终于「长出了眼睛」:能看懂视频里谁在说话并精准配字幕,能把一整部电影直接解说出中文字幕视频,也能照着一张 UI 设计稿做出可交互的购物 App。而支撑这一切的 62T Tokens 推理,全部跑在国产加速卡上。 据官方介绍,模型已对全球开源,并接入 ZCode、开放 API,开发者可自行部署。模型、国产算力和开源生态,这次算是真正接到了一起。 来源:量子位(《神秘「牛来」模型果然是智谱!GLM首个原生多模态,还用的国产卡》) 原文链接:https://www.qbitai.com/2026/08/479919.html |
工具速递阶跃一口气发布五款语音大模型:StepAudio 2026-09-18
AI生活B站「AI无限竞技场」上线:百大AI模型同台P2026-09-17
业界动态荣耀发布MagicOS 11:行业首个系统级Agent 2026-09-16