10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 小程序 标签云

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

智谱发布牛来模型:对标DeepSeek的国产大模型新突破

1小时前 AI最新动态 15 0

前几天 OpenRouter 上出现了一个匿名模型 Ox Alpha,免费开放,五天流量累积超过 50T,刷新了平台历史纪录的四倍。全网都在猜它是谁。Gemini 团队的人跑来认领,说是自家的。结果谜底揭晓:智谱,GLM-5.3 Flash。

这件事本身就很有意思。一个中国公司的模型,匿名扔到海外平台上,不靠品牌、不靠营销,纯粹凭实力把流量吸干。这说明什么?说明模型能力到了某个阈值之后,开发者是用脚投票的,他们不在乎你叫什么名字。

一个轻量模型凭什么打旗舰

GLM-5.3 Flash 的参数量是 321B,大概是自家 GLM-5.3 的 40%。按照过去的经验,小模型通常是从大模型蒸馏出来的,能力打个折扣,价格便宜点,各取所需。但智谱这次走了一条不同的路:完全重新设计架构,底层的混合注意力机制整个重写。

图片 1

具体来说,每次激活的参数从 32B 砍到 18B,层数几乎减半。局部依赖交给线性递归处理,全局上下文用轻量级索引器去捞,再加上一个叫 IndexPool 的池化技术把缓存向量压缩。整套操作下来,注意力计算量降了三倍,KV 缓存降了四倍多。

图片 2

结果就是:智谱内部评测,GLM-5.3 Flash 的 Artificial Analysis Intelligence 分数是 57 分,超过了上一代旗舰 GLM-5.2,和 Claude Opus 4.8 持平,比 DeepSeek V4 Pro 正式版的 53 分还高。一个轻量级模型,智能水平摸到了顶级旗舰的天花板。

图片 3

而它的价格是:输入 0.8 元,输出 2.8 元,每百万 token。上线前两周半价。对比 Claude Opus 4.8 海外输出价格 25 美元,GLM-5.3 Flash 海外输出价格 0.5 美元。四十分之一。

同时,GLM-5.3 Flash 支持多模态了,智谱这一点让我很欣慰啊。

DeepSeek 涨价撕开的口子

要理解这件事的意义,得先看背景。

八月份 DeepSeek 全面涨价。V4 Pro 从 6 元涨到 13.5 元,高峰 27 元;V4 Flash 输出从 2 元涨到 4.5 元,高峰 9 元。官方理由是算力稀缺,长期低价侵蚀现金流。梁文锋之前说过“智能需求没有弹性”,但市场给出了不同的答案:涨价后,OpenCode 上 DeepSeek V4 Flash 的调用量直接掉了一半。

需求当然有弹性。特别是轻量级旗舰这个区间,用户对能力有底线要求,但在底线之上,价格敏感度极高。DeepSeek 涨价等于主动让出了一块市场,而智谱精准地切了进来。

综合输入输出成本,GLM-5.3 Flash 在绝大多数常规调用场景下比涨价后的 DeepSeek V4 Flash 更便宜。考虑到它的智能分数还更高,这个性价比几乎是碾压级的。

国产芯片的一次硬核证明

还有一个容易被忽略的细节:Ox Alpha 匿名测试期间那恐怖的全球流量,全部由国产芯片集群承接。10 万张以上的国产卡,算力供应商据悉来自华为、摩尔线程与海光。

智谱在技术文档里说,集群的硬件效率和单位 token 成本已经达到了主流英伟达 GPU 相当的水平。这句话如果属实,意味着国产算力在大规模推理场景下已经不再是“能用但贵”或“能用但慢”的状态,而是真正具备了商业竞争力。

更有意思的是,智谱在构建这套国产卡集群的过程中,让 GLM-5.3 驱动的基建智能体去帮忙优化算子、诊断性能瓶颈。大模型帮着优化自己要跑的系统,这个正向循环一旦跑通,后续的迭代速度会越来越快。

轻量旗舰赛道的终局猜想

我的判断是:轻量旗舰模型正在成为 AI 行业真正的主战场。

顶级旗舰模型的能力天花板还在往上走,但大多数实际应用场景需要的是“够用的智能加上足够低的成本”。当轻量模型的智能水平已经能和上一代甚至同代旗舰持平,价格却只有十分之一到四十分之一,理性的开发者没有理由不迁移。

我感觉在国内市场,这个趋势会更加剧烈。模型选择多、能力差距小,厂商不仅要和同行竞争,还要面对开源部署和云厂商赠送额度的压力。模型很难作为稀缺品定价,更接近标准云服务。谁能在这个区间里做到能力最强、成本最低、生态最开放,谁就能吃下最大的调用量。

智谱这次的动作,时机、产品、定价都卡得很准。但这只是开始。DeepSeek 涨价撕开的口子,不会只有智谱一家看到。接下来几个月,这个赛道会挤满玩家。对开发者来说,这当然是好事。对模型公司来说,真正的淘汰赛才刚刚开始。

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:智谱发布牛来模型:对标DeepSeek的国产大模型新突破
#智谱 #牛来模型 #DeepSeek #国产大模型 #AI 
收藏 1
豆包工作8个技巧:飞书Agent实测指南
飞鼠格式:支持80+格式的本地文件转换工具,开源免费无广告
推荐阅读
  • OpenAI o3-pro震撼发布:价格砍一刀,性能翻一倍,值得一试!
  • 对标Cursor、Kiro,腾讯CodeBuddy IDE 最新深度实测体验
  • Qwen3.8-Max 评测:自主编程 16 天、2.4 万亿参数,能否挑战 GPT?
  • 火山方舟Coding Plan 和 Agent Plan 系列套餐 618特惠9.9元起,旗舰模型19元购
  • Uizard:Autodesigner 2.0 AI生成式辅助UI设计工具,产品经理+UI设计
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
33569 1年前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
30042 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
23116 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
22239 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
19782 5月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
18332 4月前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
18039 1年前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
17850 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
17624 1年前
刚刚!Cursor风控又加强了,可能是因为这个原因!
16239 1年前

文章目录

关注「苏米客」公众号

订阅推送更及时,手机查看更方便
分类排行
1 智谱发布牛来模型:对标DeepSeek的国产大模型新突破
2 人形机器人务实转向:从炫技到落地,先找活干再长身体
3 Ox Alpha正式开源:V4Flash价格、Opus4.8能力,国产大模型新突破
4 RunningHub 上线 Wan3.0:文档/PPT 直接生视频,480P 仅 0.05 元/秒
5 Sub2API 重要提醒:OpenAI 明确不支持账号共享,核心功能停止开源
6 Qwen3.8-Flash上线:Next架构MoE模型,输入0.8元/百万Tokens,缓存低至0.1元
7 阿里低调上线 HappyShrimp 音乐模型:对比 Suno 和 MiniMax,5 美元/月 150 首
8 ChatGPT Pro 降智应对指南:网页版被偷偷换模型?投屏方案解决降智问题
9 Grok Bot 开放免费试用:专属云电脑+自主执行,取消插件的 Agent 新范式
10 GLM 5.3 实测:750B 参数后训练逼平 GPT-5.6,复杂编码与安全能力全面评测
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联