10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 小程序 标签云

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

Qwen3.8-Flash上线:Next架构MoE模型,输入0.8元/百万Tokens,缓存低至0.1元

43分钟前 AI最新动态 0 0

千问AI平台正式上线 Qwen3.8-Flash 模型。这款采用 Next 代架构的多模态混合专家(MoE)模型,在编程和智能体任务中展现出极高的性价比。

Qwen3.8-Flash 总参数达千亿级别,但每次推理仅激活 6B(60亿)参数,创下模型效率新基准。最新定价如下:

• 输入:0.8 元/百万 Tokens(国际站 0.15 美元)

• 输出:2.7 元/百万 Tokens(国际站 0.47 美元)

• 缓存命中:0.1 元/百万 Tokens(国际站 0.016 美元)

Qwen3.8-Flash 价格表

在架构层面,Qwen3.8-Flash 引入了四项核心创新:

QSA 稀疏注意力机制。与 GDN 融合构建混合注意力架构,显著降低计算开销。在 1M Tokens 长上下文的高缓存命中场景中,推理速度提升 8 倍以上。

Gated Residual 门控残差方法。将传统 Transformer 的单一信息主通道拆分为 4 条,模型可根据任务动态决定信息读写策略,训练稳定性大幅提升。

51B N-gram Embedding 外挂参数。通过高效查表寻址为 Transformer 提供"记忆指南手册",每次 token 计算时无需参与额外计算,以极小资源消耗扩展模型容量。

结构与优化协同训练。模型架构设计与后期调优同步进行,收敛效率和训练吞吐量显著改善,直接推动训练与推理成本下降。

API 服务已在千问AI平台首发上线,开发者可通过 API 或 Token Plan 调用。千问办公"标准模式"也已内置 Qwen3.8-Flash,可覆盖 95% 的日常办公场景。

Qwen3.8-Flash-Next 模型权重已在 Hugging Face 和魔搭社区开源。

至此,Qwen3.8 系列三大尺寸模型——2.4T 参数量的 Qwen3.8-Max、Qwen3.8-27B 及 Qwen3.8-Flash——均已上线千问AI平台提供 API 服务。

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:Qwen3.8-Flash上线:Next架构MoE模型,输入0.8元/百万Tokens,缓存低至0.1元
#Qwen #千问AI #大模型 #MoE #AI开发 
收藏 1
DeepSeek Harness 完全指南:Everything is a Plugin 的 AI 编程工具
这是最后一篇
推荐阅读
  • Claude Desktop 新增定时任务:本地版 Claude Code,正在把 OpenClaw 的活变得更简单
  • 即梦悄悄上线数字人新模型OmniHuman 1.5,会跑会跳,能唱能演,还能变脸
  • 阿里 Qwen3 系列新模型:全模态AI,规模最大、能力最强的模型
  • OpenAI:AGI 时代的产业政策如何设计(白皮书全译与全新表述)
  • OpenAI o3-pro震撼发布:价格砍一刀,性能翻一倍,值得一试!
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
33527 1年前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
30002 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
23076 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
22191 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
19677 4月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
18279 4月前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
18003 1年前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
17783 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
17597 1年前
刚刚!Cursor风控又加强了,可能是因为这个原因!
16215 1年前

文章目录

关注「苏米客」公众号

订阅推送更及时,手机查看更方便
分类排行
1 Qwen3.8-Flash上线:Next架构MoE模型,输入0.8元/百万Tokens,缓存低至0.1元
2 阿里低调上线 HappyShrimp 音乐模型:对比 Suno 和 MiniMax,5 美元/月 150 首
3 ChatGPT Pro 降智应对指南:网页版被偷偷换模型?投屏方案解决降智问题
4 Grok Bot 开放免费试用:专属云电脑+自主执行,取消插件的 Agent 新范式
5 GLM 5.3 实测:750B 参数后训练逼平 GPT-5.6,复杂编码与安全能力全面评测
6 豆包桌面端工作任务升级:支持 GUI 操作电脑、飞书妙搭应用生成与画中画模式
7 Grok 4.6 发布:性能对标 GPT-5.6 Sol,API 定价性价比更高
8 DeepSeek Harness 插件生态:三天 112k Star,同事蒸馏和跨平台内容搜索火了
9 智谱ZCode 3.0升级:面向GLM-5.2深度优化,缓存命中率98%,限时额度1.5倍
10 DeepSeek 官宣 API 整体涨价:免费 Token 时代倒计时,开发者如何应对
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联