10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 小程序 标签云

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

Qwen 3.8 Max 实测:与 Kimi K3 三场景对比,工程严谨度更胜一筹

1周前 AI最新动态 405 0

两周多前实测 Kimi K3 时,结论是国产模型已经摸进了第一梯队。

本周 Qwen 3.8 Max 发布,我的第一反应是没兴趣——印象里它的编程能力不太行。

但 Qoder 正好在送 800 次免费调用,于是我用 K3 那次测过的三个场景原样再跑了一遍,结果出乎意料。

图片 1

三个场景打平,有一个地方 Qwen 3.8 Max 还做得更好。

Qwen 3.8 Max 是什么

2.4 万亿参数、950 亿激活的 MoE 架构,100 万 token 上下文。API 价格每百万 token 输入 2 美元、输出 6 美元,输出价约为 Claude Fable 5 的八分之一。官方定位"仅次于 Fable 5",下周开源权重——这是 Qwen Max 级别模型首次开放权重。

图片 2

在 Qoder 中,Qwen 3.8 Max 是 0.5x Credit,错峰时段(晚 10 点到早 8 点)再打 5 折,上下文 200K / 400K / 1M 三档可选。新用户注册可领 1100 次免费调用。

图片 3

图片 4

测试方案

三个场景和 K3 那次完全相同:从零做一个视频工作台、一个实时选座票务系统、一个物理驾驶小游戏。提示词整理为完整版一次性给出,验收标准更细。两边都是"模型 + 自家框架"的工作流对比(Qwen + Qoder vs K3 + Kimi Code),不是裸模型横评。全程 YOLO 模式,未人工干预。

场景一:视频工作台

对标剪映的纯前端剪辑工具,需要素材库、节目预览、多轨时间轴、片段检查器、撤销重做、本地持久化。功能层面和 K3 版打平,但界面更克制——深色编辑器配色,AI 生成味道更轻。还多出轨道锁定和静音、片段边缘修剪、左右方向键逐帧定位、窄屏只读审片模式等专业功能。

图片 5

工程上提交了 28 个单元测试全部通过,TypeScript 类型检查零错误。

场景二:实时选座票务系统

这是最重的需求:消费者端选座购票,运营后台管理场馆和演出,中间是锁座、支付、出票、退款、候补、核销的完整状态流转。架构是真后端——PostgreSQL 存数据,Redis 传实时事件,SSE 推座位状态,Worker 处理锁座过期和候补派位,Docker Compose 一键拉起。

图片 6

功能基线一项不少,工程细节更讲究:锁座原子操作、支付接口带幂等键、重复核销返回 409、候补排队有 24 小时防饿死机制。后台九个模块全部实测通过,浏览器控制台零报错。

图片 7

场景三:物理驾驶小游戏

对照 Drive Mad 玩法做原创游戏,前进/后退控制车辆越障,五个主题关卡。Qwen 版明确使用了 planck.js(Box2D 系物理引擎),悬挂弹簧、碰撞冲量、低重力和冰面摩擦的逐关调参都是真的。五关机制密度明显更高:工地有关卡内推箱垫路,冰原有相位旋转杆,火山有落石区加连续断桥。

图片 8

即死机制逐个验证全部真实触发。难度比 K3 版高,冰原和火山要卡时机。项目自带 23 个测试全部通过,包含五个关卡的无头仿真通关。

图片 9

最让我意外的一点

三个场景耗时都比 K3 长一点,但不是模型慢——而是它每写完一个场景会自己打开浏览器做验收。做视频工作台时发现预览在后台标签页里 rAF 节流卡住,主动改成 rAF + setInterval 双驱动;做订票系统时先检查环境、拉 Docker、跑 25 个测试再进浏览器走流程。

图片 10

慢的那部分时间,花在了自己给自己验收上。这个东西跑分表里看不到,但它恰恰是工程师判断敢不敢把活交给它的依据。

最后

对 Qwen 的偏见这次算是被打掉了。三个相同场景,功能打平,工程严谨度上还略强。当然它拿到的提示词更完整、没有真实项目对照,结论需要打折扣。但即便打完折扣,Qwen 已经悄悄换了位置——国产模型这一次,是真的追上来了。

如果你也好奇它到底什么水平,建议去下载 Qoder,新用户可领 1100 次免费调用,拿你手头一个真实场景丢给它跑一次。你自己的任务,比任何评测都更能替你下判断。

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:Qwen 3.8 Max 实测:与 Kimi K3 三场景对比,工程严谨度更胜一筹
#Qwen 3.8 Max #Kimi K3 #AI模型评测 #Qoder #AI编程 
收藏 1
万有无界:阿里多 Agent 协作办公平台,从目标到交付的全流程拆解
选择 TRAE Work 的 20 个理由:从打开即用到安全兜底的 AI 生产力平台
推荐阅读
  • MiniCPM-V 4.6:1B参数端侧多模态模型发布
  • LiblibAI 重磅发布 Vidu Q2:视频多主体参考,更自然、更可控的生成体验
  • 各大平台免费 AI 大模型 + API汇总
  • Wan 2.6:角色与音色可参考,多镜头更稳定,短视频制作更可控
  • Cursor 教育优惠风险提示:SheerID验证error、学信网二次审核、国科大研究所等可能引发Cursor 风控
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
33193 1年前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
29659 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
22703 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
21809 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
18874 4月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
17836 3月前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
17782 1年前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
17359 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
17270 1年前
刚刚!Cursor风控又加强了,可能是因为这个原因!
16035 1年前

文章目录

关注「苏米客」公众号

订阅推送更及时,手机查看更方便
分类排行
1 智谱ZCode 3.0升级:面向GLM-5.2深度优化,缓存命中率98%,限时额度1.5倍
2 DeepSeek 官宣 API 整体涨价:免费 Token 时代倒计时,开发者如何应对
3 MiniMax-H3-Turbo-Lora:8 步推理加速视频生成,质量不输原生 20 步
4 DeepSeek V4 Flash 内置联网搜索:Responses API 原生支持 web_search,Codex 可直接调用
5 GPT-5.6 更新:Luna 免费无限文本,Sol 统一付费 Chat 快答与深思
6 Cherry Studio V2.0 正式发布:从 AI 聊天客户端到 Agent 自主执行的全能工作站
7 Qwen-Image-3.0正式上线千问AI平台:Arena.ai文生图榜单国内第一,4.5k token复杂版面一次生成
8 Qwen 3.8 Max 实测:与 Kimi K3 三场景对比,工程严谨度更胜一筹
9 Qwen3.8-Max 评测:自主编程 16 天、2.4 万亿参数,能否挑战 GPT?
10 Qwen3.8-Max 上线:2.4 万亿参数,自主编程 16 天,API 首发千问 AI 平台
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联