#模型
阿里 CosyVoice Studio 实测:一站式 AI 语音平台,能听能说能聊
8 月初,阿里接连发布多个重磅产品。
千问办公开启公测,对标 WorkBuddy;Qwen3.8-Max 正式上线,总参数量 2.4 万亿;视频生成模型 Wan3.0 开启公测,单次可生成 30 秒视频。
不过最值得关注的是阿里新上线的 C…
AirLLM:4GB 显存跑 70B 大模型的逐层加载推理方案
之前通过 Ollama、SGLang 在本地部署过大模型的朋友都知道,受限于显卡显存,基本上只能部署小参数且量化后的模型。
这些模型在本地跑基本是残血状态,拿来玩玩还可以,但效果往往差强人意。
最近在 GitHub 上发现一个 3 万 St…
SenseNova U1.5-Lite-Preview 开源:8B 轻量级统一多模态模型,支持 4K 图像生成与编辑
今年 4 月,商汤科技发布了 SenseNova U1,首次完整展示了基于 NEO-Unify 架构的原生统一多模态路线。如今商汤持续强化模型的图像生成与编辑能力,正式开源轻量级统一多模态模型的预览版本 SenseNova U1.5-Lit…
Qwen 3.8 Max 实测:与 Kimi K3 三场景对比,工程严谨度更胜一筹
两周多前实测 Kimi K3 时,结论是国产模型已经摸进了第一梯队。
本周 Qwen 3.8 Max 发布,我的第一反应是没兴趣——印象里它的编程能力不太行。
但 Qoder 正好在送 800 次免费调用,于是我用 …
Qwen3.8-Max 评测:自主编程 16 天、2.4 万亿参数,能否挑战 GPT?
先是 GLM5.2,然后是 Kimi K3,现在是 Qwen3.8-Max。从 6 月开始,国产大模型在 Coding 和 Agent 领域明显加速,与海外顶级 SOTA 的差距正在肉眼可见地缩小。
参数与定价
Qwen3.8-Max 沿…
Modal 每月免费 30 美元:轻松部署 Kimi K3 等开源模型
Kimi K3 的完整模型权重正式开源后,多家云服务商开始陆续提供支持。今天介绍一个可以免费使用 K3 等开源模型的平台——Modal。其 Starter 套餐每月免费提供 30 美元的计算额度,支持多种国产开源模型…
Qwen3.8-Max 上线:2.4 万亿参数,自主编程 16 天,API 首发千问 AI 平台
阿里巴巴新一代基座大模型 Qwen3.8 正式发布,千问 AI 平台同步首发上线 Qwen3.8-Max 的 API 服务与 Token Plan,面向开发者与用户全面开放新模型调用。
核心能力
Qwen3.8 总参数量达 2.4 万亿,…
Kimi K3 对比 DeepSeek V4 Flash:2.8 万亿参数与 50 倍价差的路线之争
2026年7月,中国大模型赛道接连投下两枚重磅炸弹。7月17日,月之暗面在 WAIC 上海发布 Kimi K3——全球首个 3 万亿级别的开源模型,以 2.8 万亿参数将开源阵营推入新纪元。仅仅两周后,7月31日,D…
MiniMax H3 开源:全模态视频生成模型,支持 2K/15 秒/立体声
MiniMax 正式开源了新一代通用视频模型 H3。这是一个全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。得益于以任务泛化为导向的系统设计,H3 …
DeepSeek V4-Flash 正式版:284B 参数九项 Agent 测试全胜,对标 Claude Opus 4.8
DeepSeek-V4-Flash 正式版已发布
该模型以 284B 总参数(每 token 激活 13B)的体量,在九项 Agent 基准测试中全部超过此前最强的 DeepSeek-V4-Pro 预览版(1.6T 总参数,激活 49B)
…