#大模型

DeepSeek 官宣 API 整体涨价:免费 Token 时代倒计时,开发者如何应对
2026 年 8 月 6 日,DeepSeek 官方发布了一则简短公告:"计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。" 没有具体数字和生效日期,但所有人都读懂了潜台词:DeepSeek 的"价…
阿里 CosyVoice Studio 实测:一站式 AI 语音平台,能听能说能聊
8 月初,阿里接连发布多个重磅产品。 千问办公开启公测,对标 WorkBuddy;Qwen3.8-Max 正式上线,总参数量 2.4 万亿;视频生成模型 Wan3.0 开启公测,单次可生成 30 秒视频。 不过最值得关注的是阿里新上线的 C…
AirLLM:4GB 显存跑 70B 大模型的逐层加载推理方案
之前通过 Ollama、SGLang 在本地部署过大模型的朋友都知道,受限于显卡显存,基本上只能部署小参数且量化后的模型。 这些模型在本地跑基本是残血状态,拿来玩玩还可以,但效果往往差强人意。 最近在 GitHub 上发现一个 3 万 St…
Qwen3.8-Max 评测:自主编程 16 天、2.4 万亿参数,能否挑战 GPT?
先是 GLM5.2,然后是 Kimi K3,现在是 Qwen3.8-Max。从 6 月开始,国产大模型在 Coding 和 Agent 领域明显加速,与海外顶级 SOTA 的差距正在肉眼可见地缩小。 参数与定价 Qwen3.8-Max 沿…
Qwen3.8-Max 上线:2.4 万亿参数,自主编程 16 天,API 首发千问 AI 平台
阿里巴巴新一代基座大模型 Qwen3.8 正式发布,千问 AI 平台同步首发上线 Qwen3.8-Max 的 API 服务与 Token Plan,面向开发者与用户全面开放新模型调用。 核心能力 Qwen3.8 总参数量达 2.4 万亿,…
Kimi K3 对比 DeepSeek V4 Flash:2.8 万亿参数与 50 倍价差的路线之争
2026年7月,中国大模型赛道接连投下两枚重磅炸弹。7月17日,月之暗面在 WAIC 上海发布 Kimi K3——全球首个 3 万亿级别的开源模型,以 2.8 万亿参数将开源阵营推入新纪元。仅仅两周后,7月31日,D…
阿里百炼Token Plan限时活动:Qwen3.8-Max夜间0.2折,39元Lite套餐超值体验
阿里百炼 Token Plan 个人版 Lite 套餐 39 元/月,配合 Qwen3.8-Max-Preview 首发尝鲜活动,白天模型调用消耗低至 1 折,夜间(22:00-08:00)再打 2 折,最终仅需原价的 0.2 折。39 元…
Doubao-Seed-Evolving:支持 1M 上下文、按周迭代的持续进化大模型
字节跳动豆包团队发布了新模型 Doubao-Seed-Evolving——支持 1M 上下文,并按周级别持续迭代更新。当多数模型还在数月更新一次时,Doubao-Seed-Evolving 已经实现了"每周进化"的开…
Kimi K3 深度评测:2.8T 参数开源模型,性能能否媲美旗舰?
近日,Kimi K3 正式发布,成为目前参数规模最大的开源大语言模型,引发业界广泛关注。如何看待这一模型的实际能力?本文将从多个维度进行分析。 性能表现是否接近旗舰水平? 综合多家国际评测机构的测试结果,Kimi K3 的性能表现基本可信。…
Qwen-3.8-Max 限时 0.2 折,Kimi K3 下架后的平替方案
Kimi K3 近期突然下架了部分套餐方案。从实际参数规模来看,当前算力分配可能倾向于更强性能的模型,同时兼顾合规需求的用户群体。目前该套餐已无法通过常规渠道采购。 关于 K3 的实际使用体验,综合用户反馈主要有两点: 前端表现优于后端,…