#开源模型
Modal 每月免费 30 美元:轻松部署 Kimi K3 等开源模型
Kimi K3 的完整模型权重正式开源后,多家云服务商开始陆续提供支持。今天介绍一个可以免费使用 K3 等开源模型的平台——Modal。其 Starter 套餐每月免费提供 30 美元的计算额度,支持多种国产开源模型…
Qwen3.8-Max 上线:2.4 万亿参数,自主编程 16 天,API 首发千问 AI 平台
阿里巴巴新一代基座大模型 Qwen3.8 正式发布,千问 AI 平台同步首发上线 Qwen3.8-Max 的 API 服务与 Token Plan,面向开发者与用户全面开放新模型调用。
核心能力
Qwen3.8 总参数量达 2.4 万亿,…
Kimi K3 对比 DeepSeek V4 Flash:2.8 万亿参数与 50 倍价差的路线之争
2026年7月,中国大模型赛道接连投下两枚重磅炸弹。7月17日,月之暗面在 WAIC 上海发布 Kimi K3——全球首个 3 万亿级别的开源模型,以 2.8 万亿参数将开源阵营推入新纪元。仅仅两周后,7月31日,D…
MiniMax H3 开源:全模态视频生成模型,支持 2K/15 秒/立体声
MiniMax 正式开源了新一代通用视频模型 H3。这是一个全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。得益于以任务泛化为导向的系统设计,H3 …
DeepSeek V4-Flash 正式版:284B 参数九项 Agent 测试全胜,对标 Claude Opus 4.8
DeepSeek-V4-Flash 正式版已发布
该模型以 284B 总参数(每 token 激活 13B)的体量,在九项 Agent 基准测试中全部超过此前最强的 DeepSeek-V4-Pro 预览版(1.6T 总参数,激活 49B)
…
2026 年 RAG Embedding Model 选型指南:六类场景与三条过时经验
2026 年,RAG 系统的 Embedding 模型选择不再是一刀切的答案。不同场景、不同预算、不同数据形态,需要不同的模型。本文梳理了六类典型场景的最优选择,以及三条 2025 年曾被视为常识、如今已过时的经验。
场景一:通用型商业 …
MiniMax H3视频模型上线:开源路线、多模态输入、0.23元/秒对标Seedance
MiniMax 近日正式上线 H3 视频生成模型,带来了一项关键升级:支持"全能参考"模式。与此前的首尾帧生成方式不同,H3 允许用户直接输入人物形象、场景素材、音频片段等多模态内容,模型自动理解并生成连贯视频。这种工作流的改变,大幅降低了…
Kimi K3 开源:全球首个 3 万亿参数 MoE 模型,100 万 token 上下文
月之暗面 Kimi K3 模型如约开源。这是全球首个 3 万亿参数级别的开源模型,采用 MoE 架构,总参数 2.8 万亿,实际激活参数 1040 亿,支持 100 万 token 上下文窗口,同时具备原生视觉理解能力。
核心结论:Kim…
Kimi K3 开源:2.8 万亿参数 MoE 架构,100 万 token 上下文,训练效率提升 2.5 倍
Kimi K3 模型权重正式开源,参数量达到 2.8 万亿,实际激活参数 1040 亿,支持 100 万 token 上下文窗口,同时具备原生视觉理解能力。这是目前公开的首个 3 万亿参数级别的开源模型。
核心结论:Kimi K3 在综合能…
Macaron-V1:基于 GLM-5.2 的 MoL 架构个人智能体,2M 上下文 + 四大专家 LoRA
心洲科技旗下 Mind Lab 实验室开源了 Macaron-V1 模型——全球首个基于 GLM-5.2 完成后训练的个人智能体模型。该模型采用 MoL(Mixture of LoRA)架构,在 GLM-5.2 基座…