10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 小程序 标签云

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

实测美团LongCat-2.0:5万张国产芯片跑出的万亿参数MoE大模型

1月前 AI最新动态 970 0

美团发布了 LongCat-2.0,一个总参数 1.6 万亿(激活约 480 亿参数)的 MoE 模型。值得瞩目的是,该模型从预训练到大规模部署,全程跑在 5 万张国产算力芯片上,耗时一个多月,处理超过 35 万亿 tokens,全程无回滚且无不可恢复的 loss 突刺。

这一成果的意义不仅在于性能,更在于它完整跑通了基于国产算力的大模型全链路。对于经常面临海外模型封号或限流风险的用户来说,LongCat-2.0 提供了一个开源、可 API 接入、能直接集成到 Claude Code 或 Codex 等工作流的国产替代方案。

图片 1

虽然 LongCat-2.0 并非全面 SOTA(在 IFEval、GPQA-diamond 等通用能力上与 Gemini 3.1 Pro、GPT-5.5 仍有差距),但在 Agent 场景下表现突出:

  • 编程任务:在 Terminal-Bench 2.1 和 SWE-bench Pro 上基本追平 Gemini 3.1 Pro。
  • 通用 Agent:在 FORTE 任务上与 Claude Opus 4.6 表现相当。
  • 上下文支持:最大输出 128K,最高提供 1M 上下文。

图片 2

核心技术:LSA 与 N-gram Embedding

为了让模型在长上下文和工具调用中保持稳定,LongCat-2.0 引入了两项关键技术:

1. LSA 稀疏注意力机制

面对超长输入时,模型不再逐字硬啃。LSA 使模型能够更有效地处理代码库阅读、文档翻阅和多步骤操作,解决 Agent 长上下文记忆和工具调用的稳定性问题。

图片 3

2. N-gram Embedding

模型不再只关注单个 token,而是对词组组合的语义更敏感,提升了对局部语境的理解能力。

图片 4

如何接入 LongCat-2.0

LongCat-2.0 兼容 OpenAI 和 Anthropic API 生态。只需更换 base_url 和 API key 即可接入现有工作流。

OpenAI 兼容接口:

base_url="https://api.longcat.chat/openai"
model="LongCat-2.0"
api_key=LONGCAT_API_KEY

Anthropic 兼容接口:

base_url="https://api.longcat.chat/anthropic"
model="LongCat-2.0"

图片 5

图片 6

实测:接入 Claude Code

将 LongCat-2.0 接入 Claude Code,测试其对杂乱工作文件夹的整理能力。模型首先读取目录结构,区分代码、文档、素材和测试文件,然后给出不破坏项目引用和运行逻辑的重组方案。

图片 7

执行过程中,模型会先拆解整理原则,分阶段处理问题:先理解项目结构,再判断文件用途,最后结合多维度分析将文件夹还原为清晰的工作系统。

图片 8

图片 9

图片 10

实测:接入 Codex 跑 Agent 工作流

测试场景:联网搜资料 → 整理大纲 → 调用 Skill → 生成演示文稿。

LongCat-2.0 首先联网搜索官方文档,确认模型特点和适用结构,然后检查当前环境中的 Skills 能力。完成资料收集和工具盘点后,再进行整体规划并生成文稿内容。

图片 11

图片 12

图片 13

图片 14

图片 15

图片 16

图片 17

生成的 PPT 内容连贯一致,从背景介绍到核心能力、测试过程和结论,没有出现典型的 AI 生成排版问题。

总结

LongCat-2.0 最值得关注的价值在于:它是一个全程国产算力训练出来的万亿模型,直接落地到了开发者可用的位置。在当前海外模型频繁封号的背景下,看到国产模型能够开源、API 接入、接入真实工作流,无疑是一个积极的信号。

虽然基础能力离顶级闭源模型仍有差距,但至少在关键时刻,我们有了一个新的选择。

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:实测美团LongCat-2.0:5万张国产芯片跑出的万亿参数MoE大模型
#美团LongCat-2.0 #国产大模型 #万亿参数 #MoE模型 #国产芯片 #开源模型 #AI行业动态 
收藏 1
吴恩达解析 Loop Engineering:AI 时代的三层开发循环
Claude Fable 5 恢复访问:周额度减半、消耗翻倍、编程可能降级 Opus
推荐阅读
  • 小红书内测小工具功能:一键上传VibeCoding作品,笔记挂载直接可用
  • 刚刚,DeepSeek V3.2 正式发布:强化 Agent 能力,融入思考推理,支持工具调用
  • Nano Banana 2.0 到底在哪里可以用?哪些入口是免费的?最全可用入口汇总
  • 字节再放大招:豆包 Seed 2.0 专家模式现已上线!
  • 纳德拉:未来开发者要管理 1000 个 AI Agent,编程不会死但工作方式会变
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
33245 1年前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
29693 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
22785 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
21867 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
18998 4月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
17911 4月前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
17818 1年前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
17433 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
17310 1年前
刚刚!Cursor风控又加强了,可能是因为这个原因!
16072 1年前

文章目录

关注「苏米客」公众号

订阅推送更及时,手机查看更方便
分类排行
1 智谱ZCode 3.0升级:面向GLM-5.2深度优化,缓存命中率98%,限时额度1.5倍
2 DeepSeek 官宣 API 整体涨价:免费 Token 时代倒计时,开发者如何应对
3 MiniMax-H3-Turbo-Lora:8 步推理加速视频生成,质量不输原生 20 步
4 DeepSeek V4 Flash 内置联网搜索:Responses API 原生支持 web_search,Codex 可直接调用
5 GPT-5.6 更新:Luna 免费无限文本,Sol 统一付费 Chat 快答与深思
6 Cherry Studio V2.0 正式发布:从 AI 聊天客户端到 Agent 自主执行的全能工作站
7 Qwen-Image-3.0正式上线千问AI平台:Arena.ai文生图榜单国内第一,4.5k token复杂版面一次生成
8 Qwen 3.8 Max 实测:与 Kimi K3 三场景对比,工程严谨度更胜一筹
9 Qwen3.8-Max 评测:自主编程 16 天、2.4 万亿参数,能否挑战 GPT?
10 Qwen3.8-Max 上线:2.4 万亿参数,自主编程 16 天,API 首发千问 AI 平台
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联