公众号:卡尔的AI沃茨
同事件
71AI 编辑部评分,满分 100

实测美团LongCat-2.0,国产芯片长出来的万亿大模型

2026-07-01 16:59· 45天前· 卡尔的AI沃茨
AI 导读

美团发布LongCat-2.0,总参数1.6万亿、每个token仅激活约480亿参数的MoE模型,从预训练到大规模部署全程运行在5万张国产算力芯片上,训练消耗超35万亿tokens,无回滚、无不可恢复loss突刺。Agent场景表现突出:在Terminal-Bench 2.1和SWE-bench Pro编程任务上追平Gemini 3.1 Pro,FORTE通用Agent任务与Claude Opus 4.6持平。最大输出128K,最高提供1M上下文,采用LSA稀疏注意力机制和N-gram Embedding优化长上下文与工具调用。已开放API接入,支持OpenAI Compatible和Anthropic API生态,可直接接入Claude Code和Codex等工作流。

公众号正文需在微信内阅读,站内仅提供摘要。

在微信中打开原文

来源:公众号:卡尔的AI沃茨 · mp.weixin.qq.com

同一事件 · 6
返回
同事件AI 评分 71/100

实测美团LongCat-2.0,国产芯片长出来的万亿大模型

公众号:卡尔的AI沃茨·2026-07-01 16:59·45天前·卡尔的AI沃茨
AI 导读

美团发布LongCat-2.0,总参数1.6万亿、每个token仅激活约480亿参数的MoE模型,从预训练到大规模部署全程运行在5万张国产算力芯片上,训练消耗超35万亿tokens,无回滚、无不可恢复loss突刺。Agent场景表现突出:在Terminal-Bench 2.1和SWE-bench Pro编程任务上追平Gemini 3.1 Pro,FORTE通用Agent任务与Claude Opus 4.6持平。最大输出128K,最高提供1M上下文,采用LSA稀疏注意力机制和N-gram Embedding优化长上下文与工具调用。已开放API接入,支持OpenAI Compatible和Anthropic API生态,可直接接入Claude Code和Codex等工作流。

公众号正文需在微信内阅读,站内仅提供摘要。

在微信中打开原文(在新标签页打开)

来源:公众号:卡尔的AI沃茨· mp.weixin.qq.com

同一事件 · 6