腾讯低调发布Hy3:21B激活参数打平旗舰,已接入微信10亿+用户

AYi · @AYi_AInotes · X·2026-07-12 14:39·45天前
AI 导读

腾讯低调发布Hunyuan Hy3,295B总参数、21B激活参数的MoE架构,以旗舰模型2-5倍的参数规模打平其性能。Hy3定位为Agent向LLM,基于50多个真实业务反馈迭代,内部WorkBuddy任务成功率从72%提升至90%,耗时降低34%。低推理成本使其能规模化部署至微信10亿+用户。Hy3在coding、办公、复杂任务规划方面表现突出,但纯视觉能力仍有短板。

AYi@AYi_AInotes
68AI 编辑部评分,满分 100

腾讯低调发布Hy3:21B激活参数打平旗舰,已接入微信10亿+用户

2026-07-12 14:39· 45天前
AI 导读

腾讯低调发布Hunyuan Hy3,295B总参数、21B激活参数的MoE架构,以旗舰模型2-5倍的参数规模打平其性能。Hy3定位为Agent向LLM,基于50多个真实业务反馈迭代,内部WorkBuddy任务成功率从72%提升至90%,耗时降低34%。低推理成本使其能规模化部署至微信10亿+用户。Hy3在coding、办公、复杂任务规划方面表现突出,但纯视觉能力仍有短板。

最近当大家都在刷屏Fable 5和GPT-5.6 的时候, 殊不知腾讯已经悄无声息的把大模型能力给追上来了。

你们知道腾讯低调到什么程度吗? 前几天发布的Hy3 ,21B的激活参数已经可以打平旗舰水准,并且直接塞进微信10 亿+用户手里 , 这才是国产大模型真正的王炸啊兄弟们!

说实话周一刷到 Hy3 发布消息那会儿, 我第一反应跟很多人一样:又一个卷参数的国产模型? 趁着周末有空,我仔细翻了一圈资料, 发现完全不是这么回事。

原来@TencentHunyuan这个模型从一开始就不是朝着聊天模型去的,人家的定位就是奔着干活去的 Agent 向 LLM。

另外最反直觉的是它的推理效率,295B 总参数, 实际激活只有 21B 的 MoE 架构, 就能打平参数是它 2 到 5 倍的旗舰模型,

这事儿我琢磨了一下,其实有点像团队管理, 并不是说人越多产出越高, 关键得看真正干活的那几个人靠不靠谱。

为什么这个效率重要呢? 你想想微信每天服务 10 亿人, token 成本多一厘都是天文数字, 21B 激活还能打出旗舰水准, 我觉得这才是它能被规模化铺开的根本原因, 跟刷榜没半毛钱关系。

说到刷榜,我仔细研究之后这个版本还真不是, 从 preview 到正式版,Hy3 是Hunyuan团队拿了50 多个真实业务的反馈不断迭代出来的,内部 WorkBuddy 任务成功率从 72% 干到 90%,耗时降了 34%,幻觉和常识错误全往下掉。

我原来以为 Agent 的核心是想得多深, 后来发现真正决定能不能上生产的,是稳不稳, 比如工具编排会不会中途崩,出错了能不能自己爬回来,换个框架差不差太多等等, 就是这些不起眼的东西, 才是能跑完一整套 workflow 不掉链子的关键。

当然实际测试下来Hy3 也有短板, 比如纯视觉它还不够强,不过腾讯也有单独的多模态大模型线,它能打的主要还是 coding、办公、复杂任务规划这几块。

最后说个我的一个判断:就是接下来大模型拼的可能不是谁参数更大了,核心看谁能把干活的能力以最低摩擦送到更多人手里,比如Hy3 我理解它可能不是一个更会聊天的模型,更像是一个更会干活的 Agent 底座。

话说回来,腾讯这步棋确实走得挺狠, 我觉得国产大模型的拐点真的要到了, 下方视频是我用Hy3跑的几个测试案例, 分别让它做了一个介绍自己的HTML网页, 一个我的认知系统agent网页, 和做了一个10页的PPT,都很惊艳,大家可以感受下, 会干活、会自检、还会主动说自己哪没做到位, 我觉得这才是 Agent 时代,真正能用的模型该有的样子hh~ #Hy3 #Hunyuan #TencentAI

AYi强烈推荐大家都去看这个跟workbudy产品负责人Jason的深度对谈播客, 另外关于腾讯workbudy,我说个暴论,你看100篇那些AI写的教程文章,都不如抽1个小时好好看看腾讯官方出品的这期播客,太他么深度了,干货拉满! Jason分享了一个关键判断让我印象特别深:2021年他曾计划培养孩子学习编程,到2026年...