首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >#WorkBuddy# Hy3 和 Hy4 差在哪?普通用户怎么选,附切换步骤

#WorkBuddy# Hy3 和 Hy4 差在哪?普通用户怎么选,附切换步骤

原创
作者头像
GavinGeng
发布2026-08-29 18:51:19
发布2026-08-29 18:51:19
2850
举报
Hy3 vs Hy4 对比
Hy3 vs Hy4 对比

昨天(8 月 28 日)腾讯混元发了新旗舰模型 Hy4 preview,打开 WorkBuddy 一看,模型列表里多了一个选项,和原来的 Hy3 并排摆着。很多人第一反应是:这俩到底差啥?我该用哪个?今天不讲虚的,直接把参数、新特性、还有你在 WorkBuddy 里怎么切模型说清楚。

一、核心参数,一张表看懂

总参数:Hy3 295B | Hy4 770B

每次激活:Hy3 21B | Hy4 49B

上下文长度:Hy3 256K | Hy4 1M

架构:Hy3 稠密 | Hy4 MoE(256 个专家,每次激活 8+1)

费用:Hy3 免费 | Hy4 WorkBuddy 限时两周免费

定位:Hy3 日常通用 | Hy4 生产力优先、开源第一梯队

简单翻译:参数涨了近 3 倍,每次回答动用的算力翻一倍多;上下文从 256K 拉到 1M,意味着一次能塞进约 4 倍长的材料。长文档、大代码库、连续多轮对话,更不容易丢掉前面的信息。

二、Hy4 真正的新特性(不是只堆参数)

1. 为"干活"而生。 腾讯给它的定位是"生产力模型",和 WorkBuddy、CodeBuddy 一起调过。写代码、做带排版的 PPT、分析表格、跑游戏原型,都比上代明显强一截。

2. 1M 超长上下文。 就是上面那张表里的 1M,前面解释过了。

3. 开源。 Apache 2.0,权重放出来了,开发者能自己部署、自己改。

4. 会"自己改自己"。 腾讯透露 Hy4 已经参与自身研发——提方案、跑实验、读结果,实验产生的代码和日志喂回下一轮训练,端到端吞吐比基线提升 31.8%。这算是初步的"递归自我改进"。

5. 真实盲测不虚。 腾讯内部 163 名专家、203 个工程任务盲测,Hy4 均分 2.99/4,略高于 GLM 5.3(2.92)和 Kimi K3(2.94)。官方也明说这是早期预览版,"还有较大提升空间",下一版近期会上。

三、普通用户在 WorkBuddy 里怎么选

- 日常轻量:写个短文、改句话、简单问答 → 用 Hy3,免费、稳定、不排队。

- 复杂任务:长文档总结、整站代码生成、做带排版的 PPT、跨文件分析 → 上 Hy4。

- 两个坑要注意:Hy4 刚发布排队人多;而且复杂任务"想得久"、容易反复自检(官方叫"过度自验证"),等待时间偏长。真着急别死等。

怎么切模型(实际操作):打开 WorkBuddy 任意一个对话,找到右上角或输入框附近的"模型选择"下拉,点一下就能在 Hy3 / Hy4 preview 之间切换。这是对话级切换,不影响你别的会话,随时换。

举个实在的例子:你要让 WorkBuddy 读一份 200 页的 PDF 财报再写总结,Hy3 的 256K 上下文大概率装不下全本,得你先手动拆成几份;Hy4 的 1M 能一次吃进去,直接出结果。这种"长材料一次搞定"的活,就是 Hy4 的主场。反过来,你就想让它改个标题、回句话,Hy3 秒回还不排队,没必要等 Hy4。

四、给你一个不踩坑的建议

别光盯着跑分看。拿一件你上周刚做过的活——一篇要改的稿子、一份很长的资料——让 Hy4 和你常用的模型各跑一遍,很快就能看出谁理解更准、谁更少返工。榜单决定一个模型能不能被看见,返工次数决定它能不能留下来。

你这几天用 Hy4 跑过什么任务了?比 Hy3 强在哪、或者哪里还翻车?评论区聊聊,我下期接着写 WorkBuddy 实战(插件和连接器、怎么用 GitHub 装 Skill 都安排上)。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 一、核心参数,一张表看懂
  • 二、Hy4 真正的新特性(不是只堆参数)
  • 三、普通用户在 WorkBuddy 里怎么选
  • 四、给你一个不踩坑的建议
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档