
昨天(8 月 28 日)腾讯混元发了新旗舰模型 Hy4 preview,打开 WorkBuddy 一看,模型列表里多了一个选项,和原来的 Hy3 并排摆着。很多人第一反应是:这俩到底差啥?我该用哪个?今天不讲虚的,直接把参数、新特性、还有你在 WorkBuddy 里怎么切模型说清楚。
总参数:Hy3 295B | Hy4 770B
每次激活:Hy3 21B | Hy4 49B
上下文长度:Hy3 256K | Hy4 1M
架构:Hy3 稠密 | Hy4 MoE(256 个专家,每次激活 8+1)
费用:Hy3 免费 | Hy4 WorkBuddy 限时两周免费
定位:Hy3 日常通用 | Hy4 生产力优先、开源第一梯队
简单翻译:参数涨了近 3 倍,每次回答动用的算力翻一倍多;上下文从 256K 拉到 1M,意味着一次能塞进约 4 倍长的材料。长文档、大代码库、连续多轮对话,更不容易丢掉前面的信息。
1. 为"干活"而生。 腾讯给它的定位是"生产力模型",和 WorkBuddy、CodeBuddy 一起调过。写代码、做带排版的 PPT、分析表格、跑游戏原型,都比上代明显强一截。
2. 1M 超长上下文。 就是上面那张表里的 1M,前面解释过了。
3. 开源。 Apache 2.0,权重放出来了,开发者能自己部署、自己改。
4. 会"自己改自己"。 腾讯透露 Hy4 已经参与自身研发——提方案、跑实验、读结果,实验产生的代码和日志喂回下一轮训练,端到端吞吐比基线提升 31.8%。这算是初步的"递归自我改进"。
5. 真实盲测不虚。 腾讯内部 163 名专家、203 个工程任务盲测,Hy4 均分 2.99/4,略高于 GLM 5.3(2.92)和 Kimi K3(2.94)。官方也明说这是早期预览版,"还有较大提升空间",下一版近期会上。
- 日常轻量:写个短文、改句话、简单问答 → 用 Hy3,免费、稳定、不排队。
- 复杂任务:长文档总结、整站代码生成、做带排版的 PPT、跨文件分析 → 上 Hy4。
- 两个坑要注意:Hy4 刚发布排队人多;而且复杂任务"想得久"、容易反复自检(官方叫"过度自验证"),等待时间偏长。真着急别死等。
怎么切模型(实际操作):打开 WorkBuddy 任意一个对话,找到右上角或输入框附近的"模型选择"下拉,点一下就能在 Hy3 / Hy4 preview 之间切换。这是对话级切换,不影响你别的会话,随时换。
举个实在的例子:你要让 WorkBuddy 读一份 200 页的 PDF 财报再写总结,Hy3 的 256K 上下文大概率装不下全本,得你先手动拆成几份;Hy4 的 1M 能一次吃进去,直接出结果。这种"长材料一次搞定"的活,就是 Hy4 的主场。反过来,你就想让它改个标题、回句话,Hy3 秒回还不排队,没必要等 Hy4。
别光盯着跑分看。拿一件你上周刚做过的活——一篇要改的稿子、一份很长的资料——让 Hy4 和你常用的模型各跑一遍,很快就能看出谁理解更准、谁更少返工。榜单决定一个模型能不能被看见,返工次数决定它能不能留下来。
你这几天用 Hy4 跑过什么任务了?比 Hy3 强在哪、或者哪里还翻车?评论区聊聊,我下期接着写 WorkBuddy 实战(插件和连接器、怎么用 GitHub 装 Skill 都安排上)。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。