首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 >Hy-MT2-30B-A3B模型私有化部署速度慢怎么解决?

Hy-MT2-30B-A3B模型私有化部署速度慢怎么解决?

提问于 2026-08-20 19:20:20
回答 0关注 1查看 7

本地部署了Hy-MT2-30B-A3B这个模型,我的部署环境是一张A100/80G显卡,部署工具是xinference,推理引擎时transformers,用来做翻译。现在发现翻译速度非常慢,一份20页的文档翻译完要25分钟,而且完全没有并发量,单批次送入的长度100-900toekn不等,用在线的api尝试,Hy-mt2-pro,90秒就翻译完了,同样的配置下。想知道本地部署的模型要怎么优化。

回答

和开发者交流更多问题细节吧,去 写回答
相关文章

相似问题

相关问答用户
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档