首页
学习
活动
专区
圈层
工具
发布

没去求AI实验室,我自己搭了套Strix Halo模型GGUF BF16转F16的工具

我手头只有几个原本嵌了BF16张量的GGUF文件,而且都成功转成了F16,所以只用llama-bench测了这几个(这类GGUF我平时一般会筛掉,留存的本来就不多)目前看转出来的文件都能正常用

我最近在忙别的事,没做更多测试,不过结果还是挺让人有信心的,大家拿去用吧

顺便提一句,前期下载Qwen3.8-27B-Q8_0的时候,我用的是pi coding agent搭配Qwen3.6-27B-Q8_K_XL;等GGUF下好之后,就直接换成它来跑了

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OzEoA8mhINtELs4c3GYRJieQ0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。
领券