我手头只有几个原本嵌了BF16张量的GGUF文件,而且都成功转成了F16,所以只用llama-bench测了这几个(这类GGUF我平时一般会筛掉,留存的本来就不多)目前看转出来的文件都能正常用
我最近在忙别的事,没做更多测试,不过结果还是挺让人有信心的,大家拿去用吧
顺便提一句,前期下载Qwen3.8-27B-Q8_0的时候,我用的是pi coding agent搭配Qwen3.6-27B-Q8_K_XL;等GGUF下好之后,就直接换成它来跑了
分享快讯到朋友圈