我拿 Qwen 3.8 27B(Q6_UD_K_XL 版本)开了 xhigh 思考模式,把它当作基于工具调用的智能体来用它主动做了一件事,是我从没在前沿模型上见过的,真的让我很惊喜,所以想分享一下
我正在用 GuideAnts 做一个演示:一开始给智能体一组基于 comfy-ui 的技能,然后展示如何把这些技能当作起点,转而用定义好的工具去完成最终方案,并说明为什么这么做通常更值得所以测试时,我会让它用这些技能跑文生图图生图,还有局部重绘的流程
做局部重绘测试时,我让它分好几步来:先补这块,再补那块,最后补另一块,补完告诉我一声
结果它自己决定调用 Python 工具,配合 Open AI SDK 用视觉能力去检查生成的图像质量,还发现有个表演者的头被裁掉了,或者没贴合蒙版尺寸——而且蒙版尺寸也是它通过对任务生成的图像做视觉判断自己选的
用到的图像模型如下:
qwen_image_2512_bf16.safetensors —— 生成用 UNet
qwen_image_edit_2511_bf16.safetensors —— 编辑 / 局部重绘用 UNet
qwen_2.5_vl_7b_fp8_scaled.safetensors —— CLIP / 文本编码器
qwen_image_vae.safetensors —— VAE
Qwen-Image-2512-Lightning-4steps-V1.0-bf16.safetensors —— 生成用 Lightning LoRA
Qwen-Image-Edit-2511-Lightning-4steps-V1.0-bf16.safetensors —— 编辑 / 局部重绘用 Lightning LoRA
太离谱了!