yeyucca同一个模型,不同的harness,不同的结果 中发帖

5090部署的qwen 3.8 27B,都是使用的UD家的Q5量化(昨天UD Dynmic 3.0的GGUF正在下载),恰好两张5090卡同时输出,一起对比,decode都是100tks左右/s的速度 
 [image] 
提示词:不借助任何输入,使用single HTML,展示黑洞, 
OMP的输出结果: 
 [image] 
Grok输出结果震惊到了,有一点点GLM 5.2出来的,视角和滚轮拖拽比Pi要更顺滑,这一波站Grok 
 [image]
 
 
Back to Top