GPLer【建设中】Qwen3.8-Flash-Next-FP8 效果测试 中发帖

测试环境
模型: Qwen/Qwen3.8-Flash-Next-FP8 (从权重大小来看 BF16 有爆显存风险) 
显卡: 4 x A800 80GB 
引擎: vllm/vllm-openai:qwen38-flash-next (只能用这个,v0.28.0 起不来) 
上下文长度: 256k (原生 256k 简单测测够用) 
软件: Cherry Studio 
思考强度: 默认 (xhigh) 

不启用 MTP,输出速度大概 83 token/s;启用 MTP 输出速度大概 158 token/s 

前端能力测试
鹈鹕骑车

提示词: 创建一个HTML,内容是SVG绘制一个鹈鹕骑自行车的2D动画。 

 [图片] 
 [图片] 
 [图片] 

简评: 确实很认真,做了一整个完整的产品落地页,但是努力的方向好像错了? 


题目全部来源上次 Qwen3.8 27B 测试,可...
 
 
Back to Top