Light (@sgsdxzy)qwen3.8-flash-next可能是最被低估的3.8-flash 中发帖

qwen3.8-flash-next可能因为模型是实验性质,各推理引擎优化程度不高;其参数量不上不下,个人部署太大不如27B,企业部署又嫌太flash;同时其协议不是apache或者mit,对第三方部署卖api有限制,阿里自己的api又很贵,所以用的人不多。但是我在实际使用中发现这个模型有很多可取之处,可能是最被低估的3.8-flash。 
这边因为保密要求,模型都是内网自己部署的开源模型。单个开源模型的能力比不上闭源sota,所以我一直在想让多个模型高效协作的方案,目前采用的是受@ribbons-digital/pi-advisor启发的advisor范式,在dsh上自己实现了一个多席位的版本。这个advisor是被动式,主agent(executor)不知道advisor的存在,advisor作为后台continuable subagent持续观察用户和executor的输出以及工具调...
 
 
Back to Top