@daima有没有了解Qwen3-Coder-Next模型的佬友 中发帖

我的服务器双5090能部署deepseekv4-flash-0731-iq2_m这个版本的量化能跑到27t/s,我觉得可以用,我想知道qwen3-coder-next怎么样,我能部署到q6量化,这两个性能有差距吗,打算接入claudecode中用,有没有比较的方法(公司不报销token,显卡是公司的,所以不考虑在线平台的,那些虽然好,但是只打算给自己用,公司项目打算用差一点的)
 
 
Back to Top