熊大快跑 (@cuser) 在 【头脑风暴】关于Qwen 27B + Jev 协同机制是否可行 中发帖
当前痛点:Qwen 27B模型的长思维链推理中,过度思考和无法收敛导致token爆炸和GPU资源浪费的核心痛点。
当前思路:通过大小模型协同计算结合动态计算分配,通过引入Jev来充当“刹车片”AI界的ABS。
当前架构:
[image]
[image]