lilyanne 在 AtomGit Notebook每月免费1,000 核时/月算力 中发帖
可以部署 大模型推理部署(最主流):Qwen / Llama 系在 910B 上用 torch_npu 跑推理,或 SGLang / vLLM-Ascend 起服务
视频生成实验:Wan2.2 文生视频(comfyui-npu 路线
昇腾适配的文本 LLM(vLLM-Ascend 官方支持矩阵,2026 年 7 月版)
系列
已适配
DeepSeek
V3、V4、R1、R1-Distill 全系
Qwen
2 / 2.5 / 3 / 3.5 / 3.6(含 Coder、MoE、Next)、QwQ-32B
GLM
4.5、4.7-Flash、5.1 / 5.2
MiniMax
M2 / M2.5 / M2.7(注意:这是文本模型,不是 H3 视频模型)
Kimi
K2.5 / K2.6 / K2.7
其他
Llama 2/3/4、Ernie 4.5、B...