拾雨 (@c519127)蚂蚁集团百灵开源 Ling-3.0-flash 模型:124B 总参数、5.1B 激活参数 中发帖

IT之家 88 日消息,蚂蚁集团旗下百灵大模型官方昨日宣布,新一代原生混合推理模型 Ling-3.0-flash 现已正式开源。 
Ling-3.0-flash 采用 124B 总参数、5.1B 激活参数的 MoE 架构。官方同步提供基础版本以及 FP8、FP4、INT4 等多个版本,提供三种不同的落地选择: 


API 调用:面向希望快速接入、无需自建推理服务的开发者,Ling-3.0-flash 可通过云端 API 直接调用; 


单机私有化:面向数据不能出域的企业和团队,MXFP4 与 INT4 版本可在单台 NVIDIA DGX Spark 上完成端到端推理; 


高性能部署:面向单请求时延敏感的高性能服务,在指定 GPU 测试配置下,平均输出速率突破 1100 tokens/s。 


对于希望快速验证产品、上线 Agent 应用的开发者和产品团队,API 是门槛最低...
 
 
Back to Top