Bunn (@BunnHack)Ling-3.0-flash 正式发布:蚂蚁集团旗下 inclusionAI 推出生产级MoE 124B模型 中发帖

inclusionAI(IAI)蚂蚁集团旗下 AI 研究机构——正式发布 Ling-3.0-flash,一款专为生产级智能体(Agent)场景打造的混合推理混合专家(MoE)大模型。 
总参数量為124B,每Token激活参数为5.1B,上下文窗口(原生):256K。最大可扩展上下文到1M。 
以仅 1/8 总参数、1/12 激活参数的规模,在多数基准测试中追平甚至超越其自家 1万亿参数旗舰模型。 
Ling-3.0 采用原生混合线性注意力机制,核心由两种层交替堆叠(比例 5:1)构成。 
KDA 层提供对长程记忆的精细控制能力,MLA 层结合 1/64 专家激活率,大幅提升 MoE 计算效率。这一设计使模型在保持超长上下文理解能力的同时,显著降低推理成本。 
Ling-3.0-flash 现已上线 OpenRouter,并宣布免费使用至 202683日。 
 [17848568703...
 
 
Back to Top