蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰Ring-2.6-1T。
模型采用原生混合线性注意力架构与1/64稀疏MoE,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上。
Компания Ant Group представила новое поколение родной гибридной модели вывода Ling-3.0-flash с общим количеством параметров 124 миллиарда и только 5,1 милл...
Компания Ant Group представила новое поколение родной гибридной модели вывода Ling-3.0-flash с общим
количеством параметров 124 миллиарда и только 5,1 миллиарда активных параметров. По традиционным показателям вывода, соблюдению инструкций и работе с длинными текстами она сравнима или даже превосходит предыдущий флагман Ring-2.6-1T. Модель использует архитектуру родного гибридного линейного внимания и разреженную MoE с коэффициентом 1/64, а также расширена до более чем 10 000 интерактивных обучающих сред, при длинных входных данных TTFT снижается на 60–80% и более.
蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰Ring-2.6-1T。
模型采用原生混合线性注意力架构与1/64稀疏MoE,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上。
蚂蚁百灵发布原生混合推理模型Ling-3.0-flash,总参数量124B、激活参数量5.1B,并称其在传统推理、指令遵循和长文本等指标上对标甚至超越Ring-2.6-1T。
公开材料显示,该模型采用原生混合线性注意力架构与1/64稀疏MoE,训练范围扩展至超过10,000个可交互环境;在长输入场景下,TTFT降低60%至80%以上。
Aioga 判断,Ling-3.0-flash的重点是以较低激活参数量兼顾推理、指令遵循和长文本表现,但现有材料未提供具体评测集、测试条件及第三方验证结果。
Aioga 判断,混合线性注意力与稀疏MoE可能有助于改善长输入处理效率;不过,官方披露的指标能否稳定复现,以及不同任务下的实际表现,仍值得关注。 后续可重点关注完整技术报告、评测方法、基准成绩与测试环境,并核验TTFT降幅的对照模型、输入长度及部署条件,以判断相关性能表述的适用范围。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: 摘要聚合 · 原始域名: mp.weixin.qq.com
Источник: 公众号:蚂蚁百灵(Ling)
原文链接: Открыть оригинал
Aioga 归档: 查看情报页
Content record: summary-fallback · Updated: 2026-07-24T13:40:30.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。