蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰Ring-2.6-1T。
模型采用原生混合线性注意力架构与1/64稀疏MoE,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上。
Ant Group Bailing, yeni nesil yerel hibrit çıkarım modeli Ling-3.0-flash'i tanıttı; toplam parametre sayısı 124 milyar, etkin parametre sayısı yalnızca 5,1...
Ant Group Bailing, yeni nesil yerel hibrit çıkarım modeli Ling-3.0-flash'i tanıttı;
toplam parametre sayısı 124 milyar, etkin parametre sayısı yalnızca 5,1 milyar. Geleneksel çıkarım, talimat takibi ve uzun metin gibi göstergelerde, önceki nesil amiral gemisi Ring-2.6-1T ile karşılaştırıldığında eşit veya daha iyi performans sergiliyor. Model, yerel hibrit lineer dikkat mimarisi ve 1/64 seyrek MoE kullanmakta ve 10.000+'den fazla etkileşimli eğitim ortamına kadar genişletilmiş; uzun girdilerde TTFT, %60 ila %80’in üzerinde düşüyor.
蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰Ring-2.6-1T。
模型采用原生混合线性注意力架构与1/64稀疏MoE,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上。
蚂蚁百灵发布原生混合推理模型Ling-3.0-flash,总参数量124B、激活参数量5.1B,并称其在传统推理、指令遵循和长文本等指标上对标甚至超越Ring-2.6-1T。
公开材料显示,该模型采用原生混合线性注意力架构与1/64稀疏MoE,训练范围扩展至超过10,000个可交互环境;在长输入场景下,TTFT降低60%至80%以上。
Aioga 判断,Ling-3.0-flash的重点是以较低激活参数量兼顾推理、指令遵循和长文本表现,但现有材料未提供具体评测集、测试条件及第三方验证结果。
Aioga 判断,混合线性注意力与稀疏MoE可能有助于改善长输入处理效率;不过,官方披露的指标能否稳定复现,以及不同任务下的实际表现,仍值得关注。 后续可重点关注完整技术报告、评测方法、基准成绩与测试环境,并核验TTFT降幅的对照模型、输入长度及部署条件,以判断相关性能表述的适用范围。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: 摘要聚合 · 原始域名: mp.weixin.qq.com
Kaynak: 公众号:蚂蚁百灵(Ling)
原文链接: Orijinal kaynağı aç
Aioga 归档: 查看情报页
Content record: summary-fallback · Updated: 2026-07-24T13:40:30.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。