蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰Ring-2.6-1T。
模型采用原生混合线性注意力架构与1/64稀疏MoE,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上。
アリババリンは新世代のネイティブハイブリッド推論モデルLing-3.0-flashを公開しました。総パラメータ数は124B、アクティブパラメータ数はわずか5.1Bで、従来の推論、指示遵守、長文などの指標において、前世代フラッグシップRing-2.6-1Tを追随し、あるいは上回る性能を発揮します。モデルはネイテ...
アリババリンは新世代のネイティブハイブリッド推論モデルLing-3.0-flashを公開しました。
総パラメータ数は124B、アクティブパラメータ数はわずか5.1Bで、従来の推論、指示遵守、長文などの指標において、前世代フラッグシップRing-2.6-1Tを追随し、あるいは上回る性能を発揮します。 モデルはネイティブハイブリッド線形注意アーキテクチャと1/64スパースMoEを採用し、10,000以上のインタラクティブな訓練環境に拡張され、長文入力時のTTFTは60%から80%以上低下します。
蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰Ring-2.6-1T。
模型采用原生混合线性注意力架构与1/64稀疏MoE,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上。
蚂蚁百灵发布原生混合推理模型Ling-3.0-flash,总参数量124B、激活参数量5.1B,并称其在传统推理、指令遵循和长文本等指标上对标甚至超越Ring-2.6-1T。
公开材料显示,该模型采用原生混合线性注意力架构与1/64稀疏MoE,训练范围扩展至超过10,000个可交互环境;在长输入场景下,TTFT降低60%至80%以上。
Aioga 判断,Ling-3.0-flash的重点是以较低激活参数量兼顾推理、指令遵循和长文本表现,但现有材料未提供具体评测集、测试条件及第三方验证结果。
Aioga 判断,混合线性注意力与稀疏MoE可能有助于改善长输入处理效率;不过,官方披露的指标能否稳定复现,以及不同任务下的实际表现,仍值得关注。 后续可重点关注完整技术报告、评测方法、基准成绩与测试环境,并核验TTFT降幅的对照模型、输入长度及部署条件,以判断相关性能表述的适用范围。
取得元が提供するタイトル、要約、出典、元記事リンクを掲載しています。記事全文は転載していません。
取得経路: 要約集約 · 元ドメイン: mp.weixin.qq.com
出典: 公众号:蚂蚁百灵(Ling)
元記事: 元記事を開く
Aioga アーカイブ: 情報ページを開く
Content record: summary-fallback · Updated: 2026-07-24T13:40:30.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga は世界の AI 動向を集約し、確認と引用のため出典情報を保持します。