Aioga
AI资讯 / AI资讯
返回 AI资讯

inclusionAI/LLaDA2.2-flash

蚂蚁 inclusionAI:HuggingFace 新模型Aioga 编辑团队2026-07-16T03:41:45.000Z热度

inclusionAI/LLaDA2.2-flash。该动态由 蚂蚁 inclusionAI:HuggingFace 新模型 发布,Aioga 已同步发布时间、来源和原文入口,...

AI资讯蚂蚁 inclusionAI:HuggingFace 新模型

今日 AI 情报摘要

inclusionAI/LLaDA2.2-flash。

该动态由 蚂蚁 inclusionAI:HuggingFace 新模型 发布,Aioga 已同步发布时间、来源和原文入口,并将继续跟踪官方更新与行业反馈。

中文正文 · AI 翻译

如何在Transformers中使用inclusionAI/LLaDA2.2-flash:

如何在vLLM中使用inclusionAI/LLaDA2.2-flash:

如何在SGLang中使用inclusionAI/LLaDA2.2-flash:

如何在Docker模型运行器中使用inclusionAI/LLaDA2.2-flash:

LLaDA2.2-flash是LLaDA2系列中的一个面向代理的扩散语言模型。通过将Levenshtein编辑(带有DELETE和INSERT控制标记)引入扩散语言建模,它代表了LLaDA2系列在代理应用中的第一步,包括长上下文工具使用、多轮交互以及稳健的错误修正。更多信息请参阅我们的技术报告:https://github.com/inclusionAI/LLaDA2.X/blob/main/LLaDA2_2_tech_report.pdf。

inclusionAI/LLaDA2.2-flash
inclusionAI/LLaDA2.2-flash

下表比较了LLaDA2.2-flash和Ling-2.6-flash在代理基准分数和吞吐量(TPS)方面的差异。

LLaDA2.2-flash评估设置:SWE-bench系列使用Claude Code框架进行评估。在所有基准测试中,我们使用128K上下文窗口,temperature=1.0,block_length=32,threshold=0.5,以及editing_threshold=0.0。每个分数代表五次运行的平均值。

† Ling-2.6-flash在SWE-bench Verified上的得分取自Ling和Ring 2.6技术报告,该得分使用OpenHands框架获得。Ling-2.6-flash在τ²-Bench、Claw-Eval和PinchBench上的得分也来源于技术报告,而其SWE-bench Pro和SWE-bench多语言得分是我们使用与LLaDA2.2-flash相同的Claude Code框架评估的。

Ling-2.6-flash评估设置:启用了MTP,使用4个草稿标记。

更多结果将在即将发布的技术报告中公布。

高效的128K扩散基础设施:LLaDA2.2-flash将上下文窗口扩展到128K,并引入Block Routing,将MoE专家激活限制在扩散块级别,以实现高效的长上下文代理工作负载。

Levenshtein编辑:我们引入了DELETE和INSERT控制标记,允许扩散解码编辑序列结构、删除冗余内容,并在并行生成期间创建插入槽。

能动强化学习:我们提出了基于Levenshtein编辑ELBO的块级策略优化(L-EBPO),利用能动环境奖励在多轮工具使用场景中训练Levenshtein编辑和错误修正。

LLaDA2.2-flash具有以下规格:

请确保已安装transformers及其依赖项。

为了实现最佳性能,我们建议使用以下设置作为起点:

采样参数:使用block_length=32,temperature=0.0,top_p=None,top_k=None作为稳定的默认设置。

去噪阈值:根据应用所需的速度-质量权衡调整threshold、editing_threshold和max_post_steps。较低的阈值可能提高推理速度,但可能导致重复增加或输出不稳定。

长上下文能动任务:对于长上下文工具使用和多轮能动应用,我们建议使用SGLang作为服务后端。请确保服务堆栈已为128K上下文窗口和模型的MoE扩散推理要求进行配置。

如果您在中国大陆,我们强烈建议通过🤖 ModelScope访问我们的模型:https://modelscope.cn/models/inclusionAI/LLaDA2.2-flash

SGLang部署支持即将推出。

本项目根据Apache许可证2.0条款授权:https://www.apache.org/licenses/LICENSE-2.0

如有问题、合作机会或反馈,请通过Hugging Face联系我们:https://huggingface.co/inclusionAI/LLaDA2.2-flash 或在仓库中提交issue:https://github.com/inclusionAI

加入我们,共同推动面向能动应用的开放、高效、智能的扩散语言模型的发展。

情报判断

Aioga 编辑摘要

Aioga 编辑摘要:inclusionAI/LLaDA2.2-flash。 Aioga 将其归入「AI资讯」方向,重点关注它对真实使用和行业竞争的影响。

背景分析

背景分析:AI 行业动态需要结合来源、时间、实际可用性和后续反馈判断,标题或单次发布本身不能替代完整证据。

Aioga 观点

Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续

影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察原文更新、官方说明、用户反馈和同类产品的后续动作。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: 摘要聚合 · 原始域名: huggingface.co

来源: 蚂蚁 inclusionAI:HuggingFace 新模型

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-07-16T03:41:45.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

inclusionAI/LLaDA2.2-flash。该动态由 蚂蚁 inclusionAI:HuggingFace 新模型 发布,Aioga 已同步发布时间、来源和原文入口,...

蚂蚁 inclusionAI:HuggingFace 新模型2026-07-16T03:41:45.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。