AREX 是一系列递归自改进(RSI)深度研究智能体,通过内层研究循环收集证据、外层自改进循环逐约束审计答案并启动针对性研究。
4B 密集模型和 122B-A10B MoE 模型在 BrowseComp、WideSearch、DeepSearchQA、HLE 等基准上显著超越同规模基线,与使用更多激活参数的模型竞争力相当。
AREX は一連の再帰的自己改善(RSI)深層研究エージェントであり、内層の研究サイクルで証拠を収集し、外層の自己改善サイクルで制約に基づき回答を監査し、ターゲットを絞った研究を開始します。4B 集約モデルと 122B-A10B MoE モデルは、BrowseComp、WideSearch、DeepSearc...
AREX は一連の再帰的自己改善(RSI)深層研究エージェントであり、内層の研究サイクルで証拠を収集し、外層の自己改善サイクルで制約に基づき回答を監査し、ターゲットを絞った研究を開始します。
4B 集約モデルと 122B-A10B MoE モデルは、BrowseComp、WideSearch、DeepSearchQA、HLE などのベンチマークで同規模のベースラインを大きく上回り、より多くのアクティベーションパラメータを使用するモデルと同等の競争力を示します。
AREX 是一系列递归自改进(RSI)深度研究智能体,通过内层研究循环收集证据、外层自改进循环逐约束审计答案并启动针对性研究。
4B 密集模型和 122B-A10B MoE 模型在 BrowseComp、WideSearch、DeepSearchQA、HLE 等基准上显著超越同规模基线,与使用更多激活参数的模型竞争力相当。
AREX 是一系列面向深度研究的递归自改进智能体,结合内层证据收集与外层逐约束审计,并可根据审计结果启动针对性研究。
公开材料将其归入论文研究,来源为 HuggingFace Daily Papers 社区热门论文。研究涉及 4B 密集模型与 122B-A10B MoE 模型。
Aioga 判断,AREX 的核心关注点不是单次生成答案,而是把证据收集、约束审计和补充研究组织为递归循环,以改善深度研究过程。
材料称,两种模型在 BrowseComp、WideSearch、DeepSearchQA、HLE 等基准上显著超越同规模基线,并可与使用更多激活参数的模型竞争。 值得关注后续公开材料是否披露更完整的实验设置、逐项基准结果、审计约束设计与针对性研究机制,以便进一步核验效果和适用边界。
取得元が提供するタイトル、要約、出典、元記事リンクを掲載しています。記事全文は転載していません。
取得経路: 要約集約 · 元ドメイン: arxiv.org
出典: HuggingFace Daily Papers(社区热门论文)
元記事: 元記事を開く
Aioga アーカイブ: 情報ページを開く
Content record: summary-fallback · Updated: 2026-07-23T00:00:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga は世界の AI 動向を集約し、確認と引用のため出典情報を保持します。