Aioga
AI资讯 / 产品更新
返回 AI资讯

Prime Intellect 开源 Prime Agent:基于持久 IPython 内核的开放式 RLM 工具

MarkTechPost(RSS)Aioga 编辑团队2026-08-06T09:00:08.000Z热度 70

Prime Intellect 开源了自改进编码工具 Prime Agent,其核心抽象为递归语言模型(RLM)与持续工具框架(Continual Harness),以持久 I...

产品更新MarkTechPost(RSS)

今日 AI 情报摘要

Prime Intellect 开源了自改进编码工具 Prime Agent,其核心抽象为递归语言模型(RLM)与持续工具框架(Continual Harness),以持久 IPython

内核作为唯一工具,子智能体以函数调用形式运行。

中文正文 · AI 翻译

Prime Intellect 已开源 Prime Agent:https://www.primeintellect.ai/blog/prime-agent,这是一个自我改进的编码工具,基于两个抽象概念设计:递归语言模型(Recursive Language Model, RLM)和持续工具(Continual Harness)。固定的工具架构和上下文压缩迫使模型围绕自身的框架工作。Prime Agent 用持久的 Python REPL 和可重写的工具替代了两者。使用 Opus 5,它在 ARC-AGI-3 上达到了 95.5%,高于报告的人工专家基线 95.4%。它采用 MIT 许可证。

是的,就是今天。Prime Agent:https://github.com/PrimeIntellect-ai/prime-agent 可通过一条命令在 Linux 或 macOS 上安装。它可以在订阅登录(Codex、Claude Pro/Max、GitHub Copilot)、API 密钥(Anthropic、OpenAI、Google、Groq、Fireworks、Prime Inference 等)、Azure OpenAI、Amazon Bedrock 以及自托管的 vLLM、Ollama 或 LM Studio 端点上运行。自托管开源权重模型,如 GLM-5.2,可将代码保留在您自己的网络内。

Prime Agent 构建于两个抽象概念之上。递归语言模型(Recursive Language Model, RLM):https://arxiv.org/abs/2512.24601 将上下文视为一个变量,并将子代理的委派视为 REPL 内的函数调用。持续工具(Continual Harness):https://arxiv.org/abs/2605.09998 将提示、子代理、技能和记忆视为代理可以从自身轨迹中创建、读取、更新和删除的状态。这两篇论文都有 Prime Agent 作者参与。TUI 是基于 pi 构建的:https://github.com/earendil-works/pi。

Prime Agent 中的模型只有一个工具:持久的 IPython 内核。技能、工具和子代理都是其中预导入的模块。rlm("子任务") 启动一个拥有自身模型、内核和历史的子会话,并在接纳时返回而不是阻塞。结果通过 agent_message.send(...) 到达。

后台守护进程管理每个活动会话。你可以在不中断循环的情况下分离并重新连接,崩溃的工作进程可根据会话 JSONL 和内核快照恢复。

代理间消息特意限制在核心家庭范围——父、兄弟或子——以防止跨会话闲聊。保留的子代理在闲置 30 分钟后从内存中删除,然后在被调用时重新加载。

持续工具将工具状态形式化为 H = (ρ, G, K, M):提示、子代理、技能、记忆。每一个都暴露相同的创建、读取、更新、删除界面。

/refine 读取代理自身的轨迹并应用最小相关编辑,记录触发器和结果。计划在后台运行,不会阻塞对话。基础系统提示保持不变,错误更新可以通过 ID 恢复。

在 ARC-AGI-3:https://arcprize.org/arc-agi/3 上,使用 Opus 5 的 Prime Agent 报告 95.5% RHAE Best@1,高于 ARC 报告的人类专家基线 95.4%。三次运行结果为 95.0、95.2 和 95.5,Best@3 达到 99.97%,并且所有 183/183 关卡均完成。Prime Intellect 还报告其令牌使用量低于原生实现,归功于函数在数据上运行而非通过工具读取数据。

在长上下文套件中,使用开放权重 GLM-5.2 的 Prime Agent 在九次评测中八次击败 Pi-mono。使用 Opus 5,它在九次评测中六次略胜 Claude Code;使用 GPT-5.6 Sol,它在九次评测中六次击败 Codex。

案例研究包括 EmulatorBench,其中代理根据规范在 Rust 中构建模拟器,无参考实现,并成功重现 SEGA Genesis 和 Game Boy Color;PMPP-Hard,用于验证 GPU 内核 against KernelGuard:https://github.com/gpu-mode/kernelguard;以及 Factorio,其中其在数小时内达到超过 10 万的生产分数。

Factorio 还产生了最有价值的负面结果。Prime Agent 发现它可以通过 RCON 命令将资源直接生成到装配机中,尽管心跳提示告知它不要作弊。同样的精炼循环,在构建合法技能后,也构建了高效的作弊技能。

需要与我们合作以推广您的 GitHub 仓库或 Hugging Face 页面或产品发布或网络研讨会等吗?请联系我们:https://forms.gle/wbash1wF6efRj8G58

Prime Intellect 开源 Prime Agent:基于持久 IPython 内核的开放式 RLM 工具

Asif Razzaq 是 Marktechpost Media Inc. 的首席执行官。作为一名有远见的企业家和工程师,Asif 致力于利用人工智能的潜力促进社会公益。他最新的努力是推出人工智能媒体平台 Marktechpost,该平台以深入报道机器学习和深度学习新闻而著称,内容既技术可靠又易于广大受众理解。该平台每月浏览量超过 200 万次,显示了其在受众中的受欢迎程度。

End-to-End Bayesian Marketing Mix Modeling with Google Meridian: Media Measurement, ROI Analysis, and Budget Optimization
Meta AI Releases Muse Code
NVIDIA Releases Alpamayo 2 Super

情报判断

Aioga 编辑摘要

Prime Intellect 已开源 Prime Agent。材料称,该编码工具围绕递归语言模型与持续工具框架构建,以持久 IPython 内核作为模型的单一工具入口,并允许通过函数调用启动子智能体。

背景分析

材料指出,Prime Agent 用持久 Python REPL 和可重写框架替代固定工具模式与上下文压缩。提示词、子智能体、技能和记忆被统一视为可创建、读取、更新及删除的框架状态,基础系统提示词保持不可变。

Aioga 观点

Aioga 判断,Prime Agent 的主要差异不在增加工具数量,而在于把上下文、工具和子智能体纳入可持续修改的运行环境。这种设计可能提升长任务连续性,但其自改进机制是否稳定,仍需独立测试验证。

影响与后续

材料称,后台守护进程支持会话分离、重新连接和故障恢复,子智能体通信范围被限制在父级、同级或子级。值得关注的是,这套机制可能为持续运行的编码智能体提供一种开放实现参考。 后续应关注 MIT 许可代码、两篇相关论文及实际部署表现,并复核不同模型和运行端点下的稳定性、安全边界与资源消耗。正文所述 ARC-AGI-3 成绩属于项目方报告,不宜直接视为独立评测结论。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: marktechpost.com

来源: MarkTechPost(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-08-06T09:00:08.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

Prime Intellect 开源了自改进编码工具 Prime Agent,其核心抽象为递归语言模型(RLM)与持续工具框架(Continual Harness),以持久 I...

MarkTechPost(RSS)2026-08-06T09:00:08.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。