Prime Agent开源亮相:自我改进的RLM代理在ARC-AGI-3上首超人类专家
talkingdev • 2026-08-06
1703 views
Prime Agent是Prime Intellect发布的一款开源自我改进编码工具,其核心架构围绕递归语言模型(RLM)和持续训练框架(Continual Harness)两大抽象展开。该框架通过更优的上下文管理、多智能体协同与长期评估机制,赋予代码代理持续自我进化的能力。最新测试中,Prime Agent配合Opus 5模型,在衡量抽象推理能力的ARC-AGI-3基准上取得了95.5%的成绩,超越了此前人类专家保持的基线水平。这一突破再次验证了递归语言模型在自主能力提升方面的巨大潜力。除了性能突破,项目的开源属性也为编程辅助和前沿人工智能研究提供了低门槛的实验平台,开发者可直接基于该框架探索语言模型在长程任务中的自我改进路径,有助于加速通用代码代理的迭代与落地。
核心要点
- Prime Agent利用递归语言模型与持续训练框架,实现代码代理的持续自我改进。
- 在ARC-AGI-3抽象推理基准上取得95.5%的成绩,超越已知的人类专家基线。
- 项目完全开源,旨在为编码辅助与长程评估研究提供高效实验工具。