Prime Agent是Prime Intellect发布的一款开源自我改进编码工具,其核心架构围绕递归语言模型(RLM)和持续训练框架(Continual Harness)两大抽象展开。该框架通过更优的上下文管理、多智能体协同与长期评估机制,赋...
Read More开源代码审查工具PR-AF在权威基准测试Code-Review-Bench的42款工具中冲至第2名,以显著优势领先成熟的商业方案,且单次审查成本仅为后者的十分之一。该工具的核心创新在于其“审查管线”架构:它会为每个Pull Request...
Read More大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...
Read More微软在GitHub上开源了一款名为Orchard的Agentic建模框架,旨在为智能体研究提供一种统一且可移植的基础设施。Orchard的核心是一个轻量级的、Kubernetes原生的环境服务,它向上层暴露了一套通用的原语,且不对上层的...
Read More随着Claude Code、OpenCode、Codex等多款AI编程代理的爆发式增长,开发者们在终端中同时与多个代理并行协作已成为常态,但会话切换混乱、资源占用不明、群组关系复杂等问题也日益突出。新近开源的Agent Manager精准...
Read MoreCursor 团队近期在一项构建 SQLite 的智能体集群实验中取得突破性发现,展示了结构化的多智能体协作在复杂软件工程任务中的巨大潜力。新方案采用规划智能体负责任务分解,再由多个工作智能体并行执行,这种协调机制...
Read MoreLoopGain 是一款专为 AI 智能体循环设计的开源成本控制器,致力于解决当前多智能体框架中普遍存在的“固定最大迭代次数”所导致的算力浪费和输出质量退化问题。其核心创新在于引入实时“环路增益(Aβ)”监测机制:当系...
Read MoreOpenAI 最新推出的 GPT-5.6 在 Codex 开发环境中首次引入了一套精细化的多模型任务分配机制,将工作负载自动分流至 Sol、Terra 和 Luna 三个特性鲜明的执行单元。其中,Sol 专门应对目标模糊但价值极高的复杂问题,...
Read More