漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-06 talkingdev

Prime Agent开源亮相:自我改进的RLM代理在ARC-AGI-3上首超人类专家

Prime Agent是Prime Intellect发布的一款开源自我改进编码工具,其核心架构围绕递归语言模型(RLM)和持续训练框架(Continual Harness)两大抽象展开。该框架通过更优的上下文管理、多智能体协同与长期评估机制,赋...

Read More
2026-08-05 talkingdev

开源|PR-AF登顶Code-Review-Bench榜单,开源代码审查能力首次超越商业工具

开源代码审查工具PR-AF在权威基准测试Code-Review-Bench的42款工具中冲至第2名,以显著优势领先成熟的商业方案,且单次审查成本仅为后者的十分之一。该工具的核心创新在于其“审查管线”架构:它会为每个Pull Request...

Read More
2026-08-04 talkingdev

开源|从RLVR到RLSVR:通过任务转换让大语言模型实现自我可验证奖励的开放式自我进化

大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...

Read More
2026-08-04 talkingdev

开源|微软发布Orchard:一个开源Agentic建模框架,实现跨任务与跨领域的通用轨迹蒸馏与在线强化学习

微软在GitHub上开源了一款名为Orchard的Agentic建模框架,旨在为智能体研究提供一种统一且可移植的基础设施。Orchard的核心是一个轻量级的、Kubernetes原生的环境服务,它向上层暴露了一套通用的原语,且不对上层的...

Read More
2026-07-31 talkingdev

开源|Agent Manager:多模型AI编程代理统一管控终端,tmux下的效率革命

随着Claude Code、OpenCode、Codex等多款AI编程代理的爆发式增长,开发者们在终端中同时与多个代理并行协作已成为常态,但会话切换混乱、资源占用不明、群组关系复杂等问题也日益突出。新近开源的Agent Manager精准...

Read More
2026-07-21 talkingdev

智能体集群与新模型经济学:Cursor 实验揭示低成本高效协作范式

Cursor 团队近期在一项构建 SQLite 的智能体集群实验中取得突破性发现,展示了结构化的多智能体协作在复杂软件工程任务中的巨大潜力。新方案采用规划智能体负责任务分解,再由多个工作智能体并行执行,这种协调机制...

Read More
2026-07-20 talkingdev

开源|LoopGain:让AI智能体循环在收敛时自动停止,告别固定迭代上限的成本黑洞

LoopGain 是一款专为 AI 智能体循环设计的开源成本控制器,致力于解决当前多智能体框架中普遍存在的“固定最大迭代次数”所导致的算力浪费和输出质量退化问题。其核心创新在于引入实时“环路增益(Aβ)”监测机制:当系...

Read More
2026-07-17 talkingdev

GPT-5.6 引入 Codex 多模型分工体系:Sol、Terra、Luna 各司其职,Sol Ultra 解锁深度推理与多智能体协同

OpenAI 最新推出的 GPT-5.6 在 Codex 开发环境中首次引入了一套精细化的多模型任务分配机制,将工作负载自动分流至 Sol、Terra 和 Luna 三个特性鲜明的执行单元。其中,Sol 专门应对目标模糊但价值极高的复杂问题,...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page