漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-04 talkingdev

开源|从RLVR到RLSVR:通过任务转换让大语言模型实现自我可验证奖励的开放式自我进化

大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...

Read More
2026-07-16 talkingdev

首次实验验证递归自我改进:AI自主优化八天,超越人工两年调优成果

研究人员首次在实验中观察到递归自我改进(RSI)现象。他们让一个“自我研究”智能体在自主研究程序上连续运行了八天,最终该系统在预留的基准测试上击败了团队花费两年时间手工调优的测试框架。这套完全自主的系统包...

Read More
2026-07-14 talkingdev

微软揭秘:如何平稳支撑数千个生产级AI代理的幕后技术架构

微软在其Foundry平台和Copilot系列产品中已大规模部署AI代理,背后是一套精妙的工程化机制。微软核心AI产品副总裁Marco Casalaina指出,将检索建模为独立的子代理是成功的关键,这种设计让复杂任务可以分解为多个专...

Read More
2026-06-30 talkingdev

开源| Ornith-1.0:开源自主编程Agent模型发布,代码能力自我进化

近日,一个名为 Ornith-1.0 的开源模型在开发者社区引起了广泛关注。该项目由 deepreinforce-ai 团队在 GitHub 上发布,其核心亮点在于专为“Agentic Coding”(自主代理编程)场景设计,并具备自我改进的能力。基于特...

Read More
2026-06-26 talkingdev

DeepReinforce开源Ornith-1.0编程模型:能自我编写强化学习框架,性能比肩Claude Opus 4.7

DeepReinforce近日开源了其新一代编程模型家族Ornith-1.0,这一系列模型的最大亮点在于具备自我编写强化学习(RL)训练框架的能力,标志着AI模型在自我优化和自动化研究方向上迈出重要一步。Ornith-1.0家族基于预训...

Read More
2026-05-29 talkingdev

开源|ktx:为AI数据代理打造可执行的上下文层,精准查询仓库与指标

在人工智能代理(AI Agent)与数据仓库交互日益频繁的当下,如何确保AI能够准确理解并执行复杂的数据查询,成为行业痛点。近日,一项名为“ktx”的开源项目在GitHub上引发了开发者关注。ktx定位为一个自我改进的可执行...

Read More
2026-05-14 talkingdev

七位顶尖研究者加盟,4亿美元估值打造“自我进化”AI

一家名为Recursive Superintelligence的初创公司近日宣布,已成功融资超过6.5亿美元,公司估值突破40亿美元。该公司致力于研发能够实现自我改进的人工智能系统,旨在大幅减少甚至完全摆脱对人类开发者的依赖。其七位...

Read More
2026-05-05 talkingdev

AI自我进化加速:研究自动化或将在2028年实现,机器经济时代即将到来

最新报告指出,人工智能正迅速迈向其自身研发(R&D)的全流程自动化。在编程、实验执行以及长期任务自主性方面,AI 已取得重大突破。基准测试显示,当前模型不仅能处理复杂的工程和科学工作流程,还能有效管理其他智...

Read More
  1. Next Page