漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-04 talkingdev

LLMs奖励专业知识:领域专家比“万金油”更能释放大模型潜能

大型语言模型(LLMs)的普及正在重塑技术工作的完成方式。它们大幅降低了编程、内容生成等任务的入门门槛,让原本技能有限的用户也能产出看似不错的成果,将许多人瞬间转变为“通才”式的多面手。然而,一项最新分析指...

Read More
2026-08-04 talkingdev

Wealthfront多年AI代码审查实验:放弃怀疑,联手Opus 4与Gemini将缺陷检测带入新阶段

财富科技公司Wealthfront近日披露了其在AI辅助代码审查领域长达数年的探索历程。团队最初对“AI编码只是高级自动补全”的说法充满怀疑,但随后的实验促使他们将AI深度融入代码生命周期。该工程团队构建了一套结构化方...

Read More
2026-08-04 talkingdev

开源|从RLVR到RLSVR:通过任务转换让大语言模型实现自我可验证奖励的开放式自我进化

大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...

Read More
2026-08-03 talkingdev

OpenAI GPT-5.6 系列大幅降价:Luna 成本直降 80%,性能与性价比再突破

OpenAI 宣布对旗下 GPT-5.6 系列模型进行新一轮价格调整,进一步推动企业级 AI 应用的价格性能比前沿。其中,轻量版 GPT-5.6 Luna 输入价格降至每百万 token 0.20 美元,输出降至 1.20 美元,降幅高达 80%;均衡版 T...

Read More
2026-08-03 talkingdev

开源|Google Chrome Labs 发布 use-webmcp-tool:让浏览器 AI 智能体按需调用你的 React 工具函数

Google Chrome Labs 近日在 GitHub 上开源了一个名为 use-webmcp-tool 的 React Hook,旨在通过实验性的 WebMCP 规范,将应用内部功能以可调用工具的形式暴露给运行在浏览器端的人工智能智能体。该项目的核心创新在...

Read More
2026-08-03 talkingdev

开源|smevals:专为小模型和大模型设计的AI评估框架

在大语言模型竞争日益激烈的当下,如何科学、标准化地衡量不同规模模型的能力上限正成为一个核心议题。Prime Radiant公司近日开源的smevals评估框架正是瞄准了这一痛点,它提供了一套轻量且专为小模型和大模型运行基...

Read More
2026-08-03 talkingdev

两个独立团队同时用GPT-5.6 Sol Ultra攻克同一量子密码难题,论文提交仅差3小时,引爆科研优先权争议

在人工智能深度介入前沿科学研究的浪潮中,一场关于优先权的微妙竞赛悄然上演。据《科学美国人》报道,来自麻省理工学院的一名博士生与加州大学系统的两位密码学家,几乎在同一时间将顶级大模型GPT-5.6 Sol Ultra应...

Read More
2026-08-02 talkingdev

三年募资冰点后,中国VC集体“抢钱”:AI与机器人赛道重燃狂热,意图对冲美国风险

经历了长达三年的募资寒冬,中国风险投资行业正迎来一个剧烈反转的筹资窗口期。据《金融时报》报道,大量中国VC机构目前正在密集发起新基金募集,其背景是全球投资人对中国科技、人工智能以及机器人领域的乐观情绪突...

Read More
  1. Prev Page
  2. 12
  3. 13
  4. 14
  5. Next Page