大型语言模型(LLMs)的普及正在重塑技术工作的完成方式。它们大幅降低了编程、内容生成等任务的入门门槛,让原本技能有限的用户也能产出看似不错的成果,将许多人瞬间转变为“通才”式的多面手。然而,一项最新分析指...
Read More财富科技公司Wealthfront近日披露了其在AI辅助代码审查领域长达数年的探索历程。团队最初对“AI编码只是高级自动补全”的说法充满怀疑,但随后的实验促使他们将AI深度融入代码生命周期。该工程团队构建了一套结构化方...
Read More大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...
Read MoreOpenAI 宣布对旗下 GPT-5.6 系列模型进行新一轮价格调整,进一步推动企业级 AI 应用的价格性能比前沿。其中,轻量版 GPT-5.6 Luna 输入价格降至每百万 token 0.20 美元,输出降至 1.20 美元,降幅高达 80%;均衡版 T...
Read MoreGoogle Chrome Labs 近日在 GitHub 上开源了一个名为 use-webmcp-tool 的 React Hook,旨在通过实验性的 WebMCP 规范,将应用内部功能以可调用工具的形式暴露给运行在浏览器端的人工智能智能体。该项目的核心创新在...
Read More在大语言模型竞争日益激烈的当下,如何科学、标准化地衡量不同规模模型的能力上限正成为一个核心议题。Prime Radiant公司近日开源的smevals评估框架正是瞄准了这一痛点,它提供了一套轻量且专为小模型和大模型运行基...
Read More在人工智能深度介入前沿科学研究的浪潮中,一场关于优先权的微妙竞赛悄然上演。据《科学美国人》报道,来自麻省理工学院的一名博士生与加州大学系统的两位密码学家,几乎在同一时间将顶级大模型GPT-5.6 Sol Ultra应...
Read More经历了长达三年的募资寒冬,中国风险投资行业正迎来一个剧烈反转的筹资窗口期。据《金融时报》报道,大量中国VC机构目前正在密集发起新基金募集,其背景是全球投资人对中国科技、人工智能以及机器人领域的乐观情绪突...
Read More