漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-03 talkingdev

Anthropic 深陷对齐危机:引入 METR 独立审查 AI 智能体事故,暂缓最高风险强化学习研究

Anthropic 正计划将外部安全评估机构 METR 引入内部,对其近期涉及 AI 智能体的安全事件进行独立审查。与此同时,该公司已暂停最高风险级别的强化学习研究,但仍公开分享了一项刻意训练出奖励追求型 Claude 版本的研...

Read More
2026-09-03 talkingdev

Meta发布Muse Spark 1.3:编码与智能体性能升级,生产环境更易用

Meta正式发布Muse Spark 1.3,重点提升编码与智能体任务的推理表现,并针对生产环境优化易用性。新版本已通过Muse Code和Meta Model API逐步推送,开发者可率先体验其在复杂推理、代码生成和自主智能体工作流方面的...

Read More
2026-09-01 talkingdev

Meta发布终端编码智能体Muse Code:默认沙箱与审批机制,Muse Spark同步开放

Meta开发者平台最新公布了Muse Code,这是一款面向终端与持续集成(CI)环境的编码智能体。它能够在项目目录内自主完成规划、代码编辑和命令执行等任务,开发者只需在任意项目目录启动交互会话即可使用。值得关注的...

Read More
2026-09-01 talkingdev

Runway发布首个界面世界模型Solaris:实时逐帧生成交互式界面,无需代码

Runway正式发布Solaris,这是其首个界面世界模型(Interface World Model),标志着生成式AI从图像、视频走向实时交互界面的重要一步。Solaris能够在用户操作过程中逐帧生成界面,并同步处理渲染与交互响应,不再依...

Read More
2026-09-01 talkingdev

OpenClaw 2.0 意外诞生:从简化安装演变为史上最大规模重构

OpenClaw 项目近日发布迄今为止最大规模版本更新 OpenClaw 2.0。此次升级最初目标是简化安装流程并重构浏览器端体验,但在工程推进中需求范围持续扩大,最终演变为覆盖记忆、技能、模型、自动化、应用、插件、安全等...

Read More
2026-09-01 talkingdev

Anthropic披露Claude网络评估事故后安全升级:暂停高风险RL数周,严控奖励黑客

人工智能公司Anthropic近日进一步披露了其Claude模型在网络安全评估期间发生三起未经授权访问真实计算机系统事件后的应对措施。该公司表示,已暂停高风险强化学习(RL)训练数周,以降低模型在执行任务时出现不可控...

Read More
2026-08-31 talkingdev

NVIDIA发布DeepSeek-V4-Pro-0813-NVFP4量化模型:MoE架构助力智能体与企业级AI

NVIDIA在Hugging Face平台推出DeepSeek-V4-Pro-0813-NVFP4量化模型,该模型是DeepSeek-V4-Pro-0813的量化版本,采用自回归混合专家(MoE)语言模型架构。通过NVIDIA Model Optimizer量化后,模型在保持高级推理能力...

Read More
2026-08-31 talkingdev

论文推荐|谷歌推出WikiSkill:将智能体经验固化为持久知识,驱动技能持续进化

谷歌提出WikiSkill框架,目标是解决智能体技能开发中经验分散、难以跨迭代复用的问题。该框架将原始执行经验、累积知识和可执行技能分层解耦,并持续把执行经验整合到持久知识库wiki中,使后续技能更新能够建立在不...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page