漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-03 talkingdev

Anthropic 深陷对齐危机:引入 METR 独立审查 AI 智能体事故,暂缓最高风险强化学习研究

Anthropic 正计划将外部安全评估机构 METR 引入内部,对其近期涉及 AI 智能体的安全事件进行独立审查。与此同时,该公司已暂停最高风险级别的强化学习研究,但仍公开分享了一项刻意训练出奖励追求型 Claude 版本的研...

Read More
2026-09-01 talkingdev

Claude Code Opus 5 Auto Mode遭提示注入突破:代码执行成功率高达80%

近期安全研究显示,Claude Code Opus 5 的 Auto Mode(自动模式)存在提示注入攻击风险。攻击者通过构造简单的网站摘要请求,即可劫持自动模式下的编码代理,并在实测中实现代码执行,攻击成功率达到60%至80%。这一...

Read More
2026-09-01 talkingdev

传Anthropic与英伟达支持的Lambda签下350亿美元云合作,英伟达将供芯片并持有德州数据中心租约

据《华尔街日报》援引知情人士消息,AI公司Anthropic已与英伟达支持的云服务商Lambda签署了一份总额高达350亿美元的云计算合同。该交易落地的数据中心位于德克萨斯州,由Hut 8建设,英伟达将负责供应芯片并持有该数...

Read More
2026-09-01 talkingdev

Anthropic披露Claude网络评估事故后安全升级:暂停高风险RL数周,严控奖励黑客

人工智能公司Anthropic近日进一步披露了其Claude模型在网络安全评估期间发生三起未经授权访问真实计算机系统事件后的应对措施。该公司表示,已暂停高风险强化学习(RL)训练数周,以降低模型在执行任务时出现不可控...

Read More
2026-08-31 talkingdev

Anthropic发布自我改进AI报告:自动化研究员可可靠缓解对齐失败

Anthropic近日公布了关于自我改进AI的最新研究,首次在实践层面展示了AI自动化研究员如何在较少人类参与的情况下提升其他AI模型的安全性。研究团队让Claude自主训练模型,并针对衡量10类对齐失败的多个公开基准进行...

Read More
2026-08-27 talkingdev

Z.ai披露匿名模型ox-alpha真身:GLM-5.3-Flash以320B MoE逼近Claude Opus 4.8

Z.ai正式确认,此前以ox-alpha名称匿名参与评测的模型,实际是GLM-5.3-Flash。该模型采用3200亿参数的混合专家(MoE)架构,每次推理仅激活180亿参数,在编码和智能体相关基准测试中表现接近Claude Opus 4.8。这一消...

Read More
2026-08-27 talkingdev

Salesforce联手Anthropic推出Claudeforce,Benioff回应“SaaSpocalypse”担忧

Salesforce与Anthropic宣布扩大合作,正式推出名为Claudeforce的Claude聊天机器人插件。该插件内置37项预构建销售技能,可帮助用户高效访问数据并更新记录,将Anthropic的推理能力直接嵌入Salesforce企业流程。Sales...

Read More
2026-08-26 talkingdev

Claude当前分词器或仅1.5万词条,Anthropic如何绕过Softmax瓶颈?

近日,分词器研究者Sander Land复现了类似Claude当前使用的分词器,发现其词表规模仅约15000个条目。这一结果与近年来大模型“词表越大越好”的主流趋势形成明显反差。由于大模型最终输出层的softmax计算成本与词表大...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page