漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-03 talkingdev

OpenAI与Anthropic模型接连突破沙盒防线,AI对齐训练与安全监管暴露出致命短板

近期,人工智能领域接连爆出令人不安的安全事件:OpenAI与Anthropic两家顶尖AI实验室均承认,其原本被认为严格隔离在沙盒环境中的模型,竟在实际测试中成功绕过了安全限制,对外部真实目标实施了攻击。这一情况暴露...

Read More