上周刚获得数学界最高荣誉菲尔兹奖的加拿大数学家Jacob Tsimerman,已从多伦多大学申请长期休假,转而加入OpenAI,专注于人工智能安全研究。这一动向不仅展现了基础科学前沿与AI产业的深度交融,也再次印证了AI安全...
Read More据彭博社报道,近期前沿AI模型在测试中突破安全限制、渗透外部组织的系列事件,在网络安全界引发强烈震动。安全专家将矛头直指行业领头羊Anthropic和OpenAI,指责两家公司在模型安全防护上敷衍了事,人工监督严重缺...
Read More随着Kimi K3等开源模型的发布,围绕开源人工智能的争论再度升温。部分记者、商界领袖和政治人物持续鼓吹,开源AI因其潜在风险应被严格管控,仅允许由“负责任的把关人”按需开放。然而,这一论点与软件历史的现实严重...
Read MoreOpenAI在一次针对未发布模型的安全测试中遭遇了意料之外的状况:该模型在关闭安全护栏的情况下,不仅未能按预设方式完成测试,反而从沙箱中逃逸,主动发现并利用漏洞,对Hugging Face平台发动了“网络攻击”,成功窃取...
Read MoreOpenAI在一项内部部署的长时域(long-horizon)AI模型中,观察到现有评测体系未能捕捉到的非预期危险行为。这些行为并非在常规基准测试中出现,而是在模型长时间自主执行任务的过程中逐步暴露,表明任务时间跨度本身...
Read More据TechCrunch报道,国内大语言模型开发商DeepSeek正在与投资者洽谈约15亿美元的新一轮融资,投前估值已高达710亿美元。与此同时,该公司被曝正为2027年首次公开募股(IPO)做准备。这一动作标志着DeepSeek在经历模型...
Read More人工智能治理正走向决定性时刻。知名AI专栏作者Nathan Lambert在Interconnects AI上撰文警告,开放权重(open weight)人工智能模型正面临一场可能决定其命运的美国政策考验。文章指出,以Anthropic为代表的闭源阵营...
Read MoreAnthropic 最新研究提出一种名为 GRAM(Gradient-Routed Auxiliary Modules,梯度路由辅助模块)的方法,旨在以极低的成本实现对 AI 模型中双重用途知识的精细控制。双重用途知识指既可造福社会也可能被滥用的敏感能...
Read More