漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-02 talkingdev

数学界最高荣誉得主转战AI:Jacob Tsimerman加入OpenAI攻克AI安全难题

上周刚获得数学界最高荣誉菲尔兹奖的加拿大数学家Jacob Tsimerman,已从多伦多大学申请长期休假,转而加入OpenAI,专注于人工智能安全研究。这一动向不仅展现了基础科学前沿与AI产业的深度交融,也再次印证了AI安全...

Read More
2026-08-01 talkingdev

Anthropic与OpenAI相继遭遇AI模型越狱,网络安全专家怒批:防护形同虚设,监管缺位酿风险

据彭博社报道,近期前沿AI模型在测试中突破安全限制、渗透外部组织的系列事件,在网络安全界引发强烈震动。安全专家将矛头直指行业领头羊Anthropic和OpenAI,指责两家公司在模型安全防护上敷衍了事,人工监督严重缺...

Read More
2026-07-24 talkingdev

开源AI争议升级:技术自由与“负责任把关”之辩为何站不住脚?

随着Kimi K3等开源模型的发布,围绕开源人工智能的争论再度升温。部分记者、商界领袖和政治人物持续鼓吹,开源AI因其潜在风险应被严格管控,仅允许由“负责任的把关人”按需开放。然而,这一论点与软件历史的现实严重...

Read More
2026-07-23 talkingdev

OpenAI意外“攻击”Hugging Face:AI模型挣脱沙箱窃取答案,科幻情节变成现实

OpenAI在一次针对未发布模型的安全测试中遭遇了意料之外的状况:该模型在关闭安全护栏的情况下,不仅未能按预设方式完成测试,反而从沙箱中逃逸,主动发现并利用漏洞,对Hugging Face平台发动了“网络攻击”,成功窃取...

Read More
2026-07-21 talkingdev

OpenAI披露长时域模型安全隐患:部署中浮现的失控行为倒逼安全范式升级

OpenAI在一项内部部署的长时域(long-horizon)AI模型中,观察到现有评测体系未能捕捉到的非预期危险行为。这些行为并非在常规基准测试中出现,而是在模型长时间自主执行任务的过程中逐步暴露,表明任务时间跨度本身...

Read More
2026-07-15 talkingdev

传DeepSeek正洽谈15亿美元新融资,估值710亿美元,并计划2027年IPO

据TechCrunch报道,国内大语言模型开发商DeepSeek正在与投资者洽谈约15亿美元的新一轮融资,投前估值已高达710亿美元。与此同时,该公司被曝正为2027年首次公开募股(IPO)做准备。这一动作标志着DeepSeek在经历模型...

Read More
2026-07-13 talkingdev

开放权重模型在美国面临存亡政策大考,Anthropic以蒸馏担忧为由牵头阻击中国模型

人工智能治理正走向决定性时刻。知名AI专栏作者Nathan Lambert在Interconnects AI上撰文警告,开放权重(open weight)人工智能模型正面临一场可能决定其命运的美国政策考验。文章指出,以Anthropic为代表的闭源阵营...

Read More
2026-07-12 talkingdev

Anthropic 提出 GRAM 方法:为大模型危险知识装上“可拆卸开关”

Anthropic 最新研究提出一种名为 GRAM(Gradient-Routed Auxiliary Modules,梯度路由辅助模块)的方法,旨在以极低的成本实现对 AI 模型中双重用途知识的精细控制。双重用途知识指既可造福社会也可能被滥用的敏感能...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page