漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-12 talkingdev

GPT-5.6 系列正式发布:旗舰 Sol 模型领衔,智能效率双突破,成本碾压竞品

OpenAI 近日正式推出全新的 GPT-5.6 模型家族,旗舰版本代号“Sol”,在智能水平、运行效率与成本控制上实现三重跃升。该系列模型在数学推理、代码生成、长文本理解等多个权威基准测试中,不仅全面超越前代 GPT-5,也...

Read More
2026-07-12 talkingdev

Anthropic提出GRAM方法:为AI模型内的双用途知识装上可关闭的“开关”

AI模型在学习过程中不可避免地会掌握大量“双用途知识”——既能用于网络防御、漏洞检测等正面场景,也可能被用于网络攻击和信息窃取等恶意目的。如何在不削弱模型整体能力的前提下,精准管控这类敏感知识,一直是AI安全...

Read More
2026-07-12 talkingdev

OpenAI 揭露编程评估基准 SWE-Bench Pro 近三成任务存缺陷,建议撤回升级推荐

OpenAI 近期对当前广泛使用的 AI 编程能力评估基准 SWE-Bench Pro 进行了一次系统性审计,结果发现约 30% 的任务存在严重瑕疵,令该基准的可靠性与准确性备受质疑。此次审计由 Anthropic 团队执行,结合了自动化筛查...

Read More
2026-07-12 talkingdev

Bun 宣布用 Rust 重写,抛弃 Zig 以根治内存安全问题

知名 JavaScript 运行时与工具链 Bun 正式宣布已完成由 Zig 向 Rust 的全面重写。这一重大技术决策发生在 Bun 被人工智能公司 Anthropic 收购之后,核心动因在于管理复杂度的不断攀升。Bun 最初作为 esbuild 转译器...

Read More
2026-07-12 talkingdev

Anthropic 提出 GRAM 方法:为大模型危险知识装上“可拆卸开关”

Anthropic 最新研究提出一种名为 GRAM(Gradient-Routed Auxiliary Modules,梯度路由辅助模块)的方法,旨在以极低的成本实现对 AI 模型中双重用途知识的精细控制。双重用途知识指既可造福社会也可能被滥用的敏感能...

Read More
2026-07-12 talkingdev

马斯克旗下SpaceXAI发布Grok 4.5:专攻编码、智能代理与知识工作的最强模型

埃隆·马斯克旗下的人工智能公司SpaceXAI正式推出了新一代大语言模型Grok 4.5,将其定位为公司在编码、智能代理任务和知识工作领域的最强模型。官方披露,该模型在训练过程中与流行AI编程工具Cursor进行了深度协同优...

Read More
2026-06-30 talkingdev

开源|Craft Agents OSS:打造高效AI代理与API交互的开源利器

在人工智能代理(AI Agent)技术飞速发展的当下,如何让代理高效、稳定地与各种外部API和服务进行交互,成为推动自动化与智能化落地的关键瓶颈。近日,GitHub上开源的项目Craft Agents OSS(craft-ai-agents/craft-a...

Read More
2026-06-27 talkingdev

美国“绿灯”放行:Anthropic发布强大AI模型Mythos,仅限可信组织使用

美国政府在人工智能监管与部署上迈出重要一步,正式允许AI公司Anthropic将其最新研发的强大AI模型“Mythos”向部分经筛选的“可信”美国组织进行限量发布。这一决策突显了美国政府在高性能AI应用与国家安全之间的审慎平...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page