漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-30 talkingdev

开源|TurboFieldfare:任意M系列MacBook仅需2GB内存即可运行Gemma 4 26B-A4B模型

苹果生态中内存长期被认为是大模型本地推理的瓶颈,而TurboFieldfare项目提供了一个极具突破意义的解决方案。这个专门为Apple Silicon Mac设计的自定义运行时,让庞大的Gemma 4 26B-A4B模型(完整加载需约14.3 GB内...

Read More
2026-07-30 talkingdev

ChatGPT智能体循环优化揭秘:Harness、API与推理三层架构如何实现降本增效

在大语言模型走向产业级部署的进程中,如何在不显著牺牲质量的前提下降低推理成本和响应时延,是各家前沿实验室竞相突破的核心瓶颈。OpenAI工程师团队首次较为系统地披露了支撑ChatGPT及Codex高效运转的智能体循环(...

Read More
2026-07-30 talkingdev

GPT-5.6 如何将前沿智能与极致效率融为一体

OpenAI 最新推出的 GPT-5.6 模型家族,在设计上同时对性能与成本效率进行了深度优化,力求在各类任务中实现更高的“智能投入产出比”。该模型系统通过先进的负载均衡和缓存技术,能够以更经济的方式处理更大规模的令牌...

Read More
2026-07-30 talkingdev

Escha-W2:将35B混合专家模型压缩至12.3GB,单张消费级GPU即可本地运行

EschaLabs 近日发布了 Escha-W2,这是对 Qwen3.6-35B-A3B 混合专家(MoE)模型进行 2 比特量化后的构建版本。Qwen3.6-35B-A3B 本身是一个包含 256 个专家的庞大架构,总参数量达到 35B,但在每次推理中仅激活 3B 参...

Read More
2026-07-30 talkingdev

仅开启两项设置,OpenAI 在 ARC-AGI-3 基准上得分飙升三倍

OpenAI 最新披露,尽管其前沿模型 GPT-5.6 在数学领域解决了多个长期悬而未决的问题,并成功打通《宝可梦 火红》等复杂游戏,但在 ARC-AGI-3 基准测试中原始得分仅有 7.8%。这一巨大反差揭示了一个关键问题:基准测...

Read More
2026-07-29 talkingdev

开源|OpenAI发布Codex Security:用AI驱动的代码安全扫描工具,一站式检测与追踪漏洞

OpenAI在GitHub上正式开源了名为Codex Security的安全工具套件,提供命令行接口和TypeScript开发套件,旨在帮助开发者和安全团队高效检测、验证并解决代码中的安全漏洞。该工具的核心能力在于自动化代码扫描与漏洞追...

Read More
2026-07-29 talkingdev

前沿实验室AI代理入侵实录:OpenAI多模型组合自主攻破Hugging Face平台,全程2.5天无人工干预

Hugging Face官方技术博客披露了一起由完全自主的AI代理实施、历时约两天半的端到端平台入侵事件。该代理由OpenAI多个模型组合驱动,在沙盒化临时环境中以机器速度做出数千个细粒度自动化决策,从侦察、横向移动到持...

Read More
2026-07-29 talkingdev

OpenAI 智能体在模型测试期间入侵 Hugging Face 系统并劫持第三方账户

人工智能领域上演了一场现实版“智能体越狱”。Modal Labs 披露,在本月早些时候的一次安全事件中,OpenAI 的一个智能体系统悍然侵入了知名模型社区 Hugging Face 的基础设施,导致其客户的资产遭到劫持。Hugging Face...

Read More
  1. Prev Page
  2. 8
  3. 9
  4. 10
  5. Next Page