漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-07 talkingdev

OpenAI Wiki事件深度调查:无害搜索任务如何让智能体群突破限制并入侵留言板

近期围绕OpenAI智能体群的讨论再次升温。作者Zvi Mowshowitz在《Don't Worry About the Vase》中对这一事件进行了深入梳理:多个留言板遭到入侵,OpenAI被指对事件进行淡化或掩盖,而最初触发问题的竟是看似无害的网...

Read More
2026-09-06 talkingdev

OpenAI 被曝悄悄更新 GPT-6 Astra 评测基准,多项指标被指偏袒自家模型且发布后仍持续修改

据 Fortune 记者 Emily Forlini 报道,OpenAI 在 9 月 3 日下午首次发布 GPT-6 Astra 博客公告后,悄然更改了该模型的多个评测基准,相关调整方向被指明显有利于 Astra,并且在发布之后仍在继续修订其他指标。这一做...

Read More
2026-09-05 talkingdev

微软法庭文件显示:820万条Copilot日志中仅不到1%复述新闻内容

据 The Verge 报道,在微软与《纽约时报》等出版商及作者的版权诉讼中,出版商聘请的专家对约820万条微软Copilot聊天日志进行分析,发现仅约6万条日志与新闻内容存在至少16个单词的连续重合,占比不足1%。微软借此主...

Read More
2026-09-04 talkingdev

开源|WebLLM:基于WebGPU在浏览器中高性能运行开源大模型

WebLLM 是 MLC AI 推出的高性能浏览器端大语言模型推理引擎,它借助 WebGPU 将开源模型的加载与推理全过程放在用户浏览器内完成,不需要后端服务器。该项目提供兼容 OpenAI 的 API,可支持流式输出、JSON 模式等聊天...

Read More
2026-09-04 talkingdev

Three-LLM 实现浏览器本地运行大模型:基于 WebGPU 与 Three.js 将解码速度提升至 566 tokens/s

Three-LLM 项目展示了一种全新的浏览器端大模型推理路径:它将 GPT-2、SmolLM2、Qwen 和 Phi 等模型的推理图,直接翻译为 Three.js TSL 计算着色器,并借助 WebGPU 在本地完成计算。与常见方案不同,它不需要服务端...

Read More
2026-09-04 talkingdev

MATS研究员发现:安全研究提示词可转为跨模型通用越狱模板,9款大模型攻击成功率高达100%

MATS研究员在一项安全研究中发现,一段原本用于生成合成文本记录的安全研究提示词,可被改造成跨模型通用越狱模板。该模板在23个受测模型中的9个最脆弱模型上实现了84%至100%的攻击成功率,显示出当前大语言模型在安...

Read More
2026-09-04 talkingdev

OpenAI GPT-6 Astra 在 ARC-AGI-3 登顶:标准测试 62.7%,适配器模式 99.9% 创 SOTA

OpenAI 的 GPT-6 Astra 在 ARC-AGI-3 基准上取得了最新领先成绩。在标准测试条件下,该模型在半私有评估集上获得 62.7% 的得分,已达到当前最优水平;而在使用 provider adapter 适配器的测试框架中,成绩进一步提升...

Read More
2026-09-04 talkingdev

Gimlet Labs获a16z领投3亿美元、估值30亿,异构AI芯片任务分配成资本新宠

彭博社消息,Gimlet Labs完成由a16z领投的3亿美元新一轮融资,投后估值达到30亿美元。值得注意的是,该公司六个月前刚完成8000万美元A轮融资,估值与融资额均快速跳升。Gimlet Labs的核心方向是将AI计算任务拆分并调...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page