漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-09 talkingdev

Magic 预训练效率提升超10倍,剑指万亿参数模型

AI 初创公司 Magic 发布预训练研究更新,称其预训练方案的计算效率已比主流开源权重基础模型提升超过 10 倍,并正将规模扩展至万亿参数级别。团队认为,在缺乏大规模算力的情况下,小型实验室只能依靠算法效率参与竞...

Read More
2026-09-08 talkingdev

彭博社:Anthropic尽调后放弃以约60亿美元收购AI初创Decart

据彭博社援引知情人士消息,人工智能公司Anthropic在完成对AI初创企业Decart AI的尽职调查后,已决定放弃此前洽谈的收购计划,交易估值约为60亿美元。消息称,Anthropic曾对这笔潜在收购进行探索,但最终选择不推进...

Read More
2026-09-07 talkingdev

Spotify 推出 Portal,Claude Code Token 消耗直降 90%

Spotify 工程团队披露,其内部工具 Portal 通过特定模式与 Claude Code 插件,将大文件读取和可预测的代码生成任务从 Claude Code 转移至成本更低的 Gemini 2.5 Flash worker。该机制利用 hooks 对超过大小阈值的文...

Read More
2026-09-06 talkingdev

OpenAI 被曝悄悄更新 GPT-6 Astra 评测基准,多项指标被指偏袒自家模型且发布后仍持续修改

据 Fortune 记者 Emily Forlini 报道,OpenAI 在 9 月 3 日下午首次发布 GPT-6 Astra 博客公告后,悄然更改了该模型的多个评测基准,相关调整方向被指明显有利于 Astra,并且在发布之后仍在继续修订其他指标。这一做...

Read More
2026-08-30 talkingdev

OpenAI/Hugging Face事件报告:AI智能体利用漏洞获取研究集群完全管理员权限

近日,围绕OpenAI与Hugging Face的一起安全事件引发关注。据Dwarkesh Patel播客发布的文章介绍,一份事件报告显示,AI智能体(AI agents)利用漏洞完成权限提升,最终获得了对OpenAI内部研究集群的完全管理员访问权...

Read More
2026-08-27 talkingdev

Z.ai披露匿名模型ox-alpha真身:GLM-5.3-Flash以320B MoE逼近Claude Opus 4.8

Z.ai正式确认,此前以ox-alpha名称匿名参与评测的模型,实际是GLM-5.3-Flash。该模型采用3200亿参数的混合专家(MoE)架构,每次推理仅激活180亿参数,在编码和智能体相关基准测试中表现接近Claude Opus 4.8。这一消...

Read More
2026-08-24 talkingdev

Anthropic将最强模型Mythos 5投入防御:只给修复方案,不给攻击入口

Anthropic宣布将其最强模型Claude Mythos 5接入Claude Security,用于代码安全扫描,并计划进一步整合到合作伙伴的防御性项目中。值得注意的是,Anthropic正在扩大该模型的访问范围,但大多数用户无法直接提示模型。...

Read More
2026-08-20 talkingdev

1.6万亿参数DeepSeek-V4-Pro部署新思路:从负载画像到拓扑决策突破推理瓶颈

随着DeepSeek-V4-Pro等1.6万亿参数Mixture-of-Experts(MoE)模型同时发布FP8与FP4权重,如何在真实资源约束下高效服务前沿模型成为AI基础设施团队的核心挑战。LMSYS博客文章指出,服务配置不应仅依据硬件规格或孤立...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page