漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-10 talkingdev

模型基因组:给大模型做个“DNA鉴定”,一眼看穿是否从零训练

在开源大语言模型百花齐放的今天,一个模型究竟是真正从零开始预训练,还是基于现有开源权重衍生微调,常让外界难以分辨。Hugging Face社区发布的“Model Genome”项目,首次提出用类似生物基因指纹的方式为模型“验明...

Read More
2026-08-08 talkingdev

英伟达同意向Stargate园区电力开发商Lancium投资20亿美元,达标再追投10亿

据科技媒体The Information援引知情人士消息,英伟达已同意向Lancium投资20亿美元,后者正是德克萨斯州Stargate AI超大园区的电力基础设施开发商。Stargate园区由OpenAI与甲骨文等联合推动,被视为全球最具野心的AI...

Read More
2026-08-04 talkingdev

开源|微软发布Orchard:一个开源Agentic建模框架,实现跨任务与跨领域的通用轨迹蒸馏与在线强化学习

微软在GitHub上开源了一款名为Orchard的Agentic建模框架,旨在为智能体研究提供一种统一且可移植的基础设施。Orchard的核心是一个轻量级的、Kubernetes原生的环境服务,它向上层暴露了一套通用的原语,且不对上层的...

Read More
2026-08-02 talkingdev

数学界最高荣誉得主转战AI:Jacob Tsimerman加入OpenAI攻克AI安全难题

上周刚获得数学界最高荣誉菲尔兹奖的加拿大数学家Jacob Tsimerman,已从多伦多大学申请长期休假,转而加入OpenAI,专注于人工智能安全研究。这一动向不仅展现了基础科学前沿与AI产业的深度交融,也再次印证了AI安全...

Read More
2026-07-28 talkingdev

开源|Molt:英伟达发布原生PyTorch智能体强化学习框架,可扩展至万亿参数MoE模型训练

英伟达NeMo团队近日在GitHub上开源了一个名为Molt的智能体强化学习框架。该框架采用PyTorch原生设计,核心理念是将智能体本身视为可执行的程序,而非传统强化学习中固定的策略网络。Molt支持高度灵活的自定义Python...

Read More
2026-07-25 talkingdev

联手Anthropic的新云服务商Fluidstack完成8.3亿美元A轮融资,估值75亿美元

总部位于伦敦的新一代云基础设施公司Fluidstack近日披露,其在今年1月已完成由Situational Awareness领投的8.3亿美元A轮融资,投后估值达到75亿美元。Fluidstack定位为“新云”(Neocloud)服务商,专注于为大规模人工...

Read More
2026-07-24 talkingdev

如何打造前沿模型工厂:Poolside AI揭示118B MOE模型Laguna S背后的训练体系

Poolside AI联合首席执行官Eiso Kant深度分享了其团队如何以精简但高效的研究架构,构建起能够训练118B参数混合专家模型Laguna S的“模型工厂”。Laguna S在实际表现中据称超越了Thinky近1万亿参数的开放权重模型,显...

Read More
2026-07-23 talkingdev

现实世界Text-to-SQL没那么简单:新基准Beaver揭示大模型真实表现远低于预期

自然语言转SQL(Text-to-SQL)被认为是让非技术用户轻松与数据库交互的关键技术,然而现有评测基准大多在干净、规范的数据集上进行,严重脱离企业真实数据仓库的复杂状况。近日公布的新基准Beaver直接源于真实业务数...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page