漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-12 talkingdev

NVIDIA提出WorldTrace:让视频世界模型拥有可寻址记忆,突破长时序生成瓶颈

NVIDIA研究团队近日推出了一项名为WorldTrace的训练无关框架,直指视频世界模型在长时序自回归生成中的关键短板——记忆遗忘与生成质量退化。该工作通过为压缩的键值记忆赋予稳定、分布内位置偏移的方式,确保记忆在远...

Read More
2026-08-12 talkingdev

英伟达发布Switchyard路由器:AI模型可在任务中途动态切换,自测任务成本降至三分之一

英伟达推出了全新的Nemotron 3.5 Lightning模型和NeMo Switchyard开源库,旨在大幅降低AI代理的推理成本并提升效率。Nemotron 3.5 Lightning是一个拥有300亿参数的混合专家模型(MoE),专为高吞吐量的专用代理任务...

Read More
2026-08-07 talkingdev

AMD宣布收购AI芯片初创公司Taalas,定制化硅片将AI模型直接“烧录”进硬件

美国芯片巨头AMD已同意收购多伦多AI芯片创业公司Taalas。这家由前AMD员工及Tenstorrent核心成员创立的公司,专注于将AI模型“硬连线”进定制硅片,从而在前沿推理场景中大幅打破计算与内存瓶颈。与传统依赖通用GPU或庞...

Read More
2026-08-05 talkingdev

论文推荐|DiffusionGemma:基于离散扩散的超高速语言模型,单卡H100每秒生成1500 Token

来自Google的研究团队发布了DiffusionGemma技术报告,提出了一种实验性的开源权重语言模型,通过离散扩散生成文本,速度远超传统自回归模型。DiffusionGemma并未从零训练,而是在专家混合架构Gemma 4(激活参数38亿...

Read More
2026-08-05 talkingdev

Mistral推出Shieldstral:3B多模态安全分类器,以小博大性能超越7倍大模型

Mistral AI正式发布Shieldstral,这是一款参数量仅为3B的开放权重多模态安全分类器。它能够同时处理文本与图像输入,并在推理时直接接受用自然语言描述的安全策略,无需针对不同政策重新训练模型。尽管体量轻巧,Shi...

Read More
2026-07-30 talkingdev

NVIDIA提出并行解码蒸馏技术:仅用4步评估实现视频生成新标杆

NVIDIA研究团队最新发布了并行解码蒸馏(Parallel Decoding Distillation)技术,该方法通过在一次模型评估中同时预测多个去噪步骤,显著减少了扩散模型在图像和视频生成时所需的迭代次数。不同于传统需要数十甚至上...

Read More
2026-07-28 talkingdev

开源|Molt:英伟达发布原生PyTorch智能体强化学习框架,可扩展至万亿参数MoE模型训练

英伟达NeMo团队近日在GitHub上开源了一个名为Molt的智能体强化学习框架。该框架采用PyTorch原生设计,核心理念是将智能体本身视为可执行的程序,而非传统强化学习中固定的策略网络。Molt支持高度灵活的自定义Python...

Read More
2026-07-27 talkingdev

英伟达发布SANA-Video 2.0:单GPU即可生成长时720p视频,延迟大幅降低

英伟达实验室(NVIDIA Research)正式推出SANA-Video 2.0,一套面向长视频和高分辨率生成的最新模型方案。该方法在架构上融合了线性注意力(linear attention)与周期性softmax层,一改传统自注意力机制在长序列下的...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page