漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-15 talkingdev

Vera Rubin NVL72推理测试:1.6T DeepSeek模型每兆瓦Token吞吐量达Blackwell 7倍,超黄仁勋3倍说法

SemiAnalysis最新披露的推理测试结果显示,NVIDIA下一代Vera Rubin NVL72平台在运行1.6万亿参数的DeepSeek模型时,每兆瓦功耗下的Token吞吐量最高达到Blackwell平台的7倍,明显高于黄仁勋此前对1T-3T规模LLM给出的3...

Read More
2026-08-20 talkingdev

1.6万亿参数DeepSeek-V4-Pro部署新思路:从负载画像到拓扑决策突破推理瓶颈

随着DeepSeek-V4-Pro等1.6万亿参数Mixture-of-Experts(MoE)模型同时发布FP8与FP4权重,如何在真实资源约束下高效服务前沿模型成为AI基础设施团队的核心挑战。LMSYS博客文章指出,服务配置不应仅依据硬件规格或孤立...

Read More
2026-07-18 talkingdev

日本豪掷27,500颗NVIDIA Rubin芯片,打造自主机器人AI基础模型

据彭博社报道,日本正计划从英伟达采购27,500颗下一代Rubin芯片,用以构建一个面向机器人领域的国产基础人工智能模型。该项目由Noetra牵头,联合软银、索尼及NEC等科技巨头共同推进,被视为日本在“主权AI”战略上的重...

Read More
2026-02-13 talkingdev

开源模型+Blackwell架构:头部推理服务商实现AI成本骤降10倍

近日,多家领先的AI推理服务提供商,包括Baseten、DeepInfra、Fireworks AI和Together AI,宣布通过在其服务中部署基于NVIDIA Blackwell架构的GPU并运行开源模型,成功将每次推理的令牌成本大幅降低了高达10倍。这一...

Read More
2026-01-06 talkingdev

英伟达提前发布新一代AI芯片“Vera Rubin”,性能飞跃成本骤降

在拉斯维加斯举行的国际消费电子展上,英伟达正式揭晓了其最新的AI服务器系统及核心芯片“Vera Rubin”。这款备受瞩目的芯片预计将于今年下半年正式上市销售。其核心设计目标是应对生成式AI模型训练所需的巨大计算负载...

Read More
2026-01-06 talkingdev

英伟达黄仁勋宣布Vera Rubin芯片全面投产:训练部分大模型所需芯片数量仅为Blackwell的四分之一

英伟达创始人兼CEO黄仁勋近日宣布,其下一代AI芯片平台Vera Rubin已进入“全面生产”阶段。根据英伟达官方披露的技术信息,Vera Rubin平台在训练特定大型语言模型时,所需芯片数量可大幅减少至当前旗舰Blackwell架构平...

Read More
2025-12-04 talkingdev

英伟达GB200 Blackwell NVL72服务器实现10倍性能飞跃,专为前沿MoE模型设计的架构突破

英伟达在混合专家模型(Mixture-of-Experts,MoE)的扩展性能方面取得了重大突破。根据官方公布的数据,其最新的GB200 Blackwell NVL72服务器配置,在MoE AI模型上的性能表现相比上一代的Hopper HGX200架构实现了高...

Read More
2025-12-04 talkingdev

英伟达发布性能数据:GB200 Blackwell AI服务器对月之暗面Kimi K2、深度求索R1等MoE模型推理性能提升高达10倍

英伟达于近日公布了其最新一代GB200 Blackwell AI服务器的性能基准测试数据,结果显示,相较于前代H100/H200平台,该服务器在运行特定类型的混合专家模型时,性能提升高达10倍。此次测试重点针对中国AI公司月之暗面...

Read More
  1. Next Page