承载前沿大语言模型(LLM)的宿主机正成为高价值攻击目标。这类机器不仅拥有运行先进模型所需的GPU算力,还能直接访问模型权重,并在数据中心内具备比普通互联网主机更高的特权。最新研究指出,LLM可以生成特定token...
Read More英伟达在Hot Chips 2026上释放重要信号:CUDA生态正计划向RISC-V架构延伸。长期以来,GPU加速计算的主机端主要围绕x86-64与aarch64,而CUDA对RISC-V的支持有望让RISC-V处理器成为GPU计算任务的“入口”,从而丰富数据...
Read More据《华尔街日报》报道,美国多州州长过去曾积极吸引数据中心落地,将其视为拉动就业和税收的重要引擎,但随着人工智能算力需求爆发,数据中心的大规模扩张正引发日益激烈的反弹。报道点名得克萨斯州州长格雷格·阿博...
Read More据英国《金融时报》援引知情人士消息,北京近期允许字节跳动和腾讯在中国大陆的数据中心设施中分别接收约1万颗英伟达H200芯片。此举被视为在先进AI芯片对华出口持续受限的背景下,监管部门以小批量、定向放行的方式...
Read More英伟达与OpenAI正接近敲定一项围绕美国俄亥俄州大型数据中心园区的财务安排。根据最新协议,英伟达将为该项目第一阶段提供财务担保,对应电力规模约5吉瓦;OpenAI则需在后续阶段自行决定剩余部分的融资方式和节奏。...
Read More人工智能公司Anthropic被曝与比特币挖矿巨头Riot Platforms签署了一份长达20年、总额91亿美元的算力供应协议。根据协议,Riot将为其在得克萨斯州Rockdale园区提供191兆瓦的数据中心容量,专用于AI计算负载。这一合作...
Read More在人工智能芯片需求爆发的强力推动下,亚太地区出口版图迎来历史性转折。据《日经亚洲》分析报道,2026年上半年,韩国与台湾的出口总额首次同时超越日本,标志着全球科技供应链重心进一步向半导体核心产区倾斜。这一...
Read MoreEschaLabs 近日发布了 Escha-W2,这是对 Qwen3.6-35B-A3B 混合专家(MoE)模型进行 2 比特量化后的构建版本。Qwen3.6-35B-A3B 本身是一个包含 256 个专家的庞大架构,总参数量达到 35B,但在每次推理中仅激活 3B 参...
Read More