随着前沿智能模型的获取门槛持续降低,市场曾担忧应用层公司会因模型商品化而失去壁垒。但最新分析指出,丰富的通用智能并不会抹平应用层护城河,反而会把价值加速转移到能将模型转化为真实业务成果的企业。真正持久...
Read More近日,分词器研究者Sander Land复现了类似Claude当前使用的分词器,发现其词表规模仅约15000个条目。这一结果与近年来大模型“词表越大越好”的主流趋势形成明显反差。由于大模型最终输出层的softmax计算成本与词表大...
Read MorePerplexity正式发布Portable Computer,这是其智能体计算平台的一个本地化版本,目标是将AI代理任务完全运行在用户自有硬件上。该方案与Nvidia合作,可部署在DGX Spark及RTX系列Linux设备上,模型、用户数据和工作内...
Read More据GeekWire报道,住宅建筑AI软件初创公司Digs宣布完成2530万美元A轮融资,由建筑材料巨头Builders FirstSource领投。Digs总部位于美国华盛顿州温哥华,专注于为住宅建筑行业开发人工智能软件。本轮融资将帮助其进一...
Read More据彭博社报道,印度AI基础设施公司AM Intelligence已向英伟达订购9000套Vera Rubin系统,并计划在总额80亿美元的项目中提供1吉瓦(GW)计算容量。Vera Rubin是英伟达面向下一代AI工作负载推出的高性能计算平台,主要...
Read More承载前沿大语言模型(LLM)的宿主机正成为高价值攻击目标。这类机器不仅拥有运行先进模型所需的GPU算力,还能直接访问模型权重,并在数据中心内具备比普通互联网主机更高的特权。最新研究指出,LLM可以生成特定token...
Read More英伟达在Hot Chips 2026上释放重要信号:CUDA生态正计划向RISC-V架构延伸。长期以来,GPU加速计算的主机端主要围绕x86-64与aarch64,而CUDA对RISC-V的支持有望让RISC-V处理器成为GPU计算任务的“入口”,从而丰富数据...
Read More随着大模型能力不断突破,一项AI任务一旦被模型超越其“最大必要智能”阈值,该任务的智能供给就不再稀缺,而会迅速商品化。此时市场竞争从模型本身的能力高低,转向成本、响应延迟、基础设施稳定性和分发渠道效率。对...
Read More