在近期一场聚焦GPU优化的自动研究竞赛中,参赛者针对批量方阵compact-Householder QR分解(qr_v2)问题展开优化,最终在GPU Mode的qr_v2任务上实现了相对基线高达232倍的内核加速,并在183名参与者中位列第12。该项...
Read MoreSpaceX正式宣布收购AI编程工具Cursor,旨在将其庞大的GPU计算资源应用于AI模型训练,以显著提升模型性能并降低训练成本。借助SpaceX在高性能计算基础设施方面的积累,Cursor有望开发出能力更强、效率更高的代码生成...
Read More近日,阿里巴巴Qwen研究实验室正式发布Qwen 3.8 27B,这是一款采用Apache 2.0许可的270亿参数开源大语言模型,开放权重约17GB。据知名开发者Simon Willison介绍,该模型在中等参数规模下集成了长上下文处理、高效工...
Read MoreOpenAI正式预览了GPT-5.6 Sol的Ultrafast模式,该模式在推理速度上实现显著突破,最高可生成750个输出token/秒,整体处理速度达到标准模式的14倍。值得关注的是,这一性能提升并非通过切换更小的轻量模型来实现,而...
Read MoreRuby核心团队持续致力于内存优化,最新研究聚焦于应用程序中最常用的对象之一——哈希表(Hash)。尽管近期已通过为小型哈希表引入基于数组的结构以及实施可变宽度分配等措施显著提升了效率,但在压缩内存占用方面仍有...
Read MoreMeta旗下超级智能实验室正式推出Muse Glimmer,一个拥有300亿参数的开源智能体模型,采用Apache 2.0许可证。该模型专为消费级硬件上的常驻本地工作流优化,重点面向编程、函数调用和模型评估等场景,并展现出强大的...
Read More据日经亚洲消息,索尼集团与台积电计划在日本熊本县成立一家合资企业,总投资额高达63亿美元,其中索尼持股约60%,台积电持股约40%,目标是最早在2029年实现下一代图像传感器芯片的大规模量产。这将是两家半导体巨头...
Read More据科技媒体The Information援引知情人士消息,英伟达已同意向Lancium投资20亿美元,后者正是德克萨斯州Stargate AI超大园区的电力基础设施开发商。Stargate园区由OpenAI与甲骨文等联合推动,被视为全球最具野心的AI...
Read More