近日,开源推理引擎WASTE正式亮相,其核心亮点在于能够运行权重规模远超宿主设备物理内存的模型。该引擎作为让强大模型在更多硬件上可用的初步举措,旨在为个人和机构在基础设施成本、数据隐私、可用性及部署方式上...
Read More一项针对生命科学临床与监管场景的基准测试ClinReg显示,开源权重大语言模型在准确率上已追平顶尖闭源模型。测试中,GLM 5.2、Kimi K3等开源模型在监管和临床任务上的表现与GPT 5.6 Sol等商业模型的差异落在一个标准...
Read MoreCursor 团队近日公开了其为云端编程智能体(Coding Agents)构建开发环境的实践经验。为了让人工智能能够更顺畅地理解、运行和测试代码,团队将开发环境本身视作一款直接服务于智能体的产品。通过对单体仓库(Monore...
Read More谷歌DeepMind正式发布了新一代机器人AI系统Gemini Robotics ER 2,该系统在视频理解、工具编排和多机器人协作方面实现了阶跃式突破。ER 2将先进的Gemini大语言模型与机器人深层控制相结合,使机器人不仅能够更精准地...
Read More人工智能公司Thinking Machines正式推出开源权重模型Inkling-Small,以更小的体量实现了与Inkling相当的性能。该模型采用混合专家架构,总参数量达276B,但每次推理仅激活12B参数,大幅降低算力需求。Inkling-Small...
Read More一项针对人工智能领域独角兽企业的研究发现,超过半数估值超过10亿美元的AI创业公司从未正式发表过科学论文或预印本。在这些少数有学术产出的公司中,论文引用高度集中,OpenAI占据了相当大比例,显示出头部企业依然...
Read More苹果生态中内存长期被认为是大模型本地推理的瓶颈,而TurboFieldfare项目提供了一个极具突破意义的解决方案。这个专门为Apple Silicon Mac设计的自定义运行时,让庞大的Gemma 4 26B-A4B模型(完整加载需约14.3 GB内...
Read More在持续集成和多人协作的开发流程中,代码合并队列是保障主干质量的关键环节,但传统的集中式合并方案往往面临云端成本高昂、推送竞争(push races)导致构建失败以及资源冲突等问题。近日,一个名为 Claude Code Mer...
Read More