阿里巴巴通义千问团队在GitHub上正式开源了Qwen-MM-Plugins项目,这是一个专为Qwen模型设计的原生多模态插件集合。该项目的核心目标是让任意基于大模型的智能体能够直接“看”懂多种模态信息,而不仅仅局限于文本交互...
Read More在大语言模型竞争日益激烈的当下,如何科学、标准化地衡量不同规模模型的能力上限正成为一个核心议题。Prime Radiant公司近日开源的smevals评估框架正是瞄准了这一痛点,它提供了一套轻量且专为小模型和大模型运行基...
Read MoreMoonshot AI 最新开源权重模型 Kimi K3 在单次前端竞技场(Frontend Arena)中以 1392 的 Elo 分夺得第一,排名较 Kimi K2.6 上升了 10 位,较 Kimi K2.7 Code 上升了 16 位,创下 Moonshot 模型史上最大跃升记录。...
Read More知名本地大模型运行平台 LM Studio 正式推出 AI 代理 Bionic,专门为开放模型打造的智能助手,覆盖编码、研究和文档管理等多种生产力场景。Bionic 最大的特点在于架构灵活性:用户既可以选择在本地设备上完全离线运...
Read More在人工智能顶级会议ICLR 2026上,一篇题为《Transformer are inherently succinct》的论文被评选为三篇杰出论文之一。该研究从理论层面深入论证了Transformer架构在本质上具有简洁性(succinctness),即模型能够在...
Read More在大型语言模型(LLM)和视觉语言模型(VLM)部署中,模型量化是降低计算和存储成本的关键技术。然而,传统量化方法往往需要在模型大小和推理精度之间做出艰难取舍,尤其是在超低位宽(如2-bit、3-bit)下,精度损失...
Read More近日,GitHub上开源了一个名为“Get Shit Done”(简称GSD)的项目,这是一个专为Anthropic的Claude Code模型设计的轻量级、高性能开发系统。该系统融合了元提示工程、上下文工程与规范驱动开发三大核心理念,旨在提升...
Read More在深度学习领域,残差连接(Residual Connections)是构建深层神经网络的关键技术,它通过将浅层特征直接传递到深层,有效缓解了梯度消失问题。然而,传统的残差连接通常采用固定、均匀的累加方式,这可能限制了模型...
Read More