一项新研究探索了利用稀疏技术高效训练大语言模型的方法,旨在显著减少算力开销的同时保持模型性能。该方案通过引入结构化稀疏与动态剪枝策略,在训练前期识别并冻结低重要性参数,使有效参数量呈指数级下降,从而降...
Read More在执行复杂的长程任务时,智能体常常面临“行为状态衰减”困境:随着交互轨迹不断拉长,大量与决策相关的关键信息,如任务要求的变化、环境反馈、过往失败尝试的诊断以及尚未完成的子目标,会逐渐被淹没在上下文窗口中...
Read MoreOpenAI 近日正式推出全新的 GPT-5.6 模型家族,旗舰版本代号“Sol”,在智能水平、运行效率与成本控制上实现三重跃升。该系列模型在数学推理、代码生成、长文本理解等多个权威基准测试中,不仅全面超越前代 GPT-5,也...
Read MoreOpenAI正式推出GPT-5.6系列模型,包含Sol、Terra和Luna三个版本,其中Sol在编码、网络安全和科学研究等任务中展现出领先的智能与效率。该系列模型通过更少的令牌消耗实现更强的性能,单位算力成本显著下降。Sol在多...
Read MoreDeepReinforce近日开源了其新一代编程模型家族Ornith-1.0,这一系列模型的最大亮点在于具备自我编写强化学习(RL)训练框架的能力,标志着AI模型在自我优化和自动化研究方向上迈出重要一步。Ornith-1.0家族基于预训...
Read More近日,Liquid AI宣布推出其最新基础模型LFM2.5-230M,这是一款参数规模仅为2.3亿的非Transformer架构模型。与当前主流的Transformer模型不同,LFM2.5-230M基于状态空间模型与液态神经网络连续时间公式构建。尽管体积...
Read MoreQuestDB 在其最新的博文中深入探讨了数据库基准测试中常见的误导性问题。作为一款开源的高性能时序数据库,QuestDB 以超低延迟和高吞吐量著称。然而,其研究指出,基准测试结果极易受到测试方法的影响。例如,进程持...
Read MoreGLM-5.2的发布看似是一次增量更新,但其在基准测试和训练方法上的细微调整,却意外打开了广泛的全新用例。该模型在作为通用智能体应用于编码框架时表现尤为出色,展现出了极高的适应性和实用性。许多AI社区的研究者...
Read More