漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-28 talkingdev

小模型时代已至:GPT-5.6-Luna与GLM 5.3引领快速低成本AI新趋势

近期,以gpt-5.6-luna和GLM 5.3为代表的AI模型展示了小参数模型在性能、速度与成本之间的新平衡。它们虽然参数规模较小,但在响应速度和经济性上表现突出,尤其适合那些对实时性要求高、但不依赖极端智能的任务场景...

Read More
2026-08-14 talkingdev

OpenAI发布GPT-5.6 Sol超高速模式:推理速度最高提升14倍,每秒输出750 tokens

OpenAI正式预览了GPT-5.6 Sol的Ultrafast模式,该模式在推理速度上实现显著突破,最高可生成750个输出token/秒,整体处理速度达到标准模式的14倍。值得关注的是,这一性能提升并非通过切换更小的轻量模型来实现,而...

Read More
2026-08-03 talkingdev

开源|smevals:专为小模型和大模型设计的AI评估框架

在大语言模型竞争日益激烈的当下,如何科学、标准化地衡量不同规模模型的能力上限正成为一个核心议题。Prime Radiant公司近日开源的smevals评估框架正是瞄准了这一痛点,它提供了一套轻量且专为小模型和大模型运行基...

Read More
2026-07-28 talkingdev

谷歌云发布Gemini蒸馏服务:用gemini-2.5-flash复现大模型推理能力

谷歌云在Gemini企业智能体平台上正式推出Gemini蒸馏服务(Gemini Distillation Service),旨在通过大型“教师”模型的输出和推理路径,训练出更小、更高效的“学生”模型。该服务专门针对高吞吐量、低延迟严苛要求的应...

Read More
2026-07-21 talkingdev

智能体集群与新模型经济学:Cursor 实验揭示低成本高效协作范式

Cursor 团队近期在一项构建 SQLite 的智能体集群实验中取得突破性发现,展示了结构化的多智能体协作在复杂软件工程任务中的巨大潜力。新方案采用规划智能体负责任务分解,再由多个工作智能体并行执行,这种协调机制...

Read More
2026-05-13 talkingdev

强化学习赋能递归语言模型:小模型也能媲美Claude Sonnet,成本大幅降低

大型语言模型的部署成本一直是其广泛应用的主要障碍之一。一篇来自AlphaXiv的最新研究提出了一种创新解决方案:通过强化学习微调递归语言模型(RLMs)。该方法的核心在于训练一个共享的策略,同时驱动父模型和子模型...

Read More
2026-05-08 talkingdev

谷歌Gemma大模型提速3倍!投机解码技术揭秘:小模型“草稿师”成关键

谷歌近期在Gemma大型语言模型上实现了令人瞩目的推理速度提升,成功将性能提升了三倍。这一突破性进展的核心在于采用了“投机解码”(Speculative Decoding)技术。该技术的工作原理是部署一个轻量级、速度极快的“草稿...

Read More
2026-01-23 talkingdev

小模型大作为:谷歌提出分解法,实现更优意图理解,兼顾效率与隐私

谷歌研究团队近日发布了一项关于提升智能体意图理解能力的技术成果。核心观点指出,要让AI智能体真正发挥作用,其底层模型必须精准理解用户交互时的真实意图。当前,大型多模态大语言模型虽已在此任务上表现不俗,但...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page