漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-01 talkingdev

OpenAI重消费轻开发,Anthropic靠AI编程工具实现营收与估值反超

据《华尔街日报》援引消息人士报道,OpenAI在营收增长和公司估值上正被竞争对手Anthropic逐渐甩开,原因在于其过度押注消费者聊天机器人和各类博眼球的副项目,而忽视了悄然爆发的AI编程工具机遇。知情人士透露,当O...

Read More
2026-07-31 talkingdev

开源|World Model Optimizer:基于智能体轨迹蒸馏前沿模型,构建持续进化的自主智能

World Model Optimizer(WMO)是由experientiallabs开源的一项工具,直面当前智能体(Agent)系统性能优化与模型成本之间的矛盾。其核心思路是将智能体在实际运行中积累的交互轨迹作为高价值训练数据,通过知识蒸馏...

Read More
2026-07-31 talkingdev

开源WASTE推理引擎发布:仅需29GB内存即可本地运行2700亿参数Kimi K3模型

近日,开源推理引擎WASTE正式亮相,其核心亮点在于能够运行权重规模远超宿主设备物理内存的模型。该引擎作为让强大模型在更多硬件上可用的初步举措,旨在为个人和机构在基础设施成本、数据隐私、可用性及部署方式上...

Read More
2026-07-31 talkingdev

Thinking Machines发布Inkling-Small:仅四分之一规模,多模态推理能力不打折

人工智能公司Thinking Machines正式推出开源权重模型Inkling-Small,以更小的体量实现了与Inkling相当的性能。该模型采用混合专家架构,总参数量达276B,但每次推理仅激活12B参数,大幅降低算力需求。Inkling-Small...

Read More
2026-07-30 talkingdev

开源|TurboFieldfare:任意M系列MacBook仅需2GB内存即可运行Gemma 4 26B-A4B模型

苹果生态中内存长期被认为是大模型本地推理的瓶颈,而TurboFieldfare项目提供了一个极具突破意义的解决方案。这个专门为Apple Silicon Mac设计的自定义运行时,让庞大的Gemma 4 26B-A4B模型(完整加载需约14.3 GB内...

Read More
2026-07-30 talkingdev

ChatGPT智能体循环优化揭秘:Harness、API与推理三层架构如何实现降本增效

在大语言模型走向产业级部署的进程中,如何在不显著牺牲质量的前提下降低推理成本和响应时延,是各家前沿实验室竞相突破的核心瓶颈。OpenAI工程师团队首次较为系统地披露了支撑ChatGPT及Codex高效运转的智能体循环(...

Read More
2026-07-29 talkingdev

Kimi K3架构全面公开:LatentMoE、Kimi Delta Attention与原生多模态驱动推理效率跃迁

近日,Kimi K3模型的开放权重发布揭示了其架构的诸多细节。该模型本质上是去年发布的Kimi Linear架构的规模化生产版本,整体设计明显向着更高的推理效率演进。K3现已原生支持多模态输入,进一步拓宽了应用边界。本次...

Read More
2026-07-28 talkingdev

Ramp Labs开源PorTAL框架:一次训练即可跨模型复用LoRA任务表示

Ramp Labs近日正式开源了PorTAL框架,这是一个面向共享任务表示与跨模型LoRA适配的前沿工具。PorTAL的核心思路在于将任务知识与基座模型解耦:它首先学习一个与模型架构无关的“任务隐变量”,再通过轻量级的逐模型对...

Read More
  1. Prev Page
  2. 13
  3. 14
  4. 15
  5. Next Page