漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-03 talkingdev

Qwen3.8-Max震撼登场:2.4万亿参数重新定义编码与协作的极限

通义千问团队正式发布了其新一代旗舰模型Qwen3.8-Max,该模型以惊人的2.4万亿参数量,在编码、办公协同、深度研究及长周期任务处理等多个维度实现了代际跨越。不同于仅能提供简单问答的常规模型,Qwen3.8-Max展现出...

Read More
2026-07-30 talkingdev

Escha-W2:将35B混合专家模型压缩至12.3GB,单张消费级GPU即可本地运行

EschaLabs 近日发布了 Escha-W2,这是对 Qwen3.6-35B-A3B 混合专家(MoE)模型进行 2 比特量化后的构建版本。Qwen3.6-35B-A3B 本身是一个包含 256 个专家的庞大架构,总参数量达到 35B,但在每次推理中仅激活 3B 参...

Read More
2026-07-22 talkingdev

通义千问发布Qwen-Image-3.0图像生成模型:支持4.5k token输入,原生渲染12种语言

阿里巴巴通义千问团队近日正式推出第三代基础图像生成模型Qwen-Image-3.0,在内容丰富度、细节真实感和世界知识融合方面实现全面升级。该模型支持最高4.5k token的文本输入,能够精准理解复杂长文本的语义,并生成富...

Read More
2026-07-22 talkingdev

中国AI模型已占OpenRouter美国企业六成Token用量,技术封锁恐反噬本土生态

彭博社报道揭示了一个正在重塑全球AI竞争格局的关键数据:在主流大模型路由平台OpenRouter上,来自中国的AI模型已经贡献了美国企业约60%的Token使用量。这意味着,无论从模型调用频次还是实际算力消耗来看,中国大模...

Read More
2026-07-20 talkingdev

阿里巴巴宣布2.4万亿参数模型Qwen3.8即将开源,预览版已上线

阿里巴巴通义千问团队正式公布Qwen3.8,这是一款参数规模高达2.4万亿的超大规模语言模型,并明确表示将以开放权重(Open-Weight)的方式面向全球发布。这不仅是Qwen系列模型参数的又一次飞跃,也反映出阿里巴巴在开...

Read More
2026-07-13 talkingdev

论文推荐| 主动记忆代理:在关键时刻唤醒长程智能体的记忆

在执行复杂的长程任务时,智能体常常面临“行为状态衰减”困境:随着交互轨迹不断拉长,大量与决策相关的关键信息,如任务要求的变化、环境反馈、过往失败尝试的诊断以及尚未完成的子目标,会逐渐被淹没在上下文窗口中...

Read More
2026-06-26 talkingdev

DeepReinforce开源Ornith-1.0编程模型:能自我编写强化学习框架,性能比肩Claude Opus 4.7

DeepReinforce近日开源了其新一代编程模型家族Ornith-1.0,这一系列模型的最大亮点在于具备自我编写强化学习(RL)训练框架的能力,标志着AI模型在自我优化和自动化研究方向上迈出重要一步。Ornith-1.0家族基于预训...

Read More
2026-06-15 talkingdev

开源|里约热内卢“自研”大模型被曝实为“拼接怪”:397B参数模型被指直接合并现有权重

近日,巴西里约热内卢市政府下属机构IplanRIO发布的“自研”大语言模型Rio-3.5-Open-397B陷入争议。GitHub社区及技术专家发现,该模型并非如其宣传所言“完全原创”,其权重实际上是通过对现有模型——Nex-AGI团队的Nex-N2...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page