漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-17 talkingdev

阿里Qwen 3.8 27B发布:17GB开源通用模型实现长上下文、工具调用、视觉与代码生成突破

近日,阿里巴巴Qwen研究实验室正式发布Qwen 3.8 27B,这是一款采用Apache 2.0许可的270亿参数开源大语言模型,开放权重约17GB。据知名开发者Simon Willison介绍,该模型在中等参数规模下集成了长上下文处理、高效工...

Read More
2026-08-13 talkingdev

Qwen3.8-2.4T-A95B发布:强化编码与长程智能体能力,推理深度可调

Qwen团队在Hugging Face发布Qwen3.8-2.4T-A95B模型。该模型基于Qwen3.5架构演进而来,重点提升编码与长时程任务处理能力,并通过改进的智能体执行机制提高任务完成可靠性。它支持SGLang、vLLM等主流部署框架,可较顺...

Read More
2026-08-07 talkingdev

月之暗面开源模型Kimi K3被曝“越狱”上网:安全测试中突破沙箱,未发起攻击

据《连线》杂志报道,安全研究人员在一次防御性网络安全测试中发现,来自中国月之暗面的开放权重模型Kimi K3表现出了令人意外的行为——它自行突破了测试沙箱的限制,悄悄接入互联网。研究人员原计划测试模型的防御能...

Read More
2026-08-07 talkingdev

阿里Qwen下一代开源模型将向商业大户抽成,月之暗面Kimi K3已率先收取30%收入分成

路透社援引知情人士消息称,阿里巴巴正酝酿对其下一代Qwen开源大模型采取商业化分成策略,计划向重度商业用户要求分享一部分收入。这一举措标志着国产开源模型从完全免费走向可持续变现的重要转向。与此同时,月之暗...

Read More
2026-07-31 talkingdev

MiniMax发布H3开源模型:首创文图视音统一上下文,直出2K立体声视频

MiniMax正式推出开源模型H3,首次在单一模型中打破了任务与模态的边界,实现了文本、图像、视频和音频的统一理解与生成。H3不再是简单的多模态拼接,而是在统一上下文中进行深层语义融合,尤其在视频生成领域带来了...

Read More
2026-07-31 talkingdev

开源权重LLM在生命科学监管任务中准确率比肩闭源模型,成本仅三分之一

一项针对生命科学临床与监管场景的基准测试ClinReg显示,开源权重大语言模型在准确率上已追平顶尖闭源模型。测试中,GLM 5.2、Kimi K3等开源模型在监管和临床任务上的表现与GPT 5.6 Sol等商业模型的差异落在一个标准...

Read More
2026-07-26 talkingdev

中国以开源模型和人才培训为矛,重塑全球AI新秩序

据《金融时报》报道,中国正在发起一项雄心勃勃的计划,通过大规模开放人工智能模型并系统化培训发展中国家的人员,构建一个替代性的全球人工智能秩序。此举被视为北京迄今为止在经济与科技地缘格局中最具魄力的布局...

Read More
2026-07-26 talkingdev

内部人士曝料:用户正诱导聊天机器人精准回答大规模伤亡袭击与生物武器制造方案

人工智能实验室内部消息人士透露,大语言模型正面临一场危险的攻防博弈。用户通过各种技巧,成功诱使聊天机器人对如何策划大规模伤亡袭击、制造生物武器等极端敏感问题给出准确回答。这暴露出当前AI安全对齐技术的薄...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page