漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-31 talkingdev

开源权重LLM在生命科学监管任务中准确率比肩闭源模型,成本仅三分之一

一项针对生命科学临床与监管场景的基准测试ClinReg显示,开源权重大语言模型在准确率上已追平顶尖闭源模型。测试中,GLM 5.2、Kimi K3等开源模型在监管和临床任务上的表现与GPT 5.6 Sol等商业模型的差异落在一个标准...

Read More
2026-07-31 talkingdev

Thinking Machines发布Inkling-Small:仅四分之一规模,多模态推理能力不打折

人工智能公司Thinking Machines正式推出开源权重模型Inkling-Small,以更小的体量实现了与Inkling相当的性能。该模型采用混合专家架构,总参数量达276B,但每次推理仅激活12B参数,大幅降低算力需求。Inkling-Small...

Read More
2026-07-30 talkingdev

开源|TurboFieldfare:任意M系列MacBook仅需2GB内存即可运行Gemma 4 26B-A4B模型

苹果生态中内存长期被认为是大模型本地推理的瓶颈,而TurboFieldfare项目提供了一个极具突破意义的解决方案。这个专门为Apple Silicon Mac设计的自定义运行时,让庞大的Gemma 4 26B-A4B模型(完整加载需约14.3 GB内...

Read More
2026-07-30 talkingdev

开源|Claude Code Merge Queue:本地并行合并队列,彻底告别推送竞争与资源冲突

在持续集成和多人协作的开发流程中,代码合并队列是保障主干质量的关键环节,但传统的集中式合并方案往往面临云端成本高昂、推送竞争(push races)导致构建失败以及资源冲突等问题。近日,一个名为 Claude Code Mer...

Read More
2026-07-30 talkingdev

Escha-W2:将35B混合专家模型压缩至12.3GB,单张消费级GPU即可本地运行

EschaLabs 近日发布了 Escha-W2,这是对 Qwen3.6-35B-A3B 混合专家(MoE)模型进行 2 比特量化后的构建版本。Qwen3.6-35B-A3B 本身是一个包含 256 个专家的庞大架构,总参数量达到 35B,但在每次推理中仅激活 3B 参...

Read More
2026-07-29 talkingdev

开源|微软发布Flint:一种专为AI代理设计的可视化语言,让图表生成更可靠、更美观

微软在GitHub上开源了Flint项目,这是一种全新的可视化语言,旨在让AI代理能够从简洁、人类可编辑的图表规格中,可靠地生成富有表现力且外观精美的图表。该项目的核心在于它不再依赖AI模型直接输出不确定的绘图代码...

Read More
2026-07-29 talkingdev

开源|OpenAI发布Codex Security:用AI驱动的代码安全扫描工具,一站式检测与追踪漏洞

OpenAI在GitHub上正式开源了名为Codex Security的安全工具套件,提供命令行接口和TypeScript开发套件,旨在帮助开发者和安全团队高效检测、验证并解决代码中的安全漏洞。该工具的核心能力在于自动化代码扫描与漏洞追...

Read More
2026-07-29 talkingdev

微软推出轻量级多模态模型家族Mage:4B参数实现高效训练与部署

微软研究团队近期发布了Mage,一个专为研究场景设计的轻量级多模态模型家族。该系列模型严格遵循40亿参数的固定预算,在保持紧凑架构的同时,性能足以比肩规模大得多的开源系统。Mage包含两大核心成员:Mage-VL和Mag...

Read More
  1. Prev Page
  2. 11
  3. 12
  4. 13
  5. Next Page