漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-02-04 talkingdev

开源|GLM-OCR:集成CogViT与GLM-0.5B的多模态文档理解模型发布

近日,由zai-org团队在Hugging Face平台开源了GLM-OCR模型,这是一款专为复杂文档理解设计的先进多模态OCR系统。该模型的核心创新在于其精巧的三段式架构:首先,它采用了在大规模图文数据上预训练的CogViT视觉编码...

Read More
2026-02-04 talkingdev

论文推荐|SWE-Universe:从GitHub PR构建百万级可验证软件工程环境

近日,一项名为SWE-Universe的研究提出了一种革命性的可扩展框架,旨在从GitHub的拉取请求中自动构建真实世界的软件工程可验证环境。该研究成功解决了自动化构建中长期存在的三大挑战:构建成功率低、验证机制薄弱以...

Read More
2026-02-04 talkingdev

开源AI生态全景展望:从DeepSeek时刻到AI+时代

近日,Hugging Face发布深度博文,系统回顾了自“DeepSeek时刻”以来全球开源人工智能生态的发展轨迹。文章指出,以DeepSeek为代表的开源模型发布事件,标志着AI发展进入了一个由开放协作驱动的新阶段。该文深入剖析了...

Read More
2026-02-03 talkingdev

开源|Shorlabs:号称“后端Vercel”,简化Python/Node.js应用部署与扩展

近日,GitHub上一个名为Shorlabs的开源项目引起了开发者社区的关注,它旨在成为后端服务领域的“Vercel”。该项目专注于简化Python和Node.js后端应用程序的部署、管理与扩展流程。其核心在于利用AWS Lambda无服务器架...

Read More
2026-02-03 talkingdev

开源|Cloudflare推出Moltworker:在边缘运行个人AI助手OpenClaw

Cloudflare近日在GitHub上开源了一个名为Moltworker的实验性项目,该项目旨在将个人AI助手OpenClaw(曾用名Moltbot、Clawdbot)部署于其边缘计算平台Cloudflare Workers的沙箱环境中运行。这一举措标志着AI应用正加...

Read More
2026-02-03 talkingdev

深度解析:OpenAI Codex CLI核心代理循环如何协同模型与工具

OpenAI近期发布的Codex CLI是一款跨平台的本地软件代理,其核心机制——代理循环(agent loop)——代表了当前AI代理技术的前沿方向。该循环系统性地编排了用户、大语言模型与各类工具之间的交互流程:它首先迭代式地构...

Read More
2026-02-03 talkingdev

论文推荐|NVIDIA提出“金鹅”方法:从未经验证的网络文本中无限合成RLVR任务,突破大模型强化学习瓶颈

近日,NVIDIA研究团队提出了一种名为“金鹅”(Golden Goose)的创新方法,旨在解决大语言模型(LLM)强化学习领域的一个关键瓶颈。当前,基于可验证奖励的强化学习(RLVR)是解锁LLM复杂推理能力的重要基石,但其发展...

Read More
2026-02-03 talkingdev

开源模型逆袭!GPT-OSS 120B通过DPO微调,在人类偏好对齐任务上超越GPT-5.2

一项最新研究显示,通过对开源大语言模型进行高效的微调,其性能可以超越顶尖的闭源模型。研究团队采用直接偏好优化方法,仅使用5400对偏好数据对GPT-OSS 120B模型进行训练,使其在RewardBench 2评估基准的人类偏好...

Read More
  1. Prev Page
  2. 52
  3. 53
  4. 54
  5. Next Page