漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-23 talkingdev

告别昂贵算力:Petals让大模型在家用显卡上分布式运行成为现实

Petals 是一个颠覆性的点对点网络平台,它让普通用户能够在自己家中,仅凭消费级GPU甚至是免费的Google Colab笔记本环境,就运行起像 Llama 3.1、Mixtral、Falcon 和 BLOOM 这类巨型语言模型。其核心技术思路是将大...

Read More
2026-07-23 talkingdev

现实世界Text-to-SQL没那么简单:新基准Beaver揭示大模型真实表现远低于预期

自然语言转SQL(Text-to-SQL)被认为是让非技术用户轻松与数据库交互的关键技术,然而现有评测基准大多在干净、规范的数据集上进行,严重脱离企业真实数据仓库的复杂状况。近日公布的新基准Beaver直接源于真实业务数...

Read More
2026-07-23 talkingdev

Cursor Router 发布:智能模型路由以60%更低成本实现前沿级代码生成质量

人工智能开发工具领域的先锋 Cursor 正式发布了其最新的智能路由系统——Cursor Router。该技术基于一个动态模型选择引擎,能够智能分析当前开发任务的性质、上下文复杂度以及用户意图,自动将请求路由到最合适的底层...

Read More
2026-07-22 talkingdev

Poolside 发布 Laguna S 2.1:1180 亿参数 MoE 模型,专攻智能体编程,上下文窗口突破 100 万 token

专攻 AI 编码的初创公司 Poolside 在 Hugging Face 上正式发布了其最新大型语言模型 Laguna S 2.1。该模型采用混合专家架构,总参数量高达 1180 亿,但每个 token 仅激活其中 80 亿个参数,在保持强大能力的同时实现...

Read More
2026-07-21 talkingdev

开源|Wigolo:零成本本地优先的AI代理网络情报工具,无需API密钥即可执行搜索与爬取

Wigolo是一款面向AI编码代理的本地优先网络情报工具,近期以公开测试版形式在GitHub发布。该工具的创新之处在于将搜索、抓取、爬取与结构化数据提取等网络任务完全本地化,直接通过MCP(模型上下文协议)为AI代理提...

Read More
2026-07-20 talkingdev

开源|大模型之战,是数据库战争的重演吗?

该观点将当前的大语言模型竞争与上世纪90年代的数据库之争进行了历史性类比,揭示了技术基础设施演进的一种深层规律。作者认为,大语言模型正沿着数据库的发展轨迹前进:从最初作为引发行业狂热的前沿技术,逐步演化...

Read More
2026-07-20 talkingdev

LLM辅助编程引发“人在回路”疲劳,软件工程师角色正被重塑

随着大语言模型(LLM)在编程领域的广泛应用,一种被称为“人在回路疲劳”的现象开始在开发者群体中蔓延。越来越多的工程师发现,虽然LLM大幅提升了代码生成效率,但也带来了持续性的认知负担。开发者不再仅仅专注于创...

Read More
2026-07-20 talkingdev

Netflix 自研内部 LLM 推理平台:基于 vLLM 与 Triton 的统一服务架构,实现高效模型部署与 A/B 测试

Netflix 近期公开了其内部自研的大语言模型(LLM)推理服务平台的设计与实践。与依赖外部托管 API 不同,该平台将模型部署和推理完全集成到 Netflix 现有的生产环境中,既保障了数据安全与低延迟,又实现了对模型的...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page