漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-20 talkingdev

Netflix 自研内部 LLM 推理平台:基于 vLLM 与 Triton 的统一服务架构,实现高效模型部署与 A/B 测试

Netflix 近期公开了其内部自研的大语言模型(LLM)推理服务平台的设计与实践。与依赖外部托管 API 不同,该平台将模型部署和推理完全集成到 Netflix 现有的生产环境中,既保障了数据安全与低延迟,又实现了对模型的...

Read More
2026-07-17 talkingdev

Moonshot 发布 Kimi K3:2.8万亿参数多模态巨擘,百万Token上下文与代理编码能力全开

国内人工智能公司 Moonshot 正式推出新一代旗舰多模态模型 Kimi K3,参数规模高达 2.8 万亿,并原生支持 100 万 token 的超长上下文窗口。K3 的亮点不仅在于规模,更在于工程上的深度优化:团队针对长上下文场景大幅...

Read More
2026-07-15 talkingdev

DeepSeek年化收入逼近5亿美元,新一轮融资目标估值翻倍至约740亿美元

据The Information援引知情人士消息,中国开源AI明星企业DeepSeek的年度经常性收入近期已达到4亿至5亿美元区间,展现出强劲的商业化增长势头。在这一业绩支撑下,公司正积极推进第二轮融资,计划筹集约74亿美元资金...

Read More
2026-07-14 talkingdev

开源|Engram:为AI编程代理打造持久记忆系统,跨会话上下文无忧

Engram是一款专为AI编程代理设计的持久记忆系统,旨在解决智能体在跨会话协作中上下文丢失的痛点。作为一个语言无关的独立Go二进制文件,它底层采用SQLite进行数据存储,并集成了FTS5全文搜索引擎,实现了高效的知识...

Read More
2026-07-13 talkingdev

Claude Code竟如此耗Token?实测发现其指令开销为OpenCode的4.7倍

一项针对AI编程工具Claude Code与OpenCode的测评显示,在开始读取用户提示之前,Claude Code的系统级指令和工具定义等前置开销就已达到约33000个Token,而OpenCode仅为7000个Token,前者是后者的4.7倍。这一差异源于...

Read More
2026-07-12 talkingdev

Meta发布Muse Spark 1.1:多模态推理与工具交互能力大幅增强,同步开放API预览

Meta正式推出了新一代AI模型Muse Spark 1.1,在工具调用、代码生成、计算机交互和多模态推理等关键维度上实现了显著升级。该版本通过深度的模型架构优化与训练数据配比调整,让模型在理解复杂指令并自主操控外部工具...

Read More
2026-07-12 talkingdev

SpaceXAI 发布 Grok 4.5:面向编码、自主代理与知识工作的最强模型

SpaceXAI 正式推出其最新一代大语言模型 Grok 4.5,该模型被定义为迄今最先进版本,专为三大核心领域深度优化:编码生成与推理、自主代理(Agentic)任务执行以及高复杂度知识工作。与前代产品相比,Grok 4.5 在工具...

Read More
2026-06-30 talkingdev

开源| Meta 八年磨一剑:Astryx 开源设计系统,赋能 13000+ 应用并面向 AI 智能体

Meta(原 Facebook)近日在 GitHub 上开源了其内部打磨长达八年的设计系统——Astryx。该系统不仅支撑了 Meta 内部超过 13,000 款应用程序的界面开发,更凭借其 150 多个高可访问性组件和丰富主题体系,展示了在极端规...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page