漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-25 talkingdev

英伟达支持的AI云服务商Lambda被曝寻求融资30亿美元,估值或超120亿

据彭博社援引知情人士消息,英伟达投资的AI云计算公司Lambda Inc.正在洽谈一轮最高30亿美元的融资,估值可能超过120亿美元,其今年营收预计将达到15亿美元以上。Lambda是典型的“新云”(neocloud)服务商,主要提供面...

Read More
2026-08-24 talkingdev

AI芯片架构竞赛升级:英伟达、谷歌TPU、AMD Instinct与Cerebras晶圆级引擎分化演进

AI芯片架构正沿不同技术路线加速分化。英伟达GPU强调可编程性与可扩展架构,在通用AI训练和推理生态中保持主导;谷歌TPU采用专用化设计,针对矩阵乘法进行深度优化,以更高能效支撑大规模深度学习负载;AMD Instinct...

Read More
2026-08-22 talkingdev

消息称 Anthropic IPO 或募资超 1000 亿美元,估值 2 万亿美元超 SpaceX

据《纽约时报》援引知情人士消息,Anthropic 的银行家在近期与潜在投资者的沟通中表示,这家成立仅五年的人工智能初创公司可能在首次公开募股(IPO)中筹集超过 1000 亿美元资金,整体估值有望达到 2 万亿美元。若这...

Read More
2026-08-21 talkingdev

论文推荐|TaoLive提出Harness感知训练:35B数字人直播代理实时适应可变接口,P50延迟仅3.4秒

TaoLive团队针对直播电商数字人代理的实时性与适应性矛盾,提出Harness-Aware Training(HAT)后训练方法。其核心是将技能、钩子、系统提示和工具模式从模型权重中解耦,使运行时行为可随业务策略变化而无需重新训练...

Read More
2026-08-21 talkingdev

PagedAttention:用虚拟内存破解KV缓存碎片化,大模型GPU并发推理提升2-4倍

大模型自回归推理过程中,KV缓存用于保存每个请求的注意力键值对,避免每一步解码都重新计算。但随着序列长度增加,KV缓存会线性膨胀,长上下文场景下甚至会消耗比模型权重更多的GPU显存,成为稀缺资源。更严重的...

Read More
2026-08-20 talkingdev

Agent Memory正成为AI智能体护城河:上下文复利如何改变竞争格局

Redis 最新博客文章分析了智能体记忆(Agent Memory)为何能成为 AI 系统的持久竞争优势。传统大模型大多是无状态的,无法在多次交互之间保存信息;而具备记忆能力的智能体可以持久化、组织和召回历史信息,从静态推...

Read More
2026-08-20 talkingdev

Replit推出免费模式:接入GPT-5.6 Luna,日常任务不消耗积分

Replit宣布推出免费模式(Free Mode),用户在日常任务中调用OpenAI GPT-5.6 Luna时将不再消耗积分,官方称可让创作产出提升30倍。该模式通过全新界面打通聊天、任务执行与完整项目构建之间的流程,使从想法到成品的...

Read More
2026-08-19 talkingdev

GLM-5.3 API上线:每百万token 1.4/4.4美元,开源权重并列全球第一

z.ai 正式通过 API 发布 GLM-5.3 模型,沿用上一代 GLM-5.2 的定价,输入和输出费用分别为每百万 token 1.4 美元和 4.4 美元。据 Artificial Analysis 评估,GLM-5.3 与月之暗面 Kimi K3 并列全球性能最强的开源权重...

Read More
  1. Prev Page
  2. 6
  3. 7
  4. 8
  5. Next Page