据彭博社援引知情人士消息,英伟达投资的AI云计算公司Lambda Inc.正在洽谈一轮最高30亿美元的融资,估值可能超过120亿美元,其今年营收预计将达到15亿美元以上。Lambda是典型的“新云”(neocloud)服务商,主要提供面...
Read MoreAI芯片架构正沿不同技术路线加速分化。英伟达GPU强调可编程性与可扩展架构,在通用AI训练和推理生态中保持主导;谷歌TPU采用专用化设计,针对矩阵乘法进行深度优化,以更高能效支撑大规模深度学习负载;AMD Instinct...
Read More据《纽约时报》援引知情人士消息,Anthropic 的银行家在近期与潜在投资者的沟通中表示,这家成立仅五年的人工智能初创公司可能在首次公开募股(IPO)中筹集超过 1000 亿美元资金,整体估值有望达到 2 万亿美元。若这...
Read MoreTaoLive团队针对直播电商数字人代理的实时性与适应性矛盾,提出Harness-Aware Training(HAT)后训练方法。其核心是将技能、钩子、系统提示和工具模式从模型权重中解耦,使运行时行为可随业务策略变化而无需重新训练...
Read More在大模型自回归推理过程中,KV缓存用于保存每个请求的注意力键值对,避免每一步解码都重新计算。但随着序列长度增加,KV缓存会线性膨胀,长上下文场景下甚至会消耗比模型权重更多的GPU显存,成为稀缺资源。更严重的...
Read MoreRedis 最新博客文章分析了智能体记忆(Agent Memory)为何能成为 AI 系统的持久竞争优势。传统大模型大多是无状态的,无法在多次交互之间保存信息;而具备记忆能力的智能体可以持久化、组织和召回历史信息,从静态推...
Read MoreReplit宣布推出免费模式(Free Mode),用户在日常任务中调用OpenAI GPT-5.6 Luna时将不再消耗积分,官方称可让创作产出提升30倍。该模式通过全新界面打通聊天、任务执行与完整项目构建之间的流程,使从想法到成品的...
Read Morez.ai 正式通过 API 发布 GLM-5.3 模型,沿用上一代 GLM-5.2 的定价,输入和输出费用分别为每百万 token 1.4 美元和 4.4 美元。据 Artificial Analysis 评估,GLM-5.3 与月之暗面 Kimi K3 并列全球性能最强的开源权重...
Read More