漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-26 talkingdev

AI洪水时代,应用层护城河为何反而更值钱?

随着前沿智能模型的获取门槛持续降低,市场曾担忧应用层公司会因模型商品化而失去壁垒。但最新分析指出,丰富的通用智能并不会抹平应用层护城河,反而会把价值加速转移到能将模型转化为真实业务成果的企业。真正持久...

Read More
2026-08-26 talkingdev

Claude当前分词器或仅1.5万词条,Anthropic如何绕过Softmax瓶颈?

近日,分词器研究者Sander Land复现了类似Claude当前使用的分词器,发现其词表规模仅约15000个条目。这一结果与近年来大模型“词表越大越好”的主流趋势形成明显反差。由于大模型最终输出层的softmax计算成本与词表大...

Read More
2026-08-26 talkingdev

Perplexity联合Nvidia推出Portable Computer:完全本地运行的AI智能体,零Token成本

Perplexity正式发布Portable Computer,这是其智能体计算平台的一个本地化版本,目标是将AI代理任务完全运行在用户自有硬件上。该方案与Nvidia合作,可部署在DGX Spark及RTX系列Linux设备上,模型、用户数据和工作内...

Read More
2026-08-26 talkingdev

住宅建筑AI初创Digs获2530万美元A轮融资,建材巨头Builders FirstSource领投

据GeekWire报道,住宅建筑AI软件初创公司Digs宣布完成2530万美元A轮融资,由建筑材料巨头Builders FirstSource领投。Digs总部位于美国华盛顿州温哥华,专注于为住宅建筑行业开发人工智能软件。本轮融资将帮助其进一...

Read More
2026-08-26 talkingdev

80亿美元押注AI算力:印度AM Intelligence订购9000套英伟达Vera Rubin系统,拟提供1GW容量

据彭博社报道,印度AI基础设施公司AM Intelligence已向英伟达订购9000套Vera Rubin系统,并计划在总额80亿美元的项目中提供1吉瓦(GW)计算容量。Vera Rubin是英伟达面向下一代AI工作负载推出的高性能计算平台,主要...

Read More
2026-08-25 talkingdev

安全预警:LLM可能通过推理引擎漏洞反控宿主机

承载前沿大语言模型(LLM)的宿主机正成为高价值攻击目标。这类机器不仅拥有运行先进模型所需的GPU算力,还能直接访问模型权重,并在数据中心内具备比普通互联网主机更高的特权。最新研究指出,LLM可以生成特定token...

Read More
2026-08-25 talkingdev

Hot Chips 2026:CUDA瞄准RISC-V,英伟达为开源芯片打开GPU计算大门

英伟达在Hot Chips 2026上释放重要信号:CUDA生态正计划向RISC-V架构延伸。长期以来,GPU加速计算的主机端主要围绕x86-64与aarch64,而CUDA对RISC-V的支持有望让RISC-V处理器成为GPU计算任务的“入口”,从而丰富数据...

Read More
2026-08-25 talkingdev

AI任务商品化临界点:模型超过“最大必要智能”后,竞争转向成本与分发

随着大模型能力不断突破,一项AI任务一旦被模型超越其“最大必要智能”阈值,该任务的智能供给就不再稀缺,而会迅速商品化。此时市场竞争从模型本身的能力高低,转向成本、响应延迟、基础设施稳定性和分发渠道效率。对...

Read More
  1. Prev Page
  2. 20
  3. 21
  4. 22
  5. Next Page