漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-08 talkingdev

开源|Qwen-Drive-1.0:打通感知、语言与规划的自动驾驶视觉语言基础模型

QwenLM团队在GitHub开源了Qwen-Drive-1.0项目,定位为面向自动驾驶的视觉语言基础模型。该项目采用分阶段训练策略,将感知、语言理解和规划目标融合到统一框架中,使模型既能获得专业驾驶能力,又能保留广泛的视觉理...

Read More
2026-09-06 talkingdev

消息称卡兰尼克旗下Atoms研发robotaxi:收购Pronto、聘请莱万多夫斯基,Uber投资1亿美元

据金融时报消息,特拉维斯·卡兰尼克创立的Atoms公司正在开发自动驾驶出租车(robotaxi)技术,并在收购安东尼·莱万多夫斯基创办的Pronto后将其纳入团队。Uber已向Atoms投资1亿美元。Atoms正筹备大规模招聘,未来可能...

Read More
2026-08-30 talkingdev

英伟达“物理AI”年入百亿美元,中国机器人厂商仍依赖其芯片与软件

英伟达的芯片业务正在从训练大语言模型扩展到“物理AI”领域,即驱动机器人、自动驾驶等与真实物理世界交互的智能系统。据华尔街日报援引业内人士消息,英伟达物理AI相关业务年收入已约100亿美元,凸显其从云端训练延...

Read More
2026-08-16 talkingdev

黑莓Q1现金流转正:2017年以来首次,QNX与Secusmart成关键推手

据《金融时报》报道,黑莓公司第一季度实现正现金流,这是自2017财年以来首次在第一季度取得现金正向表现。主要推动力来自旗下QNX车载操作系统和Secusmart安全通信产品。曾以手机硬件闻名的黑莓,在智能手机业务淡出...

Read More
2026-08-11 talkingdev

开源|Qwen-MM-Plugins发布:让任意智能体原生多模态化

阿里巴巴通义千问团队在GitHub上正式开源了Qwen-MM-Plugins项目,这是一个专为Qwen模型设计的原生多模态插件集合。该项目的核心目标是让任意基于大模型的智能体能够直接“看”懂多种模态信息,而不仅仅局限于文本交互...

Read More
2026-07-26 talkingdev

前Meta团队打造AI原生图像传感器,Elio获2100万美元A轮融资

由前Meta硬件工程师创立的初创公司Elio宣布完成2100万美元的A轮融资,本轮由Innovation Endeavors和Xora联合领投。Elio正在开发一种颠覆传统思路的图像传感器架构,其设计目标不再是为人眼所见的视觉质量服务,而是...

Read More
2026-07-14 talkingdev

DeepMind推出GenCeption:视频生成预训练变身通用视觉模型,多任务六合一实测SOTA

DeepMind提出了GenCeption,将预训练的视频生成模型重新设计为一种可通过文本指令控制的统一视觉系统,引发学界关注。该模型基于前馈、非自回归的生成式架构,不需要针对下游任务进行微调即可同时处理深度估计、表面...

Read More
2026-06-20 talkingdev

VLC创始人的新篇章:低延迟远程设备控制SDK公司Kyber获500万美元融资

由VLC媒体播放器首席开发者Jean-Baptiste Kempf创立的巴黎初创公司Kyber,宣布获得500万美元融资,由知名风投Lightspeed领投。Kyber专注于开发低延迟远程设备控制SDK,旨在将VLC在高性能视频处理方面的技术积累,延...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page