谷歌最新启动的Mobility AI计划,旨在通过人工智能技术彻底革新城市交通体系。该计划整合了三大核心技术模块:AI驱动的多源交通数据实时分析系统、基于深度学习的城市交通流仿真平台,以及具备自适应优化能力的智能...
Read More近日,一项名为KGMEL的创新性研究提出了一种突破性的多模态实体链接方法,通过三阶段处理流程整合文本、图像及知识图谱三元组数据,显著提升了实体识别的准确率。该技术通过第一阶段的多模态特征提取、第二阶段的跨...
Read More近日,科技社区热议的π0.5(Pi-0.5)模型在开放世界泛化能力上取得重要进展。该视觉语言模型(VLA)通过创新架构设计,在未见过的新场景中展现出超越同类模型的零样本学习能力。技术博客透露,其核心突破在于动态多...
Read More开发者Eric Jenott在GitHub上开源了名为Evertop的创新项目,该设备完美复刻了1983年经典IBM XT电脑的外形,但革命性地采用电子墨水屏作为显示核心。这款设备最引人注目的特性是其超长续航能力——单次充电可连续运行10...
Read More近日,一种名为Turing-Drawings的算法艺术形式引发技术圈广泛关注。该项目通过模拟图灵机原理,将数学计算与视觉艺术相结合,生成极具抽象美感的数字绘画作品。其核心在于利用确定性有限状态自动机的规则集控制像素...
Read More微软DeepSpeed团队在GitHub开源了DeepCompile项目,通过引入编译技术显著提升分布式训练性能。该项目针对训练过程中的瓶颈操作进行深度优化,采用改进版的torch compile实现算子融合与代码生成,实测可使关键操作获...
Read More谷歌研究院与加州大学团队在arXiv最新发表的论文提出3D CoCa框架,这一突破性技术通过整合视觉语言对比学习(Contrastive Learning)与场景描述(Captioning)两大前沿方向,实现了对三维场景的多模态联合理解。该框...
Read More全球领先的人工智能研究实验室 OpenAI 最近发布了两款新型的模拟推理模型——o3和o4-mini。这两款模型不仅拥有模拟推理的能力,还首次集成了对各种ChatGPT工具的访问功能,包括网页浏览和编程等,这标志着OpenAI在推理...
Read More