由于室外数据的复杂性和空白性,真实世界的室外环境一直是3D场景生成中被忽视的挑战。SemCity通过专注于真实世界的室外环境,彻底颠覆了3D场景生成,实现了真实的室外场景生成。SemCity通过3D扩散模型,将真实世界的...
Read More这项研究介绍了一种创新的视频生成方法,使用状态空间模型(SSMs)克服了传统的基于注意力扩散模型的内存限制,重点关注线性内存消耗。在UCF101和MineRL Navigate数据集的测试中,SSMs能够创建具有竞争力质量的更长...
Read MoreMoAI是一种新型的大型语言和视觉模型,它通过整合专门的计算机视觉任务的辅助视觉信息来增强当前模型。该模型在 GitHub 上发布,旨在改善自然语言处理和计算机视觉任务之间的互动。MoAI使用了一种新的训练方法,可以...
Read More据报道,自动驾驶软件领导者Applied Intuition完成了2.5亿美元的D轮融资,其估值达到了60亿美元,比之前的估值增长了67%。该公司的生成式人工智能技术用于开发汽车、卡车和其他行业的软件,导致了三位数的盈利增长和...
Read More谷歌DeepMind的SIMA是一个通用的AI代理,可在各种电子游戏环境中遵循自然语言指令。它标志着将AI系统变得更加多才多艺、可指导的转变。此前,AI系统只能在特定的环境中工作,现在SIMA可以在多种环境下工作,这是一项...
Read MorePerplexity将Yelp的数据整合到其聊天机器人中,以提供用户直接丰富的本地搜索结果,包括地图、评论和餐厅详细信息,从而增强聊天机器人的回答能力。Perplexity是一家专注于自然语言处理和人工智能技术的创业公司,其...
Read More微软在第14届Ability Summit上宣布了一系列面向无障碍性的更新,包括面向残障开发人员的新Azure AI功能,面向语言障碍者的“Speak For Me”功能的预览版,Copilot的新技能和心理健康工具包。
Read More谷歌正在为Gemini Web应用程序推出一项新功能,允许用户使用重新生成、更短、更长和删除等选项微调AI生成的响应,目的是提供对创意内容更大的控制。
Read More