微信扫码实时跟踪AI前沿
最新研究表明,长视频理解领域存在多粒度噪声对应问题,影响了视频语言研究的准确性。为了解决这一问题,研究人员开发了一种名为Norton的新方法,应用了最优传输算法来提高长期视频理解。该方法通过处理多粒度噪声对...
TESTA,一种旨在通过组合相似帧和补丁来加速理解长视频的方法。使用TESTA,研究人员成功地降低了计算负荷,并提高了匹配段落到视频以及回答关于长视频的问题的性能。