Nov, 2023

缩小差距:一个统一的视频理解框架用于时刻检索和重点检测

TL;DR提出了一种统一视频理解框架 (UVCOM),通过深入挖掘内在的本质特点,联合解决视频片段检索和重点片段检测问题。在多粒度的内部和跨模态的进步集成中,通过多方面对比学习,实现了对视频进行全面理解,成功地提高了效果。