BriefGPT.xyz
Jun, 2023
通过补丁选择实现人体姿势估计的高效视觉变换器
Efficient Vision Transformer for Human Pose Estimation via Patch Selection
HTML
PDF
Kaleab A. Kinfu, René Vidal
TL;DR
提出了一种用于减少Vision Transformers计算复杂度的简单方法,通过选择和处理最有信息的小片段,我们将二维人体姿态估计网络的结果作为指导进行小片段的选择,实验结果表明这种方法在显著提高速度和减少计算复杂度方面非常有效,而且性能略微下降。
Abstract
While
convolutional neural networks
(CNNs) have been widely successful in 2D human
pose estimation
,
vision transformers
(ViTs) have emerge
→