BriefGPT.xyz
Ask
alpha
关键词
dualtoken-vit
搜索结果 - 1
DualToken-ViT:具有双重令牌融合的位置感知高效视觉 Transformer
提出了一种轻量级和高效的视觉变换模型 DualToken-ViT,它通过卷积和自注意结构有效地融合了局部信息和全局信息以实现高效的注意力结构,并使用位置感知的全局标记来丰富全局信息,并改进了图像的位置信息,通过在图像分类、物体检测和语义分割
→
PDF
10 months ago
Prev
Next