arXiv:2605.07766cs.CV2026-05

让机器理解发型变化等外观差异,实现更精准的头部相似性比对。

Head Similarity: Modeling Structured Whole-Head Appearance Beyond Face Recognition

论文配图:Head Similarity: Modeling Structured Whole-Head Appearance Beyond Face Recognition
图 1 · 摘自论文原文
  • 通过分层监督与身份感知蒸馏,显式建模同一人不同发型的外观变化。
  • 在包含遮挡和侧视的长视频数据集上,显著优于传统人脸识别模型。
  • 适合需要关注发型、服饰等外观细节的应用,如刑侦追踪或虚拟形象匹配。

许多视觉应用需要在非正脸视角或面部线索缺失时仍保持身份一致性。然而,传统人脸识别模型强制身份不变性,将发型、造型等外观变化压缩为单一表征,限制了其在外观敏感场景中的使用。为此,本文提出头像相似性(Head Similarity),一种超越身份识别的结构化全头外观建模新范式。该方法显式捕捉同一身份下的外观变化,并在身份与外观状态间建立分层相似性排序,即使在遮挡或后视条件下也能进行有意义的比较。我们基于长视频构建了一个大规模弱监督外观状态基准数据集,涵盖多样姿态、遮挡及时间变化。作为初步探索,提出一个简单但有效的框架,通过分层监督与身份感知蒸馏联合建模身份区分与外观敏感相似性。实验表明,传统人脸识别模型无法捕捉依赖外观的相似性,而本文方法验证了结构化全头相似性建模的可行性。

原文摘要 · Abstract (English)

Many vision applications require identity consistency beyond strict biometric recognition, especially under non-frontal views or when facial cues are missing. However, conventional face recognition models enforce intra-identity invariance, collapsing appearance variations such as hairstyle or styling changes into a single representation, limiting their use in appearance-sensitive scenarios. To address this limitation, we introduce Head Similarity, a new formulation that extends identity-centric recognition to structured whole-head similarity modeling. Our approach explicitly captures intra-identity appearance variation and enforces hierarchical similarity ordering across identity and appearance states, enabling meaningful comparison even under occlusion or rear-view conditions. We construct a large-scale benchmark from long-form videos with weakly-supervised appearance states, covering diverse poses, occlusions, and temporal changes. As a first step, we develop a simple yet effective framework that jointly models identity discrimination and appearance-sensitive similarity through hierarchical supervision and identity-aware distillation. Experiments show that conventional face recognition models fail to capture appearance-dependent similarity, while our approach demonstrates the feasibility of structured whole-head similarity modeling.

外观建模身份识别视频分析分层学习

Thank you to arXiv for use of its open access interoperability. PaperDance 不是 arXiv 官方产品;中文卡片由大模型生成,请以原文为准。