Compresión de cápsulas explicada para expertos


La compresión de cápsulas incluye métodos para la representación eficiente de las salidas de cápsulas en redes de cápsulas mediante reducción de dimensiones, selección o agregación.

Formalmente, la compresión de cápsulas puede describirse como una función \( C: \{ \mathbf{v}_i \}_{i=1}^n \to \{ \mathbf{u}_j \}_{j=1}^m \) con \( m < n \), donde \( \mathbf{v}_i \in \mathbb{R}^d \) son los vectores de cápsulas originales y \( \mathbf{u}_j \in \mathbb{R}^k \) las representaciones comprimidas.

Las técnicas incluyen, por ejemplo, análisis de componentes principales (PCA) sobre vectores de cápsulas, sumas ponderadas con pesos de enrutamiento adaptativos o codificación escasa para eliminar información redundante.

Esta compresión preserva información esencial de pose y activación, que es crucial para el reconocimiento jerárquico en redes de cápsulas.


Definición:
«La compresión de cápsulas se refiere a métodos para reducir el número o la dimensión de cápsulas en redes de cápsulas, con el fin de minimizar el coste computacional y el uso de memoria, mientras se mantienen las características esenciales de los datos.»


Fuente:
Wang, X., Liu, M., & Li, J. (2021). Efficient Capsule Compression for Deep Learning. Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR).