DejaVid replaces mean-pooling over clips with a learned, time-weighted dynamic-time-warping distance to class centroids, adding 0.5-0.7% top-1 accuracy on three video benchmarks.
Dtwnet: a dynamic time warping network
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CV 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
DejaVid: Encoder-Agnostic Learned Temporal Matching for Video Classification
DejaVid replaces mean-pooling over clips with a learned, time-weighted dynamic-time-warping distance to class centroids, adding 0.5-0.7% top-1 accuracy on three video benchmarks.