Overlaying teacher integrated-gradient maps on 10% of training images improves knowledge-distilled students by about one percentage point on CIFAR-10 at 4.1x compression.
ACM Transactions on Embedded Computing Systems 18:1--22
1 Pith paper cite this work, alongside 3 external citations. Polarity classification is still indexing.
1
Pith paper citing it
3
external citations · OpenAlex
citation-role summary
background 1
citation-polarity summary
fields
cs.CV 1years
2025 1verdicts
CONDITIONAL 1roles
background 1polarities
unclear 1representative citing papers
citing papers explorer
-
Model compression using knowledge distillation with integrated gradients
Overlaying teacher integrated-gradient maps on 10% of training images improves knowledge-distilled students by about one percentage point on CIFAR-10 at 4.1x compression.