{"as_of":"2026-08-18T19:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bd0ee3bc7f2c77881a252ae43d45ebd04291c38b9fa0b3742daa32f3c4942a21","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T01:04:36.015575Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.19055/citation-record","integrity":"/paper/2412.19055/integrity","json":"/paper/2412.19055/citation-record.json","paper":"/paper/2412.19055"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2005.00928","last_updated":"2020-05-31T16:59:40Z","snapshot_observed_at":"2026-08-14T07:01:16.499526Z","submitted_at":"2020-05-02T21:45:27Z","title":"Quantifying Attention Flow in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00928","snapshot_observed_at":"2026-08-11T01:04:35.872100Z","title":"and Zuidema, W","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.872100Z"},"links":{"cited_paper":"/paper/2005.00928","citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:4ef5a2f0d9466976b8e02eb4a8aff18e835ee66bd0c406a2d1000b26abc73af3","observation_id":"5fdc74f8-b5d4-445f-97d3-00673b752555","resolution":{"observed_at":"2026-08-11T01:04:35.872100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.460190Z","title":"and Li, Y","venue":null,"work_id":"78a05706-b46f-4810-85fd-09ac2514bd34","year":2023},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.876611Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:9d26fe1e48f0fd3e655d547e99fd41488643e4a5e54198360bdb9412402f0159","observation_id":"98b43cdd-2b9a-444e-b5ae-a5c9ef39f11f","resolution":{"observed_at":"2026-08-11T01:04:36.464204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.447670Z","title":"Subgraphormer: Unifying subgraph GNN s and graph transformers via graph products","venue":null,"work_id":"dabaaa50-c892-4053-8339-4ce5d2d7b880","year":2024},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.880746Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:abdbdea9c5364aebb1d37d402845078af11a1df23962887988b5d9dd15b428dd","observation_id":"bd79c7a6-6346-4683-b06f-53bd3edc8557","resolution":{"observed_at":"2026-08-11T01:04:36.452045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:35.884949Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.884949Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:eaf23997d30c68dd2363741caf5c6a5cc7b69c40fbae364e353b04d4b94d15d0","observation_id":"055fa37f-fc1f-49c7-8667-56d6c7f77d0f","resolution":{"observed_at":"2026-08-11T01:04:35.884949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:35.888743Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.888743Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:7e754e449f9b285e1209a8bf8d982940a1df521a2de7515b5d17afd63c809c7f","observation_id":"fa7cbabd-532c-4683-9479-3518fdcb6de8","resolution":{"observed_at":"2026-08-11T01:04:35.888743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.422269Z","title":"Revisiting label smoothing and knowledge distillation compatibility: What was missing? In International Conference on Machine Learning, pp.\\ 2890--2916","venue":null,"work_id":"1711d1ce-3d38-49d3-b4c8-0d5805e02374","year":2022},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.892778Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:858ba931ac20b65ad734a2b0431ccf383d04dc9470f81b3a41efe7a089913623","observation_id":"d0caf514-14fb-4941-aee1-5f61a0dd8acf","resolution":{"observed_at":"2026-08-11T01:04:36.425766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.412111Z","title":"Transformer interpretability beyond attention visualization","venue":null,"work_id":"1ea13146-9ad3-4e4d-b28d-0e4bc81c3947","year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.896926Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:4b638ddb6daf25e3b6e56e2570f15e15349e2d2c05b95abbdf6e354050a64f5e","observation_id":"f498591a-4f5f-449e-ac26-8853a8add48a","resolution":{"observed_at":"2026-08-11T01:04:36.415689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.402074Z","title":"Dearkd: data-efficient early knowledge distillation for vision transformers","venue":null,"work_id":"1d618267-a1f7-4226-b38f-e3d819e7cfe1","year":2022},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.900408Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:280dae8b3952aa19c3d91c77cf4d3df28ff7cf7545f8725e4f17527f022b8cf0","observation_id":"00736f39-239b-48ce-8051-da0a06c1d899","resolution":{"observed_at":"2026-08-11T01:04:36.405438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.391252Z","title":"A comprehensive survey on model compression and acceleration","venue":null,"work_id":"10001e89-3d94-49fe-b015-ccf6fe916135","year":2020},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.903905Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:7e45323c7da7fd519d32e52ce602e8620cb97cf7c453bfa6c9fd951ad2d2daf4","observation_id":"88479d2b-f271-4142-9599-d0689b2e4166","resolution":{"observed_at":"2026-08-11T01:04:36.395359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:35.907405Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.907405Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:9f3130324590013f65d4276b5b32c6ad94f092492fdd2c101ebf4201835d1216","observation_id":"4c0a4568-febe-489a-aa41-ba7626da88ca","resolution":{"observed_at":"2026-08-11T01:04:35.907405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T01:04:35.910934Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.910934Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:c64bbe43ed8aea3ed935f3f1b79d05be12e7251fc34f02bbe5e4a8b030f69c94","observation_id":"f5d7404e-a4ef-41f7-b6d3-1292ae790f76","resolution":{"observed_at":"2026-08-11T01:04:35.910934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-11T01:04:35.914565Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.914565Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:633270e703d00dcd43b7a2dfeeb33eb6e453cff0473860f6e92c6159a3db1030","observation_id":"f62f1e47-cf2e-421e-847f-a5bcc4c3c8ba","resolution":{"observed_at":"2026-08-11T01:04:35.914565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06786","last_updated":"2024-11-11T08:25:21Z","snapshot_observed_at":"2026-08-16T13:01:15.856132Z","submitted_at":"2024-11-11T08:25:21Z","title":"ScaleKD: Strong Vision Transformers Could Be Excellent Teachers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06786","snapshot_observed_at":"2026-08-11T01:04:35.917522Z","title":"Scalekd: Strong vision transformers could be excellent teachers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.917522Z"},"links":{"cited_paper":"/paper/2411.06786","citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:3400f97cac8d6b03a504478a422e27185a2d069519a998e5ed3c227d8b90b50e","observation_id":"91123b34-90f6-4197-af5e-0a0b62235ce7","resolution":{"observed_at":"2026-08-11T01:04:35.917522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.372744Z","title":null,"venue":null,"work_id":"d952df3f-0891-4523-ab12-2c548c7c7dab","year":1987},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.920975Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:7fafa2db1d5bb81b3e57e39ae08ea17b3c64970ce4b678e1b2fb62656121f259","observation_id":"b0478bdb-a570-40ab-9b60-fcf69591d5fa","resolution":{"observed_at":"2026-08-11T01:04:36.376786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.361013Z","title":"Transformer in transformer","venue":null,"work_id":"1243cca0-d3f3-40b1-a0ef-a1df413f72fc","year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.923849Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:be71a1da477a7f0b3813d92720a022826d15cc6bec3f76a96ddf911345a0bc03","observation_id":"ea2b829f-5fbe-4a8e-9b04-b717c6b1dcf3","resolution":{"observed_at":"2026-08-11T01:04:36.364943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:35.926623Z","title":"A survey on vision transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.926623Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:2dc605916892d6ab0db15c228541846b12bdf58c6e40f27e5aa64902f68a7ba6","observation_id":"cfffc763-c6fd-4f34-802a-280985dbd3b4","resolution":{"observed_at":"2026-08-11T01:04:35.926623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.340663Z","title":"Learning efficient vision transformers via fine-grained manifold distillation","venue":null,"work_id":"f64157cc-099d-4e43-9aab-e45d64753932","year":2022},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.929203Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:cacd184f77ab936e13175ae8e0500b30e9c2a9cf77aef1ec4ef9c194ab81ccd3","observation_id":"b0b9c40f-a5a4-42ae-8bfe-b08c74294862","resolution":{"observed_at":"2026-08-11T01:04:36.345007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-11T01:04:35.932001Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.932001Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:031d48722e92abfeb8d31b85342659e35e81c07d6f01acf4c53cae5dd396769e","observation_id":"b3195623-1fbf-4257-a56d-b1a2cd8195a9","resolution":{"observed_at":"2026-08-11T01:04:35.932001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.329496Z","title":"Knowledge distillation from a stronger teacher","venue":null,"work_id":"faf30d8d-88f0-4ba7-ad8f-35511bcf014d","year":2022},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.935789Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:20a8f2a6f7bda129f9f36deccab9ef9ccc882d199d0d8f0e2c278396f0162106","observation_id":"35125065-9f4e-435e-965a-3c04ec12cef7","resolution":{"observed_at":"2026-08-11T01:04:36.333274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.318681Z","title":null,"venue":null,"work_id":"35f6fdc1-76e9-4269-b3f9-4ccad69e8615","year":2024},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.939393Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:af816c76838dacdb010bae154ca04362cdba6972306ee9f6eec08695bfeb8118","observation_id":"f75bc942-1a59-4f10-9139-3f9e7e2a43d5","resolution":{"observed_at":"2026-08-11T01:04:36.322364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:35.943037Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.943037Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:a854f15f1d82f0490d815a8fe129d7bcfdd84cc6995d7aaefe8cd583d865aa42","observation_id":"12d22fa5-bdd3-4e02-98eb-edc91cf219a4","resolution":{"observed_at":"2026-08-11T01:04:35.943037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.298918Z","title":"K., Rawat, A","venue":null,"work_id":"f65bfefe-b2eb-49ac-881b-a0ecb4e98924","year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.946308Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:e00a50852d1e8019b8d510a74f8268a4a8f2ccef3375321674b869e806e847e7","observation_id":"85db9e62-ce3e-4219-913b-192700b92b33","resolution":{"observed_at":"2026-08-11T01:04:36.303284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.288134Z","title":"and Mikolajczyk, K","venue":null,"work_id":"d7c647a7-3c43-4c4a-a786-12867467f406","year":2024},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.949660Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:e6a43d36b9de00d44bdee73a6e345d0b2f03fed74d37e09da521b257a1f9add6","observation_id":"af297c68-2005-43b3-9a24-cf42f19225df","resolution":{"observed_at":"2026-08-11T01:04:36.291202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.278653Z","title":"Ia-red ^2 : Interpretability-aware redundancy reduction for vision transformers, 2021","venue":null,"work_id":"f50195a6-6327-46e6-9397-707c39882c5b","year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.953139Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:65069d025d66e2a0f7c3f8f5039440184f70b83c8424ddf3a687acdff9f706f8","observation_id":"db3f44ac-557c-47d6-a605-73ceb2c72b0c","resolution":{"observed_at":"2026-08-11T01:04:36.281961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.269106Z","title":"Relational knowledge distillation","venue":null,"work_id":"44cb5354-72b0-48e5-adfa-bfab2d5290ed","year":2019},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.956354Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:ca1a1ac40b7c2cba3804524182415ff8acb777c092b352398306b41269a353d1","observation_id":"a717fd00-c5da-4cba-a30d-42d485e36b0b","resolution":{"observed_at":"2026-08-11T01:04:36.272294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.258519Z","title":"Frequency attention for knowledge distillation","venue":null,"work_id":"5d6aae32-3981-475c-ae61-b35a60835425","year":2024},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.959783Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:5c25b0cf320df82d6eb275f0ca443654f0e59256ffd95db43d87b488faae9652","observation_id":"032d00c5-2122-4b36-b009-c4d1be9208a0","resolution":{"observed_at":"2026-08-11T01:04:36.262337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.246898Z","title":"and Lampert, C","venue":null,"work_id":"7dd6956e-d217-4f84-9dd0-483a3ee0d048","year":2019},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.963324Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:f05129a763599c8abea2c9eaaf1b422cf38f8ccf150296978833b4964cb3a5ec","observation_id":"befd295c-a7fc-489c-a05d-58c6199327c7","resolution":{"observed_at":"2026-08-11T01:04:36.250671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:35.967174Z","title":"Do vision transformers see like convolutional neural networks? Advances in neural information processing systems, 34: 0 12116--12128, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.967174Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:8b4dbca0f749e839becb6d5c572b726def4f2aacbbc033228c8f1498a03df063","observation_id":"f01ed459-ea23-46c2-ac63-eab67ab62dd2","resolution":{"observed_at":"2026-08-11T01:04:35.967174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16348","last_updated":"2024-04-29T14:12:49Z","snapshot_observed_at":"2026-08-16T22:14:00.872089Z","submitted_at":"2024-04-25T05:59:42Z","title":"Dual Expert Distillation Network for Generalized Zero-Shot Learning","version":2},"cited_work":{"arxiv_id":"2404.16348","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.16348","snapshot_observed_at":"2026-08-11T01:04:36.046695Z","title":"Dual Expert Distillation Network for Generalized Zero-Shot Learning","venue":"cs.CV","work_id":"14bc30a2-a054-47a6-bc70-01e87144ff84","year":2024},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.970750Z"},"links":{"cited_paper":"/paper/2404.16348","citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:b721e8a4fdcd03e361f01b8128c223309dfe74a33396dcb7d1cd451db7a4f22c","observation_id":"35a1e67e-933f-49b7-92c7-0d1fd992e12e","resolution":{"observed_at":"2026-08-11T01:04:36.053322Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.228748Z","title":"The role of masking for efficient supervised knowledge distillation of vision transformers","venue":null,"work_id":"17648509-37d7-42df-9349-feab1a353d8d","year":2025},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.974512Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:88fa11ae9afce03ece2bd755201ec0dfb0ef6d8332c15a594cfb33695c768eb0","observation_id":"59316e39-1679-4f69-b93f-f7a0adc6a6b7","resolution":{"observed_at":"2026-08-11T01:04:36.232528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.217483Z","title":"Training data-efficient image transformers & distillation through attention","venue":null,"work_id":"1ff536ca-b2b1-49c5-92da-64f914013887","year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.977843Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:d9dfce4dcb5768b19e08ed6298f24ed663403177ff47d66ef79304467d38ceef","observation_id":"4b1a1732-1296-437e-bbff-b060162cdbf1","resolution":{"observed_at":"2026-08-11T01:04:36.221617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.206526Z","title":"Going deeper with image transformers","venue":null,"work_id":"6279eeb0-2eb2-4594-9a6a-0543a55b1f16","year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.981216Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:606bc81892360a956ee8b9eec2c7b0e700099aa0db1dd779b899e888b6471035","observation_id":"fea5e417-4cf9-4723-b9fe-a9f81fd9bedf","resolution":{"observed_at":"2026-08-11T01:04:36.210575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:35.984566Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.984566Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:4e3f50bc1a2a23e58d833e139be37b17abbfafe5805b330a83705af39acaeb8f","observation_id":"8a3d1d70-4403-48fe-916b-856d00923012","resolution":{"observed_at":"2026-08-11T01:04:35.984566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:35.987733Z","title":"Pytorch image models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.987733Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:b5ee5563479c06a98fe32c7948359b3d02a53f1db33ddbd10d77861f5dde1880","observation_id":"00e69076-a0e0-45b9-adc1-d39a5b29866c","resolution":{"observed_at":"2026-08-11T01:04:35.987733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.181354Z","title":"Self-supervised learning based on transformer for flow reconstruction and prediction","venue":null,"work_id":"59af980d-1d49-4e20-bf6b-51e41cbf5bec","year":2024},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.991032Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:8e06546459af3e639cf909d516476cf1c1a4e0f4d9d1bf248ab3d44ea9bd4a6f","observation_id":"15a7217a-2fd0-409b-89de-54d9914b3ed2","resolution":{"observed_at":"2026-08-11T01:04:36.185364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.170007Z","title":"Knowledge distillation via softmax regression representation learning","venue":null,"work_id":"6bfb767a-5873-481b-8973-ab41f908c9be","year":2021},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.994681Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:eade4eb8948bbc49d4ccf66b068ff3f33c1c213570e20c9538f6ff1c92b6c381","observation_id":"968052c0-6225-40ef-b076-c51daf1b0eee","resolution":{"observed_at":"2026-08-11T01:04:36.173871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.158117Z","title":"From knowledge distillation to self-knowledge distillation: A unified approach with normalized loss and customized soft labels","venue":null,"work_id":"cc4a8547-f4c9-40b1-8852-41d95d9c8ca7","year":2023},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:35.997770Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:7776f959b58439964a174310b8e98212f4c50b5b5d56856a1d2c105e8c6f7585","observation_id":"dcd52404-66eb-4d71-8383-e6b00e529509","resolution":{"observed_at":"2026-08-11T01:04:36.161854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.147898Z","title":"Attentionviz: A global view of transformer attention","venue":null,"work_id":"5dcf35ea-ba58-413a-adcc-522b0c9601a8","year":2023},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:36.001303Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:a9130b0f2467646c3492219f28d07f51fb6b12fb6915816a316c9d345f5a27eb","observation_id":"974e1125-8fc7-48cc-ada9-7e18f97f0f78","resolution":{"observed_at":"2026-08-11T01:04:36.151494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.136974Z","title":"and Xiang, W","venue":null,"work_id":"b2bc060b-0efd-4223-a155-2458734c8cd5","year":2023},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:36.004880Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:84df14506d55b13a96c6d0861ba704be5aef2c0541b203a06cdf60b5a6b1cc05","observation_id":"42458a0c-09fc-453e-b1d3-fbb7c7490d66","resolution":{"observed_at":"2026-08-11T01:04:36.140889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.126975Z","title":"Peeling back the layers: Interpreting the storytelling of vit","venue":null,"work_id":"19523218-e176-497c-9cee-6cb2e0182112","year":2024},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:36.008459Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:5c58b927fa38fb58dd14b7c09e965ae3b391295df880c290a0e2ab5736ee75f0","observation_id":"ae586ad2-08b9-49ef-93b1-919e965872f0","resolution":{"observed_at":"2026-08-11T01:04:36.130481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.116961Z","title":"S., Klein, T., and Brendel, W","venue":null,"work_id":"12aee16c-5341-44b1-b673-4da4ec966655","year":2024},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:36.012103Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:f198e8db28654302d6598c5f5bcfd416175e193eeaefb23e17b1c71b3991ef22","observation_id":"954ed680-21f4-4801-812f-c67533518b0e","resolution":{"observed_at":"2026-08-11T01:04:36.120096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T01:04:36.015575Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T01:04:36.015575Z"},"links":{"citing_paper":"/paper/2412.19055"},"observation_digest":"sha256:cc47a22cdf033b85c8cd326a1406c9429e2882876a59d89895d1db1755ac486f","observation_id":"f3ea406a-8adf-4e0f-b70f-656558faa1f7","resolution":{"observed_at":"2026-08-11T01:04:36.015575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.19055","last_updated":"2025-01-30T07:00:34Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T12:17:50.120229Z","submitted_at":"2024-12-26T04:45:05Z","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.19055."}