{"as_of":"2026-08-07T22:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2f13f806b0839588fa3a48e181791dd45a04d7ca56447fd46050341b9d2a84a7","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:48:52.035624Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12780/citation-record","integrity":"/paper/2507.12780/integrity","json":"/paper/2507.12780/citation-record.json","paper":"/paper/2507.12780"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.441115Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.441115Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:84f0983e8fb64315d93c24f5cfc4a182dcc8535d080c60d63061def19d4c69d3","observation_id":"142a132a-6aff-46da-a77b-6ecd42098881","resolution":{"observed_at":"2026-08-06T16:48:39.441115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.505580Z","title":"Du, Wei Hu, Zhiyuan Li, and Ruosong Wang","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.505580Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f2ad8fbe8d6f2b7012559390ba069261ef65b1133502527f4ed743bbb7eb1f01","observation_id":"6ac69ea9-e55e-44e7-abcd-c7ed9103f7d5","resolution":{"observed_at":"2026-08-06T16:48:39.505580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.620429Z","title":"Implicit gradient regularization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.620429Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:0a042d0676b42752c1932bad8d9998a380621e3c566085a1f9269be8ba5534df","observation_id":"b00b76f1-a6f7-43c6-9099-6bfedb869186","resolution":{"observed_at":"2026-08-06T16:48:39.620429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.728431Z","title":"Bartlett, Olivier Bousquet, and Shahar Mendelson","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.728431Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:974fc173eea31b1c01eb46089a08714359950100a7ed8a3ec8b11b935a17390a","observation_id":"3c0bd139-fd16-4ab1-9486-c3652213e3c2","resolution":{"observed_at":"2026-08-06T16:48:39.728431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.877339Z","title":"To understand deep learning we need to understand kernel learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.877339Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:df19e5aab98dc05050ac6060cbeddb9f97e6e66727c522d27c35f39a9c4590e4","observation_id":"9f1734e4-bd73-44c6-9722-b6ea0a0b4ef8","resolution":{"observed_at":"2026-08-06T16:48:39.877339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:39.995309Z","title":"Token merging: Your vit but faster","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:39.995309Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:954dd80c932a6db3e35ca6e0912e85da968593fe5ec32ea18391c1f29e194f70","observation_id":"d879229b-53a6-400f-9083-c155bbd7951c","resolution":{"observed_at":"2026-08-06T16:48:39.995309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.122126Z","title":"Learned thresholds token merging and pruning for vision transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.122126Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:7ae09dd71c9c873f14a74b21f31357961fd91f73f592cc0160051d0ab51a96b4","observation_id":"671c5233-f3c0-487f-bbda-be961d65a12c","resolution":{"observed_at":"2026-08-06T16:48:40.122126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.262568Z","title":"Cvtstego-net: A convolutional vision transformer architecture for spatial image steganalysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.262568Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5c9546160119737851fbd0843165f6ea58bfade494c3f223c5b8617d53d1dcfe","observation_id":"851c30d9-c80d-431e-beb1-04bd4e7c0b01","resolution":{"observed_at":"2026-08-06T16:48:40.262568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.416800Z","title":"Efficientvit: Enhanced linear attention for high-resolution low-computation visual recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.416800Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f5cc3f81df9724ec6e88760f7ac5f9d9f48a96a4d16932309ac4818afd1b4fe4","observation_id":"6b5ef737-7171-46ed-bcdb-a529166437c0","resolution":{"observed_at":"2026-08-06T16:48:40.416800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.515094Z","title":"Cascade R-CNN: high quality object detection and instance segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.515094Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:d0d863719a0cb94982fe37ec228e6d1633d42812b11c02a2d965a0ee157d2239","observation_id":"2616678e-d99d-44b3-83f8-205b1f9e8328","resolution":{"observed_at":"2026-08-06T16:48:40.515094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.634303Z","title":"A kernel analysis of feature learning in deep neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.634303Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:327f9f7a01e044b17d1b5bb60b82807047e717112f8faf20681515f2cde2726f","observation_id":"1db2d52e-0a68-4827-83fa-6382bcfdec67","resolution":{"observed_at":"2026-08-06T16:48:40.634303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.775717Z","title":"Generalization bounds of stochastic gradient descent for wide and deep neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.775717Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:4cb4ffd690708c32cd3e83691a9bec8170640ac0de76bdd8f73636fecd66ea31","observation_id":"a2f39430-811a-4a95-829c-c624705f2698","resolution":{"observed_at":"2026-08-06T16:48:40.775717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:40.880802Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:40.880802Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:64046c8e4f59291b8921dbc95561a8b17bf05a50d39bbd3c3596b40f6c8907a5","observation_id":"0866bcec-73d1-4904-af2e-4d77352568f3","resolution":{"observed_at":"2026-08-06T16:48:40.880802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.020190Z","title":"Vision transformer slimming: Multi-dimension searching in continuous optimization space","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.020190Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:500590b352d036a5410b5bbf55a9b6a3f841f9b09e1157a449975dd16a96d0b4","observation_id":"3df8fb80-e7b6-461a-84dd-8fb22b5f1576","resolution":{"observed_at":"2026-08-06T16:48:41.020190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.130895Z","title":"CrossVit: Cross-attention multi-scale vision transformer for image classification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.130895Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5d42971e82351400f21167abe82850816eb43f19a8b91239556733076a7331e0","observation_id":"32bafa41-41e8-4dd2-95b2-bea93127cefa","resolution":{"observed_at":"2026-08-06T16:48:41.130895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.251996Z","title":"Autoformer: Searching transformers for visual recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.251996Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:c306b4f3841165f9b03c354306ea6e82233aedf6d4ea9e2445ff92c20a891bcb","observation_id":"55345051-e4b2-4bfe-9474-fb5f758b2efb","resolution":{"observed_at":"2026-08-06T16:48:41.251996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.404358Z","title":"Chasing sparsity in vision transformers: An end-to-end exploration","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.404358Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:1a07af434a40f754f83a0d0e04a2f3e4a096eae5a3973039a1b876eb789d519b","observation_id":"66b8239b-1a2a-496d-8afe-e5366a9be74c","resolution":{"observed_at":"2026-08-06T16:48:41.404358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02444","last_updated":"2025-09-10T14:37:12Z","snapshot_observed_at":"2026-08-01T04:03:24.200146Z","submitted_at":"2023-03-04T16:04:17Z","title":"Calibrating Transformers via Sparse Gaussian Processes","version":4},"cited_work":{"arxiv_id":"2303.02444","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.02444","snapshot_observed_at":"2026-08-06T16:48:53.027431Z","title":"Calibrating Transformers via Sparse Gaussian Processes","venue":"cs.LG","work_id":"807728fb-5bbe-46b9-abb5-61d8ee79ae71","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.518130Z"},"links":{"cited_paper":"/paper/2303.02444","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:745545e28a377d8639ca4e4bcf64c3a27ffb526fcd872a1b884611c6611c4d8c","observation_id":"841dc598-8742-4618-9ff4-8dcefea2816e","resolution":{"observed_at":"2026-08-06T16:48:53.109932Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.639820Z","title":"Neural architecture search on imagenet in four GPU hours: A theoretically inspired perspective","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.639820Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:1adb44ddb53656f03623477d7ecdc518fa489280e70600a2765c6e112fe456f2","observation_id":"fbe45abc-7985-49d2-95c7-8ca59a4c7d2c","resolution":{"observed_at":"2026-08-06T16:48:41.639820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:41.785288Z","title":"Primal-attention: Self-attention through asymmetric kernel svd in primal representation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.785288Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:df9168e980911ec44ec27d1f90426157f9e3c868c907a174be5df329129560e2","observation_id":"a09ade7d-c589-4d51-b123-2afaef6c8a69","resolution":{"observed_at":"2026-08-06T16:48:41.785288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05895","last_updated":"2022-03-03T18:56:44Z","snapshot_observed_at":"2026-07-06T11:37:52.596961Z","submitted_at":"2021-08-12T17:59:55Z","title":"Mobile-Former: Bridging MobileNet and Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.05895","snapshot_observed_at":"2026-08-06T16:48:41.930429Z","title":"Mobile-former: Bridging mobilenet and transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:41.930429Z"},"links":{"cited_paper":"/paper/2108.05895","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:64f0d7097d519971d534d27ea30917489499d6e6fc36186634ae45a747151256","observation_id":"9f526b79-4f49-40d7-b436-a5a3b2fbfef3","resolution":{"observed_at":"2026-08-06T16:48:41.930429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:09.792300Z","title":"Kerple: Kernelized relative positional embedding for length extrapolation","venue":null,"work_id":"1994b8a6-865e-4f2c-9061-0e8f45a75148","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.034243Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:797bcaa8e3fc3aefc7d2d6c5befadf07a2128262cc1e93537301a9693243282d","observation_id":"0ac1a747-4a2b-42f7-be42-8494601b0048","resolution":{"observed_at":"2026-08-06T16:49:09.941070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:09.487824Z","title":"Colwell, and Adrian Weller","venue":null,"work_id":"dc502b87-9d48-4d1b-869b-e400bed0ed86","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.114041Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:04b554cceee74a93078c061d9bc8a742c4ed0e632dd91b96d4d1e88a12a2c9c0","observation_id":"a2852c68-1723-47ab-a6ca-a09c196f4751","resolution":{"observed_at":"2026-08-06T16:49:09.638063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:09.195482Z","title":"Lee, and Mahdi Soltanolkotabi","venue":null,"work_id":"d83ed89a-2029-40d1-bcd4-df1cbd8bfc1b","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.215249Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5c6aaac45b53a095f89a580e63950c2df28619fb74cbd0911b8d877521aa0c89","observation_id":"a6900736-fcbf-4fff-b109-60fad9089bf4","resolution":{"observed_at":"2026-08-06T16:49:09.359527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:09.073625Z","title":"Neuralef: Deconstructing kernels by deep neural networks","venue":null,"work_id":"df68a864-fac5-485c-9c85-f9c0ae20bc23","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.368679Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:e93bc8c2e412db890784365ef630ef6653c0d3095a709b7c200ffc91907ce216","observation_id":"b5ea8cf9-abe8-4765-8ccc-b4c610fe3620","resolution":{"observed_at":"2026-08-06T16:49:09.129969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:08.836217Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"a052e777-a74b-45a9-9f88-d01c642f488b","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.477877Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:9d2d4a184de1afc411770c974947a76b5803d352e55a87bb2321fccf594efa59","observation_id":"549eb97e-ff61-478a-bd24-f7864203a7a7","resolution":{"observed_at":"2026-08-06T16:49:08.968756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:08.672463Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"e1ba3dfd-5e35-4172-b94e-0edf2cad581e","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.616294Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:7502864216401da10d4d88f030ddd179f7a497e05f7e8d6c3fa626601f19dfa7","observation_id":"1a6bed93-03c6-4497-959e-1a0942923ea6","resolution":{"observed_at":"2026-08-06T16:49:08.781986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:08.511713Z","title":"Deep learning versus kernel learning: an empirical study of loss landscape geometry and the time evolution of the neural tangent kernel","venue":null,"work_id":"7cfb3400-cd80-4291-9427-d720310be6d4","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.759199Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f0adac72319a82aaf46010de1be1f946e9daaff9b04a29bf1aeb1a637135520d","observation_id":"af503526-cc40-48c5-90a6-55c9ed336732","resolution":{"observed_at":"2026-08-06T16:49:08.569050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:08.214109Z","title":"Linearized two-layers neural networks in high dimension","venue":null,"work_id":"4a524278-12c6-45e0-867a-eda50acaea4f","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:42.899309Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:3757a9cec818faafe99db7757e6f625b326a44a34faa24a866192c794a35227d","observation_id":"cd7f1b94-be04-4fd0-b702-778b236b0a86","resolution":{"observed_at":"2026-08-06T16:49:08.349692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.989593Z","title":"NASV it: Neural architecture search for efficient vision transformers with gradient conflict aware supernet training","venue":null,"work_id":"86fd9837-48c3-4ac1-b74d-066c81215aa8","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.011560Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:53a7490c84ef22041a23ca3e5ebffa45114f8bc758943d3ab65b8ed1f7766028","observation_id":"75190eca-5075-4a59-9318-b96e5b040d22","resolution":{"observed_at":"2026-08-06T16:49:08.091391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.745774Z","title":"Levit: a vision transformer in convnet's clothing for faster inference","venue":null,"work_id":"e91b4bfc-95a8-4152-ae24-ebe8902b3365","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.178998Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f8979fb9d473c294a6e40c99318e271bb81b62241d6169be4c0994a89f098bd3","observation_id":"1de62b6e-229d-4829-b592-b2fd8d3d4415","resolution":{"observed_at":"2026-08-06T16:49:07.843351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.507911Z","title":"lossless","venue":null,"work_id":"c0ce08d1-b584-4b7e-8be8-b1f185805a5e","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.303499Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:1c8a464c13d9db7a01cbfb331249eda363a81c6579d5b81793c486e7a852f6d1","observation_id":"1e00f1fe-8bd8-4b80-b3e3-d5481cee9bb7","resolution":{"observed_at":"2026-08-06T16:49:07.610792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.329545Z","title":"Deep learning with kernels through rkhm and the perron-frobenius operator","venue":null,"work_id":"8ad283ed-d7fb-4363-84dc-524a61d50f3c","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.427184Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:9177c1ad0a8e6dc74b2b01573378fbfcf891cfcae4221d6dba794a9a492b2de9","observation_id":"f5cec189-157e-40c5-a8cb-00898c9161a1","resolution":{"observed_at":"2026-08-06T16:49:07.405113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:07.044222Z","title":"Rethinking spatial dimensions of vision transformers","venue":null,"work_id":"e9ac42dc-9f2a-45e6-ac21-0ff3b3f8c7f5","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.574248Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:2bd598e8de7f9b37305aabc0e354ec7b4d367be5f7a7809719573c4871be3bda","observation_id":"ddda46dc-bcb5-44a7-beb8-ec6a52c6f948","resolution":{"observed_at":"2026-08-06T16:49:07.176446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:06.732054Z","title":"Hierarchical kernels in deep kernel learning","venue":null,"work_id":"d2c7ca3f-2c4e-4d9c-8e55-f71cda2100b2","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.852722Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:63cb26dbae122710d9fdffc07a911e5fe7d4a0b28bad4f3fa19c60407f3a6443","observation_id":"33b3f297-5b3d-4078-af35-14f559ddaf89","resolution":{"observed_at":"2026-08-06T16:49:06.905544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:06.518926Z","title":"Neural tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":"e8b67ec1-9f04-46f7-949c-4445e34bcf83","year":2018},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:43.977510Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:604e08df2dc597a7d9abb79ee7ba1dad78b30aa9736fe462fb0186b8aa2b7a6d","observation_id":"35365ca3-a7c1-4774-bd06-e44562a17176","resolution":{"observed_at":"2026-08-06T16:49:06.622947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:06.249578Z","title":"Neural tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":"58702c43-7908-4ea6-826d-0ac0eba3ee1c","year":2018},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.125432Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:35e68ef2a6f163b3c44ffdcaf30d333fd53f1d0ca1b2f55571103f2eefe4d6f9","observation_id":"2cfbc8a1-9660-4427-853d-d99cc3635993","resolution":{"observed_at":"2026-08-06T16:49:06.418045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:06.027019Z","title":"Token fusion: Bridging the gap between token pruning and token merging","venue":null,"work_id":"68b05737-cfdd-434f-912b-e7980c114c1d","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.262279Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:2dd864b5088306f6e91ea3bf0cd2aca538b069d65d49c1acca4ccd6ba5c42b0c","observation_id":"b900388b-0ff2-473e-ba51-0a435f11f1de","resolution":{"observed_at":"2026-08-06T16:49:06.115942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:05.817892Z","title":"Local rademacher complexities and oracle inequalities in risk minimization","venue":null,"work_id":"d05efcae-f8fd-4e8a-a1bc-c69ad3752215","year":2006},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.426306Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:820c18e1c90c75963897d43330613a6b5241ee4d0c4da70a0a8bf29d409a981f","observation_id":"2e70fa98-dfca-4a9c-9381-0445e469a8ee","resolution":{"observed_at":"2026-08-06T16:49:05.913196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:05.627815Z","title":"Spvit: Enabling faster vision transformers via latency-aware soft token pruning","venue":null,"work_id":"34814a27-e868-4845-8b8e-a37e689ceacf","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.578999Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:e07e88a953027b67584065fc6c1c101d3c3b8de0172f586cc7e44b9507cf14ca","observation_id":"4285eeca-afef-4f59-a0ac-5bb0c3bab3a3","resolution":{"observed_at":"2026-08-06T16:49:05.720400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3308.23436","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:52.841243Z","title":"Sampling methods for the nystr \\\" o m method","venue":null,"work_id":"0324c021-62e1-40a0-9289-45f230da7126","year":2012},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.730880Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:658e78071d497cd2fb4f545064a55c741cb5ca22e87e5e42e9057c28317d331b","observation_id":"d94b3e7c-a19a-4c43-8fb6-ee0721665c22","resolution":{"observed_at":"2026-08-06T16:48:52.948697Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:05.423424Z","title":"Neural tangent kernel analysis of deep narrow neural networks","venue":null,"work_id":"2841a8a0-a4b7-4f1f-a439-160aa72e5b85","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:44.883132Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:a73238310e7d25039ed05ec191a12cf8172b25684e3b52b2364618a6d38a57e6","observation_id":"004f09ac-dc29-461e-829b-48c81d578108","resolution":{"observed_at":"2026-08-06T16:49:05.530223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:05.098263Z","title":"Q-vit: Accurate and fully quantized low-bit vision transformer","venue":null,"work_id":"1d25d1c4-20e8-45d9-86e9-4579f1750275","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.061802Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:6bcf2e7fb6cf2a947d190421c5f70a4c77dbc444ff49cdcc05b4d371c9df1c46","observation_id":"f7c95c33-5eb5-4c64-b544-2468fd6d301a","resolution":{"observed_at":"2026-08-06T16:49:05.274601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:04.868244Z","title":"Efficientformer: Vision transformers at mobilenet speed","venue":null,"work_id":"40fa893b-2d35-4f32-942a-b5c9afa60ec7","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.186857Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:cace116ecf63046d570c19b3a578f3c802c771d97c71e39fe9ab917cfb912c5d","observation_id":"3f31b37b-6f95-43d1-a03b-196aa132e77b","resolution":{"observed_at":"2026-08-06T16:49:04.977112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:04.620656Z","title":"Repq-vit: Scale reparameterization for post-training quantization of vision transformers","venue":null,"work_id":"e5c8f3ff-b915-4832-be21-d2cea75d4a13","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.337452Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:a6303bffe5bfa4e1b152d577524bbba31852a2e2546913f3b58e3c5cdde56ed6","observation_id":"91e67f29-8481-4af9-950b-ad0969fab6f9","resolution":{"observed_at":"2026-08-06T16:49:04.747217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:04.379190Z","title":"Swinir: Image restoration using swin transformer","venue":null,"work_id":"44819fea-e0a8-4b8e-9923-5df69f669ec1","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.492302Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:bd620f6ea59f9ca865d9646cbf322768e3d6ced6c3a097d43abd750653e13e3f","observation_id":"3ef34586-903f-41a2-a2ba-fdd98730b593","resolution":{"observed_at":"2026-08-06T16:49:04.462290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:45.635114Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.635114Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:39c9a55c15fc3969984c877f9156784a9d78614376aecf369546f1c0350ab938","observation_id":"03c2f466-9ac4-4533-9c00-8a9b22619fd0","resolution":{"observed_at":"2026-08-06T16:48:45.635114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:04.084562Z","title":"Fq-vit: Post-training quantization for fully quantized vision transformer","venue":null,"work_id":"64de2e44-805a-4167-ad16-825e90fa177c","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.806194Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f885b4e2b5f63c7eb3498b43c3e67b873f3272291ebb883f8f19f30c5373170e","observation_id":"56182cef-0c4b-4413-8fd4-8cf5042eb2ea","resolution":{"observed_at":"2026-08-06T16:49:04.197180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:03.848909Z","title":"Visual instruction tuning","venue":null,"work_id":"80b9a8d3-911f-44e2-a686-6e18237058d7","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.902309Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:a7cf398101b26969b1254ee58949fdcd36713a978b4d76a7834bfa16f45931fa","observation_id":"98dc5d24-4465-442a-a7f5-da78acdf12ea","resolution":{"observed_at":"2026-08-06T16:49:03.977166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:03.621179Z","title":"Updp: A unified progressive depth pruner for cnn and vision transformer","venue":null,"work_id":"08cb1c77-0577-4414-a2f4-8a4b0388a6ff","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:45.994888Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:aea6e20b8e7ac644c13929f3d453715c182ffded709a0424fcec766b125a73a7","observation_id":"fb0fbf8a-f713-4cef-bbd5-e57a465768ad","resolution":{"observed_at":"2026-08-06T16:49:03.740013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:03.368462Z","title":"Efficientvit: Memory efficient vision transformer with cascaded group attention","venue":null,"work_id":"81467a5f-1e4b-4bb8-9876-218222ffb0f2","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.100416Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:ff478a2195d4eec2e70d64391aad28dceac9de6513cefcc9e87c390765be74e8","observation_id":"858d6266-bb77-48c2-9581-9f415654c414","resolution":{"observed_at":"2026-08-06T16:49:03.498380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:03.109212Z","title":"Revisiting token pruning for object detection and instance segmentation","venue":null,"work_id":"146bd3a2-a5a8-44e1-ad6f-1c2f4f959d72","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.228200Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:c6336c5aa26da1958d72cf8692e43f43c1116e8fe1dcfa539d747e9c91777fed","observation_id":"50b6e305-d4bc-4646-b635-cb1bc73155fe","resolution":{"observed_at":"2026-08-06T16:49:03.233885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14030","last_updated":"2021-08-17T16:41:34Z","snapshot_observed_at":"2026-08-07T00:32:15.123562Z","submitted_at":"2021-03-25T17:59:31Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14030","snapshot_observed_at":"2026-08-06T16:48:46.367308Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.367308Z"},"links":{"cited_paper":"/paper/2103.14030","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:7d6d510ead74ac25f534cbceab8bcbca8ac19e82e466386af80bb0876ac78f5e","observation_id":"af8a7517-ebda-4f12-9552-e81a0afbf5ae","resolution":{"observed_at":"2026-08-06T16:48:46.367308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:02.852449Z","title":"Post-training quantization for vision transformer","venue":null,"work_id":"7c560215-3728-43d7-97cf-8b32e2f24a7e","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.506500Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:618e485c491b876c42851edc9a1582b27550ce5e6fc98709a9c0cb154467b7f8","observation_id":"a670530a-31cb-4f7e-8ff4-7cdf49ff8c6e","resolution":{"observed_at":"2026-08-06T16:49:02.942968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:46.657739Z","title":"Prune and merge: Efficient token compression for vision transformer with spatial information preserved","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.657739Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:efedb4bfdad8e0145e682a9f39d62dcc4eac74ed476c13e7ce8cad18c5379503","observation_id":"6852d327-71cf-4189-9b0f-930aa1e3ba4b","resolution":{"observed_at":"2026-08-06T16:48:46.657739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:02.560848Z","title":"Mobilevit: light-weight, general-purpose, and mobile-friendly vision transformer","venue":null,"work_id":"5114bba3-1a9c-4b0f-8120-2cb3b4505443","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.806703Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:ff83bc0e353f197c547e30a1ca768b5933b121f1ff218a8f462288e6c39d2726","observation_id":"74cd347b-28d6-47ed-abdb-3be2f5bb45c5","resolution":{"observed_at":"2026-08-06T16:49:02.700626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:02.303610Z","title":"Geometric parameters of kernel machines","venue":null,"work_id":"189f773e-85ce-41af-a1ac-e72b70acfd70","year":2002},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:46.938769Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:eba11d3e1009752eb2b683bcd51b187e653eb91e1ffd4451a0977f43f2562f64","observation_id":"f5117968-abc7-4fba-a834-9a561819d5ef","resolution":{"observed_at":"2026-08-06T16:49:02.456574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:01.994410Z","title":null,"venue":null,"work_id":"899fbd6b-8844-41d1-b5c3-0f162a3ce180","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.079796Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:e2d2dbdc170111bc9d4946934a5e365fe7a9a0ddaa0353255ddc732336f4b835","observation_id":"5bcb92b8-e6f7-4985-8527-959c9d66c0d0","resolution":{"observed_at":"2026-08-06T16:49:02.167537Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:01.726535Z","title":"Kernel analysis of deep networks","venue":null,"work_id":"423d57c9-2775-44c1-8e13-fdda1d4a89b0","year":2011},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.242548Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:aab09facd2261e3ea34052705b27cd868c9b9da39319a8611c0d6d1c8d70a07b","observation_id":"7837a7a1-1978-46bc-9a26-4549cfab67e6","resolution":{"observed_at":"2026-08-06T16:49:01.838520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:01.447618Z","title":"Fourierformer: Transformer meets generalized fourier integral theorem","venue":null,"work_id":"470a1f79-8eb6-43eb-99ef-8d0d029efa23","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.385582Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:872166b67cb8607f5997d6e8d70700783f4bef2353f1af9e04b2e51efe3723e4","observation_id":"54415af0-1ba3-457e-944b-f2e8553fac97","resolution":{"observed_at":"2026-08-06T16:49:01.601104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:01.148403Z","title":"Bertozzi, Richard G","venue":null,"work_id":"f000c085-8791-4dd0-a11d-c9c7e7f631da","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.535104Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:30c44374aedcfbb0436599e73b532f8a0ba541b5013bef1daaf8ff3b86c4f318","observation_id":"a53808ef-6a9d-4219-9874-927c622cef05","resolution":{"observed_at":"2026-08-06T16:49:01.303721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:00.933158Z","title":null,"venue":null,"work_id":"677647bf-54d3-4906-a77a-564b08a958ac","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.670820Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:b3f36c4bb1700d4558324f780b3fd8b014d5bbb87b9ad578bbc9182f8d6bb714","observation_id":"01d2ba1e-c327-4679-ae77-44f57563e1d2","resolution":{"observed_at":"2026-08-06T16:49:01.056016Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:00.693880Z","title":"A survey on efficient vision transformers: algorithms, techniques, and performance benchmarking","venue":null,"work_id":"75c81b94-e5d5-4b12-aa27-5c269c7857f8","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.789270Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:8f3c3940bcf59a2cf84225d82e296c559dfa17c19a3eba7ce50040269400452f","observation_id":"7658578b-f0ca-4cb4-983d-317596feced6","resolution":{"observed_at":"2026-08-06T16:49:00.795866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:00.441573Z","title":"u gner, Bertrand Charpentier, Simon Geisler, Morgane Ayle, and Stephan G \\","venue":null,"work_id":"2a89b21a-b35d-4a16-af80-bf1fd7f3e262","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.906762Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:00a3b0889a51355c8f36a89147ba0aa6c3ba511d37fc8643cea437d4efbccd83","observation_id":"456fd9ae-0236-411a-8a59-c3e849b4d508","resolution":{"observed_at":"2026-08-06T16:49:00.582639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:49:00.100950Z","title":"Designing network design spaces","venue":null,"work_id":"fa60de17-0342-4d46-93c5-dea0d83b2862","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:47.987297Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:a9635507a0cd4d7bdf26ae75aab03e0d797d15428438cd1e71ca329ddaa6543c","observation_id":"20595e52-02f3-4535-a164-679a2637b5f1","resolution":{"observed_at":"2026-08-06T16:49:00.249181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.02034","last_updated":"2021-10-26T13:37:53Z","snapshot_observed_at":"2026-08-05T14:53:57.820469Z","submitted_at":"2021-06-03T17:57:41Z","title":"DynamicViT: Efficient Vision Transformers with Dynamic Token Sparsification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.02034","snapshot_observed_at":"2026-08-06T16:48:48.087616Z","title":"Dynamicvit: Efficient vision transformers with dynamic token sparsification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.087616Z"},"links":{"cited_paper":"/paper/2106.02034","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:8b75119ba05aef7e7cb243c2f1c029edec6ae95986c4f6b9f46db8c88d0e8020","observation_id":"fd173311-25a9-4ddf-b0af-d96955baa203","resolution":{"observed_at":"2026-08-06T16:48:48.087616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:48.239393Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.239393Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:3db76ec3d5ecf9282c17dfb8048c84e98592bc798343f7486f2b7c7381220b6d","observation_id":"cd750613-dac9-49b9-af78-4ac71a758bce","resolution":{"observed_at":"2026-08-06T16:48:48.239393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:59.779930Z","title":"Analyzing finite neural networks: Can we trust neural tangent kernel theory? In Mathematical and Scientific Machine Learning, pp.\\ 868--895","venue":null,"work_id":"70c30928-167f-473c-8337-de4d142a55f9","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.353618Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:a22a8f68cd5835865ec9b3a6ab85e039ca2e8f1df98942c46e0fc23d29fd7012","observation_id":"a4f045c2-91a2-4869-92e1-36bff398f67e","resolution":{"observed_at":"2026-08-06T16:48:59.949806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:48.444958Z","title":"FLAVA: A foundational language and vision alignment model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.444958Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:ad588b27b3f7856da2dbb26897291d3930b55072aaf2d76856c9324626713e12","observation_id":"5b96e45b-58ed-45f1-b181-c95b2490dc1d","resolution":{"observed_at":"2026-08-06T16:48:48.444958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:59.555219Z","title":"Implicit kernel attention","venue":null,"work_id":"b94d1579-5b2c-402a-88fd-ed6477093fab","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.540459Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:c9ed2e8239fae0e87576de57f57fee1e52abfe5dbc984ffa2952bafafaa02082","observation_id":"2db2238d-6922-41b4-96da-daecb7f86db0","resolution":{"observed_at":"2026-08-06T16:48:59.677410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:59.330121Z","title":"Vitas: Vision transformer architecture search","venue":null,"work_id":"d4b2306f-68d4-4054-9b61-7be9930d3d8c","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.694425Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:4965430528de29793684a6f2d1dd5c034215885a1805519cf367ccf7d86bb2bc","observation_id":"adc23e85-1eab-42c9-82bc-d9609f391c2d","resolution":{"observed_at":"2026-08-06T16:48:59.422215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:59.080833Z","title":"Mean-field analysis on two-layer neural networks from a kernel perspective","venue":null,"work_id":"d989850a-6a58-4c3d-98e9-da2958788367","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.786147Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:9af0fac11b63162e6ae883e56b557bc613cb222435ea90e38f89c04662bc6c05","observation_id":"368fa89b-bbf5-4893-8812-504e18e68e28","resolution":{"observed_at":"2026-08-06T16:48:59.208642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:58.847589Z","title":"Mnasnet: Platform-aware neural architecture search for mobile","venue":null,"work_id":"2e7ccb36-a370-466e-bf3d-52972d0633d1","year":2019},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:48.911019Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5c7446ecefda85aae7d311fb1172eef9aacf1f222e90c14a412d8073bd53e4ff","observation_id":"2fb34c2c-678d-4ecd-b36e-c250ad580279","resolution":{"observed_at":"2026-08-06T16:48:58.928648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:58.637413Z","title":"Training data-efficient image transformers & distillation through attention","venue":null,"work_id":"4f05d172-067d-4758-b72e-0bb3bebc0dbb","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.072604Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:08de4313de7de787e0b429694a26603ff5fd92fd9b21e21cd35d16a00a97e0e2","observation_id":"b3c6b548-ce5d-44bc-892c-d7d9c0f408b1","resolution":{"observed_at":"2026-08-06T16:48:58.753997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:58.352356Z","title":"Attention is all you need","venue":null,"work_id":"d48b2e5c-01d5-4e5f-bc94-0df3194c4266","year":2017},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.203761Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:64f56b0f0149d9c8f734337b1511e437f685ffb0585b240b6d2b2b90df9c5838","observation_id":"b69b1629-1d91-4999-8ed6-acee7cd97c2e","resolution":{"observed_at":"2026-08-06T16:48:58.522382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03619","last_updated":"2023-04-18T21:41:11Z","snapshot_observed_at":"2026-07-06T12:45:14.351278Z","submitted_at":"2022-03-04T22:16:18Z","title":"Adaptive Cross-Layer Attention for Image Restoration","version":3},"cited_work":{"arxiv_id":"2203.03619","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.03619","snapshot_observed_at":"2026-08-06T16:48:52.407545Z","title":"Adaptive Cross-Layer Attention for Image Restoration","venue":"eess.IV","work_id":"c2c4af90-ca9a-43a8-8d12-19aee6aae008","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.339119Z"},"links":{"cited_paper":"/paper/2203.03619","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:220cd5f96ccc4792d323fd61383546be271b6d96d20ffae9d299252aa7c15cb2","observation_id":"f78538c7-e2df-4fa5-b97e-aec74389ce27","resolution":{"observed_at":"2026-08-06T16:48:52.509701Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:58.098200Z","title":"NTK-SAP: improving neural network pruning by aligning training dynamics","venue":null,"work_id":"5883facd-6faa-4770-8f52-661b2885b92e","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.491442Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:4a2299af1d97ed6b565710563d1fd4134dfb06a40fb46caca869ccdc0d87c547","observation_id":"f19eb25b-5142-48e2-934c-9f700bea8e3b","resolution":{"observed_at":"2026-08-06T16:48:58.228446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:57.854898Z","title":"Vtc-lfc: Vision transformer compression with low-frequency components","venue":null,"work_id":"e71e164d-62e7-4644-a0fd-fa2ef79340f6","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.596189Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f5d3eecd406912e822c1e52211b114def80921840f926eb508675f6e5cdfc929","observation_id":"df346213-07b8-4db6-8ec7-8c1b962e4042","resolution":{"observed_at":"2026-08-06T16:48:57.974082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:57.576582Z","title":"Ntk-approximating MLP fusion for efficient language model fine-tuning","venue":null,"work_id":"0512ecc8-0924-4841-97c1-f392cc71cdd3","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.693298Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:b538731a343127d1601f7f8d8eebdaa9e9bac9df06de4f695ad3c3d6d8ebc532","observation_id":"87543ea8-7243-419f-a56f-2777f59d8f55","resolution":{"observed_at":"2026-08-06T16:48:57.696217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:57.283495Z","title":"Auto-prox: Training-free vision transformer architecture search via automatic proxy discovery","venue":null,"work_id":"3e965a42-b910-4b41-81ff-f5da4cffb61f","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.811480Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f7feaffaef95974e820400748b837c78437a318f5003c0effb8bd951941ea602","observation_id":"2469fc1b-b4a3-4c5e-8de0-6b7d12892ac2","resolution":{"observed_at":"2026-08-06T16:48:57.465910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.985480Z","title":"Kernel and rich regimes in overparametrized models","venue":null,"work_id":"daef6298-be28-428a-9246-f784570180bc","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:49.944505Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:729c5963b0a4c7d76db0001c73c08e834dc149cf7cd7120219ace450aa7d8700","observation_id":"a1db33f2-7b49-4de3-80b7-ef164df9df4b","resolution":{"observed_at":"2026-08-06T16:48:57.131253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.776663Z","title":"Tinyvit: Fast pretraining distillation for small vision transformers","venue":null,"work_id":"d903cbd2-8671-41c6-8a3b-71aa7ac27f86","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.065013Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:4d6124309ce5cc6131e4e4705b5f9029d83e07a08636fd7b2561f68665a751e1","observation_id":"8e36504f-7dc0-43db-8e4c-b1f6e2df3f1f","resolution":{"observed_at":"2026-08-06T16:48:56.867669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.567662Z","title":"Disentangling trainability and generalization in deep neural networks","venue":null,"work_id":"7cab7489-d612-4f09-94a0-739a1acd1ee3","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.185562Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:61bff03be24fd875d7da69af6512a85de53120ddcc167fddd05c3796f1fcfa2a","observation_id":"561dcfed-e2ab-42e6-80b3-fc85c4fdda8b","resolution":{"observed_at":"2026-08-06T16:48:56.679368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.340973Z","title":"Unified perceptual parsing for scene understanding","venue":null,"work_id":"17f5bd5c-0ec8-429e-9e7b-bc35af5e3f4b","year":2018},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.342915Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:949e47f000bd3de5f7f21dff0b0789fb4ed060d726ff963ace3fa3f46619b9f5","observation_id":"0c75385c-0247-4f3d-bd2c-2ea551cfe94b","resolution":{"observed_at":"2026-08-06T16:48:56.465083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:56.139855Z","title":"Lpvit: Low-power semi-structured pruning for vision transformers","venue":null,"work_id":"a1e38630-1e54-4c02-9d2f-61b2730e65af","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.459886Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:574c78d6d3cc4848c28422cb4f932808dad22576ca384bcbffa963f62372059a","observation_id":"fa5be48b-de96-4c9e-85a8-737eb82cba50","resolution":{"observed_at":"2026-08-06T16:48:56.246800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:55.821139Z","title":"From knowledge distillation to self-knowledge distillation: A unified approach with normalized loss and customized soft labels","venue":null,"work_id":"8ff9911b-7680-4c38-bf67-5a57993c19c0","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.551963Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:29df2f7fb927f9067336da4a3a79a47a77e77ed3c8fba883956795da3cd967f3","observation_id":"350e2d2a-e221-4107-8a93-d4191a25fb33","resolution":{"observed_at":"2026-08-06T16:48:55.976923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:55.544451Z","title":"Vitkd: Feature-based knowledge distillation for vision transformers","venue":null,"work_id":"e49ade50-a445-481f-accc-dfc946b58033","year":2024},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.662975Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:70bf669ff7c82855f66de14cfa9d3f5e3d3edb36c50f2b6ec4cd78724bc97df5","observation_id":"c81ce9b3-1135-4d7c-b82b-27d13fce8d62","resolution":{"observed_at":"2026-08-06T16:48:55.688918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:55.316855Z","title":"Width & depth pruning for vision transformers","venue":null,"work_id":"e3a28ed0-b47b-42d3-91c6-162b9a958dba","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.780234Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:f05f225fc88087b2a380114b4adf312a0e8ed6a574ed84586e6b7542fc01e261","observation_id":"c1fcf31d-968b-4d12-b3aa-975e6ae051d5","resolution":{"observed_at":"2026-08-06T16:48:55.406216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:54.967289Z","title":"Unified visual transformer compression","venue":null,"work_id":"674fa2c8-9626-452d-a7c0-0bdbf113bfe0","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:50.912827Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:4e4c783e8207283e1bb3fe904c853725b6a6c35890aac6bd67653a512353245e","observation_id":"201a64f4-b9f3-4dfa-92b1-adccc8965f4e","resolution":{"observed_at":"2026-08-06T16:48:55.100330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:54.647792Z","title":"Tokens-to-token vit: Training vision transformers from scratch on imagenet","venue":null,"work_id":"66f88ce1-c8b6-44b1-ab6e-2609fa639d97","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.011650Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:d837be0cd33c8d00416812c79b6dddbc1030d327619fa0fdfffbddb35e44f24c","observation_id":"b67b03b3-f590-4f31-af9c-98e0614e925f","resolution":{"observed_at":"2026-08-06T16:48:54.803196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:54.419416Z","title":"Cumulative spatial knowledge distillation for vision transformers","venue":null,"work_id":"424b5369-69a2-4083-8b30-2c9bb1929326","year":2023},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.162955Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:b4ff6119f4f5002bc6ad9b23515ab1fed6172e0621fe9e8dbeef635a982b1ba3","observation_id":"2a92b499-67d7-45aa-8b7c-53109f7452b3","resolution":{"observed_at":"2026-08-06T16:48:54.531223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:54.178320Z","title":"Savit: Structure-aware vision transformer pruning via collaborative optimization","venue":null,"work_id":"f2935f09-038c-475f-8015-68f271079ad2","year":2022},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.288846Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:fba2e8aa097b672dbcdc9c2c79a3034b32698cff3ba1d4087b7b99f3ea806199","observation_id":"f8bbba53-850b-4340-8e75-12b05129500e","resolution":{"observed_at":"2026-08-06T16:48:54.291410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:53.941436Z","title":null,"venue":null,"work_id":"afaf6b8b-0b95-41c0-9b4b-318b2de88c3a","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.415662Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5ebf9a9cdb8972d63b4a24b9391687e1d7a662efeb20b5f2852f2a5780657df9","observation_id":"b71aeb6f-d302-4e0d-b01f-729f26e0b0e3","resolution":{"observed_at":"2026-08-06T16:48:54.058280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:53.653330Z","title":"Semantic understanding of scenes through the ADE20K dataset","venue":null,"work_id":"7876dec8-df55-49b0-8235-fb1af55f3cbf","year":2019},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.560020Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:af0dbbac58c9f9ba25ee7c7173f636ba186ca82d9929b22cd22e8c4d8912fc0d","observation_id":"baf21a4d-3c59-4c19-8fbf-249ac9ad2dd2","resolution":{"observed_at":"2026-08-06T16:48:53.797772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:53.348069Z","title":"Deformable detr: Deformable transformers for end-to-end object detection","venue":null,"work_id":"1bf7df0a-feb2-4ff6-9b93-17f64f502e9c","year":2021},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.678343Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:5ef79af3b2157b24ade09ce309189e2e8075262bb450e06985b71de7444b8d0e","observation_id":"f83c1625-db3e-4ae1-8dfe-64582d3fe575","resolution":{"observed_at":"2026-08-06T16:48:53.486662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:51.793967Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.793967Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:8bc519adb1b8fdd3b618e69734b733723f6d0b5be4f5370c981a11181521b6e8","observation_id":"5def573a-51aa-4a2d-a36e-9bf1a83e631b","resolution":{"observed_at":"2026-08-06T16:48:51.793967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:48:51.897482Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:51.897482Z"},"links":{"citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:788fbaa8ae169a0ccc7f3a527a2a9f68e48d36163db03140f77c5729f16954c3","observation_id":"41bd2ee2-da64-4659-acbb-6df2f58167cc","resolution":{"observed_at":"2026-08-06T16:48:51.897482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.13007","last_updated":"2020-07-25T20:42:21Z","snapshot_observed_at":"2026-08-03T09:06:09.229037Z","submitted_at":"2020-07-25T20:42:21Z","title":"HATNet: An End-to-End Holistic Attention Network for Diagnosis of Breast Biopsy Images","version":1},"cited_work":{"arxiv_id":"2007.13007","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.13007","snapshot_observed_at":"2026-08-06T16:48:52.208438Z","title":"HATNet: An End-to-End Holistic Attention Network for Diagnosis of Breast Biopsy Images","venue":"eess.IV","work_id":"ff18aa6f-9362-4b0f-9a22-0c1e4c151181","year":2020},"citing_paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T16:48:52.035624Z"},"links":{"cited_paper":"/paper/2007.13007","citing_paper":"/paper/2507.12780"},"observation_digest":"sha256:e594b91f412641b77deeb3e0edbed69c76ec0d1204eb51f41b7ade7893ba1ed6","observation_id":"bec91c63-936f-442d-aa76-f411a26938c4","resolution":{"observed_at":"2026-08-06T16:48:52.283609Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12780","last_updated":"2025-07-17T04:41:18Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:08:52.341257Z","submitted_at":"2025-07-17T04:41:18Z","title":"Compact Vision Transformer by Reduction of Kernel Complexity"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":31,"verified_exact":2,"verified_fuzzy":63},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 0 inbound Pith citation observations for arXiv:2507.12780."}