{"as_of":"2026-08-08T08:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c89cfb76c5f9be6b8483cd0a1477aa76dfbe4ce8d0dce6f2384e932f67948d97","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:19:59.110224Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16260/citation-record","integrity":"/paper/2507.16260/integrity","json":"/paper/2507.16260/citation-record.json","paper":"/paper/2507.16260"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:58.837857Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.837857Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:0ceb1b7fafaa8d27986ddac13eb8519f20c9b9a2991d07b22c6052db815712ac","observation_id":"9af22605-017b-459b-a20c-567cd3042483","resolution":{"observed_at":"2026-08-06T15:19:58.837857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T15:19:58.844109Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.844109Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:8e41d20ccb08dc52176f9786d3cfee5a3fe762fdb065ffa31aab977b0cda290d","observation_id":"0cc6bdb9-1adf-4c2f-96d5-0deb8ff02b75","resolution":{"observed_at":"2026-08-06T15:19:58.844109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.170972Z","title":"(2022) Introducing chatgpt","venue":null,"work_id":"6a64a9ab-76e1-4793-8d3e-e90c92f449fe","year":2022},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.853053Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:904e09b7e84cb34939ce0f031438b4c62ea74338c839adfa4c6bcb60fcf7bc2c","observation_id":"625c183d-304e-478e-ac5a-1e66d08d1c75","resolution":{"observed_at":"2026-08-06T15:20:00.180963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.137617Z","title":"(2023) Github copilot: Your ai pair programmer","venue":null,"work_id":"f7e60b68-17ea-4896-8593-38b06a7fe7d4","year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.861119Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:c35684d8eff8e7334e9c51482f8a30b08df12400a6ab8176cadfa4ffca9ac615","observation_id":"3b0154b0-7f2c-4e98-9df6-d4c2dbb78b5b","resolution":{"observed_at":"2026-08-06T15:20:00.146757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:58.869022Z","title":"Training data-efficient image transformers & distillation through attention,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.869022Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:4935e7c159f9406647c314f6a944e744eb6584bd89509d01894486e40e3f5a6f","observation_id":"9d22507a-d8a7-4c12-a8a2-e241f0284866","resolution":{"observed_at":"2026-08-06T15:19:58.869022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.075974Z","title":"Tinymim: An empirical study of distilling mim pre-trained models,","venue":null,"work_id":"0a82819c-fb5a-4868-aa51-ab117310d42e","year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.874879Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:1c63e1316ffad08a9d94d6d77a0b9e0c7e3d7ec639cd20f347384acb485cf892","observation_id":"d2f7a58c-099c-402e-a65f-582dd39f2fee","resolution":{"observed_at":"2026-08-06T15:20:00.082874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:58.882285Z","title":"Llm-pruner: On the structural pruning of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.882285Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:9b40c6032962692f5777044aad93b1afea7d7e6db2a7bfd399d36b9325a2e96c","observation_id":"d587a21c-d107-43c5-a37c-bd25f3be3deb","resolution":{"observed_at":"2026-08-06T15:19:58.882285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.018885Z","title":"Width & depth pruning for vision transformers,","venue":null,"work_id":"b9523e3a-e67d-4cff-ba87-13546e98c6db","year":2022},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.888142Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:a9641448ed6607ad88f6d3f15eb42fa57c74d1cb91bc9a755acf8de910fed14b","observation_id":"78efd689-fbdd-4af7-a373-282771e77cf3","resolution":{"observed_at":"2026-08-06T15:20:00.025120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.986968Z","title":"Towards accurate post-training quantization for vision transformer,","venue":null,"work_id":"5b14e168-eb44-4ca7-abc2-c79bfb944c94","year":2022},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.894027Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:4e5e1d1b1350bbfb82662c42dfdeb2319d195b0fd94dad06c96a738fe2e9531d","observation_id":"fe4a3eab-9de8-4e80-ab80-8c3fba1aba3a","resolution":{"observed_at":"2026-08-06T15:19:59.993363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.967065Z","title":"Pyramid vision transformer: A versatile backbone for dense prediction without convolutions,","venue":null,"work_id":"4ce6d23f-aafd-4874-aebb-63b69520f104","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.900070Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:0e31afdfae3f41f4f2561629b6b69ec39b02a99450c9bab12746e19177f19397","observation_id":"62356d5e-b19f-4ac8-b4a9-b25d4f2ed401","resolution":{"observed_at":"2026-08-06T15:19:59.972101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.944122Z","title":"Co-scale conv-attentional image transformers,","venue":null,"work_id":"f916cf3d-25cb-4188-9ea0-32104b2c8522","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.906535Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:f895e75f4ceb71c1a95d145b113e208387a0ad7a7104f640fd2b14533c2735c2","observation_id":"19e15b13-674d-47e8-a099-3970fb6770cb","resolution":{"observed_at":"2026-08-06T15:19:59.952342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:58.912103Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.912103Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:b9b2f66c8cb42622b128367338d68bb7b2b556cb6e11707aa08c42e3361b8276","observation_id":"572eed05-64be-4d63-9395-b1fc0ed5187e","resolution":{"observed_at":"2026-08-06T15:19:58.912103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.905609Z","title":"Tokens-to-token vit: Training vision transformers from scratch on imagenet,","venue":null,"work_id":"656175c2-aaf7-4dee-b689-772d51d21d76","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.917727Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:b51336518ab34ecc4dd699df8cbb47796d992937af9dade31c79eed7536905ee","observation_id":"5924a9e0-d702-4f04-bc33-fc69fadcd86b","resolution":{"observed_at":"2026-08-06T15:19:59.916326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07800","last_updated":"2022-04-13T23:46:08Z","snapshot_observed_at":"2026-08-03T03:15:29.208149Z","submitted_at":"2022-02-16T00:19:42Z","title":"Not All Patches are What You Need: Expediting Vision Transformers via Token Reorganizations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07800","snapshot_observed_at":"2026-08-06T15:19:58.923885Z","title":"Not all patches are what you need: Expediting vision transformers via token reorganizations,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.923885Z"},"links":{"cited_paper":"/paper/2202.07800","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:c6b78f38d402b7d250250fcf2a0b5b7bd8e60cb34fad45976d69ad4d6216f24e","observation_id":"87a9b2e3-3c2f-46d2-94f8-a85bd043f075","resolution":{"observed_at":"2026-08-06T15:19:58.923885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:58.929249Z","title":"Dynam- icvit: Efficient vision transformers with dynamic token sparsification,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.929249Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:80163c60b60aecd4aca39b602eccb7b4bb002265db127b976fdc413991eaf47f","observation_id":"e12db6a7-43fa-4d7e-ba8c-f503893a1a2b","resolution":{"observed_at":"2026-08-06T15:19:58.929249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.867938Z","title":"Token merging: Your vit but faster,","venue":null,"work_id":"57d2c99a-eef2-4801-b564-930dc60c9049","year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.934260Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:9bcae10a0817a6ca7f3b6a02e40f841c1184d4a2a4183e824c0c1ba2d8b3833c","observation_id":"70cd872a-877b-43c8-8948-f5ab71a62886","resolution":{"observed_at":"2026-08-06T15:19:59.873298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.847877Z","title":"Adaptive sparse vit: towards learnable adaptive token pruning by fully exploiting self-attention,","venue":null,"work_id":"fb6c1fda-8cc4-446c-908c-55d18c908f31","year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.938965Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:4c31afe08675eb393d5f1d4c31b37a92b0504c820321c00e8197143214218f7e","observation_id":"1f88df41-913b-4475-aacd-ea987b69ac93","resolution":{"observed_at":"2026-08-06T15:19:59.853885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.825906Z","title":"A simple romance between multi-exit vision transformer and token reduction,","venue":null,"work_id":"80ca8dc5-0063-4f9f-bb66-a1b1e8ae7b19","year":2024},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.944619Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:dc08d52c89b100bd4ee04125d399a72bc74822e9f5199316a883adec95135416","observation_id":"abacbcaa-26e1-43f2-800d-1412e5f28a1c","resolution":{"observed_at":"2026-08-06T15:19:59.831841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.803474Z","title":"Synergistic patch pruning for vision transformer: Unifying intra-& inter-layer patch importance,","venue":null,"work_id":"49be7f03-ab6d-407e-93fb-8060d91269bb","year":2024},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.952328Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:08a903a65d571bfb23d63d96e85253752702fd39f0b729b78b4a4f1cdf1c2e4e","observation_id":"832cfb95-3282-47cf-842f-523cf4fa28d0","resolution":{"observed_at":"2026-08-06T15:19:59.809147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.777329Z","title":"Diffrate: Differentiable compression rate for efficient vision transformers,","venue":null,"work_id":"e745be08-41a0-4340-96d3-e455bd3d207e","year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.960087Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:367b805cf865c9beade6c2a54916ae7830f0226972619abf9e669ae44162fd01","observation_id":"5a02c8ef-48f5-45be-9de3-930a74b587db","resolution":{"observed_at":"2026-08-06T15:19:59.784661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.748956Z","title":"Beyond attentive tokens: Incorporating token importance and diversity for efficient vision transformers,","venue":null,"work_id":"6e99ea37-b55f-45a8-a06b-9193d00e62ec","year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.965826Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:fbc12fa8d47de87a09360a66bd8fc04403591b4aff618d05dda91fbb9fb040d6","observation_id":"f2aff503-aa81-4511-8807-d79ad442c39f","resolution":{"observed_at":"2026-08-06T15:19:59.759181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.729743Z","title":"Joint token pruning and squeezing towards more aggressive compression of vision transformers,","venue":null,"work_id":"f936928f-35b0-4f9e-842a-476afe09ee14","year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.972638Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:5f004b8cf470b9b9bc71606f73fa7708d1bce1fbbbdce2172dcf5389c25fa10d","observation_id":"f77f8566-6718-4936-80e4-fea8cb6fb691","resolution":{"observed_at":"2026-08-06T15:19:59.736637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10858","last_updated":"2021-06-09T15:27:26Z","snapshot_observed_at":"2026-08-03T15:49:54.863858Z","submitted_at":"2021-04-22T04:43:06Z","title":"All Tokens Matter: Token Labeling for Training Better Vision Transformers","version":3},"cited_work":{"arxiv_id":"2104.10858","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.10858","snapshot_observed_at":"2026-08-06T15:19:59.309811Z","title":"All Tokens Matter: Token Labeling for Training Better Vision Transformers","venue":"cs.CV","work_id":"ae3e302d-63cd-4c8c-be11-a0b64a2de292","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.978387Z"},"links":{"cited_paper":"/paper/2104.10858","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:3eb19d89c26e6669cb36986e1fa1e0aa42895d6119ca12f1b20c7f431e96aa6b","observation_id":"2de641b9-64a4-4e3b-9b16-e1caf65f9fd3","resolution":{"observed_at":"2026-08-06T15:19:59.317187Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.704266Z","title":"[Online]","venue":null,"work_id":"63734f94-13e8-42f2-a3d3-6f811ee59c1c","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.984084Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:a77fd291564ca5a9c3d0db528f4c8bbd5e0798c3bd56b6e14981401aae6abd8f","observation_id":"5af4db4f-f28f-4827-bbbe-0e19e78aa40e","resolution":{"observed_at":"2026-08-06T15:19:59.713468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01144","last_updated":"2017-08-05T22:45:19Z","snapshot_observed_at":"2026-08-01T18:34:23.156273Z","submitted_at":"2016-11-03T19:48:08Z","title":"Categorical Reparameterization with Gumbel-Softmax","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01144","snapshot_observed_at":"2026-08-06T15:19:58.990554Z","title":"Categorical reparameterization with gumbel-softmax,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.990554Z"},"links":{"cited_paper":"/paper/1611.01144","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:605f3cc59131b6190304cbe50d8c2d406f92bd0b78eca0df43baee5fa077d4d7","observation_id":"fb95ba81-c319-4833-95a2-07d6ddd47cfc","resolution":{"observed_at":"2026-08-06T15:19:58.990554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.00712","last_updated":"2017-03-05T16:59:44Z","snapshot_observed_at":"2026-08-05T03:48:52.905768Z","submitted_at":"2016-11-02T18:25:40Z","title":"The Concrete Distribution: A Continuous Relaxation of Discrete Random Variables","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.00712","snapshot_observed_at":"2026-08-06T15:19:58.996503Z","title":"The concrete distribution: A continuous relaxation of discrete random variables,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:58.996503Z"},"links":{"cited_paper":"/paper/1611.00712","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:ac35488b543ad92a41bac09b8dc38f3edfa0091ce76e8c1fdf8d269c5fbe409b","observation_id":"568dd40d-ccb7-4160-b96e-34cc1a7a87c4","resolution":{"observed_at":"2026-08-06T15:19:58.996503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.678959Z","title":"All tokens matter: Token labeling for training better vi- sion transformers,","venue":null,"work_id":"c74b76a2-48ad-4f4d-b5af-c5262ac7c8f5","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.001219Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:9737ab0edc17734abd8e296e9a7597a26c0bfd2d5d12db49891ce4b7df868248","observation_id":"4df2c928-24a3-4f30-97a7-78f5eebbe469","resolution":{"observed_at":"2026-08-06T15:19:59.685878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.007173Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.007173Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:eb99cdcad4ac9adf70076a173371d6a41ac20b0fa26c6c3f7194cbf94e2c1712","observation_id":"8cc1c5bf-8968-4ad3-9eca-ff44277872a7","resolution":{"observed_at":"2026-08-06T15:19:59.007173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.637269Z","title":"Crossvit: Cross-attention multi- scale vision transformer for image classification,","venue":null,"work_id":"682355b1-6ab2-4c73-a8ce-82620c739e4b","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.011938Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:da622703843c4814c2004dfb131a8d324038108d8ffeac61fbbca1fcce5a23fe","observation_id":"cb0d1b08-096d-49d0-aa98-1f546ab89995","resolution":{"observed_at":"2026-08-06T15:19:59.647920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.10882","last_updated":"2023-02-13T01:19:57Z","snapshot_observed_at":"2026-08-06T12:12:32.479948Z","submitted_at":"2021-02-22T10:29:55Z","title":"Conditional Positional Encodings for Vision Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.10882","snapshot_observed_at":"2026-08-06T15:19:59.017983Z","title":"Condi- tional positional encodings for vision transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.017983Z"},"links":{"cited_paper":"/paper/2102.10882","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:fa9663b71a9b12ddce2b1025c5637ec7c47cca20cea60bebf91abcd6d474bd3a","observation_id":"8987f68c-8c40-440b-bc33-52f6ac536e7a","resolution":{"observed_at":"2026-08-06T15:19:59.017983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.613067Z","title":"Designing network design spaces,","venue":null,"work_id":"861bf0e7-ea70-4158-b665-7cdd4ef51dcc","year":2020},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.024356Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:363201dfe989643d248a373010693c46aa6d3cbaa103d1d2730ed618305529ac","observation_id":"44b3072c-8fde-4962-9483-13ed35662064","resolution":{"observed_at":"2026-08-06T15:19:59.621790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.031380Z","title":"Efficientnet: Rethinking model scaling for con- volutional neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.031380Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:b5de0b2a84f819d61b995067d91c0f489b0b0fcaa96ab984c7216b77bc16f536","observation_id":"3d830739-c10d-4ffa-8adb-fb5655c9ef7d","resolution":{"observed_at":"2026-08-06T15:19:59.031380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.574066Z","title":"High-performance large-scale image recognition without normalization,","venue":null,"work_id":"54e09243-a6b4-4e5e-ae74-2d0589419dac","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.036325Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:72676107bd26ea399d578fac7fb5b9b421a7a6bf73eaa67c5872d328beec13ad","observation_id":"97cb1b04-74a3-4c25-b03f-e0aa5e84be7b","resolution":{"observed_at":"2026-08-06T15:19:59.579909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.543867Z","title":"Ia- red2: Interpretability-aware redundancy reduction for vision transform- ers,","venue":null,"work_id":"e7e58a02-563d-427b-b433-ae6e87b6395b","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.043395Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:b25d9bf6d75b47037825efa6b025a6ea039f66ef07863baeebaef3228e0ac502","observation_id":"e50636b9-6167-4504-b1e4-ca2361d7bfdd","resolution":{"observed_at":"2026-08-06T15:19:59.551094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.518940Z","title":"Evo-vit: Slow-fast token evolution for dynamic vision transformer,","venue":null,"work_id":"ce6d90db-ca02-4522-9e0e-86bec5284a19","year":2022},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.049458Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:870ed4d89829a3599bc546509cd771f571396efd206127ebfc680dfc968d5f4b","observation_id":"d7d8b8ae-3b9a-4682-9082-11b969d85168","resolution":{"observed_at":"2026-08-06T15:19:59.525469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.494996Z","title":"Token fusion: Bridging the gap between token pruning and token merging,","venue":null,"work_id":"2618bdd2-7c06-4418-b902-d7e376f08b23","year":2024},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.055273Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:e1330bd5af8e3a7619dee7b4b2498690b2cd5ee1e3f106e3c0fc9fe69ff4ed72","observation_id":"8003ba18-028c-4aec-99ff-e69e99ef612e","resolution":{"observed_at":"2026-08-06T15:19:59.502746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.063188Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.063188Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:581b191a14d27be9a326b5086208cd6f5f6f83ea39fef283b3993b357d04ca4b","observation_id":"a8a5d023-6529-418a-aa39-3c600eb0082a","resolution":{"observed_at":"2026-08-06T15:19:59.063188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.460595Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":"54ec7551-96f2-4268-a98e-171d0cb1dcd1","year":2019},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.069281Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:15631d67b76e8925d206761a21d786ffde8ff21d87979567d82282fc973aa68d","observation_id":"8427ab51-f64f-4175-a580-a259b68060b3","resolution":{"observed_at":"2026-08-06T15:19:59.465685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.441281Z","title":"Edge learning: The enabling technology for distributed big data analytics in the edge,","venue":null,"work_id":"fc6e7d5d-ad8d-4711-ad7a-2080f3a1cff9","year":2021},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.075342Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:b14a5dd288519035df43c50b8702262552703cd0eb615dc164eaa7cbc3861bc6","observation_id":"1e7d451e-8995-4a7a-9dc5-a7b9369c9f48","resolution":{"observed_at":"2026-08-06T15:19:59.447360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05031","last_updated":"2024-01-10T09:43:29Z","snapshot_observed_at":"2026-08-04T23:49:18.831626Z","submitted_at":"2024-01-10T09:43:29Z","title":"OTAS: An Elastic Transformer Serving System via Token Adaptation","version":1},"cited_work":{"arxiv_id":"2401.05031","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.05031","snapshot_observed_at":"2026-08-06T15:19:59.210707Z","title":"OTAS: An Elastic Transformer Serving System via Token Adaptation","venue":"cs.DC","work_id":"663881d8-f187-4f42-a729-37385b43e78d","year":2024},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.080749Z"},"links":{"cited_paper":"/paper/2401.05031","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:872239a11d8b03a9995129e3ad764f1ecdcc5e620f2f9dde2e8fa9a0616c5a13","observation_id":"ab0038f8-df86-4fdd-b33f-9d5a946a32a1","resolution":{"observed_at":"2026-08-06T15:19:59.217652Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04284","last_updated":"2019-06-18T19:42:31Z","snapshot_observed_at":"2026-07-06T07:59:23.899551Z","submitted_at":"2019-06-07T13:58:49Z","title":"Analyzing the Structure of Attention in a Transformer Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04284","snapshot_observed_at":"2026-08-06T15:19:59.085751Z","title":"Analyzing the structure of attention in a transformer language model,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.085751Z"},"links":{"cited_paper":"/paper/1906.04284","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:6688277bb67b2af73dcc57eef9cae1de8b20998c8bb9c801740126871020d1e0","observation_id":"43a9069e-a3c9-4aca-b3c6-20f5ad12c821","resolution":{"observed_at":"2026-08-06T15:19:59.085751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.421794Z","title":"Xception: Deep learning with depthwise separable convolu- tions,","venue":null,"work_id":"55fb9237-3fe3-4723-82b5-ddf51391e4b8","year":2017},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.090761Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:64d833428a01cb7146aacc40d375d6bb6c37abd02e27cbf469cfd5ada5b34077","observation_id":"d0c9366d-5136-4032-9bc3-3b4c3c06da3c","resolution":{"observed_at":"2026-08-06T15:19:59.426932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.095202Z","title":"Approximation by superpositions of a sigmoidal function,","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.095202Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:2dee4c882426fbc883db8a3215c8b4355abad2315da86f09d62170d4cd1043a4","observation_id":"4a768149-49f9-479c-b834-657140eaa732","resolution":{"observed_at":"2026-08-06T15:19:59.095202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10780","last_updated":"2023-08-17T11:51:16Z","snapshot_observed_at":"2026-07-06T15:56:22.198858Z","submitted_at":"2023-07-20T11:30:12Z","title":"Learned Thresholds Token Merging and Pruning for Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10780","snapshot_observed_at":"2026-08-06T15:19:59.099779Z","title":"Learned thresholds token merging and pruning for vision transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.099779Z"},"links":{"cited_paper":"/paper/2307.10780","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:debce8513a6fb75cd82638ee6f610683e9b75f8ec98953c78cf7d889474729f3","observation_id":"c7f1ee75-5fd2-42f4-b9ed-ac79be845217","resolution":{"observed_at":"2026-08-06T15:19:59.099779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01812","last_updated":"2024-02-05T09:21:28Z","snapshot_observed_at":"2026-07-06T16:26:58.234941Z","submitted_at":"2023-10-03T05:55:11Z","title":"PPT: Token Pruning and Pooling for Efficient Vision Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01812","snapshot_observed_at":"2026-08-06T15:19:59.104941Z","title":"Ppt: Token pruning and pooling for efficient vision transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.104941Z"},"links":{"cited_paper":"/paper/2310.01812","citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:690cb274b503791e9b36a419a0334283c4df8e662c5bf18a8e966697b632aa3b","observation_id":"f27f4608-c54d-415f-b3ea-948f73c63830","resolution":{"observed_at":"2026-08-06T15:19:59.104941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:19:59.377717Z","title":"No token left behind: Efficient vision transformer via dynamic token idling,","venue":null,"work_id":"fb3bd49c-a9c3-433f-b383-4c31f64fa79b","year":2023},"citing_paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:19:59.110224Z"},"links":{"citing_paper":"/paper/2507.16260"},"observation_digest":"sha256:ef517f86ab67a68d764906a85676e93ea7b65efb7f7354ab7f4f491648c4da75","observation_id":"baa02c17-fe57-444a-9de5-6a628a2ade34","resolution":{"observed_at":"2026-08-06T15:19:59.386239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16260","last_updated":"2025-07-22T06:17:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T12:15:46.752138Z","submitted_at":"2025-07-22T06:17:44Z","title":"ToFe: Lagged Token Freezing and Reusing for Efficient Vision Transformer Inference"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":2,"verified_fuzzy":27},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2507.16260."}