{"as_of":"2026-08-08T09:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:477a948713246086cee64f7f8b547b222ec02e08d301b596dd0b57981c01f209","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:08:10.568820Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:17:26.122002Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":"2412.01818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-02T22:17:26.122002Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":"0e705883-8702-42cd-b101-1faff544762a","year":2025},"citing_paper":{"arxiv_id":"2503.14075","last_updated":"2026-04-10T01:08:12Z","snapshot_observed_at":"2026-07-06T20:54:36.522651Z","submitted_at":"2025-03-18T09:52:45Z","title":"Growing a Multi-head Twig via Distillation and Reinforcement Learning to Accelerate Large Vision-Language Models","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T23:58:57.819555Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2503.14075"},"observation_digest":"sha256:46f1f102f14f7d6b29f66e6393bce507483f44a3b7d9a45fc2349205e29e1644","observation_id":"4d590f45-b32e-4d8f-9566-7aa62d9e1872","resolution":{"observed_at":"2026-05-23T00:02:17.826191Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-07T14:08:10.568820Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20100","last_updated":"2025-05-26T15:08:37Z","snapshot_observed_at":"2026-08-08T00:45:52.342992Z","submitted_at":"2025-05-26T15:08:37Z","title":"AdaTP: Attention-Debiased Token Pruning for Video Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:08:10.568820Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2505.20100"},"observation_digest":"sha256:f23f67f36990433389ba06842e675a7379aee1ba55a3b2f6f12c739b448a6b4b","observation_id":"a152e2cf-71b3-4838-ae5a-24f22fbedff1","resolution":{"observed_at":"2026-08-07T14:08:10.568820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-07T11:59:10.721952Z","title":"[cls] attention is all you need for training-free visual token pruning: Make vlm inference faster, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00993","last_updated":"2025-06-01T12:49:39Z","snapshot_observed_at":"2026-08-08T00:45:30.620269Z","submitted_at":"2025-06-01T12:49:39Z","title":"FlexSelect: Flexible Token Selection for Efficient Long Video Understanding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:10.721952Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2506.00993"},"observation_digest":"sha256:c6a53b838af45a6cb701894c63b6a9f9388e595925ddcc2b917b1d14bf105321","observation_id":"dfa4e81f-0ea0-49af-aad9-41a331e93e78","resolution":{"observed_at":"2026-08-07T11:59:10.721952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-07T05:03:22.689471Z","title":"[CLS] attention is all you need for training-free visual token pruning: Make vlm inference faster.arXiv preprint arXiv:2412.01818, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08991","last_updated":"2025-06-10T17:02:36Z","snapshot_observed_at":"2026-08-08T00:48:31.237305Z","submitted_at":"2025-06-10T17:02:36Z","title":"Do Concept Replacement Techniques Really Erase Unacceptable Concepts?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:03:22.689471Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2506.08991"},"observation_digest":"sha256:815bc4620e436b0ebd6c72aca2ba4c0a7a3e4bf926041e0292b7cb2e8d2d72ba","observation_id":"71ec673b-1526-4118-a103-06c1a1fd7bbf","resolution":{"observed_at":"2026-08-07T05:03:22.689471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-07T00:42:53.731513Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13166","last_updated":"2025-06-16T07:21:11Z","snapshot_observed_at":"2026-08-08T08:38:39.497266Z","submitted_at":"2025-06-16T07:21:11Z","title":"GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:53.731513Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2506.13166"},"observation_digest":"sha256:a0fa7bd57902e92ecfa7cca91e7a7ec374bee6d12e683f3821cd462eb302da34","observation_id":"a1a373ab-ce2e-4b1e-8eac-7867ae7a5305","resolution":{"observed_at":"2026-08-07T00:42:53.731513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-06T23:47:39.833498Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21600","last_updated":"2025-06-19T07:16:18Z","snapshot_observed_at":"2026-08-08T00:45:25.658279Z","submitted_at":"2025-06-19T07:16:18Z","title":"Structured Attention Matters to Multimodal LLMs in Document Understanding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:47:39.833498Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2506.21600"},"observation_digest":"sha256:1ea88b865c05d0b86b982df89e37be3fd433675005aab348b46e9e0793ecc8fd","observation_id":"de3b0a21-a37f-471b-b485-d88fd6c34fe7","resolution":{"observed_at":"2026-08-06T23:47:39.833498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-06T22:24:36.069967Z","title":"[cls] attention is all you need for training-free visual token pruning: Make vlm inference faster.arXiv preprint arXiv:2412.01818, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21862","last_updated":"2025-06-27T02:29:58Z","snapshot_observed_at":"2026-08-07T08:24:31.697101Z","submitted_at":"2025-06-27T02:29:58Z","title":"LLaVA-Scissor: Token Compression with Semantic Connected Components for Video LLMs","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-06T22:24:36.069967Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2506.21862"},"observation_digest":"sha256:3a492d140eeb803c7c6e09ad74e77aa0a01dcaa6c50edce91c0947cb924a84d3","observation_id":"027bcc54-980e-4005-976e-4024bede4f92","resolution":{"observed_at":"2026-08-06T22:24:36.069967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-06T22:22:38.007759Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21873","last_updated":"2025-06-27T03:11:22Z","snapshot_observed_at":"2026-08-08T07:59:16.819249Z","submitted_at":"2025-06-27T03:11:22Z","title":"Grounding-Aware Token Pruning: Recovering from Drastic Performance Drops in Visual Grounding Caused by Pruning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:22:38.007759Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2506.21873"},"observation_digest":"sha256:da369f0af794d307c2450061aa7ba1305fd884e7a04f362b8a97b656e5db72f3","observation_id":"9769bad8-5242-44f0-8796-3fb811209059","resolution":{"observed_at":"2026-08-06T22:22:38.007759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-06T20:29:56.989156Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster.arXiv preprint arXiv:2412.01818, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02591","last_updated":"2025-07-23T07:25:27Z","snapshot_observed_at":"2026-08-07T06:17:01.457380Z","submitted_at":"2025-07-03T12:55:16Z","title":"AuroraLong: Bringing RNNs Back to Efficient Open-Ended Video Understanding","version":3},"reference_index":113,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:56.989156Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2507.02591"},"observation_digest":"sha256:6fcd2457961326f02a526c02f66707d40a62e405f68a3fdbd1cef55def8cc215","observation_id":"db89bafa-0a57-4cdb-9ed4-0046b86f872e","resolution":{"observed_at":"2026-08-06T20:29:56.989156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-06T16:16:49.501635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14042","last_updated":"2025-07-18T16:11:28Z","snapshot_observed_at":"2026-08-06T19:19:01.839604Z","submitted_at":"2025-07-18T16:11:28Z","title":"Training-free Token Reduction for Vision Mamba","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T16:16:49.501635Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2507.14042"},"observation_digest":"sha256:6a73b73c1597cd2b0f050505127a2f8a93118b18610b7ea4fd1d8a318303603a","observation_id":"6e34a4b6-98fa-45e8-929f-7b2dce7e4b12","resolution":{"observed_at":"2026-08-06T16:16:49.501635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-06T13:18:05.802359Z","title":"[CLS] attention is all you need for training-free visual token pruning: Make VLM inference faster","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20842","last_updated":"2025-07-28T13:50:53Z","snapshot_observed_at":"2026-08-07T09:17:15.026471Z","submitted_at":"2025-07-28T13:50:53Z","title":"METEOR: Multi-Encoder Collaborative Token Pruning for Efficient Vision Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T13:18:05.802359Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2507.20842"},"observation_digest":"sha256:17802bc61c9bd8bc46a3624c74380adfb73cb32de8a5a59da4f3915876515aa6","observation_id":"18328f71-a4db-42db-a401-0e22267c7c09","resolution":{"observed_at":"2026-08-06T13:18:05.802359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-06T05:37:35.455914Z","title":"Beyond text-visual attention: Exploiting visual cues for effective token pruning in vlms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01548","last_updated":"2025-08-03T02:15:43Z","snapshot_observed_at":"2026-08-07T08:25:25.474549Z","submitted_at":"2025-08-03T02:15:43Z","title":"A Glimpse to Compress: Dynamic Visual Token Pruning for Large Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T05:37:35.455914Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2508.01548"},"observation_digest":"sha256:6bd06e2944f85f1e5923d61e396e08ee51909bc0477b9181da9402ac8ba45061","observation_id":"feaaf656-4822-432f-856a-1c299155dab3","resolution":{"observed_at":"2026-08-06T05:37:35.455914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-05T13:42:28.922349Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00419","last_updated":"2025-08-30T08:57:53Z","snapshot_observed_at":"2026-08-08T00:44:37.664755Z","submitted_at":"2025-08-30T08:57:53Z","title":"LightVLM: Acceleraing Large Multimodal Models with Pyramid Token Merging and KV Cache Compression","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T13:42:28.922349Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2509.00419"},"observation_digest":"sha256:3f3232c8dda59d78785d1d223cce644f4672c4c2fdf1c86d672bede338339bcc","observation_id":"a8b6add4-2c32-4340-9e76-eb965d4975ed","resolution":{"observed_at":"2026-08-05T13:42:28.922349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":"2412.01818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-02T22:17:26.122002Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":"0e705883-8702-42cd-b101-1faff544762a","year":2025},"citing_paper":{"arxiv_id":"2604.05601","last_updated":"2026-04-07T08:52:28Z","snapshot_observed_at":"2026-08-02T09:38:57.549881Z","submitted_at":"2026-04-07T08:52:28Z","title":"ID-Selection: Importance-Diversity Based Visual Token Selection for Efficient LVLM Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T19:00:03.743899Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2604.05601"},"observation_digest":"sha256:e0057425fbf955de17740e994e1154b1913229f027d4c0bc3cc24860df815faa","observation_id":"8b8ff788-206e-4cad-bc21-8ee7d2dc6826","resolution":{"observed_at":"2026-05-10T23:35:51.376207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":"2412.01818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-02T22:17:26.122002Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":"0e705883-8702-42cd-b101-1faff544762a","year":2025},"citing_paper":{"arxiv_id":"2604.11122","last_updated":"2026-04-13T07:36:02Z","snapshot_observed_at":"2026-07-06T22:59:36.571641Z","submitted_at":"2026-04-13T07:36:02Z","title":"Semantic-Geometric Dual Compression: Training-Free Visual Token Reduction for Ultra-High-Resolution Remote Sensing Understanding","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:49.681399Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2604.11122"},"observation_digest":"sha256:b6c6d5d195e1ffcf7e354dc893dcdb0633240f86f503c0a8866acb57662271cd","observation_id":"7dfed331-4316-49bf-b658-c03c40981a1b","resolution":{"observed_at":"2026-05-11T10:26:01.376382Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":"2412.01818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-02T22:17:26.122002Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":"0e705883-8702-42cd-b101-1faff544762a","year":2025},"citing_paper":{"arxiv_id":"2605.09429","last_updated":"2026-05-10T09:07:04Z","snapshot_observed_at":"2026-08-03T02:25:12.314678Z","submitted_at":"2026-05-10T09:07:04Z","title":"Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T02:29:22.152053Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2605.09429"},"observation_digest":"sha256:0af340f71e4477e77d781cc96ca81b5fb5f4aa3bc927267a6a07709464283000","observation_id":"934549df-7e05-41c0-912b-9f82bb5c1873","resolution":{"observed_at":"2026-05-12T07:36:37.432782Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":"2412.01818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-02T22:17:26.122002Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":"0e705883-8702-42cd-b101-1faff544762a","year":2025},"citing_paper":{"arxiv_id":"2605.09982","last_updated":"2026-05-11T04:50:05Z","snapshot_observed_at":"2026-08-06T18:43:23.449356Z","submitted_at":"2026-05-11T04:50:05Z","title":"ERASE: Eliminating Redundant Visual Tokens via Adaptive Two-Stage Token Pruning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T04:14:04.738673Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2605.09982"},"observation_digest":"sha256:ea88b35aa507450f1093b16456912acdfdbb43362cf8b33801c17ed4b343fc65","observation_id":"9f0a851d-c669-4ddd-b934-f862a7070ee4","resolution":{"observed_at":"2026-05-12T06:31:25.369861Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":"2412.01818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-02T22:17:26.122002Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":"0e705883-8702-42cd-b101-1faff544762a","year":2025},"citing_paper":{"arxiv_id":"2605.15621","last_updated":"2026-05-15T05:09:15Z","snapshot_observed_at":"2026-08-02T06:28:30.704142Z","submitted_at":"2026-05-15T05:09:15Z","title":"LRCP: Low-Rank Compressibility Guided Visual Token Pruning for Efficient LVLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T19:04:15.273932Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2605.15621"},"observation_digest":"sha256:535bc10e03400b5ef22804e0e51051b24f95938fc1324537abfb904e56afff2c","observation_id":"a9079ea7-51fd-418c-a080-ce9acb14dd8c","resolution":{"observed_at":"2026-05-20T19:08:54.487547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":"2412.01818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-02T22:17:26.122002Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":"0e705883-8702-42cd-b101-1faff544762a","year":2025},"citing_paper":{"arxiv_id":"2605.25179","last_updated":"2026-05-24T17:19:31Z","snapshot_observed_at":"2026-07-06T23:35:11.987278Z","submitted_at":"2026-05-24T17:19:31Z","title":"Locality Matters for Training-Free Audio Token Compression in Audio-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T11:39:41.560725Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2605.25179"},"observation_digest":"sha256:d9ce8b34bb0151309cc0f6f1aa280b2a4bea5d7622fd625bd0fa60ee139e1f3c","observation_id":"37f6b381-e56a-4e33-a38a-e603e6bee3fa","resolution":{"observed_at":"2026-06-30T11:44:38.351501Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":"2412.01818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-02T22:17:26.122002Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":"0e705883-8702-42cd-b101-1faff544762a","year":2025},"citing_paper":{"arxiv_id":"2606.08511","last_updated":"2026-06-07T08:32:13Z","snapshot_observed_at":"2026-07-06T23:48:02.118629Z","submitted_at":"2026-06-07T08:32:13Z","title":"Look Less, Reason More: Block-wise Attention Skipping for Efficient Multimodal LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T19:02:59.403688Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2606.08511"},"observation_digest":"sha256:ae99404af846359dfd091cf44721f086a4611427f33d00567060cfd7266a5bcf","observation_id":"470d56ab-54bb-4b1e-87db-372c9e49ec2f","resolution":{"observed_at":"2026-07-02T22:17:26.123720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":"2412.01818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-02T22:17:26.122002Z","title":"[cls] attention is all you need for training- free visual token pruning: Make vlm inference faster","venue":null,"work_id":"0e705883-8702-42cd-b101-1faff544762a","year":2025},"citing_paper":{"arxiv_id":"2606.31383","last_updated":"2026-06-30T09:11:50Z","snapshot_observed_at":"2026-07-07T00:05:07.912609Z","submitted_at":"2026-06-30T09:11:50Z","title":"MS-Resampler: Multi-Scope Visual Resampling for Efficient Multimodal LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-01T05:41:04.184461Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2606.31383"},"observation_digest":"sha256:ccdef389bd529d897038f716ba739bad459900744bb4d1a36bd45898e36731a7","observation_id":"9afba30e-add1-4789-94e4-34aad4b59574","resolution":{"observed_at":"2026-07-01T10:15:44.594522Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-01T03:50:32.497038Z","title":"arXiv preprint arXiv:2412.01818 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23046","last_updated":"2026-07-25T05:08:22Z","snapshot_observed_at":"2026-08-05T23:06:05.708340Z","submitted_at":"2026-07-25T05:08:22Z","title":"Structured Redundancy Modeling for Efficient Visual Token Pruning in High-Resolution MLLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T03:50:32.497038Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2607.23046"},"observation_digest":"sha256:e30ca7e9c8b1b2d3c19b83fb65198738d7b612906b27b147dc8278c3edefc04a","observation_id":"31e0ae82-63bd-4e86-aa8f-789c4ea6cec9","resolution":{"observed_at":"2026-08-01T03:50:32.497038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-01T01:26:49.636465Z","title":"Beyond text- visual attention: Exploiting visual cues for effective token pruning in VLMs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-02T18:28:59.293276Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.636465Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:5bdbd9d82b3bcbd9c21fedfbe886b3bf92b8bcb908e968506b5328b31e8d9bb4","observation_id":"9cab3c0a-6146-49ac-bb56-15432c60c487","resolution":{"observed_at":"2026-08-01T01:26:49.636465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-01T03:07:43.698719Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27700","last_updated":"2026-07-30T05:36:29Z","snapshot_observed_at":"2026-08-08T00:47:02.739295Z","submitted_at":"2026-07-30T05:36:29Z","title":"Calibrate Before Reason: Robust Visual Token Reduction against Semantic Drift in VLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T03:07:43.698719Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2607.27700"},"observation_digest":"sha256:38f29599ac34e737a99331e2c2811feff9afbaa37c0119b1fd0dee0abe31deef","observation_id":"2ff5e9df-6bdd-44d4-964f-969d81b032dd","resolution":{"observed_at":"2026-08-01T03:07:43.698719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-07-31T10:42:21.341740Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28341","last_updated":"2026-07-30T15:07:00Z","snapshot_observed_at":"2026-08-04T02:02:27.774896Z","submitted_at":"2026-07-30T15:07:00Z","title":"Capturing Token Tendencies for Training-Free Token Pruning in Multimodal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T10:42:21.341740Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2607.28341"},"observation_digest":"sha256:76d8e7ea819f740f5067ad42faf1c7ea3cf1edb6f3bc6e956a08c7c156c655e6","observation_id":"fe0ca0c7-afc8-4328-9ca5-3091f69bb5b4","resolution":{"observed_at":"2026-07-31T10:42:21.341740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-05T15:19:02.843428Z","title":"[CLS] attention is all you need for training-free visual token pruning: Make VLM inference faster","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03649","last_updated":"2026-08-04T13:33:11Z","snapshot_observed_at":"2026-08-08T01:06:38.251380Z","submitted_at":"2026-08-04T13:33:11Z","title":"When Do Fewer Visual Tokens Accelerate Multimodal Inference? A Break-Even Study Across Decision Locations and Hardware","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:02.843428Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2608.03649"},"observation_digest":"sha256:100598642d305c0c7674cfb4f525299d1cf0d231d3f6664757649c808517a7a8","observation_id":"b8e56e5f-2d4b-4c0a-ba66-b94aabab9a82","resolution":{"observed_at":"2026-08-05T15:19:02.843428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.01818/citation-record","integrity":"/paper/2412.01818/integrity","json":"/paper/2412.01818/citation-record.json","paper":"/paper/2412.01818"},"outbound":[],"paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2412.01818."}