{"as_of":"2026-08-07T15:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e46098abf653bb4192c35aa259048924aee647ab5e33e749438fa8f7f40a1a50","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:20:30.500266Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02175","snapshot_observed_at":"2026-08-07T04:20:30.500266Z","title":"Divprune: Diversity-based visual token pruning for large multimodal models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10967","last_updated":"2025-07-01T08:19:08Z","snapshot_observed_at":"2026-08-07T04:10:34.426874Z","submitted_at":"2025-06-12T17:59:09Z","title":"Beyond Attention or Similarity: Maximizing Conditional Diversity for Token Pruning in MLLMs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:20:30.500266Z"},"links":{"cited_paper":"/paper/2503.02175","citing_paper":"/paper/2506.10967"},"observation_digest":"sha256:cfff8d026fce84c4a53b7404a377e3be2c663e7affc0f9ef21aaf08f16e7ae3b","observation_id":"d9580dc0-9e63-41c9-860c-842923ee40f6","resolution":{"observed_at":"2026-08-07T04:20:30.500266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02175","snapshot_observed_at":"2026-08-07T00:42:53.586485Z","title":"R.; Singh, G.; Akbari, M.; and Zhang, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13166","last_updated":"2025-06-16T07:21:11Z","snapshot_observed_at":"2026-08-07T08:04:06.531324Z","submitted_at":"2025-06-16T07:21:11Z","title":"GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:53.586485Z"},"links":{"cited_paper":"/paper/2503.02175","citing_paper":"/paper/2506.13166"},"observation_digest":"sha256:3c6de96536904a8aa369d0e31f1c0160473a06fafe329a225a47d51894535a4c","observation_id":"b7a2c712-d4dd-404c-aaca-61c8123a70ec","resolution":{"observed_at":"2026-08-07T00:42:53.586485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02175","snapshot_observed_at":"2026-08-06T21:59:15.578220Z","title":"arXiv preprint arXiv:2503.02175","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02946","last_updated":"2025-06-28T15:24:05Z","snapshot_observed_at":"2026-08-06T21:52:26.365788Z","submitted_at":"2025-06-28T15:24:05Z","title":"Iterative Zoom-In: Temporal Interval Exploration for Long Video Understanding","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T21:59:15.578220Z"},"links":{"cited_paper":"/paper/2503.02175","citing_paper":"/paper/2507.02946"},"observation_digest":"sha256:5fc066b8b6ace3af9ab2bac90663c2b9e24b5ddb830db48f128af572821c82d2","observation_id":"0ebdbcd1-1622-47c7-8529-22f36dd1d1dc","resolution":{"observed_at":"2026-08-06T21:59:15.578220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02175","snapshot_observed_at":"2026-08-05T10:40:01.253257Z","title":"Divprune: Diversity- based visual token pruning for large multimodal models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03872","last_updated":"2025-09-04T04:18:46Z","snapshot_observed_at":"2026-08-06T13:21:38.892660Z","submitted_at":"2025-09-04T04:18:46Z","title":"Focus Through Motion: RGB-Event Collaborative Token Sparsification for Efficient Object Detection","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T10:40:01.253257Z"},"links":{"cited_paper":"/paper/2503.02175","citing_paper":"/paper/2509.03872"},"observation_digest":"sha256:79aeb9d82f9e7c90f17058a41e54997dc552b05d3238df20d1cd38933bc44737","observation_id":"64125b5d-0f93-4ca2-9c34-d0abc1a30b2f","resolution":{"observed_at":"2026-08-05T10:40:01.253257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":"2503.02175","doi":"10.48550/arxiv.2503.02175","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.02175","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CVPR , author =","venue":"ArXiv.org","work_id":"4548a9a9-bd0e-494e-95f0-11267ddd7a14","year":2025},"citing_paper":{"arxiv_id":"2604.12358","last_updated":"2026-04-15T17:43:53Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T06:48:31Z","title":"Why and When Visual Token Pruning Fails? A Study on Relevant Visual Information Shift in MLLMs Decoding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T14:50:37.022338Z"},"links":{"cited_paper":"/paper/2503.02175","citing_paper":"/paper/2604.12358"},"observation_digest":"sha256:6fa8e1d987a1f76ac9fcf84250c3899040f1e08214705cbcdcfa5fcf2dd17caf","observation_id":"da857c0b-d36c-4b63-9596-c59d90f5caa1","resolution":{"observed_at":"2026-05-11T11:31:01.529415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":"2503.02175","doi":"10.48550/arxiv.2503.02175","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.02175","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CVPR , author =","venue":"ArXiv.org","work_id":"4548a9a9-bd0e-494e-95f0-11267ddd7a14","year":2025},"citing_paper":{"arxiv_id":"2605.00789","last_updated":"2026-05-01T17:11:39Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-05-01T17:11:39Z","title":"Make Your LVLM KV Cache More Lightweight","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-09T19:04:48.058450Z"},"links":{"cited_paper":"/paper/2503.02175","citing_paper":"/paper/2605.00789"},"observation_digest":"sha256:636d9a33b02c059f63f34cc7369db9e410c1faede88fdb727e650a769570f3fb","observation_id":"39164111-2608-4f09-b0f6-c36ce73aa20d","resolution":{"observed_at":"2026-05-09T19:05:10.202394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":"2503.02175","doi":"10.48550/arxiv.2503.02175","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.02175","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CVPR , author =","venue":"ArXiv.org","work_id":"4548a9a9-bd0e-494e-95f0-11267ddd7a14","year":2025},"citing_paper":{"arxiv_id":"2605.05899","last_updated":"2026-05-07T09:11:41Z","snapshot_observed_at":"2026-08-05T02:12:24.336765Z","submitted_at":"2026-05-07T09:11:41Z","title":"VisMMOE: Exploiting Visual-Expert Affinity for Efficient Visual-Language MoE Offloading","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T16:10:22.588945Z"},"links":{"cited_paper":"/paper/2503.02175","citing_paper":"/paper/2605.05899"},"observation_digest":"sha256:a02d21aa6468597ba309d0dbf8c2fecb6f5d849792d68a845f0b0d783b008a99","observation_id":"e2158895-ae9a-49ed-beb1-4838702cc90a","resolution":{"observed_at":"2026-05-11T16:36:06.803914Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02175","snapshot_observed_at":"2026-08-04T23:46:51.648153Z","title":"IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01644","last_updated":"2026-08-03T03:27:46Z","snapshot_observed_at":"2026-08-06T23:32:52.420159Z","submitted_at":"2026-08-03T03:27:46Z","title":"CRAFT: Compression via Recursive Adaptive Fusion of Video Tokens for Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T23:46:51.648153Z"},"links":{"cited_paper":"/paper/2503.02175","citing_paper":"/paper/2608.01644"},"observation_digest":"sha256:738443189d664421cdf8f0c87dc4899b19170c60cf2286e202662cd62c63324b","observation_id":"60ce3a48-5358-4e4a-b3e9-7352a90a19b5","resolution":{"observed_at":"2026-08-04T23:46:51.648153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02175","snapshot_observed_at":"2026-08-05T16:41:28.828746Z","title":"Divprune: Diversity-based visual token pruning for large multimodal models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03580","last_updated":"2026-08-04T12:34:46Z","snapshot_observed_at":"2026-08-07T14:30:48.062561Z","submitted_at":"2026-08-04T12:34:46Z","title":"SlimVLM: Sensitivity-aware Dynamic Structured Pruning with Adaptive Visual Token Selection for Efficient Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T16:41:28.828746Z"},"links":{"cited_paper":"/paper/2503.02175","citing_paper":"/paper/2608.03580"},"observation_digest":"sha256:5d163146e79bfa3698f9e78a7613c1cf5800c2f69d11c07bcffad92c79e1dad9","observation_id":"bee256a7-029f-46ec-9450-ba9fc1af794e","resolution":{"observed_at":"2026-08-05T16:41:28.828746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.02175/citation-record","integrity":"/paper/2503.02175/integrity","json":"/paper/2503.02175/citation-record.json","paper":"/paper/2503.02175"},"outbound":[],"paper":{"arxiv_id":"2503.02175","last_updated":"2025-04-01T19:02:04Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T20:46:09.097525Z","submitted_at":"2025-03-04T01:33:14Z","title":"DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2503.02175."}