{"as_of":"2026-08-09T23:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65279be3ad482ecdcbc2423de39ce75e9003602683515086c2de016950772f3a","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:26:51.082680Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25818/citation-record","integrity":"/paper/2607.25818/integrity","json":"/paper/2607.25818/citation-record.json","paper":"/paper/2607.25818"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-01T01:26:49.040376Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.040376Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:ad94a714317077db64dcd0ba9332ac4385b0326545a98e0bfe1c5c092bd4e9d9","observation_id":"217938a5-dc6f-48ae-827c-0359c6c2cb76","resolution":{"observed_at":"2026-08-01T01:26:49.040376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-01T01:26:49.087415Z","title":"Qwen2.5- vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.087415Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:76a419bd224a121193ea0899fcff41af03d39688cad66aba308f7c0e4bd7a583","observation_id":"7528e459-51df-42c7-a31f-d4efa9df8c32","resolution":{"observed_at":"2026-08-01T01:26:49.087415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-01T01:26:49.156022Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source mul- timodal models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.156022Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:8d5b1235c779bb79417c63382e6da0e5194a125db4723401226e0eb79bce9f44","observation_id":"ad930bb1-3186-4d39-9854-2e6770810ed4","resolution":{"observed_at":"2026-08-01T01:26:49.156022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:49.238362Z","title":"Improved baselines with visual instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.238362Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:734dab3cfc1257eb38e1fbedc55e0e5ce87007017d02dcd646a659711dfbb8b7","observation_id":"5d5d0b0c-a60c-43e7-b986-44de67cc35c9","resolution":{"observed_at":"2026-08-01T01:26:49.238362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:49.340707Z","title":"Internlm-xcomposer2-4khd: A pioneering large vision-language model handling resolutions from 336 pixels to 4k HD,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.340707Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:b371f0ddf022add846965395cedbc4723f77dd761406deaf78068fcb08eee231","observation_id":"93a0201b-11cc-43bf-8462-0143430e69f8","resolution":{"observed_at":"2026-08-01T01:26:49.340707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:49.457955Z","title":"Dynamicvit: Efficient vision transformers with dynamic token sparsification,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.457955Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:4de2be7e6045735b0d0c69d5a55da012d9ccf633c479b5b0c0899a764729d67f","observation_id":"b71d865e-e830-4d5c-be0f-d5489301de35","resolution":{"observed_at":"2026-08-01T01:26:49.457955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:49.568708Z","title":"An image is worth 1/2 tokens after layer 2: Plug-and-play inference acceleration for large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.568708Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:7c4c6b5482aa21b268c1c1a32fe057b7bd035c2daeabf95eed35e5e9ea9fbfd7","observation_id":"cd3b5f41-2a64-46c0-892e-1757334b3692","resolution":{"observed_at":"2026-08-01T01:26:49.568708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01818","last_updated":"2025-05-11T17:45:02Z","snapshot_observed_at":"2026-08-08T00:45:04.947316Z","submitted_at":"2024-12-02T18:57:40Z","title":"Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01818","snapshot_observed_at":"2026-08-01T01:26:49.636465Z","title":"Beyond text- visual attention: Exploiting visual cues for effective token pruning in VLMs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.636465Z"},"links":{"cited_paper":"/paper/2412.01818","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:f313447c24ef7b9840c4b6d87ceedc40b239e1ff8ea851dca6c68bb056f09b98","observation_id":"9cab3c0a-6146-49ac-bb56-15432c60c487","resolution":{"observed_at":"2026-08-01T01:26:49.636465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:49.706989Z","title":"Llava-prumerge: Adaptive token reduction for efficient large multi- modal models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.706989Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:e0b4426aabf699bfa417e79eb2ee954f356a33958b77668703f88ca2946916c8","observation_id":"a112fd40-00f6-496f-8688-8d9aafd0ea96","resolution":{"observed_at":"2026-08-01T01:26:49.706989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-07-06T14:06:56.291161Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09461","snapshot_observed_at":"2026-08-01T01:26:49.784716Z","title":"Token merging: Your vit but faster,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.784716Z"},"links":{"cited_paper":"/paper/2210.09461","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:362a033771fa5ab0d1dfd161edd0c4431a5df738253279340ae501baae4b3c80","observation_id":"7c065bb2-9e5c-4683-b1bc-ede02df0ad86","resolution":{"observed_at":"2026-08-01T01:26:49.784716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:49.905295Z","title":"Posprune: Visual token pruning with positional bias correction for efficient large vision-language models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.905295Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:8f6099d076fb4a947ccfe53e65e3043e660f2872feee3581a1a1f4167900687e","observation_id":"c97e9a89-208e-4001-aa30-80bb68a92d10","resolution":{"observed_at":"2026-08-01T01:26:49.905295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:49.982696Z","title":"Lifting the veil on visual information flow in mllms: Unlocking pathways to faster inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:49.982696Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:52d41ec9e4b34d03e3be022b2932ea0ff9f4566ad33862aca1e8d98fb36d354c","observation_id":"316f3fca-4fb2-48a5-858b-c012fe4dc4be","resolution":{"observed_at":"2026-08-01T01:26:49.982696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:50.106589Z","title":"FlashAttention: Fast and memory-efficient exact attention with IO-awareness,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.106589Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:6fe4643362008706efe2a93fbd09c518280969009d4e82bf71b2ceea57470514","observation_id":"118afd50-33ea-4771-a9a6-8be482a8e3bb","resolution":{"observed_at":"2026-08-01T01:26:50.106589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:50.149809Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.149809Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:302e6f09b58d6f5d37a710be12f76b4584fe1a204750b5e8babb7f8e71535048","observation_id":"6665121f-5166-40ef-b102-a58c734a063a","resolution":{"observed_at":"2026-08-01T01:26:50.149809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:50.225381Z","title":"Divprune: Diversity-based visual token pruning for large multimodal models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.225381Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:b9649aaadae4a8ef63f964aa1fb282df6c34d98c80609c6e54fd6851023fc17e","observation_id":"667132df-c368-4c32-be2d-392c405d5b41","resolution":{"observed_at":"2026-08-01T01:26:50.225381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11494","last_updated":"2025-06-08T08:35:58Z","snapshot_observed_at":"2026-08-08T00:45:20.646947Z","submitted_at":"2025-02-17T06:56:28Z","title":"Stop Looking for Important Tokens in Multimodal Language Models: Duplication Matters More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11494","snapshot_observed_at":"2026-08-01T01:26:50.285248Z","title":"Stop looking for important tokens in multimodal language models: Duplication matters more,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.285248Z"},"links":{"cited_paper":"/paper/2502.11494","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:60bc1572dc06c3646f48a63645176d42a95939b783c5c5d40f1b69a0e9fe42d3","observation_id":"22b19c55-7038-416e-969c-d448915a52bb","resolution":{"observed_at":"2026-08-01T01:26:50.285248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:50.393243Z","title":"Fit and prune: Fast and training-free visual token pruning for multi-modal large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.393243Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:2197b83a1a9fe4646edc03474e2e3fa5bc12d0c8c1044d25ed48033f6491faff","observation_id":"21f39751-262d-4fae-b297-1fc8abcb2b31","resolution":{"observed_at":"2026-08-01T01:26:50.393243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04417","last_updated":"2025-06-03T04:12:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-06T09:18:04Z","title":"SparseVLM: Visual Token Sparsification for Efficient Vision-Language Model Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04417","snapshot_observed_at":"2026-08-01T01:26:50.499048Z","title":"SparseVLM: Visual token sparsifi- cation for efficient vision-language model inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.499048Z"},"links":{"cited_paper":"/paper/2410.04417","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:5b9de457b13e924de5800e6865529b166211767cc0289c6348db616019a9244e","observation_id":"f836949a-bf70-4340-a192-55de70e61a77","resolution":{"observed_at":"2026-08-01T01:26:50.499048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10803","last_updated":"2024-11-16T13:45:33Z","snapshot_observed_at":"2026-08-08T00:44:00.494972Z","submitted_at":"2024-11-16T13:45:33Z","title":"Multi-Stage Vision Token Dropping: Towards Efficient Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10803","snapshot_observed_at":"2026-08-01T01:26:50.559182Z","title":"Multi-stage vision token dropping: Towards efficient multimodal large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.559182Z"},"links":{"cited_paper":"/paper/2411.10803","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:cea75378ecaacd76630ac3aa9e76d64115eedad9ed7a81b136f436133d8b7cf0","observation_id":"6d05624f-a8bc-480b-9d30-1829bd76b99e","resolution":{"observed_at":"2026-08-01T01:26:50.559182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17247","last_updated":"2025-02-27T11:16:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T17:59:53Z","title":"PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17247","snapshot_observed_at":"2026-08-01T01:26:50.663785Z","title":"Pyra- middrop: Accelerating your large vision-language models via pyramid visual redundancy reduction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.663785Z"},"links":{"cited_paper":"/paper/2410.17247","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:d71f7df5b34dce37fa05eb15c07eb1ae4d0fbef75cc03339871bdadd688a9919","observation_id":"cee6e4c2-79fe-4b23-92b7-0362ca803d9b","resolution":{"observed_at":"2026-08-01T01:26:50.663785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:50.773014Z","title":"Hired: Attention-guided token dropping for efficient inference of high-resolution vision-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.773014Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:c020c23cef4ce52527a3f53ed0d58b75a2ce2f1231fa291e8be2e982add4a7d7","observation_id":"14a3eb1d-4fd8-4404-890d-7579fff8c686","resolution":{"observed_at":"2026-08-01T01:26:50.773014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10967","last_updated":"2025-07-01T08:19:08Z","snapshot_observed_at":"2026-08-08T17:11:06.528222Z","submitted_at":"2025-06-12T17:59:09Z","title":"Beyond Attention or Similarity: Maximizing Conditional Diversity for Token Pruning in MLLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10967","snapshot_observed_at":"2026-08-01T01:26:50.833164Z","title":"Beyond attention or similarity: Maximizing conditional diversity for token pruning in mllms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.833164Z"},"links":{"cited_paper":"/paper/2506.10967","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:0ad1f9b3f973fa554ca3961103264f8b6ad0aa1e122009649239071cb95016f9","observation_id":"d99230ee-52b9-41a9-911f-f0300818985a","resolution":{"observed_at":"2026-08-01T01:26:50.833164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:26:50.941399Z","title":"Filter, cor- relate, compress: Training-free token reduction for mllm acceleration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.941399Z"},"links":{"citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:81327f9a8b7a84e4b2ddacba11565e074e59370b9d7995e57866d87bacff5be2","observation_id":"76b05607-c089-4c72-95e8-7ae858aa0116","resolution":{"observed_at":"2026-08-01T01:26:50.941399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-01T01:26:50.999520Z","title":"RoFormer: Enhanced transformer with rotary position embedding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:50.999520Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:b50829274bdb41a7fe723738a9f8afd21b7909b7a4c7c8a454aee396dc6ec0a7","observation_id":"988d8154-1321-4fe3-bc40-6b36996c66b8","resolution":{"observed_at":"2026-08-01T01:26:50.999520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13180","last_updated":"2025-07-31T22:51:46Z","snapshot_observed_at":"2026-08-08T00:47:16.263621Z","submitted_at":"2024-12-17T18:56:50Z","title":"Feather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13180","snapshot_observed_at":"2026-08-01T01:26:51.082680Z","title":"Feather the throttle: Revisiting visual token pruning for vision-language model acceleration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T01:26:51.082680Z"},"links":{"cited_paper":"/paper/2412.13180","citing_paper":"/paper/2607.25818"},"observation_digest":"sha256:e0129afdacb687e4b0fbaed5b313b1ff61c181c529f9c3bd88a59ffe4af3300a","observation_id":"98243ab9-77d3-4036-b55f-56c5d3ae6542","resolution":{"observed_at":"2026-08-01T01:26:51.082680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25818","last_updated":"2026-07-28T15:01:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T17:11:46.682074Z","submitted_at":"2026-07-28T15:01:02Z","title":"SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2607.25818."}