{"as_of":"2026-08-07T21:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa9e8bc3cba610a8c4ab8b129e96291753db39602751a28447773b2a9c5ad9a4","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:09:11.183706Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00479/citation-record","integrity":"/paper/2506.00479/integrity","json":"/paper/2506.00479/citation-record.json","paper":"/paper/2506.00479"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:02.555774Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:02.555774Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:7835bb741b3423bc559f627b74bf004e7329e23d2cec6404e0ab21837b55567c","observation_id":"f56fb0a5-7b6a-458d-b587-2c0220979ec5","resolution":{"observed_at":"2026-08-07T12:09:02.555774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:15.366430Z","title":null,"venue":null,"work_id":"621b4970-70b2-45b8-8c43-33cd551a570d","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:02.625316Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:751e5c598c026c83505acd0ccbcd2ba91bc0b3459e008f9f8e907182838e86d9","observation_id":"9c26ac62-efaf-44e5-ad12-3cede73a7382","resolution":{"observed_at":"2026-08-07T12:09:15.475257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:15.204026Z","title":"Token merging: Your vit but faster","venue":null,"work_id":"9434fe28-2ee6-413c-bf83-0fe1b4c18af1","year":null},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:02.726098Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:aaf919eaf87f888f6611055ddd662ce1f297238a4bc3ac264553ed4b2576cb50","observation_id":"00b19a81-e497-47b2-83de-74d6d022971c","resolution":{"observed_at":"2026-08-07T12:09:15.296765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16236","last_updated":"2025-07-03T06:59:56Z","snapshot_observed_at":"2026-08-04T14:59:50.724834Z","submitted_at":"2024-10-21T17:41:28Z","title":"LLaVA-KD: A Framework of Distilling Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16236","snapshot_observed_at":"2026-08-07T12:09:02.820442Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:02.820442Z"},"links":{"cited_paper":"/paper/2410.16236","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:acc076ada30bc0ffb500b96b9bf62986e53cd586e7ae0a7cf2ddad413b8f5355","observation_id":"f7e81d51-b139-4664-b78c-65b990cad2b3","resolution":{"observed_at":"2026-08-07T12:09:02.820442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-07T12:09:02.889790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:02.889790Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:c3876c8a1517386795501c1117b46eaa444c43b4b796799b4afedf65bbfc0762","observation_id":"9919307c-5500-4ba4-983b-81b8f588db1e","resolution":{"observed_at":"2026-08-07T12:09:02.889790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:15.041133Z","title":null,"venue":null,"work_id":"c665ab7e-9147-4e01-8629-4dc6ee70c31d","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:02.990085Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:5ba7ec63e94bc3c4179338d503b095b43a3e3d549b91098315b0ecf40c94e9d6","observation_id":"b45c0c22-95bf-467a-9f2e-a61f2e07b3b5","resolution":{"observed_at":"2026-08-07T12:09:15.127558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11684","last_updated":"2024-06-17T07:55:59Z","snapshot_observed_at":"2026-07-06T17:31:53.996417Z","submitted_at":"2024-02-18T19:26:49Z","title":"ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11684","snapshot_observed_at":"2026-08-07T12:09:03.093897Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.093897Z"},"links":{"cited_paper":"/paper/2402.11684","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:1924e68aa6ec350b278e298f67bf4da380b584272598ff903a86dae85782422f","observation_id":"67d9685b-6d5b-432a-a3e2-9e6eb2243803","resolution":{"observed_at":"2026-08-07T12:09:03.093897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:14.866048Z","title":null,"venue":null,"work_id":"ecad87f7-396a-4e5e-a6fb-d0c2369f0eb6","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.191048Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:b96934e59d3fc57f6ecc7df4beb7c72dc5fac1df027e770475c8015dea20adeb","observation_id":"ffc00c09-4437-4a0a-9da6-f8bc35463f43","resolution":{"observed_at":"2026-08-07T12:09:14.934095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-07T12:09:03.262385Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.262385Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:3e419a7d09daf15470901493e8f53bb381f4f141498e8cc8d2cad48f0b408d02","observation_id":"311932d2-583b-4b36-bfe5-d64663fbeb51","resolution":{"observed_at":"2026-08-07T12:09:03.262385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-07T12:09:03.377456Z","title":"Lawrence Zitnick","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.377456Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:a6b1c19d03e3e92d5f5a357db49f425ded41a9fa7df2970cb33611b0f9757e15","observation_id":"5440017d-14d2-4a21-9b9c-d8b6c051913e","resolution":{"observed_at":"2026-08-07T12:09:03.377456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T12:09:03.480920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.480920Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:a691dc5e2d458c56be2ec5e971f62509733b25d8fbf5bd317075065458ca4e71","observation_id":"45b1c30d-60b4-4e2d-9249-f678a1b45626","resolution":{"observed_at":"2026-08-07T12:09:03.480920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-07T12:09:03.581061Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.581061Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:57492e4af51b87d7f87b9f03c9206bba285a13e63e69057423f06f26ce7d91df","observation_id":"3aa2728d-3fec-4f78-a294-8fad8b760c77","resolution":{"observed_at":"2026-08-07T12:09:03.581061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:03.678517Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.678517Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:5950c18f99b9056ff67fa831647e8c9e4dba73c610ca2b6ead41e010301f61af","observation_id":"ea5b6afa-9964-43cb-adf9-cc7da093ce47","resolution":{"observed_at":"2026-08-07T12:09:03.678517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:14.708520Z","title":null,"venue":null,"work_id":"a56e8196-563c-4ef2-be16-6d96010639db","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.742644Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:e9ee34c162fabbc80e75cca2d1b8342e41e087d216dd2600c0b3a8e8897cad02","observation_id":"cfa5ad37-f96d-4625-a669-331cb7de822c","resolution":{"observed_at":"2026-08-07T12:09:14.762241Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:14.552075Z","title":null,"venue":null,"work_id":"753eb2d9-3384-4ca3-9db3-9fb48d6e71c2","year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.840614Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:87f9a3468e9d8755fad4ef8f04bde438537950b609b7e869e2ff7040d0a83354","observation_id":"f1e9f16a-d582-48eb-b18c-fde23eb30dc1","resolution":{"observed_at":"2026-08-07T12:09:14.650554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17146","last_updated":"2024-12-05T14:28:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-25T17:59:51Z","title":"Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17146","snapshot_observed_at":"2026-08-07T12:09:03.945148Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:03.945148Z"},"links":{"cited_paper":"/paper/2409.17146","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:01ec60f8ddd895672add101a5a4880ca340d18948a1e32dffb270e179de08e80","observation_id":"58ca255d-2b00-4c9e-8cb7-7068e9f27fc1","resolution":{"observed_at":"2026-08-07T12:09:03.945148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:04.041916Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.041916Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:3a8bbb6dd9255b6fef8be21e67fb39b6c086e4c396c1097751bbaa9104bd1b2b","observation_id":"aab7c8d1-1eb8-462b-a3ac-f2e7918ed958","resolution":{"observed_at":"2026-08-07T12:09:04.041916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-07T12:09:04.142316Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.142316Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:63a44206c7103739256dcbfdc18dc0bba379b3cce7a64f5b3bdf6b2611475331","observation_id":"33196863-26c8-45e1-8c32-b3d57eb5a418","resolution":{"observed_at":"2026-08-07T12:09:04.142316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-07T12:09:04.217760Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.217760Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:16d867a14cedbca7220467046e6f7f506023bf08b22a4815e16723a79103e848","observation_id":"12fb0c08-b472-4d86-9027-a4accd4e0e3e","resolution":{"observed_at":"2026-08-07T12:09:04.217760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:14.374267Z","title":null,"venue":null,"work_id":"f40f08c2-a174-476b-a492-cf7ab3830754","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.308813Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:e77ce2ed95c2919dce46769beb8d8a94323e80d0196519af48bf7ba79125d528","observation_id":"657c798b-fb57-45c1-944a-7d1ac31829db","resolution":{"observed_at":"2026-08-07T12:09:14.452893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:04.402199Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.402199Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:a403fbca4cb726071778cddf6320eb30e4ad7118f9ba40e1a530ccafd7069958","observation_id":"75f8cb19-397f-4d05-a1cd-aa2bfdcfb978","resolution":{"observed_at":"2026-08-07T12:09:04.402199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00876","last_updated":"2025-03-21T13:30:33Z","snapshot_observed_at":"2026-08-06T17:48:57.425700Z","submitted_at":"2024-12-01T16:32:31Z","title":"Dynamic-LLaVA: Efficient Multimodal Large Language Models via Dynamic Vision-language Context Sparsification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00876","snapshot_observed_at":"2026-08-07T12:09:04.476990Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.476990Z"},"links":{"cited_paper":"/paper/2412.00876","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:156b6e9a9cc4f1295eb9ddcec510f8dba5c6a792c2cfcfc5909cd285c892ed74","observation_id":"e2cfb951-d60c-40ed-a503-e003e29d048e","resolution":{"observed_at":"2026-08-07T12:09:04.476990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:04.564617Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.564617Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:3b5f8fe6be34336db8e67cc8ec03dfc1259cdde1e00ed89e67fa5400d1fdc0bc","observation_id":"b0975858-64f8-4524-9445-65932fa0b3a0","resolution":{"observed_at":"2026-08-07T12:09:04.564617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1603.07396","last_updated":"2016-03-24T00:02:58Z","snapshot_observed_at":"2026-08-07T19:22:55.853637Z","submitted_at":"2016-03-24T00:02:58Z","title":"A Diagram Is Worth A Dozen Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.07396","snapshot_observed_at":"2026-08-07T12:09:04.693367Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.693367Z"},"links":{"cited_paper":"/paper/1603.07396","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:ed526eb6aa0b0beac273502dbcaec4188a1ffa12dd1823f1b82416e7739e30f9","observation_id":"d56bc46e-ef93-4f45-a84a-fe0b108909f6","resolution":{"observed_at":"2026-08-07T12:09:04.693367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:04.758019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.758019Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:47cff2f024c566094a3729b1edc361a9bcbaf31f67799e7e6544b707573a0249","observation_id":"50b7079d-2a18-4360-bdc5-d780251ed9af","resolution":{"observed_at":"2026-08-07T12:09:04.758019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T12:09:04.816245Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.816245Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:f301c3dea1910327f63aa5f8adf793064880b081805ca9cc4e7dcfc326c207e3","observation_id":"8d6e7b60-b348-4a02-ae26-27e5859a82b9","resolution":{"observed_at":"2026-08-07T12:09:04.816245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02392","last_updated":"2024-08-28T08:49:57Z","snapshot_observed_at":"2026-07-06T18:40:22.951929Z","submitted_at":"2024-07-02T16:10:55Z","title":"TokenPacker: Efficient Visual Projector for Multimodal LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02392","snapshot_observed_at":"2026-08-07T12:09:04.930789Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:04.930789Z"},"links":{"cited_paper":"/paper/2407.02392","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:6a7bdf9121a7ddd67dcf01630f9decf44d096e07c3618431d2b250d85d77b099","observation_id":"9f5a24b9-6c20-4983-ad8f-d9e2bcdde671","resolution":{"observed_at":"2026-08-07T12:09:04.930789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-07T12:09:05.032000Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:05.032000Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:283bddda4efc611a4292328d645c88a8050f27181947d8794da53c1332cb7676","observation_id":"aa089c92-f5ec-4752-a6ee-208d7d71c1ab","resolution":{"observed_at":"2026-08-07T12:09:05.032000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-07-06T18:03:55.981890Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-08-07T12:09:05.132509Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:05.132509Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:273f046cb8eddf95402614610d53ad065be39d6820307fba75f7a3bf35588e51","observation_id":"8986123c-c5a2-47e1-8ac1-afc60ddea231","resolution":{"observed_at":"2026-08-07T12:09:05.132509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-07T15:49:03.741523Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04921","snapshot_observed_at":"2026-08-07T12:09:05.297228Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:05.297228Z"},"links":{"cited_paper":"/paper/2505.04921","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:9c27f810cecff518bef96eccad78290c8ffc620af59ca5fa8524ddc53b34b377","observation_id":"ac921fad-726d-400e-9f44-58e6cc0506de","resolution":{"observed_at":"2026-08-07T12:09:05.297228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:05.435659Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:05.435659Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:f68b460e2ac08efc69d05451410c356a9d5fcff63b1e503b207e8d30e99e2caf","observation_id":"02c49dd8-33eb-4ec9-a29d-e2a95d0a0a75","resolution":{"observed_at":"2026-08-07T12:09:05.435659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:14.151812Z","title":null,"venue":null,"work_id":"9707554f-59da-43e1-9f44-436fb2f8280a","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:05.571066Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:955008aace5592a79b5af7b178b8c60e2173c4485cdd705c4cf8606de77fc622","observation_id":"0ef4e4e5-e58d-454d-a874-6e12eace66a4","resolution":{"observed_at":"2026-08-07T12:09:14.241806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:14.001603Z","title":null,"venue":null,"work_id":"2f238552-bb2c-4835-b75d-acf58c8ed7aa","year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:05.709115Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:f760efb0301ceb99e321a9fb538776abad5a95b114527f07f9f653b35b945826","observation_id":"e919dc04-8a62-40d2-95b5-9f6c2a07ce50","resolution":{"observed_at":"2026-08-07T12:09:14.074837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-07T12:09:05.822627Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:05.822627Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:799e3cfe8e9994e2cefa7ce0e882c5a991aec3ec5e7baccf5b024a276553ea41","observation_id":"6c22fad2-d0f7-4780-8135-18e990911e86","resolution":{"observed_at":"2026-08-07T12:09:05.822627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:06.026445Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:06.026445Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:e062d2719d801a03746ecf4840f135d2f4bf3869a44de592b8e1aa6f68902d2d","observation_id":"b08b161d-24b7-43bf-8312-00c114ed167b","resolution":{"observed_at":"2026-08-07T12:09:06.026445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04468","last_updated":"2026-04-25T07:16:42Z","snapshot_observed_at":"2026-08-03T08:48:57.969106Z","submitted_at":"2024-12-05T18:59:55Z","title":"NVILA: Efficient Frontier Visual Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04468","snapshot_observed_at":"2026-08-07T12:09:06.218354Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:06.218354Z"},"links":{"cited_paper":"/paper/2412.04468","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:353bc18d3e9c6773f67ff086568ff484f50cf42dbd12b2ac66e4c5eba1522d02","observation_id":"df08e76c-feda-4625-aff8-133bf071001d","resolution":{"observed_at":"2026-08-07T12:09:06.218354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-05T16:51:32.094151Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-07T12:09:06.433177Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:06.433177Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:e5dabf5d0b06bfcb8bf3955b66cf59a492d0d65fd69fb23f175692a0884d3e90","observation_id":"11a2caad-c4de-467c-9a78-67ee2c14d35f","resolution":{"observed_at":"2026-08-07T12:09:06.433177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.818463Z","title":null,"venue":null,"work_id":"c152a96d-317c-452a-9a58-332b95c8400b","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:06.593994Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:3d805bb539d981ff17a93975f54545702fcd963564c5b07245496756722be774","observation_id":"eea8e480-f364-4e85-aa6d-19af943891c0","resolution":{"observed_at":"2026-08-07T12:09:13.912847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13859","last_updated":"2024-10-17T17:59:53Z","snapshot_observed_at":"2026-08-02T12:28:37.806189Z","submitted_at":"2024-10-17T17:59:53Z","title":"$\\gamma-$MoD: Exploring Mixture-of-Depth Adaptation for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13859","snapshot_observed_at":"2026-08-07T12:09:06.707034Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:06.707034Z"},"links":{"cited_paper":"/paper/2410.13859","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:92211985f48d142164e43c75746ad6af69c25bd484d78a93d26531efa0bf52d6","observation_id":"da8c2a85-2051-4c3e-bb92-342941a2ceda","resolution":{"observed_at":"2026-08-07T12:09:06.707034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-07T12:09:06.790342Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:06.790342Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:d9dbc3ea0ec0afc7f5eef31c7aebfed84be9427c4accc8757ea66f7f7c544a59","observation_id":"3259a21a-63af-4a58-8077-6b545e38a270","resolution":{"observed_at":"2026-08-07T12:09:06.790342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00398","last_updated":"2021-01-05T05:39:39Z","snapshot_observed_at":"2026-07-06T09:34:24.643148Z","submitted_at":"2020-07-01T11:37:40Z","title":"DocVQA: A Dataset for VQA on Document Images","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00398","snapshot_observed_at":"2026-08-07T12:09:06.849342Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:06.849342Z"},"links":{"cited_paper":"/paper/2007.00398","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:87658c1bdde4c6c77931b30bea0ae06c6f9fabf68635de5a22138f7b1f9181de","observation_id":"7e1f81cd-a1b2-4d68-b093-2d83107fdba0","resolution":{"observed_at":"2026-08-07T12:09:06.849342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:06.996816Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:06.996816Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:367b673e4d45b25928463a9a7d7b3b555e425ef5922c0cf258b3ec9c78362e40","observation_id":"62e0cd97-5876-42bb-a1f2-5ad3850420cf","resolution":{"observed_at":"2026-08-07T12:09:06.996816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.657367Z","title":null,"venue":null,"work_id":"79b40cdf-8484-41b5-9e9c-fa5728a86187","year":2025},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:07.153496Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:2f2628f1a2c160f288dc646eaab8c9f601df6d4528ba0e7046c6e57fa2466e30","observation_id":"7dad4a3b-d688-4838-bf69-4c55f5f51167","resolution":{"observed_at":"2026-08-07T12:09:13.744307Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06708","last_updated":"2025-05-10T17:15:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-10T17:15:49Z","title":"Gated Attention for Large Language Models: Non-linearity, Sparsity, and Attention-Sink-Free","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06708","snapshot_observed_at":"2026-08-07T12:09:07.284810Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:07.284810Z"},"links":{"cited_paper":"/paper/2505.06708","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:b9a48add57dd858d30a97f6556e8da34ead6921b358f755010eb76944afda43c","observation_id":"b29b7b36-0969-493b-b45d-fef4ece0c31a","resolution":{"observed_at":"2026-08-07T12:09:07.284810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:07.427986Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:07.427986Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:88bb6e04d3a9e3820981b1815bdfd2691eac495b8c222080ecd33f6dde25a4bf","observation_id":"4aa1e786-45bd-4b27-be5b-431ff7de85b1","resolution":{"observed_at":"2026-08-07T12:09:07.427986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15881","last_updated":"2024-10-23T09:52:23Z","snapshot_observed_at":"2026-08-05T18:22:08.247118Z","submitted_at":"2024-08-28T15:52:23Z","title":"LLaVA-MoD: Making LLaVA Tiny via MoE Knowledge Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15881","snapshot_observed_at":"2026-08-07T12:09:07.514859Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:07.514859Z"},"links":{"cited_paper":"/paper/2408.15881","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:055c5b860ceedfb0e330674ed0359243c6c7c894067358b7f25fe43f0a231f4a","observation_id":"02e740a3-e6a5-40af-9e5b-e2df760632d3","resolution":{"observed_at":"2026-08-07T12:09:07.514859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:07.618949Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:07.618949Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:d0868ca6ce8802547f35cf2cb38cf4dcc01c3f47f0399b99cf59a4225e633767","observation_id":"87806932-2c6b-47b2-b480-14688314a791","resolution":{"observed_at":"2026-08-07T12:09:07.618949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16449","last_updated":"2024-03-09T06:43:37Z","snapshot_observed_at":"2026-08-05T04:26:02.499259Z","submitted_at":"2023-07-31T07:15:45Z","title":"MovieChat: From Dense Token to Sparse Memory for Long Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16449","snapshot_observed_at":"2026-08-07T12:09:07.794518Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:07.794518Z"},"links":{"cited_paper":"/paper/2307.16449","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:e9cd08db26703c5a31cefe8800c27b48f4af12e02606c95f757d57de3530aaf8","observation_id":"2042abbd-d90d-445f-9c54-2a82c3e8af38","resolution":{"observed_at":"2026-08-07T12:09:07.794518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-07T12:09:07.878549Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:07.878549Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:9ac8570eb314a21baae0e15a5bae474795a06ca56d2c4970ade9fa944e224525","observation_id":"0195c9a1-0b52-4e98-9abe-f1bd09faac68","resolution":{"observed_at":"2026-08-07T12:09:07.878549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02998","last_updated":"2024-01-26T18:45:29Z","snapshot_observed_at":"2026-08-03T18:42:27.648911Z","submitted_at":"2023-10-04T17:34:00Z","title":"ECoFLaP: Efficient Coarse-to-Fine Layer-Wise Pruning for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02998","snapshot_observed_at":"2026-08-07T12:09:08.047002Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:08.047002Z"},"links":{"cited_paper":"/paper/2310.02998","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:39f081a8f063d11f0ad04ee509a6003d1dd4343bd732ea9a33a7b55baa49291b","observation_id":"344b9015-776b-4c94-affa-9a911504e288","resolution":{"observed_at":"2026-08-07T12:09:08.047002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T12:09:08.160820Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:08.160820Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:52d3d4e582d0447b0f9cd7c864741f357368f0b08f169f7fbb109b69422746a1","observation_id":"9ff81832-14f7-450c-886e-1bde2af39fc9","resolution":{"observed_at":"2026-08-07T12:09:08.160820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:08.269554Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:08.269554Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:0778b6f1a19a0aa5d863704b7bfd46caedde9ea99ce3a74cfa4e4f8951cd7397","observation_id":"30e50b78-3da5-4559-898c-61b8cf554435","resolution":{"observed_at":"2026-08-07T12:09:08.269554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05935","last_updated":"2023-04-01T10:00:35Z","snapshot_observed_at":"2026-08-07T11:26:39.139402Z","submitted_at":"2022-12-07T10:09:49Z","title":"Hierarchical multimodal transformers for Multi-Page DocVQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05935","snapshot_observed_at":"2026-08-07T12:09:08.417275Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:08.417275Z"},"links":{"cited_paper":"/paper/2212.05935","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:c72ee1efef73f13ec779a7eaf015d910a958d4ebd87250816e6cb831b4bb4bbd","observation_id":"b72f363f-e7cc-4bdb-8aae-8c7ab167779e","resolution":{"observed_at":"2026-08-07T12:09:08.417275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23317","last_updated":"2024-10-29T20:04:34Z","snapshot_observed_at":"2026-08-02T02:59:04.120462Z","submitted_at":"2024-10-29T20:04:34Z","title":"VL-Cache: Sparsity and Modality-Aware KV Cache Compression for Vision-Language Model Inference Acceleration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23317","snapshot_observed_at":"2026-08-07T12:09:08.527752Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:08.527752Z"},"links":{"cited_paper":"/paper/2410.23317","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:0918def4890c37e89d75be23a10e2c403b172b81be8aa953f070e795df548609","observation_id":"90c47060-c235-431c-96c6-da62c80e40bc","resolution":{"observed_at":"2026-08-07T12:09:08.527752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.469723Z","title":null,"venue":null,"work_id":"8800cbdb-cfa0-4934-a961-10416e5d45a6","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:08.688896Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:26370086ae5bd86c252e52af3492ebec9d91a2fb856a552c86a03f7a84ef8c0f","observation_id":"90f8f698-5f3e-49dd-8346-83e0e5bd9760","resolution":{"observed_at":"2026-08-07T12:09:13.559711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T12:09:08.800886Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:08.800886Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:73c37fb304cff8f0328028b4939ba6c236b6a85c05f1e1e54e53a238f28506d6","observation_id":"f3044e37-f678-4b5a-984e-4f836446bc1a","resolution":{"observed_at":"2026-08-07T12:09:08.800886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.298785Z","title":null,"venue":null,"work_id":"42f77fd1-fbc6-433d-a50b-f4e8810b145b","year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:08.926829Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:1cb77d82f7ee51f273e2dbcdbe4d577809812a0e4f79f6b79ba78dff0ec815a3","observation_id":"1711006d-f79b-4188-815e-2e6908de78ed","resolution":{"observed_at":"2026-08-07T12:09:13.360928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13199","last_updated":"2024-12-10T02:55:21Z","snapshot_observed_at":"2026-08-02T13:47:04.653314Z","submitted_at":"2024-09-20T04:03:27Z","title":"CFSP: An Efficient Structured Pruning Framework for LLMs with Coarse-to-Fine Activation Information","version":2},"cited_work":{"arxiv_id":"2409.13199","doi":"10.48550/arxiv.2409.13199","metadata_source":"pith","pith_arxiv_id":"2409.13199","snapshot_observed_at":"2026-08-07T18:16:16.850658Z","title":"CFSP: An Efficient Structured Pruning Framework for LLMs with Coarse-to-Fine Activation Information","venue":"cs.CL","work_id":"0950385f-e743-4e94-92fb-030cbe9dcfd1","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:09.062426Z"},"links":{"cited_paper":"/paper/2409.13199","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:da14911c0d1357a89d21fa7f4a945985ed1f97037624fc9640aac766dc367cdb","observation_id":"3defe7bf-cf5e-49c7-8324-460f89e2e9a0","resolution":{"observed_at":"2026-08-07T12:09:11.412685Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15033","last_updated":"2024-02-26T15:26:20Z","snapshot_observed_at":"2026-08-05T16:55:19.542695Z","submitted_at":"2023-05-24T11:18:00Z","title":"SmartTrim: Adaptive Tokens and Attention Pruning for Efficient Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15033","snapshot_observed_at":"2026-08-07T12:09:09.213401Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:09.213401Z"},"links":{"cited_paper":"/paper/2305.15033","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:5792c318b227b82e65ca6ae30682ccb528d67b82f3f2c0cb266fbd5760d2ce16","observation_id":"399bf6f5-25a4-4e1f-8613-2c2e36431556","resolution":{"observed_at":"2026-08-07T12:09:09.213401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.08723","last_updated":"2022-10-17T16:27:09Z","snapshot_observed_at":"2026-07-06T12:19:25.743466Z","submitted_at":"2021-12-16T09:21:18Z","title":"Distilled Dual-Encoder Model for Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":"2112.08723","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.08723","snapshot_observed_at":"2026-08-07T12:09:11.789944Z","title":"Distilled Dual-Encoder Model for Vision-Language Understanding","venue":"cs.CL","work_id":"f5198516-2426-4c6b-998e-4c081fe13468","year":2021},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:09.309361Z"},"links":{"cited_paper":"/paper/2112.08723","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:676a22bb41eefd9eed281d38349698f5af996b2edefab26ce04d62a4cbd11db4","observation_id":"02d43063-5dfa-4778-8c3a-a58d4b5a1cd2","resolution":{"observed_at":"2026-08-07T12:09:11.842112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.165205Z","title":"https://x.ai/blog/grok-1.5v Grok-1.5 vision preview","venue":null,"work_id":"1b5fa7f9-c4f1-40e6-9fa3-bbb39ad27e13","year":null},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:09.399595Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:66a1bcaedef1145c3a0a296da411a4de3b5f3f5dddc566c95465fe7cb7030bcf","observation_id":"15fb7c56-bd39-48f3-9a26-0a0acb1656b7","resolution":{"observed_at":"2026-08-07T12:09:13.215592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:12.996748Z","title":null,"venue":null,"work_id":"ee422d35-ba48-48d7-8dae-2e23bb6dc338","year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:09.489451Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:e90ac97bc084efa5cd2e43ef6a5e27452d359ffe28b9fe1e6db76b01422b72b3","observation_id":"27c69028-80a4-487e-94fb-5e1f195dfea1","resolution":{"observed_at":"2026-08-07T12:09:13.071841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:12.778711Z","title":"McAuley, and Furu Wei","venue":null,"work_id":"bddda0ae-41a9-4252-8a4f-a81c6a241df8","year":2021},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:09.615671Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:558c0447110f6b26b3a5e01a26fd99909c42a2a118f751def97a824d740e9c67","observation_id":"58a8b3e5-1e7e-43d0-8ef3-2fef8cc8e629","resolution":{"observed_at":"2026-08-07T12:09:12.876667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04454","last_updated":"2025-05-05T16:17:20Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:58:26Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04454","snapshot_observed_at":"2026-08-07T12:09:09.701180Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:09.701180Z"},"links":{"cited_paper":"/paper/2412.04454","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:56805ba376745b725b61b155e302aedcf58402901b5b23e3dba8ba70e6d9d7fd","observation_id":"c2ca67bb-415e-46f5-98e8-32e0ef0a2cc3","resolution":{"observed_at":"2026-08-07T12:09:09.701180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21018","last_updated":"2025-02-27T12:30:43Z","snapshot_observed_at":"2026-08-02T14:11:02.770149Z","submitted_at":"2024-07-30T17:59:08Z","title":"ThinK: Thinner Key Cache by Query-Driven Pruning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21018","snapshot_observed_at":"2026-08-07T12:09:09.833693Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:09.833693Z"},"links":{"cited_paper":"/paper/2407.21018","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:e800ba5b6fb0b378c48d4ffdbaad7903a819b514aa6b2a8101780be28c15ab44","observation_id":"4ba0e51a-3a24-43a1-a20c-9cccf4b082c0","resolution":{"observed_at":"2026-08-07T12:09:09.833693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:09.933170Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:09.933170Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:fb92f0c111afd1a33d3db8bb991c4dff296766c88c713332ed92fcce8202717a","observation_id":"2420936d-638a-4630-8d16-5e4ab2adae8c","resolution":{"observed_at":"2026-08-07T12:09:09.933170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-07T12:09:10.058321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:10.058321Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:fc56d36eb87ea176d9b2b376c23035117574ddf47ea4b49c58c1a3d0f9b751cc","observation_id":"cd372c72-0a39-4af6-b4f3-f4bd6e731079","resolution":{"observed_at":"2026-08-07T12:09:10.058321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00425","last_updated":"2025-08-10T04:13:03Z","snapshot_observed_at":"2026-08-03T13:46:15.251113Z","submitted_at":"2025-02-01T13:08:02Z","title":"MQuant: Unleashing the Inference Potential of Multimodal Large Language Models via Full Static Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00425","snapshot_observed_at":"2026-08-07T12:09:10.222780Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:10.222780Z"},"links":{"cited_paper":"/paper/2502.00425","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:f5cb2c6e0cc694d031a156610619f95b12115084b6217231154dd332acc6241c","observation_id":"d3466021-9e02-4e90-a8f3-43e92a6c9323","resolution":{"observed_at":"2026-08-07T12:09:10.222780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-06T13:03:19.727877Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-07T12:09:10.352718Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:10.352718Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:089f1dac609bc32e95109e8262f1356f7605cf8ea5eb78a65beb02b4e99bbc43","observation_id":"cb5ab091-1f00-4d56-95e7-a340c096b845","resolution":{"observed_at":"2026-08-07T12:09:10.352718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:12.650914Z","title":null,"venue":null,"work_id":"791d6670-5cb5-43e5-8e2d-1e6048263992","year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:10.533866Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:a737c7db4710513048714a8028701b709853b72a1a3ca96fa414598c8566a3a6","observation_id":"0716cfb9-65bc-4e23-b196-aee7c58bf29d","resolution":{"observed_at":"2026-08-07T12:09:12.700814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12772","last_updated":"2025-05-05T04:48:45Z","snapshot_observed_at":"2026-07-06T18:47:56.109836Z","submitted_at":"2024-07-17T17:51:53Z","title":"LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12772","snapshot_observed_at":"2026-08-07T12:09:10.660378Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:10.660378Z"},"links":{"cited_paper":"/paper/2407.12772","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:f2e069dd32c2599ace8322d3a57b78b33ee51fc572bd88ea4790c80b37e6d710","observation_id":"f780789c-d041-484f-bd98-f944e3e6b659","resolution":{"observed_at":"2026-08-07T12:09:10.660378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04417","last_updated":"2025-06-03T04:12:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-06T09:18:04Z","title":"SparseVLM: Visual Token Sparsification for Efficient Vision-Language Model Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04417","snapshot_observed_at":"2026-08-07T12:09:10.744371Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:10.744371Z"},"links":{"cited_paper":"/paper/2410.04417","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:64673e5a334331ffb776c071745704c69056603c6afd8aa107d2edfa4e167467","observation_id":"97b22696-2756-4685-ae74-3a29949828a3","resolution":{"observed_at":"2026-08-07T12:09:10.744371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:10.817353Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:10.817353Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:7f73996753c16d08c2dc460d25d6cd5b46c51507df35b3e62c9e46249b05dcb6","observation_id":"bb8c964a-432a-40f2-9bca-4d568890cac7","resolution":{"observed_at":"2026-08-07T12:09:10.817353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:12.380936Z","title":null,"venue":null,"work_id":"b26707b5-e0d8-4ea0-8c57-5d233a05b3a3","year":2023},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:10.928602Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:d23d1e7da01edf05ac89f8cbabbd6269ba084ff0f2074978f2d154d7fc4dc010","observation_id":"414ddd8c-4421-4a6c-a269-d323efcd4fb9","resolution":{"observed_at":"2026-08-07T12:09:12.491683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14289","last_updated":"2024-02-22T05:05:30Z","snapshot_observed_at":"2026-08-03T05:27:32.394774Z","submitted_at":"2024-02-22T05:05:30Z","title":"TinyLLaVA: A Framework of Small-scale Large Multimodal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14289","snapshot_observed_at":"2026-08-07T12:09:10.995545Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:10.995545Z"},"links":{"cited_paper":"/paper/2402.14289","citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:8e57aa309e1f648c09f6459c9e6ef78f1002a34331f72ae59fd743dd9bfca05e","observation_id":"aad67730-e1de-47b9-a1a6-e10607ef4bdf","resolution":{"observed_at":"2026-08-07T12:09:10.995545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:11.081816Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:11.081816Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:a54ed318d6a5208071e27899b1653ef01a9ea1c28f9fcf01e3c13d1d5f06d92b","observation_id":"b181ebe2-9374-4691-b35b-ad723169226f","resolution":{"observed_at":"2026-08-07T12:09:11.081816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:11.183706Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T12:09:11.183706Z"},"links":{"citing_paper":"/paper/2506.00479"},"observation_digest":"sha256:ed0c0eddb1a620884bb26af84ffa1faa5d96940f32ba971db43a5ec082b23f1c","observation_id":"898f31ce-4c8e-42e4-9173-a1ae1186bb00","resolution":{"observed_at":"2026-08-07T12:09:11.183706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00479","last_updated":"2025-05-31T09:10:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T12:02:00.195241Z","submitted_at":"2025-05-31T09:10:43Z","title":"EffiVLM-BENCH: A Comprehensive Benchmark for Evaluating Training-Free Acceleration in Large Vision-Language Models"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":72,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2506.00479."}