{"as_of":"2026-08-05T11:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0f39669ae0c388b68a52b2199995cb1c9a983b4cb626718d5f0efd71ed7ab9fa","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:15:04.261855Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.11240/citation-record","integrity":"/paper/2604.11240/integrity","json":"/paper/2604.11240/citation-record.json","paper":"/paper/2604.11240"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:adf5b898034c683ec196fc883b4b283f350fbc26e3f11f8598269305f2ed227e","observation_id":"26d2ee5c-dd3b-4590-912c-9c77c86c4100","resolution":{"observed_at":"2026-05-11T10:56:05.653290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2725704a-3e3f-443e-9386-9c74ee12e92e","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:1f1c1d4f705953502a1b6130f688c0092b4d74741dcfde5084e4e540f95b48a4","observation_id":"12606c43-2c01-4cba-91d0-7beedc222ef0","resolution":{"observed_at":"2026-05-18T05:32:26.234884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:0e45427f4a2705d54ba5ce64cf8161a9f5a0893c7a80457fc8b5728ba066b51b","observation_id":"78f65eb4-dbdc-4a0d-8843-36deccd11aef","resolution":{"observed_at":"2026-05-11T10:56:05.661973Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-07-06T14:06:56.291161Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"cited_work":{"arxiv_id":"2210.09461","doi":"10.48550/arxiv.2210.09461","metadata_source":"pith","pith_arxiv_id":"2210.09461","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token Merging: Your ViT But Faster","venue":"cs.CV","work_id":"528509bc-2611-4e7f-a772-ea14d25b6dae","year":2022},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2210.09461","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:085b04a8c143878e4c1dcc6b0751af4c876858f298298abedafafe2cbf4b0662","observation_id":"24e8f1f1-fda6-4d14-bb32-dcf413778c48","resolution":{"observed_at":"2026-05-12T20:52:10.541797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a12bcdd6-baea-49cc-8acd-b5d857db5328","year":2021},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:4497007489a1fb25757666574094f9905d24a32b01d93bb7e68cdbeb3e8e580e","observation_id":"55133d34-ca4b-48d2-8b65-a5833a23acdf","resolution":{"observed_at":"2026-05-18T05:32:26.262576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":"2306.13394","doi":"10.48550/arxiv.2306.13394","metadata_source":"pith","pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-07-10T13:27:05.561984Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","venue":"cs.CV","work_id":"806d2e73-71b3-4d56-87e0-39d571cc15d6","year":2023},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:1f2a2badc7885d90826b886a2c96795dacb420ddc2c2a356b3dbe8d323d55a7f","observation_id":"84d975dc-997c-4ca6-b601-c389879acad9","resolution":{"observed_at":"2026-05-11T10:56:05.639747Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c65bf320-e951-4094-af12-a100da061353","year":2011},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:6d598ee9825ed3dd41138057fcf7601089a229b8d65505cec0d11d85e8fac053","observation_id":"263d45d2-828f-4a94-8306-17591ff61de9","resolution":{"observed_at":"2026-05-18T05:32:26.182649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"217f5949-e371-4e99-98ab-626b60d6e9b8","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:9308f8d2d378ab7adaaf36315eb8bf4d1a5b4aba33362927600570b03bef1c7f","observation_id":"8709f90e-67a3-4e98-8d50-7d9ec89663bd","resolution":{"observed_at":"2026-05-18T05:32:26.168525Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"61b0ab9e-3de0-40e1-bc7c-7eff950b8fb6","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:f7f866bb21257d9832411661ec13bff01b8e9e17fd6b3fddde20d0219f61ac0e","observation_id":"ec340d01-26aa-4de5-a520-1e2cd718a29c","resolution":{"observed_at":"2026-05-18T05:32:26.199348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8966bec3-079d-4e06-8094-47e8766fe3e4","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:31c86117ac4a24632df5b545e503bf8f6b38d3538d2d4cf2dcd898d46b9a1454","observation_id":"859010a6-c759-43d0-a84c-b68e34739060","resolution":{"observed_at":"2026-05-18T05:32:26.195973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"41961e8c-2fcc-4a2e-abf9-c53676f9bf29","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:acb13991acd171d0aabbba05f8a639d987aaaa1da782c9f1e0bcf3dde6ac48b8","observation_id":"192c636b-f9fb-42c1-b8ef-0619906e2898","resolution":{"observed_at":"2026-05-18T05:32:26.215727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"feb9bec7-8791-49e1-847f-3b10d1a5867a","year":2023},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:0026b41174661c6113cc7107e13ed3d74e4db6fbc8f437edce12298581342125","observation_id":"80d22856-ee29-4ff0-88ab-4d3cfac571fa","resolution":{"observed_at":"2026-05-18T05:32:26.244970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2df58bf1-dad2-4bec-ac90-91423afb4f71","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:ea646be989054914abc7dca6a989e079fd69abc56abfd244433804ab3bee7fbd","observation_id":"979d5c1d-88f8-4afa-90e6-1ace4062cdb0","resolution":{"observed_at":"2026-05-18T05:32:26.221603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"196068d8-cd47-45d8-9ba8-b22207478569","year":2021},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:dfe327c365cb1e73480e3f1ba79a327223789824d8a6c7263c225f98d362bdd9","observation_id":"e50813f0-d658-4a4a-9dc3-780ddae743d0","resolution":{"observed_at":"2026-05-18T05:32:26.272120Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:01:39.219050Z","title":null,"venue":null,"work_id":"2c8fa9c4-4671-4028-950d-904016d1fcf6","year":null},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:a3dd01839ea20bf173372c36a163ca73029a78dda5fdae5c9136935eff917190","observation_id":"b76b5e8e-e2b1-434d-8038-3ac2733e5ee1","resolution":{"observed_at":"2026-05-18T05:32:26.176111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c63ddfc5-57e1-4094-ab16-58411a4a5763","year":null},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:57cdd1f6793896095df2b8f22c7f947c5ea72c751fee53adc3b87fa69c8d6539","observation_id":"23b83432-b963-4496-b4ea-761c54efc145","resolution":{"observed_at":"2026-05-18T05:32:26.206596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d8ff67ab-e277-4c22-bfa3-2a13bf5f21ac","year":2023},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:e70f0d82483c589ef2f4562f96f5d376fed5df60505c05d8967a477097d180bf","observation_id":"df078ab1-b998-468e-b940-92b035657f0f","resolution":{"observed_at":"2026-05-18T05:32:26.268768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"50a14434-ab73-4b83-b58c-fd0a687a68af","year":2018},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:c02b04ad17d71f2907d98a32428719407e0c38853ee2248ba2b7bfbc60382ddc","observation_id":"17f4b219-6272-48f4-8e69-b524119777f5","resolution":{"observed_at":"2026-05-18T05:32:26.224814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"38cd47b7-8b4f-495d-ba28-87010f2cd17e","year":2019},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:79897fdcb0d698b96f73be73e930f76f613fbd507c2c7e48f786efd4cc720e21","observation_id":"465a8e91-acdc-48c6-8bf8-ded159a8d900","resolution":{"observed_at":"2026-05-18T05:32:26.185886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6dfad9d9-93ad-4880-881c-44f0686428ef","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:1a2439d262f6d0dcc3cf2063d78af622106107a83ace97da1d9946f4fd57ebd4","observation_id":"031a6e45-fe2a-43d7-ab57-067182fc2f97","resolution":{"observed_at":"2026-05-18T05:32:26.254068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"798ad0a6-f38e-45ae-a58a-9f9fa8fe022a","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:2c6972edb34e83bba931a7fc78ebebd7c8ae478abc0c6f7dd034939be6c45b19","observation_id":"9010b584-1324-4632-8eda-a5d1fab32ee0","resolution":{"observed_at":"2026-05-18T05:32:26.173024Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"48d12017-508c-4010-bfd8-1bca1e535d9c","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:7c7b1fbe3c96c42b29b6a8fa7be00ba18f6e7d400e978ca47291acc8a407b00e","observation_id":"d19c70e8-8d0b-40c1-a66e-eda05e10c6d2","resolution":{"observed_at":"2026-05-18T05:32:26.165367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":"2305.10355","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-07-10T11:37:03.198858Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","venue":"cs.CV","work_id":"66d8ac3e-c134-4995-b528-550afa17586f","year":2023},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:047d16144e725f9160fa6245cec26c6309f7105e98d61959792db7265e3474f0","observation_id":"4f536046-d0ae-4e3a-a443-061da87f04f3","resolution":{"observed_at":"2026-05-11T13:44:10.072171Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-07-06T21:20:41.212212Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"cited_work":{"arxiv_id":"2505.04921","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.04921","snapshot_observed_at":"2026-07-08T02:44:28.049569Z","title":"Perception, reason, think, and plan: A survey on large multimodal reasoning models","venue":"cs.CV","work_id":"18ce98be-3cf0-4e03-b05f-ad32a6306ca2","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2505.04921","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:4ee49e69a11747c3c08192cee02572c55e9b2079ffedf8787edf36c5d00f3a5a","observation_id":"438d5b62-a28e-4181-bc8a-a59a304a203a","resolution":{"observed_at":"2026-05-11T10:56:05.744774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1429d9d6-5105-4fe2-9913-99a97e2a5578","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:831d7ad1077a6e99ad34196bd9478c09500aa9ffed9bf2b5145b59e3dd44eb6f","observation_id":"830d8c82-0e20-49fc-bec8-5e8da3624799","resolution":{"observed_at":"2026-05-18T05:32:26.158480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a4edbd4-4c7f-47aa-96a4-f2ffc4017f99","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:90da1da182a30c0a04f4801a210103c158f955c0ebf482a925bbee9f821da78a","observation_id":"9443083d-594e-4426-9db1-e6518ec52fe4","resolution":{"observed_at":"2026-05-18T05:32:26.241727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a406d9d-a4cf-46bd-aedc-cd6263eb9050","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:b4b18624299964c72027df8ba5f0e8f6e25b6610b6d9c32f5c8110673edf4452","observation_id":"6f320fc3-3592-47d9-8ff2-5726f06b74e2","resolution":{"observed_at":"2026-05-18T05:32:26.189475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5bb06ad4-7008-4f92-9f13-ad81799d8f95","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:d16a055b8bcffc4f435cba8ed17f2179e8b833e807b75579d2b93325a5989f65","observation_id":"3e4073db-16ca-4a43-b2c2-8518d7acbffb","resolution":{"observed_at":"2026-05-18T05:32:26.192961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d605870d-7037-4e72-8975-82d74b862b30","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:2edab62e8f08fe8d21072b0fb59487b23b7890aeb0da8d12cbe5db0bc89f03e6","observation_id":"8b47a884-6f80-4972-b039-ce6db479222f","resolution":{"observed_at":"2026-05-18T05:32:26.259604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a46d51f-fec5-4d36-87c3-4633d5e43853","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:cc30b94acca17b56148cf574e3ba2c702a05103d33054180a0eb1528b225bafd","observation_id":"d9fb2c4b-d550-4394-9582-796e0542bfe5","resolution":{"observed_at":"2026-05-18T05:32:26.256741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"862eeea1-36e2-42f8-9ba6-8b1134489dfe","year":2022},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:685f594e87bb566c52fb6406925b70726507b2b11b4a1bcc8df988c395d67712","observation_id":"77501771-228b-4500-9ba9-4808e547685c","resolution":{"observed_at":"2026-05-18T05:32:26.265811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"28ef1c6c-b42a-48cb-83fa-69e2dbc1b033","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:537b089f2e497ab6a6cca919046fde6d946a857b3e21b1a21d6ad3b340b0cc73","observation_id":"24f655e4-6c6d-4761-8b6b-db46cc7f2874","resolution":{"observed_at":"2026-05-18T05:32:26.179567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b0b6fe60-2104-46d5-9f3c-b2247e4d2643","year":2019},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:40e285a4d9f3cf881d5e1e9cd538203a6fa5fc85d3439c5fe13982869bdddd40","observation_id":"2cd80e45-b2d0-46d4-98f9-aee5db2784d1","resolution":{"observed_at":"2026-05-18T05:32:26.238004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10994","last_updated":"2024-12-17T02:05:27Z","snapshot_observed_at":"2026-07-06T19:16:36.688367Z","submitted_at":"2024-09-17T08:56:27Z","title":"Less is More: A Simple yet Effective Token Reduction Method for Efficient Multi-modal LLMs","version":3},"cited_work":{"arxiv_id":"2409.10994","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.10994","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eff55ccf-a3a6-47f4-9569-7d6e1a16afee","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2409.10994","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:40357c01215b629a1f285fc1b8e2f05a869e9773894700512d9ca33ea9473d0c","observation_id":"b6892eaa-924d-4828-af34-43c1c7fce364","resolution":{"observed_at":"2026-05-11T10:56:05.735855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"516782de-f691-4b07-8aa5-18760839f6c9","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:c4718bfeed5266bcdb37e090923080a745e64e63cc824dda50fb1233d70a2c39","observation_id":"357e843d-1715-41b2-a283-3560785f6f7c","resolution":{"observed_at":"2026-05-18T05:32:26.218671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19536","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T10:15:45.200025Z","title":"Flowcut: Rethinking redundancy via information flow for efficient vision-language models","venue":null,"work_id":"d668fcb4-90a6-4964-a7c9-63eec5e1894c","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:fd23665ec5a304a6bfaef194e4f8a3939b78365a7cd573ccff1aa94f8b341494","observation_id":"8c4c8d3c-13bb-4fbe-9fcf-c2c550f0e26b","resolution":{"observed_at":"2026-05-11T10:56:05.700792Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"297c71e6-3e00-4fed-bf65-ef0449af0000","year":2017},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:8aef7d3e039095ce8b334076a5d4b6a0f93310846c3b50391f047867964f3d22","observation_id":"0c565e97-caf7-48fd-b950-cd4607024123","resolution":{"observed_at":"2026-05-18T05:32:26.231241Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bcd71f16-0168-4807-a266-4406a6394337","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:b91558a2382c5269cec7591275b218536af976ddfca6301d5cc99d549a14791c","observation_id":"85336059-7bd3-4b33-b598-3eaf1996f466","resolution":{"observed_at":"2026-05-18T05:32:26.203623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12386","last_updated":"2025-07-13T18:57:17Z","snapshot_observed_at":"2026-08-05T00:52:07.112592Z","submitted_at":"2025-01-21T18:59:00Z","title":"InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling","version":3},"cited_work":{"arxiv_id":"2501.12386","doi":"10.48550/arxiv.2501.12386","metadata_source":"pith","pith_arxiv_id":"2501.12386","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling","venue":"cs.CV","work_id":"5801b83f-d5f4-4020-bad2-4bc47f71fe7d","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2501.12386","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:9109681f24834ca23485bf8c1ab04b119203654b728a529a2c965505965c63e6","observation_id":"ba20b7fd-ddc6-422c-b8ae-4b189c29cccf","resolution":{"observed_at":"2026-05-17T02:52:20.835573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c9202d39-0b28-47ce-837f-dca8aaf0e502","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:f4fa18ed2ee521c982cf3289cea635866f2f85f54a9a84b79d7b9b572db62c79","observation_id":"2c443586-e453-4618-85c1-4b1818e30989","resolution":{"observed_at":"2026-05-18T05:32:26.209438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11501","last_updated":"2025-05-29T09:18:35Z","snapshot_observed_at":"2026-07-06T20:37:37.864423Z","submitted_at":"2025-02-17T07:05:36Z","title":"Token Pruning in Multimodal Large Language Models: Are We Solving the Right Problem?","version":2},"cited_work":{"arxiv_id":"2502.11501","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.11501","snapshot_observed_at":"2026-07-04T07:59:40.278596Z","title":"arXiv preprint arXiv:2502.11501 , year=","venue":null,"work_id":"e464475a-9870-43b1-8060-a9866dce6505","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2502.11501","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:afdd05dbdd7d0d1c31fb8f367675b5f93937892e0a51b9773daaca85eac8cd72","observation_id":"e205e0cd-ba2e-4345-9dee-10754d966920","resolution":{"observed_at":"2026-05-11T10:56:05.671079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Important Tokens","venue":null,"work_id":"fcee9443-5e95-4f53-a071-5a641cac47d0","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:227b58091461ffb588e3e374b83f9b34afa5d1b3958396515acf8094c87afe16","observation_id":"488ce761-1682-4d5b-a8bc-0db85ed79965","resolution":{"observed_at":"2026-05-18T05:32:26.212516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17247","last_updated":"2025-02-27T11:16:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T17:59:53Z","title":"PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction","version":2},"cited_work":{"arxiv_id":"2410.17247","doi":"10.48550/arxiv.2410.17247","metadata_source":"pith","pith_arxiv_id":"2410.17247","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction","venue":"cs.CV","work_id":"ca5cea36-45c6-4d00-8408-14876a5d59c3","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2410.17247","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:d9134dcabbf08addd7ad23fa024f5b2c3d11ab1e97ebc200e107becfb02607e0","observation_id":"bcc8370c-c9cd-43c5-b349-67ab5a7cd099","resolution":{"observed_at":"2026-05-15T12:12:14.835646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7eb80898-47d9-4008-ae69-b211af3f95d2","year":2016},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:ef8e19d8313dc6843eeb17d4df476a2ec59c962aa0c9e8890e2ae7ed34f66d86","observation_id":"4d9254a3-1396-481d-97bb-57d521837bbb","resolution":{"observed_at":"2026-05-18T05:32:26.228045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"75d16b90-cc94-4b2c-ae22-7241ceedb4c6","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:faa759ff59e6ef0e34f56ff52df69a64532c6a8d07183551b4f7b4613242f88b","observation_id":"e7c9f977-548d-4af2-8b71-1304d018a91b","resolution":{"observed_at":"2026-05-18T05:32:26.251211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20985","last_updated":"2024-05-31T16:31:38Z","snapshot_observed_at":"2026-08-04T13:01:39.904947Z","submitted_at":"2024-05-31T16:31:38Z","title":"DeCo: Decoupling Token Compression from Semantic Abstraction in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2405.20985","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20985","snapshot_observed_at":"2026-07-04T16:39:57.301173Z","title":"Deco: Decoupling token compression from semantic abstraction in multimodal large language models","venue":null,"work_id":"72b8bcdd-c399-4415-a8e7-ca6f24d31b48","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2405.20985","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:077fe7da7240d877c9a6dfcf5d5302941e356be23c87bd6071492c1f98000493","observation_id":"4e7580aa-13f4-4d70-a71b-9a7ef1611c41","resolution":{"observed_at":"2026-05-11T10:56:05.685086Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"52c249f1-2064-4eed-865d-3f74bd699537","year":null},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:b0b56a98489fbf4331cbe566e842807bbd48a28bc900214a667c26e6cc686022","observation_id":"97861cfd-6504-40fa-a2a2-996279bd31c4","resolution":{"observed_at":"2026-05-18T05:32:26.161913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04417","last_updated":"2025-06-03T04:12:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-06T09:18:04Z","title":"SparseVLM: Visual Token Sparsification for Efficient Vision-Language Model Inference","version":4},"cited_work":{"arxiv_id":"2410.04417","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04417","snapshot_observed_at":"2026-07-09T21:36:34.338168Z","title":"SparseVLM: Visual Token Sparsification for Efficient Vision-Language Model Inference","venue":"cs.CV","work_id":"691499bc-3ae3-49f0-aba6-ab6c7972a7a7","year":2024},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2410.04417","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:2f9d39a0cc0a86c683634b518c3918bd08c63a0ae19b85d5c0fa8a0209f913d6","observation_id":"320c0715-28f5-4777-9509-f4ee8fa70cc1","resolution":{"observed_at":"2026-05-15T14:58:32.742607Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.02912","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:48:32.421869Z","title":"Don’t just chase” highlighted tokens” in mllms: Revisiting visual holistic con- text retention","venue":null,"work_id":"27c52942-094d-4ff1-952d-7941f68362ec","year":2025},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:e949b088a4136a510522530455e71b8ff6928054db661a2ea55c7c5ea6012cbe","observation_id":"3f8cc0d8-b998-4601-95cd-a3c8b4bce662","resolution":{"observed_at":"2026-05-11T10:56:05.750840Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.13822","last_updated":"2022-10-03T03:58:19Z","snapshot_observed_at":"2026-08-03T02:26:07.630093Z","submitted_at":"2022-09-28T04:11:05Z","title":"TokenFlow: Rethinking Fine-grained Cross-modal Alignment in Vision-Language Retrieval","version":2},"cited_work":{"arxiv_id":"2209.13822","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.13822","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"574a3237-d8f4-4ec9-8854-31c40e1d69f1","year":2022},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"cited_paper":"/paper/2209.13822","citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:17cce8d94a291b5f163748115ccb82b749eea6744991d8ce2c00f2a794ca888e","observation_id":"d85e0a01-adcd-4da7-927d-390e948dd4b5","resolution":{"observed_at":"2026-05-11T10:56:05.730000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"As shown in Table 7, our method consistently maintains competitive performance across multiple video under- standing benchmarks while retaining only 50% of the visual token budget","venue":null,"work_id":"2a2a73ab-fe5b-4569-895f-eaacca15ad76","year":null},"citing_paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T15:15:04.261855Z"},"links":{"citing_paper":"/paper/2604.11240"},"observation_digest":"sha256:ae5becba8c13677f4f11673f694fb9d3e044a3ad123716ca8f10f00de050865a","observation_id":"3b9cb270-ab21-4519-9567-7e9e90d7cd88","resolution":{"observed_at":"2026-05-18T05:32:26.248282Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.11240","last_updated":"2026-04-13T09:44:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T05:19:31.992123Z","submitted_at":"2026-04-13T09:44:52Z","title":"Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":34,"verified_exact":13,"verified_fuzzy":1},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2604.11240."}