{"as_of":"2026-08-08T06:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d9846a1ca0d92052959eaeb6b9c5387d72e4c91b147c243c4527f0cb59305ffa","coverage":[{"denominator":84,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":84,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T11:58:32.095426Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.22586/citation-record","integrity":"/paper/2607.22586/integrity","json":"/paper/2607.22586/citation-record.json","paper":"/paper/2607.22586"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-02T11:58:19.894867Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:19.894867Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:a15d030d903378af87e6dc18a0555b8b90fadc123dd9e90697871b22b86d0dfd","observation_id":"4c9fa41f-ceba-4ddf-bf19-fd591d23e4c7","resolution":{"observed_at":"2026-08-02T11:58:19.894867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:20.054978Z","title":"Nikolopoulos, Hans Vandierendonck, Deepu John, and Bo Ji","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:20.054978Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:e764d376cd95ddccc58239e371edc1e07f8b3c33979c6cabf14e0c8574dc93a4","observation_id":"610b6963-6a14-426d-9b6a-0b323fa6235a","resolution":{"observed_at":"2026-08-02T11:58:20.054978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T11:58:20.222339Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:20.222339Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:6a8a36213afd130feddffa68084a0cad76e8f6918aaf7d6390684866ce0e131e","observation_id":"d5560da7-6839-4c85-a888-927562fbf26b","resolution":{"observed_at":"2026-08-02T11:58:20.222339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:20.585480Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:20.585480Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:0fc96d250e49a31915d7d11cdc8a5cf7ec364a08936fdaafc9b7e25952dbb30c","observation_id":"1403ce93-0877-46f5-8cd4-6d4cd083be51","resolution":{"observed_at":"2026-08-02T11:58:20.585480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-02T11:58:20.913521Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:20.913521Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:da0d74cc41dc814e9cf0047939ca718016bf3d3124d5268494ddd37f07350279","observation_id":"1ab748ed-05c8-4f8d-8d04-4e7a709034e8","resolution":{"observed_at":"2026-08-02T11:58:20.913521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:21.026569Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:21.026569Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:0da977d56b89b3ed5fc7da29c1aaa6c60864bc365b4b43821034138f7939956f","observation_id":"4ed5212b-863e-4cd8-b443-04f25aa6187c","resolution":{"observed_at":"2026-08-02T11:58:21.026569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05650","last_updated":"2026-04-08T18:13:56Z","snapshot_observed_at":"2026-07-06T22:54:21.571606Z","submitted_at":"2026-04-07T09:54:33Z","title":"See the Forest for the Trees: Loosely Speculative Decoding via Visual-Semantic Guidance for Efficient Inference of Video LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05650","snapshot_observed_at":"2026-08-02T11:58:21.450728Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:21.450728Z"},"links":{"cited_paper":"/paper/2604.05650","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:e7239ad7aae565233298f2f7f6e6ae5a52ba051d4a7ab4eaba06058b50e2c265","observation_id":"04a2b01f-4983-4b17-80b9-b58b4dbf6f4c","resolution":{"observed_at":"2026-08-02T11:58:21.450728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:21.569466Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:21.569466Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:36484abe1d369de632bf325cf39cd82fda81a61848d8bc513d542b0cbdefd757","observation_id":"ad466646-dfd4-4c2e-bfbf-33543f930347","resolution":{"observed_at":"2026-08-02T11:58:21.569466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-02T11:58:21.770610Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:21.770610Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:f9ad54b1d0f9a5df333fe8db488b559c79773d40f90d4712134e3acbaeff1971","observation_id":"ea860bbb-30e8-454f-b31c-de52ed70f3d1","resolution":{"observed_at":"2026-08-02T11:58:21.770610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:21.891492Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:21.891492Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:3c06dd2c2914cf1414687c8c74dc98307f1ff858398b161a431d7c25d7d61aa1","observation_id":"3df26648-73ab-4607-b379-44f33c18f53f","resolution":{"observed_at":"2026-08-02T11:58:21.891492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:22.063778Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:22.063778Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:e1afcb674bf849508780f8fe3d77344b2b7aec871b6a9b52210a02b06376c551","observation_id":"672026b0-2428-4a96-852a-a19364078c1e","resolution":{"observed_at":"2026-08-02T11:58:22.063778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:22.181795Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:22.181795Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:4e642e5bfeb7c80608dd0ef055a6b932968f0be6632ffba28db451c03d79dc6d","observation_id":"40a1932f-c375-43cf-892d-0df718559623","resolution":{"observed_at":"2026-08-02T11:58:22.181795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-07-06T19:06:19.400102Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-02T11:58:22.293241Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:22.293241Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:d9ac7aeaddda2fef8d69744b3999219b249a06a970fba87bfd99257b4f1121ff","observation_id":"713147ac-3da5-4830-9770-8dfa6e57943e","resolution":{"observed_at":"2026-08-02T11:58:22.293241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:22.698273Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:22.698273Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:302c0a8be9ae88d4b6102260b40ea98ba74e4ff3541522242a0516928fe8adda","observation_id":"b2be34b0-341b-4c68-b7b5-37c4b0c39e49","resolution":{"observed_at":"2026-08-02T11:58:22.698273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:22.839506Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:22.839506Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:a2f71eec1623a36a4e7beb3889d157542cf154db6b966e27899142277e78437c","observation_id":"7fe856aa-0215-44ef-9a08-e0b5b3992028","resolution":{"observed_at":"2026-08-02T11:58:22.839506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:22.959713Z","title":"Morse, Raghavv Goel, Mingu Lee, and Chris Lott","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:22.959713Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:26580268b8dcb9c04faf33bad7469b41f5ad485c0f6b796d7b2f35c7dc39f923","observation_id":"50b5f7a1-d2c3-4162-a318-e3c84d2dc512","resolution":{"observed_at":"2026-08-02T11:58:22.959713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03848","last_updated":"2025-04-22T14:11:50Z","snapshot_observed_at":"2026-08-06T01:28:29.570476Z","submitted_at":"2024-02-06T09:50:08Z","title":"ANLS* -- A Universal Document Processing Metric for Generative Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03848","snapshot_observed_at":"2026-08-02T11:58:23.108518Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:23.108518Z"},"links":{"cited_paper":"/paper/2402.03848","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:9e328281bb2dc8316823fe2678ad6ecc0993e1ca1f91954c92102eee17f01f5b","observation_id":"b00a8e43-9164-48e3-8c1a-d9f65f3bad6d","resolution":{"observed_at":"2026-08-02T11:58:23.108518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:23.423299Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:23.423299Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:b16b98009f4fa98303dcf0d26aab2ac654c5a9d26fe26809ff20158f63679a1e","observation_id":"c9c0e047-deeb-4640-adc3-d986e28eeb9e","resolution":{"observed_at":"2026-08-02T11:58:23.423299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:23.571629Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:23.571629Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:fa65821e1e1cbcd6af4b38309de663b44e9c4c6300ea8754b761b745a00275a1","observation_id":"b76d9ec2-e6a8-4c75-bb4b-7485e2118a70","resolution":{"observed_at":"2026-08-02T11:58:23.571629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:23.810534Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:23.810534Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:e57a7ab954bfb5195968f31db2ae0a494c4bd7224ac6f58b9ec3d31c9d17e67e","observation_id":"30e33678-916c-476e-9e8a-73626e926fc7","resolution":{"observed_at":"2026-08-02T11:58:23.810534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05344","last_updated":"2025-07-05T15:40:51Z","snapshot_observed_at":"2026-08-07T10:18:54.361523Z","submitted_at":"2025-06-05T17:59:55Z","title":"SparseMM: Head Sparsity Emerges from Visual Concept Responses in MLLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05344","snapshot_observed_at":"2026-08-02T11:58:24.192980Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:24.192980Z"},"links":{"cited_paper":"/paper/2506.05344","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:c363e6cd9b035c60bc078576f7dfe18b19abeaa4690105648b02fc71e79e8621","observation_id":"20c69d2f-748e-4b1f-8a59-577e5f5e0335","resolution":{"observed_at":"2026-08-02T11:58:24.192980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:24.335787Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:24.335787Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:c02e006ad4feb32998f781b42d9315da25d8574bb8cb0d9c2d8a9c8a3b944457","observation_id":"d24cf86a-d86d-4779-af46-ecac5407352a","resolution":{"observed_at":"2026-08-02T11:58:24.335787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-02T11:58:24.448018Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:24.448018Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:f39bfb7d0780358615816af5837bdbb6270f2f300bc0792b810b62123dbfda90","observation_id":"f2bd8cea-7ddb-4931-ba17-f052837b67fb","resolution":{"observed_at":"2026-08-02T11:58:24.448018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:24.611574Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:24.611574Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:d17f4c492f4c6e989dbf2f20b898eeafca88a408690e8124faafd67293026b03","observation_id":"3459f733-da4e-49d3-b874-c26b79a2e42f","resolution":{"observed_at":"2026-08-02T11:58:24.611574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:24.737749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:24.737749Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:4b873f2d0b7eeeacc072e44b4f5ffe963a0514e5d5d0a0f7b43233c50b2beed6","observation_id":"7c186425-9c29-498c-8f4c-603e8ba516ab","resolution":{"observed_at":"2026-08-02T11:58:24.737749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:24.851839Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:24.851839Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:bca5e2c257372a01eb5a58ac6c5704ebf983e553368efde3fb779606e488d5f3","observation_id":"90b9b16c-7779-4e73-94e4-1064694c1459","resolution":{"observed_at":"2026-08-02T11:58:24.851839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:24.963171Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:24.963171Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:98e05b9a592d1242c3ef051514d342fa978cd7aa73343d4ddfe04f17076638e9","observation_id":"5dda8ded-2289-44d8-a403-4508c5cb6fa6","resolution":{"observed_at":"2026-08-02T11:58:24.963171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05887","last_updated":"2026-04-07T13:51:07Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T13:51:07Z","title":"HybridKV: Hybrid KV Cache Compression for Efficient Multimodal Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05887","snapshot_observed_at":"2026-08-02T11:58:25.085915Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:25.085915Z"},"links":{"cited_paper":"/paper/2604.05887","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:ccb423373fbf2e8ee65207dcf8cd871a6268cc1375fc3db66438da70eda3bdb6","observation_id":"f811e027-85bb-4c6a-be33-3662a4401d3c","resolution":{"observed_at":"2026-08-02T11:58:25.085915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05546","last_updated":"2026-04-14T01:04:46Z","snapshot_observed_at":"2026-08-05T11:51:07.603519Z","submitted_at":"2026-04-07T07:44:11Z","title":"Efficient Inference for Large Vision-Language Models: Bottlenecks, Techniques, and Prospects","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05546","snapshot_observed_at":"2026-08-02T11:58:25.244892Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:25.244892Z"},"links":{"cited_paper":"/paper/2604.05546","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:abadfc1af88256c40621a8a27363c421d0e3aa682e15161996847d31f5b94f8e","observation_id":"82653632-2db3-4d9f-a680-d6a8e1c94ad2","resolution":{"observed_at":"2026-08-02T11:58:25.244892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:25.477725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:25.477725Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:6e1eb73e240810ed3ad8f9211dabbaba1b270d49330b0431852f67f41dd12441","observation_id":"36df42ca-8cab-4db5-bc92-6a6657fc4cb7","resolution":{"observed_at":"2026-08-02T11:58:25.477725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:25.572692Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:25.572692Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:7a86982de2a30a062c8cd4d96b2dc47d8fe81f48ab51b65a065e88676e2dc913","observation_id":"6922c32b-0f07-417d-a96a-34fa06eff11b","resolution":{"observed_at":"2026-08-02T11:58:25.572692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:25.702041Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:25.702041Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:a48d1a7fbf1a71b1ae0904fc39b34cf2ec25bb9bfed959b7726455076f1c9dc6","observation_id":"fc4a7285-a518-4125-97db-8435ee05097a","resolution":{"observed_at":"2026-08-02T11:58:25.702041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:25.791801Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:25.791801Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:4af4b84ce7e0d93ec11ce56fa959b2c24f4d2526f499f3999516dd8be0a20f33","observation_id":"5d211f02-76b7-4335-b5a0-4b146a7d472a","resolution":{"observed_at":"2026-08-02T11:58:25.791801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:25.922021Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:25.922021Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:0740a78f280cf42c45896cd9bdc7dbf6be71affad1bb6684b6f03164d3566eec","observation_id":"4e6a33a1-3ea4-49e2-9cc8-d27a4e75c50e","resolution":{"observed_at":"2026-08-02T11:58:25.922021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:26.082011Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:26.082011Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:d8eb1b8a9d3a72f9160430fdb34e2d97fb41eae124cdd63082349fd668310cc0","observation_id":"a6d8d12c-f06b-40f5-bcf6-2c953812cad8","resolution":{"observed_at":"2026-08-02T11:58:26.082011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:26.168724Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:26.168724Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:533e3bc6bdb9083c280938451e96ac9a8657200ba6aa28c28438e7dc6e91b2a8","observation_id":"f830f334-e753-4852-be3c-3b67bbe3877e","resolution":{"observed_at":"2026-08-02T11:58:26.168724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:26.270260Z","title":"2023 , eprint =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:26.270260Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:437faaf9db560a31dcdd3bc526a0fc269a6f64576ea33fc0d547c8b1cdf10952","observation_id":"246fab55-4d51-422b-b25b-f32212782cfa","resolution":{"observed_at":"2026-08-02T11:58:26.270260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:26.385348Z","title":"2023 , eprint =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:26.385348Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:e21bdb0752f16e7e1799c576fe90c14cc52f4949f6dc31a425d01bf8de896370","observation_id":"f0cb8b69-e774-4754-89e0-325ae7162404","resolution":{"observed_at":"2026-08-02T11:58:26.385348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:26.512769Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:26.512769Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:3f36baa5f8ebe5c54fbef00ad454292073cfc5a99cee0051fcb8b2d02526162f","observation_id":"ad1ef3bc-18b5-42d1-98d5-ea8223b8c366","resolution":{"observed_at":"2026-08-02T11:58:26.512769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:26.635446Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:26.635446Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:735b720b95463fd7ff82816278765d5a2f4addc8f6bd0dde871b1319a3ecdfa0","observation_id":"973b3d56-208c-4b95-ae63-42e351e05ff4","resolution":{"observed_at":"2026-08-02T11:58:26.635446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:26.768096Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:26.768096Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:ffd3df90a7200675c93084a615b5129f882f178a0f017132832827e6421e494d","observation_id":"ba523d12-1836-4ff9-8495-eec731bfa467","resolution":{"observed_at":"2026-08-02T11:58:26.768096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07895","last_updated":"2024-08-26T02:37:14Z","snapshot_observed_at":"2026-07-06T15:26:46.489500Z","submitted_at":"2023-05-13T11:28:37Z","title":"OCRBench: On the Hidden Mystery of OCR in Large Multimodal Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07895","snapshot_observed_at":"2026-08-02T11:58:26.902599Z","title":"OCRBench : On the Hidden Mystery of OCR in Large Multimodal Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:26.902599Z"},"links":{"cited_paper":"/paper/2305.07895","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:023445ae58d5af20ca04664fb8827c8d03d1e1279354974abed6651d6dc59243","observation_id":"cfb5dd04-0ff9-4297-ad0c-19a70376f45d","resolution":{"observed_at":"2026-08-02T11:58:26.902599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:27.039296Z","title":"TextCaps : A Dataset for Image Captioning with Reading Comprehension","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:27.039296Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:6e8eba5ab57bdb1ed194bb33da9317c2b4c110ea56faf8a29fba42c60179438a","observation_id":"70e8483f-bc4e-4b6e-afd4-007a2ece93d4","resolution":{"observed_at":"2026-08-02T11:58:27.039296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:27.150104Z","title":"MMMU : A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:27.150104Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:a98f04f67bf5d71f20fcfb2f830e42f5fea2e2859828d520f55700f8e2467351","observation_id":"1029a303-26d1-49e1-a0cf-5863cb5e4817","resolution":{"observed_at":"2026-08-02T11:58:27.150104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:27.289634Z","title":"Findings of the Association for Computational Linguistics:. ChartQA : A Benchmark for Question Answering about Charts with Visual and Logical Reasoning. 2022 , address =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:27.289634Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:3a091c33546a8041bce9e3c5cecaca2031eecf1ca191f2c2c78cc99539dfb800","observation_id":"956b0500-334f-4eb6-995b-dd6c947af03b","resolution":{"observed_at":"2026-08-02T11:58:27.289634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:27.422148Z","title":"Towards VQA Models That Can Read","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:27.422148Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:f2ac6a03d6d4efb1199260df9ff91a2a716c09a011c4f3fed04b05db2bcf7b06","observation_id":"636132c9-4b37-4837-8a89-f7b94ec292b3","resolution":{"observed_at":"2026-08-02T11:58:27.422148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:27.549270Z","title":", booktitle = \"Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision (","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:27.549270Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:8681f3b7a6a3278e4b488b8a9097a802dab2fa64f8efc0aa14e171e2d0137362","observation_id":"bb64e5c9-fa21-4552-bf88-666ffc84c5f9","resolution":{"observed_at":"2026-08-02T11:58:27.549270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02750","last_updated":"2024-07-25T09:16:05Z","snapshot_observed_at":"2026-07-06T17:25:18.238343Z","submitted_at":"2024-02-05T06:06:47Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02750","snapshot_observed_at":"2026-08-02T11:58:27.683696Z","title":"KIVI : A Tuning-Free Asymmetric 2-bit Quantization for KV Cache","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:27.683696Z"},"links":{"cited_paper":"/paper/2402.02750","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:b1c3de50a66e57c43a7956643f42021652222729d002cc02e691b4b256794c54","observation_id":"8a43d895-8e4e-49a8-a5fd-6d3a8be1cee5","resolution":{"observed_at":"2026-08-02T11:58:27.683696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:27.842372Z","title":"AWQ : Activation-aware Weight Quantization for On-Device LLM Compression and Acceleration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:27.842372Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:eb4e10f586e7218fec4420e0ceb95ffa28786c13d5151256c740b394a0c752ea","observation_id":"d18f3edf-a0dc-4c1a-bff2-65ae682dd6fb","resolution":{"observed_at":"2026-08-02T11:58:27.842372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:27.962962Z","title":"Computer Vision --. An Image is Worth 1/2 Tokens After Layer 2: Plug-and-Play Inference Acceleration for Large Vision-Language Models. 2025 , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:27.962962Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:d3b738ddba94c6c29a1ef51558303fb13163b1f8fddef06e37a92673a73df84a","observation_id":"1a51ac52-0af4-4c70-a11a-e24e0bd6f9c3","resolution":{"observed_at":"2026-08-02T11:58:27.962962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-02T11:58:28.105753Z","title":"and Chen, Deming and Dao, Tri , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.105753Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:eb6816a0a2b4e121be756c072549cccf01b30206c3c70e1992fbb8109f586ffc","observation_id":"618513c7-b8a9-49ed-a6c3-48315be267e7","resolution":{"observed_at":"2026-08-02T11:58:28.105753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:28.185604Z","title":"Association for Computing Machinery","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.185604Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:f93e10130ff0ba6e10d3aeec13c43032fd22849e83eec70b28ee8ef140109342","observation_id":"94e7f057-f949-40b9-897e-1162f22cc9e3","resolution":{"observed_at":"2026-08-02T11:58:28.185604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:28.334271Z","title":"InfLLM : Training-free Long-context Extrapolation for LLMs with an Efficient Context Memory","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.334271Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:8dcbe29b87fa5158c4ec67f6e54529c96385cbd728bddb97d5cb10e718555af0","observation_id":"9027bd55-13a7-4f06-9b86-e558141dad8e","resolution":{"observed_at":"2026-08-02T11:58:28.334271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:28.466982Z","title":"H2O : Heavy-hitter Oracle for Efficient Generative Inference of Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.466982Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:048cf43ae052dd50f299f14642abacc5a80c601fb412db70f45215ab63db70f0","observation_id":"ae356680-5cb6-4441-89e3-60a5f58b5277","resolution":{"observed_at":"2026-08-02T11:58:28.466982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16383","last_updated":"2025-02-02T03:04:54Z","snapshot_observed_at":"2026-07-06T20:27:00.165620Z","submitted_at":"2025-01-25T01:45:29Z","title":"RotateKV: Accurate and Robust 2-Bit KV Cache Quantization for LLMs via Outlier-Aware Adaptive Rotations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16383","snapshot_observed_at":"2026-08-02T11:58:28.560458Z","title":"RotateKV : Accurate and Robust 2-bit KV Cache Quantization for LLMs via Outlier-Aware Adaptive Rotations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.560458Z"},"links":{"cited_paper":"/paper/2501.16383","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:95e487b732430ef794d05f3afa49ab6c647aaf2403b6e7476d58f8c11a81fee8","observation_id":"15fbe337-d973-4b09-b47e-e986514b5c09","resolution":{"observed_at":"2026-08-02T11:58:28.560458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-06T08:05:35.311510Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-02T11:58:28.674400Z","title":"Generating Long Sequences with Sparse Transformers","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.674400Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:64eb0031e51e04eac4e812cc4c232927826edbd864da98d19d64b2a37c0dddcb","observation_id":"3a451ae3-ee0e-4995-b1fe-ff143af95e43","resolution":{"observed_at":"2026-08-02T11:58:28.674400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:28.800958Z","title":"Training-free and Adaptive Sparse Attention for Efficient Long Video Generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.800958Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:4b339931c0e17f23ed420ddb6564f0bf3d301476d05126f725dadc0e92d9f238","observation_id":"1429e6f6-af11-466b-b455-4c7253c6d26b","resolution":{"observed_at":"2026-08-02T11:58:28.800958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-02T11:58:28.898360Z","title":"A Simple and Effective L_2 Norm-Based Strategy for KV Cache Compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.898360Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:0fcb799c752dfa0eb1fb45ed90a55d0f61c46e5998f03dec8e5be131fe0180a9","observation_id":"5d9ccd38-9620-42e3-8271-7f82ef51b2a7","resolution":{"observed_at":"2026-08-02T11:58:28.898360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:28.992900Z","title":", journal =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.992900Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:202b54c517219fb4ee1b849338a05f1c0057013965e502796f4992971ea50100","observation_id":"8ff85135-0005-4cd1-a816-5f5b2afa60ba","resolution":{"observed_at":"2026-08-02T11:58:28.992900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-02T11:58:29.142425Z","title":"PyramidKV : Dynamic KV Cache Compression based on Pyramidal Information Funneling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:29.142425Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:9ca31e50e038971d3bcd321bc8fe7a432023efa0bd8f53bedd837a9ab7395bf9","observation_id":"01fccef6-38ff-457f-ba8f-bfd7f0bb4477","resolution":{"observed_at":"2026-08-02T11:58:29.142425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:29.256668Z","title":"VisionZip : Longer is Better but Not Necessary in Vision-Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:29.256668Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:d87b4a9742a05bbf26b4d384dbe3236a00311f7bc30faa4c04f5c3f764c89483","observation_id":"f69adfc5-62c1-4796-8bab-c8adb5afc3a1","resolution":{"observed_at":"2026-08-02T11:58:29.256668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:29.361640Z","title":"DyCoke : Dynamic Compression of Tokens for Fast Video Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:29.361640Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:0ded8dc68dc0128d160b1efa6c730b22fd0453393cb123bf0911859b0475a9ed","observation_id":"bac81452-c74b-4091-9a4b-3ade95250148","resolution":{"observed_at":"2026-08-02T11:58:29.361640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17434","last_updated":"2024-10-22T21:21:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T21:21:37Z","title":"LongVU: Spatiotemporal Adaptive Compression for Long Video-Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17434","snapshot_observed_at":"2026-08-02T11:58:29.497400Z","title":"and Soran, Bilge and Krishnamoorthi, Raghuraman and Elhoseiny, Mohamed and Chandra, Vikas , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:29.497400Z"},"links":{"cited_paper":"/paper/2410.17434","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:e9890a66cfb914c3f6ea3ed08b4481cbffed36a188ee6389387df1d336f36bc4","observation_id":"da5de966-860a-4fa6-8ea5-f2d30ba177a6","resolution":{"observed_at":"2026-08-02T11:58:29.497400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:29.609514Z","title":"TopV : Compatible Token Pruning with Inference Time Optimization for Fast and Low-Memory Multimodal Vision-Language Model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:29.609514Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:e4252d890eca3e643da07bbe9fc47772052afaa22a50bf4be48b0e175600ed23","observation_id":"eedee17c-53af-4b77-81d6-c8aafc2a1471","resolution":{"observed_at":"2026-08-02T11:58:29.609514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-02T11:58:29.746228Z","title":"LOOK-M : Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:29.746228Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:a3ec567518c82fdf1707a5216e2168d9776ef5e8eb125070952290ac4ddadefa","observation_id":"f4c52329-4ebd-4876-957d-ec47b3ddc319","resolution":{"observed_at":"2026-08-02T11:58:29.746228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:29.845572Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:29.845572Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:cafc9ce2e9d78db26c53049a56d5bbd22cdf4106d41fa94b48902eecfb66aa97","observation_id":"95ed4cdf-9601-4f9c-a19a-5b5fe7b61733","resolution":{"observed_at":"2026-08-02T11:58:29.845572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10819","last_updated":"2024-10-14T17:59:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-14T17:59:58Z","title":"DuoAttention: Efficient Long-Context LLM Inference with Retrieval and Streaming Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10819","snapshot_observed_at":"2026-08-02T11:58:29.935195Z","title":"DuoAttention : Efficient Long-Context LLM Inference with Retrieval and Streaming Heads","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:29.935195Z"},"links":{"cited_paper":"/paper/2410.10819","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:9f28024720105d3589eb25733089e7b1843c88eebfadbc81759fddf65f59fe94","observation_id":"5348cdde-7e76-4659-8e7e-6d942dd84429","resolution":{"observed_at":"2026-08-02T11:58:29.935195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11550","last_updated":"2025-10-16T13:25:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-16T09:53:32Z","title":"Ada-KV: Optimizing KV Cache Eviction by Adaptive Budget Allocation for Efficient LLM Inference","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11550","snapshot_observed_at":"2026-08-02T11:58:30.056509Z","title":"Kevin , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:30.056509Z"},"links":{"cited_paper":"/paper/2407.11550","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:87c5c5cba084ed527779bf12804600bd878b6dc60e1d9e01de43f8f1edee77ec","observation_id":"0e0d93f9-2ca8-4c7a-8d0c-75e38cda5bc0","resolution":{"observed_at":"2026-08-02T11:58:30.056509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:30.166806Z","title":"and Li, Dongsheng and Lin, Chin-Yew and Yang, Yuqing and Qiu, Lili , booktitle = \"Advances in Neural Information Processing Systems (","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:30.166806Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:06f0b9fc1132a59b4aee9c373713a7722967b6d7ee005538afa75410b90cc15f","observation_id":"9ddf2ab0-fcee-4955-aa19-8f1645883cd3","resolution":{"observed_at":"2026-08-02T11:58:30.166806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:30.314903Z","title":"SparseVLM : Visual Token Sparsification for Efficient Vision-Language Models Inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:30.314903Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:7a3afce48a84fb15b93a70406b6480b45b47359ece592803704c075ef59851c6","observation_id":"c6446cc8-25ce-48e3-b393-e3363a4e9e7e","resolution":{"observed_at":"2026-08-02T11:58:30.314903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16710","last_updated":"2024-10-18T04:02:31Z","snapshot_observed_at":"2026-08-08T01:15:44.293937Z","submitted_at":"2024-04-25T16:20:23Z","title":"LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16710","snapshot_observed_at":"2026-08-02T11:58:30.462516Z","title":"and Chen, Beidi and Wu, Carole-Jean , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:30.462516Z"},"links":{"cited_paper":"/paper/2404.16710","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:91b522d0e732b74af95cfa1e13edd1cf72e57c210f6dfd2aa2edc134b8392fbd","observation_id":"cf8bd247-429e-4259-a8fa-97fc5e1019eb","resolution":{"observed_at":"2026-08-02T11:58:30.462516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:30.589649Z","title":"GQA : Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:30.589649Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:c764c4a4854cb01a58bff80679b62a25284be4155b990ffea80118884a8099ba","observation_id":"e7840632-cd37-4724-a617-bf44c1d6517b","resolution":{"observed_at":"2026-08-02T11:58:30.589649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05055","last_updated":"2023-02-17T17:54:50Z","snapshot_observed_at":"2026-07-06T14:28:52.486524Z","submitted_at":"2022-12-09T18:57:37Z","title":"Sparse Upcycling: Training Mixture-of-Experts from Dense Checkpoints","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05055","snapshot_observed_at":"2026-08-02T11:58:30.699815Z","title":"Sparse Upcycling : Training Mixture-of-Experts from Dense Checkpoints","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:30.699815Z"},"links":{"cited_paper":"/paper/2212.05055","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:a6fc97107f9d1a2845fa8106183b4b83dbb2b4a11743f6606d2d8696d64cd86c","observation_id":"b7d7e243-73ff-4194-a052-a263e3d8d0a1","resolution":{"observed_at":"2026-08-02T11:58:30.699815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-06T01:54:01.546928Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-02T11:58:30.811138Z","title":"Sparse VideoGen : Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:30.811138Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:5949884982d48e6f52a51040fc929e570dfdb7b6929da3beb97cef0f4e686ae6","observation_id":"d4b9599c-978b-4803-9284-d698d4c5d12c","resolution":{"observed_at":"2026-08-02T11:58:30.811138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:30.936965Z","title":"Proceedings of the Thirty-Ninth AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:30.936965Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:bc1ce9c326ab7f466badf4c7567945a47d03b1ecd3ab5e3ef791ab8effac6ead","observation_id":"41e47fe2-a1c4-48a4-b890-0c33ada6060d","resolution":{"observed_at":"2026-08-02T11:58:30.936965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:31.077641Z","title":"Multi-Layer Visual Feature Fusion in Multimodal LLMs : Methods, Analysis, and Best Practices","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:31.077641Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:e4eb1d59dd93063432e18d3282e3d1d09c5abcd36ee4c3772092d70a2684055f","observation_id":"4ae0194c-339d-47ff-bdd1-b83036f7ba99","resolution":{"observed_at":"2026-08-02T11:58:31.077641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12772","last_updated":"2025-05-05T04:48:45Z","snapshot_observed_at":"2026-07-06T18:47:56.109836Z","submitted_at":"2024-07-17T17:51:53Z","title":"LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12772","snapshot_observed_at":"2026-08-02T11:58:31.210800Z","title":"LMMs-Eval : Reality Check on the Evaluation of Large Multimodal Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:31.210800Z"},"links":{"cited_paper":"/paper/2407.12772","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:d9716a4182ff52d93851600f66e93578763baad14b90b31d79eed6e81268027d","observation_id":"40bbf5e9-7530-4ceb-950b-f498f214554d","resolution":{"observed_at":"2026-08-02T11:58:31.210800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13899","last_updated":"2022-12-27T07:15:09Z","snapshot_observed_at":"2026-08-04T16:21:26.203281Z","submitted_at":"2022-03-25T20:34:08Z","title":"Exact Matching: Algorithms and Related Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13899","snapshot_observed_at":"2026-08-02T11:58:31.358219Z","title":"Exact Matching: Algorithms and Related Problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:31.358219Z"},"links":{"cited_paper":"/paper/2203.13899","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:9f82a9602b1aa333fb490bdf7b8037c4590fdc2d2322e3ea592313102d3311cc","observation_id":"c389fac6-4e4d-4d9e-944c-cea45b386618","resolution":{"observed_at":"2026-08-02T11:58:31.358219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.5726","last_updated":"2015-06-03T01:42:20Z","snapshot_observed_at":"2026-08-07T17:52:59.562945Z","submitted_at":"2014-11-20T23:54:35Z","title":"CIDEr: Consensus-based Image Description Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.5726","snapshot_observed_at":"2026-08-02T11:58:31.477570Z","title":"Lawrence and Parikh, Devi , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:31.477570Z"},"links":{"cited_paper":"/paper/1411.5726","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:20210231bcec2df8a5386ff7da36b4cf71ec64885bd0892957c47ef49f7b8d33","observation_id":"b7eee086-72ee-43e4-b1d7-6ec22f130b18","resolution":{"observed_at":"2026-08-02T11:58:31.477570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:31.594074Z","title":"ANLS* -- A Universal Document Processing Metric for Generative Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:31.594074Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:bbaac058f690aeba78267c2652a4fcf605b7104b4064a9da33be1776dcba8ea0","observation_id":"71d68937-354d-4e03-811b-8792b63dca2a","resolution":{"observed_at":"2026-08-02T11:58:31.594074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:31.690860Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:31.690860Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:92cdb165521c8f81b21b52a6458a51387b43798e7a1e518e2c37b3ec5e593c53","observation_id":"6631fa7b-dd24-4a0c-9655-bf93d45333d1","resolution":{"observed_at":"2026-08-02T11:58:31.690860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:31.854901Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:31.854901Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:7298cbb33c04105d9d41a3b2d67759949331e25ded08809d806f1ba93a85dd16","observation_id":"bcc1a2f5-baa6-4f6d-bce4-865a6f4ac7a9","resolution":{"observed_at":"2026-08-02T11:58:31.854901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:31.995756Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:31.995756Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:6626b07845ff1cbadf23d0ef936042a438e3045286a70660238e40cbcf74ef70","observation_id":"adebac80-f026-4807-85a5-c17826c9a6a9","resolution":{"observed_at":"2026-08-02T11:58:31.995756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T11:58:32.095426Z","title":"Proceedings of the 42nd International Conference on Machine Learning , series =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:32.095426Z"},"links":{"citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:57b04488d7d1d9f39afd8c6734653ab8f2cc383f6dab4964d8d41c6f65bd1c75","observation_id":"eade1ae3-54f1-4bb1-b807-0b5d172e1d6e","resolution":{"observed_at":"2026-08-02T11:58:32.095426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models"},"reference_resolution":{"displayed":84,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":84,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":84},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 84 of 84 outbound references and 0 inbound Pith citation observations for arXiv:2607.22586."}