{"as_of":"2026-08-05T04:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d2da53d4acd327092b99bb6f525e9c34df0ed02ea5d819863446f7ba9f72e44","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T07:16:33.817183Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.22269/citation-record","integrity":"/paper/2605.22269/integrity","json":"/paper/2605.22269/citation-record.json","paper":"/paper/2605.22269"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flamingo: a visual language model for few-shot learning.NeurIPS, 35: 23716–23736","venue":null,"work_id":"76a1e60c-a6d8-4d6f-8ab1-b4fb2250ebd8","year":2022},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:41d2373753b8a9f2b5d838d085166c6f772abf06b7ad631779dc54f4df307ce3","observation_id":"f48a51dc-6644-4799-abfc-ded2c76cc6ac","resolution":{"observed_at":"2026-05-22T07:21:14.518829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:f8b454aee687f1b32c4eae590f06e1325548d24079b0987bbb6e7e407b9e2761","observation_id":"d79c84ca-d52d-41a6-8ff8-d6cf64f156f7","resolution":{"observed_at":"2026-05-22T07:21:13.171108Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:d19c3f6ace9a10167da3940543ae76ec2a463e4ca83efa93f78dce72afb5fcfc","observation_id":"7313532e-d499-4156-833d-4fa4aebf9593","resolution":{"observed_at":"2026-05-22T07:21:13.211109Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13915","last_updated":"2025-04-10T17:13:08Z","snapshot_observed_at":"2026-07-06T21:11:39.503336Z","submitted_at":"2025-04-10T17:13:08Z","title":"Memory-efficient Streaming VideoLLMs for Real-time Procedural Video Understanding","version":1},"cited_work":{"arxiv_id":"2504.13915","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.13915","snapshot_observed_at":"2026-07-04T13:19:50.790416Z","title":"Memory-efficient streaming videollms for real-time procedural video understanding","venue":null,"work_id":"74bc44fa-7cf0-445e-a837-49c5d4faab49","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2504.13915","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:f81258f92eacbe6e8c11231c9fef47fee5aeedc8253347a92f12cc6f96664113","observation_id":"67f14717-b47b-48f1-bace-e605ee57cb6b","resolution":{"observed_at":"2026-05-22T07:21:13.234731Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth 1/2 tokens after layer 2: Plug-and-play inference acceleration for large vision-language models","venue":null,"work_id":"18fc1e77-43cd-40c0-9b0c-30b6092a7e51","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:679fa183d0b8bb9b6279186008ec4912152efd7e30692d564c9ab1acab3a93ef","observation_id":"08211e91-7187-46fa-98b3-04232d970c51","resolution":{"observed_at":"2026-05-22T07:21:14.635686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18269","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:00:08.172355Z","title":"Stream- ingtom: Streaming token compression for efficient video un- derstanding","venue":null,"work_id":"6530c90e-bd82-4d7a-bcc5-611c713645f1","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:17ff176bdf938165966e3b8db8b3324650a8c026df64d5a4c239e774a183fc71","observation_id":"8556364b-d2cb-49f6-ab4f-836644a08bed","resolution":{"observed_at":"2026-05-22T07:21:13.157633Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":"957bb1b7-b5e7-449a-9b4d-1cc3683e9658","year":2023},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:07ed86e4dcc996f18471f358776da037cb0f5a3ea0f40ef2b492eb1da2d548ff","observation_id":"e9abc9ae-0c01-40ee-bf20-a09172d12d3a","resolution":{"observed_at":"2026-05-22T07:21:14.541807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An algorithm for the machine calculation of complex fourier series.Mathematics of computation, 19(90):297–301","venue":null,"work_id":"c9c795bc-3d56-4537-b198-b623b658cf2e","year":1965},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:f461b589792d2db1fed46bcf534d86abeaf6f6d10ec73af5c2950610f0881f32","observation_id":"bb0f27fe-7b0d-41db-a602-924e7b6910d0","resolution":{"observed_at":"2026-05-22T07:21:14.545879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Streaming video question-answering with in-context video kv-cache retrieval","venue":null,"work_id":"8c74bb28-68a0-4868-af30-8df29ca99960","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:afd224e624a93688d8a6722844178f937b3b7bde984cb8fb0f43e8b56b6c92df","observation_id":"5aae5c93-d068-4aee-83e3-c8afed73c690","resolution":{"observed_at":"2026-05-22T07:21:14.650695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The llama 3 herd of models.arXiv e-prints, pages arXiv–2407","venue":null,"work_id":"7b4584e0-efef-4cfc-928a-61b1400bae6f","year":null},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:8b40128695831de6e513858e07522371748cda92034ac8bbd28f38fd0b1ce296","observation_id":"786c6920-8039-4858-b5a3-56a8ab67c4d3","resolution":{"observed_at":"2026-05-22T07:21:14.534445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videoagent: A memory-augmented mul- timodal agent for video understanding","venue":null,"work_id":"f11964da-56c5-4114-9e31-29b2859edee5","year":null},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:e408dc5bf6af3199c4743291c3fa2964d316a52863b94b79f57ee7e4ef85e722","observation_id":"a1511583-0714-4d33-8a52-8e03951bab0d","resolution":{"observed_at":"2026-05-22T07:21:14.530357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d0750baa-3b9e-4c31-a8e3-a91f0ae1af32","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:f417bc0c0f559f1a8eca826598476e69db019dbc2ce958428ae21aba2506191e","observation_id":"9afe74f7-d43d-481e-be94-175d877b771d","resolution":{"observed_at":"2026-05-22T07:21:14.538100Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis","venue":null,"work_id":"57789c58-e5a5-4f2d-9170-3d6160e35ad6","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:946da232ca825c5c03abdb871b6eb88a023396ff0717d3cc94b3b917ae049add","observation_id":"7348c682-6026-4180-b4d9-4720b17de7a6","resolution":{"observed_at":"2026-05-22T07:21:14.550053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Not all heads matter: A head-level kv cache compression method with integrated retrieval and reasoning.ICLR","venue":null,"work_id":"cdfe4cce-de06-47d2-aa1c-b36eaa1ba193","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:e581d4a373ff7ce65d659f31c62310215b44ed08264092c24571dacbef5ec58e","observation_id":"fd5bebd7-5cbe-43d4-8f70-f5aacd5cea0c","resolution":{"observed_at":"2026-05-22T07:21:14.522477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kvquant: Towards 10 million context length llm inference with kv cache quantization.Advances in Neural Information Processing Systems, 37:1270–1303","venue":null,"work_id":"6322ca64-7025-481d-ba7a-1bae20d3c6b1","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:647c46be07a38cab40fbe4b12679dff009332fe3cc412f3f17ed8f1a9e3b14a6","observation_id":"66ff5f31-3f37-4b67-bec1-002ccbfd0d21","resolution":{"observed_at":"2026-05-22T07:21:14.526751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:741454395a90a72003cb7da2af28f241f958310b8875cc085210a3f4a50445af","observation_id":"fdcbb041-873e-42a3-ad48-4a58e48cb870","resolution":{"observed_at":"2026-05-22T07:21:13.253524Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01068","last_updated":"2026-04-20T06:24:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T05:25:09Z","title":"FastKV: Decoupling of Context Reduction and KV Cache Compression for Prefill-Decoding Acceleration","version":7},"cited_work":{"arxiv_id":"2502.01068","doi":"10.48550/arxiv.2502.01068","metadata_source":"pith","pith_arxiv_id":"2502.01068","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"FastKV: Decoupling of Context Reduction and KV Cache Compression for Prefill-Decoding Acceleration","venue":"cs.LG","work_id":"9ed354e4-4a0d-4c9d-977e-b620b335f24d","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2502.01068","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:69d1466b7abb9de8c256682520d92be0a78cbd3f5858eafbf448be9cbe65ca4b","observation_id":"d7b9526d-fd9b-4e8f-bc47-5e37cdc0777b","resolution":{"observed_at":"2026-05-22T07:21:13.141948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.00570","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:49:51.560010Z","title":"Freqkv: Frequency domain key- value compression for efficient context window extension","venue":null,"work_id":"4f922691-d98d-43b9-af91-23c0c5c9e7ac","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:de8cbd53d229172fd8ecec0d42ce90788021b1596d2168449fd1c499ecd3eee2","observation_id":"1198858a-1275-4c0f-8ccb-ebcea1cc33e3","resolution":{"observed_at":"2026-05-22T07:21:13.147333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Infinipot-v: Memory-constrained kv cache compres- sion for streaming video understanding.NeurIPS","venue":null,"work_id":"1c640021-b510-4160-b53c-02c8ca576bd8","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:67312bc410ec90537bbb6d377614cf68f1cdb53ad0dfc724bb06d3d1b07ba301","observation_id":"c32ad5e0-704f-41ed-9201-ea322d728f4b","resolution":{"observed_at":"2026-05-22T07:21:14.553283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":"2408.03326","doi":"10.48550/arxiv.2408.03326","metadata_source":"pith","pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","venue":"cs.CV","work_id":"f5f2452b-f2a9-49ac-b38d-c76e18cdfe49","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:6bef505badb14cfb721cba298155cc3d3e898efb25024010ac78723af25305d6","observation_id":"8c3d3d4d-88e4-4f4f-9529-cf6f9424fe98","resolution":{"observed_at":"2026-05-22T07:21:13.166616Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mvbench: A comprehensive multi-modal video understand- ing benchmark","venue":null,"work_id":"5c7ed329-36e1-4144-b566-cd579a0210ae","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:6a95e8dc5ac8150dd83b996df65a9326d88189b7f4c5f2612f5cf9eec5a81c1a","observation_id":"c5799eed-7eb5-429c-a6ed-600f4c0a464f","resolution":{"observed_at":"2026-05-22T07:21:14.556925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":"2311.10122","doi":"10.48550/arxiv.2311.10122","metadata_source":"pith","pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","venue":"cs.CV","work_id":"e2121c51-a55e-476a-af81-7ba6970fe6cf","year":2023},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:db6649cd9dde5262909e6743aa9e43c96467c21c2129f10c27154251ec8b0474","observation_id":"4900905f-d1b9-4830-9a55-451bf3df74f9","resolution":{"observed_at":"2026-05-22T07:21:13.205540Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03628","last_updated":"2024-11-06T02:50:30Z","snapshot_observed_at":"2026-07-06T19:45:57.808548Z","submitted_at":"2024-11-06T02:50:30Z","title":"StreamingBench: Assessing the Gap for MLLMs to Achieve Streaming Video Understanding","version":1},"cited_work":{"arxiv_id":"2411.03628","doi":"10.48550/arxiv.2411.03628","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.03628","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Streamingbench: Assessing the gap for mllms to achieve streaming video un- derstanding","venue":"arXiv (Cornell University)","work_id":"caec985b-dd2d-4dbb-9199-d147732de99a","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2411.03628","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:f5931435eba80b0cf234e5af6e624999cd65a06a3c2487a9301567c8eb882a12","observation_id":"ff030c80-ab6b-4b45-ba45-c3975a3dddef","resolution":{"observed_at":"2026-05-22T07:21:13.153199Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.13109","doi":"10.48550/arxiv.2505.13109","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Freekv: Boosting kv cache retrieval for efficient llm inference","venue":"arXiv (Cornell University)","work_id":"8586ceab-3316-437c-a3ff-85f469311e8d","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:fa518bdab0f8729575869a7196fa93dcf5d00363dc7bf6b3a2bad835f7d0f54d","observation_id":"20bf36fa-d7e9-49b5-b497-d4e95c941b42","resolution":{"observed_at":"2026-05-22T07:21:13.191012Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cachegen: Kv cache com- pression and streaming for fast large language model serv- ing","venue":null,"work_id":"3422f17b-389f-40b8-a529-4c83787d147e","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:e9c28967b9697548c99fe18330278cbb84dc9e561c837a7a8ae26d3b26231f9e","observation_id":"8ddbfde8-7c09-4cdb-8d23-7e42aa394cc4","resolution":{"observed_at":"2026-05-22T07:21:14.643410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2306.05424","doi":"10.48550/arxiv.2306.05424","metadata_source":"pith","pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","venue":"cs.CV","work_id":"51f627f4-8fae-4882-a3e9-abdf932ef27b","year":2023},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:e805e0704582d6aa788afb9a3791721bc1b4b7b00c5bf86ec7dc11980bceac6b","observation_id":"7969c3f8-41b1-48e7-8a5e-eca94aee438c","resolution":{"observed_at":"2026-05-22T07:21:13.243711Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Egoschema: A diagnostic benchmark for very long- form video language understanding.Advances in Neural In- formation Processing Systems, 36:46212–46244","venue":null,"work_id":"1b3fe148-6057-41d5-b806-72e34f233c42","year":2023},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:03cc114bd274d93a029e7444180fb31107d9d45e54324b87c8c8be6d10f86fed","observation_id":"6a612dde-440f-486e-af3c-80e3864da606","resolution":{"observed_at":"2026-05-22T07:21:14.631955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Morevqa: Exploring modular reason- ing models for video question answering","venue":null,"work_id":"6b84a3d7-a01b-42f0-9553-56346b75763a","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:81add82c935a9a25eaa1502f421527537932137312afff34ec918e13931059e8","observation_id":"285586a3-6d54-43cf-a36a-5e7003746a77","resolution":{"observed_at":"2026-05-22T07:21:14.628333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15269","last_updated":"2026-04-23T12:54:38Z","snapshot_observed_at":"2026-08-03T01:07:06.468931Z","submitted_at":"2025-05-21T08:47:15Z","title":"LiveVLM: Efficient Online Video Understanding via Streaming-Oriented KV Cache and Retrieval","version":2},"cited_work":{"arxiv_id":"2505.15269","doi":"10.48550/arxiv.2505.15269","metadata_source":"pith","pith_arxiv_id":"2505.15269","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"LiveVLM: Efficient Online Video Understanding via Streaming-Oriented KV Cache and Retrieval","venue":"cs.CV","work_id":"a00b4d7a-5adc-4855-89a1-5356dc946a85","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2505.15269","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:912ed31bf44be7c58264e5fee649b5e3986497aab803e49810388f4ceb3c41fd","observation_id":"9d48b7c7-e9dc-43fc-9759-88459a5e170f","resolution":{"observed_at":"2026-05-22T07:21:13.215686Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Streaming long video understanding with large language models.NeurIPS, 37: 119336–119360","venue":null,"work_id":"86ce7193-6493-4982-92e1-6cc462cb266a","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:cff32f50625a510e57deff91ef5dc0d71db95890e2cfd5ca2bd658ce22512e91","observation_id":"b7e7ee0a-073b-43ac-813f-daa36f9de4f7","resolution":{"observed_at":"2026-05-22T07:21:14.560478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dispider: Enabling video llms with active real-time interaction via dis- entangled perception, decision, and reaction","venue":null,"work_id":"2a71545e-9e07-453e-9a36-d41d6d4b1d31","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:22a73c4c82e9b7af4283866159bbb2d5f67c4733e5da15dba49efdda77366a28","observation_id":"d1aca159-7f11-4ca3-8591-21c2e03aa2f3","resolution":{"observed_at":"2026-05-22T07:21:14.621147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Question- answering dense video events","venue":null,"work_id":"e2d5587c-f69d-49f5-b226-7cc4f5a12771","year":null},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:8b05a884caf44ee3d5dc3af10bf81392ce548773778879b8dbfa72861f91abf0","observation_id":"43b82120-628a-41fc-8396-d8de75b65ee2","resolution":{"observed_at":"2026-05-22T07:21:14.624663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17434","last_updated":"2024-10-22T21:21:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T21:21:37Z","title":"LongVU: Spatiotemporal Adaptive Compression for Long Video-Language Understanding","version":1},"cited_work":{"arxiv_id":"2410.17434","doi":"10.48550/arxiv.2410.17434","metadata_source":"pith","pith_arxiv_id":"2410.17434","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongVU: Spatiotemporal Adaptive Compression for Long Video-Language Understanding","venue":"cs.CV","work_id":"82f3cbed-22bb-41b5-b9c9-67304154cd52","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2410.17434","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:1f74a88c8009f0c2b41e538aa9c8ab4a80975e5e89eb68d619291d0815825ac2","observation_id":"f4a8f6fd-ce67-428a-9ae4-8bd9fe2216e0","resolution":{"observed_at":"2026-05-22T07:21:13.220539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-xl: Extra-long vision language model for hour-scale video understanding","venue":null,"work_id":"08119513-ebf6-43c6-9d0a-01ff7d053372","year":null},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:8199b7fafc4b1b767277aa67c9337d1411aa506e8668c7b36150e678b45cb6a8","observation_id":"f33e1d2f-db16-4f3f-b3d5-1382c9f93e9e","resolution":{"observed_at":"2026-05-22T07:21:14.606203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Moviechat+: Question-aware sparse memory for long video question answering.IEEE Transac- tions on Pattern Analysis and Machine Intelligence","venue":null,"work_id":"480c0635-05bc-4dfb-b678-c904813a426b","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:52b0d4ece17aebe9ef9ff050e618863e345aa4afd84675a444179c53519172cb","observation_id":"0af27a94-9b11-4271-95be-303332d1520b","resolution":{"observed_at":"2026-05-22T07:21:14.610239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Razorattention: Ef- ficient kv cache compression through retrieval heads.ICLR","venue":null,"work_id":"315e6208-9479-41d6-abf6-cd051d4ad1e8","year":null},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:49df9fff11a829878d2764b6c12bd973585d7e7c6fa901e5bbfd3cf8bb17656a","observation_id":"be3c5e96-0714-44b6-a02a-6f6bdeb68a4d","resolution":{"observed_at":"2026-05-22T07:21:14.617433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.08256","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fier: Fine-grained and efficient kv cache retrieval for long-context llm inference","venue":null,"work_id":"410de39d-62f0-47ab-8fb3-bebe7e647d75","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:f12cd8c038ddf46a0bd1b3561d0f996f9c80801757d81798120756fbbdf81677","observation_id":"56721c51-539e-4a84-83a1-7d1801205009","resolution":{"observed_at":"2026-05-22T07:21:13.225391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":"2508.18265","doi":"10.48550/arxiv.2508.18265","metadata_source":"pith","pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","venue":"cs.CV","work_id":"b8f5e260-fff5-444e-bcf5-2c42cfefd83d","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:ee80213f47cfc179d798e43ad2eebbe6b6adb5633ac08d16d1996b45401729ff","observation_id":"cf529906-fa32-4aab-b958-28592168f03a","resolution":{"observed_at":"2026-05-22T07:21:13.239247Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videoagent: Long-form video understanding with large language model as agent","venue":null,"work_id":"e42ea18d-74d3-42c1-b3f7-c8cf9ef1b5e1","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:b9541b51b50f3559216d6cdfbdc1652d5c562d4a7da2dad5b547bb8bf7597e95","observation_id":"2dda01c6-f905-474d-b6e8-4ed73230c145","resolution":{"observed_at":"2026-05-22T07:21:14.613815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12386","last_updated":"2025-07-13T18:57:17Z","snapshot_observed_at":"2026-08-05T00:52:07.112592Z","submitted_at":"2025-01-21T18:59:00Z","title":"InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling","version":3},"cited_work":{"arxiv_id":"2501.12386","doi":"10.48550/arxiv.2501.12386","metadata_source":"pith","pith_arxiv_id":"2501.12386","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling","venue":"cs.CV","work_id":"5801b83f-d5f4-4020-bad2-4bc47f71fe7d","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2501.12386","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:6e6dcc37e0417940839426adf354a6108c2b4276fe0e39fdab9ed4720f745661","observation_id":"bf36e788-09c0-43e7-8528-2b51fd61e1ed","resolution":{"observed_at":"2026-05-22T07:21:13.185135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.06097","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:28:32.169031Z","title":"Videochat-a1: Thinking with long videos by chain-of-shot reasoning","venue":null,"work_id":"e8d8636e-0ca2-480e-87ef-352a1b6631c8","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:c746520eb049d731e2ef77284d4701a9152bf91d1a7975ccdae992671c964abb","observation_id":"fcb46db8-ca8e-4b40-8810-bbc67439016b","resolution":{"observed_at":"2026-05-22T07:21:13.248852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videotree: Adaptive tree-based video representation for llm reasoning on long videos","venue":null,"work_id":"5d8e08d5-b87b-4ad2-b5fa-d66b2ce42d78","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:eb129f10d05d131f466fb97c078ea2b6f56e2f0204c48301392d270258d18e09","observation_id":"c011934e-e4a6-4bcb-b1c5-839b29a33695","resolution":{"observed_at":"2026-05-22T07:21:14.602442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Longvlm: Efficient long video understand- ing via large language models","venue":null,"work_id":"358ae16a-0dc9-4a00-8161-1928d0b82b8b","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:0405244eebc5c660e3948fa3988bb4b52264ae63232a1ab8ef635ff3a08907c0","observation_id":"d0d419aa-88e2-4df5-af3e-3e58681b2410","resolution":{"observed_at":"2026-05-22T07:21:14.598984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"eb7836ce-eac0-49cc-bc34-5a8157b4b80a","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:6dd15826e2d20d716dc08a6993c93a9a5ca9b4ed9dec0c687977695718ed32e1","observation_id":"69ea27b5-249d-4e79-93ec-380aaa7089fd","resolution":{"observed_at":"2026-05-22T07:21:14.589088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Next-qa: Next phase of question-answering to explaining temporal actions","venue":null,"work_id":"f0084c49-fdb5-486b-a6bc-ec11e3d71516","year":2021},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:54630252647bf2b2785e64f21b4f2a48c26328be26da64ed3547e385981a5c09","observation_id":"97b736e7-2cfd-4019-a811-bd6572a6b774","resolution":{"observed_at":"2026-05-22T07:21:14.585766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videoqa in the era of llms: An empirical study.International Journal of Computer Vi- sion, 133(7):3970–3993","venue":null,"work_id":"a85c6ad1-4c58-483c-bd4a-9fc2b296bbb8","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:556c5986a368cc78244838ca8abe5facd4be18a12104005b50a666a5391b645c","observation_id":"551801b3-427e-4510-8928-626f655cc50f","resolution":{"observed_at":"2026-05-22T07:21:14.592604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unleashing the power of llms for medical video answer localization","venue":null,"work_id":"78531f60-af3f-43f6-97ce-92bb52dcc402","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:81434436b03e2f8bf5d4c5a9e4c75404e2f09b2547bc7b97986b3cf1251470d3","observation_id":"291d701a-1627-4e1f-af12-8960d57ab3e1","resolution":{"observed_at":"2026-05-22T07:21:14.578509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video question answer- ing via gradually refined attention over appearance and mo- tion","venue":null,"work_id":"29d60f86-f0bc-4968-9450-97de30059780","year":2017},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:e3e3263ec539c1ae6e4b8300a1b7846cad8b693268af4f6bf2586288d00ccefe","observation_id":"b49c3d7f-a602-4830-a94c-533543d45598","resolution":{"observed_at":"2026-05-22T07:21:14.573793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16994","last_updated":"2024-04-29T14:52:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T19:29:55Z","title":"PLLaVA : Parameter-free LLaVA Extension from Images to Videos for Video Dense Captioning","version":2},"cited_work":{"arxiv_id":"2404.16994","doi":"10.48550/arxiv.2404.16994","metadata_source":"pith","pith_arxiv_id":"2404.16994","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PLLaVA : Parameter-free LLaVA Extension from Images to Videos for Video Dense Captioning","venue":"cs.CV","work_id":"8949d4db-20f2-47c1-83a6-fcbe041b62ef","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2404.16994","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:2761e61ced98ed3b261b286811ce3005ea7a05696b7b4805465828042c6edf3a","observation_id":"55609626-adcd-46cd-88ff-eb6783f7d384","resolution":{"observed_at":"2026-05-22T07:21:13.229626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.09608","last_updated":"2025-10-10T17:59:58Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-10T17:59:58Z","title":"StreamingVLM: Real-Time Understanding for Infinite Video Streams","version":1},"cited_work":{"arxiv_id":"2510.09608","doi":"10.48550/arxiv.2510.09608","metadata_source":"pith","pith_arxiv_id":"2510.09608","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StreamingVLM: Real-Time Understanding for Infinite Video Streams","venue":"cs.CV","work_id":"e6785f4f-90d8-45ab-8e34-1a406ea2db88","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2510.09608","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:ab9e7e795121ff8ca5ce2e8f0bb60ed379f5d7a75fd67c3f355c78ea430bf4f1","observation_id":"cd37c81d-61b9-4404-a76b-cf719321fb94","resolution":{"observed_at":"2026-05-22T07:21:13.201067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:464a39c9e0b8ea924d6845e5585a2b1b67e542fae2bc861c34d4a55e1c92c349","observation_id":"99402878-9b5f-4874-aa84-faf21aaf5fc9","resolution":{"observed_at":"2026-05-22T07:21:13.180275Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15717","last_updated":"2025-08-21T16:56:29Z","snapshot_observed_at":"2026-08-04T15:51:47.648176Z","submitted_at":"2025-08-21T16:56:29Z","title":"StreamMem: Query-Agnostic KV Cache Memory for Streaming Video Understanding","version":1},"cited_work":{"arxiv_id":"2508.15717","doi":"10.48550/arxiv.2508.15717","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15717","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Streammem: Query-agnostic kv cache memory for stream- ing video understanding.arXiv preprint arXiv:2508.15717","venue":"ArXiv.org","work_id":"752bf839-d545-4378-a68d-4a958ba10cee","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2508.15717","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:4d1de6eddc055847976fb464e08c62c9c7c8ab5b6df597e8c0ca8be197d8556d","observation_id":"6628c57b-9336-400a-b86a-95d6822793db","resolution":{"observed_at":"2026-05-22T07:21:13.162351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Activitynet-qa: A dataset for understanding complex web videos via question answering","venue":null,"work_id":"30fbd36b-820c-41bd-9aa9-8d83d631f5a2","year":2019},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:4466029ade744359ed48fdab8831c8d3d0dc779d979a6546553f93763651c901","observation_id":"1e15930b-668f-4629-b693-018775e1bacf","resolution":{"observed_at":"2026-05-22T07:21:14.570323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Socratic models: Composing zero-shot multimodal reasoning with language","venue":null,"work_id":"e47c5994-e7b1-469c-9a59-cbebe8ad60d8","year":null},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:9d091b7e8d02557c707dbdebaa210876bbdc5ae8929e49b88a8c1589820a3be9","observation_id":"51f1d8a0-4f7e-4669-b215-4aa338b27296","resolution":{"observed_at":"2026-05-22T07:21:14.581986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13106","last_updated":"2025-06-03T03:33:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T18:59:46Z","title":"VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding","version":4},"cited_work":{"arxiv_id":"2501.13106","doi":"10.48550/arxiv.2501.13106","metadata_source":"pith","pith_arxiv_id":"2501.13106","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding","venue":"cs.CV","work_id":"38f52461-37fd-4266-bc46-9dea31be2824","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2501.13106","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:6d88f580c5339b1cfc574f26f7fddad6bcb377c66d77b9900faf020a4507eed6","observation_id":"a4b2eb10-8254-4afe-9eb6-bf7a245d332a","resolution":{"observed_at":"2026-05-22T07:21:13.175600Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"cf679928-f745-4141-9e8c-7bf4c5bafeab","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:7dbbdc915f85ff3eb63c696ad5730982a2ef5adbdbf20133cc7f96e5df64ca58","observation_id":"3bacab6a-b5c9-4eed-8c17-e716b8d675c1","resolution":{"observed_at":"2026-05-22T07:21:14.566770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-07-06T15:38:39.712379Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":"2306.02858","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-07-04T16:29:57.761121Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","venue":"cs.CL","work_id":"555cf04a-49a7-44b8-9019-a83ce85ace95","year":2023},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:667961cd9f648e4a07af51a1bb6326a829d984f0c1d1e393fd4cca14b0a2ef04","observation_id":"212bcabf-15f2-42fc-9d1f-28eae45cda23","resolution":{"observed_at":"2026-05-22T07:21:13.195740Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flash-vstream: Memory- based real-time understanding for long video streams.ICCV","venue":null,"work_id":"ac65c9bb-9ccc-4014-b2a9-8b38c7bdbeb4","year":null},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:c073d9a98601c28cee5e5a5fb6fb5ad2ace5539da2d83ce34361822f7fc12c36","observation_id":"d250c4d7-474d-49d6-9da9-2c345d28a825","resolution":{"observed_at":"2026-05-22T07:21:14.595603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":"2406.16852","doi":"10.48550/arxiv.2406.16852","metadata_source":"pith","pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Long Context Transfer from Language to Vision","venue":"cs.CV","work_id":"52f1b946-568f-4819-9d8a-a87296f8852d","year":2024},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:39a7246ba3e52700a63ffcfdea5e094e4cb53d614bc5d0845d50113cda03988e","observation_id":"cacf7c82-db82-4615-8625-563b629ee5cb","resolution":{"observed_at":"2026-05-22T07:21:13.259289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mlvu: Benchmarking multi-task long video understanding","venue":null,"work_id":"f5e0000f-f8e1-469b-950b-f9d01a9646fa","year":2025},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:211a12362924442fd79126d7c9990cd9fdd7b2844051192797cf6018a1d7e555","observation_id":"ad2eac76-8dcb-4c7f-a80c-2cb14fce30c7","resolution":{"observed_at":"2026-05-22T07:21:14.655074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What is the person holding right now?","venue":null,"work_id":"ec16078b-2338-4319-9a59-dc2cb15ad687","year":null},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:c079f4d486371712d4307a2860cdd42ef7e4187a0a4c8451a309021e54564f77","observation_id":"461620b9-6954-48d2-98df-5faed5f8a491","resolution":{"observed_at":"2026-05-22T07:21:14.647143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f14734e8-2436-4ee3-9853-d4f79b2aaca7","year":2048},"citing_paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T07:16:33.817183Z"},"links":{"citing_paper":"/paper/2605.22269"},"observation_digest":"sha256:7dd5862c1b109a9541d6d096b7ec62f52dd9a9681243731bdb47b750cea129fa","observation_id":"8602b304-783d-4946-b1a4-d8ef17a4e380","resolution":{"observed_at":"2026-05-22T07:21:14.563576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.22269","last_updated":"2026-05-21T10:13:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T11:53:00.337572Z","submitted_at":"2026-05-21T10:13:03Z","title":"MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":1,"verified_exact":25,"verified_fuzzy":35},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2605.22269."}