{"as_of":"2026-08-06T21:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c02c120627a14bfbb997587f69d7028af6f6dedd4b3543d9f8f22d80c22a8ca9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:44:03.238976Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T18:23:51.007381Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-08-06T20:44:03.238976Z","title":"Videollamb: Long-context video understanding with recur- rent memory bridges","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01945","last_updated":"2025-07-09T16:30:21Z","snapshot_observed_at":"2026-08-06T20:37:19.917083Z","submitted_at":"2025-07-02T17:55:50Z","title":"LongAnimation: Long Animation Generation with Dynamic Global-Local Memory","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:44:03.238976Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2507.01945"},"observation_digest":"sha256:21d574e1057019c614e59b5d23c87cbd4a150581294ca386f73478af2c8f332d","observation_id":"ca68543e-d87a-4c79-9db9-02a69d12bdf8","resolution":{"observed_at":"2026-08-06T20:44:03.238976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-08-06T18:32:49.423515Z","title":"Videollamb: Long-context video understanding with recur- rent memory bridges","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07990","last_updated":"2025-07-10T17:59:02Z","snapshot_observed_at":"2026-08-06T18:25:29.869749Z","submitted_at":"2025-07-10T17:59:02Z","title":"Multi-Granular Spatio-Temporal Token Merging for Training-Free Acceleration of Video LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:32:49.423515Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2507.07990"},"observation_digest":"sha256:0c87d15a38af03268c19187830cdcb268de9b814f1a16ad4cf4b9a4471fcb170","observation_id":"0778abac-b905-4d0b-ab9a-8dd7e3b71467","resolution":{"observed_at":"2026-08-06T18:32:49.423515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-08-06T00:00:03.754369Z","title":"Videollamb: Long-context video understanding with recur- rent memory bridges.arXiv preprint arXiv:2409.01071,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04546","last_updated":"2025-08-06T15:33:49Z","snapshot_observed_at":"2026-08-06T00:00:03.003440Z","submitted_at":"2025-08-06T15:33:49Z","title":"Hierarchical Event Memory for Accurate and Low-latency Online Video Temporal Grounding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T00:00:03.754369Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2508.04546"},"observation_digest":"sha256:3b6980b5b0e3fbf111a81d91132de134d39b09e8cfd3fe8eb7edacc82db5fe09","observation_id":"6c2b59d2-197a-469b-83ea-a207d082543a","resolution":{"observed_at":"2026-08-06T00:00:03.754369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":"2409.01071","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-06-29T18:23:51.007381Z","title":"Videollamb: Long-context video understanding with recurrent memory bridges","venue":null,"work_id":"59142d11-0f07-4eae-8492-0d831ac73a3c","year":2025},"citing_paper":{"arxiv_id":"2512.08410","last_updated":"2026-04-09T06:44:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-09T09:40:20Z","title":"Towards Effective Long Video Understanding of Multimodal Large Language Models via One-shot Clip Retrieval","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-17T00:10:01.596422Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2512.08410"},"observation_digest":"sha256:b2f44a2fd2d694a60a5d21e9e37e546d8b5880ebc635f14921ddae5931ac8a44","observation_id":"34757533-2a60-48e7-999a-739a0c631ee5","resolution":{"observed_at":"2026-05-17T00:11:23.240739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":"2409.01071","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-06-29T18:23:51.007381Z","title":"Videollamb: Long-context video understanding with recurrent memory bridges","venue":null,"work_id":"59142d11-0f07-4eae-8492-0d831ac73a3c","year":2025},"citing_paper":{"arxiv_id":"2604.25276","last_updated":"2026-04-28T06:34:19Z","snapshot_observed_at":"2026-07-06T23:11:11.827339Z","submitted_at":"2026-04-28T06:34:19Z","title":"OmniVTG: A Large-Scale Dataset and Training Paradigm for Open-World Video Temporal Grounding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-07T16:51:43.783133Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2604.25276"},"observation_digest":"sha256:b608b15e3f60d4613308d7669eef24fb5a8fe4d4202c2b92fa81c0c0895605ef","observation_id":"e7591b8a-679a-4216-abbc-7a52314fdbaa","resolution":{"observed_at":"2026-05-11T23:31:15.734353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":"2409.01071","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-06-29T18:23:51.007381Z","title":"Videollamb: Long-context video understanding with recurrent memory bridges","venue":null,"work_id":"59142d11-0f07-4eae-8492-0d831ac73a3c","year":2025},"citing_paper":{"arxiv_id":"2605.00814","last_updated":"2026-05-08T16:52:48Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-05-01T17:54:37Z","title":"Persistent Visual Memory: Sustaining Perception for Deep Generation in LVLMs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-09T18:53:06.494640Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2605.00814"},"observation_digest":"sha256:0c1eab5e176b6a6f5eff8ff83b236bf358a8622d638814ac054b359ee19a9ef7","observation_id":"43124493-f105-4c02-ba43-63dfd62b2e1f","resolution":{"observed_at":"2026-05-11T16:01:22.477381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":"2409.01071","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-06-29T18:23:51.007381Z","title":"Videollamb: Long-context video understanding with recurrent memory bridges","venue":null,"work_id":"59142d11-0f07-4eae-8492-0d831ac73a3c","year":2025},"citing_paper":{"arxiv_id":"2605.00814","last_updated":"2026-05-08T16:52:48Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-05-01T17:54:37Z","title":"Persistent Visual Memory: Sustaining Perception for Deep Generation in LVLMs","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-11T01:49:15.136031Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2605.00814"},"observation_digest":"sha256:f4c76d27940f33e884cef1f87a86680a2cc73c5f5ff87a0912de5bed9ab869c9","observation_id":"8849df04-aa87-459c-a3cb-00fd24c0c940","resolution":{"observed_at":"2026-05-11T01:50:51.570261Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":"2409.01071","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-06-29T18:23:51.007381Z","title":"Videollamb: Long-context video understanding with recurrent memory bridges","venue":null,"work_id":"59142d11-0f07-4eae-8492-0d831ac73a3c","year":2025},"citing_paper":{"arxiv_id":"2605.27318","last_updated":"2026-07-06T17:18:57Z","snapshot_observed_at":"2026-07-12T15:54:07.137141Z","submitted_at":"2026-05-26T17:26:29Z","title":"Q-GeoMem: Question-Guided Geometric Memory for Video Spatial Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T18:15:28.261185Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2605.27318"},"observation_digest":"sha256:6cd1befc53afc55cbb663c33bb66a621a8396979fd451aa10e2b2e841ed30bb2","observation_id":"7683df80-902e-4954-9ea1-8a540e09be14","resolution":{"observed_at":"2026-06-29T18:23:51.009030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-07-12T15:54:12.909974Z","title":"VideoLLaMB : Long Streaming Video Understanding with Recurrent Memory Bridges","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27318","last_updated":"2026-07-06T17:18:57Z","snapshot_observed_at":"2026-07-12T15:54:07.137141Z","submitted_at":"2026-05-26T17:26:29Z","title":"Q-GeoMem: Question-Guided Geometric Memory for Video Spatial Reasoning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-12T15:54:12.909974Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2605.27318"},"observation_digest":"sha256:12c793f6e6101fd27713fc32af50741a8fb7576bcb0ef0ca1074f1ba9be35710","observation_id":"655297c5-6dfa-4e27-87be-9359489d299e","resolution":{"observed_at":"2026-07-12T15:54:12.909974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-08-01T02:59:25.170043Z","title":"arXiv preprint arXiv:2409.01071 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T02:59:25.170043Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:d8f01f464408af5c8373da114eaf20c914b178004aa420bdfec1c36b3b3780d9","observation_id":"52f8764d-3b52-4ccd-a7a7-1d37855c85b5","resolution":{"observed_at":"2026-08-01T02:59:25.170043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-08-03T01:46:06.891797Z","title":"arXiv preprint arXiv:2409.01071 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.891797Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:859ceed739a05288b90719c4028db9284758f0ab74f0769f252730879fdb8690","observation_id":"94ae74b1-982f-4230-ac96-898394411722","resolution":{"observed_at":"2026-08-03T01:46:06.891797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.01071/citation-record","integrity":"/paper/2409.01071/integrity","json":"/paper/2409.01071/citation-record.json","paper":"/paper/2409.01071"},"outbound":[],"paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2409.01071."}