{"as_of":"2026-08-10T13:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c49a1df7dc7a626a4fc837a09ce7a43643f32cc8e62dfc0736d6e61fd64852fb","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:03:14.040372Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T05:39:06.193766Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17343","snapshot_observed_at":"2026-08-06T18:03:14.040372Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09313","last_updated":"2025-07-15T11:48:07Z","snapshot_observed_at":"2026-08-09T21:58:49.061689Z","submitted_at":"2025-07-12T15:11:50Z","title":"ProactiveVideoQA: A Comprehensive Benchmark Evaluating Proactive Interactions in Video Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T18:03:14.040372Z"},"links":{"cited_paper":"/paper/2504.17343","citing_paper":"/paper/2507.09313"},"observation_digest":"sha256:3243b5f86610ad724bf9d0f93ccde6b3bbe380135b009db08455dc5eb163864d","observation_id":"46f8794c-4d6e-4420-8c39-7195e583ed0c","resolution":{"observed_at":"2026-08-06T18:03:14.040372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17343","snapshot_observed_at":"2026-08-06T15:38:44.871097Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.871097Z"},"links":{"cited_paper":"/paper/2504.17343","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:d61e2a7a54c0332e80c46dafa5f29240773ee2c8cb6eae53017a7c7320c7f0b3","observation_id":"d938463f-64c3-4ad2-8bb0-0f1ac0dd97a6","resolution":{"observed_at":"2026-08-06T15:38:44.871097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos","version":1},"cited_work":{"arxiv_id":"2504.17343","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.17343","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Timechat-online: 80% visual tokens are naturally redundant in streaming videos","venue":null,"work_id":"9ac6613c-204a-45e0-b458-fa6ab43cc0ab","year":2025},"citing_paper":{"arxiv_id":"2511.21998","last_updated":"2026-04-12T05:29:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-27T00:54:35Z","title":"Can Multi-Modal LLMs Provide Live Step-by-Step Task Guidance?","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-17T05:36:09.208754Z"},"links":{"cited_paper":"/paper/2504.17343","citing_paper":"/paper/2511.21998"},"observation_digest":"sha256:dfd919d80126e7935874e35e8e36b07d5951d5f4a92df2baeb58726928b7c155","observation_id":"61ad33aa-d5bb-43aa-bcbf-ce181d58f477","resolution":{"observed_at":"2026-05-17T05:39:06.196486Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos","version":1},"cited_work":{"arxiv_id":"2504.17343","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.17343","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Timechat-online: 80% visual tokens are naturally redundant in streaming videos","venue":null,"work_id":"9ac6613c-204a-45e0-b458-fa6ab43cc0ab","year":2025},"citing_paper":{"arxiv_id":"2601.14724","last_updated":"2026-05-07T12:10:26Z","snapshot_observed_at":"2026-08-05T03:02:47.238051Z","submitted_at":"2026-01-21T07:26:15Z","title":"HERMES: KV Cache as Hierarchical Memory for Efficient Streaming Video Understanding","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T12:55:04.564442Z"},"links":{"cited_paper":"/paper/2504.17343","citing_paper":"/paper/2601.14724"},"observation_digest":"sha256:9a14676ddf2aab514ed167735b4ce69c2211de2f14666fae9532682fe072d724","observation_id":"11abff98-bfa7-4491-9d0d-7670db5d6b1e","resolution":{"observed_at":"2026-05-16T12:57:53.845048Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos","version":1},"cited_work":{"arxiv_id":"2504.17343","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.17343","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Timechat-online: 80% visual tokens are naturally redundant in streaming videos","venue":null,"work_id":"9ac6613c-204a-45e0-b458-fa6ab43cc0ab","year":2025},"citing_paper":{"arxiv_id":"2604.24317","last_updated":"2026-04-27T11:07:03Z","snapshot_observed_at":"2026-07-06T23:10:24.992210Z","submitted_at":"2026-04-27T11:07:03Z","title":"Don't Pause! Every prediction matters in a streaming video","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-08T04:32:01.379605Z"},"links":{"cited_paper":"/paper/2504.17343","citing_paper":"/paper/2604.24317"},"observation_digest":"sha256:1e1dd887e12671614d6340b22152b0635de53ca5afe243bca7e79b8ba35d12e9","observation_id":"c6459779-3754-4260-8941-caf8d2ac18f6","resolution":{"observed_at":"2026-05-11T21:41:18.125769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17343","snapshot_observed_at":"2026-07-31T06:20:14.311583Z","title":"TimeChat-Online: 80% visual tokens are naturally redundant in streaming videos.arXiv preprint arXiv:2504.17343, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24904","last_updated":"2026-07-27T17:59:53Z","snapshot_observed_at":"2026-08-07T06:47:24.083796Z","submitted_at":"2026-07-27T17:59:53Z","title":"Mage-VL: An Efficient Codec-Native Streaming Multimodal Foundation Model","version":1},"reference_index":164,"source":"pdf_text","source_observed_at":"2026-07-31T06:20:14.311583Z"},"links":{"cited_paper":"/paper/2504.17343","citing_paper":"/paper/2607.24904"},"observation_digest":"sha256:2451f457fdbb307aa1a4ef69bc089a0f5d241493e87fc186e0da7757c30e6d71","observation_id":"9a56d4c2-d23a-4179-84b3-a42f9c4c4bc3","resolution":{"observed_at":"2026-07-31T06:20:14.311583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17343","snapshot_observed_at":"2026-08-04T03:21:48.087769Z","title":"TimeChat-Online:80 arXiv:2504.17343","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28312","last_updated":"2026-08-01T16:00:11Z","snapshot_observed_at":"2026-08-06T23:11:29.524233Z","submitted_at":"2026-07-30T14:47:00Z","title":"ObjectStream: Latent Objects as Memory Anchors for Streaming Video Understanding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T03:21:48.087769Z"},"links":{"cited_paper":"/paper/2504.17343","citing_paper":"/paper/2607.28312"},"observation_digest":"sha256:4437f83d8eb2b7e532a9e072be849cf4cabf5da0890d4c91b1de09766a48a3fa","observation_id":"9f90c176-5427-4d24-8ab0-82d7e6cc4a71","resolution":{"observed_at":"2026-08-04T03:21:48.087769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17343","snapshot_observed_at":"2026-08-04T23:46:51.620346Z","title":"Proceedings of the 33rd ACM International Conference on Multimedia (ACM MM) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01644","last_updated":"2026-08-03T03:27:46Z","snapshot_observed_at":"2026-08-08T16:21:27.207921Z","submitted_at":"2026-08-03T03:27:46Z","title":"CRAFT: Compression via Recursive Adaptive Fusion of Video Tokens for Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T23:46:51.620346Z"},"links":{"cited_paper":"/paper/2504.17343","citing_paper":"/paper/2608.01644"},"observation_digest":"sha256:7551495bd9a8c858e494af332d75eba00e53256640d47cf99393d0a195a2ceeb","observation_id":"5571a5f0-8880-4e9d-8541-74175d42959c","resolution":{"observed_at":"2026-08-04T23:46:51.620346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.17343/citation-record","integrity":"/paper/2504.17343/integrity","json":"/paper/2504.17343/citation-record.json","paper":"/paper/2504.17343"},"outbound":[],"paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2504.17343."}