{"as_of":"2026-08-05T13:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3de7e97c5b86394bd3d0d075d42c6700cc5eff66e41b729c58466b9c81737942","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T03:21:44.094823Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T19:07:17.481649Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.12769","last_updated":"2025-03-17T03:05:31Z","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T03:05:31Z","title":"ViSpeak: Visual Instruction Feedback in Streaming Videos","version":1},"cited_work":{"arxiv_id":"2503.12769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12769","snapshot_observed_at":"2026-07-02T19:07:17.481649Z","title":"Vispeak: Visual instruction feedback in streaming videos","venue":null,"work_id":"ff02f96e-6220-439c-a2d7-ebe7d4b79876","year":2025},"citing_paper":{"arxiv_id":"2512.01707","last_updated":"2026-05-13T04:12:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-01T14:15:44Z","title":"StreamGaze: Gaze-Guided Temporal Reasoning and Proactive Understanding in Streaming Videos","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T02:49:12.987772Z"},"links":{"cited_paper":"/paper/2503.12769","citing_paper":"/paper/2512.01707"},"observation_digest":"sha256:cacc947386138bb9476dba8b6f6be59ae22f96765b70e755556676c2aa887dce","observation_id":"b09d52e4-25f3-43c1-b130-33c9e61191ff","resolution":{"observed_at":"2026-05-17T02:51:28.106200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12769","last_updated":"2025-03-17T03:05:31Z","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T03:05:31Z","title":"ViSpeak: Visual Instruction Feedback in Streaming Videos","version":1},"cited_work":{"arxiv_id":"2503.12769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12769","snapshot_observed_at":"2026-07-02T19:07:17.481649Z","title":"Vispeak: Visual instruction feedback in streaming videos","venue":null,"work_id":"ff02f96e-6220-439c-a2d7-ebe7d4b79876","year":2025},"citing_paper":{"arxiv_id":"2603.20633","last_updated":"2026-04-17T08:57:17Z","snapshot_observed_at":"2026-07-06T22:49:57.103822Z","submitted_at":"2026-03-21T04:03:45Z","title":"Seed1.8 Model Card: Towards Generalized Real-World Agency","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T07:44:02.827006Z"},"links":{"cited_paper":"/paper/2503.12769","citing_paper":"/paper/2603.20633"},"observation_digest":"sha256:f073ef4204f9c2f7d06bddf4d2d5c28906b04a3b30ebd40bc34c719df4861d5c","observation_id":"dba0ab46-dda6-4f6a-96ca-fc34129fa3eb","resolution":{"observed_at":"2026-05-15T07:45:14.469150Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12769","last_updated":"2025-03-17T03:05:31Z","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T03:05:31Z","title":"ViSpeak: Visual Instruction Feedback in Streaming Videos","version":1},"cited_work":{"arxiv_id":"2503.12769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12769","snapshot_observed_at":"2026-07-02T19:07:17.481649Z","title":"Vispeak: Visual instruction feedback in streaming videos","venue":null,"work_id":"ff02f96e-6220-439c-a2d7-ebe7d4b79876","year":2025},"citing_paper":{"arxiv_id":"2604.24317","last_updated":"2026-04-27T11:07:03Z","snapshot_observed_at":"2026-07-06T23:10:24.992210Z","submitted_at":"2026-04-27T11:07:03Z","title":"Don't Pause! Every prediction matters in a streaming video","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T04:32:01.379605Z"},"links":{"cited_paper":"/paper/2503.12769","citing_paper":"/paper/2604.24317"},"observation_digest":"sha256:5a29148c0672992c55eac81b98878e9b301ebe3b71c39a3c3a23584ecf03c369","observation_id":"2e49beec-9862-40ba-82d5-46d57153ac7a","resolution":{"observed_at":"2026-05-11T21:41:17.900650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12769","last_updated":"2025-03-17T03:05:31Z","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T03:05:31Z","title":"ViSpeak: Visual Instruction Feedback in Streaming Videos","version":1},"cited_work":{"arxiv_id":"2503.12769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12769","snapshot_observed_at":"2026-07-02T19:07:17.481649Z","title":"Vispeak: Visual instruction feedback in streaming videos","venue":null,"work_id":"ff02f96e-6220-439c-a2d7-ebe7d4b79876","year":2025},"citing_paper":{"arxiv_id":"2605.01858","last_updated":"2026-05-03T13:02:44Z","snapshot_observed_at":"2026-07-06T23:15:01.968194Z","submitted_at":"2026-05-03T13:02:44Z","title":"Decouple and Cache: KV Cache Construction for Streaming Video Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T14:47:54.917408Z"},"links":{"cited_paper":"/paper/2503.12769","citing_paper":"/paper/2605.01858"},"observation_digest":"sha256:8347d3dfe181a2ba91b0b576f6f21e962cd51fe7cf8657140306828ce281691a","observation_id":"c43ba94c-104b-4986-8759-33939e277c70","resolution":{"observed_at":"2026-05-11T11:31:03.582625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12769","last_updated":"2025-03-17T03:05:31Z","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T03:05:31Z","title":"ViSpeak: Visual Instruction Feedback in Streaming Videos","version":1},"cited_work":{"arxiv_id":"2503.12769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12769","snapshot_observed_at":"2026-07-02T19:07:17.481649Z","title":"Vispeak: Visual instruction feedback in streaming videos","venue":null,"work_id":"ff02f96e-6220-439c-a2d7-ebe7d4b79876","year":2025},"citing_paper":{"arxiv_id":"2606.06991","last_updated":"2026-06-05T07:29:20Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T07:29:20Z","title":"Don't Pause: Streaming Video-Language Synchrony for Online Video Understanding","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-27T22:11:01.690237Z"},"links":{"cited_paper":"/paper/2503.12769","citing_paper":"/paper/2606.06991"},"observation_digest":"sha256:ada7997d79ded277f6fab8814e9741bc75a39567012aefaade7505021990110e","observation_id":"52daadf1-6945-4010-b379-dc782656f36c","resolution":{"observed_at":"2026-07-02T17:07:12.853502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12769","last_updated":"2025-03-17T03:05:31Z","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T03:05:31Z","title":"ViSpeak: Visual Instruction Feedback in Streaming Videos","version":1},"cited_work":{"arxiv_id":"2503.12769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12769","snapshot_observed_at":"2026-07-02T19:07:17.481649Z","title":"Vispeak: Visual instruction feedback in streaming videos","venue":null,"work_id":"ff02f96e-6220-439c-a2d7-ebe7d4b79876","year":2025},"citing_paper":{"arxiv_id":"2607.00248","last_updated":"2026-06-30T22:57:43Z","snapshot_observed_at":"2026-08-03T15:00:12.134373Z","submitted_at":"2026-06-30T22:57:43Z","title":"Seed2.0 Model Card: Towards Intelligence Frontier for Real-World Complexity","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-02T18:57:46.841456Z"},"links":{"cited_paper":"/paper/2503.12769","citing_paper":"/paper/2607.00248"},"observation_digest":"sha256:3b056b518bb96ce125a3f8dbdb1fd58c44f6c94accafc9e7a78ab51f823f94da","observation_id":"b5c9ce37-0440-4dba-9c07-7e5f9c80280b","resolution":{"observed_at":"2026-07-02T19:07:17.483090Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12769","last_updated":"2025-03-17T03:05:31Z","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T03:05:31Z","title":"ViSpeak: Visual Instruction Feedback in Streaming Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12769","snapshot_observed_at":"2026-08-04T03:21:44.094823Z","title":"arXiv:2503.12769","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28312","last_updated":"2026-08-01T16:00:11Z","snapshot_observed_at":"2026-08-05T13:23:08.266631Z","submitted_at":"2026-07-30T14:47:00Z","title":"ObjectStream: Latent Objects as Memory Anchors for Streaming Video Understanding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T03:21:44.094823Z"},"links":{"cited_paper":"/paper/2503.12769","citing_paper":"/paper/2607.28312"},"observation_digest":"sha256:f3c5d66c75117978ea6b646d39fd0ee227e2f2c8a24be1585af5f4f263c739f1","observation_id":"984293e1-8d30-48b1-9d06-5b80680846ba","resolution":{"observed_at":"2026-08-04T03:21:44.094823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.12769/citation-record","integrity":"/paper/2503.12769/integrity","json":"/paper/2503.12769/citation-record.json","paper":"/paper/2503.12769"},"outbound":[],"paper":{"arxiv_id":"2503.12769","last_updated":"2025-03-17T03:05:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T03:05:31Z","title":"ViSpeak: Visual Instruction Feedback in Streaming Videos"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2503.12769."}