{"as_of":"2026-08-07T23:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a02181f2becde9ce47c3b200210bfaf0391af53b9b334f737e7de1d36f9559e2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:57:53.167691Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:48:03.011665Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":"2312.17235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-07-03T10:48:03.011665Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"4432e401-22bc-40ec-aee7-e835bf80f547","year":2023},"citing_paper":{"arxiv_id":"2404.16994","last_updated":"2024-04-29T14:52:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T19:29:55Z","title":"PLLaVA : Parameter-free LLaVA Extension from Images to Videos for Video Dense Captioning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T20:21:57.873354Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2404.16994"},"observation_digest":"sha256:c7d9c2154b21d2efbc3743cabba7d68c46f46273fd9d0fd85c3b3fee722cd64e","observation_id":"df1358d4-cea1-4665-8cf1-34ee1e4e3d41","resolution":{"observed_at":"2026-05-15T20:21:58.044985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":"2312.17235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-07-03T10:48:03.011665Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"4432e401-22bc-40ec-aee7-e835bf80f547","year":2023},"citing_paper":{"arxiv_id":"2407.03320","last_updated":"2024-07-03T17:59:21Z","snapshot_observed_at":"2026-08-04T22:09:42.241578Z","submitted_at":"2024-07-03T17:59:21Z","title":"InternLM-XComposer-2.5: A Versatile Large Vision Language Model Supporting Long-Contextual Input and Output","version":1},"reference_index":172,"source":"pdf_text","source_observed_at":"2026-05-17T10:46:28.447347Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2407.03320"},"observation_digest":"sha256:7434089a0bb53af852cb0d1bce680c8991d12913adeb1ba4b87c4df39765d1bc","observation_id":"5fbec168-da9c-4c0f-8ff8-5d4de93b152a","resolution":{"observed_at":"2026-05-17T10:46:28.857614Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-08-07T14:57:53.167691Z","title":"A sim- ple llm framework for long-range video question-answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16784","last_updated":"2025-06-08T02:36:43Z","snapshot_observed_at":"2026-08-07T14:52:57.917127Z","submitted_at":"2025-05-22T15:27:31Z","title":"Four Eyes Are Better Than Two: Harnessing the Collaborative Potential of Large Models via Differentiated Thinking and Complementary Ensembles","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:53.167691Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2505.16784"},"observation_digest":"sha256:81f85f28788138d863057cdc8f7503ac552c45c0cd130f6ccf52de8b1923ff26","observation_id":"d88c3ee7-3d28-4528-8fc2-6a4f70996126","resolution":{"observed_at":"2026-08-07T14:57:53.167691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-08-07T13:52:47.594214Z","title":"A sim- ple llm framework for long-range video question-answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20644","last_updated":"2025-05-27T02:45:14Z","snapshot_observed_at":"2026-08-07T13:47:38.739847Z","submitted_at":"2025-05-27T02:45:14Z","title":"HCQA-1.5 @ Ego4D EgoSchema Challenge 2025","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:52:47.594214Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2505.20644"},"observation_digest":"sha256:00ca591838d1ee374fe9ac991ed21c9192dcc1ed0c54add99af5c9553c0c9049","observation_id":"89b6721f-3457-49b3-88e1-24ab7fba52b6","resolution":{"observed_at":"2026-08-07T13:52:47.594214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-08-06T23:29:26.732647Z","title":"A simple LLM framework for long-range video question-answering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18071","last_updated":"2025-06-27T06:32:43Z","snapshot_observed_at":"2026-08-06T23:21:00.317883Z","submitted_at":"2025-06-22T15:39:02Z","title":"MUPA: Towards Multi-Path Agentic Reasoning for Grounded Video Question Answering","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:29:26.732647Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2506.18071"},"observation_digest":"sha256:0ee39020ca41d6db309704dca7812850f76fad5162889afca21ea0b654a6e9be","observation_id":"0cd89e7c-11c0-45cd-8bc6-4f53a320ddf1","resolution":{"observed_at":"2026-08-06T23:29:26.732647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-08-06T20:29:56.959356Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02591","last_updated":"2025-07-23T07:25:27Z","snapshot_observed_at":"2026-08-07T06:17:01.457380Z","submitted_at":"2025-07-03T12:55:16Z","title":"AuroraLong: Bringing RNNs Back to Efficient Open-Ended Video Understanding","version":3},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:56.959356Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2507.02591"},"observation_digest":"sha256:9fa04c52646e1426a5f4c0b28b6a7e8722c32e9268481df738d63a4cb24aba20","observation_id":"d6452b5a-89f2-4f23-9ca3-fe3a857482c8","resolution":{"observed_at":"2026-08-06T20:29:56.959356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-08-06T15:53:36.153446Z","title":"Zhang, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14784","last_updated":"2025-08-18T09:06:46Z","snapshot_observed_at":"2026-08-06T15:45:28.332431Z","submitted_at":"2025-07-20T01:57:00Z","title":"LeAdQA: LLM-Driven Context-Aware Temporal Grounding for Video Question Answering","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T15:53:36.153446Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2507.14784"},"observation_digest":"sha256:60f7787eb465141d3c39f9fe34b081785c6aea9fa252f1afc0b177d33bd7f61a","observation_id":"cd904f4d-844d-430f-a3a9-23449a5f5372","resolution":{"observed_at":"2026-08-06T15:53:36.153446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-08-06T04:49:42.312571Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03039","last_updated":"2025-08-05T03:33:24Z","snapshot_observed_at":"2026-08-07T14:34:47.687957Z","submitted_at":"2025-08-05T03:33:24Z","title":"VideoForest: Person-Anchored Hierarchical Reasoning for Cross-Video Question Answering","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T04:49:42.312571Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2508.03039"},"observation_digest":"sha256:a729d60cd9e39ca1cd36e42328456448134b84f6630116f600d63194ae68e768","observation_id":"34e11361-29a3-4833-90e7-58ddcf13c67e","resolution":{"observed_at":"2026-08-06T04:49:42.312571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-08-04T21:27:33.767446Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07680","last_updated":"2025-09-09T17:59:39Z","snapshot_observed_at":"2026-08-04T21:27:30.632810Z","submitted_at":"2025-09-09T17:59:39Z","title":"CAViAR: Critic-Augmented Video Agentic Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T21:27:33.767446Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2509.07680"},"observation_digest":"sha256:6cbbedcf2196e006a4587e2edd40a89747a6958ed7661f0e8f9107b7a1487a85","observation_id":"4c6df0f6-e239-4eee-b50c-4bf0e9b1d78f","resolution":{"observed_at":"2026-08-04T21:27:33.767446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":"2312.17235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-07-03T10:48:03.011665Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"4432e401-22bc-40ec-aee7-e835bf80f547","year":2023},"citing_paper":{"arxiv_id":"2509.24943","last_updated":"2026-05-06T06:07:38Z","snapshot_observed_at":"2026-07-06T22:31:05.409865Z","submitted_at":"2025-09-29T15:42:55Z","title":"Perceive, Verify and Understand Long Video: Multi-Granular Perception and Active Verification via Interactive Agents","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-18T12:40:19.544260Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2509.24943"},"observation_digest":"sha256:f3c8b43d23d92fbc5f97592654b15345c984fb91423684177a94124aa1633ac6","observation_id":"cea25f6f-a7db-49e6-bb95-189a99b560d1","resolution":{"observed_at":"2026-05-18T12:41:22.621623Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":"2312.17235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-07-03T10:48:03.011665Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"4432e401-22bc-40ec-aee7-e835bf80f547","year":2023},"citing_paper":{"arxiv_id":"2511.11113","last_updated":"2026-04-20T07:37:36Z","snapshot_observed_at":"2026-07-31T14:35:45.739240Z","submitted_at":"2025-11-14T09:42:42Z","title":"VIDEOP2R: Video Understanding from Perception to Reasoning","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-17T22:24:41.760120Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2511.11113"},"observation_digest":"sha256:790f43e56cacc826ad941f31ca8b86ee524a019a821750576884189104d2b3c5","observation_id":"b693d7da-96f3-4119-aeba-636ba2d90386","resolution":{"observed_at":"2026-05-17T22:25:22.682531Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-08-02T23:33:16.311655Z","title":"A simple llm framework for long-range video question-answering.arXiv preprint arXiv:2312.17235, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.13602","last_updated":"2026-05-30T00:19:02Z","snapshot_observed_at":"2026-08-02T23:33:07.026705Z","submitted_at":"2026-02-14T04:52:11Z","title":"Towards Sparse Video Understanding and Reasoning","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T23:33:16.311655Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2602.13602"},"observation_digest":"sha256:0a1b45f20c3389ea0ff431d86de4fe46e6ada70ff1fef5d9becd1c3c347a6486","observation_id":"39f82adb-aefa-44aa-b2f5-9b44fd964678","resolution":{"observed_at":"2026-08-02T23:33:16.311655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":"2312.17235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-07-03T10:48:03.011665Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"4432e401-22bc-40ec-aee7-e835bf80f547","year":2023},"citing_paper":{"arxiv_id":"2604.02891","last_updated":"2026-04-03T09:00:38Z","snapshot_observed_at":"2026-07-06T22:52:10.923214Z","submitted_at":"2026-04-03T09:00:38Z","title":"Progressive Video Condensation with MLLM Agent for Long-form Video Understanding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T20:40:41.380829Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2604.02891"},"observation_digest":"sha256:a8c6499c10ed675978e5e0f263f3a23ceca86d12ea1c21aa8a283361620b2d10","observation_id":"290ab08c-93d4-4de8-85c2-b2ab3dc664c7","resolution":{"observed_at":"2026-05-13T20:43:14.889680Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":"2312.17235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-07-03T10:48:03.011665Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"4432e401-22bc-40ec-aee7-e835bf80f547","year":2023},"citing_paper":{"arxiv_id":"2604.23145","last_updated":"2026-04-25T05:07:43Z","snapshot_observed_at":"2026-08-03T01:16:00.979324Z","submitted_at":"2026-04-25T05:07:43Z","title":"UpstreamQA: A Modular Framework for Explicit Reasoning on Video Question Answering Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T08:41:42.061219Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2604.23145"},"observation_digest":"sha256:ff6806c30382729286d51666de6a0dedada75e90cb468e2e5f6d21304fcc4afc","observation_id":"488288cd-eb57-4fc0-a317-92bbea7afcb2","resolution":{"observed_at":"2026-05-11T20:31:13.224993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":"2312.17235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-07-03T10:48:03.011665Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"4432e401-22bc-40ec-aee7-e835bf80f547","year":2023},"citing_paper":{"arxiv_id":"2606.05748","last_updated":"2026-06-04T06:20:23Z","snapshot_observed_at":"2026-07-06T23:45:42.379051Z","submitted_at":"2026-06-04T06:20:23Z","title":"UNIVID: Unified Vision-Language Model for Video Moderation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-27T22:56:26.674841Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2606.05748"},"observation_digest":"sha256:949d235b04c7a4d67cab694f7c3d7a4e604071742bb2b05a9c3c45b7f05714e6","observation_id":"058c212c-0e18-4f04-9a59-49c33874108f","resolution":{"observed_at":"2026-07-02T16:07:09.283746Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":"2312.17235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-07-03T10:48:03.011665Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"4432e401-22bc-40ec-aee7-e835bf80f547","year":2023},"citing_paper":{"arxiv_id":"2606.12195","last_updated":"2026-06-10T15:17:08Z","snapshot_observed_at":"2026-08-01T02:09:41.655807Z","submitted_at":"2026-06-10T15:17:08Z","title":"InternVideo3: Agentify Foundation Models with Multimodal Contextual Reasoning","version":1},"reference_index":170,"source":"arxiv_source","source_observed_at":"2026-06-27T09:48:27.652901Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2606.12195"},"observation_digest":"sha256:b3d4b6f9ae7adfe37777a44dbbd6a625cb996c2a3fe7ba64a3da2e45ae6f7319","observation_id":"4760a439-14da-41c5-b5d7-935380a77d67","resolution":{"observed_at":"2026-07-03T10:48:03.012988Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering","version":3},"cited_work":{"arxiv_id":"2312.17235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17235","snapshot_observed_at":"2026-07-03T10:48:03.011665Z","title":"A simple llm framework for long-range video question-answering","venue":null,"work_id":"4432e401-22bc-40ec-aee7-e835bf80f547","year":2023},"citing_paper":{"arxiv_id":"2606.29472","last_updated":"2026-06-28T15:59:31Z","snapshot_observed_at":"2026-08-01T16:45:40.105247Z","submitted_at":"2026-06-28T15:59:31Z","title":"Agent-Computer Observation Interfaces Enable Dynamic Computer Use","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T06:59:20.295818Z"},"links":{"cited_paper":"/paper/2312.17235","citing_paper":"/paper/2606.29472"},"observation_digest":"sha256:e3de2dad26de0cfcdb6ce691116b556005342c75d2e732f18603cee2aee5378c","observation_id":"5edf0bcf-564c-4d65-9551-ccf929071349","resolution":{"observed_at":"2026-06-30T07:04:21.233670Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2312.17235/citation-record","integrity":"/paper/2312.17235/integrity","json":"/paper/2312.17235/citation-record.json","paper":"/paper/2312.17235"},"outbound":[],"paper":{"arxiv_id":"2312.17235","last_updated":"2024-10-10T05:17:00Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T17:09:24.271573Z","submitted_at":"2023-12-28T18:58:01Z","title":"A Simple LLM Framework for Long-Range Video Question-Answering"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2312.17235."}