{"as_of":"2026-08-09T00:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e4525309c734b2caf53d1752ca00140ceceba5b1690cdd21d86340f0125ae289","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:43:50.035955Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04866/citation-record","integrity":"/paper/2608.04866/integrity","json":"/paper/2608.04866/citation-record.json","paper":"/paper/2608.04866"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.929766Z","title":null,"venue":null,"work_id":"c99601be-bda7-41d5-b786-d056c6aa2560","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:44.621779Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:95ae91dff7cfe9e902f84a56fbb00389f3e3d440b5c19ab28a38d12c903980d2","observation_id":"ab6a0c98-1ca1-4d45-ab06-e0482924d440","resolution":{"observed_at":"2026-08-06T14:43:53.934169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.914169Z","title":null,"venue":null,"work_id":"19c3c443-df15-48ac-ba04-ab36c44bf713","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:44.683935Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:3da8fdf41636118e4d0f63b213bcd9b5824a633c88991004232617b9c9980671","observation_id":"460741e8-d399-41ea-91ba-d5c84c9991f4","resolution":{"observed_at":"2026-08-06T14:43:53.918980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.899581Z","title":null,"venue":null,"work_id":"79b3186d-c9e5-429e-bc82-df0e16f89120","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:44.796907Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:5dbccae5f03a5690e009d73326bb320deabbf93aba5b0763c24b6518e4628cea","observation_id":"aa5ed60e-394f-4ca0-a06c-2468a0dab98f","resolution":{"observed_at":"2026-08-06T14:43:53.903818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.884258Z","title":null,"venue":null,"work_id":"70118527-055c-45d8-84d9-862ccf6e226c","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:44.901320Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:3b36ffec605343f4394e2b2ea9113c8840ae98c70395ddfe7bcdb6d72bca66d8","observation_id":"d4044472-111d-4e1d-b67f-389f0f6e6d1e","resolution":{"observed_at":"2026-08-06T14:43:53.889089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.868425Z","title":null,"venue":null,"work_id":"88eb8045-8ece-4ac9-be0d-b12fce658a80","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.003815Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:47dae937dae56f313574c39cedc156218662b4c2eb1fee5e46c7f43f0defde34","observation_id":"7264ded5-4efe-4ffd-8500-30e18833fa68","resolution":{"observed_at":"2026-08-06T14:43:53.872983Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:45.125565Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.125565Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:a7cb64b0017ed63303ee2f14cfe203624726c3caa23fe51d6f54b808f4ab7b0a","observation_id":"56e10586-c656-4aeb-a065-7a071e190dfa","resolution":{"observed_at":"2026-08-06T14:43:45.125565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.841642Z","title":"2024 , organization=","venue":null,"work_id":"df0a8a7d-251e-4364-a7a4-d8794c92c8b6","year":2024},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.227874Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:d3980f07b466627b2de60162647ca9c3b31abb9b67f8fe150ebb7e17d9994153","observation_id":"8263accc-826f-48bd-b408-aedc3be93693","resolution":{"observed_at":"2026-08-06T14:43:53.846357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.826000Z","title":null,"venue":null,"work_id":"46dbc9d6-1525-4364-a808-885c3d63b638","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.334373Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:35121d8e7d26ee7f9f38c08eae984d0d886c20711af14254d6ffc62fbb1cb9af","observation_id":"e25cbddb-c10f-4a79-91a5-e0b8f08ef811","resolution":{"observed_at":"2026-08-06T14:43:53.830645Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.809066Z","title":"and Soran, Bilge and Krishnamoorthi, Raghuraman and Elhoseiny, Mohamed and Chandra, Vikas , booktitle=","venue":null,"work_id":"b463208a-3390-43d8-b6e0-dd7a99464aab","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.409409Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:8b0df89c034bb2cdba76f38a197887c472eeefc45b3abf1351ae260209d2a586","observation_id":"9fe9a487-5e3f-44c6-95c1-72141fa3d938","resolution":{"observed_at":"2026-08-06T14:43:53.814677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.792934Z","title":"Object-Centric Learning with","venue":null,"work_id":"acdbf1e9-57a5-4b02-b53b-f65216595c51","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.515315Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:0c299e869a091bd2b64b859b3899a1b48c3e9458a4dc2fedca2748fe66dd650b","observation_id":"11d9a447-e4f7-4454-a200-99d77b651f2d","resolution":{"observed_at":"2026-08-06T14:43:53.797693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.776867Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"d48d2a9a-224c-4b3c-8d3f-b97c8cfdc854","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.585210Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:3ee4338ad912baacac6b868508834b91f7d3a488f50fc54baea5d2dc93cd2050","observation_id":"73956562-9356-40af-bab9-5f52ff11e377","resolution":{"observed_at":"2026-08-06T14:43:53.781921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:45.687911Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.687911Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:cc0b99577b76b3e6b82ddafb9b6a13cca2d9c25069c7889e075ce92e791f4c63","observation_id":"6359d21f-d7bb-49de-860a-c7a012f46e4e","resolution":{"observed_at":"2026-08-06T14:43:45.687911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.749173Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"1024f8fa-d810-4c1e-b390-7b692d50f7cc","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.779658Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:ba8f5e159b44991f071e1b87b38ca6e17dee5c3f2151a2f4736dc8f2aeabeb19","observation_id":"c96a3652-d7d1-4cff-a304-783382aeff11","resolution":{"observed_at":"2026-08-06T14:43:53.753856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.734052Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":"f770f7e7-c492-401d-86e2-52b822a5c121","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.883721Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:70130481862270d60a72fd2d1a8c1aeea44b9cc5742f08e8328cbe4d0209e888","observation_id":"4a1b798a-75c6-419e-80de-0ab7eba70d99","resolution":{"observed_at":"2026-08-06T14:43:53.739012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.719081Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"d2112444-df0c-4b65-b2c7-274c9dd17606","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:45.967279Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:8cc0e61f2f1953cfc7cb7f3d141d8a2c66ccbcee653a3b56803ea8fe277667d4","observation_id":"1922eee8-c2dd-476f-a302-bb0d35bbcc27","resolution":{"observed_at":"2026-08-06T14:43:53.723834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.704144Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"5c353b94-6561-4fd1-806e-28f443eec201","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.094687Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:76d8c3dbb5ec02287f05bfbcb988557f7e2852660389a0cef74294255252dca8","observation_id":"6a20213c-4d26-466a-9fcf-cd9e1dc8c62b","resolution":{"observed_at":"2026-08-06T14:43:53.708759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.687678Z","title":"Efficient Motion-Aware Video","venue":null,"work_id":"af8c395a-3fc4-4a4e-aa23-63e6ad7592ba","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.185525Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:603fa0b97b3e1d0c14e4a2cb29601a2113b2fb97489909ab2042e02ad3bd8fb8","observation_id":"d1aaf68a-9088-4e22-a7b5-4a740767aa6b","resolution":{"observed_at":"2026-08-06T14:43:53.692665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.671290Z","title":null,"venue":null,"work_id":"7cbbc2d7-a4f4-4f82-ba96-2934db2eda9c","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.267473Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:c83c505333ef8512d87cd9bd8a685d0d0bf60bf29ca7b498dc956cc4b723edea","observation_id":"49e68a52-22b5-475f-ab86-6b1264251adb","resolution":{"observed_at":"2026-08-06T14:43:53.676078Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.655981Z","title":"Proceedings of the 25th ACM International Conference on Multimedia , pages=","venue":null,"work_id":"aad0108a-b0fe-4c9c-b24c-0574ea1c1247","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.369125Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:f079777d9f22d3144edbfd3ee6a8653095e6f9ec64dd5a07e97459e02009e31b","observation_id":"cbef60ac-46d3-4e0d-89ea-4cc2e9784b43","resolution":{"observed_at":"2026-08-06T14:43:53.660389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.641104Z","title":null,"venue":null,"work_id":"3247af93-7cbe-4fb5-ab1e-adb9b850a628","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.454013Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:805831780916c7d08adb846aee24bf28d7a48aefe8caed06adabe45b2fcd40cb","observation_id":"16020611-fbf8-44ee-83a9-2c7b58b4256a","resolution":{"observed_at":"2026-08-06T14:43:53.645819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.625820Z","title":null,"venue":null,"work_id":"f908e761-5fda-4fd6-9984-4b3ef4969485","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.583088Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:70d2d0d863aacf047ace9358474696d1e7e9c797979530a9ccaa7d73057a5659","observation_id":"16bd151a-00cf-4fbc-9690-f1db5cd3ffd7","resolution":{"observed_at":"2026-08-06T14:43:53.630562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.611578Z","title":null,"venue":null,"work_id":"b48cb984-402c-46c6-9ef7-038bf4d30174","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.672773Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:0dd5c115f175b1049f8fe5002b8da2435fc18c7b4cb4d4d3bc72c0a244ec28cb","observation_id":"4ecce88c-ed85-4838-b2da-ade653885f92","resolution":{"observed_at":"2026-08-06T14:43:53.615940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:46.790742Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.790742Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:6dedeafe4b4ce0a13ed3087f04ba7826b88d020c7ce7805857fd9e514be49a8b","observation_id":"30de05bb-6f37-4b91-a66b-7306d8dbb459","resolution":{"observed_at":"2026-08-06T14:43:46.790742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:46.868901Z","title":"2023 , organization=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.868901Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:88f00dc3932ec8c38702973b337eb2af644bd159bec587d14b0d8a14081fc75c","observation_id":"9cbb5765-1737-4cc5-ae8d-f01b496a32a4","resolution":{"observed_at":"2026-08-06T14:43:46.868901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.575301Z","title":null,"venue":null,"work_id":"a2a8eb2c-459b-4564-8c25-461b7e351272","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:46.982751Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:dc123616b987a6d110dd3ecc65ed134b86c7b00ee221b697f6b29723df26d022","observation_id":"c46aa8dc-6275-4be8-9685-6dca55d9c7ec","resolution":{"observed_at":"2026-08-06T14:43:53.579822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.559288Z","title":null,"venue":null,"work_id":"f851165c-4a75-44bf-99b5-f3f7d50caa6e","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.057858Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:f437d3587397f3c6e2a102bcb9ce60fc1a6d97f6a5ced5032a701e6ff0f5450b","observation_id":"141bff49-71e0-4c83-b7a0-2f403e707ac7","resolution":{"observed_at":"2026-08-06T14:43:53.564624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:47.179027Z","title":"Token Merging: Your","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.179027Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:1a003392dac47439391381716d3622f5388332c24f673330c8d638831c501583","observation_id":"377343d2-d7be-42a1-b411-61ec3716515b","resolution":{"observed_at":"2026-08-06T14:43:47.179027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.532675Z","title":null,"venue":null,"work_id":"202ff7d9-36c9-4b0d-8b55-c215c8346d1d","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.269390Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:eb9cc267ca8c5ac28a3ccbe6a8be7a341be6d6f63ec3cf8bc0c56abb6473564a","observation_id":"76ef49a1-728f-4fec-bd96-b1fd9f8db26a","resolution":{"observed_at":"2026-08-06T14:43:53.537674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.516076Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"3e733561-4b79-4c1b-a6f1-1e5148b9d892","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.385200Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:c38ede54d10b7c9dcf6738c60a59ffc87eec4dad1c5b527c3b9fe517d6657c55","observation_id":"37691565-95d3-4321-bdf1-ab263a41837a","resolution":{"observed_at":"2026-08-06T14:43:53.521236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.499972Z","title":null,"venue":null,"work_id":"bea7095c-6512-4b3e-9833-4d4a9b5d6e04","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.524416Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:2408047d5fab436acce4f258957bb06e72447083a8973fba25a0f993dbca8a34","observation_id":"b7812c3b-fae6-406c-b1c0-7709fbf61d74","resolution":{"observed_at":"2026-08-06T14:43:53.504629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.485127Z","title":null,"venue":null,"work_id":"47a24344-9ab3-480f-8c4c-02c3a458a368","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.603783Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:4b13b0c38718b9a7a4f74b082fdf9251d96f7973645129edbff5060fcea9508d","observation_id":"a925443b-3183-486a-a3ba-4cdee798320d","resolution":{"observed_at":"2026-08-06T14:43:53.489629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.468951Z","title":null,"venue":null,"work_id":"786ed0d4-6ab2-4850-ad54-0991436eb78c","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.765881Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:36d015c0dd0ef0e636b6031f7dc6c4619901a540fb835a8f7d27765df46c7d13","observation_id":"98da2d9c-0407-434a-ab42-3afdcaf43f48","resolution":{"observed_at":"2026-08-06T14:43:53.473718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.453493Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"dd21876e-81d5-412b-a10c-62158869a1fd","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.888421Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:6663f3c9b63903755a683e374e1211c29807693dd615c7bc00be73201a1b3e16","observation_id":"456d27ad-8db0-4f45-9518-ce801b16eab0","resolution":{"observed_at":"2026-08-06T14:43:53.458239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.311673Z","title":null,"venue":null,"work_id":"ab3765c6-0594-467a-a2f7-b07d3bb6ce21","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:47.985495Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:71d6cc801294f9252be9321c0651ced5ad4c854a378f2f0642cfe5a938085445","observation_id":"fd7de6c5-dc2d-4ce4-889e-31bd130afdd0","resolution":{"observed_at":"2026-08-06T14:43:53.411731Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:48.084978Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.084978Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:dc16f840bb14d116a0eaaa85d4658b2b164faf769ab7ff6e001bffc837c71ab7","observation_id":"ba6bbfe4-297e-4edf-ad67-813f9446bd20","resolution":{"observed_at":"2026-08-06T14:43:48.084978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.182365Z","title":null,"venue":null,"work_id":"d07ba66e-15c0-4f97-9715-f0549e194cde","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.183004Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:9d87f0472862779542e26562974cab8cc08cc20ac02f48c46c539725b48084cd","observation_id":"f141fe54-a3d2-47fd-8264-da7a40748a71","resolution":{"observed_at":"2026-08-06T14:43:53.252240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.031073Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":"756b5940-c29f-4d8c-8df6-1d77aac04294","year":2024},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.313886Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:62b921ec7d54192cd81b0d27fd7f78291292833fb38e0777eee4a144d30ef10c","observation_id":"5fff37d9-8962-45ce-af69-cacbdfe7280d","resolution":{"observed_at":"2026-08-06T14:43:53.095588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.871662Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision Workshops , pages=","venue":null,"work_id":"6714f23b-84f6-41cd-9e55-33ab0e91d01a","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.468535Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:a80e326a5d5adae556f9071ba58be6f1d275fc486062ee0bb21bcd13a00622cd","observation_id":"f04d9cb9-6695-4075-8519-1ad56b88f68f","resolution":{"observed_at":"2026-08-06T14:43:52.941031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.769400Z","title":null,"venue":null,"work_id":"289bc980-2cce-4cc9-8fae-4af220473df6","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.577304Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:d46388341af859cae0ea5091a99f1fb1705366e98ec4d9f7f2316868a3aa8f6f","observation_id":"30ed2180-5404-451a-bdcf-5e49faad1328","resolution":{"observed_at":"2026-08-06T14:43:52.812477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11390","last_updated":"2019-01-22T18:55:34Z","snapshot_observed_at":"2026-07-06T07:30:18.170401Z","submitted_at":"2019-01-22T18:55:34Z","title":"MONet: Unsupervised Scene Decomposition and Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11390","snapshot_observed_at":"2026-08-06T14:43:48.662390Z","title":"arXiv preprint arXiv:1901.11390 , year=","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.662390Z"},"links":{"cited_paper":"/paper/1901.11390","citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:e1bd978dd8841c3e53a213210ca93ae7588037e5b3c61dd525ead06325256449","observation_id":"eb6eb139-f511-45ab-92c8-98431c69b6f1","resolution":{"observed_at":"2026-08-06T14:43:48.662390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.557836Z","title":"Proceedings of the 36th International Conference on Machine Learning , volume=","venue":null,"work_id":"e63037c6-e2fc-4688-afff-9bafe2391ef9","year":2019},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.773871Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:9b2a64e66b97ac60bc595e1ac25d779669d15dbdae0cc69021514a7d2dd8d5fe","observation_id":"48588e6f-ba8d-45cc-9b14-0065e9fc3d4d","resolution":{"observed_at":"2026-08-06T14:43:52.690520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.275745Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"411012b3-b4f6-454d-8f27-2e7c787310bc","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.844200Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:2984bdc2cc5fe1f562134cb55fb12c7360b960154f4e9705d02506b84a271284","observation_id":"cb537fe9-0334-4174-b3ba-d1122707a6ab","resolution":{"observed_at":"2026-08-06T14:43:52.413524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.033904Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"0d8d36bf-4a8f-4ca9-90e2-476b4edb5985","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.923629Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:3d83b4c2acc9af1280f63bc2b3d1b2b3ac6c8f821b1438b8b5bd8562c8522b9f","observation_id":"641c5691-962d-4170-8966-20580f46c385","resolution":{"observed_at":"2026-08-06T14:43:52.170901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:51.723928Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"b19cbde4-caa9-41f8-b883-210d79a439cb","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:48.993970Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:e37c5e6c7f4dc9dc6bf2b154dadada8629cac1562440b63aeb35b154d597e602","observation_id":"e779b23a-d7b6-4145-9e3b-75921f4c98f5","resolution":{"observed_at":"2026-08-06T14:43:51.868024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:49.060712Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.060712Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:2b7bdc2293f9381c3d24d39e57124e49a1d79c5786bd9d8a015b6826c6047195","observation_id":"2a66c2dd-0184-4758-868f-eb2f1f67df27","resolution":{"observed_at":"2026-08-06T14:43:49.060712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:51.513104Z","title":"and Ionescu, Radu Tudor , journal=","venue":null,"work_id":"824564a3-5003-4d87-b952-5a0881ce6d6b","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.196217Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:c8b43e4f3602edbea52b1c6aa85c5a04cebaea9b68108d00643d36edd39b48cd","observation_id":"38987ed4-b3ed-4561-b68d-f44574c0a63d","resolution":{"observed_at":"2026-08-06T14:43:51.615786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.12601","last_updated":"2026-06-10T19:00:47Z","snapshot_observed_at":"2026-08-06T04:22:12.456126Z","submitted_at":"2026-06-10T19:00:47Z","title":"Dual-State Slot Attention: Decoupling Appearance and Identity for Video Object-Centric Learning","version":1},"cited_work":{"arxiv_id":"2606.12601","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.12601","snapshot_observed_at":"2026-08-06T14:43:50.185915Z","title":"Dual-State Slot Attention: Decoupling Appearance and Identity for Video Object-Centric Learning","venue":"cs.CV","work_id":"f3176802-b538-4439-8c91-3cf985973ba8","year":2026},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.273507Z"},"links":{"cited_paper":"/paper/2606.12601","citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:5b3faf49a81d094de16b14eb37aced9eef18c9bab92f27035c905f7cb06566e4","observation_id":"e99b3254-d831-44fa-a4c6-2539fa418df5","resolution":{"observed_at":"2026-08-06T14:43:50.334258Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:51.321108Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"cc030159-da21-43da-be90-7d6497955baa","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.367118Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:2b448a22f1c88a7c0caa9f1ca07fb636af96fc163db7588b4afbe89cd0304b22","observation_id":"0565e546-60f5-44f2-87dc-351ca47000c0","resolution":{"observed_at":"2026-08-06T14:43:51.403661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:51.095316Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"e9abf289-9902-4e54-9814-f96e4d6c5810","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.509821Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:ddc8f00d5299e7c221aae7b4bff9ce067f59fbc5e94d923bb7043bf968e2b6f6","observation_id":"7e803d03-281f-4800-a1f4-3afc4b5f13e3","resolution":{"observed_at":"2026-08-06T14:43:51.176220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:50.851084Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"fe2b7535-b226-4ffb-a367-0176fdef9dcd","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.616783Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:70987fae73e81bbc996934359e8c80fef79b348d98a8c9678987ea7b8b728333","observation_id":"3dc4c40a-487b-49a0-b012-45dd0ac1e835","resolution":{"observed_at":"2026-08-06T14:43:50.947543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:50.649321Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"537e0654-d4f8-4447-857a-99b3db478fe3","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.730447Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:5f30e054250f2cba5860836b3f26b1defe71f22de20fa6583734d6637b38a0a5","observation_id":"3987332d-8db1-4205-b84c-716f24bde5c2","resolution":{"observed_at":"2026-08-06T14:43:50.736480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T14:43:49.844800Z","title":"arXiv preprint arXiv:2407.10671 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.844800Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:46fc408a8d9e906eccaded6efd42dd82285fce0ab4a7b8edb9ff29ee5cbbab9a","observation_id":"2da55dd4-1977-4c5a-9ba5-71f29764ec10","resolution":{"observed_at":"2026-08-06T14:43:49.844800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07798","last_updated":"2024-06-10T13:55:21Z","snapshot_observed_at":"2026-07-06T18:13:33.931286Z","submitted_at":"2024-05-13T14:42:13Z","title":"FreeVA: Offline MLLM as Training-Free Video Assistant","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07798","snapshot_observed_at":"2026-08-06T14:43:49.954944Z","title":"arXiv preprint arXiv:2405.07798 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:49.954944Z"},"links":{"cited_paper":"/paper/2405.07798","citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:3c6233deedfabbd9e68e70c55b68930f25f2b8f0facf8107f4c77a5db24acfa3","observation_id":"3105391f-0eb4-4e9c-a957-58b9b1c00b7e","resolution":{"observed_at":"2026-08-06T14:43:49.954944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:50.446006Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"a3caf2df-c4b7-4d5d-a29c-66f3219f7546","year":null},"citing_paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T14:43:50.035955Z"},"links":{"citing_paper":"/paper/2608.04866"},"observation_digest":"sha256:768eb22088692fccbb43253ebceb95251a080ccb90e2b743ecad9b37824753f5","observation_id":"a6f449d7-a092-4a93-8a8f-5cbfa993be22","resolution":{"observed_at":"2026-08-06T14:43:50.526646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04866","last_updated":"2026-08-05T13:59:04Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T23:13:19.781657Z","submitted_at":"2026-08-05T13:59:04Z","title":"Persistent Object Narratives for Token-Efficient Video Language Models"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2608.04866."}