{"as_of":"2026-08-07T05:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:72f30d605134716139deb61d20a1389e4ae1326eede6defa4af965fc23bd6a73","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:23:43.243274Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.21785/citation-record","integrity":"/paper/2506.21785/integrity","json":"/paper/2506.21785/citation-record.json","paper":"/paper/2506.21785"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.16715","last_updated":"2023-08-18T07:56:32Z","snapshot_observed_at":"2026-07-31T14:34:12.552081Z","submitted_at":"2023-07-31T14:34:49Z","title":"UniVTG: Towards Unified Video-Language Temporal Grounding","version":2},"cited_work":{"arxiv_id":"2307.16715","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.16715","snapshot_observed_at":"2026-08-06T22:23:44.255560Z","title":"UniVTG: Towards Unified Video-Language Temporal Grounding","venue":"cs.CV","work_id":"19098a11-cec9-4ba7-8075-c085bd912d3f","year":2023},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.171290Z"},"links":{"cited_paper":"/paper/2307.16715","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:58665e6acb305a22f5538aca42cf3e5974a3b000d8c4cdc82c1d8ffc023ba203","observation_id":"9c8b10c0-3408-4d37-b3b5-e2fca4dcb349","resolution":{"observed_at":"2026-08-06T22:23:44.366891Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11816","last_updated":"2024-06-17T17:55:32Z","snapshot_observed_at":"2026-08-02T08:01:10.902033Z","submitted_at":"2024-06-17T17:55:32Z","title":"VideoLLM-online: Online Video Large Language Model for Streaming Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11816","snapshot_observed_at":"2026-08-06T22:23:41.274752Z","title":"VideoLLM-online: Online Video Large Language Model for Streaming Video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.274752Z"},"links":{"cited_paper":"/paper/2406.11816","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:ac2f99fb4218b3646699f452e09d098dd275944af159e54bd5e8a80a90058ad6","observation_id":"90c0f3b1-5916-4edf-8bfe-b087c15b290a","resolution":{"observed_at":"2026-08-06T22:23:41.274752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-07-06T17:42:49.471518Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-06T22:23:41.396361Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.396361Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:d6cacef331a35f5ab5ef282a935da5b1b633a81620eb8b43baf57ab97f7084bc","observation_id":"60fd24f9-7f8e-4d8d-bade-a4d8a55cc9a8","resolution":{"observed_at":"2026-08-06T22:23:41.396361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-06T22:23:41.495758Z","title":"Mamba: Linear-time Sequence Modeling with Selective State Spaces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.495758Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:0d7a6ffa77bde81f06d4fc8a4e5a38c49a7290956853d810013b6bd5d7388af5","observation_id":"bdf647d9-3f6f-4ac8-bb9d-c1c7908b92a9","resolution":{"observed_at":"2026-08-06T22:23:41.495758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05095","last_updated":"2021-06-09T14:48:13Z","snapshot_observed_at":"2026-07-06T10:39:58.765690Z","submitted_at":"2021-02-09T19:49:33Z","title":"Is Space-Time Attention All You Need for Video Understanding?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05095","snapshot_observed_at":"2026-08-06T22:23:41.597659Z","title":"Is Space-Time Attention All You Need for Video Understanding?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.597659Z"},"links":{"cited_paper":"/paper/2102.05095","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:57c7d173baa993c84024cf29538e2c84f4fec30d405b325637efa18e19780c67","observation_id":"bd7e80c6-f1a6-4542-be12-6e0b683c42a7","resolution":{"observed_at":"2026-08-06T22:23:41.597659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18259","last_updated":"2024-09-25T21:55:38Z","snapshot_observed_at":"2026-08-05T13:44:08.331144Z","submitted_at":"2023-11-30T05:21:07Z","title":"Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18259","snapshot_observed_at":"2026-08-06T22:23:41.740633Z","title":"Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.740633Z"},"links":{"cited_paper":"/paper/2311.18259","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:61267a98c4077fefe0b2a7c412977206f17824cb2a6296ef8dd632b12568cf23","observation_id":"3ae6917d-ea86-4819-bad3-0222acd15ed4","resolution":{"observed_at":"2026-08-06T22:23:41.740633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20648","last_updated":"2024-10-21T08:52:10Z","snapshot_observed_at":"2026-07-06T18:23:10.807498Z","submitted_at":"2024-05-31T07:30:24Z","title":"Shotluck Holmes: A Family of Efficient Small-Scale Large Language Vision Models For Video Captioning and Summarization","version":2},"cited_work":{"arxiv_id":"2405.20648","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.20648","snapshot_observed_at":"2026-08-06T22:23:43.978120Z","title":"Shotluck Holmes: A Family of Efficient Small-Scale Large Language Vision Models For Video Captioning and Summarization","venue":"cs.CV","work_id":"578d0d33-a8a3-4465-9752-a96bc066a8ad","year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.864051Z"},"links":{"cited_paper":"/paper/2405.20648","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:2565bb0a0af983ef7cbcc29627506f08b561a52e3eb1ee1966e96b311aeed66c","observation_id":"248d10b3-b2d1-4c0d-b58e-6c6220c682b4","resolution":{"observed_at":"2026-08-06T22:23:44.044371Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10300","last_updated":"2025-02-05T09:57:59Z","snapshot_observed_at":"2026-07-06T17:03:56.263404Z","submitted_at":"2023-12-16T03:17:30Z","title":"Shot2Story: A New Benchmark for Comprehensive Understanding of Multi-shot Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10300","snapshot_observed_at":"2026-08-06T22:23:41.969901Z","title":"Shot2Story20K: A New Benchmark for Comprehensive Understanding of Multi-shot Videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:41.969901Z"},"links":{"cited_paper":"/paper/2312.10300","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:bbf9c4aeaecd8d7cfac4ef78e0b08d184a5955b405be973a6904738f6b87cd20","observation_id":"e5aed2b2-69a5-42fe-87bd-b4dce7efe8ad","resolution":{"observed_at":"2026-08-06T22:23:41.969901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.10337","last_updated":"2022-07-08T08:46:43Z","snapshot_observed_at":"2026-07-06T12:10:16.997623Z","submitted_at":"2021-11-19T17:36:01Z","title":"Advancing High-Resolution Video-Language Representation with Large-Scale Video Transcriptions","version":2},"cited_work":{"arxiv_id":"2111.10337","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.10337","snapshot_observed_at":"2026-08-06T22:23:43.796125Z","title":"Advancing High-Resolution Video-Language Representation with Large-Scale Video Transcriptions","venue":"cs.CV","work_id":"b4214fa2-b6f1-40ec-95b1-450b50854a3f","year":2021},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.126947Z"},"links":{"cited_paper":"/paper/2111.10337","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:af394cf6b0e9f2b83fffa26f3f2a9d976dc19bcd4c69128b1b8c9913a938a21f","observation_id":"5e87f939-0cdb-4a1c-bef7-4e88cf736c47","resolution":{"observed_at":"2026-08-06T22:23:43.860557Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.04838","last_updated":"2020-08-11T16:37:59Z","snapshot_observed_at":"2026-08-03T19:11:12.569454Z","submitted_at":"2020-08-11T16:37:59Z","title":"TransNet V2: An effective deep network architecture for fast shot transition detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.04838","snapshot_observed_at":"2026-08-06T22:23:42.246470Z","title":"Transnet v2: An effective deep network architecture for fast shot transition detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.246470Z"},"links":{"cited_paper":"/paper/2008.04838","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:31f1f33289f052e3950245fcd039861fe63a3c735ba505ad92fbe8bad524b105","observation_id":"504e0a5d-bbdc-46a6-9602-16acb08fd1e5","resolution":{"observed_at":"2026-08-06T22:23:42.246470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07058","last_updated":"2022-03-11T19:40:26Z","snapshot_observed_at":"2026-07-06T11:57:42.646453Z","submitted_at":"2021-10-13T22:19:32Z","title":"Ego4D: Around the World in 3,000 Hours of Egocentric Video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07058","snapshot_observed_at":"2026-08-06T22:23:42.360607Z","title":"Ego4D: Around the World in 3,000 Hours of Egocentric Video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.360607Z"},"links":{"cited_paper":"/paper/2110.07058","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:6b5f657a052a345e0dec740d5b253b64a8116feefaf28e88eac42e92da5eec8a","observation_id":"0335ffe1-ba69-4b56-90af-e15f5577fc2e","resolution":{"observed_at":"2026-08-06T22:23:42.360607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04269","last_updated":"2023-09-08T11:31:08Z","snapshot_observed_at":"2026-07-06T16:16:07.182657Z","submitted_at":"2023-09-08T11:31:08Z","title":"From Sparse to Dense: GPT-4 Summarization with Chain of Density Prompting","version":1},"cited_work":{"arxiv_id":"2309.04269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.04269","snapshot_observed_at":"2026-08-06T22:23:43.578087Z","title":"From Sparse to Dense: GPT-4 Summarization with Chain of Density Prompting","venue":"cs.CL","work_id":"5082c16e-427a-4757-94dd-24249e6e66ca","year":2023},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.496883Z"},"links":{"cited_paper":"/paper/2309.04269","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:173334a9ef7d4150653ee46e5012f2dc46b0327bf3ddccfe2895d3ee364e9ad7","observation_id":"2f91c3c5-a537-41c3-a653-86e22eebc81f","resolution":{"observed_at":"2026-08-06T22:23:43.644497Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T22:23:42.657182Z","title":"GPT-4 Technical Report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.657182Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:6f8f49e25f15dce564927456edbed028cf3684eba3e89afc38f580a3dfbebdec","observation_id":"ece7af2f-5675-4b0a-8fb9-4d57d673dfd8","resolution":{"observed_at":"2026-08-06T22:23:42.657182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04511","last_updated":"2024-04-06T05:55:14Z","snapshot_observed_at":"2026-07-06T17:56:27.818353Z","submitted_at":"2024-04-06T05:55:14Z","title":"Cluster-based Video Summarization with Temporal Context Awareness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04511","snapshot_observed_at":"2026-08-06T22:23:42.816049Z","title":"Cluster-based Video Summarization with Temporal Context Awareness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.816049Z"},"links":{"cited_paper":"/paper/2404.04511","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:069418cfa185462aa6981185bfe73f5cf7c72d7ebb44cc54e003ea29e49462da","observation_id":"998b9a53-fd36-4a54-a714-cae86b08c33a","resolution":{"observed_at":"2026-08-06T22:23:42.816049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:23:42.917546Z","title":"Creating Summaries from User Videos","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.917546Z"},"links":{"citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:c443c33a08b965318579cd0f6c4e430d10e9475efea366a89615ac07e6241989","observation_id":"a2d84fed-fae2-4413-bc87-bb203fad4ccf","resolution":{"observed_at":"2026-08-06T22:23:42.917546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15343","last_updated":"2023-09-27T12:05:41Z","snapshot_observed_at":"2026-07-06T15:08:30.190912Z","submitted_at":"2023-03-27T15:53:01Z","title":"Sigmoid Loss for Language Image Pre-Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15343","snapshot_observed_at":"2026-08-06T22:23:42.985153Z","title":"Sigmoid Loss for Language Image Pre-Training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:42.985153Z"},"links":{"cited_paper":"/paper/2303.15343","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:3cc86a6f46ed2dac990e55a3fc22bfc534622faa78ec38e1378197868ff18134","observation_id":"9d10f3e3-ba32-4d81-88d6-3cf103de00d9","resolution":{"observed_at":"2026-08-06T22:23:42.985153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:23:43.101087Z","title":"BIRCH: An Efficient Data Clustering Method for Very Large Databases","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:43.101087Z"},"links":{"citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:6903da27956b9825a93377acd4ff58f3d18767dd42793da23e932dcde8e71ed7","observation_id":"e64a774c-1eea-46ea-987e-18ebdce0fd69","resolution":{"observed_at":"2026-08-06T22:23:43.101087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-06T22:23:43.159750Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:43.159750Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:c61ee264cf12c998a5a1da1114543219707b8fdb00ceca875ecba84d75d04072","observation_id":"46b74914-c675-4384-9cba-1e2f60511c7d","resolution":{"observed_at":"2026-08-06T22:23:43.159750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:23:44.509718Z","title":"Nov 4, 2024, https://build.nvidia.com/nvidia/video-search-and-summarization 13","venue":null,"work_id":"29b0086d-daec-4164-bb49-90668291acde","year":2024},"citing_paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:43.243274Z"},"links":{"citing_paper":"/paper/2506.21785"},"observation_digest":"sha256:7564366d88c57438d54bae12d55d3b713d3abd3d02d86a890210cd56b37b96b6","observation_id":"6b7f6f11-5185-4657-9eca-d3c950b1ec78","resolution":{"observed_at":"2026-08-06T22:23:44.649217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.21785","last_updated":"2025-06-26T21:46:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T22:16:50.634645Z","submitted_at":"2025-06-26T21:46:48Z","title":"Comparing Learning Paradigms for Egocentric Video Summarization"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":4,"verified_fuzzy":1},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2506.21785."}