{"as_of":"2026-08-09T13:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:558bf7fae27cae1f958e618313d8a1959524da796f106fbf985da6692b0410c6","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T12:10:52.100410Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.04872/citation-record","integrity":"/paper/2607.04872/integrity","json":"/paper/2607.04872/citation-record.json","paper":"/paper/2607.04872"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":"https://api.semanticscholar.org/CorpusID:263218031 Gpt-4v(ision) system card","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:7db1965a2b51d5e919565f538daa03be832a4d7886e7db3051f7952dd79d93fc","observation_id":"b61f0fc0-3d65-4c73-8f92-e500ea9d3565","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:388ad2367a661563b69dbb6224d6dd0f5c74cc55957cb3da24fc26a7cf2791a6","observation_id":"0b8fa30d-b99e-462c-892e-5bce371ad76d","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:d314630eead4e33b0b033d3599087d6ef920162eb517df71c93c0eefa3ec52f6","observation_id":"3c979f7c-69f4-4a9e-a558-b4dd0a773bb8","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:1e63fab68cf4fdcc2012bd39bbff3d4924bf7c0d952a7a8246e9a2af1470baff","observation_id":"b34e582c-b76b-4a27-bfde-e6c1539d6907","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:2ed22f5fdfd24db0b507dbe1ab814b58f635e8a7175ac3a458181ba2151c71a6","observation_id":"f0e88844-fe13-4313-9324-c83e444b040d","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:ee2bf05b4eb80daf1519311c00cd9e86bf620fd6c346dc81d625a7393d10de78","observation_id":"1f7266d2-2e39-409a-a917-0eeb43864b59","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:594bcd96cb4fec0e52e1c8fb20f0dc485ef5012a76525a004ec0cda5fe93419f","observation_id":"833a48df-c7b4-40b8-b843-437aa7abf418","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07476","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2406.07476","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:3ab97a9a3d14658f9f91301459fdbe47fe1b4babf4563cc4e1e6022682b8da55","observation_id":"be9b3956-c41a-4a06-be50-c27e38c3752b","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.17555","last_updated":"2026-05-13T14:09:57Z","snapshot_observed_at":"2026-08-02T08:53:32.433698Z","submitted_at":"2026-02-19T17:09:30Z","title":"GraphThinker: Reinforcing Temporally Grounded Video Reasoning with Event Graph Thinking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.17555","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2602.17555","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:88a28aa3e99a9628a2bb184048ff7a11138bd707ef1970a1b6789b29abe3440e","observation_id":"85dba891-455d-446f-8815-b7e93f4c9785","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:e6f08c0ccdc714996dafef0957df1165746fcf6af60ef69b48e2e5a204bc36d7","observation_id":"247fa838-febb-49a0-b748-b3595eeb992d","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:546192135fa494ff56e4de0101a05cb42725fbe27b5478cd6883ff842e0e95ae","observation_id":"bffd64bb-cde1-4ef7-9b70-b8c6e3648f43","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":"Cover and P","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:63e24bf6a5915313efb68c702c5a6a1faf716fa1a22f79a735d5a3dcb51b6539","observation_id":"77eaa161-ed33-4d4e-bfac-f76097bf7e70","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:ce5a65aec3d639e29e08649178ab613c2eceb4e25fec8d7da14727d20339ad9a","observation_id":"33968e96-5ca7-4eea-a099-211dbd2f19cb","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:0ef849f3498263a9c5e8c5054dac919b368cbb1128e502c1eb9409ecd164e023","observation_id":"7c3d625a-1e50-4b45-8616-c6bcddca0bb7","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:fd266b1e747e101a6b56b8d95eda3a211d9d8702e86499626d4567d87bdf8903","observation_id":"b88ab8ab-73a1-4e8f-a93d-476206bfb529","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:b73520d774af085b6797a81008a7b83a744ecef52e08eafd6745f2519496c355","observation_id":"484f0c72-12bf-4d0d-9c8a-8f373228f62a","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:c3ae71b5b3c1941066035af36531b1c66938e7136a944980609180e95b27efeb","observation_id":"8205984a-7dc6-486d-a4c1-89aacc675930","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:f74c074f62d0c06af596fc82267ce04e3eda2ef439754541882537fa1a813148","observation_id":"ff9bdeb0-b101-4b96-9594-910c2681e103","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:408fcf0210ff927b283890bdd54bc7cfe4adb9be130321604bcdd465fa428237","observation_id":"275a3482-b3bc-4b2e-af1b-8eb6a0b7475b","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:4f25c428a2ef572b739c165b7dc91233a944b7f4bc7e8c45235638ca5f733566","observation_id":"47e3d175-d918-4c91-a36f-309bb1a6bd2b","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:6754174493ba271327eab4db2beee3b93626283c999901b0c6ea62b267124e39","observation_id":"e30b830b-3fca-470f-a25f-89b2fb37c72b","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:7efd4391bde24e3274a453bd0cb9ba8a80ea16064df2bfd3517292616fd3180d","observation_id":"bb0763e8-7e21-4a3e-aa23-c676969cbbf2","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:ad417f8480412fcbba1a78788243705835d22c16cf7d60d27773885e30170288","observation_id":"5c00cfb0-bd01-4019-a63c-96953e4b5d83","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:285b58f64fc2f2de4d3a17b92eaa870bf133fcac0d78dd6207cb6827db697c89","observation_id":"274cebe2-6013-4639-821b-b3fd631e0961","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:ad9833c11ad779e2140f22a7a4312be007ad852c631d6d735930b3bd9ca9f085","observation_id":"0358d678-0cc0-4233-b66d-4df708a25f7f","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:f89c385bebe9c0ce8c6bdca3eb1247d71ad41d7085b4fd6812b3bb0a1b30d58b","observation_id":"b7c54aeb-a8c8-4da0-a6e1-425e9aa1717e","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:5f8d6da781b193b60e2192ca3367c29b856f7a52fe62d878febab0dd9eb1ef00","observation_id":"c1d84dce-0393-4d7e-82d2-fef058881550","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:74e4f1f387768c6d2b0b69c9c6b1fc629e9d17a0cccb9e27ffb02054f7cf62b7","observation_id":"b261a4e7-accd-4c02-8365-0964ebaef08e","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:de2da5d6e9a720b68b6b2e6bad67f6eef7585fa5ef603e9ec840c80c6539e9fa","observation_id":"30601b59-fa38-4f55-ae02-047c71c436d7","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:c3d6aea1273b6e099ac5ef581c352b11f461c88e9345caf93bd6ac80473dea94","observation_id":"7772ff25-1647-44c9-88b7-c68d073c5d9d","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:ad1db7271152c7262cd546497e34432362d42826e0df811ba5c0b528c3f40847","observation_id":"606cc14b-cbdb-4074-9a18-1d142d69e859","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:e2c00482e0353a5b5e378ae084f39cee133bb9d9bdb023697759e420a7221450","observation_id":"a22e555c-0af2-470c-bc82-d1c1f3a81dfe","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:24e6e60fc2ce1844c274ba0791ec9646c0d4119ea6f9a86eb19cc725d2f851d5","observation_id":"618fbe71-0d46-4cea-9daa-81783d8199f0","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:20b1b7ee60403cb0e9dd5efc8ab9db2e9431ebb5dcd072d96747fe877631cb5c","observation_id":"bc5f67fc-6da2-4284-ae79-33090bfe311c","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:37e56ef0513179e21e901b1b48c1e2991553a9a2d02d1adf433c790bc098e6a6","observation_id":"897a2a83-33d5-4d5d-a855-a963a421b822","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07680","last_updated":"2025-09-09T17:59:39Z","snapshot_observed_at":"2026-08-04T21:27:30.632810Z","submitted_at":"2025-09-09T17:59:39Z","title":"CAViAR: Critic-Augmented Video Agentic Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.07680","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2509.07680","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:9a0c07072b41ac7c099e3db190e552479dd14ca930473aee2c305464ed23b9b0","observation_id":"8c9e2c2c-f4c5-4319-9144-045b73a1fd8c","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:eca7de45f788e3a3207d2edb5333655eaf744dda832dbed856498aee2a914f0a","observation_id":"731b28fd-edb7-4785-8622-04a57c9ecf25","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:64028e0044f34c8df6588a3ebe925fa8989f8b7c95638b42dc73c085e1b1f937","observation_id":"4d231079-e171-4728-a739-e505f4ff6b87","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:51cd7ea29a6dd6d1fe210a05fa69b094396fc41291646ee720ef177d39c30c44","observation_id":"790683c0-6a61-48f0-9021-ef4dd92c4886","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:39d21d000dcbba528c9e4bfc668b557a3aa514f0ca8b9e510192727f073e595f","observation_id":"65d9a45b-adae-4522-b871-976e453d685c","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:508359b139a8efee4aac37a238d94a2b368abf1996695b4e928c4748c971d4c8","observation_id":"c3000371-152d-45d7-8f32-5c8c6a5bdc88","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:9f572380961eb35ce98da8520abb1aab165710187645aee92b15764bcfa0e04f","observation_id":"54816c0f-3aab-4d72-9a90-63d6264b5fd8","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:ff2a73c1c0f9cd52edda005005e62e08dd5310f84720bb66ce7bfbd20fec4561","observation_id":"a84cdba7-36e8-4579-9d57-d37f0e3b5ea5","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:cee7f1d1d4c5f6e1f8a680d2c959215ddc3b15702fc5ad36d9372508b76d9651","observation_id":"34d69f06-1ce1-4126-9f03-5e91fa3e0cc6","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:821dec14d9604790e7aae5f7eb1c3a1c7df9d80393e69aae5513d9bba6468d83","observation_id":"42147f4b-724e-4be4-bf37-db5ecd69ae2f","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:8e5da02423056bf3fbe0abad122d36cc2205b39ae2c7425146c364b86dce9bcd","observation_id":"5fdf4639-9af3-48b8-8ab6-58c979baed0d","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:e33e7041e18ee6d762460f0a4b553c6320f937069572174d2c9d72c1e76b10f3","observation_id":"2af94c0f-eb7b-4867-b9c4-f91d7c092cd7","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:6b27e1a37e4d15265db0d8732e90f15d373bf362c782dcc2bada42c50791c792","observation_id":"8ee73acb-fdc8-410a-9a72-a89df50ff841","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:e8842b6f799cabd4b39377d6f9080e134ecfbbbacccc2429e7a59442f8c11fe2","observation_id":"85e17add-ddf4-4675-a714-aef1a4dbf1e0","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:a58b346656e97babae5b0eff629c2da3ec5e357e4ab3d57d1046a71562e1d43a","observation_id":"7f73b213-993a-4ad0-8c70-ddc7138d8165","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:076f26b465b76365760c3a8f19c3f6c737368d9140d0bd3a97e3315338028e94","observation_id":"dfb61aae-9301-4f6c-9f0a-4a35c543748b","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04840","last_updated":"2024-08-13T08:10:32Z","snapshot_observed_at":"2026-07-06T18:58:39.334273Z","submitted_at":"2024-08-09T03:25:42Z","title":"mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04840","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2408.04840","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:5b3be8f4348be66fe6c33812ae3926e20b437518753aca42df1b1c703f9597c4","observation_id":"e2bfbc0b-1aa7-4e6e-ad9d-1eb2e65a6d43","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:f46eded53b3e86bd1725e0cb7335a6fad6a2f4c20e098557f52e296dda2be828","observation_id":"624f9c50-eaa1-4693-a7d0-a63c9ee2c024","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:0f00c2dcbca3c8f28fe6f4be3699859bd5756ac074b2222f2da0e11105460c45","observation_id":"5ecca96c-cd9c-4905-a768-baa8a336d068","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:b85e3bda4525cdd1b6c74e5dd9effb7e11950fa181f248f3020655ed9b79472e","observation_id":"5b90f426-06cf-44ee-b8db-fa6906d7f08f","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:b64ec9563a342a16fd32e7d421f855fc6c8cb5eb7439d5660e27ce9964a04f37","observation_id":"fc92106a-4d0f-4886-b4bc-2c0c2a4d8396","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:d58d79b838ffde77b4f182c756c922bd21d4d8eabf72e11d792cec44c96ed5ef","observation_id":"80992af4-175d-4c1f-b55f-d6ad867f5573","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04471","last_updated":"2025-04-06T13:03:34Z","snapshot_observed_at":"2026-08-07T16:08:13.539826Z","submitted_at":"2025-04-06T13:03:34Z","title":"VideoAgent2: Enhancing the LLM-Based Agent System for Long-Form Video Understanding by Uncertainty-Aware CoT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04471","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2504.04471","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:1f3248fb5136024eabf0b2b5f21acacad8d817dc854bd806845d6b0174f8ce2b","observation_id":"7c456548-7f5e-42d0-bab2-7fc368bcd735","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:9864dc29033708d2b553dca524e7cefe3b73b3b6bf5750eecdd343f01416e889","observation_id":"bb7579d8-3d66-4079-9697-4676aab3d2d3","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:3c979fc1e336c6d99728c5b2ba94cc85e8ad7632653cfed693a4ce359ced888d","observation_id":"f3651ef8-bde0-495b-89a2-27ddcf036380","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:709bb1b387c4f1c362070577de7280604b9669380713fc036937e5367535d1eb","observation_id":"2be23ff0-df14-4fe2-a61b-0c68bba92bed","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-07-11T12:10:52.100410Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-11T12:10:52.100410Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2607.04872"},"observation_digest":"sha256:54711cfc13770c4eeb966b925d65652d05dc87c044d5a2ba00a0916ffa4f0e3e","observation_id":"a3fa4675-d013-4c78-835b-9d0b44583066","resolution":{"observed_at":"2026-07-11T12:10:52.100410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04872","last_updated":"2026-07-06T09:47:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T06:09:59.502332Z","submitted_at":"2026-07-06T09:47:23Z","title":"EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2607.04872."}