{"as_of":"2026-08-09T18:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d37c27161471cc38d34603d3549f81dd3c5a04371d3bea553db11482b57d607","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T22:56:23.337858Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.13402/citation-record","integrity":"/paper/2603.13402/integrity","json":"/paper/2603.13402/citation-record.json","paper":"/paper/2603.13402"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: SIGGRAPH Asia 2024 Conference Papers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:cd360ac07dffa957468d81643012e9bf897c90b33f62b8de9144503b9717a802","observation_id":"f4059add-5065-4830-a290-275577167519","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"ArXivabs/2311.15127(2023),https://api.semanticscholar.org/CorpusID: 26531255125","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:f3109ec01d3e5fae5b4221aab48b46b9099d59f3c209de1b0599989aee1efa8c","observation_id":"295d11e7-2593-495b-9a20-a110c016006d","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: 2023 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:4e0be20dc473ada2d981ae0a2454961190e27bbb3f3b6713c0a20b8db92ccde7","observation_id":"302eb8cc-1db8-4122-9052-6a1e5783faa3","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: Singh, A., Fazel, M., Hsu, D., Lacoste- Julien, S., Berkenkamp, F., Maharaj, T., Wagstaff, K., Zhu, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:65cb680193a3246f26df5a07c380e826ac53887582cb898e76af0eb2e059b5e8","observation_id":"23061a30-6b7b-4b9f-8e1f-74b2820b24ee","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: NeurIPS 2021 Work- shop on Deep Generative Models and Downstream Applications (2021),https: //openreview.net/forum?id=qw8AKxfYbI25","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:888ace6b52cb734bf8b410612ebb01ab51d734e155754b928a713a85d0ef21ef","observation_id":"96398e6e-da28-4b0b-8ea2-72ce803f120b","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: Chaudhuri, K., Salakhutdinov, R","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:3b48b8fe98aaf5f4cf33cb453b33f3fd57b2d30a7aecd7e075cd68b73be62fea","observation_id":"b8118885-44ae-488e-acab-f4b801edd18d","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: International Con- ference on Learning Representations (2022),https://openreview.net/forum?id= nZeVKeeFYf932","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:60e917ab15ac701bf4cc1d9b57c334466a198b92cbcf005b99f9a3f376be3665","observation_id":"cccb86e3-3777-4333-9150-379776451ca2","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11251","last_updated":"2025-03-14T10:01:55Z","snapshot_observed_at":"2026-08-09T05:35:15.000362Z","submitted_at":"2025-03-14T10:01:55Z","title":"Step-Video-TI2V Technical Report: A State-of-the-Art Text-Driven Image-to-Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11251","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2503.11251","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:dee196e7a93ffe6e7cfafb087b43f0d164cf5391d109a489e15eb72b02f2977d","observation_id":"7213dedf-a53b-4a22-a3e5-f9f82440cc3e","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:9d7f955477788cf3f8ca286bbb3cb2f39d99bd553a3e9c41d603b4a8f10c19ee","observation_id":"2507e421-3dd1-47d3-a15e-c2c37980fcf2","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:3594a11732e74b4b129713a0991d4f9d2cccc6e567af2ef2f3f56e11314405b3","observation_id":"f83aa2ce-bfba-497d-86a3-84638d243d6e","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: The Thirteenth International Conference on Learning Representations (2025), https://openreview.net/forum?id=66NzcRQuOq2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:ed831ad1c3174f82a0111a3f8ebfc35036efc1b9ce9f53c7ef61bd18ca8e51e9","observation_id":"b58e7bf4-d9ff-4a8e-92fc-b5b693ff13dd","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:b9693c8df544f026310ddb5bb3616685ff4573ca9279b2a1b5302ef0317bacfa","observation_id":"04a8dab1-4a81-42c1-8a94-9a2339fcdc77","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: The Thirty-eighth Annual Conference on Neural Information Processing Systems (2024),https://openreview.net/forum?id=53daI9kbvf2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:1fc262ddc8137f3628561f5439814caf4f30f5a052cf07d18a3d4255f0d3891b","observation_id":"2c9ccf5a-38f7-47f6-a22c-f2abe3024408","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: The Thirteenth International Conference on Learning Representations (2025),https://openreview.net/forum?id=BZwXMqu4zG2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:73bb0373e9404d6982f93249215ae7bddb73dd11579884f768427168f08a1411","observation_id":"7da56f96-fa9e-420d-9fac-833fed3b6150","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: The Eleventh International Conference on Learning Representations (2023),https://openreview.net/forum?id=PqvMRDCJT9t4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:02e52fe1b90e025aa7af90be99bbed270c87f4970fc30150fb895ef4ccb39b37","observation_id":"94c3cf96-0841-416c-9c9d-304f9fe1fc87","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: Avidan, S., Brostow, G., Cissé, M., Farinella, G.M., Hassner, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:b0a1cfe76d3f284b1987f0305262c0ed8156d5a9a3fe3cc0446baf90fcc1ce37","observation_id":"aeeded6d-0eca-4749-9895-aef4ca88c741","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:872fe6464cd1fe1647386e94ec44c04f87c78b97f005f0ec6b59502c7991ea13","observation_id":"5112e65a-e406-4eb6-865b-585573014806","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22265","last_updated":"2026-06-29T23:52:39Z","snapshot_observed_at":"2026-08-07T01:42:43.037224Z","submitted_at":"2026-02-25T06:07:01Z","title":"Entropy-Controlled Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.22265","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2602.22265","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:8a262a9c46412118d642338eb3d2990a019c5150b95f0a99c6ce9b7e9b2f29f5","observation_id":"883cfd76-4e60-49d5-b6de-dcafc9383350","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"org/abs/2505.2154525, 49","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:cdd7f3abe3c9118d5c134268af5e9d5bbe2a246851f51145bd13515f74cc52a4","observation_id":"e30d96cb-8d9c-4cb4-ad15-590472b8f4b4","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:569be48c015bdd3350575ad49844ce847d331ee137b4739ed01d3766cb849981","observation_id":"54e5236f-6e6e-4c87-be9c-8b58fdceea55","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: 2023 IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:d9325e1d1c2c5d5bc3caf84af3dbfda5ccb0798e5e2de2c61876328532bc7772","observation_id":"2ea16e18-bbdb-46f0-b75a-38df5d877e33","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-09T03:17:30.671491Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"arXiv preprint arXiv:2410.13720 (2024) 2, 3, 5, 24","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:31ed7124d5f3da699e01f1684b1ff268d67e4ff432a26788431c32982d945ab4","observation_id":"2bcb739c-2f05-4c21-8968-3ec12f344c25","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:64a5c1df8babcd567d9ee507632858d5548bd8250affa586b03cade4b8d1f25e","observation_id":"a47162fd-152f-47d8-a9d3-93cfa9bdb8eb","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: 2022 IEEE/CVF Confer- ence on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:9916e4ea23c28d694023d9092102de8e6ffa44baf8ad3106d4ab1a93e439f559","observation_id":"530e6c80-cb50-4c9e-b30f-7a901b269540","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:e143bf588c70321657106e4b3ad226a58f12cd40c7536e84614ca811e7d74381","observation_id":"ff931985-2634-4348-8de5-ac8cd2ee5fec","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.18870","last_updated":"2025-11-25T02:52:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-24T08:22:07Z","title":"HunyuanVideo 1.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.18870","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2511.18870","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:33f309eac5a8a99c8e1419ff2d486f5c0fe9837a519466bf2db59e2b4c6d5e31","observation_id":"fe7062fc-2f92-4826-8fe2-0881415960f2","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: The Thirteenth International Conference on Learning Represen- tations (2025),https://openreview.net/forum?id=LQzN6TRFg92, 3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:b5119371f6fa4c8c808d0d6a0d4b9b9d77ccc636aa2ad4d85a2615d5191b69d5","observation_id":"b60f68cd-11c8-4890-b525-a8c91283d3ac","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: 2023 IEEE/CVF International Conference on Computer Vi- sion (ICCV)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:788b892f85f6643872a390587080d84f1e7bede218da4e1285c1a74620a4e797","observation_id":"71c00dd6-d637-4280-a372-eadc5fa8fe50","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:de88d3f1cc543d530828b0a7164fe1a6669f02f5d28e5d85cfa25e4bd44d0deb","observation_id":"e8a8eff0-82bf-4053-9e63-f807a970cd59","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:a6f90e8dd1cf7fc56b88bb45d463b62319b71898161ccd2c3ecb5e7ae6c60abe","observation_id":"cf20a088-0f91-4618-990f-ca1a9eef1480","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"In: Thirty-seventh Conference on Neu- ral Information Processing Systems (2023),https://openreview.net/forum?id= 9fWKExmKa05, 40","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:5ee2ba4d716bc5e66b8074abc82d9d000e8167bcbc6f9f282c7ec8263ba957fd","observation_id":"6ffe06a5-cc86-4052-a0ee-4192c5338adf","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-07-14T22:56:23.337858Z","title":"strong-early","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T22:56:23.337858Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2603.13402"},"observation_digest":"sha256:bdd390b1a7ae36766448fbc001946b9f22602a137f3b5b4874e9ab647d5db427","observation_id":"a412d222-625c-46b8-bcf1-5705e43575a0","resolution":{"observed_at":"2026-07-14T22:56:23.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.13402","last_updated":"2026-06-29T23:43:05Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T00:48:30.265316Z","submitted_at":"2026-03-12T00:16:56Z","title":"Event-Driven Video Generation"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2603.13402."}