{"as_of":"2026-08-06T19:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39fdf5f13e7537aecf0a3ae247ec14484d1aa4aeeb16eeaf1b67e290a54eb0f2","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T21:40:43.956642Z","state":"measured"},{"denominator":163,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":163,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":102,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:39:21.916399Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":37,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T23:51:23.877344Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2311.04145"},"observation_digest":"sha256:4172cec9d8bc26bf805b79c75d9ad91bc022b52bb956b2055f8f7a5467585753","observation_id":"e006bb4c-6a3b-4c02-935d-93590a2c153d","resolution":{"observed_at":"2026-05-17T23:51:24.055365Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2312.14125","last_updated":"2024-06-04T17:25:20Z","snapshot_observed_at":"2026-07-30T23:45:07.963944Z","submitted_at":"2023-12-21T18:46:41Z","title":"VideoPoet: A Large Language Model for Zero-Shot Video Generation","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T17:51:05.465548Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2312.14125"},"observation_digest":"sha256:84ee4c27a8bce6bfb5342b54947db907c896f6268976901f534337e1409f2142","observation_id":"426170da-27f0-43e9-a152-835b47dfd271","resolution":{"observed_at":"2026-05-15T17:51:05.654063Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-04T13:02:12.217544Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T19:43:33.639639Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2406.02509"},"observation_digest":"sha256:715f9776706c2ad56a4bd6c4eb7aaf886ee94e1ab45c46cb602c3e7f8db8113d","observation_id":"c1732485-e125-4bf6-80a4-b757820b66ec","resolution":{"observed_at":"2026-05-16T19:43:33.831108Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2407.02371","last_updated":"2025-02-13T10:13:24Z","snapshot_observed_at":"2026-08-06T12:43:20.523348Z","submitted_at":"2024-07-02T15:40:29Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-14T20:34:53.141898Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2407.02371"},"observation_digest":"sha256:26fb3a4466b3d5fa5c4da8ade23b8b49704bff33e6553269b552759ca73f2aa4","observation_id":"cd152788-bebd-4ade-80fc-7278477d8bc8","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T14:16:18.521699Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2410.13720"},"observation_digest":"sha256:a68d7a6a999635e600187f42c145478a49f8170a94e29cc1697cfc8d08924b65","observation_id":"c0b07ee2-4b25-4c54-b1b0-414e9ea2a2ff","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2411.16748","last_updated":"2026-05-08T09:16:59Z","snapshot_observed_at":"2026-08-04T02:06:42.093429Z","submitted_at":"2024-11-24T04:46:00Z","title":"Multimodal Diffusion Transformer with Memory Bank for Scalable Long-Duration Talking Video Generation","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-23T17:19:51.411937Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2411.16748"},"observation_digest":"sha256:2a9c7253ab7d139eeac63aa71c6b446b7eb1edbe54e99f69578c81dad72c0a37","observation_id":"10460333-0b84-4b65-8e7b-13fcaeba0829","resolution":{"observed_at":"2026-05-23T17:23:15.440156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T18:42:02.940250Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2503.21755"},"observation_digest":"sha256:bc5443d4dbfb00395b6514b1b58b61bd80a799e7c8ac42d9b61b9c92b87c069a","observation_id":"5fc17b73-e264-4628-a563-8c92539999b5","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2504.17180","last_updated":"2026-04-03T02:52:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-24T01:34:12Z","title":"We'll Fix it in Post: Improving Text-to-Video Generation with Neuro-Symbolic Feedback","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T18:56:39.735334Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2504.17180"},"observation_digest":"sha256:7d6cb60f9ce466b1c262e2a48b5a5518bf4e65c18fe25d930a2b8185716f7dff","observation_id":"380dedcd-b486-4843-bda1-495402ad3e94","resolution":{"observed_at":"2026-05-22T18:56:58.362844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2506.15564","last_updated":"2025-09-22T01:24:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T15:39:15Z","title":"Show-o2: Improved Native Unified Multimodal Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T18:51:15.428692Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2506.15564"},"observation_digest":"sha256:ddad3a31dd4f11b482098114674afcc8136663d501558fd9d0c5e61c79e881b2","observation_id":"5f58e02a-10c3-4ead-891b-c0498dd1c865","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2506.23690","last_updated":"2026-04-28T09:27:09Z","snapshot_observed_at":"2026-07-06T21:49:38.384518Z","submitted_at":"2025-06-30T10:09:32Z","title":"SynMotion: Semantic-Visual Adaptation for Motion Customized Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T07:59:49.398271Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2506.23690"},"observation_digest":"sha256:61202c3a30b2e5fd8fd23f1bc7ba10cafb570f54455c90f0cc66e29059350c37","observation_id":"91015f69-6c2f-45f0-8cdc-24e0dfb6cbd2","resolution":{"observed_at":"2026-05-19T08:02:10.311210Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2507.01925","last_updated":"2025-07-02T17:34:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-02T17:34:52Z","title":"A Survey on Vision-Language-Action Models: An Action Tokenization Perspective","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-05-17T14:08:34.893876Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.01925"},"observation_digest":"sha256:98cf532d131feb061cdfacc95c499a422f211710bd6a2ff61ce3c93bc2303668","observation_id":"eb7d097e-2a0f-43da-862a-f92c445d6416","resolution":{"observed_at":"2026-05-17T14:08:35.191363Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2507.07982","last_updated":"2026-05-05T14:55:01Z","snapshot_observed_at":"2026-08-04T10:05:27.686733Z","submitted_at":"2025-07-10T17:55:08Z","title":"Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-19T05:13:28.767788Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.07982"},"observation_digest":"sha256:a0a02190a5f4189fd66db4f663ac1c408757e5776738d1f96b8dd3f74d437086","observation_id":"a487e12a-7211-4226-b224-620720a0d5db","resolution":{"observed_at":"2026-05-19T05:17:06.610614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T16:39:21.916399Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12952","last_updated":"2025-07-17T09:46:43Z","snapshot_observed_at":"2026-08-06T16:31:38.596869Z","submitted_at":"2025-07-17T09:46:43Z","title":"LoViC: Efficient Long Video Generation with Context Compression","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:21.916399Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.12952"},"observation_digest":"sha256:fd56516ab54d06440fa9b86ab53583f28e3c1e93b73f697eb6778b8cb1a768a7","observation_id":"6c9fcc23-b086-4b9b-92d3-f3a8e8bcbf8c","resolution":{"observed_at":"2026-08-06T16:39:21.916399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T15:24:25.313817Z","title":"Videocrafter1: Open diffusion models for high- quality video generation.arXiv preprint arXiv:2310.19512,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16116","last_updated":"2026-05-26T15:21:27Z","snapshot_observed_at":"2026-08-06T15:15:40.031886Z","submitted_at":"2025-07-22T00:09:37Z","title":"Pusa V1.0: Unlocking Temporal Control in Pretrained Video Diffusion Models via Vectorized Timestep Adaptation","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T15:24:25.313817Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.16116"},"observation_digest":"sha256:ca5285c6e9a4d51b22b8fbab5ce3bc6e21ee36111af224c95e1e3221da4c3434","observation_id":"755f72c9-b82c-4f19-a1e1-4d380e1b2978","resolution":{"observed_at":"2026-08-06T15:24:25.313817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T15:20:00.075763Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-06T15:10:11.498821Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.075763Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:d6ee2987ce22c74f2b860bd84d24897d2c6663cbfbd2c8dd996d568dc8de8ffb","observation_id":"b4a1deb5-66ff-4975-b55a-97e8de553122","resolution":{"observed_at":"2026-08-06T15:20:00.075763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T14:43:26.298363Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18107","last_updated":"2025-07-24T05:37:08Z","snapshot_observed_at":"2026-08-06T14:36:17.487067Z","submitted_at":"2025-07-24T05:37:08Z","title":"T2VWorldBench: A Benchmark for Evaluating World Knowledge in Text-to-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:26.298363Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.18107"},"observation_digest":"sha256:bea2c2dfa41f5f44fd3858ae84801483ece1458b856b87f5e2550d3ec4c75f43","observation_id":"66558e01-953a-4bcc-91e7-70f36cf8d7ba","resolution":{"observed_at":"2026-08-06T14:43:26.298363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T13:47:44.875426Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20158","last_updated":"2025-07-27T07:25:08Z","snapshot_observed_at":"2026-08-06T13:47:43.619731Z","submitted_at":"2025-07-27T07:25:08Z","title":"AnimeColor: Reference-based Animation Colorization with Diffusion Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:44.875426Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.20158"},"observation_digest":"sha256:7b72a92ef6440cca562a401cde217ef5412f0e95575f69833a8bbbd2abae80e6","observation_id":"4038557f-9098-441d-aa26-06e3cf165e1f","resolution":{"observed_at":"2026-08-06T13:47:44.875426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T04:44:56.200389Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03032","last_updated":"2025-08-05T03:18:04Z","snapshot_observed_at":"2026-08-06T04:44:54.183188Z","submitted_at":"2025-08-05T03:18:04Z","title":"A Summer Meridional Subsurface Temperature Dipole Mode in the South China Sea","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T04:44:56.200389Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2508.03032"},"observation_digest":"sha256:3c3abc3fa47e44997748364f87537ac942c7c44159c8d37ceda828e14841a55f","observation_id":"d12af3d5-5103-4fe5-abf5-85cedc1f9aa4","resolution":{"observed_at":"2026-08-06T04:44:56.200389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T04:46:04.032620Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03050","last_updated":"2025-08-05T03:54:18Z","snapshot_observed_at":"2026-08-06T04:45:56.328963Z","submitted_at":"2025-08-05T03:54:18Z","title":"Multi-human Interactive Talking Dataset","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T04:46:04.032620Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2508.03050"},"observation_digest":"sha256:d497511f2c6f537484dfbf42685715d9d60bd0c2b9cfe8359f3106d2bc7ec33e","observation_id":"0a5c21c2-a261-4a67-b674-442421b2a455","resolution":{"observed_at":"2026-08-06T04:46:04.032620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T22:22:43.881657Z","title":"Videocrafter1: Open diffusion models for high-quality video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07149","last_updated":"2025-08-10T02:45:59Z","snapshot_observed_at":"2026-08-05T22:22:43.327316Z","submitted_at":"2025-08-10T02:45:59Z","title":"SketchAnimator: Animate Sketch via Motion Customization of Text-to-Video Diffusion Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T22:22:43.881657Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2508.07149"},"observation_digest":"sha256:dad9471c1ac7b7baab12ff39211ec49ab0d9f1b8f813c25a00ced579511874ce","observation_id":"320308bd-f76d-4df0-b399-e7fa2cffd300","resolution":{"observed_at":"2026-08-05T22:22:43.881657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T22:21:05.579844Z","title":"Videocrafter1: Open diffusion models for high-quality video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-05T22:21:04.402017Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.579844Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:23eef5a2e935d6be12c79b53834c2b1c01e110ebae81f208cce4401869c9d367","observation_id":"67ebeb40-4eb4-4d39-b795-07e016efc5d4","resolution":{"observed_at":"2026-08-05T22:21:05.579844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T17:46:34.279019Z","title":"Videocrafter1: Open diffusion models for high-quality video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.15774","last_updated":"2025-08-21T17:59:57Z","snapshot_observed_at":"2026-08-05T17:46:31.112694Z","submitted_at":"2025-08-21T17:59:57Z","title":"CineScale: Free Lunch in High-Resolution Cinematic Visual Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T17:46:34.279019Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2508.15774"},"observation_digest":"sha256:10a4fe63e03cd425e5002e14490bec9b067570f2eef6adb654d45ed5101e52f5","observation_id":"9d89fd37-f3ec-4ff1-9b61-a42d7b042d1d","resolution":{"observed_at":"2026-08-05T17:46:34.279019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T10:36:57.270453Z","title":"Videocrafter1: Open diffusion models for high-quality video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03883","last_updated":"2025-09-04T04:39:21Z","snapshot_observed_at":"2026-08-05T10:36:47.088347Z","submitted_at":"2025-09-04T04:39:21Z","title":"Human Motion Video Generation: A Survey","version":1},"reference_index":129,"source":"pdf_text","source_observed_at":"2026-08-05T10:36:57.270453Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2509.03883"},"observation_digest":"sha256:6034c5f48cfaf6a67f0ec91eedc7d6b3d4585bd146614c5a7e99befbdc516471","observation_id":"6553090b-ab34-4d09-9847-4edc1083ae44","resolution":{"observed_at":"2026-08-05T10:36:57.270453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2509.19979","last_updated":"2026-04-19T15:26:50Z","snapshot_observed_at":"2026-07-31T17:00:04.951932Z","submitted_at":"2025-09-24T10:34:24Z","title":"CamPVG: Camera-Controlled Panoramic Video Generation with Epipolar-Aware Diffusion","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T14:35:57.939589Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2509.19979"},"observation_digest":"sha256:39de6ea11c37e60d5065b052561314ae324cf2b6b1948c3535d02d7b0e184e29","observation_id":"8a76d11f-6c96-4ce3-96e2-ec22ffe84250","resolution":{"observed_at":"2026-05-18T14:36:28.459037Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-04T10:54:30.288405Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.08073","last_updated":"2026-06-10T11:00:38Z","snapshot_observed_at":"2026-08-04T10:54:17.464105Z","submitted_at":"2025-10-09T11:00:35Z","title":"Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:30.288405Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2510.08073"},"observation_digest":"sha256:45fdcc7396fad6fe49d91d2acd31b61704dba15696c4a91586bd8699c0874f71","observation_id":"51055e20-7b89-49ed-ab5a-e87a72efd481","resolution":{"observed_at":"2026-08-04T10:54:30.288405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-04T10:49:47.409544Z","title":"Videocrafter1: Open diffusion models for high- quality video generation.arXiv preprint arXiv:2310.19512,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.08377","last_updated":"2026-07-03T16:46:11Z","snapshot_observed_at":"2026-08-04T10:49:46.339959Z","submitted_at":"2025-10-09T16:01:30Z","title":"UniVideo: Unified Understanding, Generation, and Editing for Videos","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T10:49:47.409544Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2510.08377"},"observation_digest":"sha256:2b0e9c5b4a2685ae88cfda5a2b6e678847d614a58228db50563f84f7fe42aaf6","observation_id":"602babb6-035c-45da-8804-32abc1170651","resolution":{"observed_at":"2026-08-04T10:49:47.409544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-04T10:45:58.066473Z","title":"Videocrafter1: Open diffusion models for high- quality video generation.arXiv preprint arXiv:2310.19512,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.08555","last_updated":"2026-05-27T13:14:12Z","snapshot_observed_at":"2026-08-04T15:58:21.664751Z","submitted_at":"2025-10-09T17:58:59Z","title":"VideoCanvas: Unified Video Completion from Arbitrary Spatiotemporal Patches via In-Context Conditioning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T10:45:58.066473Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2510.08555"},"observation_digest":"sha256:6d3504265c198d2c1a115385eb4a57b60e2982a905a52a9da2077450d83a11ca","observation_id":"7a0b5785-49dd-437e-b9e1-558f475f1187","resolution":{"observed_at":"2026-08-04T10:45:58.066473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2511.19320","last_updated":"2026-05-18T02:38:41Z","snapshot_observed_at":"2026-08-02T10:22:49.004993Z","submitted_at":"2025-11-24T17:15:55Z","title":"SteadyDancer: Harmonized and Coherent Human Image Animation with First-Frame Preservation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T18:21:08.172735Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2511.19320"},"observation_digest":"sha256:0b8118988e63ce6d63dda98f0a37c5dbb3a9a9271d662f8f546830b515331ca5","observation_id":"c7212b2e-c93a-4d14-ae43-edd1ba4f7281","resolution":{"observed_at":"2026-05-21T18:24:18.330790Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-03T18:30:01.936675Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.05044","last_updated":"2026-07-08T17:50:45Z","snapshot_observed_at":"2026-08-03T18:29:59.896456Z","submitted_at":"2025-12-04T17:59:10Z","title":"Geometry-Aware Single-Image 4D Synthesis via Dense Trajectory Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T18:30:01.936675Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2512.05044"},"observation_digest":"sha256:d4f204f5a2b5170d4f4fd1a3e2c44116228944ad5ec309eba0765152589d7543","observation_id":"eac69dac-033f-4718-8efa-a80d32ca4533","resolution":{"observed_at":"2026-08-03T18:30:01.936675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2512.09923","last_updated":"2026-04-28T15:00:07Z","snapshot_observed_at":"2026-07-06T22:38:40.044448Z","submitted_at":"2025-12-10T18:57:04Z","title":"Splatent: Splatting Diffusion Latents for Novel View Synthesis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T23:04:28.468206Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2512.09923"},"observation_digest":"sha256:1fdd6102d407fd8e43208d28f8be4272d37dc62b210e7cfdbfc5cb2e2ac5ec8e","observation_id":"6dd20179-2f44-420f-b083-bc6e844aa843","resolution":{"observed_at":"2026-05-16T23:08:40.138851Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-03T13:24:43.707619Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.24551","last_updated":"2026-06-18T22:13:10Z","snapshot_observed_at":"2026-08-03T13:24:41.191940Z","submitted_at":"2025-12-31T01:19:14Z","title":"PhyGDPO: Physics-Aware Groupwise Direct Preference Optimization for Physically Consistent Text-to-Video Generation","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T13:24:43.707619Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2512.24551"},"observation_digest":"sha256:b6ac29214e219973608a6f1a9471da11dca1ccba9dcb6527d2cd9821eb9c0c10","observation_id":"1a7ad2e2-d4f0-459e-82bf-eb8759b2f0a6","resolution":{"observed_at":"2026-08-03T13:24:43.707619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-03T11:36:13.383486Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.05729","last_updated":"2026-05-26T12:06:13Z","snapshot_observed_at":"2026-08-03T11:36:12.571402Z","submitted_at":"2026-01-09T11:15:27Z","title":"TAGRPO: Boosting GRPO on Image-to-Video Generation with Direct Trajectory Alignment","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T11:36:13.383486Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2601.05729"},"observation_digest":"sha256:1b5cc6ff19c1faf056400f792f5cce79cff923cfc1a771ec6c4969575f0e16fb","observation_id":"f8c335d7-9599-4d26-a8f0-d821fa852b93","resolution":{"observed_at":"2026-08-03T11:36:13.383486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T17:32:01.642256Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2602.02214"},"observation_digest":"sha256:b525e6c26bce3d643ed18ab29df3589c778e897581fb28a1a7d8098743fca759","observation_id":"18a3bb33-b979-48df-b396-94677ad2290c","resolution":{"observed_at":"2026-05-21T17:32:01.692690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T11:48:00.633421Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2602.02214"},"observation_digest":"sha256:410ef64fcf6f18a73531c805d29350bffb983c280c72071bfdb3d84ab9fa3c25","observation_id":"3ac6d2d8-aee2-4119-b6ff-3e894202e66d","resolution":{"observed_at":"2026-05-22T11:51:29.847088Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-03T05:30:24.315015Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-03T05:30:22.346810Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":5},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T05:30:24.315015Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2602.02214"},"observation_digest":"sha256:1e183727cff850ed55123aef5ab919e982f830f33556fe48e723ec4ebe593a06","observation_id":"9b789e77-2c53-4e54-baac-4aa21cbaa843","resolution":{"observed_at":"2026-08-03T05:30:24.315015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2602.07775","last_updated":"2026-05-03T01:49:14Z","snapshot_observed_at":"2026-07-30T09:22:37.641917Z","submitted_at":"2026-02-08T02:16:02Z","title":"Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion","version":6},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T07:02:38.876518Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2602.07775"},"observation_digest":"sha256:20cc475a2a6e7f239fab548c628225f98044fd3c2f899a5bbc8a73b65c3cd99b","observation_id":"e029e815-0cb4-4049-b07f-f681e762ba6a","resolution":{"observed_at":"2026-05-16T07:07:29.979047Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-03T00:09:55.905154Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11564","last_updated":"2026-05-27T07:44:49Z","snapshot_observed_at":"2026-08-03T00:09:54.641709Z","submitted_at":"2026-02-12T04:35:16Z","title":"LUVE : Latent-Cascaded Ultra-High-Resolution Video Generation with Dual Frequency Experts","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T00:09:55.905154Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2602.11564"},"observation_digest":"sha256:d1d808ddb258b747234c063476e8e711b4c339bc482681acf00a53954e0aad78","observation_id":"5f7d1632-9758-4bf8-a676-047785cf26dc","resolution":{"observed_at":"2026-08-03T00:09:55.905154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2603.03066","last_updated":"2026-05-19T02:39:43Z","snapshot_observed_at":"2026-07-31T20:59:59.870316Z","submitted_at":"2026-03-03T15:05:27Z","title":"EduVQA: Towards Concept-Aware Assessment of Educational AI-Generated Videos","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T11:52:09.262497Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2603.03066"},"observation_digest":"sha256:65138f13315f6bfa439f6c2717d2ff02678dd4770dbed0f3830f5aa936fbf8ac","observation_id":"d814426f-2eed-49f0-b1cf-764b707e8baf","resolution":{"observed_at":"2026-05-21T11:54:09.086838Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-07-14T21:09:36.040879Z","title":"arXiv preprint arXiv:2310.19512 (2023) 4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.14526","last_updated":"2026-06-28T22:57:12Z","snapshot_observed_at":"2026-08-02T01:05:20.949344Z","submitted_at":"2026-03-15T18:07:29Z","title":"LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T21:09:36.040879Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2603.14526"},"observation_digest":"sha256:bb641d1ccf0bdeb6fbd48c7e234485d1b55e21bd5b2b45b2d1459b39b4f9225b","observation_id":"6aa111e7-9027-4624-a0df-138fdfd90550","resolution":{"observed_at":"2026-07-14T21:09:36.040879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-03T00:56:26.115945Z","title":"arXiv preprint arXiv:2310.19512 (2023) 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.02330","last_updated":"2026-07-30T19:00:35Z","snapshot_observed_at":"2026-08-06T00:22:06.543814Z","submitted_at":"2026-04-02T17:59:58Z","title":"ActionParty: Multi-Subject Action Binding in Generative Video Games","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T00:56:26.115945Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.02330"},"observation_digest":"sha256:0c20df1266d8251fd5d67b3365ab78e3d37007f6a625ddb1ff7104056c2b7822","observation_id":"4d389076-f765-4efc-9c90-ab0b0e982277","resolution":{"observed_at":"2026-08-03T00:56:26.115945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2604.04029","last_updated":"2026-04-05T09:10:13Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T09:10:13Z","title":"ATSS: Detecting AI-Generated Videos via Anomalous Temporal Self-Similarity","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-13T17:15:14.018979Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.04029"},"observation_digest":"sha256:168a3df6da32ff9bb8b05d2062ba35838573f743506239c084daf9c65fb6d638","observation_id":"5cff4964-e024-4b99-9ff3-ca7f53f11c29","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"orphan_title_repair","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2604.08500","last_updated":"2026-04-09T17:44:18Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:44:18Z","title":"Novel View Synthesis as Video Completion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:26:39.418764Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.08500"},"observation_digest":"sha256:16fa207fc113567bd228a79dfaa23d2ebe44b0b4fff46e977113c759fc748a3f","observation_id":"40358177-5c14-4518-b3d0-cd0878ae0ebc","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2604.08546","last_updated":"2026-04-09T17:59:57Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:59:57Z","title":"When Numbers Speak: Aligning Textual Numerals and Visual Instances in Text-to-Video Diffusion Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:39:26.420463Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.08546"},"observation_digest":"sha256:147287be127c27f5cc80d222c56c2c108e0d87a5117b6d001c007353050586b6","observation_id":"bd648c7c-57ac-4caa-8b8f-2894ca291ab2","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2604.11283","last_updated":"2026-06-01T08:50:38Z","snapshot_observed_at":"2026-08-02T05:26:21.584719Z","submitted_at":"2026-04-13T10:42:31Z","title":"Multimodal Large Language Model-Enabled Video Translation: A Role-Oriented Survey","version":1},"reference_index":124,"source":"pdf_text","source_observed_at":"2026-05-10T16:36:33.264166Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.11283"},"observation_digest":"sha256:0bc6ff55ff5306e343a53d67319270b9e97956674dc0f19f392121d4b6b1993a","observation_id":"74486fde-550f-4174-bb44-f34241fd00c0","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-07-12T22:04:31.302192Z","title":"Videocrafter1: Open diffusion models for high-quality video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.11283","last_updated":"2026-06-01T08:50:38Z","snapshot_observed_at":"2026-08-02T05:26:21.584719Z","submitted_at":"2026-04-13T10:42:31Z","title":"Multimodal Large Language Model-Enabled Video Translation: A Role-Oriented Survey","version":2},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-07-12T22:04:31.302192Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.11283"},"observation_digest":"sha256:276ade4ba55728c9aec641a380df2dfe2c78ff1a944285c858cddbe1d4c302c1","observation_id":"f23cc3f8-e384-4a5e-8ebe-e1ed8a41ded7","resolution":{"observed_at":"2026-07-12T22:04:31.302192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2604.11789","last_updated":"2026-04-20T14:38:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T17:55:02Z","title":"LMMs Meet Object-Centric Vision: Understanding, Segmentation, Editing and Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T15:35:37.095627Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.11789"},"observation_digest":"sha256:a52652d51440db1d85d9f7a2ef613c6e3c9c6f9cc5056aa4df0d496db9acff01","observation_id":"3a3761ef-a2ae-444e-a4db-5388b0a759b7","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2604.13030","last_updated":"2026-07-07T13:17:16Z","snapshot_observed_at":"2026-07-12T21:00:28.771955Z","submitted_at":"2026-04-14T17:59:03Z","title":"Generative Refinement Networks for Visual Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T15:41:23.057949Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.13030"},"observation_digest":"sha256:83b4b7afb3bd6f44fc6462ce93b9b22df29dce3d0a038767a6f24c8ef82a38a3","observation_id":"bd5d5ab6-072f-4226-9104-27b676f29936","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-07-12T21:00:35.123495Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.13030","last_updated":"2026-07-07T13:17:16Z","snapshot_observed_at":"2026-07-12T21:00:28.771955Z","submitted_at":"2026-04-14T17:59:03Z","title":"Generative Refinement Networks for Visual Synthesis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T21:00:35.123495Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.13030"},"observation_digest":"sha256:a6f69c87f6b3cc93e56cec4da42069225e3c325f8ab8698dcfa1d785b588a0a1","observation_id":"fe037970-48c3-43e6-8eca-12aa1c072dd5","resolution":{"observed_at":"2026-07-12T21:00:35.123495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2604.23579","last_updated":"2026-04-26T07:34:41Z","snapshot_observed_at":"2026-07-06T23:09:48.137856Z","submitted_at":"2026-04-26T07:34:41Z","title":"CineAGI: Character-Consistent Movie Creation through LLM-Orchestrated Multi-Modal Generation and Cross-Scene Integration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T05:08:37.971891Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2604.23579"},"observation_digest":"sha256:4efb6d79018259742c39a4d0d518bf102b1fae5a1c17e8757cc0e50b4c59c8eb","observation_id":"d607a89a-c3ce-4069-8059-afffb872a05b","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.00630","last_updated":"2026-05-01T13:04:14Z","snapshot_observed_at":"2026-07-06T23:14:01.852096Z","submitted_at":"2026-05-01T13:04:14Z","title":"CMTA: Leveraging Cross-Modal Temporal Artifacts for Generalizable AI-Generated Video Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-09T20:22:00.777817Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.00630"},"observation_digest":"sha256:d3b3b482fd0c2a62ccc5bbb1326086c3566ca0c389733c233f6b0157b79fac13","observation_id":"9600dc55-602e-435a-9ed0-b53b035d62b0","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.01517","last_updated":"2026-05-02T16:10:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-02T16:10:55Z","title":"VAnim: Rendering-Aware Sparse State Modeling for Structure-Preserving Vector Animation","version":1},"reference_index":222,"source":"arxiv_source","source_observed_at":"2026-05-09T14:05:15.742176Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.01517"},"observation_digest":"sha256:f91c9875564513b526061ca51ffc7b55b9bb8b885431c6a028c156390eb6d06b","observation_id":"4d8504b3-de0d-486e-8a85-399ccb33e74d","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.05895","last_updated":"2026-07-31T14:44:20Z","snapshot_observed_at":"2026-08-05T23:14:25.356148Z","submitted_at":"2026-05-07T09:08:32Z","title":"Detecting AI-Generated Videos with Spiking Neural Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T16:15:42.113951Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.05895"},"observation_digest":"sha256:8479d90e125d5e68f21c18c1439ec70cda873223c9ab0192a4d2b64c4c28fa0f","observation_id":"af843475-e8fb-4cb5-8054-4bc0484bdd64","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-03T02:24:57.328179Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.05895","last_updated":"2026-07-31T14:44:20Z","snapshot_observed_at":"2026-08-05T23:14:25.356148Z","submitted_at":"2026-05-07T09:08:32Z","title":"Detecting AI-Generated Videos with Spiking Neural Networks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T02:24:57.328179Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.05895"},"observation_digest":"sha256:4bd7d783b9499e96ab50373769adf8d158a816da7ccce537c123c1ba3de61c97","observation_id":"9cd17cc0-da27-4936-be70-d0cb6ed86471","resolution":{"observed_at":"2026-08-03T02:24:57.328179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.06509","last_updated":"2026-05-07T16:21:34Z","snapshot_observed_at":"2026-08-06T11:28:24.405584Z","submitted_at":"2026-05-07T16:21:34Z","title":"FreeSpec: Training-Free Long Video Generation via Singular-Spectrum Reconstruction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T13:11:46.079614Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.06509"},"observation_digest":"sha256:83d1b1c3e7a2ad6022692c20728e362e855106e4e3afb58db8e0c8ae35b962d6","observation_id":"bea2588b-b945-4053-8c10-338a133b44b9","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.07503","last_updated":"2026-05-08T09:37:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-08T09:37:46Z","title":"Diffusion-APO: Trajectory-Aware Direct Preference Alignment for Video Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T01:58:25.291448Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.07503"},"observation_digest":"sha256:b3762e0dc0af9690ce1879bebe65b69c78ceb2034df56a75d45568bae5f01add","observation_id":"4f01954b-c2f4-4c73-b8df-fef6279dece5","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.10525","last_updated":"2026-05-19T08:06:35Z","snapshot_observed_at":"2026-08-02T10:41:59.419436Z","submitted_at":"2026-05-11T13:11:54Z","title":"GemDepth: Geometry-Embedded Features for 3D-Consistent Video Depth","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T04:30:52.549395Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.10525"},"observation_digest":"sha256:63087757fef353e6951d3cd53a324513fd1b5c09d705b14577b51a414d5f8987","observation_id":"b32a48a4-1b09-42ef-9ce0-c41cda030dca","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.10525","last_updated":"2026-05-19T08:06:35Z","snapshot_observed_at":"2026-08-02T10:41:59.419436Z","submitted_at":"2026-05-11T13:11:54Z","title":"GemDepth: Geometry-Embedded Features for 3D-Consistent Video Depth","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T07:49:49.874581Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.10525"},"observation_digest":"sha256:f354f8121da4a34307553ea78fc25eb7a51bf15ba87ec40e5ae87c3f15e1e799","observation_id":"83925331-ba44-46a8-9c79-c9f184aa7f3b","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.10525","last_updated":"2026-05-19T08:06:35Z","snapshot_observed_at":"2026-08-02T10:41:59.419436Z","submitted_at":"2026-05-11T13:11:54Z","title":"GemDepth: Geometry-Embedded Features for 3D-Consistent Video Depth","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T21:27:45.071498Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.10525"},"observation_digest":"sha256:d07103530d22b64c2f28205b4095661a5dceb089d06a7ec87112933b7a98f5d5","observation_id":"d7f3fced-9737-4f04-8642-94da152fc420","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.10525","last_updated":"2026-05-19T08:06:35Z","snapshot_observed_at":"2026-08-02T10:41:59.419436Z","submitted_at":"2026-05-11T13:11:54Z","title":"GemDepth: Geometry-Embedded Features for 3D-Consistent Video Depth","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T23:00:25.109961Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.10525"},"observation_digest":"sha256:ff7e734c453afae39a457a2913f5edcde819a2bc8f0033b0c107cc684d46bd53","observation_id":"eb97e632-f22c-4b7a-8606-329390cd2621","resolution":{"observed_at":"2026-05-20T23:03:50.742749Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.11869","last_updated":"2026-05-12T09:49:36Z","snapshot_observed_at":"2026-07-06T23:23:39.723268Z","submitted_at":"2026-05-12T09:49:36Z","title":"FIS-DiT: Breaking the Few-Step Video Inference Barrier via Training-Free Frame Interleaved Sparsity","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T07:16:33.110035Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.11869"},"observation_digest":"sha256:bf5dec2a38b053a0dbd47c8efe496ba650e58ef1ef7a25b9cdfe569b2e71adad","observation_id":"00242939-f173-4018-9e67-9b2ca3c5aa11","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.12271","last_updated":"2026-05-26T13:34:33Z","snapshot_observed_at":"2026-08-03T01:41:22.691646Z","submitted_at":"2026-05-12T15:35:34Z","title":"Beyond Text Prompts: Visual-to-Visual Generation as A Unified Paradigm","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T06:02:39.114660Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.12271"},"observation_digest":"sha256:959010ca87ed0c78831ba0eab31136d7e62f8ba1b486cd1d0c3bb4de6ca69ef2","observation_id":"daf7aee2-1696-40fa-b6fb-b7512c96db40","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.12271","last_updated":"2026-05-26T13:34:33Z","snapshot_observed_at":"2026-08-03T01:41:22.691646Z","submitted_at":"2026-05-12T15:35:34Z","title":"Beyond Text Prompts: Visual-to-Visual Generation as A Unified Paradigm","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T22:18:55.933311Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.12271"},"observation_digest":"sha256:b8cc198e07429fc7d0d5880fb372bedd7740b265f07989db398631298b8cd9ed","observation_id":"1106ef4b-2dca-4fab-b580-21bb30ce0f6f","resolution":{"observed_at":"2026-07-01T14:05:46.591430Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.13838","last_updated":"2026-06-27T12:19:23Z","snapshot_observed_at":"2026-08-01T20:39:26.680238Z","submitted_at":"2026-05-13T17:58:13Z","title":"R-DMesh: Video-Guided 3D Animation via Rectified Dynamic Mesh Flow","version":1},"reference_index":143,"source":"arxiv_source","source_observed_at":"2026-05-14T19:07:53.671769Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.13838"},"observation_digest":"sha256:1196a32b2fcc0750be3ab09800020c7918202f4b17c3303f8af75b4363225d35","observation_id":"f544950b-2171-4303-9ae5-4d8dd2daff3d","resolution":{"observed_at":"2026-05-14T21:40:44.284627Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.13838","last_updated":"2026-06-27T12:19:23Z","snapshot_observed_at":"2026-08-01T20:39:26.680238Z","submitted_at":"2026-05-13T17:58:13Z","title":"R-DMesh: Video-Guided 3D Animation via Rectified Dynamic Mesh Flow","version":2},"reference_index":143,"source":"arxiv_source","source_observed_at":"2026-05-15T06:08:52.321351Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.13838"},"observation_digest":"sha256:b58682f8b2d765bca8a336779687760b2a8755192cf40f204b16f1be3cbe0f6a","observation_id":"1738c846-8730-4fd7-9bbb-4e45afe54b97","resolution":{"observed_at":"2026-05-15T06:09:49.707848Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.14487","last_updated":"2026-05-14T07:27:39Z","snapshot_observed_at":"2026-08-06T04:41:33.559035Z","submitted_at":"2026-05-14T07:27:39Z","title":"Head Forcing: Long Autoregressive Video Generation via Head Heterogeneity","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T02:31:48.593354Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.14487"},"observation_digest":"sha256:552f6cf4bb77739ae52923217e6134ed64abb6c472a522fb77d4fcdfb8ba8dc3","observation_id":"06c10233-d274-4876-9738-623436773b8c","resolution":{"observed_at":"2026-05-15T02:33:32.135560Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.14569","last_updated":"2026-05-14T08:39:42Z","snapshot_observed_at":"2026-08-05T11:27:50.353545Z","submitted_at":"2026-05-14T08:39:42Z","title":"Bridging Brain and Semantics: A Hierarchical Framework for Semantically Enhanced fMRI-to-Video Reconstruction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T01:51:57.018809Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.14569"},"observation_digest":"sha256:764ab1db95eb2d5e85d4f5a4cd3052b36d64927761dddfa5f4677569feb5b7cd","observation_id":"9c63564a-e809-4dff-aed7-53f739ae9308","resolution":{"observed_at":"2026-05-15T01:53:28.889898Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.15964","last_updated":"2026-05-15T13:55:39Z","snapshot_observed_at":"2026-07-06T23:27:11.118592Z","submitted_at":"2026-05-15T13:55:39Z","title":"WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T17:47:32.953903Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.15964"},"observation_digest":"sha256:5287ae70530dda3596060db53fcae6b25cec439fbc458c385065fdab9aeadef0","observation_id":"667ae89c-62dc-41f5-9ec2-919ed76c89be","resolution":{"observed_at":"2026-05-20T17:48:48.649741Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.16937","last_updated":"2026-05-16T11:14:18Z","snapshot_observed_at":"2026-08-01T18:52:35.499750Z","submitted_at":"2026-05-16T11:14:18Z","title":"DEVIS-GRPO: Unleashing GRPO on Dynamic Extreme View Synthesis","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-19T20:53:42.240453Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.16937"},"observation_digest":"sha256:c5dc0bfbb4dbc700b666a24dae8f997e708d3cd4981ae595bc6840f6caa75d89","observation_id":"21975557-6729-4c0b-9d77-5e128a21bfcf","resolution":{"observed_at":"2026-05-19T20:57:47.031263Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.17248","last_updated":"2026-05-17T04:10:55Z","snapshot_observed_at":"2026-08-02T22:41:54.302633Z","submitted_at":"2026-05-17T04:10:55Z","title":"Image-to-Video Diffusion: From Foundations to Open Frontiers","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-20T15:06:02.084336Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.17248"},"observation_digest":"sha256:6643bbcf88cefecfaaac7d5f21b263e4ebb6738705404459087fd5163f674208","observation_id":"72c27364-3008-4e8f-873d-13a92854dac0","resolution":{"observed_at":"2026-05-20T15:08:24.927120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.20309","last_updated":"2026-05-19T16:27:07Z","snapshot_observed_at":"2026-07-06T23:30:53.900592Z","submitted_at":"2026-05-19T16:27:07Z","title":"Tiny-Engram: Trigger-Indexed Concept Tables for Generative Vision","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T07:46:05.375388Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.20309"},"observation_digest":"sha256:e6b358b535c6b0e577f3b581008675b3cb296c689257e69481e0aa86e0a633cf","observation_id":"a413afef-44ac-45a3-95cb-e2d75af437c5","resolution":{"observed_at":"2026-05-21T07:49:50.273841Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.30431","last_updated":"2026-05-28T18:00:14Z","snapshot_observed_at":"2026-07-06T23:39:43.967889Z","submitted_at":"2026-05-28T18:00:14Z","title":"DTG-Restore: Training-Free Diffusion Refinement for Generative Video Super-Resolution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T08:11:11.134337Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.30431"},"observation_digest":"sha256:ec55b407c47c826e47c87b0f538584d960e1a9973a4822fdfa0e5df8ae0c1c22","observation_id":"ae5d2f76-5ada-4fa2-b693-8d842953e5a2","resolution":{"observed_at":"2026-06-29T08:13:14.797079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2605.30774","last_updated":"2026-05-29T03:02:50Z","snapshot_observed_at":"2026-08-06T06:18:28.186016Z","submitted_at":"2026-05-29T03:02:50Z","title":"CameraNoise: Enabling Faithful Camera Control in Video Diffusion through Geometry-Flow-Guided Noise Warping","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T23:21:12.987597Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2605.30774"},"observation_digest":"sha256:8bd03af26518bcf076f92cd8910eccfcb1fb4b15c369e5efd4f5028bcdd037f8","observation_id":"7ea8ce33-44a3-4870-87ee-b78deb340248","resolution":{"observed_at":"2026-06-28T23:22:46.711723Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.00793","last_updated":"2026-06-08T08:58:38Z","snapshot_observed_at":"2026-07-06T23:41:24.911421Z","submitted_at":"2026-05-30T16:17:33Z","title":"MBench: A Comprehensive Benchmark on Memory Capability for Video World Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T19:04:58.672464Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.00793"},"observation_digest":"sha256:24b330a12c9b626aaae50fead91b41af31d572aba40f05ddd856a584ba71b083","observation_id":"257bb731-5de5-4ced-977a-58182c4a0fb9","resolution":{"observed_at":"2026-06-28T19:22:35.146424Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.01399","last_updated":"2026-05-31T18:45:11Z","snapshot_observed_at":"2026-07-06T23:41:58.121923Z","submitted_at":"2026-05-31T18:45:11Z","title":"PAI-Studio: Cinematic Video Background Replacement with Camera-Aware Motion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T17:14:23.336848Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.01399"},"observation_digest":"sha256:e67ec391b24118c9e48c94ac48d8f7a4498612e62310b91f1ceab9370014232b","observation_id":"5ed41403-5877-4e62-ae6b-53d61f0ef9c9","resolution":{"observed_at":"2026-07-01T21:16:14.712435Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.09056","last_updated":"2026-06-08T05:46:01Z","snapshot_observed_at":"2026-07-06T23:48:26.076260Z","submitted_at":"2026-06-08T05:46:01Z","title":"MilliVid: Hierarchical Latents for Long-Range Consistency in Video Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-27T17:02:00.653422Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.09056"},"observation_digest":"sha256:a6bec811062495b9152ca9d0f4e92d0b4031a5e40d8ca54ae166dd581d87d365","observation_id":"3afad763-004b-448f-a669-eb90c4f3952d","resolution":{"observed_at":"2026-07-03T00:47:30.385025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.12555","last_updated":"2026-07-02T19:10:03Z","snapshot_observed_at":"2026-07-12T14:16:32.755376Z","submitted_at":"2026-06-10T18:06:27Z","title":"AudioX-Turbo: A Unified Framework for Efficient Anything-to-Audio Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-27T08:04:48.283908Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.12555"},"observation_digest":"sha256:32dab6efb684b9138dfd41c20ad8839e5e958d49966654ca4b2e3573ba9b39de","observation_id":"49a0d011-ced4-4f4b-b0b4-ce06a65ec510","resolution":{"observed_at":"2026-07-03T13:28:18.798733Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.13768","last_updated":"2026-06-16T17:59:39Z","snapshot_observed_at":"2026-08-06T01:41:21.935867Z","submitted_at":"2026-06-11T17:59:10Z","title":"CineOrchestra: Unified Entity-Centric Conditioning for Cinematic Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T06:51:31.625416Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.13768"},"observation_digest":"sha256:0e115522cee2445c34d9ba589b9081ed8a99557646fa6f5da0d79dfc7ad3bbaf","observation_id":"e1744c67-9dbb-4be7-80a3-7d97eacb7b11","resolution":{"observed_at":"2026-07-03T14:58:32.686951Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.17566","last_updated":"2026-06-16T06:12:05Z","snapshot_observed_at":"2026-07-06T23:53:07.149182Z","submitted_at":"2026-06-16T06:12:05Z","title":"AoiZora: Topology-Aware Auto-Parallel Optimization for Inference of Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T23:07:13.368633Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.17566"},"observation_digest":"sha256:f6404974bfd30831e6f7f47d7598e7a923a99c0684a8b647ff4e974c5ca7ab26","observation_id":"bd30e020-16c9-426d-8f0f-8163abadb71c","resolution":{"observed_at":"2026-07-03T22:59:03.328953Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.21146","last_updated":"2026-06-19T06:37:13Z","snapshot_observed_at":"2026-07-06T23:56:12.374739Z","submitted_at":"2026-06-19T06:37:13Z","title":"ChronoLock: Protecting Videos from Unauthorized Text-to-Video Personalization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T14:34:52.232360Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.21146"},"observation_digest":"sha256:a1df21f6760a21bdea25ec173d7024db9b9a52753500622b161d88269971d274","observation_id":"fe984864-2950-4ae3-91b4-756d5ba4e34f","resolution":{"observed_at":"2026-07-04T06:19:38.597390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.22370","last_updated":"2026-06-21T07:39:37Z","snapshot_observed_at":"2026-07-06T23:57:14.069903Z","submitted_at":"2026-06-21T07:39:37Z","title":"Towards Error-Free Long Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T10:49:36.838492Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.22370"},"observation_digest":"sha256:aed1743ae713b5f0483eb6760619f2a4aaf2030eb9290f9d18e0a9e781aaabc9","observation_id":"c89c6f58-40b8-4d4e-9354-bd51e88f6a7d","resolution":{"observed_at":"2026-07-04T08:59:42.130129Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.23298","last_updated":"2026-06-22T13:10:26Z","snapshot_observed_at":"2026-08-05T14:24:25.811151Z","submitted_at":"2026-06-22T13:10:26Z","title":"Ocean4D: Generative Underwater 4D Reconstruction via Medium-Aware Video Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T09:24:28.715994Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.23298"},"observation_digest":"sha256:7422b425e6423911dc06d2e125ab725116be2b06cce0b5ec7ddb0e3810de4931","observation_id":"035eba26-12cf-4749-b4ae-ebf98405bed6","resolution":{"observed_at":"2026-07-04T09:49:44.709928Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.26916","last_updated":"2026-06-25T11:53:27Z","snapshot_observed_at":"2026-07-07T00:01:10.711037Z","submitted_at":"2026-06-25T11:53:27Z","title":"PhysRAG: Enhancing Physics-Awareness in Video Generation via Retrieval-Augmented Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T05:16:53.011837Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.26916"},"observation_digest":"sha256:f71bdb82b954b9c45155b3a58005aa1020fead073757b071d28d01c6bc2bc7ab","observation_id":"81f41235-9561-461a-af51-ccc4f3bcc340","resolution":{"observed_at":"2026-07-04T13:19:51.145710Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T02:03:45.564122Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:ca102ce869720adc8e2b9248f273f541ec5a41261b5d455476de15dd3d6db75f","observation_id":"0da83254-417a-4249-a41e-40b91f4e506f","resolution":{"observed_at":"2026-07-01T18:25:57.831280Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-01T06:25:58.872140Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:72950513cab11df85c3996f47e090112f41bc27080cfebcacd425c658a3c102b","observation_id":"9926009b-805e-43f8-92b8-4df82fc9d54b","resolution":{"observed_at":"2026-07-01T09:35:40.495439Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-02T20:52:28.444524Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:323c2ef57fe297eb15545a791be24989a0354f7707fa7a3c3ea9b7afcdc04b55","observation_id":"363dcc17-b9ce-4d13-a3d7-1b7c95313dd5","resolution":{"observed_at":"2026-07-02T20:57:22.816472Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T22:44:16.272541Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:543f48ae21c3331e5efaefbaafa11de666fe63f1ab1e3fced9c9238abb17bb2e","observation_id":"7a97c1de-f2bb-45fd-b4da-72fe29469e42","resolution":{"observed_at":"2026-07-03T22:49:00.841691Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-07-14T17:14:19.770867Z","title":"arXiv preprint arXiv:2310.19512 (2023) 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T17:14:19.770867Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:9af7dc1997655c404f77f2c2bb34be458aa4a9d58a226349e428e44d01b748dc","observation_id":"cddce2ff-d97f-49b9-9f68-dd2e73ced28c","resolution":{"observed_at":"2026-07-14T17:14:19.770867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-02T10:00:09.354702Z","title":"arXiv preprint arXiv:2310.19512 (2023) 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":6},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T10:00:09.354702Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:b4f1102ce0cca26680124ffce8078ee24ab08942bf616f81230b99400c1cbbae","observation_id":"32efcba4-0f0b-407d-b100-630e8d249af5","resolution":{"observed_at":"2026-08-02T10:00:09.354702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2606.31258","last_updated":"2026-06-30T07:33:46Z","snapshot_observed_at":"2026-08-03T23:20:39.094410Z","submitted_at":"2026-06-30T07:33:46Z","title":"WarpHammer: Densifying Scene Warps with 3D Object Priors for Extreme View Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T06:19:53.091972Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2606.31258"},"observation_digest":"sha256:dcc5c2b900bcf93050b290a640c9e5e6ab68e907577ef9eddf31776fe6ebd6bf","observation_id":"c404dce3-3553-484a-b4d9-2948ab285222","resolution":{"observed_at":"2026-07-01T09:45:39.690419Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2607.01222","last_updated":"2026-07-01T17:56:39Z","snapshot_observed_at":"2026-08-04T02:18:09.786163Z","submitted_at":"2026-07-01T17:56:39Z","title":"Ink3D: Sculpting 3D Assets with Extremely Complex Textures via Video Generative Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-02T13:16:16.676244Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.01222"},"observation_digest":"sha256:fd9e31ed35222503f4eb2c40c499744892aea58b75a2ce9087944a605920de36","observation_id":"20b5ccad-8ddc-44f3-a09c-233c24c11e21","resolution":{"observed_at":"2026-07-02T13:16:58.091913Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2607.01499","last_updated":"2026-07-30T22:02:39Z","snapshot_observed_at":"2026-08-05T23:10:57.913318Z","submitted_at":"2026-07-01T22:00:18Z","title":"Anti-Prompt: Image Protection against Text-Guided Image-to-Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-03T20:57:06.512365Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.01499"},"observation_digest":"sha256:f299f7207dfc4b82fe75228b15f5d6335b14263e98b0f3e593b5744d6be1738f","observation_id":"f2d83883-3ddf-429e-aa5c-08cc8e59c4a8","resolution":{"observed_at":"2026-07-03T20:58:57.242741Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-07-12T08:45:35.247511Z","title":"arXiv preprint arXiv:2310.19512 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.01499","last_updated":"2026-07-30T22:02:39Z","snapshot_observed_at":"2026-08-05T23:10:57.913318Z","submitted_at":"2026-07-01T22:00:18Z","title":"Anti-Prompt: Image Protection against Text-Guided Image-to-Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T08:45:35.247511Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.01499"},"observation_digest":"sha256:1f6189d713e95ef360f05a00f1d44ad09c127458dd82a559467d5c28133a63dd","observation_id":"a750e236-be7b-481e-93b5-a9d3d8fc8632","resolution":{"observed_at":"2026-07-12T08:45:35.247511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-03T02:03:40.995044Z","title":"arXiv preprint arXiv:2310.19512 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.01499","last_updated":"2026-07-30T22:02:39Z","snapshot_observed_at":"2026-08-05T23:10:57.913318Z","submitted_at":"2026-07-01T22:00:18Z","title":"Anti-Prompt: Image Protection against Text-Guided Image-to-Video Generation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T02:03:40.995044Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.01499"},"observation_digest":"sha256:b44c4737603ba2ea75b63af7a7d23c980adff24ad6d9d4eedecd0a8f6993facf","observation_id":"5952a2ef-efa7-4dd5-8743-c68f51cbb62f","resolution":{"observed_at":"2026-08-03T02:03:40.995044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2607.01869","last_updated":"2026-07-02T08:25:38Z","snapshot_observed_at":"2026-07-07T00:07:23.664493Z","submitted_at":"2026-07-02T08:25:38Z","title":"QWERTY: Training-Free Motion Control via Query-Warped Video Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-03T16:19:51.348169Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.01869"},"observation_digest":"sha256:dc85a348fbfa7a342caf2c6ec24896cd4279e39e4a3f45f0870b944a72f0cbdc","observation_id":"05347fe1-8da6-4cc5-8d8f-778f307dad59","resolution":{"observed_at":"2026-07-03T16:28:38.476646Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":"2310.19512","doi":"10.48550/arxiv.2310.19512","metadata_source":"pith","pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","venue":"cs.CV","work_id":"4d4486c5-6317-4d8d-bb5b-3b100d732a83","year":2023},"citing_paper":{"arxiv_id":"2607.02516","last_updated":"2026-07-02T17:59:57Z","snapshot_observed_at":"2026-07-07T00:07:56.573640Z","submitted_at":"2026-07-02T17:59:57Z","title":"Alignment Is All You Need For X-to-4D Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-03T14:31:18.256171Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.02516"},"observation_digest":"sha256:54104a56f4340bd4fabd1c902200e753a26054cde8a7c433902785ed2e18e9e3","observation_id":"7711f71e-9e2c-47bd-ae51-f4f156d135ac","resolution":{"observed_at":"2026-07-03T14:38:28.741222Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-01T16:41:46.594733Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:d4530971bd1cd3ec36ee9d4f0f1f435331e96e09c7dcf1e2d56d77871a39bb57","observation_id":"ece77e36-243e-471c-8e05-7441f64a3e8c","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-07-12T06:22:35.545340Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02886","last_updated":"2026-07-03T02:34:50Z","snapshot_observed_at":"2026-08-05T00:36:30.433892Z","submitted_at":"2026-07-03T02:34:50Z","title":"SPLIT: Training-Free AI-Generated and Partially Edited Video Detection via Spatial Patch-Level Incoherence and Temporal Roughness","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T06:22:35.545340Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.02886"},"observation_digest":"sha256:a69389b737718eef4608de4b9568765398551c85c59fbc6380cf6e356aacc871","observation_id":"3b447377-47d3-4821-b4de-ab659a158e85","resolution":{"observed_at":"2026-07-12T06:22:35.545340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-07-12T00:20:07.678576Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03732","last_updated":"2026-07-04T06:39:40Z","snapshot_observed_at":"2026-08-03T19:44:12.162762Z","submitted_at":"2026-07-04T06:39:40Z","title":"ProxyUp: Training-Free Proxy-Conditioned Video Generation for Controllable Dynamics","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T00:20:07.678576Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.03732"},"observation_digest":"sha256:8218350ace69aa46560d68badb127b4bf7832727a064fc00db195b28169e69e4","observation_id":"b8824b7b-8171-458a-8764-21fe31dd8414","resolution":{"observed_at":"2026-07-12T00:20:07.678576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-01T17:22:29.691123Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17675","last_updated":"2026-07-20T08:27:18Z","snapshot_observed_at":"2026-08-03T01:44:20.390965Z","submitted_at":"2026-07-20T08:27:18Z","title":"ShotPlan: Cinematic Video Generation with Learnable Planning Token","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T17:22:29.691123Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.17675"},"observation_digest":"sha256:4c280af206a7a014beeca8dcc2c74dff5ac2ee72d54ef3fcc03e5648e494a5e1","observation_id":"31abe09e-a209-43be-a690-273dc9d2b82e","resolution":{"observed_at":"2026-08-01T17:22:29.691123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T00:24:37.408478Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01334","last_updated":"2026-08-02T15:54:54Z","snapshot_observed_at":"2026-08-06T18:31:57.097047Z","submitted_at":"2026-08-02T15:54:54Z","title":"SphereVideo: Prototype-anchored Hyperspherical Boundary for Continual AI-generated Video Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:24:37.408478Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2608.01334"},"observation_digest":"sha256:8fef704a30c74ebdb99141728e06e05d7869449d372b6ef68fb5a684f3c2fbe1","observation_id":"dfb0567d-70b6-4a2a-91a3-a52d6d955092","resolution":{"observed_at":"2026-08-06T00:24:37.408478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.19512/citation-record","integrity":"/paper/2310.19512/integrity","json":"/paper/2310.19512/citation-record.json","paper":"/paper/2310.19512"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed October 22, 2023 [Online] https:// research.runwayml.com/gen2","venue":null,"work_id":"13424273-e098-4752-b508-3664d253c055","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:a3ea01640d850e3e9ceff40f5820719640c8ebe2ac6e399e8e0118fc1d5db626","observation_id":"d842b9f8-4ca1-438a-96b6-f4a5af2a35ab","resolution":{"observed_at":"2026-05-14T21:40:44.263992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed October 22, 2023 [Online] https : / / github.com/deep-floyd/IF","venue":null,"work_id":"1f374479-4139-4a1a-9a9b-36e1914431f7","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:8c2a4de1bf90c25aec56a1be92f65a7055b4a1bf51f0da304ba0689eda9bf94f","observation_id":"229d25cc-59c3-4fb7-819e-45272197b219","resolution":{"observed_at":"2026-05-14T21:40:44.194843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed October 22, 2023 [Online] https: //laion.ai/blog/laion-coco/","venue":null,"work_id":"77fb37fc-1c38-4984-ac70-290ea3a3b8c1","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:0b807c4f764eacdd37772effe5b705b5f9f879f3ca0777146be8844e48fcae3f","observation_id":"7c904ef5-9956-497e-bf53-937f5145ec82","resolution":{"observed_at":"2026-05-14T21:40:44.198379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed October 22, 2023 [Online] https: //github.com/hotshotco/Hotshot-XL","venue":null,"work_id":"9a07b936-6609-4d38-8bd9-c271e4c8bba5","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:4b96f24f2014fded9264312141bd3f61a777c05d814fdd8487672b851d0e3124","observation_id":"82e01027-a6c7-492e-ae3e-d9bb8cea4c4e","resolution":{"observed_at":"2026-05-14T21:40:44.201878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed October 22, 2023 [Online] https: //moonvalley.ai/","venue":null,"work_id":"23be4b42-07a0-452b-a925-35d30574fbd8","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:ab482f4e934ef52a3f6dac8a971310401562b20b54dcc648912c533af343e3fc","observation_id":"ce0b80b9-173a-41a3-b498-75cd3b07cac5","resolution":{"observed_at":"2026-05-14T21:40:44.205144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed October 22, 2023 [Online] https: //www.pika.art/","venue":null,"work_id":"a3f16da6-9b39-48e1-99db-02c79699d8c1","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:046c2a39d178beb216bc5463b73bf23261cb780ddf7bfea41380ac27bb5aa304","observation_id":"d90bfc42-9362-4e03-b87f-8932679dbc4e","resolution":{"observed_at":"2026-05-14T21:40:44.207938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accessed October 22, 2023 [Online] https: //huggingface.co/cerspense/zeroscope_v2_ XL","venue":null,"work_id":"f29124e1-fd9a-4f34-b277-690c87e162f0","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:980c2332008c69a243f7a3cf42ab2ee28e579d4f93253b3518615c327efe5221","observation_id":"7f5e9669-cfa5-48a0-9c58-919dc8be5c35","resolution":{"observed_at":"2026-05-14T21:40:44.211129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Frozen in time: A joint video and image encoder for end-to-end retrieval","venue":null,"work_id":"ab0b604f-3ef6-43b5-97cb-a59f88646d37","year":2021},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:3001524e1bdc0618a954bd8ea723d6a9b94bd452876eb8bde6225807dfcaa1e9","observation_id":"77fe6bf5-5dc0-4a8a-9b86-2f095a5ea87c","resolution":{"observed_at":"2026-05-14T21:40:44.214729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:521f32a1fec3158e98fa6df973f52344f1c56304f3d8e324633b85a63921c391","observation_id":"17968458-04fe-42e0-841b-a467d0eca150","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":"24242018-c325-4e27-b681-594455299f74","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:86707d08027cfd807920320af7fd91266c82321fedc9b8a8a502ae64a38981a7","observation_id":"638c4a5e-76e0-4b91-b03b-161d0f927133","resolution":{"observed_at":"2026-05-14T21:40:44.222153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00704","last_updated":"2023-01-02T14:43:38Z","snapshot_observed_at":"2026-08-03T00:33:47.397969Z","submitted_at":"2023-01-02T14:43:38Z","title":"Muse: Text-To-Image Generation via Masked Generative Transformers","version":1},"cited_work":{"arxiv_id":"2301.00704","doi":"10.48550/arxiv.2301.00704","metadata_source":"pith","pith_arxiv_id":"2301.00704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Muse: Text-to- image generation via masked generative transformers","venue":"cs.CV","work_id":"ad8925f8-72d8-4ac4-88b8-027e08b46103","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2301.00704","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:2888d59750f69d03033cded0a6ed168948488d73e2f5e195dfc00152d761cccf","observation_id":"a07e5ce6-1751-4c76-9b09-d8f18e2bd385","resolution":{"observed_at":"2026-05-14T21:40:44.012282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":"2310.00426","doi":"10.48550/arxiv.2310.00426","metadata_source":"pith","pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","venue":"cs.CV","work_id":"77157568-e4be-4041-bb20-388177fc59d0","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:770ff501ab42c06fe1e15030e79ae46d6074f9edc4fbcb4d31635c1c5e819b21","observation_id":"301d929a-8d94-4a41-9b87-94711272d13a","resolution":{"observed_at":"2026-05-14T21:40:44.020027Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dif- fusiondet: Diffusion model for object detection","venue":null,"work_id":"c3d90c15-bca1-4f84-9487-70dd504b6610","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:19084aa3cd42615b330df88af11e6c7ca10d5be0984b33bf4455a1641bd585d2","observation_id":"af3bfa9b-72f1-4c05-971a-e609f01f2c13","resolution":{"observed_at":"2026-05-14T21:40:44.231390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reproducible scal- ing laws for contrastive language-image learning","venue":null,"work_id":"a1ee9df2-4389-40a6-baaf-f47ad9f3ff80","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:a99c03c3e9b9c788d1292ed470a682995f55ec662c7bc9466e26012df44f5c0b","observation_id":"d7585b3c-5437-4416-932d-45b8a68dbb45","resolution":{"observed_at":"2026-05-14T21:40:44.234211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I2vgen-xl","venue":null,"work_id":"6ee9718f-5889-4e1d-ac5c-d7508dc47657","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:0de04917736a48be1133bd941a4bb4437b99b638f7f7e5a9f08631eadb265360","observation_id":"737502d4-553f-4ac1-81dc-f1cba629639f","resolution":{"observed_at":"2026-05-14T21:40:44.237091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15807","last_updated":"2023-09-27T17:30:19Z","snapshot_observed_at":"2026-08-02T11:54:13.342379Z","submitted_at":"2023-09-27T17:30:19Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","version":1},"cited_work":{"arxiv_id":"2309.15807","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.15807","snapshot_observed_at":"2026-07-08T05:54:33.464514Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","venue":"cs.CV","work_id":"ae882a46-08bc-4ec0-a38c-72bc9eec3afe","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2309.15807","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:1c36c93314887c3a0c8eac2698a2e30b0fedb1316da08e8a9b62f45ca55caa54","observation_id":"42d87797-31cd-4ee7-8f31-e653f77eaee2","resolution":{"observed_at":"2026-05-14T21:40:44.028439Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":"a9a699b3-80da-4b0b-8980-b05adc9a2803","year":2020},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:6c681540c8794d797e696e986554a7b37bbf69bcd8f1a967424235724212de83","observation_id":"e83fde39-0800-44f0-a729-4a48c130bbf8","resolution":{"observed_at":"2026-05-14T21:40:44.243893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":"5f384aa8-0d7a-4f8a-82e8-c2205e6b443f","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:167832b7eaeb5001367cd8d25f695a8efe4423323d444c0847897a8d2889963d","observation_id":"a051505e-e76b-48e6-ad71-87c41ca8ce34","resolution":{"observed_at":"2026-05-14T21:40:44.246882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Make-a-scene: Scene- based text-to-image generation with human priors","venue":null,"work_id":"26f098d3-8e26-4095-a5ec-f99658b3acbb","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:58f955cea0721a96c00cff7f0acb55d10505e3e8fd22ea0047a7c69ce8b6a7d6","observation_id":"984e9496-d6e7-42d0-988f-af4213b5c16d","resolution":{"observed_at":"2026-05-14T21:40:44.250020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preserve your own correlation: A noise prior for video diffusion models","venue":null,"work_id":"aeca68ac-1748-4813-b56e-d9b965fc2d7b","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:2b7e47aea0c948321198ac8396970f0ce05e12058cddb6e5539f562fe732506c","observation_id":"0570f1cd-5e16-4504-b36b-eb722b70c0ea","resolution":{"observed_at":"2026-05-14T21:40:44.253475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vec- tor quantized diffusion model for text-to-image synthesis","venue":null,"work_id":"6a80f2d0-436f-49b5-bdfd-9c04da7424d0","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:7748001e3bf29a339c67b6321dbb12b39c9cf00230ce1731a321b03fb7483ba5","observation_id":"4f7a1eb0-9e3f-4007-b6df-5a23d9960ee1","resolution":{"observed_at":"2026-05-14T21:40:44.256769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14897","last_updated":"2026-04-25T05:18:57Z","snapshot_observed_at":"2026-07-06T15:08:15.836938Z","submitted_at":"2023-03-27T03:12:24Z","title":"Seer: Language Instructed Video Prediction with Latent Diffusion Models","version":4},"cited_work":{"arxiv_id":"2303.14897","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.14897","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seer: Language Instructed Video Prediction with Latent Diffusion Models","venue":"cs.CV","work_id":"892ae328-663b-4261-b0c7-5813862bf0ab","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2303.14897","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:5cc06818d2d12798f821a59735ef0ede81057170dd8b60d6d73397f536ac1172","observation_id":"3bea67d4-04d5-42b5-8cac-6d3ed3eca702","resolution":{"observed_at":"2026-05-14T21:40:44.034480Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":"2307.04725","doi":"10.48550/arxiv.2307.04725","metadata_source":"pith","pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","venue":"cs.CV","work_id":"1f9d1d3b-a6d6-45a9-9f13-51393c03be8a","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:8ba88590a4ee0242ac0e09d7cf83d9a8b2d1637fb58e8fd2d407d57e802658db","observation_id":"b8b639a7-e3d9-4231-8d1a-f436b5d81943","resolution":{"observed_at":"2026-05-14T21:40:44.040472Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-07-06T14:22:24.004857Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":"2211.13221","doi":"10.48550/arxiv.2211.13221","metadata_source":"pith","pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","venue":"cs.CV","work_id":"23338b3d-620a-4954-904f-bab6a577b8a5","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:5bb0b8cb852c7124575aeefeab8d2173fad106d5392c798f714c3379527bfd2f","observation_id":"32643e5b-0e18-4cc9-a7f7-e855f7f6fa4f","resolution":{"observed_at":"2026-05-15T04:27:43.523852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07702","last_updated":"2023-10-11T17:52:39Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T17:52:39Z","title":"ScaleCrafter: Tuning-free Higher-Resolution Visual Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2310.07702","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.07702","snapshot_observed_at":"2026-07-03T00:37:29.771192Z","title":"Scalecrafter: Tuning-free higher- resolution visual generation with diffusion models","venue":null,"work_id":"a4122944-d8dd-437a-83dc-ad0cf0167058","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2310.07702","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:65d218305d5e96e4e0a936cd48cddf024d3f271c590bf393071cb6bddaf0b5af","observation_id":"5761198c-1171-4d06-9182-9717ae204665","resolution":{"observed_at":"2026-05-14T21:40:44.052987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"2eb3b0e8-842d-4bef-821f-69312b3940e7","year":2020},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:6b8e89f6b3f142c9aebe18b7c97f21d5c628e5d156dd5358310e536eed6c0abc","observation_id":"2a0e0e9a-d5db-4498-8b50-57b690fe616a","resolution":{"observed_at":"2026-05-14T21:40:44.273435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2210.02303","doi":"10.48550/arxiv.2210.02303","metadata_source":"pith","pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","venue":"cs.CV","work_id":"bb20d241-dc6f-4b0a-b071-fd43a2cbd57f","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:05e7cc43deeb9bfa9a6e664d695a899e497bed88db51e778d68c535380b2c27a","observation_id":"96e67082-aa48-4805-9783-b2d046023236","resolution":{"observed_at":"2026-05-14T21:40:44.059650Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:59.676131+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:59.676131+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video dif- fusion models","venue":null,"work_id":"19ba3841-6d74-4bc7-90b4-c2b90fa1fa3e","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:1965bc4847912cb953df303e7f57080b3db6b3ddd0f41e0c99b560be8c5fc76c","observation_id":"8705c65f-3e6d-4c0d-8de8-bb5ba7d82a47","resolution":{"observed_at":"2026-05-14T21:40:44.279807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13439","last_updated":"2023-03-23T17:01:59Z","snapshot_observed_at":"2026-08-02T10:20:57.683645Z","submitted_at":"2023-03-23T17:01:59Z","title":"Text2Video-Zero: Text-to-Image Diffusion Models are Zero-Shot Video Generators","version":1},"cited_work":{"arxiv_id":"2303.13439","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.13439","snapshot_observed_at":"2026-06-29T17:53:46.729515Z","title":"arXiv preprint arXiv:2303.13439 , year=","venue":null,"work_id":"ddea38b0-8bf6-45cd-9c6b-9a5d839f9224","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2303.13439","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:e33f9081a6295cf9a8e357e9948973d8afbbbbe333c23c2d5834a73d4462af0b","observation_id":"a9c1627e-7a23-4c4e-8dbe-4ce0a54a5a42","resolution":{"observed_at":"2026-05-14T21:40:44.065287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00398","last_updated":"2023-09-07T08:11:01Z","snapshot_observed_at":"2026-07-06T16:13:15.274672Z","submitted_at":"2023-09-01T11:14:43Z","title":"VideoGen: A Reference-Guided Latent Diffusion Approach for High Definition Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2309.00398","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00398","snapshot_observed_at":"2026-07-04T14:59:55.947520Z","title":"arXiv preprint arXiv:2309.00398 (2023) 6, 1","venue":null,"work_id":"3e0e2f45-9789-4c06-9f52-59d98e898afc","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2309.00398","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:8bcc8a953df894b7235290498da67eca1dc32efb2b0e219df659280004bd6da9","observation_id":"4c3dc50f-bfe1-4dbe-a7ba-5900f5fffb75","resolution":{"observed_at":"2026-05-14T21:40:44.072118Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":"d1cfa006-c38c-4fe0-9755-bbc836d2b025","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:35551c8da4987619fc043b3a8a2a3f4af0ef0015f678218eb6933d09f58fbf13","observation_id":"4abb260f-f8f2-45d7-bd50-eed44c057f38","resolution":{"observed_at":"2026-05-14T21:40:44.178447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evalcrafter: Benchmarking and eval- uating large video generation models","venue":null,"work_id":"417ab153-f259-48c6-b4c4-1f75a93480d1","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:b4e287ac89baa03f85b00b95a78803efad817c7854893da7d9f2e4b9b57ba46d","observation_id":"95cb688c-d060-4a28-9d31-ad61bdbb2321","resolution":{"observed_at":"2026-05-14T21:40:44.181696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videofusion: Decomposed diffusion models for high-quality video generation","venue":null,"work_id":"9bc14b06-961f-4a37-a2a3-ecfad77bb23c","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:2da404d1d5d60c8b3631be72408c4693f9a6bb31fb4d369b185f69a56b6a2268","observation_id":"19df5e59-6b44-49b4-8b96-eb54cc7c3671","resolution":{"observed_at":"2026-05-14T21:40:44.184806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01186","last_updated":"2024-01-03T09:10:12Z","snapshot_observed_at":"2026-07-06T15:11:35.938311Z","submitted_at":"2023-04-03T17:55:14Z","title":"Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos","version":2},"cited_work":{"arxiv_id":"2304.01186","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.01186","snapshot_observed_at":"2026-07-04T03:29:29.521295Z","title":"arXiv preprint arXiv:2304.01186 , year=","venue":null,"work_id":"f53f3d58-c8da-40e9-a2a5-7cf90beaeefc","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2304.01186","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:a63b6c6b4226880a04196748535e6d03e502724292c54c9a4f2d32a504566144","observation_id":"07386c06-b62b-4d2d-b13d-55a066e83e44","resolution":{"observed_at":"2026-05-14T21:40:44.078817Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01329","last_updated":"2023-02-02T18:58:58Z","snapshot_observed_at":"2026-07-06T14:47:48.494911Z","submitted_at":"2023-02-02T18:58:58Z","title":"Dreamix: Video Diffusion Models are General Video Editors","version":1},"cited_work":{"arxiv_id":"2302.01329","doi":"10.48550/arxiv.2302.01329","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.01329","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2302.01329 , year=","venue":"arXiv (Cornell University)","work_id":"ca67528e-7a41-4d0b-b2ac-92f36aaacc4f","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2302.01329","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:96037b46ada2073def6d7d6a69b945e683fdc2585c313ecc5905bdf344eac1f3","observation_id":"567249ef-8d69-4cc6-b4b9-27a9ef9538ab","resolution":{"observed_at":"2026-05-14T21:40:44.088460Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-07-31T21:11:02.534986Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.08453","doi":"10.48550/arxiv.2302.08453","metadata_source":"pith","pith_arxiv_id":"2302.08453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"2337b26e-9ca1-4157-be2a-438971c5fef3","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2302.08453","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:1a72ea222475290edfff322be3cfd53bcc5a2e854125b46a9c847a54949a2491","observation_id":"6311606b-2520-4c22-b36c-ddd467e90f8a","resolution":{"observed_at":"2026-05-16T22:47:50.630300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04291","last_updated":"2023-10-31T00:18:09Z","snapshot_observed_at":"2026-07-06T14:59:57.727357Z","submitted_at":"2023-03-07T23:52:51Z","title":"Diffusion in the Dark: A Diffusion Model for Low-Light Text Recognition","version":2},"cited_work":{"arxiv_id":"2303.04291","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04291","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion in the dark: A diffu- sion model for low-light text recognition","venue":null,"work_id":"fc1d1fcf-3e36-4a85-8cb8-52395c9a4ac7","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2303.04291","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:0ac0f3c9038437651b5351091603e47a335ec0a6a634b46518cff5561368ebdf","observation_id":"19294b01-280a-474a-ae30-bb0b8bbc65bb","resolution":{"observed_at":"2026-05-14T21:40:44.101553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Glide: Towards photorealis- tic image generation and editing with text-guided diffusion models","venue":null,"work_id":"21fdb77b-e785-41c3-8ed4-04da1538e21b","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:d887f8f29f40f3dad6e0e42298ee3e882138d02c715da5f4d5e1d7c537356019","observation_id":"29b7f350-b1df-4aed-beb1-a69189e5a16a","resolution":{"observed_at":"2026-05-14T21:40:44.228180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:478ebe6addbfbd350ddf664a10586d1505c81359e22469ade2b275da09882432","observation_id":"9beef1a5-ce29-4775-aa10-40a30d546d3d","resolution":{"observed_at":"2026-05-14T21:40:44.107627Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"ea9a9537-7fed-4c58-b101-bae333320ac5","year":2021},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:633d3d4bd2a16a654be1fcbc8d370011d007446ad47bd62725c2e82b07434ef6","observation_id":"53e65019-5e72-4751-8533-4fbfab0ceff1","resolution":{"observed_at":"2026-05-14T21:40:44.260006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":"2204.06125","doi":"10.48550/arxiv.2204.06125","metadata_source":"pith","pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","venue":"cs.CV","work_id":"0c6a768b-70b8-4242-bb0e-459f1008c9fc","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:3cb0a0a633c91b745d7d2f89b728410642c266391d8368136adb81dcf2f8b7eb","observation_id":"c2d549e1-f5e3-41bc-85c9-25fa78efd9a1","resolution":{"observed_at":"2026-05-14T21:40:44.113162Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"b183e1a5-a777-4b9a-afb8-ea6f1bf6fa0b","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:0431272f300a55bb56855e57b74c8316ef935e8412013e4577c3c580c1bfbfb6","observation_id":"6bfdd643-8523-4fb7-8ddb-234d71c246aa","resolution":{"observed_at":"2026-05-14T21:40:44.267363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":"3cbff08e-28c2-4313-9c65-030289d91202","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:9f72fab934768ec627cf11f4f7130504dae36f8a8c39b7898b290c8139e98ad6","observation_id":"348aacd1-35e4-4f80-887c-da449235bfc3","resolution":{"observed_at":"2026-05-14T21:40:44.270343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03411","last_updated":"2023-04-06T23:26:38Z","snapshot_observed_at":"2026-07-06T15:13:13.695535Z","submitted_at":"2023-04-06T23:26:38Z","title":"InstantBooth: Personalized Text-to-Image Generation without Test-Time Finetuning","version":1},"cited_work":{"arxiv_id":"2304.03411","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.03411","snapshot_observed_at":"2026-07-01T22:36:17.779896Z","title":"Instantbooth: Personalized text-to-image generation without test-time finetuning","venue":null,"work_id":"af035bd7-d2b3-499c-adfc-38ed48db81ef","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2304.03411","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:4ab58ea89e13ee5371561b7313792e306376c3871276277ed82eec9cb4f88503","observation_id":"9feeffd9-1cd3-4673-9890-9f2c948610b9","resolution":{"observed_at":"2026-05-14T21:40:44.119213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":"e3d11832-4931-404d-b4c8-aab8dd09b677","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:6eb4a8a39e7fb16f273ed7e443e53ef90763ea14c72712b168bdbde2b4fe3c7e","observation_id":"5284cea4-45bd-48b8-b6c4-909932d77378","resolution":{"observed_at":"2026-05-14T21:40:44.283028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"a4be6232-cccd-4985-9b1f-036cee77488f","year":2015},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:f1e7f30e7c23d373ec859a552310aeaaaa9288d2997854181c926620b0dfc721","observation_id":"afa4f77e-874d-4280-9ecd-16426018b73b","resolution":{"observed_at":"2026-05-14T21:40:44.175181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":"2010.02502","doi":"10.48550/arxiv.2010.02502","metadata_source":"pith","pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Denoising Diffusion Implicit Models","venue":"cs.LG","work_id":"8fa2128b-d18c-405c-ac92-0e669cf89ac0","year":2020},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:0b9ce2bd218a9effb8edfce342043b87f27cf17ce698051f84929eef4d9666a2","observation_id":"4a85e6ce-7ec4-4cbd-9067-ced049c2a46d","resolution":{"observed_at":"2026-05-14T21:40:44.123919Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":"9bf70721-94ba-4e8c-b4ee-db81bad4f59e","year":2021},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:6f0360c0d5d42bf51aa2a279ba9d90a1df1887e50eef242e57e9eaad0643c8fe","observation_id":"94120712-75f5-436a-ae35-b25e1a5e52cc","resolution":{"observed_at":"2026-05-14T21:40:44.191604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Phenaki: Variable length video generation from open domain textual description","venue":null,"work_id":"ef2704e6-d5af-43b8-96ef-e710ad05c7ca","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:af2c86fb2d6c28461e518fc8141cbf20416ecff1edec596d6c3ff8f882483055","observation_id":"ac346ada-0aec-49ff-9590-ab2cea2b113f","resolution":{"observed_at":"2026-05-14T21:40:44.218616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-07-06T16:05:35.645037Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":"2308.06571","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-07-11T01:57:50.025885Z","title":"ModelScope Text-to-Video Technical Report","venue":"cs.CV","work_id":"1b1baf78-58ec-44d0-b700-84dff57b2f1f","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:fd68d45e266f161230eee64d4219d245f18b9122b3022bd80a6bea96dad9d261","observation_id":"f8a8db36-15e1-44d4-8994-62339d833ed5","resolution":{"observed_at":"2026-05-14T21:40:44.129406Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02018","last_updated":"2023-06-06T03:54:10Z","snapshot_observed_at":"2026-08-05T12:13:59.998888Z","submitted_at":"2023-06-03T06:29:02Z","title":"VideoComposer: Compositional Video Synthesis with Motion Controllability","version":2},"cited_work":{"arxiv_id":"2306.02018","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.02018","snapshot_observed_at":"2026-07-04T19:40:06.599018Z","title":"arXiv preprint arXiv:2306.02018 , year=","venue":null,"work_id":"3a8f7fc5-5e55-46d3-9f96-5af522d6224b","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2306.02018","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:25f29288d49b963689086c56ee8702527dacb639d20d06e0b081ad3548676e06","observation_id":"a2551e8c-de6c-4356-928a-f854648535ff","resolution":{"observed_at":"2026-05-14T21:40:44.135032Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":"2309.15103","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-06-29T18:43:51.114876Z","title":"Lavie: High-quality video gener- ation with cascaded latent diffusion models","venue":null,"work_id":"e26464f0-6aed-49c2-b00f-e3639b1da5b1","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:6ccc811b60c9e7aed50ab6947e781ec3dc67ee6a32145f2c1022d81f399fec57","observation_id":"6298f9a0-5825-457e-8d03-a76f88201c28","resolution":{"observed_at":"2026-05-14T21:40:44.140329Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00943","last_updated":"2023-06-01T17:43:27Z","snapshot_observed_at":"2026-07-06T15:36:45.014921Z","submitted_at":"2023-06-01T17:43:27Z","title":"Make-Your-Video: Customized Video Generation Using Textual and Structural Guidance","version":1},"cited_work":{"arxiv_id":"2306.00943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.00943","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Make-your-video: Customized video generation using textual and structural guidance","venue":null,"work_id":"b99a13cd-003d-4061-a0fd-0e221b973394","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2306.00943","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:9e270cf08b78433c7a0a66d0ff61de39c085309d7099aec7e23e645141bcd394","observation_id":"7a54ab85-e063-4485-88dc-a94dfd61087d","resolution":{"observed_at":"2026-05-14T21:40:44.145522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":"18205116-029d-45c0-a63c-0db980f8fd4b","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:ef013d09fba250286982fcecb9ab1199c9d9e09eb296d4ada3ba92e523a15e12","observation_id":"5b817ba0-aa16-402a-83f5-30185a4b7a9e","resolution":{"observed_at":"2026-05-14T21:40:44.187879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":"2308.06721","doi":"10.48550/arxiv.2308.06721","metadata_source":"pith","pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"98e51b10-54bd-4251-8a2d-f79bd6215c19","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:238eb8461e0b5773c08fa1d7b79794a3980318a0ad8a7df260800197a1913729","observation_id":"01a79f2e-6c50-4810-82dc-a2c913ea487f","resolution":{"observed_at":"2026-05-14T21:40:44.150411Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":"2308.08089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-07-04T20:10:08.842410Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","venue":"cs.CV","work_id":"eb6df0b7-199d-4cc7-8711-9cd5a6e25349","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:9f96405c9d74ab9db35db6b59ee5adab71a9888cf1b8eb48c1ecd62922e50753","observation_id":"f46fc3d8-e869-4386-a444-17bc8978e79a","resolution":{"observed_at":"2026-05-20T13:03:58.521687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":"2206.10789","doi":"10.48550/arxiv.2206.10789","metadata_source":"pith","pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","venue":"cs.CV","work_id":"0a105815-ff2e-43ce-8566-966cdcae1af4","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:114234d8f7770639abed214d7605e6848ef60e2e831ca504257b48fd7155ec1d","observation_id":"a8853952-f1e1-4838-b391-1c392deb9ec6","resolution":{"observed_at":"2026-05-14T21:40:44.160267Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magvit: Masked generative video transformer","venue":null,"work_id":"12ca77b3-2304-4797-b24a-99c333078e02","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:c50b60f9a5b9beadf62ac15bdd3f77bb729275117b597d7a721a7aa1160740ea","observation_id":"bce22b5d-18c7-4fb7-843f-aba3096c0bb8","resolution":{"observed_at":"2026-05-14T21:40:44.276531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation","venue":null,"work_id":"a425dc71-f539-447e-ae4f-1269ca16d60f","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:92616c719ead819130af1d91cf5cbce48cf768a1ed4899436d10fd46b381ffb6","observation_id":"eb6c908b-304e-4dc5-b1ae-b94407130d29","resolution":{"observed_at":"2026-05-14T21:40:44.225117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"cac4468c-8b91-4f79-8584-8ab2df5caf36","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:198f3d5446cf99c00602896007a384d3c7e701dade736005daa04cad75e340d4","observation_id":"910c30ee-a4d1-42a6-b14a-544ff9788d81","resolution":{"observed_at":"2026-05-14T21:40:44.240882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13077","last_updated":"2023-05-22T14:48:53Z","snapshot_observed_at":"2026-07-06T15:30:42.173342Z","submitted_at":"2023-05-22T14:48:53Z","title":"ControlVideo: Training-free Controllable Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2305.13077","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13077","snapshot_observed_at":"2026-07-04T17:40:00.876998Z","title":"the words ‘KEEP OFF THE GRASS","venue":null,"work_id":"31856993-b01c-4e20-8380-fae90b49a405","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2305.13077","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:baf0d54867ab3c562d8e1f329136d97de08c5b75f41b92f1f13090a59682162b","observation_id":"3370a45b-0ee5-45ce-a2d2-727b4f1223a5","resolution":{"observed_at":"2026-05-14T21:40:44.165165Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18729","last_updated":"2023-11-07T03:34:26Z","snapshot_observed_at":"2026-07-06T15:35:11.938380Z","submitted_at":"2023-05-30T04:09:47Z","title":"Real-World Image Variation by Aligning Diffusion Inversion Chain","version":3},"cited_work":{"arxiv_id":"2305.18729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.18729","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Real- world image variation by aligning diffusion inversion chain","venue":null,"work_id":"551acc7e-36ab-4fb9-81e4-f4b62facf772","year":2023},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2305.18729","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:8d4fc60d86018c31d19eab9eb8c6aab59cb436f3c6319aa7c34b4278fa3a4e38","observation_id":"678c58a0-564f-4d41-b719-34471a499d45","resolution":{"observed_at":"2026-05-14T21:40:44.171638Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":"2211.11018","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.11018","snapshot_observed_at":"2026-07-11T01:57:50.042360Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","venue":"cs.CV","work_id":"aad71b40-2721-438d-8e8c-97f84063ed39","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2211.11018","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:4dd3a5209d9c0da917203cce5445ddbe89a26e71e0d70bd7a71baaa273c30ddb","observation_id":"57894bb5-227c-4b34-b713-167d23479aef","resolution":{"observed_at":"2026-05-15T18:47:57.649874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":0,"verified_exact":24,"verified_fuzzy":34},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 100 inbound Pith citation observations for arXiv:2310.19512."}