{"as_of":"2026-08-09T23:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71fbc58fdd658fe19f45382a094666830ca5b699ffe58c38c950efaef45ad815","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T23:03:34.555438Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T22:49:00.811936Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-09T03:17:30.671491Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T14:16:18.521699Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2410.13720"},"observation_digest":"sha256:7c11ac8e7844f4cbb9024ed72945a0bfd1f92911f4eb13537f83994af9327d97","observation_id":"6d5d256a-5199-48db-903f-0e6f59148992","resolution":{"observed_at":"2026-05-11T14:16:25.123993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2411.15115","last_updated":"2026-04-20T17:59:36Z","snapshot_observed_at":"2026-08-02T10:06:23.710148Z","submitted_at":"2024-11-22T18:31:47Z","title":"Self-Correcting Text-to-Video Generation with Misalignment Detection and Localized Refinement","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-23T08:25:01.468957Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2411.15115"},"observation_digest":"sha256:9943360aad762f283b41843a3c9cdf8adb291e33201fb07b9cfe789d6c63a49f","observation_id":"5cc5827b-6f53-4df8-b8bf-1e6039e9b06d","resolution":{"observed_at":"2026-05-23T08:25:29.337738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-12T18:38:11.110166Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2412.14803"},"observation_digest":"sha256:8c523e2204ff95a2acef6c41d2df1f04ef3edd1db12e54e87d148a7e677b1bb3","observation_id":"1e82a8e0-03b7-480c-81fa-a0c3b06e56e2","resolution":{"observed_at":"2026-05-12T18:38:11.251784Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-08-09T23:03:34.555438Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18565","last_updated":"2025-04-01T03:18:58Z","snapshot_observed_at":"2026-08-09T22:55:48.903791Z","submitted_at":"2025-01-30T18:38:09Z","title":"BounTCHA: A CAPTCHA Utilizing Boundary Identification in Guided Generative AI-extended Videos","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T23:03:34.555438Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2501.18565"},"observation_digest":"sha256:d848f6d9fdc5bb865e0ed442ecf17f9b7c2d23178adaaa8620ac4731f429426a","observation_id":"cda05513-a459-4366-ab0b-b3897500d182","resolution":{"observed_at":"2026-08-09T23:03:34.555438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-08-09T17:34:10.088933Z","title":"Videofusion: Decomposed diffusion mod- els for high-quality video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01690","last_updated":"2025-02-02T16:55:42Z","snapshot_observed_at":"2026-08-09T17:26:43.945178Z","submitted_at":"2025-02-02T16:55:42Z","title":"HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T17:34:10.088933Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2502.01690"},"observation_digest":"sha256:1e6ee28270c766354f08567ced794b6b94b45b7eababeaa3dd892c79e1783a7a","observation_id":"3f6a5461-697a-4484-a276-9d89b8e2ca84","resolution":{"observed_at":"2026-08-09T17:34:10.088933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-08-08T11:51:13.227463Z","title":"org/CorpusID:266573555","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07737","last_updated":"2025-02-12T14:50:50Z","snapshot_observed_at":"2026-08-09T14:39:05.131807Z","submitted_at":"2025-02-11T17:57:53Z","title":"Next Block Prediction: Video Generation via Semi-Autoregressive Modeling","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:13.227463Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2502.07737"},"observation_digest":"sha256:33df5abc6e684cf91e6c04644ddbb53041023f64fe52450a8c2b4d472311dc7e","observation_id":"b50c31fb-2946-4b91-bf0a-41b91b03745f","resolution":{"observed_at":"2026-08-08T11:51:13.227463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-08-07T05:36:15.636162Z","title":"Videofusion: Decomposed diffusion models for high-quality video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-08T12:50:28.189950Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.636162Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:83eec72d403c1822e02e83a8948fbc9a0b92adb72cf2d61d020f95c9b9b47675","observation_id":"ae0d8297-91b7-4cc9-9557-3208a3e74c0d","resolution":{"observed_at":"2026-08-07T05:36:15.636162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2512.09299","last_updated":"2026-04-06T13:16:33Z","snapshot_observed_at":"2026-07-06T22:38:35.387503Z","submitted_at":"2025-12-10T03:57:29Z","title":"VABench: A Comprehensive Benchmark for Audio-Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T00:03:45.576961Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2512.09299"},"observation_digest":"sha256:09d7dcd754b555c8a839272b58e6dd46ecb2537b1b3879e90fa7a38dfae0873d","observation_id":"c375f6ff-c488-4805-aba1-7e03228e56bf","resolution":{"observed_at":"2026-05-17T00:08:43.918082Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2604.06339","last_updated":"2026-04-07T18:17:05Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T18:17:05Z","title":"Evolution of Video Generative Foundations","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-10T18:41:38.616611Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2604.06339"},"observation_digest":"sha256:645dcaac800c98fe08ed966e46173616156d494369180bc175c2c1c4b414b53c","observation_id":"df33fe41-8768-4538-b113-f7ca2720e351","resolution":{"observed_at":"2026-05-11T00:05:51.385213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2604.10127","last_updated":"2026-04-11T09:44:39Z","snapshot_observed_at":"2026-07-06T22:58:47.599383Z","submitted_at":"2026-04-11T09:44:39Z","title":"VGA-Bench: A Unified Benchmark and Multi-Model Framework for Video Aesthetics and Generation Quality Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:44:02.709823Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2604.10127"},"observation_digest":"sha256:eb461518ac01503b3792d6ef92aba8d28a4db8d4ca9fe143b452f0faf2b80b1c","observation_id":"a2a1123d-922c-43f3-a1f0-c1291002f8b1","resolution":{"observed_at":"2026-05-11T09:56:04.349804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2605.21042","last_updated":"2026-05-20T11:24:02Z","snapshot_observed_at":"2026-07-06T23:31:32.577242Z","submitted_at":"2026-05-20T11:24:02Z","title":"Dynamic Video Generation: Shaping Video Generation Across Time and Space","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T05:42:41.925474Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2605.21042"},"observation_digest":"sha256:a4f1e0e19161042d88aacca943d7224d18c54cb4567eea5f0408f336e49cde8c","observation_id":"1bdb771e-87b3-471b-b29b-791ca44b61ee","resolution":{"observed_at":"2026-05-21T05:43:58.793582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T02:03:45.564122Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:4fd148053d69bf7d953c81b2ff6be55eefa97598c039046b0b40fc0c84a0cb8e","observation_id":"ba90d827-b445-410e-bc6f-1a8a99027ebf","resolution":{"observed_at":"2026-07-01T18:25:57.827823Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-01T06:25:58.872140Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:b6882f2994aabc1e97c5950e441e91bb30c29560fa79b9733382c6e2c34fc976","observation_id":"d958836d-fa44-4659-83ae-42d9b6774d94","resolution":{"observed_at":"2026-07-01T09:35:40.647952Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-02T20:52:28.444524Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:4ee86f605a803e191ff69eca4c1e3bfe5536735d9599811ff832a7b5f742629b","observation_id":"827b35af-659f-4f91-88b7-aad354eb5087","resolution":{"observed_at":"2026-07-02T20:57:22.754580Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":"2303.08320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-03T22:49:00.811936Z","title":"Videofusion: Decomposed diffusion models for high- quality video generation","venue":null,"work_id":"3c0d22b0-62a7-4957-910d-b77cce740f9c","year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-03T22:44:16.272541Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:591bcceef8ca9a09006739d25a68a6dbac8fe3fdb2e68e983d25c2a6d96da26b","observation_id":"b3479984-be52-4d69-ba43-9e245cd6e527","resolution":{"observed_at":"2026-07-03T22:49:00.814404Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-14T17:14:19.770867Z","title":"arXiv preprint arXiv:2303.08320 (2023) 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":5},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-14T17:14:19.770867Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:088ccd078400b3f52bf27a74d905592010d247cc61568568ec54d713c9ccc77e","observation_id":"3c98606b-c722-46e4-a839-cd3ec72c6789","resolution":{"observed_at":"2026-07-14T17:14:19.770867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-08-02T10:00:12.931363Z","title":"arXiv preprint arXiv:2303.08320 (2023) 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-08-05T10:16:29.451498Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":6},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T10:00:12.931363Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:e3a7575d2adb499ab9f56328da36060d10e1c26ee6a4b7fa3c9ba8ab7bb8add3","observation_id":"c9685d15-0f55-4f0f-955c-1b5b368ba7f6","resolution":{"observed_at":"2026-08-02T10:00:12.931363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-12T01:59:48.820112Z","title":"Videofusion: Decomposed diffusion models for high-quality video generation.arXiv preprint arXiv:2303.08320,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03509","last_updated":"2026-07-03T17:34:14Z","snapshot_observed_at":"2026-08-02T07:31:16.311305Z","submitted_at":"2026-07-03T17:34:14Z","title":"Flex-Forcing: Towards a Unified Autoregressive and Bidirectional Video Diffusion Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T01:59:48.820112Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2607.03509"},"observation_digest":"sha256:d2452aca70f0dea5738f0e2fd8b57b6f7ab1762a8ba8e0a385098bd7ea5c94ad","observation_id":"a493f91e-91fb-43c9-9c1f-76d66a316974","resolution":{"observed_at":"2026-07-12T01:59:48.820112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-07-14T03:51:24.547781Z","title":"arXiv preprint arXiv:2303.08320 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11689","last_updated":"2026-07-13T15:22:56Z","snapshot_observed_at":"2026-08-02T18:20:32.168835Z","submitted_at":"2026-07-13T15:22:56Z","title":"From World Action Models to Embodied Brains: A Roadmap for Open-World Physical Intelligence","version":1},"reference_index":148,"source":"arxiv_source","source_observed_at":"2026-07-14T03:51:24.547781Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2607.11689"},"observation_digest":"sha256:759b062c306ee0ff678ae6fdf961035f97eea042db3799ff9f2e8f90570d8423","observation_id":"ebb93047-d7ca-4954-8a82-418d60547826","resolution":{"observed_at":"2026-07-14T03:51:24.547781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-08-01T04:24:27.251462Z","title":"Videofusion: Decomposed diffusion models for high-quality video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27634","last_updated":"2026-07-30T03:45:34Z","snapshot_observed_at":"2026-08-09T13:20:35.345494Z","submitted_at":"2026-07-30T03:45:34Z","title":"4DHumanDiff: Direct Text-to-4DGS Generation for Consistent 360-Degree Dynamic Humans","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-08-01T04:24:27.251462Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2607.27634"},"observation_digest":"sha256:55942463e6f655fe97a10af480d7d73bda29118f633321dd15674ae0c0c46a73","observation_id":"74ce9a22-650f-4924-bd2a-128d9ad5ba63","resolution":{"observed_at":"2026-08-01T04:24:27.251462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2303.08320/citation-record","integrity":"/paper/2303.08320/integrity","json":"/paper/2303.08320/citation-record.json","paper":"/paper/2303.08320"},"outbound":[],"paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2303.08320."}