{"as_of":"2026-08-13T14:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb58785b7865a40a114c89b1cfea773a6ca06894d7fe9f8524e0de833d273616","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T18:36:19.244722Z","state":"measured"},{"denominator":92,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":92,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:12:17.519375Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-07T14:03:48.633352Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-08-07T11:12:17.519375Z","title":"arXiv:2412.07760 [cs.CV] https: //arxiv.org/abs/2412.07760 Fan Bao, Chendong Xiang, Gang Yue, Guande He, Hongzhou Zhu, Kaiwen Zheng, Min Zhao, Shilong Liu, Yaole Wang, and Jun Zhu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03141","last_updated":"2025-08-12T02:27:56Z","snapshot_observed_at":"2026-08-10T02:48:41.050656Z","submitted_at":"2025-06-03T17:59:05Z","title":"Context as Memory: Scene-Consistent Interactive Long Video Generation with Memory Retrieval","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:12:17.519375Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2506.03141"},"observation_digest":"sha256:ea42d3287a6f338638285d635df59e5396b21422206bce7756dda1fb8306522a","observation_id":"4c299b7d-e5e4-4399-8a2c-bc9d2752a7ab","resolution":{"observed_at":"2026-08-07T11:12:17.519375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-08-07T10:51:43.039778Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints.arXiv preprint arXiv:2412.07760, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04216","last_updated":"2025-06-04T17:57:43Z","snapshot_observed_at":"2026-08-08T15:17:23.629862Z","submitted_at":"2025-06-04T17:57:43Z","title":"UNIC: Unified In-Context Video Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:51:43.039778Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2506.04216"},"observation_digest":"sha256:29219646657d5c6769ddba6f9bed604f297c3277fd754aa409984ecd8253613d","observation_id":"e8b09f01-88bb-459e-882c-e3ae9e23fe9e","resolution":{"observed_at":"2026-08-07T10:51:43.039778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-08-07T00:33:08.419844Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints.arXiv preprint arXiv:2412.07760, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13697","last_updated":"2025-06-16T17:02:47Z","snapshot_observed_at":"2026-08-08T14:18:54.627294Z","submitted_at":"2025-06-16T17:02:47Z","title":"Vid-CamEdit: Video Camera Trajectory Editing with Generative Rendering from Estimated Geometry","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:33:08.419844Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2506.13697"},"observation_digest":"sha256:9dd9c3efa2922264e831b19b48335545a83c3394f2e8e528c73df267084d5755","observation_id":"4ba4907c-aa37-497a-bef4-7b542b53cdc1","resolution":{"observed_at":"2026-08-07T00:33:08.419844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-08-03T18:26:31.636629Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints.arXiv preprint arXiv:2412.07760, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.05672","last_updated":"2026-07-06T07:23:46Z","snapshot_observed_at":"2026-08-04T17:03:44.669117Z","submitted_at":"2025-12-05T12:31:09Z","title":"InverseCrafter: Efficient Video ReCapture as a Latent Domain Inverse Problem","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T18:26:31.636629Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2512.05672"},"observation_digest":"sha256:614bc234fad88736ade4947935979217c4a2b45f338bdff2609bb87ab70f5f7e","observation_id":"f0535286-52bb-4636-9a87-dc9cbe8251ee","resolution":{"observed_at":"2026-08-03T18:26:31.636629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-08-02T19:20:38.793082Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.02697","last_updated":"2026-06-03T03:49:31Z","snapshot_observed_at":"2026-08-12T23:38:32.156634Z","submitted_at":"2026-03-03T07:41:12Z","title":"ShareVerse: Multi-Agent Consistent Video Generation for Shared World Modeling","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T19:20:38.793082Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2603.02697"},"observation_digest":"sha256:92eb3bbd159137846a0d9259822a2043c64fc5a6edb00e5bb71518d4548875b2","observation_id":"b9afade4-388b-43c8-8c62-40fba1c1952e","resolution":{"observed_at":"2026-08-02T19:20:38.793082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2604.03181","last_updated":"2026-04-03T16:57:06Z","snapshot_observed_at":"2026-08-11T12:51:27.052380Z","submitted_at":"2026-04-03T16:57:06Z","title":"Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T18:54:07.081457Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2604.03181"},"observation_digest":"sha256:8e1d5cfe57fd76923adc1e5564b963bd8ea3899ff73674f8bf4bc2ec46a7ffe7","observation_id":"45dce378-7731-4b79-ae07-2bbc03841789","resolution":{"observed_at":"2026-05-13T18:58:08.850233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-13T12:26:54.361488Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints.arXiv preprint arXiv:2412.07760, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03723","last_updated":"2026-06-24T08:25:16Z","snapshot_observed_at":"2026-08-06T04:57:30.700520Z","submitted_at":"2026-04-04T12:59:24Z","title":"SymphoMotion: Joint Control of Camera Motion and Object Dynamics for Coherent Video Generation","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T12:26:54.361488Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2604.03723"},"observation_digest":"sha256:7f47c428e3210c63281b605dc3889c3fbf6ec843de73a1f9215e80f6fd100521","observation_id":"6f8c1890-d18e-4319-aeed-310d7f052b03","resolution":{"observed_at":"2026-07-13T12:26:54.361488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2604.06010","last_updated":"2026-04-07T16:06:02Z","snapshot_observed_at":"2026-08-11T06:31:59.653450Z","submitted_at":"2026-04-07T16:06:02Z","title":"OmniCamera: A Unified Framework for Multi-task Video Generation with Arbitrary Camera Control","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T20:11:35.077141Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2604.06010"},"observation_digest":"sha256:5eea91c77ec49bff2604d68c6a591523b27d83ac078a00d62c01fd019dc98b94","observation_id":"6a8fb7a4-6390-4d90-85a3-78d6a069a187","resolution":{"observed_at":"2026-05-10T22:10:48.785886Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2604.07990","last_updated":"2026-04-26T05:22:47Z","snapshot_observed_at":"2026-08-11T08:51:25.778493Z","submitted_at":"2026-04-09T08:59:33Z","title":"SceneScribe-1M: A Large-Scale Video Dataset with Comprehensive Geometric and Semantic Annotations","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T17:16:23.355682Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2604.07990"},"observation_digest":"sha256:f06a39701a92397afeacc4eb11424385e0183363f27656faa1c1cb0ad6c4efbf","observation_id":"8976eb8f-0541-471f-b15d-56553e0b0546","resolution":{"observed_at":"2026-05-11T07:11:01.965732Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2604.21776","last_updated":"2026-04-24T04:18:46Z","snapshot_observed_at":"2026-08-11T15:40:34.486841Z","submitted_at":"2026-04-23T15:32:56Z","title":"Reshoot-Anything: A Self-Supervised Model for In-the-Wild Video Reshooting","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T23:00:45.496971Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2604.21776"},"observation_digest":"sha256:ecd3aac01367380ff8ac9cc98ea2c9a52edce949c7bdcc701f0b61b3493c5e91","observation_id":"5dc8343b-b63c-48e7-a591-521165fcdade","resolution":{"observed_at":"2026-05-09T23:04:17.890439Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2605.05207","last_updated":"2026-07-04T22:32:17Z","snapshot_observed_at":"2026-08-11T16:53:36.304511Z","submitted_at":"2026-05-06T17:59:55Z","title":"Syn4D: A Multiview Synthetic 4D Dataset","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T17:14:50.827455Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2605.05207"},"observation_digest":"sha256:7e60b340b8a4e9d941d94cc92aa1cdc851e8244cdcb6a50d4b91a05a8dfa268f","observation_id":"647ed7a7-6614-4867-ad21-98647c4ae2f6","resolution":{"observed_at":"2026-05-11T17:46:07.496588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-12T17:33:21.224727Z","title":"arXiv preprint arXiv:2412.07760 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.05207","last_updated":"2026-07-04T22:32:17Z","snapshot_observed_at":"2026-08-11T16:53:36.304511Z","submitted_at":"2026-05-06T17:59:55Z","title":"Syn4D: A Multiview Synthetic 4D Dataset","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-12T17:33:21.224727Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2605.05207"},"observation_digest":"sha256:65c5d71cd19df4527e53fdfd9d02c3d75242a991483e32e9eee5d9c73b57d3b6","observation_id":"4e23110a-c88e-40a3-b654-c9b9a3f623be","resolution":{"observed_at":"2026-07-12T17:33:21.224727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2605.11871","last_updated":"2026-05-16T12:55:04Z","snapshot_observed_at":"2026-08-11T21:07:05.098435Z","submitted_at":"2026-05-12T09:51:04Z","title":"$h$-control: Training-Free Camera Control via Block-Conditional Gibbs Refinement","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T07:09:32.103652Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2605.11871"},"observation_digest":"sha256:51cbd4d310c8e5b4ba44b893f48b67bc9f691fcc53e6410a6f669d3f42247573","observation_id":"02c33dab-d9ce-4b83-b23e-660c42b1d10e","resolution":{"observed_at":"2026-05-13T07:12:28.168078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2605.11871","last_updated":"2026-05-16T12:55:04Z","snapshot_observed_at":"2026-08-11T21:07:05.098435Z","submitted_at":"2026-05-12T09:51:04Z","title":"$h$-control: Training-Free Camera Control via Block-Conditional Gibbs Refinement","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T22:55:00.590833Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2605.11871"},"observation_digest":"sha256:25555120c70bc8cfa529976045e8d83539856746db660ba1c73ab045577a7760","observation_id":"4c140c61-3d46-444a-8038-ca6abfc6b7c8","resolution":{"observed_at":"2026-05-20T22:59:11.796440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2605.14815","last_updated":"2026-05-14T13:27:33Z","snapshot_observed_at":"2026-08-02T19:23:49.520789Z","submitted_at":"2026-05-14T13:27:33Z","title":"Probing into Camera Control of Video Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T21:11:19.441408Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2605.14815"},"observation_digest":"sha256:10257878e3e900883f66b7a25531e5ce391298af6814b4f40b76acb38b1aa135","observation_id":"6817541f-68ed-4623-94f4-1daba8cce214","resolution":{"observed_at":"2026-06-30T21:15:04.372320Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2605.18365","last_updated":"2026-05-18T13:17:08Z","snapshot_observed_at":"2026-08-02T07:31:08.555715Z","submitted_at":"2026-05-18T13:17:08Z","title":"GeoFlow: Enforcing Implicit Geometric Consistency in Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T11:06:09.367559Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2605.18365"},"observation_digest":"sha256:08d10f6a1f28920718fd4f184d6377d74c659093e15b1e3eb90cb70c29f317d7","observation_id":"63025397-b896-4f97-b2f3-062f06275b67","resolution":{"observed_at":"2026-05-20T11:08:13.612507Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2605.22344","last_updated":"2026-05-21T11:30:29Z","snapshot_observed_at":"2026-08-12T12:52:42.939698Z","submitted_at":"2026-05-21T11:30:29Z","title":"Bernini: Latent Semantic Planning for Video Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T06:39:47.124605Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2605.22344"},"observation_digest":"sha256:1d7260923bff5ebc6e40fc43ebc0897b2c5c8434e0987e4d92223a973eb0ce78","observation_id":"e77d55a4-04d1-4150-9063-6b6b2a075742","resolution":{"observed_at":"2026-05-22T06:41:10.471665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2606.00299","last_updated":"2026-05-29T19:28:07Z","snapshot_observed_at":"2026-08-11T02:13:23.357431Z","submitted_at":"2026-05-29T19:28:07Z","title":"Real2SAM2Real: Generative 3D Caches as Complementary Context for Video Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T22:41:00.915004Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2606.00299"},"observation_digest":"sha256:66c9ed8d1ebdbbfd488a1c5377a57d4dab2a407317ac08c9b28256f2d4b7f8dd","observation_id":"144de9d3-5bc8-4fec-83ec-16161982aeaf","resolution":{"observed_at":"2026-06-28T22:42:46.290107Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2606.17536","last_updated":"2026-06-16T05:25:55Z","snapshot_observed_at":"2026-07-31T01:15:07.358009Z","submitted_at":"2026-06-16T05:25:55Z","title":"OmniDrive: An LLM-Choreographed Multi-Agent World Model with Unified Latent Co-Compression for Multi-View Driving Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T01:46:14.430539Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2606.17536"},"observation_digest":"sha256:aab84712fc5f8a0f0ce2a99048c768d21d881f3fff1fe9f0fd7f9b7d3d8239e2","observation_id":"87604c17-2a3d-4e9c-8192-0c3e6212e565","resolution":{"observed_at":"2026-07-03T19:28:52.683395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":"2412.07760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-07T14:03:48.633352Z","title":"Syncammaster: Synchronizing multi-camera video generation from diverse viewpoints","venue":"cs.CV","work_id":"1e2ec4f5-4262-4ac2-8516-d696e541587e","year":2024},"citing_paper":{"arxiv_id":"2607.05376","last_updated":"2026-07-06T17:54:16Z","snapshot_observed_at":"2026-07-09T23:18:25.821956Z","submitted_at":"2026-07-06T17:54:16Z","title":"MV-Forcing: Long Multi-View Video Generation via 4D-Grounded Spatio-Temporal Self-Forcing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-07T13:58:13.194386Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2607.05376"},"observation_digest":"sha256:87b363851b11d613d1a402a5b7e744450f5a9f5e3c899b1bc5494e8452c94145","observation_id":"cfb1fa9f-4217-41da-a779-16cb4cedeb20","resolution":{"observed_at":"2026-07-07T14:03:48.634744Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-07-14T03:51:24.547781Z","title":"arXiv preprint arXiv:2412.07760 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11689","last_updated":"2026-07-13T15:22:56Z","snapshot_observed_at":"2026-08-12T10:42:47.843668Z","submitted_at":"2026-07-13T15:22:56Z","title":"From World Action Models to Embodied Brains: A Roadmap for Open-World Physical Intelligence","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-14T03:51:24.547781Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2607.11689"},"observation_digest":"sha256:bb9a5502443147c9f52e6086133cc24243b5df451a874cee8945c5ab83727cda","observation_id":"49e68044-2f8e-42af-a640-3f8277553be8","resolution":{"observed_at":"2026-07-14T03:51:24.547781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07760","snapshot_observed_at":"2026-08-03T03:17:51.668564Z","title":"arXiv preprint arXiv:2412.07760 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29627","last_updated":"2026-07-31T16:59:46Z","snapshot_observed_at":"2026-08-05T23:16:09.548439Z","submitted_at":"2026-07-31T16:59:46Z","title":"FlexComposer: Unified Video Compositing from Images to Dynamic Footage with Flexible Trajectory Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T03:17:51.668564Z"},"links":{"cited_paper":"/paper/2412.07760","citing_paper":"/paper/2607.29627"},"observation_digest":"sha256:6a5eb987f85c63e850b64a3aa6d52b16c88f85f9b9248ebf33ec031499a261c2","observation_id":"0b0ae8cb-edee-4e42-a0a1-9779e41560d4","resolution":{"observed_at":"2026-08-03T03:17:51.668564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.07760/citation-record","integrity":"/paper/2412.07760/integrity","json":"/paper/2412.07760/citation-record.json","paper":"/paper/2412.07760"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:18.783726Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.783726Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:1ec22087644189e153aac40f3e5b5f134bbfc23ca508f7d09b9c6b26b6654617","observation_id":"741e2c8f-fa96-4899-9e0f-cc924d75e6c0","resolution":{"observed_at":"2026-08-11T18:36:18.783726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-12T23:20:07.594666Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-11T18:36:18.792226Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.792226Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:37e08845f2470c3010f942916a955e46cab9708ce29e66acbc0112ce98fdba21","observation_id":"7bda044c-ecf2-4b1c-9e2d-20c29418e186","resolution":{"observed_at":"2026-08-11T18:36:18.792226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-11T18:36:18.799054Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.799054Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:95c369a8e2b8537855a66a83bceabdf8cbfe4b976815a36999ba0a440bc0b0d5","observation_id":"4e257db3-9a50-428d-8a2c-ea56c912e315","resolution":{"observed_at":"2026-08-11T18:36:18.799054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:18.805734Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.805734Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:ca1311f9b899af407378a469ec193ee8e550f5eafc70cdb37e70378c1013963e","observation_id":"11067f54-ec2f-4648-9d98-85267d985e17","resolution":{"observed_at":"2026-08-11T18:36:18.805734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.976249Z","title":"Generative novel view synthesis with 3d-aware diffusion models","venue":null,"work_id":"4ce6f871-e19c-4483-9741-0c049906adba","year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.812374Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:804af353d4752f3f406ecf6ff3f167dea335d97a918f71ebe45bcc0fa154214f","observation_id":"04a54701-13e1-4ca7-aaf6-491c4eab1cfd","resolution":{"observed_at":"2026-08-11T18:36:20.982324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.957382Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":"caf7640f-7542-4edd-956a-85d5a420d65a","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.820753Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:61c455a3896e48d21e11bbf8dc9f56eb6df0624ff48f77ee29b7892d429a5a9f","observation_id":"a0d60a84-34d9-493f-a2f6-898a3262c8b7","resolution":{"observed_at":"2026-08-11T18:36:20.962853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:18.827062Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.827062Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:74d6b33477695d510834d8192a593696f64276eff941efb32af63e7c45b277d9","observation_id":"fd9b9a01-b49a-4308-83ab-4cd740f15865","resolution":{"observed_at":"2026-08-11T18:36:18.827062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.707549Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"51533cde-6ed1-477a-919f-c0c882172971","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.833050Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:963a2c74c35f81c3724bfcddc02a0bc716c2949c2f41c89e3f92e15203e183d2","observation_id":"17405870-a59c-46d2-840d-ffef3f62852a","resolution":{"observed_at":"2026-08-11T18:36:20.714571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.688623Z","title":"3dtrajmaster: Mastering 3d trajectory for multi-entity motion in video generation","venue":null,"work_id":"6e97ddcc-81f2-4a4f-8662-09cc708d6c85","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.838624Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:c5da34e86607752476f12a825b92921aa76af11907d7e1057a002078db01bd5f","observation_id":"4d6aeb27-e294-442b-b745-2298f4e16307","resolution":{"observed_at":"2026-08-11T18:36:20.694821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10314","last_updated":"2024-05-16T17:59:05Z","snapshot_observed_at":"2026-08-10T20:20:11.320482Z","submitted_at":"2024-05-16T17:59:05Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10314","snapshot_observed_at":"2026-08-11T18:36:18.844242Z","title":"Cat3d: Create anything in 3d with multi-view diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.844242Z"},"links":{"cited_paper":"/paper/2405.10314","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:0f4240d34f5317d27394acbaa5db6a99c717807c4a1d5185934eba3fa9ade31b","observation_id":"a3067124-2cad-4fbb-b837-ab07814520ec","resolution":{"observed_at":"2026-08-11T18:36:18.844242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.670490Z","title":null,"venue":null,"work_id":"7ac91ed1-3a40-4453-88b6-348bbb18f483","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.850116Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:41c7b0b0dbb573114037a71782fb0a7288cad12aebc230b9b63b47dd744e6bc0","observation_id":"27e3eee3-11d2-4c3b-bda5-a3f2324020cd","resolution":{"observed_at":"2026-08-11T18:36:20.675623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10709","last_updated":"2024-08-02T18:55:25Z","snapshot_observed_at":"2026-08-13T05:22:58.925946Z","submitted_at":"2023-11-17T18:59:04Z","title":"Emu Video: Factorizing Text-to-Video Generation by Explicit Image Conditioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10709","snapshot_observed_at":"2026-08-11T18:36:18.856072Z","title":"Emu video: Factorizing text-to-video generation by explicit image conditioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.856072Z"},"links":{"cited_paper":"/paper/2311.10709","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:c53a68e67a7da4d29915bca36579f0d6d611225c67a1be16b3331ed4dfb00aef","observation_id":"30e2ec5f-24e8-411b-aac1-02ccbc6817ed","resolution":{"observed_at":"2026-08-11T18:36:18.856072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16933","last_updated":"2023-11-28T16:33:08Z","snapshot_observed_at":"2026-08-13T05:15:15.489641Z","submitted_at":"2023-11-28T16:33:08Z","title":"SparseCtrl: Adding Sparse Controls to Text-to-Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16933","snapshot_observed_at":"2026-08-11T18:36:18.863356Z","title":"Sparsectrl: Adding sparse controls to text-to-video diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.863356Z"},"links":{"cited_paper":"/paper/2311.16933","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:31fef3c22528795e1e1e6285ed10e16931604a629ea8038bb30d60d870d67e6d","observation_id":"f78e426d-1012-4e85-ae0c-6447a36acc79","resolution":{"observed_at":"2026-08-11T18:36:18.863356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-11T18:36:18.869676Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.869676Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:e331399226956fb69e41705c829d127a4dfc2349be8f81efa413d4688ff1257f","observation_id":"60877abf-cdbf-4a50-a215-b165fb7708f7","resolution":{"observed_at":"2026-08-11T18:36:18.869676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-12T01:27:32.593496Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-11T18:36:18.875000Z","title":"Cameractrl: Enabling camera control for text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.875000Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:636012b12a7864a8f41f5d961edc315e4a3f51a037967687782e77802deed549","observation_id":"7adba87a-d7b0-443b-93f7-e7808218420c","resolution":{"observed_at":"2026-08-11T18:36:18.875000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.653344Z","title":"Epipolar transformers","venue":null,"work_id":"c90fabaa-7842-452f-a70b-9e2deae5ea32","year":2020},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.881184Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:813ea4eac1b3e38279a569ebf7e0d658657f719e6f52bb249dee8257e91cea5b","observation_id":"1d7ebf4e-f2e2-4bb6-aeb3-6c1052cc79d0","resolution":{"observed_at":"2026-08-11T18:36:20.659488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:18.886805Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.886805Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:1482e52a2982b208219ea0a51ffe1095c55e6905d10cef5cf5d8d3a00b80c3ce","observation_id":"f867fd31-4d57-4b67-93b5-d7e85eabbeb9","resolution":{"observed_at":"2026-08-11T18:36:18.886805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.624836Z","title":"o llein, Alja z Bo z i c , Norman M \\","venue":null,"work_id":"0a50d617-f9d1-44e9-a16a-de18f221aaa2","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.892026Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:037235d4501a57bdbc62ac7e57a13555d64e28027962b1ab20cb1aa82c3cbca1","observation_id":"151ee55e-b5ff-4593-b729-d9fbc08ba44d","resolution":{"observed_at":"2026-08-11T18:36:20.630098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T18:36:18.898074Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.898074Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:ae6596d2987017e626a1c0635c50a6702164ef119ed8d7b04425dcd6631dee15","observation_id":"03802f35-d8df-4813-8185-66dfe5bb979c","resolution":{"observed_at":"2026-08-11T18:36:18.898074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:18.904545Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.904545Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:f18f4a7c53963e0711afed6bd9a3fa03ae1ef877ccab32649fccda298251e0d2","observation_id":"1bda6893-30b1-4955-ac02-906163871fff","resolution":{"observed_at":"2026-08-11T18:36:18.904545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:18.910359Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.910359Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:f3bfbd96633ea572589e2856753f2d91cc5796389680907ed5a2467e32fb4db2","observation_id":"039297e2-6724-4e51-8f0b-550abb8e5805","resolution":{"observed_at":"2026-08-11T18:36:18.910359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.580777Z","title":"Videobooth: Diffusion-based video generation with image prompts","venue":null,"work_id":"6f76ab89-aca2-4c30-bf23-8877573a7bae","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.916380Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:a79b690acc36c428ebf34b2889d4a37e0dacb78afe07282adefa3b950fbcae0d","observation_id":"5108cad5-9fdd-4773-90c8-ca1b9eb29f14","resolution":{"observed_at":"2026-08-11T18:36:20.586651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17242","last_updated":"2025-04-02T21:12:32Z","snapshot_observed_at":"2026-08-12T22:17:19.990901Z","submitted_at":"2024-10-22T17:58:28Z","title":"LVSM: A Large View Synthesis Model with Minimal 3D Inductive Bias","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17242","snapshot_observed_at":"2026-08-11T18:36:18.923139Z","title":"Lvsm: A large view synthesis model with minimal 3d inductive bias","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.923139Z"},"links":{"cited_paper":"/paper/2410.17242","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:0779555ec58ff66153e75fa797d3aca75f05a28d60dc6401832e8a7849b7545b","observation_id":"bde67322-30dd-4bca-9e12-0cf363de2305","resolution":{"observed_at":"2026-08-11T18:36:18.923139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.562030Z","title":"Panoptic studio: A massively multiview system for social motion capture","venue":null,"work_id":"ec7bdbcc-421c-41bd-84b1-0c23f2ea296c","year":2015},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.929425Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:44d00930f3a4a92a1b2b8a6558356da8e590506bbcba6fb3782df13e0343c3d4","observation_id":"68299a65-34a3-4a86-a23c-e49387bde649","resolution":{"observed_at":"2026-08-11T18:36:20.567999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.542523Z","title":"Spad: Spatially aware multi-view diffusers","venue":null,"work_id":"58003a73-df71-4370-b36b-bf3041cccf7e","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.935138Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:5d6ef53729d16066248644adce1f7919e643aaeb65262aad22eba09d6821fcb1","observation_id":"3935cb95-a984-49df-a5ee-31a4c6d8cd64","resolution":{"observed_at":"2026-08-11T18:36:20.548433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07635","last_updated":"2024-10-01T13:15:53Z","snapshot_observed_at":"2026-08-13T10:55:12.508649Z","submitted_at":"2023-07-14T21:13:04Z","title":"CoTracker: It is Better to Track Together","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07635","snapshot_observed_at":"2026-08-11T18:36:18.941470Z","title":"Cotracker: It is better to track together","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.941470Z"},"links":{"cited_paper":"/paper/2307.07635","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:939498d7df2a4336f937cf9fdab7ea2e538bcf130c30c3ccca1a5cc2ea623066","observation_id":"103b9ec6-d3e6-4149-b6c0-1bfdf14f6236","resolution":{"observed_at":"2026-08-11T18:36:18.941470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:18.948865Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.948865Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:a0170bf920c51565bba10368ca744e623c24995884b4c7694d33baef9947525e","observation_id":"a0a90abf-6116-4c10-afde-d90223843100","resolution":{"observed_at":"2026-08-11T18:36:18.948865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:18.955502Z","title":"Segment anything","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.955502Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:95249cf13398fc3ac478269406605fa87b844afcfa54f7a6e70789482ad96f07","observation_id":"f267f2cc-54a9-4042-833e-0c32dc0b6301","resolution":{"observed_at":"2026-08-11T18:36:18.955502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.498940Z","title":null,"venue":null,"work_id":"a109d9aa-cb4c-4730-b9f1-16c2c8f5580b","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.964288Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:8d7e561fda634a3a5b117e0d2ee442129bd241a87621925a51bea5de3866ee81","observation_id":"2e2a6849-74c4-4738-960f-41ae53965a4f","resolution":{"observed_at":"2026-08-11T18:36:20.505507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17414","last_updated":"2024-05-27T17:58:01Z","snapshot_observed_at":"2026-08-12T23:56:51.490761Z","submitted_at":"2024-05-27T17:58:01Z","title":"Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17414","snapshot_observed_at":"2026-08-11T18:36:18.978524Z","title":"Collaborative video diffusion: Consistent multi-video generation with camera control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.978524Z"},"links":{"cited_paper":"/paper/2405.17414","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:3dbbf36aa128c066a99c3ef58177c143e8c15e21d3772c5c9968094b4cd6b566","observation_id":"67de54d1-a1b6-4984-bd36-6b8593eb5775","resolution":{"observed_at":"2026-08-11T18:36:18.978524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08659","last_updated":"2024-06-12T21:44:04Z","snapshot_observed_at":"2026-08-13T05:57:40.453283Z","submitted_at":"2024-06-12T21:44:04Z","title":"Vivid-ZOO: Multi-View Video Generation with Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08659","snapshot_observed_at":"2026-08-11T18:36:18.989755Z","title":"Vivid-zoo: Multi-view video generation with diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.989755Z"},"links":{"cited_paper":"/paper/2406.08659","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:9094bc34bcda7a4d0921cad6ae7d48a4d2de3374b4838b1dc1ff772f36439205","observation_id":"f6bc2980-ea75-4892-b0cc-be8c1bf2ba80","resolution":{"observed_at":"2026-08-11T18:36:18.989755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16645","last_updated":"2024-05-26T17:47:34Z","snapshot_observed_at":"2026-08-12T23:57:41.828438Z","submitted_at":"2024-05-26T17:47:34Z","title":"Diffusion4D: Fast Spatial-temporal Consistent 4D Generation via Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16645","snapshot_observed_at":"2026-08-11T18:36:18.999202Z","title":"Diffusion4d: Fast spatial-temporal consistent 4d generation via video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:18.999202Z"},"links":{"cited_paper":"/paper/2405.16645","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:670b0573ae2510b5d1eb8618005373e3c9e39eb58b1b4aea9db42f38d829ad7e","observation_id":"cd2df887-b218-438d-be1a-70285a123125","resolution":{"observed_at":"2026-08-11T18:36:18.999202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.478639Z","title":"Efficient neural radiance fields for interactive free-viewpoint video","venue":null,"work_id":"90f24a04-1838-48b9-a684-1508de2671df","year":2022},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.005036Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:544213c80494b9ed59eae317eef3cc3df2743786941976dd3bdf2a7b04210bb1","observation_id":"d076518a-1f9b-4da4-a8be-e2be1605511a","resolution":{"observed_at":"2026-08-11T18:36:20.484575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:19.010316Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.010316Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:2852b7b760031d136ecd214048fa2dcca876bc5dcba488f5b2780429d2d77a5b","observation_id":"1bf5d27e-1b70-4f18-82bd-5c0049d40fb5","resolution":{"observed_at":"2026-08-11T18:36:19.010316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.436381Z","title":null,"venue":null,"work_id":"3b64a312-c6f4-4582-8512-22acde539cec","year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.021825Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:efaa18cddf29268a1350b21e3fce0df46f88242f383c71e814a1dff4d7ebd085","observation_id":"1c87b10f-7c34-43e2-a032-c2e97337821d","resolution":{"observed_at":"2026-08-11T18:36:20.443338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00330","last_updated":"2024-09-12T06:50:53Z","snapshot_observed_at":"2026-08-13T05:12:44.505891Z","submitted_at":"2023-12-01T03:53:21Z","title":"StyleCrafter: Enhancing Stylized Text-to-Video Generation with Style Adapter","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00330","snapshot_observed_at":"2026-08-11T18:36:19.027795Z","title":"Stylecrafter: Enhancing stylized text-to-video generation with style adapter","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.027795Z"},"links":{"cited_paper":"/paper/2312.00330","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:308020dbf74b1d1145497f6264f33d9b0e795a782f08defc47bc45d514a0f4ac","observation_id":"f0a1cd91-0793-463b-8434-26443ab2109f","resolution":{"observed_at":"2026-08-11T18:36:19.027795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.416113Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"6377a6a5-402f-47fa-8da4-19bfdffbf80a","year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.033239Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:3aa3f7185233f882988d3ecc07c52df5c1d135a93b6fb9997d73801e23656db4","observation_id":"381d953c-d681-4547-b5e5-aae1ecca79c0","resolution":{"observed_at":"2026-08-11T18:36:20.422704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03453","last_updated":"2024-04-15T10:28:44Z","snapshot_observed_at":"2026-08-12T22:52:54.817720Z","submitted_at":"2023-09-07T02:28:04Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03453","snapshot_observed_at":"2026-08-11T18:36:19.040244Z","title":"Syncdreamer: Generating multiview-consistent images from a single-view image","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.040244Z"},"links":{"cited_paper":"/paper/2309.03453","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:603d1da97ea526ff78179f0648f02d0bd2cc35c8e25fef974115d4b518fdf18e","observation_id":"4df9c262-6b21-40ad-a782-1af802bfa64d","resolution":{"observed_at":"2026-08-11T18:36:19.040244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-13T10:28:06.516901Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-11T18:36:19.045628Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.045628Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:11ad9664228053303b3bebdb3cb27cad07896ba79f457f1d3998f3c679d457b6","observation_id":"e81776c7-fc18-4c4a-a91d-c9ffb0ab7717","resolution":{"observed_at":"2026-08-11T18:36:19.045628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09368","last_updated":"2024-03-20T17:36:35Z","snapshot_observed_at":"2026-08-13T04:18:54.508144Z","submitted_at":"2024-02-14T18:13:51Z","title":"Magic-Me: Identity-Specific Video Customized Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09368","snapshot_observed_at":"2026-08-11T18:36:19.051104Z","title":"Magic-me: Identity-specific video customized diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.051104Z"},"links":{"cited_paper":"/paper/2402.09368","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:7a3f203ad84aa5c8eed422413d1fbc0f342dcd1db4a2ff1d6d632eb38b2e4a80","observation_id":"bd7573aa-1c32-4515-bdd2-6bfc5dd09c34","resolution":{"observed_at":"2026-08-11T18:36:19.051104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:19.067392Z","title":"Snap video: Scaled spatiotemporal transformers for text-to-video synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.067392Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:5744196bbb06ad24f7579b8c435cb4225cdf3b07e8abfa3891030875a3a4c811","observation_id":"adf03aa5-ed70-4c3d-ad7a-0ecc18e43395","resolution":{"observed_at":"2026-08-11T18:36:19.067392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:19.073941Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.073941Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:0c4a6ba7d88eee63480110358966ae26390f5f89da2506c94ab6f552e1ff94bb","observation_id":"2dcbfaaf-b7f5-4bb7-93de-b8a0a5c9126f","resolution":{"observed_at":"2026-08-11T18:36:19.073941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:19.078919Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.078919Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:d4dac3558753d8587c68eaa0aa29e40604096e65dbbefaab166da28f2cd729d0","observation_id":"80abe563-b76b-4ac8-8d40-3644ef3e3225","resolution":{"observed_at":"2026-08-11T18:36:19.078919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.351653Z","title":"Common objects in 3d: Large-scale learning and evaluation of real-life 3d category reconstruction","venue":null,"work_id":"64314a73-f5c0-48e8-9be4-5b3b2bf8c087","year":2021},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.084300Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:6849b3855b630c17b52a0c302b28678f4b995f1ec6cf6e3f34fc4870ce440945","observation_id":"f699e0e6-40b1-4177-9788-4d8e6ee9ded0","resolution":{"observed_at":"2026-08-11T18:36:20.358417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.329456Z","title":"An introduction to Unreal engine 4","venue":null,"work_id":"2acd6f51-cd76-47e3-ade0-ce5025f89f4a","year":2016},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.089573Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:6d5e98e7b6aa7c2be57248403e763a3732113c0e69b817b9e5b1f1f8c0fc3fd3","observation_id":"8e7f3b2a-c993-4119-a5e5-f55e2beda678","resolution":{"observed_at":"2026-08-11T18:36:20.336416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.310002Z","title":"Ntu rgb+ d: A large scale dataset for 3d human activity analysis","venue":null,"work_id":"8971bce6-a881-4303-a221-ee646f124bf2","year":2016},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.095927Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:c413b9bd3c223b4ac4306016f111e7416bf1b7363911b9788ebeb3ff9e87f962","observation_id":"a86eeabc-d677-43e8-97f0-62d7617f197c","resolution":{"observed_at":"2026-08-11T18:36:20.315368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.289445Z","title":"Gim: Learning generalizable image matcher from internet videos","venue":null,"work_id":"5015ed11-1b7d-422a-b121-b2afe659578f","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.102821Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:19f78c3f2ed108aed98f10bec868db8f1fb846082a137d965f6ce87cd4630a6d","observation_id":"dcd98f63-15e3-4a1f-a825-ff09af3d80b4","resolution":{"observed_at":"2026-08-11T18:36:20.296225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-11T18:36:19.108005Z","title":"Mvdream: Multi-view diffusion for 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.108005Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:c1a994b5b41056e0107505b4df77c78bd5e50622db025f32e3a11e13624a4477","observation_id":"50a5856a-0f25-42bb-bea6-e37d2b4de460","resolution":{"observed_at":"2026-08-11T18:36:19.108005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.268173Z","title":null,"venue":null,"work_id":"7c7f2da4-9cfc-4bb0-8899-3ad9ac7311d2","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.113532Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:27537bd596785e7686d5691191d92b450393a06159adbdb78ab18f003baaa3ca","observation_id":"2f3abd1a-bd50-4e37-860c-4b6107ebdfc8","resolution":{"observed_at":"2026-08-11T18:36:20.276374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.248999Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":"e74e8990-e7f5-4394-b7fc-37def968b174","year":2019},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.119772Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:ec5b32d13c7b214d2058f103fae90548b97b983e006ecbf0d00b9b8196f5d563","observation_id":"2f3a3246-7a15-4371-b66b-9f76f610c408","resolution":{"observed_at":"2026-08-11T18:36:20.255165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14868","last_updated":"2024-07-05T17:59:57Z","snapshot_observed_at":"2026-08-12T23:59:30.015652Z","submitted_at":"2024-05-23T17:59:52Z","title":"Generative Camera Dolly: Extreme Monocular Dynamic Novel View Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14868","snapshot_observed_at":"2026-08-11T18:36:19.125073Z","title":"Generative camera dolly: Extreme monocular dynamic novel view synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.125073Z"},"links":{"cited_paper":"/paper/2405.14868","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:7517b640d7a03499e5073245d902b2a6b9daf361d26aba1d94ff3245671271a6","observation_id":"44456577-e15e-4351-bbf0-23d967dd5442","resolution":{"observed_at":"2026-08-11T18:36:19.125073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-10T01:52:30.999213Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-11T18:36:19.131134Z","title":"Modelscope text-to-video technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.131134Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:0a4462501bcadf2ce307113fa38b416cf23943cb2e713a3af0ec666d1f4512e3","observation_id":"c7454739-3060-49fc-aa7e-46be10b7ff6d","resolution":{"observed_at":"2026-08-11T18:36:19.131134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-08-13T10:04:30.993324Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-08-11T18:36:19.139649Z","title":"Lavie: High-quality video generation with cascaded latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.139649Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:d56b1bd5c86ada00659751df5bdf8cbf81753280da6192d5d863ac122335c95e","observation_id":"8a612708-b6a5-4fa8-a32f-9536049e8904","resolution":{"observed_at":"2026-08-11T18:36:19.139649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.218387Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"93822ae8-dbc4-4a22-bd0d-f4564f58607a","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.146266Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:e2bfe3a3c85955854e6bddf24e2dcd953655d2427c2f8f7a75fc5a171120426c","observation_id":"72e69d3b-2093-44f4-92a5-2dde266c9d95","resolution":{"observed_at":"2026-08-11T18:36:20.231289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.193156Z","title":"4d gaussian splatting for real-time dynamic scene rendering","venue":null,"work_id":"d568575c-23f9-4f4d-8988-9140f930a1e2","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.151580Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:76c96572182cbaf35db83447c5500b1aa3ebbfb963647aa8638a368cd81de28e","observation_id":"a7f6cd59-63b1-4bb5-aab2-9230a02294ca","resolution":{"observed_at":"2026-08-11T18:36:20.199513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17470","last_updated":"2025-02-27T21:52:39Z","snapshot_observed_at":"2026-08-12T23:15:26.209419Z","submitted_at":"2024-07-24T17:59:43Z","title":"SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17470","snapshot_observed_at":"2026-08-11T18:36:19.157166Z","title":"Sv4d: Dynamic 3d content generation with multi-frame and multi-view consistency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.157166Z"},"links":{"cited_paper":"/paper/2407.17470","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:e300107f5fbeaef41379f7c9cfe53e8b3cfbe1b24dfddf8abcda5a19dd5d61ec","observation_id":"01897858-db0e-4412-8be7-935d97f591a1","resolution":{"observed_at":"2026-08-11T18:36:19.157166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.167359Z","title":"Make-your-video: Customized video generation using textual and structural guidance","venue":null,"work_id":"a79ca9fa-235f-432a-87ac-810b867e603e","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.162839Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:074843510f9e9cef933823ace530340cadca25c0da32a0fc3e59b4202879d761","observation_id":"d1652e25-7d66-49d4-ae7d-964b6cc03e26","resolution":{"observed_at":"2026-08-11T18:36:20.174909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-04T13:02:12.217544Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-08-11T18:36:19.169279Z","title":"Camco: Camera-controllable 3d-consistent image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.169279Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:7da8a72162a3ea6cf60ef58c16743419b34dfdaf70a71caa41252b765d78aae1","observation_id":"41dee740-96ed-4271-8ede-029e1bbc0631","resolution":{"observed_at":"2026-08-11T18:36:19.169279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.135012Z","title":"Direct-a-video: Customized video generation with user-directed camera movement and object motion","venue":null,"work_id":"2d7fe3f8-80ef-4f4f-b9b9-513e63dbd238","year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.175464Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:94dbada41a951cce4e057b7d4089a91c57ac8549a971269bfdc8455eeb29199c","observation_id":"9cb7970a-b353-4ab5-b8f1-4ba6156cfbe9","resolution":{"observed_at":"2026-08-11T18:36:20.148462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.114020Z","title":"Rerender a video: Zero-shot text-guided video-to-video translation","venue":null,"work_id":"c70df203-1604-4ecf-a658-8347faf42ae6","year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.181717Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:50606f824fe06e4ec83bc8212b189ddb7aa9054d8a2100244d9cceeebbb3fafc","observation_id":"a926f7d1-38b3-48e5-91c3-199dc7799d95","resolution":{"observed_at":"2026-08-11T18:36:20.120507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-11T18:36:19.186845Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.186845Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:74825fcb6409a776b828337439ac2b2226a9325f95e2297b01ba1290eea4573e","observation_id":"92cd9913-5c63-4b0f-8784-8b5341f26689","resolution":{"observed_at":"2026-08-11T18:36:19.186845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-08-11T18:36:19.192857Z","title":"Dragnuwa: Fine-grained control in video generation by integrating text, image, and trajectory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.192857Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:918f141a81bce502805c1424aecc3ec6d1f8d44dc411df949c069a070f622cc8","observation_id":"2a7c804f-8052-4451-84b6-22b17822999e","resolution":{"observed_at":"2026-08-11T18:36:19.192857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:20.086406Z","title":"Mvimgnet: A large-scale dataset of multi-view images","venue":null,"work_id":"282a7de4-12ca-4fce-8764-3e55ee2f61bb","year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.198877Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:cce86bda45823e1455d948fa28bdc6761e5f190626f474257285ad9b0d81987f","observation_id":"3b6a5658-e9ab-4c5f-85db-36c086af78ec","resolution":{"observed_at":"2026-08-11T18:36:20.098670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15818","last_updated":"2025-05-30T03:55:20Z","snapshot_observed_at":"2026-08-13T10:03:45.103373Z","submitted_at":"2023-09-27T17:44:18Z","title":"Show-1: Marrying Pixel and Latent Diffusion Models for Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15818","snapshot_observed_at":"2026-08-11T18:36:19.205295Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.205295Z"},"links":{"cited_paper":"/paper/2309.15818","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:3d077b61b27da576aa3cef979be0b544a97dc6cb10843844dfe3a0c15cf28ca6","observation_id":"d3d6bd96-61ad-4056-b08c-ef5b21ce7d0f","resolution":{"observed_at":"2026-08-11T18:36:19.205295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20674","last_updated":"2024-10-22T08:50:16Z","snapshot_observed_at":"2026-08-12T23:53:30.964876Z","submitted_at":"2024-05-31T08:18:39Z","title":"4Diffusion: Multi-view Video Diffusion Model for 4D Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20674","snapshot_observed_at":"2026-08-11T18:36:19.213306Z","title":"4diffusion: Multi-view video diffusion model for 4d generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.213306Z"},"links":{"cited_paper":"/paper/2405.20674","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:eef3192e92816b2a30b8f1962b56a8c220b7d2af0efc400db78094271dad97f4","observation_id":"20c210d8-bc09-490f-942d-b233c2bbf8e4","resolution":{"observed_at":"2026-08-11T18:36:19.213306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13077","last_updated":"2023-05-22T14:48:53Z","snapshot_observed_at":"2026-08-13T11:37:13.641309Z","submitted_at":"2023-05-22T14:48:53Z","title":"ControlVideo: Training-free Controllable Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13077","snapshot_observed_at":"2026-08-11T18:36:19.219233Z","title":"Controlvideo: Training-free controllable text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.219233Z"},"links":{"cited_paper":"/paper/2305.13077","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:acb5d617aadf6281fb7c269aaec26226a5b03646eb105e3db97ebf0277a2cc0e","observation_id":"238ecb3b-c198-4d62-9fd9-76c5dce06b63","resolution":{"observed_at":"2026-08-11T18:36:19.219233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09817","last_updated":"2018-05-24T17:58:02Z","snapshot_observed_at":"2026-07-06T06:41:05.545426Z","submitted_at":"2018-05-24T17:58:02Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09817","snapshot_observed_at":"2026-08-11T18:36:19.225792Z","title":"Stereo magnification: Learning view synthesis using multiplane images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.225792Z"},"links":{"cited_paper":"/paper/1805.09817","citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:fb504b419273ca031aeb05f54cd0f1e2ad46ba18e9674091469db7df092936c1","observation_id":"73641f9a-a87a-4ff4-96d6-940d4b5eb869","resolution":{"observed_at":"2026-08-11T18:36:19.225792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:19.232060Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.232060Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:3302e18f21cb408fa41ff99f45da7c87c30fa9631793e110751c241db8f98506","observation_id":"da27f7c2-df2f-4085-998e-a4f4b4a5ff32","resolution":{"observed_at":"2026-08-11T18:36:19.232060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:19.238396Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.238396Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:6a160e01658e3db05a1ebdca2b4a5357c1eb4c6f90ec6b995ffe9476bcba5afa","observation_id":"0027f15f-19b6-48f2-8dad-5228190d53a9","resolution":{"observed_at":"2026-08-11T18:36:19.238396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:36:19.244722Z","title":"Mono. Video","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-11T18:36:19.244722Z"},"links":{"citing_paper":"/paper/2412.07760"},"observation_digest":"sha256:c713e6e58389769615a2aa471e5d990e01d5bef6cac07cef2d4b5ceb5a00431c","observation_id":"c4a46330-866e-4f16-9d6e-a16ea4c0dc3f","resolution":{"observed_at":"2026-08-11T18:36:19.244722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.07760","last_updated":"2024-12-10T18:55:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T06:24:05.696135Z","submitted_at":"2024-12-10T18:55:17Z","title":"SynCamMaster: Synchronizing Multi-Camera Video Generation from Diverse Viewpoints"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 22 inbound Pith citation observations for arXiv:2412.07760."}