{"as_of":"2026-08-07T18:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2d68e33509a3f91a8d8afa8092d1548b8b650fef3888f4350eb72eab73b61e80","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T21:01:10.584591Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T11:10:41.415757Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T20:50:11.187124Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"cited_work":{"arxiv_id":"2511.17185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.17185","snapshot_observed_at":"2026-07-04T20:50:11.187124Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query- Shared Cross-Attention","venue":"cs.CV","work_id":"973efba6-3687-421f-aa3e-0986acf3283b","year":2025},"citing_paper":{"arxiv_id":"2604.07209","last_updated":"2026-04-13T13:03:18Z","snapshot_observed_at":"2026-07-06T22:55:28.855291Z","submitted_at":"2026-04-08T15:31:22Z","title":"INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T19:08:56.588282Z"},"links":{"cited_paper":"/paper/2511.17185","citing_paper":"/paper/2604.07209"},"observation_digest":"sha256:2cc3ec1afd9a4dc94ea5a89c7605888fadd1a54b4a01ff10101f61dd0b97d4e5","observation_id":"ce782ef3-8c84-47ca-a8ba-23fa1275fb8d","resolution":{"observed_at":"2026-06-01T02:02:22.028800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"cited_work":{"arxiv_id":"2511.17185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.17185","snapshot_observed_at":"2026-07-04T20:50:11.187124Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query- Shared Cross-Attention","venue":"cs.CV","work_id":"973efba6-3687-421f-aa3e-0986acf3283b","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-03T23:51:59.792532Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"cited_paper":"/paper/2511.17185","citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:82b6720bcde8e7ef2f20117e275ab14535ac19d0952850a25abe813f2568aa39","observation_id":"2c79a029-c315-43c2-8609-1506297fdf73","resolution":{"observed_at":"2026-07-04T20:50:11.188941Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.17185","snapshot_observed_at":"2026-07-31T11:10:41.415757Z","title":"arXiv preprint arXiv:2511.17185 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24591","last_updated":"2026-07-27T15:55:08Z","snapshot_observed_at":"2026-08-07T03:34:00.173954Z","submitted_at":"2026-07-27T15:55:08Z","title":"CameraAnything: Refilming Videos with Arbitrary Camera Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T11:10:41.415757Z"},"links":{"cited_paper":"/paper/2511.17185","citing_paper":"/paper/2607.24591"},"observation_digest":"sha256:8cd60a5436dc158cc680635a344ee16599c6acc354c0a26d04cd4c9fb7dd6d7c","observation_id":"bd29cd42-28bc-4ea6-890e-c408a4857451","resolution":{"observed_at":"2026-07-31T11:10:41.415757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2511.17185/citation-record","integrity":"/paper/2511.17185/integrity","json":"/paper/2511.17185/citation-record.json","paper":"/paper/2511.17185"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-03T21:01:06.386578Z","title":"Vd3d: Taming large video diffu- sion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.386578Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:d00d6e2f282ed127944269757e3410d2751df7177397499d4c5b65f8967f8d1a","observation_id":"0d49eacd-0a98-44e6-b278-b848fcf9b09a","resolution":{"observed_at":"2026-08-03T21:01:06.386578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:06.462941Z","title":"Ac3d: Analyzing and improving 3d camera control in video diffusion trans- formers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.462941Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:01c95f80a1f4f13db148a3c0b5a4cf61334995d26360339735dae1a64c283c3b","observation_id":"621f1a46-e75e-4917-b3f6-9c6e757d14cd","resolution":{"observed_at":"2026-08-03T21:01:06.462941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11647","last_updated":"2025-07-09T08:09:06Z","snapshot_observed_at":"2026-08-07T17:03:10.859634Z","submitted_at":"2025-03-14T17:59:31Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11647","snapshot_observed_at":"2026-08-03T21:01:06.620560Z","title":"Recammaster: Camera-controlled generative rendering from a single video.arXiv preprint arXiv:2503.11647, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.620560Z"},"links":{"cited_paper":"/paper/2503.11647","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:8c6f3c8c89c7f3ca9b1920cdcfcc24040a743891adda470bf5a6cbd814d45f5e","observation_id":"9d81a507-3e67-4237-8739-4c2882156a65","resolution":{"observed_at":"2026-08-03T21:01:06.620560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02690","last_updated":"2025-01-05T23:55:33Z","snapshot_observed_at":"2026-08-06T14:33:47.079999Z","submitted_at":"2025-01-05T23:55:33Z","title":"GS-DiT: Advancing Video Generation with Pseudo 4D Gaussian Fields through Efficient Dense 3D Point Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02690","snapshot_observed_at":"2026-08-03T21:01:06.699695Z","title":"Gs-dit: Advancing video generation with pseudo 4d gaussian fields through efficient dense 3d point tracking.arXiv preprint arXiv:2501.02690,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.699695Z"},"links":{"cited_paper":"/paper/2501.02690","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:7f72c6b7afe9d60f26d02b00205ab06565e9fd68e3865dda242ccc52183d7a3d","observation_id":"edb73e95-bf3e-4f48-a8f9-b3f92a0381e6","resolution":{"observed_at":"2026-08-03T21:01:06.699695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-03T21:01:06.754154Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.754154Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:d077dd30de9c539ea83c942a17021983db3cdc67e0cd04e15fb135be9e5ee976","observation_id":"843a13c5-ca58-4de9-b46c-3eb4446c2acd","resolution":{"observed_at":"2026-08-03T21:01:06.754154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:06.935417Z","title":"Video generation models as world simulators.OpenAI Blog, 1:8, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.935417Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:267ef7e04e6ea6b9ba5bb18a6c715ce4d6038d62d21c0341c133e608eb58689c","observation_id":"db7baa48-53bd-40f0-9b12-58f51ad2ffb1","resolution":{"observed_at":"2026-08-03T21:01:06.935417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:07.075598Z","title":"Mvgenmaster: Scaling multi-view generation from any image via 3d priors enhanced diffusion model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.075598Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:c622820eeaa0bc6317c1f0244f5a851989b8df89ae194836e9b3dd6265dd11c1","observation_id":"9fd068d2-6c06-48a2-bbb5-a99b4d5a7ed7","resolution":{"observed_at":"2026-08-03T21:01:07.075598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:07.187491Z","title":"Uni3c: Unifying precisely 3d-enhanced camera and hu- man motion controls for video generation.arXiv preprint arXiv:2504.14899, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.187491Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:0eec7035fa71146365fb1887f7380cd2f5d919e8bc2d0b9d627c14fe4c387d31","observation_id":"25678265-0723-4425-b316-d83bc8dfa672","resolution":{"observed_at":"2026-08-03T21:01:07.187491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06525","last_updated":"2025-02-28T06:40:38Z","snapshot_observed_at":"2026-07-06T19:48:05.525731Z","submitted_at":"2024-11-10T16:59:39Z","title":"I2VControl-Camera: Precise Video Camera Control with Adjustable Motion Strength","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06525","snapshot_observed_at":"2026-08-03T21:01:07.233855Z","title":"I2vcontrol-camera: Precise video camera control with adjustable motion strength.arXiv preprint arXiv:2411.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.233855Z"},"links":{"cited_paper":"/paper/2411.06525","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:0d37cdc238ff032ddec450bbd668aed05baf67ecc63760ccf6cce7390240fd0b","observation_id":"7e86137a-9738-4a43-ba2f-412521d90e91","resolution":{"observed_at":"2026-08-03T21:01:07.233855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03847","last_updated":"2025-01-09T04:25:42Z","snapshot_observed_at":"2026-07-06T20:17:43.203959Z","submitted_at":"2025-01-07T15:01:58Z","title":"Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03847","snapshot_observed_at":"2026-08-03T21:01:07.329732Z","title":"Diffusion as shader: 3d-aware video diffu- sion for versatile video generation control.arXiv preprint arXiv:2501.03847, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.329732Z"},"links":{"cited_paper":"/paper/2501.03847","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:dc6deef66734b28af756ef75c80c0d65ac45c3ede277368b6bd432192d414def","observation_id":"d2c47cc0-6550-45b4-9840-f52b4bc6f53a","resolution":{"observed_at":"2026-08-03T21:01:07.329732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-03T21:01:07.433226Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning.arXiv preprint arXiv:2307.04725, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.433226Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:5eddaec991183cb571786d9ee9d551550ef4b40434569a17aeed22051a88646f","observation_id":"17e0b4a3-dd67-47ba-9b80-bd3b33330a07","resolution":{"observed_at":"2026-08-03T21:01:07.433226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-03T21:01:07.589419Z","title":"Cameractrl: Enabling camera control for text-to-video generation.arXiv preprint arXiv:2404.02101, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.589419Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:895153eeaebb7b933adb17ea9ab336d06881bc5c9c208109c6ed8762d00402c3","observation_id":"6c26ed86-d911-4639-b3ba-81df5402e741","resolution":{"observed_at":"2026-08-03T21:01:07.589419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10592","last_updated":"2025-03-13T17:42:01Z","snapshot_observed_at":"2026-08-07T17:06:18.240718Z","submitted_at":"2025-03-13T17:42:01Z","title":"CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10592","snapshot_observed_at":"2026-08-03T21:01:07.753225Z","title":"Cameractrl ii: Dynamic scene exploration via camera-controlled video diffusion models.arXiv preprint arXiv:2503.10592, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.753225Z"},"links":{"cited_paper":"/paper/2503.10592","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:069fdb8b499e9e174ec9be94964b082234f6f2f32b44f49c15a273e33607da96","observation_id":"051809f8-19b3-4fd4-a146-1baaaa651660","resolution":{"observed_at":"2026-08-03T21:01:07.753225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:07.835628Z","title":"Video dif- fusion models.Advances in Neural Information Processing Systems, 35:8633–8646, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.835628Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:bdae6621d36bea935ad6df78b758acae7fec11eda15060d8c0088234d514d944","observation_id":"98d30fcf-5b72-4621-ae2b-6647f361bc69","resolution":{"observed_at":"2026-08-03T21:01:07.835628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10126","last_updated":"2025-02-25T00:32:29Z","snapshot_observed_at":"2026-08-06T19:44:31.746821Z","submitted_at":"2024-06-14T15:33:00Z","title":"Training-free Camera Control for Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10126","snapshot_observed_at":"2026-08-03T21:01:07.919357Z","title":"Training-free camera control for video generation.arXiv preprint arXiv:2406.10126, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.919357Z"},"links":{"cited_paper":"/paper/2406.10126","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:7f2f9c9f6759c5efe14c6c42258603387eaf459788fc3f832cd5b83a11fe267a","observation_id":"4e6efd46-f60e-4fa3-97b0-9c7ac7628524","resolution":{"observed_at":"2026-08-03T21:01:07.919357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15789","last_updated":"2024-05-01T02:37:18Z","snapshot_observed_at":"2026-07-06T18:04:54.726338Z","submitted_at":"2024-04-24T10:28:54Z","title":"MotionMaster: Training-free Camera Motion Transfer For Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15789","snapshot_observed_at":"2026-08-03T21:01:07.988861Z","title":"Mo- tionmaster: Training-free camera motion transfer for video generation.arXiv preprint arXiv:2404.15789, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.988861Z"},"links":{"cited_paper":"/paper/2404.15789","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:4797d447d440036df2e7aa99f04c63e87d1987f191ea466b282e00efa10c31cd","observation_id":"992fff34-18be-4e0b-8166-4e185bd29031","resolution":{"observed_at":"2026-08-03T21:01:07.988861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:08.051114Z","title":"Vbench: Comprehensive bench- mark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.051114Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:c2c63762284c33c4c5e851a1e1a7f19721fcc7433167902c2ac294df0af786e4","observation_id":"2d1bf0c7-2d09-4b10-88f6-63ee532c130c","resolution":{"observed_at":"2026-08-03T21:01:08.051114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-03T21:01:08.144786Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.144786Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:5b0aaeadcbb40c7997e5eae77df9bc0470f601ea5e8ba8d9159911403c50bb19","observation_id":"3ad9ba29-fd5d-4b66-9abd-9d67ea5f28ae","resolution":{"observed_at":"2026-08-03T21:01:08.144786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:08.207231Z","title":"Collab- orative video diffusion: Consistent multi-video generation with camera control.Advances in Neural Information Pro- cessing Systems, 37:16240–16271, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.207231Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:50c04bcd7da1d9edb9d1b9662d7efd3649a8a471f2fdcf863a6c79b8916f7df0","observation_id":"a32e1fed-9f42-407f-94bd-cf4334eaa280","resolution":{"observed_at":"2026-08-03T21:01:08.207231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10059","last_updated":"2025-07-13T08:12:15Z","snapshot_observed_at":"2026-08-05T12:07:57.099216Z","submitted_at":"2025-02-14T10:21:49Z","title":"RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10059","snapshot_observed_at":"2026-08-03T21:01:08.294175Z","title":"Realcam-i2v: Real-world image-to- video generation with interactive complex camera control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.294175Z"},"links":{"cited_paper":"/paper/2502.10059","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:9bb329755209ce1343ad5657ace9691d5e0122cfd8237a2ecc6dc9238906b2f7","observation_id":"2802c1a3-9967-4d99-b519-26a9dde2b0aa","resolution":{"observed_at":"2026-08-03T21:01:08.294175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:08.356000Z","title":"Wonderland: Navi- gating 3d scenes from a single image","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.356000Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:8cce4f92129eed30a40e215b2ae205b8ddfc49a6ce0c3690cbf6ac71ee44fc17","observation_id":"0aa06f3d-3ca2-4e32-a87d-db54aadd27c8","resolution":{"observed_at":"2026-08-03T21:01:08.356000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05338","last_updated":"2024-10-22T04:22:16Z","snapshot_observed_at":"2026-07-06T18:27:28.886692Z","submitted_at":"2024-06-08T03:44:25Z","title":"MotionClone: Training-Free Motion Cloning for Controllable Video Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05338","snapshot_observed_at":"2026-08-03T21:01:08.419049Z","title":"Motionclone: Training-free motion cloning for controllable video generation.arXiv preprint arXiv:2406.05338, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.419049Z"},"links":{"cited_paper":"/paper/2406.05338","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:2e4a185acfd625115e5061c82379a91270d1b31da19b69db31abccb1f4a76785","observation_id":"846ecf1e-54c1-4a29-bb1e-d3675b4cbcad","resolution":{"observed_at":"2026-08-03T21:01:08.419049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-03T21:01:08.605544Z","title":"Flow matching for generative mod- eling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.605544Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:10b98146fbf80f22956465de07486f58d58d26e04a45bd7ea2c9ee178ed823c1","observation_id":"6f0ca84e-bbe5-40cb-95ce-7a9b84028b22","resolution":{"observed_at":"2026-08-03T21:01:08.605544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05638","last_updated":"2025-03-07T17:57:53Z","snapshot_observed_at":"2026-08-07T17:21:30.561865Z","submitted_at":"2025-03-07T17:57:53Z","title":"TrajectoryCrafter: Redirecting Camera Trajectory for Monocular Videos via Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05638","snapshot_observed_at":"2026-08-03T21:01:08.733360Z","title":"Tra- jectorycrafter: Redirecting camera trajectory for monoc- ular videos via diffusion models.arXiv preprint arXiv:2503.05638, 2, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.733360Z"},"links":{"cited_paper":"/paper/2503.05638","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:30000375fecc57d4324b33feccd14f54e494fdcfa2f01c4431d39c07fc85b7ec","observation_id":"aeaf5e6f-4d8f-4ccb-8591-5bed754021d5","resolution":{"observed_at":"2026-08-03T21:01:08.733360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:08.901669Z","title":"Multidiff: Consistent novel view synthesis from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.901669Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:a13a9b66467c71551e8405294464f3aae37f010bd65c35818ce0fde0345f009a","observation_id":"396dcf10-02d1-4c6f-b97c-2f75a8a1ec86","resolution":{"observed_at":"2026-08-03T21:01:08.901669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02371","last_updated":"2025-02-13T10:13:24Z","snapshot_observed_at":"2026-08-07T10:03:56.902190Z","submitted_at":"2024-07-02T15:40:29Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02371","snapshot_observed_at":"2026-08-03T21:01:09.013472Z","title":"Openvid-1m: A large-scale high-quality dataset for text-to- video generation.arXiv preprint arXiv:2407.02371, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.013472Z"},"links":{"cited_paper":"/paper/2407.02371","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:542443060acd0b953bd29849fcdbaf1125f7171fe3eb3bef7ce4377fbcbffb3d","observation_id":"f631fa7f-8fb8-4080-950f-8c5c500c78e1","resolution":{"observed_at":"2026-08-03T21:01:09.013472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:09.143480Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.143480Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:7104cc9e472e65ceacbd6bfa44a95b2533809386bda90a5003235293f7bc46b0","observation_id":"ff9f9768-a8b3-4a90-8549-7b390c6de69e","resolution":{"observed_at":"2026-08-03T21:01:09.143480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06006","last_updated":"2025-01-31T17:26:57Z","snapshot_observed_at":"2026-08-03T22:29:57.453501Z","submitted_at":"2025-01-10T14:37:32Z","title":"CamCtrl3D: Single-Image Scene Exploration with Precise 3D Camera Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06006","snapshot_observed_at":"2026-08-03T21:01:09.243860Z","title":"Camctrl3d: Single-image scene exploration with precise 3d camera con- trol.arXiv preprint arXiv:2501.06006, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.243860Z"},"links":{"cited_paper":"/paper/2501.06006","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:80317a0e681ec75f3b4dedec9cbb2a1390ee0918ec219624de3ce22ddfe6a92a","observation_id":"fceedd1c-4928-42cf-a0ef-0a45cb5ee4f2","resolution":{"observed_at":"2026-08-03T21:01:09.243860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:09.372364Z","title":"Gen3c: 3d-informed world-consistent video generation with precise camera con- trol","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.372364Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:691d8399e9a8e220aa675bd09640fc4c302980d5a26d0d6dfcd1df1583059b36","observation_id":"fea8352e-c1e1-401e-a8b2-1d0e50c5db5f","resolution":{"observed_at":"2026-08-03T21:01:09.372364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-03T21:01:09.487841Z","title":"Make-a-video: Text-to-video generation without text-video data.arXiv preprint arXiv:2209.14792,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.487841Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:2c0180f2f57647370381e431fe572918e7ff6d4fdf1b53e6be9fb7d523510967","observation_id":"a4e9d4f9-aef0-45b8-9b75-2c1916c29de0","resolution":{"observed_at":"2026-08-03T21:01:09.487841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:09.577266Z","title":"Generative camera dolly: Ex- treme monocular dynamic novel view synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.577266Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:838f9a541afd532a3c4b807d30afe191a5b5b0ec53826f3c35d1b406d8f16187","observation_id":"f8a5d067-e720-4e45-a870-69b984201bb3","resolution":{"observed_at":"2026-08-03T21:01:09.577266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-03T21:01:09.648117Z","title":"Wan: Open and advanced large-scale video gen- erative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.648117Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:29f1dab977792916382c4dbd72ba2b71720e56635cfe9145ad371601b991df69","observation_id":"7d9c1d0d-62c9-408e-b6fc-44ee1bb0e922","resolution":{"observed_at":"2026-08-03T21:01:09.648117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01429","last_updated":"2024-12-02T12:10:00Z","snapshot_observed_at":"2026-07-06T20:00:09.775334Z","submitted_at":"2024-12-02T12:10:00Z","title":"CPA: Camera-pose-awareness Diffusion Transformer for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01429","snapshot_observed_at":"2026-08-03T21:01:09.717580Z","title":"Cpa: Camera-pose-awareness dif- fusion transformer for video generation.arXiv preprint arXiv:2412.01429, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.717580Z"},"links":{"cited_paper":"/paper/2412.01429","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:f972b326ba6dc1348d0b2ed6e0d8cba71d987a5f3f5996d7234bf8d0c3aeb6ba","observation_id":"2da49068-e7c5-4b66-9210-16ef64f8daaa","resolution":{"observed_at":"2026-08-03T21:01:09.717580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:09.741441Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.741441Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:65d5e13f7b2681fc191fc488e4e98090a69bbcb07f86323d865d0aeb13096d5c","observation_id":"205f8e16-3531-4cd4-9444-650173522c23","resolution":{"observed_at":"2026-08-03T21:01:09.741441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19324","last_updated":"2024-11-28T18:59:51Z","snapshot_observed_at":"2026-08-06T00:28:11.369638Z","submitted_at":"2024-11-28T18:59:51Z","title":"Trajectory Attention for Fine-grained Video Motion Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19324","snapshot_observed_at":"2026-08-03T21:01:09.794702Z","title":"Trajectory atten- tion for fine-grained video motion control.arXiv preprint arXiv:2411.19324, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.794702Z"},"links":{"cited_paper":"/paper/2411.19324","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:efecf2cd2fc13c20e909f6b528502ec54bf349804cade8ebf186cca3a62388da","observation_id":"30220acf-b2e4-41ee-9652-b51bf3ffafb1","resolution":{"observed_at":"2026-08-03T21:01:09.794702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14864","last_updated":"2024-11-12T01:31:41Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:40Z","title":"Video Diffusion Models are Training-free Motion Interpreter and Controller","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14864","snapshot_observed_at":"2026-08-03T21:01:09.889425Z","title":"Video diffusion models are training-free motion interpreter and controller.arXiv preprint arXiv:2405.14864, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.889425Z"},"links":{"cited_paper":"/paper/2405.14864","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:db2a6aabdf3d883127d0cf20c36534279e87436c76a9996116ab103ce7f7cb0d","observation_id":"fc95a1df-a73f-4ac5-a2ae-39837a7c294e","resolution":{"observed_at":"2026-08-03T21:01:09.889425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-04T13:02:12.217544Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-08-03T21:01:09.977882Z","title":"Camco: Camera- controllable 3d-consistent image-to-video generation.arXiv preprint arXiv:2406.02509, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.977882Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:8e125b3b90b05612b94541f8486e7f238a02b7329c60bc1674e961175c046c6a","observation_id":"dd862312-5517-4a85-aa4a-e184f1756f01","resolution":{"observed_at":"2026-08-03T21:01:09.977882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-03T21:01:10.079490Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.079490Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:fe0857ccb5005f8c4fb840fbe3de6aabc3821424c8e61e1bd22b5abb8ae4519f","observation_id":"26596c49-7314-4b4e-b301-058d805b9c70","resolution":{"observed_at":"2026-08-03T21:01:10.079490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08004","last_updated":"2025-06-09T17:59:47Z","snapshot_observed_at":"2026-08-07T05:18:07.470205Z","submitted_at":"2025-06-09T17:59:47Z","title":"Dynamic View Synthesis as an Inverse Problem","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08004","snapshot_observed_at":"2026-08-03T21:01:10.207947Z","title":"Dynamic view synthe- sis as an inverse problem.arXiv preprint arXiv:2506.08004,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.207947Z"},"links":{"cited_paper":"/paper/2506.08004","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:040e4c9248bb39e6608fab7d14fb01bb77b0983a83a019e44d08ec010e9619bd","observation_id":"eff63027-832f-457c-83f6-b629ca8429b8","resolution":{"observed_at":"2026-08-03T21:01:10.207947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-08-03T21:01:10.278230Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis.arXiv preprint arXiv:2409.02048, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.278230Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:da630346ad55f0b9251a4aa4979dd5effa0f0ad3620515a677637fce08406ea7","observation_id":"8a2ec8ad-8755-4884-9e61-294463fe4d0b","resolution":{"observed_at":"2026-08-03T21:01:10.278230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05763","last_updated":"2025-04-13T06:21:42Z","snapshot_observed_at":"2026-08-01T20:32:13.074216Z","submitted_at":"2025-01-10T07:41:47Z","title":"StarGen: A Spatiotemporal Autoregression Framework with Video Diffusion Model for Scalable and Controllable Scene Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05763","snapshot_observed_at":"2026-08-03T21:01:10.379545Z","title":"Stargen: A spatiotemporal autoregression framework with video diffusion model for scalable and con- trollable scene generation.arXiv preprint arXiv:2501.05763,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.379545Z"},"links":{"cited_paper":"/paper/2501.05763","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:688da237662a3cedd1e12b66cf6243cff02f6e35b82fecbb99f78700f88b82e6","observation_id":"fcaa4e04-7e6c-4d8b-a209-44a86231c455","resolution":{"observed_at":"2026-08-03T21:01:10.379545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:10.442021Z","title":"Recapture: Gener- ative video camera controls for user-provided videos using masked video fine-tuning","venue":null,"work_id":null,"year":2050},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.442021Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:b7d7351a1ae90129082a5aa2f738746f64729bd8e9ab59b2541e9d32b3c53612","observation_id":"263459ec-b2a8-4b0c-aecc-e6222d9ef529","resolution":{"observed_at":"2026-08-03T21:01:10.442021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-07-06T19:37:03.013065Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-03T21:01:10.508086Z","title":"Cami2v: Camera-controlled image-to-video dif- fusion model.arXiv preprint arXiv:2410.15957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.508086Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:5f45628481ee2a815d09f29cbb5dba7d6873c92f2c8e2d6a4211a2574a7b4348","observation_id":"5f398621-9666-4553-a647-192282fa0374","resolution":{"observed_at":"2026-08-03T21:01:10.508086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-03T21:01:10.584591Z","title":"Open-sora: Democratizing efficient video production for all.arXiv preprint arXiv:2412.20404, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.584591Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:28eee96f203aa06841bea104566226aa9e424e9de6fff25d26626386b965e46f","observation_id":"cf00d3ec-6dbc-4270-b5b4-e957cffc9df7","resolution":{"observed_at":"2026-08-03T21:01:10.584591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 3 inbound Pith citation observations for arXiv:2511.17185."}