{"as_of":"2026-08-13T07:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2a6c618862c3bbbcf5a1aab4941db0f22f985b08e7f64eb05f85bb037f014251","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T21:56:38.133405Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T07:21:39.698103Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T13:58:21.912282Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"cited_work":{"arxiv_id":"2605.12119","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.12119","snapshot_observed_at":"2026-07-03T13:58:21.912282Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","venue":"cs.CV","work_id":"94284f7d-4036-473a-8af0-550cccd40151","year":2026},"citing_paper":{"arxiv_id":"2606.13376","last_updated":"2026-06-17T16:38:12Z","snapshot_observed_at":"2026-08-11T17:54:56.574878Z","submitted_at":"2026-06-11T14:01:02Z","title":"MoVerse: Real-Time Video World Modeling with Panoramic Gaussian Scaffold","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T07:21:39.698103Z"},"links":{"cited_paper":"/paper/2605.12119","citing_paper":"/paper/2606.13376"},"observation_digest":"sha256:2a6897c2f39133b47ad3f297f2eb17e0ffa7e68243c7b998861f4043b4de2e67","observation_id":"aba8daf3-a091-458c-a64a-656f7249ec36","resolution":{"observed_at":"2026-07-03T13:58:21.913443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.12119/citation-record","integrity":"/paper/2605.12119/integrity","json":"/paper/2605.12119/citation-record.json","paper":"/paper/2605.12119"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-12T23:20:07.594666Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:05722a00fffc3b7ad40c12dc193b398c2702a089e3233e5e807e3b1c023be810","observation_id":"df99b25d-d054-47d7-8b70-1a43f8a7af6e","resolution":{"observed_at":"2026-05-14T21:58:03.151805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11647","last_updated":"2025-07-09T08:09:06Z","snapshot_observed_at":"2026-08-07T17:03:10.859634Z","submitted_at":"2025-03-14T17:59:31Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video","version":2},"cited_work":{"arxiv_id":"2503.11647","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11647","snapshot_observed_at":"2026-07-04T16:29:56.626897Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video, March 2025","venue":null,"work_id":"468e39a2-8f08-49d5-b3a6-92df4205b5f3","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2503.11647","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:9aedd3cd61b9766417d90c64342dd7b2e24b8ed105218667e77608d0b8388346","observation_id":"aeacf4e5-6aae-40b2-8fa8-64c280984f67","resolution":{"observed_at":"2026-05-14T21:58:03.157994Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:cada9a140a61b45286a5f2412fbb9b9a8aab77847772a2a56d2079dbf42774f3","observation_id":"7c6ac09b-5c13-4f72-b082-53d4af1b3ce9","resolution":{"observed_at":"2026-05-14T21:58:03.163771Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Pro- ceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recogni- tion","venue":null,"work_id":"e97a4b73-600a-4a37-81c6-c03024cc6e7b","year":2023},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:8d0a31ad076f49e2bcb5271450142a6ba1129db5341e6c2d50d98c15cd138803","observation_id":"e8c2e6cb-9a9f-4f2c-b7c9-d5ee6e04c679","resolution":{"observed_at":"2026-05-14T21:59:32.015545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Advances in Neural Information Processing Systems (NeurIPS) (2025)","venue":null,"work_id":"d59ac9a5-a9f7-46bd-ab23-ba29118acff5","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:f39827989bab289189d63d35ab54700d0aa361844b6021d697b014e11d8d0d01","observation_id":"f12446a1-095c-4aa4-b6b9-d43651f731dd","resolution":{"observed_at":"2026-05-14T21:59:32.000546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Transactions on Visualization and Computer Graphics (2025)","venue":null,"work_id":"a3816281-c81d-4d9d-aa77-91099147c798","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:66e164296d61d973cad655c2986a75e615e6cbb3693844fbec0cf8db64879368","observation_id":"3b233793-7aff-4f13-8424-c08171919f04","resolution":{"observed_at":"2026-05-14T21:59:32.004400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ACM SIGGRAPH 2024 Conference Papers","venue":null,"work_id":"da4024f6-b820-431c-b3d3-16e747dd2e82","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:5299a16b58cfc5ac6cd8d6539ee5a2fc08722ae02b7299c7b370bf41de395a7c","observation_id":"f0761572-85f4-4eba-bbb5-a31ce34e433d","resolution":{"observed_at":"2026-05-14T21:59:32.011413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":"f94032e8-4db9-44cd-88ec-afe017545660","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:39bc2b9896cf854acbccdd999495c2bcafdf7e7429377c89175c8b05b9d6e53e","observation_id":"f068370d-243b-430c-91d3-2dd6cfa2ed87","resolution":{"observed_at":"2026-05-14T23:08:16.201334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:46:18.469157Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"9fe3039b-9a12-4eb3-8443-e5ee2878423d","year":2023},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:d974095c9392b2ae82d0d6d61db48dd77ce5866ed570afd069e0954698e6633f","observation_id":"44c43334-0961-494a-ae93-2b9aa5f7ad4a","resolution":{"observed_at":"2026-05-14T23:08:16.224643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"a1ba0111-b57b-4fa6-ae6a-760851d55298","year":2021},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:b01ad6b32ba66a4024c81426426dc4b12e75c3f3b6916a22bd1505cfb79d83cf","observation_id":"f30bf08a-8be2-49f3-ba3c-0d30f2fbbb7b","resolution":{"observed_at":"2026-05-14T21:59:32.086026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: NeurIPS (2022)","venue":null,"work_id":"72233999-c25b-4183-86dd-22779f79771b","year":2022},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:feee184b7481ff574f24878a7911ab1a13a1df9f5a14c582360edf608d84bcb5","observation_id":"40f4b03e-c046-4f44-90dd-1dc417e71b84","resolution":{"observed_at":"2026-05-14T21:59:31.982484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"32ceef19-1a9b-4458-b8b0-9bbd4e1a911d","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:6d76ff3950c31935b1c017218aff8b8ba46973d2aa26b04d149f5a4b09d2bb9d","observation_id":"a3a3bfa3-1a94-4864-b58c-f007aed2e075","resolution":{"observed_at":"2026-05-14T21:59:31.961661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-12T01:27:32.593496Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2404.02101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-07-10T01:46:41.167891Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","venue":"cs.CV","work_id":"1c05c278-c023-4ef0-a359-25a41f1065eb","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:147e049adcf30943ec464873c01f6fc900640f27cd0861628f65a39800095572","observation_id":"b929e742-9cea-4698-a9ce-918b8dff6b52","resolution":{"observed_at":"2026-05-14T21:58:03.247174Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-07-06T22:13:09.586800Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":"2508.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-04T13:29:51.199853Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","venue":"cs.CV","work_id":"2d60e542-3c1c-4656-becc-ded522856631","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:8442ba2827ce129ece1922863535f860b3f4ab9bde1ececfd4bc9a36eafaffb6","observation_id":"5cf90b1b-1953-4d4d-9852-c4afb696a49d","resolution":{"observed_at":"2026-05-16T16:41:08.910540Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2024) 16 Liu et al","venue":null,"work_id":"8c8d77c2-b3c8-4157-aa8c-066f23f2e2d7","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:b35cc7845cbaa8ff5aee5b570f171e010c39183d8da1186111eb345221609613","observation_id":"07eac234-b289-41ef-aa54-13d0ccabdb90","resolution":{"observed_at":"2026-05-14T21:59:31.965820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09151","last_updated":"2025-09-10T16:59:24Z","snapshot_observed_at":"2026-08-07T17:10:47.695342Z","submitted_at":"2025-03-12T08:26:15Z","title":"Reangle-A-Video: 4D Video Generation as Video-to-Video Translation","version":3},"cited_work":{"arxiv_id":"2503.09151","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.09151","snapshot_observed_at":"2026-07-03T18:08:45.633034Z","title":"arXiv preprint arXiv:2503.09151 (2025)","venue":null,"work_id":"61ff784b-6589-4796-bb80-a97b0c05bce1","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2503.09151","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:2d6febde696c370bcbd8af2b01510acde4170acc5c83e905c4ffa38bfa1f564e","observation_id":"cbdc8726-4e2d-41c4-9700-fdc69e684951","resolution":{"observed_at":"2026-05-14T21:58:03.211040Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:02:45.845059Z","title":"ACM Trans","venue":null,"work_id":"18adf1b6-eb50-461d-88e5-8f6081c5266f","year":2023},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:76fdc704b8bf3ce053e9d9472b7fa3bba78d41fdd4ec3ddb3259a7b1f2af7789","observation_id":"dfcaa6df-b9c7-4039-b1d0-21dd797bdfb8","resolution":{"observed_at":"2026-05-14T21:59:31.953956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:b0ec4875971076a11b3225d63e079e2ff7987eb6ba407731680dbb2007b4ee2d","observation_id":"5f8e4b98-a704-4cce-9a71-c49ead9964a4","resolution":{"observed_at":"2026-05-14T21:58:03.204714Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.21119","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2509.21119 (2025)","venue":null,"work_id":"b737e296-fe01-4244-bbcd-ec383abeb5fb","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:b626ed5c3a7ac6ffd2a4154aa1c42b2043809ab5c80caf6c6b6fd0f538b55814","observation_id":"9ade12c0-452e-42d8-904f-90cf6ee623aa","resolution":{"observed_at":"2026-05-14T21:58:03.241225Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"43ab8e07-6d93-43ec-b106-10c18d233394","year":2022},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:69b185c07928397423049ea6d089fe60150e7b19a13921719c479b6525eb2928","observation_id":"0f54167a-736e-48f3-9a8d-72b0cb476291","resolution":{"observed_at":"2026-05-14T21:59:32.074855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:56:18.693980Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"42283a10-7059-408f-b9c2-816746d44ef5","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:e7855f9abe9fa4d8c821e1cc3160ee717eb564e366588f578bf4e1b8c85c379e","observation_id":"1587a8a8-41fc-42b7-886b-692ac35af469","resolution":{"observed_at":"2026-05-14T21:59:32.082404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:12:55.739274Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"bdd9388a-1d60-473c-8b72-238a0e9f3418","year":2021},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:a2ec66653c4ee90113179ba9f359e4a57f9337f14e60cafd174e34bd4b5a6240","observation_id":"f2c4fbc1-051c-4d48-b898-111441341460","resolution":{"observed_at":"2026-05-14T21:59:32.044289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:46:18.524759Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"f7a7c21c-f843-475c-8afb-7f32629cc287","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:c3d54e9d328066fa8124e192d1aafc89882d9dcdddfa7118a47bc435a2682ee3","observation_id":"8c100142-b08d-4ffc-b6be-94b7cfd7bd23","resolution":{"observed_at":"2026-05-14T21:59:32.047787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: The Thirteenth International Conference on Learning Representations (2025),https://openreview.net/forum?id=2prShxdLkX","venue":null,"work_id":"e16d3168-a5cb-4a86-a88b-e5f9daf3f5cc","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:b17beb7bad2ecce2ab4c5ea2c418ba292cb51443734c1caecc189f7a44b8788f","observation_id":"fba6329d-db7b-4f94-838b-4638109094a4","resolution":{"observed_at":"2026-05-14T21:59:32.050998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems (2025)","venue":null,"work_id":"4459abde-df9f-4990-8d39-f9c8315cd9a9","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:fb5ac2ca4215852b5f96d4fb0dfb3a23807e4b32cfb96980fec9c0361edb6d91","observation_id":"954d8e50-313f-4f88-88ed-ab0cb5163d4a","resolution":{"observed_at":"2026-05-14T21:59:32.062115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Eu- ropean Conference on Computer Vision","venue":null,"work_id":"0fa7c23f-f30f-40fd-a909-1663ccdb2517","year":2020},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:3b824ad9c0d3cb04f31b94820b1bb2e4bdc51d0b6d9f1e4c9c8529769269d069","observation_id":"be55caea-b5ae-4c16-8633-e6ae0a1d0c0f","resolution":{"observed_at":"2026-05-14T21:59:32.078659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the AAAI conference on artificial intelligence","venue":null,"work_id":"1abdedfe-d9f8-44b2-8edd-ceefa7542431","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:186c3f7994db69dc567d2d9987d13885f34f56e418380ed5876abf9fdaee979d","observation_id":"b08361a4-cef7-445b-8764-a29b3015b8c9","resolution":{"observed_at":"2026-05-14T21:59:32.029970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02371","last_updated":"2025-02-13T10:13:24Z","snapshot_observed_at":"2026-08-07T10:03:56.902190Z","submitted_at":"2024-07-02T15:40:29Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","version":3},"cited_work":{"arxiv_id":"2407.02371","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.02371","snapshot_observed_at":"2026-07-05T16:41:18.954519Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","venue":"cs.CV","work_id":"00dd95a8-d503-4a41-9603-785dcf4a0b8e","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2407.02371","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:77cdbced50426d5f59b51e303abce8ad8b1e5f23934e9f095f4b78dfffbb2589","observation_id":"e60f8823-ab23-45a7-b210-1c990493fe35","resolution":{"observed_at":"2026-05-14T21:58:03.216697Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 ieee","venue":null,"work_id":"a6d3284c-97f6-44e3-a6e2-d8d8e1077dfd","year":2021},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:139bc839edcbfe756c78ee9b04a482afeaf7fbbb7e1841fcc90d63f47d0e6709","observation_id":"9da330ab-f5c5-42ea-a1d7-1f14719cb572","resolution":{"observed_at":"2026-05-14T21:59:32.070998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"d6cd73b4-fbc6-41ea-a78b-444ac641ecd3","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:3bcfdfa805c41cf4e09e8de139af0fe79703b8eb21153792c40ae0dca7c52f49","observation_id":"9c21f887-fd11-4c0a-907a-74e178474b4f","resolution":{"observed_at":"2026-05-14T21:59:32.057922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: 2025 International Conference on 3D Vision (3DV)","venue":null,"work_id":"d619d9b9-65dc-4b8e-a88f-d2a1b8a05453","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:3d848198a6557136630f15bb14d921ef592ebe1031f067f34acde20fd3a4f0c6","observation_id":"b27120a8-5696-48c9-bcb0-80969223ecc5","resolution":{"observed_at":"2026-05-14T21:59:32.026921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Confer- ence on Computer Vision (ICCV)","venue":null,"work_id":"5a99ab0b-e2ef-4467-8e6f-2f448624bccf","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:2b64b82bf1b297a7c9469546b29dbd66849029c0fa4e145f0db9bce93ed14e20","observation_id":"4e0ab8bc-386c-47c5-bf74-144c28604c91","resolution":{"observed_at":"2026-05-14T21:59:32.033218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:03:48.810028Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"1e591237-07d0-4e87-83b5-95bda20c4011","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:8f05e697ff2c92e7916a7fe042a44432166f604f1d91254e044c47aa5a519a4a","observation_id":"d4b39e83-b28a-4eee-a909-395ab051b6ad","resolution":{"observed_at":"2026-05-14T21:59:32.036729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:b0f4345de91dd951530bf5b6203ba33f62e264934edb37dec014b13c634d75d5","observation_id":"b478735f-c106-410e-9103-fc1dadd7519f","resolution":{"observed_at":"2026-05-14T21:58:03.198329Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"b4ce5e04-6345-4b54-a983-750f58b0cd78","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:05c9749da57612c73a14adabf96c8d35b1facbef831784c3f58373516e4af97b","observation_id":"d822fb42-cf2c-4c1e-a39d-6008e8bbc46a","resolution":{"observed_at":"2026-05-14T21:59:32.023720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"978d4578-90ea-462e-9ce1-cea65fd51275","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:d24ca83ea997766d9c0f94bdd6a7ccbeb66dd72304256d1e1fdf3b2c24d3b026","observation_id":"df0394f5-02a2-4370-99f1-d925f826a722","resolution":{"observed_at":"2026-05-14T21:59:32.040613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"43ff65ec-ee10-4c6e-9169-88ce32c64263","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:ff3d775de4502cd7ff40f353cce5bef48ef778e02cab5d01703aae224a3887ca","observation_id":"b181bcb0-2098-436d-9bf6-33afeabdb065","resolution":{"observed_at":"2026-05-14T21:59:32.066891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceed- ings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"0c9aa49d-4400-4bc3-8fb4-ff599a0496be","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:c6df3c8a45570cbca6f065cef1413cf20b3a46737ae456a71738e8939e9cb389","observation_id":"4b3b9f71-6926-4c22-ac2a-09eb93aa4d14","resolution":{"observed_at":"2026-05-14T21:59:32.054213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10642","last_updated":"2024-02-22T15:08:49Z","snapshot_observed_at":"2026-08-13T05:48:11.830894Z","submitted_at":"2023-10-16T17:57:43Z","title":"Real-time Photorealistic Dynamic Scene Representation and Rendering with 4D Gaussian Splatting","version":3},"cited_work":{"arxiv_id":"2310.10642","doi":"10.48550/arxiv.2310.10642","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.10642","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Real-time Photorealistic Dynamic Scene Representation and Rendering with 4D Gaussian Splatting, February 2024","venue":"arXiv (Cornell University)","work_id":"bdd707be-c2be-4c01-989f-4f76f91c6c6a","year":2023},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2310.10642","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:30b501472f9caccc84dd1d08984856e8de09fbb9ce5dadf718d422e696b6d515","observation_id":"71505de2-f62b-437f-91e3-7b239aa5ab86","resolution":{"observed_at":"2026-05-14T21:58:03.181287Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:f982831b4ef993a88c6018e9a18a49ab9254064dbe6a0e49491d3e7db85a2cae","observation_id":"c488e79c-5c18-4ed7-8c17-e22ab84c0ebe","resolution":{"observed_at":"2026-05-14T21:58:03.192741Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"1d18e064-48e5-491c-bb3f-21cdc808b446","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:59233ba765bc1588c0fcb62a819ec7a907479eb24066933cb2c7023985164ab9","observation_id":"59a4398a-f6ed-49fd-860d-0291bc5144fb","resolution":{"observed_at":"2026-05-14T21:59:32.089439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":"2308.06721","doi":"10.48550/arxiv.2308.06721","metadata_source":"pith","pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"98e51b10-54bd-4251-8a2d-f79bd6215c19","year":2023},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:2dcba4d0de34b79f654a126d78c9f8672ba0c9f81ef7a448f2c6699354b2b3ac","observation_id":"4f82e46e-7907-4517-a98e-b8736dda4542","resolution":{"observed_at":"2026-05-14T21:58:03.186821Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15364","last_updated":"2025-04-02T06:16:43Z","snapshot_observed_at":"2026-08-12T23:59:00.767398Z","submitted_at":"2024-05-24T08:56:19Z","title":"NVS-Solver: Video Diffusion Model as Zero-Shot Novel View Synthesizer","version":2},"cited_work":{"arxiv_id":"2405.15364","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.15364","snapshot_observed_at":"2026-07-05T16:51:14.156794Z","title":"Nvs-solver: Video diffusion model as zero-shot novel view synthesizer","venue":"cs.CV","work_id":"61c9589e-effb-46a1-a923-ad26bf478a07","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2405.15364","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:79061573b34a06a4a25410049077677650f52ba6ea3cb71f5430032cba7ab893","observation_id":"17aa814a-9f2d-4d1f-b97f-cf41658b59d6","resolution":{"observed_at":"2026-05-14T21:58:03.175607Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05638","last_updated":"2025-03-07T17:57:53Z","snapshot_observed_at":"2026-08-08T08:14:53.742154Z","submitted_at":"2025-03-07T17:57:53Z","title":"TrajectoryCrafter: Redirecting Camera Trajectory for Monocular Videos via Diffusion Models","version":1},"cited_work":{"arxiv_id":"2503.05638","doi":"10.48550/arxiv.2503.05638","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.05638","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trajectorycrafter: Redirecting camera trajectory for monocular videos via diffusion models","venue":"arXiv (Cornell University)","work_id":"a82fed40-e96b-4d33-834b-f0ab36c82d56","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2503.05638","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:595a475ec8dfa5a3473d92c4d6a352775d3cf3ad65dbd1557b31d679de1d0ce8","observation_id":"ac622052-0e22-4a5b-a8fc-8d2b3b1ea97b","resolution":{"observed_at":"2026-05-14T21:58:03.223449Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2025)","venue":null,"work_id":"39298893-1bd7-4ea4-ae52-1df6afefff97","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:d2223c9afa3e083601cd15664d26dc12560b697dbae550cf1037db3ceda1b409","observation_id":"5d356f1e-5298-45c1-9576-dcde0f0757be","resolution":{"observed_at":"2026-05-14T21:59:32.019602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"b547a2b4-53be-45b1-8d45-698e037471fb","year":2050},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:9a5a3fc74258ff0890f0cabd6affaef883d2f307f3319038f7f82f1a37d06284","observation_id":"3d61d72b-8648-4e50-8b48-80f94e7c2e87","resolution":{"observed_at":"2026-05-14T21:59:32.007938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Transactions on Visualization and Computer Graphics30(12), 7749–7762 (2024)","venue":null,"work_id":"7e1c3a38-5293-4035-838a-c374bc685c72","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:60dd6dd9750a10b8262d8176ee2d9a166d41f7b0dc148ff6115ce4458d7cf6fb","observation_id":"3aeac92f-381c-4c2e-9af9-d010ee371eae","resolution":{"observed_at":"2026-05-14T21:59:31.991290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T16:51:14.380548Z","title":null,"venue":null,"work_id":"2858417e-b0db-476e-a212-0a161c58f668","year":2023},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:3dca5de5fa1e1dd07d1d46d760ca8b8f255d3a856e30f869624c3b1e718df496","observation_id":"ee318cc9-03f6-41a4-ba04-6d939ab1a4b8","resolution":{"observed_at":"2026-05-14T21:59:31.987216Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"61f405d6-af1d-41ee-957d-312f454ad13e","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:2ff745d5c2499d0eb5f7ff7846a1289f3790e6c5a9774fc07778876de3eb3213","observation_id":"fdb8ab92-1218-4035-b156-6760b4ec446b","resolution":{"observed_at":"2026-05-14T21:59:31.995822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":"6ecc62a9-d81f-4015-8887-f8980d164f01","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:a0409b528bf5b41375da24cba7ec6b1e9ff99cd7d34d455e1ed0c021a55bb531","observation_id":"be875205-ce4e-4740-b113-c149cceaccb6","resolution":{"observed_at":"2026-05-14T21:59:31.983453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08166","last_updated":"2025-03-11T08:29:41Z","snapshot_observed_at":"2026-08-07T17:13:56.933699Z","submitted_at":"2025-03-11T08:29:41Z","title":"Dynamic Scene Reconstruction: Recent Advance in Real-time Rendering and Streaming","version":1},"cited_work":{"arxiv_id":"2503.08166","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08166","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamic Scene Reconstruc- tion: Recent Advance in Real-time Rendering and Stream- ing","venue":null,"work_id":"6a576c8d-0b41-499b-a8a3-69df4789e845","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2503.08166","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:e0582abf8453413b0f6811e9293720602d6967161c32c49edc04f7c70a5fce34","observation_id":"2dc8b781-55df-4f9e-8ff9-ca13e77a74ff","resolution":{"observed_at":"2026-05-14T21:58:03.234937Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07416","last_updated":"2025-03-10T15:03:30Z","snapshot_observed_at":"2026-08-07T17:16:30.674697Z","submitted_at":"2025-03-10T15:03:30Z","title":"TimeStep Master: Asymmetrical Mixture of Timestep LoRA Experts for Versatile and Efficient Diffusion Models in Vision","version":1},"cited_work":{"arxiv_id":"2503.07416","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.07416","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"cache-then-reuse","venue":null,"work_id":"0f4df66c-3c47-4185-afbe-b9fb4eb99c12","year":2025},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2503.07416","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:0f1f9e012f844a6d45cb519ffb0a88de5df7bc714ec66bd6d3880d1a768de001","observation_id":"263c2e96-d2e5-4f69-a549-44b51cb2676e","resolution":{"observed_at":"2026-05-14T21:58:03.170189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T00:44:07.047003Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":12,"parse_uncertain":0,"unresolved":1,"verified_exact":5,"verified_fuzzy":34},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 1 inbound Pith citation observation for arXiv:2605.12119."}