{"as_of":"2026-07-23T14:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:394575d79ffa1b47289c9ff2ef18ede21419c3ac3e8c435ea69d8df4b3afadcb","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T22:59:03.642189Z","state":"measured"},{"denominator":168,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":168,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-23T06:31:01.910684+00:00","state":"measured"},{"denominator":89,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-15T12:07:05.640150Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-07T14:03:48.606626Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2411.13549","last_updated":"2026-05-06T19:17:31Z","snapshot_observed_at":"2026-07-06T19:53:21.444233Z","submitted_at":"2024-11-20T18:58:31Z","title":"KFC-W: Generating 3D-Consistent Videos from Unposed Internet Photos","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-23T16:47:09.717923Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2411.13549"},"observation_digest":"sha256:2adb6983e2ca3d4674e493bcad758fbd752c3177a1c1be93eaa25b03153f93c6","observation_id":"10deac81-f2f8-42bf-afc9-40f395856924","resolution":{"observed_at":"2026-05-23T16:48:12.377109Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2411.14295","last_updated":"2026-05-03T12:27:01Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T16:41:55Z","title":"DissolveStereo: Coarse Depth Injection for Zero-Shot Stereo Video Generation","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-23T17:17:48.961672Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2411.14295"},"observation_digest":"sha256:c7e7e263fcee53aa26ee6f3f90d4dcdc4e1b0ae4f78457e2d9c6f0d5723cce1c","observation_id":"18425613-bfc8-40b5-b95d-fb2f6565954e","resolution":{"observed_at":"2026-05-23T17:18:13.961985Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2506.18601","last_updated":"2026-04-07T16:31:10Z","snapshot_observed_at":"2026-07-06T21:46:16.372616Z","submitted_at":"2025-06-23T13:03:42Z","title":"BulletGen: Improving 4D Reconstruction with Bullet-Time Generation","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-19T08:02:14.123151Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2506.18601"},"observation_digest":"sha256:c717164e826725a97d6cadf74e30cc6a97f492915d3c48593e9d900f361eca04","observation_id":"86931470-fec7-4ea2-81d4-971e01e56315","resolution":{"observed_at":"2026-05-19T08:03:01.100857Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2507.07982","last_updated":"2026-05-05T14:55:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-10T17:55:08Z","title":"Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-19T05:13:28.767788Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2507.07982"},"observation_digest":"sha256:fd4c329e337c77b06b6262da40987ad5fcac4fd7da8a467bcfec3c620762f7dd","observation_id":"72ecd1ba-786f-43ef-9017-b5d59be7ada3","resolution":{"observed_at":"2026-05-19T05:17:06.574122Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2508.09977","last_updated":"2026-04-11T08:26:14Z","snapshot_observed_at":"2026-07-06T22:12:31.023627Z","submitted_at":"2025-08-13T17:44:39Z","title":"A Survey on 3D Gaussian Splatting Applications: Segmentation, Editing, and Generation","version":4},"reference_index":244,"source":"pdf_text","source_observed_at":"2026-05-18T22:39:24.200019Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2508.09977"},"observation_digest":"sha256:77515e2b08d535c645ca0e2927af0a10de7a402d424106e43c9896a3ca0a0f32","observation_id":"6f1da59e-25ae-4cc0-a8b8-bea92f8d4339","resolution":{"observed_at":"2026-05-18T22:41:53.436440Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:ca57e317a6cdd06a5988e785f2175c9617973a95182010d6f5f841ea41106fb5","observation_id":"55cd1a8e-2095-48b3-9f6f-1fd3642d1b88","resolution":{"observed_at":"2026-05-18T02:00:39.686068Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2511.17844","last_updated":"2026-04-08T06:05:56Z","snapshot_observed_at":"2026-07-06T22:36:40.133596Z","submitted_at":"2025-11-21T23:41:19Z","title":"Less is More: Data-Efficient Adaptation for Controllable Text-to-Video Generation","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-17T19:54:35.190865Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2511.17844"},"observation_digest":"sha256:9e71c0101ef382770c98d9a22034cfeb55a4afdcea810aaa7a30f92062599a21","observation_id":"b482257b-77ed-4294-a1f6-3da3c836067b","resolution":{"observed_at":"2026-05-17T19:55:09.966042Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2512.14614","last_updated":"2026-06-09T16:18:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T17:22:46Z","title":"WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-15T14:29:56.348733Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2512.14614"},"observation_digest":"sha256:da8f551794cfdf4befb69948eb3e775c0f2349c6d4f3d7a206002e976ca89761","observation_id":"2795e46f-77dd-49d4-bc28-17d4fdebe6ba","resolution":{"observed_at":"2026-05-15T14:29:56.509471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2601.18993","last_updated":"2026-05-19T03:39:50Z","snapshot_observed_at":"2026-07-06T22:43:07.053570Z","submitted_at":"2026-01-26T22:03:46Z","title":"FreeOrbit4D: Training-Free Arbitrary Camera Redirection for Monocular Videos via Foreground-Complete 4D Reconstruction","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-21T14:05:27.817441Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2601.18993"},"observation_digest":"sha256:b395589af986253517996e05b546b23108244fd9238a3f0729224567e0b2beb4","observation_id":"e156d0ef-36fc-4ac1-8c57-12193484ba39","resolution":{"observed_at":"2026-05-21T14:10:13.631884Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-15T12:07:05.640150Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.09241","last_updated":"2026-06-26T11:58:42Z","snapshot_observed_at":"2026-07-15T12:07:03.818843Z","submitted_at":"2026-03-10T06:16:23Z","title":"RAE-NWM: Navigation World Model in Dense Visual Representation Space","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-15T12:07:05.640150Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2603.09241"},"observation_digest":"sha256:fa469f038db5dc7692dc51c7cf1633ba7962b4fba7ca5519d74d151d0a5aff8d","observation_id":"7d92ff58-4787-4caa-8675-9893bc1dc949","resolution":{"observed_at":"2026-07-15T12:07:05.640150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-14T20:50:44.778323Z","title":"arXiv preprint arXiv:2409.02048 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.14965","last_updated":"2026-06-30T12:43:25Z","snapshot_observed_at":"2026-07-14T20:50:28.394106Z","submitted_at":"2026-03-16T08:23:00Z","title":"GeoNVS: Geometry Grounded Video Diffusion for Novel View Synthesis","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-14T20:50:44.778323Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2603.14965"},"observation_digest":"sha256:abc86292246bb97397fc8c951680acd3d64cb6564f9fdd390094d16341397c8e","observation_id":"0b63c8e8-e71a-48ad-9c36-51cabf562fa0","resolution":{"observed_at":"2026-07-14T20:50:44.778323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2603.17812","last_updated":"2026-04-07T18:00:52Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:04:57Z","title":"ChopGrad: Pixel-Wise Losses for Latent Video Diffusion via Truncated Backpropagation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-15T09:42:26.074609Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2603.17812"},"observation_digest":"sha256:d8f8ed76dadcfe636fb604453f8d9c27126d42578cbe65221ee544b95b879f7a","observation_id":"6d5a1409-e0c3-4457-95c6-04a32e3a9384","resolution":{"observed_at":"2026-05-15T09:45:23.302823Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2603.26481","last_updated":"2026-04-07T06:59:09Z","snapshot_observed_at":"2026-07-06T22:50:46.243903Z","submitted_at":"2026-03-27T14:44:52Z","title":"SparseCam4D: Spatio-Temporally Consistent 4D Reconstruction from Sparse Cameras","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-14T23:41:24.423859Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2603.26481"},"observation_digest":"sha256:3786d007f3721dea3069ef492e6883ad6e6d358aecfad43b1f49ea7eb0fb8b90","observation_id":"59c26135-1e8a-46ff-b7f0-835688fa2c9b","resolution":{"observed_at":"2026-05-14T23:43:18.033815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.02003","last_updated":"2026-04-10T20:21:07Z","snapshot_observed_at":"2026-07-06T22:51:40.181565Z","submitted_at":"2026-04-02T13:09:05Z","title":"ProDiG: Progressive Diffusion-Guided Gaussian Splatting for Aerial to Ground Reconstruction","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T22:01:55.438767Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.02003"},"observation_digest":"sha256:22ed594c79ab5f77ae5c6228f3402d3a2fa8cb8d77dfa171778940c6cea90632","observation_id":"03eedc75-7e3a-4a36-b3fb-565d7a7947f9","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.02828","last_updated":"2026-04-03T07:50:39Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:50:39Z","title":"NavCrafter: Exploring 3D Scenes from a Single Image","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T20:15:33.275096Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.02828"},"observation_digest":"sha256:f98c4a551cc056fefefded9e3d444d93b511061e263ec2b7205bb608648163b7","observation_id":"2fadacc1-c866-4c7d-a748-d950a6356658","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-13T12:26:54.361488Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis.arXiv preprint arXiv:2409.02048, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03723","last_updated":"2026-06-24T08:25:16Z","snapshot_observed_at":"2026-07-13T12:26:50.989359Z","submitted_at":"2026-04-04T12:59:24Z","title":"SymphoMotion: Joint Control of Camera Motion and Object Dynamics for Coherent Video Generation","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-13T12:26:54.361488Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.03723"},"observation_digest":"sha256:0f0a921353797090ebbbd7bd35ed56463beeb6a6f2a413d3fb116470bf628c9f","observation_id":"acd5bc2b-f33c-4986-8800-eaafb14184d5","resolution":{"observed_at":"2026-07-13T12:26:54.361488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.06010","last_updated":"2026-04-07T16:06:02Z","snapshot_observed_at":"2026-07-06T22:54:34.877944Z","submitted_at":"2026-04-07T16:06:02Z","title":"OmniCamera: A Unified Framework for Multi-task Video Generation with Arbitrary Camera Control","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T20:11:35.077141Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.06010"},"observation_digest":"sha256:4e35f4e2b23d8a173d2e7efd9af1fe12a29fbf84f00900500b99c2fcc1421043","observation_id":"540d9ff6-f19b-45bc-a01b-ab4cb5d2fcac","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.06339","last_updated":"2026-04-07T18:17:05Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T18:17:05Z","title":"Evolution of Video Generative Foundations","version":1},"reference_index":285,"source":"pdf_text","source_observed_at":"2026-05-10T18:41:38.616611Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.06339"},"observation_digest":"sha256:e283969002ab10d83586cb59d78ea35e43f3f1de26f0156626790c346c47888f","observation_id":"3b54ce58-6f85-4c9b-a995-d3bf74d91149","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.08500","last_updated":"2026-04-09T17:44:18Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:44:18Z","title":"Novel View Synthesis as Video Completion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T18:26:39.418764Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.08500"},"observation_digest":"sha256:85abcea411f6389535dbb1beeacab6012e4c31a2d95ed582ae9ae71273ff44dc","observation_id":"4808e4be-4b42-4931-a6c0-f40eb53e26c9","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.10578","last_updated":"2026-04-14T11:24:24Z","snapshot_observed_at":"2026-07-06T22:59:09.778842Z","submitted_at":"2026-04-12T10:55:14Z","title":"Rein3D: Reinforced 3D Indoor Scene Generation with Panoramic Video Diffusion Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T15:34:15.916685Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.10578"},"observation_digest":"sha256:8d0dc5db432a64f01e73de854d842a215ac7fc57eecd55b3c429cb435339ebf5","observation_id":"79ef969d-e9a5-4bd5-aecf-c14667a2a42d","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.11331","last_updated":"2026-04-13T11:32:36Z","snapshot_observed_at":"2026-07-06T22:59:45.139155Z","submitted_at":"2026-04-13T11:32:36Z","title":"Any 3D Scene is Worth 1K Tokens: 3D-Grounded Representation for Scene Generation at Scale","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-10T16:30:33.113292Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.11331"},"observation_digest":"sha256:5389d79529b22a1c663311f71fcdd95c0a671ca7d6d318b58c6c53c3a56c8f56","observation_id":"93206e1f-652b-49f4-bbfa-6c36953126ac","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.12270","last_updated":"2026-04-14T04:34:48Z","snapshot_observed_at":"2026-07-06T23:00:32.607699Z","submitted_at":"2026-04-14T04:34:48Z","title":"DreamStereo: Towards Real-Time Stereo Inpainting for HD Videos","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T15:13:10.251475Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.12270"},"observation_digest":"sha256:869bab98bc68bb0e0a54d37afad331c801473ba922c3e64e0936f1c0a20571ac","observation_id":"d698ce92-8a6d-45db-a832-fe60ea134d88","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.13036","last_updated":"2026-04-14T17:59:44Z","snapshot_observed_at":"2026-07-06T23:01:05.634599Z","submitted_at":"2026-04-14T17:59:44Z","title":"Lyra 2.0: Explorable Generative 3D Worlds","version":1},"reference_index":130,"source":"pdf_text","source_observed_at":"2026-05-10T15:30:57.712342Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.13036"},"observation_digest":"sha256:3c9f2d37f7b3ae9cbb2bfc8a6a01b89f4f1375c3460249695b5187ef54fcb1b1","observation_id":"0763003d-0c31-445a-aa45-d2a601f7dd37","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.14025","last_updated":"2026-04-15T16:07:18Z","snapshot_observed_at":"2026-07-06T23:01:55.698452Z","submitted_at":"2026-04-15T16:07:18Z","title":"Feed-Forward 3D Scene Modeling: A Problem-Driven Perspective","version":1},"reference_index":255,"source":"pdf_text","source_observed_at":"2026-05-10T13:13:42.052386Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.14025"},"observation_digest":"sha256:a707b7592564a837b4428efe8de00bb3634f49cad16bd5392575097c8b809196","observation_id":"e5ffeb01-95c9-44f1-95c4-72965f56b698","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.14302","last_updated":"2026-07-18T16:18:55Z","snapshot_observed_at":"2026-07-23T13:19:12.823774Z","submitted_at":"2026-04-15T18:00:45Z","title":"Geometrically Consistent Multi-View Scene Generation from Freehand Sketches","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T13:23:58.169493Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.14302"},"observation_digest":"sha256:3e96656b405646a9c605e4ade33991f0f5c0a159db09259a71cbaa402cc0b0e1","observation_id":"a876f927-f157-4a6d-813f-6ee1fb55375f","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-10T06:03:06.920592Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:6b1c39c73ddf4715e3f4c4f4f78e3f8a0638b16125580c242f3f438b31e6a5a1","observation_id":"4eac284b-13a7-4ed2-a8ca-3924fdff6538","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-12T02:52:58.232585Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:b4d5ceebee284a46c66fccc7b5a2c9df4d69d9c77d1652c3e70973415d37467b","observation_id":"5799eb06-8091-45bd-bf36-fc442ac0d3c8","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":4},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-05T16:47:32.853010Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:6242c0a8922608aaeccd5e8613160017cfe469a7402fa50824c142e5987edc92","observation_id":"a8300915-5fac-4e46-b88b-14f1984b1602","resolution":{"observed_at":"2026-07-05T16:51:14.147633Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.18215","last_updated":"2026-04-21T16:05:42Z","snapshot_observed_at":"2026-07-06T23:05:08.728446Z","submitted_at":"2026-04-20T13:00:17Z","title":"Memorize When Needed: Decoupled Memory Control for Spatially Consistent Long-Horizon Video Generation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T04:49:44.525757Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.18215"},"observation_digest":"sha256:1a5b337d21de6690e1f5c26ee444f0ebd786e9ca32ec49fff42395f7f906ebde","observation_id":"13fec622-41f2-4538-8e88-7de904e7867c","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.18564","last_updated":"2026-04-21T06:41:18Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T17:52:15Z","title":"MultiWorld: Scalable Multi-Agent Multi-View Video World Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T05:06:11.514186Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.18564"},"observation_digest":"sha256:445f308f72fb9d5746260700291557dfb8e9f28068511251d3081db0026f21c4","observation_id":"e85360bf-f5f9-4c7b-9785-3414f8bf88e6","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.19741","last_updated":"2026-06-03T18:09:47Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-04-21T17:59:03Z","title":"CityRAG: Stepping Into a City via Spatially-Grounded Video Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T02:10:54.935053Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.19741"},"observation_digest":"sha256:62bd94a21489f542b58c8eaf14a4d5e9982581fd9f9b0f7f828a10fd0d442547","observation_id":"fc39bd57-a3db-4e72-8509-bc9bd8047e4a","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.19747","last_updated":"2026-04-21T17:59:47Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-04-21T17:59:47Z","title":"AnyRecon: Arbitrary-View 3D Reconstruction with Video Diffusion Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T02:04:25.848510Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.19747"},"observation_digest":"sha256:8e1631ea4b146ea8d90aa962547da722e5081954051cde901aeebb275eb1602c","observation_id":"8142cace-d6be-4931-9e21-ae2e22674b1c","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.24764","last_updated":"2026-05-26T15:39:12Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:59:56Z","title":"World-R1: Reinforcing 3D Constraints for Text-to-Video Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-08T04:26:58.408225Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.24764"},"observation_digest":"sha256:fbf6bafedd6bbbc2513b06adad78eb44814492fd3ba1df188ea5b2a6b33a4615","observation_id":"b08848d6-eccc-433a-8ed2-3f839052f169","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.24764","last_updated":"2026-05-26T15:39:12Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:59:56Z","title":"World-R1: Reinforcing 3D Constraints for Text-to-Video Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-21T08:47:47.264480Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.24764"},"observation_digest":"sha256:dbd713d8abc5a2c5bed3c8fc0b392477a9ab36a74f1d0d656929f143ac193ed0","observation_id":"65f51f3e-5847-49a5-b214-7f439ef7e8e6","resolution":{"observed_at":"2026-05-21T08:49:53.583849Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2604.24764","last_updated":"2026-05-26T15:39:12Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:59:56Z","title":"World-R1: Reinforcing 3D Constraints for Text-to-Video Generation","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-25T06:44:23.038517Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2604.24764"},"observation_digest":"sha256:bb76b5cd01c123f60c25dfe1555cfdc18f0a2516311a6ea2de488bf59c530798","observation_id":"039d583f-012f-42a1-9af2-d6706bc3790e","resolution":{"observed_at":"2026-05-25T06:45:25.860921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.00345","last_updated":"2026-05-01T02:05:28Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T02:05:28Z","title":"Pose-Aware Diffusion for 3D Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-09T20:14:41.740288Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.00345"},"observation_digest":"sha256:04c03f9a0fe754082cdd948335d149e9c04f29484e59ea47650c7ad6d877b744","observation_id":"30496e2d-c194-43a0-aa12-da1e8fea11ee","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.11367","last_updated":"2026-05-12T00:42:27Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-12T00:42:27Z","title":"3D-Belief: Embodied Belief Inference via Generative 3D World Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T02:24:35.901673Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.11367"},"observation_digest":"sha256:4eaea32eea0f2d2ffcedbc2e1a5f4771d2bec9da0f82c1135c9aca6a3b662573","observation_id":"8a6d18ae-2b8a-4741-adda-d83d3ad76dad","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.11871","last_updated":"2026-05-16T12:55:04Z","snapshot_observed_at":"2026-07-06T23:23:39.723268Z","submitted_at":"2026-05-12T09:51:04Z","title":"$h$-control: Training-Free Camera Control via Block-Conditional Gibbs Refinement","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T07:09:32.103652Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.11871"},"observation_digest":"sha256:0c688ecb0155e06fd0cfa7658863ff321c887748378c00f442fc654434bb1055","observation_id":"5aa41685-27e4-4f4b-89db-5f1422aea749","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.11871","last_updated":"2026-05-16T12:55:04Z","snapshot_observed_at":"2026-07-06T23:23:39.723268Z","submitted_at":"2026-05-12T09:51:04Z","title":"$h$-control: Training-Free Camera Control via Block-Conditional Gibbs Refinement","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T22:55:00.590833Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.11871"},"observation_digest":"sha256:a5db7a54ed44ce449455e211fd67cf11a37932267f13e6bd666905e18cb0857b","observation_id":"1e92d6b7-71da-420a-9d5e-f5b661087691","resolution":{"observed_at":"2026-05-20T22:59:11.801948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.12169","last_updated":"2026-05-12T14:16:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T14:16:47Z","title":"UniFixer: A Universal Reference-Guided Fixer for Diffusion-Based View Synthesis","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T07:08:45.182462Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.12169"},"observation_digest":"sha256:0555831a5345e3cbfce6a2d2b8ed2413d3ab161cbe6a61f62857d1feb11840cd","observation_id":"6b4fb009-265e-4360-8154-f993b65386af","resolution":{"observed_at":"2026-05-13T22:59:04.050916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.12957","last_updated":"2026-05-13T03:43:02Z","snapshot_observed_at":"2026-07-06T23:24:37.915639Z","submitted_at":"2026-05-13T03:43:02Z","title":"GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-14T19:39:16.410139Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.12957"},"observation_digest":"sha256:d3030a0e8d3efa2529a5b5451deba2bcab4a1e436f6c5465173f9501f650823b","observation_id":"159930a4-16ea-437c-9bf1-c4f85200aae5","resolution":{"observed_at":"2026-05-14T19:39:23.435450Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.15178","last_updated":"2026-05-14T17:58:03Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T17:58:03Z","title":"SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-15T13:56:17.912350Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.15178"},"observation_digest":"sha256:c5389fe52cad5514749ff83757a942bbe8721493a5a2cd1027c83dd34a01a184","observation_id":"252ce8e5-8aa1-416d-ba93-183333c52c52","resolution":{"observed_at":"2026-05-15T14:00:03.340112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.15182","last_updated":"2026-05-14T17:58:26Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T17:58:26Z","title":"Warp-as-History: Generalizable Camera-Controlled Video Generation from One Training Video","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T03:16:07.765247Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.15182"},"observation_digest":"sha256:533598a3bda8cbaf69d8af8f3efbedccef935d689cefa2ab5bd43109b416f5b1","observation_id":"c852dd31-8c6d-4180-9607-1cc058855f99","resolution":{"observed_at":"2026-05-15T03:19:43.822290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.17248","last_updated":"2026-05-17T04:10:55Z","snapshot_observed_at":"2026-07-06T23:28:16.927009Z","submitted_at":"2026-05-17T04:10:55Z","title":"Image-to-Video Diffusion: From Foundations to Open Frontiers","version":1},"reference_index":127,"source":"pdf_text","source_observed_at":"2026-05-20T15:06:02.084336Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.17248"},"observation_digest":"sha256:277734b706a4add3f45819141599e8a6fb9493869ee25bd5e9a36e37849a03c9","observation_id":"a10a6bb5-70d1-4f39-b61a-494c1245c63e","resolution":{"observed_at":"2026-05-20T15:08:24.920230Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.18365","last_updated":"2026-05-18T13:17:08Z","snapshot_observed_at":"2026-07-06T23:29:14.916114Z","submitted_at":"2026-05-18T13:17:08Z","title":"GeoFlow: Enforcing Implicit Geometric Consistency in Video Generation","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-20T11:06:09.367559Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.18365"},"observation_digest":"sha256:0975f9194c08528258084537813615f6cfa53cdf19d900963267591132ac2384","observation_id":"fb46e09c-e1ed-47d7-a3b0-baf5a0605699","resolution":{"observed_at":"2026-05-20T11:08:13.595515Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.18754","last_updated":"2026-05-18T17:59:58Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:58Z","title":"Can These Views Be One Scene? Evaluating Multiview 3D Consistency when 3D Foundation Models Hallucinate","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T10:42:15.983864Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.18754"},"observation_digest":"sha256:55e969af1804bf07efce943cee763a1ddb08cfe1ab501ac103b8a1cee44c2511","observation_id":"ae08af1a-a114-4ae1-85bc-a42d4f9878b4","resolution":{"observed_at":"2026-05-20T10:43:12.415014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.20961","last_updated":"2026-05-20T09:47:02Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T09:47:02Z","title":"Preserve, Reveal, Expand: Faithful 4D Video Editing with Region-Aware Conditioning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-21T05:11:27.328050Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.20961"},"observation_digest":"sha256:3d354f7be55fe2258b72549ae5b34d392204bb878bf1ea0ca34fe97133e77177","observation_id":"31e57403-529d-4158-8365-4cd5630696c0","resolution":{"observed_at":"2026-05-21T05:13:58.501383Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.23555","last_updated":"2026-05-22T12:20:46Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:20:46Z","title":"Generator-Refiner-Examiner: A Tri-Module Data Augmentation Framework for 3D Human Avatar Learning from Monocular Videos","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-25T05:08:07.521840Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.23555"},"observation_digest":"sha256:8a06a8071da852ff1179492e9b41f3c6c9115c72e4924e4dc79c4e5a501b0abc","observation_id":"23d0ad3a-e65c-4c5b-a1e7-a8df19be0ba7","resolution":{"observed_at":"2026-05-25T05:10:22.107043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.23888","last_updated":"2026-05-22T17:49:59Z","snapshot_observed_at":"2026-07-06T23:34:03.934151Z","submitted_at":"2026-05-22T17:49:59Z","title":"GenRecon: Bridging Generative Priors for Multi-View 3D Scene Reconstruction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-25T04:37:47.777425Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.23888"},"observation_digest":"sha256:4cda57c9411d49bce960f6f96daa56df77048916e11c957bb9574d91fb1b5eea","observation_id":"a309f42c-77b9-409a-926c-8d64201a9b9b","resolution":{"observed_at":"2026-05-25T04:40:24.276433Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.24321","last_updated":"2026-05-23T01:01:35Z","snapshot_observed_at":"2026-07-06T23:34:23.087565Z","submitted_at":"2026-05-23T01:01:35Z","title":"Unified 3D Scene Understanding Through Physical World Modeling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T14:19:03.682306Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.24321"},"observation_digest":"sha256:ba1fe5b42f0586dff6f9dbc2ec8b83543a60335e8624de089a7b865c85299544","observation_id":"b0f0d70c-9bcd-49ae-8eac-14b2cab12e3e","resolution":{"observed_at":"2026-06-30T14:24:45.165366Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.25266","last_updated":"2026-05-24T21:39:54Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-24T21:39:54Z","title":"DeltaCam: Differential Intrinsic Camera Modeling for Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T11:44:08.734390Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.25266"},"observation_digest":"sha256:24e2eacefef30e274ff647b5d0ba384c2b574178f4fe017905e506d3fadd09a1","observation_id":"6af79ac9-7b1a-44a9-ad80-915ecf684803","resolution":{"observed_at":"2026-06-30T11:44:37.831838Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.25449","last_updated":"2026-06-08T06:26:00Z","snapshot_observed_at":"2026-07-06T23:35:26.687529Z","submitted_at":"2026-05-25T06:00:01Z","title":"Pantheon360: Taming Digital Twin Generation via 3D-Aware 360{\\deg} Video Diffusion","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-29T22:46:55.049969Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.25449"},"observation_digest":"sha256:6d65865f74736d884f08aab226823d494773067656bd86f8ba51724b7502c474","observation_id":"ec0b661a-7888-45f0-a8cd-ea947a24d840","resolution":{"observed_at":"2026-06-29T22:54:01.261408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2605.30855","last_updated":"2026-06-01T09:19:36Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:21:33Z","title":"Robust Dreamer: Deviation-Aware Latent Gaussian Memory for Action-Controlled AR Video Generation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T22:56:35.530309Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2605.30855"},"observation_digest":"sha256:823c12b069ff2df2feb5a10f625119f86f78df10de3ba804be5343d22b70aa44","observation_id":"140bc412-a51c-44d7-a2ea-d2413fb8950b","resolution":{"observed_at":"2026-07-01T19:16:00.395509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.00299","last_updated":"2026-05-29T19:28:07Z","snapshot_observed_at":"2026-07-06T23:41:01.066075Z","submitted_at":"2026-05-29T19:28:07Z","title":"Real2SAM2Real: Generative 3D Caches as Complementary Context for Video Diffusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T22:41:00.915004Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.00299"},"observation_digest":"sha256:e972ac440200ab4ae4bfc2d33098b1043868d485d08cd72fc6132287dfd0854d","observation_id":"852883ba-5130-4c31-9eb1-fa7f829ef9ed","resolution":{"observed_at":"2026-06-28T22:42:46.294910Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.00386","last_updated":"2026-05-29T22:00:17Z","snapshot_observed_at":"2026-07-06T23:41:05.637982Z","submitted_at":"2026-05-29T22:00:17Z","title":"{\\alpha}Depth: Learning Single-Pass Soft Boundary Decomposition for Stereo Conversion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T22:37:00.236409Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.00386"},"observation_digest":"sha256:59b59c28abc017060527db02295a30617602298e13e03dd16a7c532393e68bb6","observation_id":"01af5929-3c9b-4afc-8010-919f86df74d1","resolution":{"observed_at":"2026-06-28T22:42:46.968501Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.01164","last_updated":"2026-05-31T11:12:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-31T11:12:30Z","title":"Towards Interactive Video World Modeling: Frontiers, Challenges, Benchmarks, and Future Trends","version":1},"reference_index":113,"source":"pdf_text","source_observed_at":"2026-06-28T17:29:18.513507Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.01164"},"observation_digest":"sha256:d6d091065c877a44463d4dfa6808be05384d70d301df488ca7b521363003935a","observation_id":"add784da-f7c1-47df-9f93-72520ed90652","resolution":{"observed_at":"2026-07-01T21:06:13.774459Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.01315","last_updated":"2026-05-31T16:04:55Z","snapshot_observed_at":"2026-07-06T23:41:53.635605Z","submitted_at":"2026-05-31T16:04:55Z","title":"DeblurNVS: Geometric Latent Diffusion for Novel View Synthesis from Sparse Motion-Blurred Images","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T17:27:55.194746Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.01315"},"observation_digest":"sha256:a2c0c111c79fb87d8a7b9e773b84649ed039d1d6e5d8763a5ff11b3a2bad1dc6","observation_id":"a5023ae9-2e66-4203-82ae-39981a34d67a","resolution":{"observed_at":"2026-07-01T21:06:14.524993Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.07117","last_updated":"2026-06-05T10:13:17Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T10:13:17Z","title":"Native3D: End-to-End 3D Scene Generation via Unified Mesh-Texture Modeling and Semantic Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T22:17:37.135761Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.07117"},"observation_digest":"sha256:a12b0f40d8f4441c9776b18fc332c401d003f41dc7a52c6dff8aca8e3c643644","observation_id":"b84bd7a0-eeb9-468c-ac07-de4e57ff3aec","resolution":{"observed_at":"2026-07-02T16:57:09.674945Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.07326","last_updated":"2026-06-05T14:43:13Z","snapshot_observed_at":"2026-07-06T23:47:00.425715Z","submitted_at":"2026-06-05T14:43:13Z","title":"AnchorWorld: Embodied Egocentric World Simulation with View-based Evolution Customization","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-27T22:25:18.152134Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.07326"},"observation_digest":"sha256:e81a957ece251bb0d1d8a8cec8daab8dc9a79f7589c7f9bd51c3d6e659c8fdb8","observation_id":"3958a786-6c0f-41a8-a200-11a6f4b6fce3","resolution":{"observed_at":"2026-07-02T16:47:09.356259Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.09187","last_updated":"2026-06-08T08:23:12Z","snapshot_observed_at":"2026-07-06T23:48:35.190418Z","submitted_at":"2026-06-08T08:23:12Z","title":"CP4D: Compositional Physics-aware 4D Scene Generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T16:52:36.288955Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.09187"},"observation_digest":"sha256:8f0a70c2622784872c7d194b8264fdd64cd426333c564b6717ec378a254ec91f","observation_id":"252f4cf9-e7c4-4638-a3f0-dd15c5c88f3b","resolution":{"observed_at":"2026-07-03T00:57:30.514640Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.09828","last_updated":"2026-06-08T17:59:54Z","snapshot_observed_at":"2026-07-06T23:49:08.412079Z","submitted_at":"2026-06-08T17:59:54Z","title":"Latent Spatial Memory for Video World Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T16:47:42.761342Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.09828"},"observation_digest":"sha256:9b17eb9ed43f1bce1ffd96dead76ece46058b4ea065dc25b22bbbee1b85a2946","observation_id":"6ae2c67d-b19a-4f0a-9fe2-ed851ec43425","resolution":{"observed_at":"2026-07-03T01:07:30.547536Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.18960","last_updated":"2026-06-18T07:33:11Z","snapshot_observed_at":"2026-07-06T23:54:18.292223Z","submitted_at":"2026-06-17T11:42:00Z","title":"Mem-World: Memory-Augmented Action-Conditioned World Models for Persistent Robot Manipulation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T21:50:26.223702Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.18960"},"observation_digest":"sha256:7d72600e13ac2f64f91ef54df99e2ec0e7feb36c19580319a68dead96a3ae3b2","observation_id":"47689372-03fd-4a01-9f49-62687c4a2e9a","resolution":{"observed_at":"2026-07-03T23:39:04.928285Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.20545","last_updated":"2026-06-18T17:55:15Z","snapshot_observed_at":"2026-07-06T23:55:38.979306Z","submitted_at":"2026-06-18T17:55:15Z","title":"Current World Models Lack a Persistent State Core","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T17:33:41.461245Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.20545"},"observation_digest":"sha256:0f259d9b1e32e561a2d4493a6c26f28bdec0faedb3d34eabf62748b87c041be9","observation_id":"4ef7b6e9-7de2-46c7-870a-a862639acc30","resolution":{"observed_at":"2026-07-04T03:49:30.990503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.23105","last_updated":"2026-06-22T09:46:36Z","snapshot_observed_at":"2026-07-06T23:57:53.101659Z","submitted_at":"2026-06-22T09:46:36Z","title":"Compression and Retrieval: Implicit Memory Retrieval for Video World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T08:46:28.619102Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.23105"},"observation_digest":"sha256:653abf7324eb4ebe4c49d088f988cd2743b9f3e1d0b6e97661ef57f4855f03b9","observation_id":"ce44bd6b-ce4a-4633-be1d-47b7fd484ec2","resolution":{"observed_at":"2026-07-04T10:29:45.423048Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.24799","last_updated":"2026-06-23T16:50:47Z","snapshot_observed_at":"2026-07-06T23:59:18.313042Z","submitted_at":"2026-06-23T16:50:47Z","title":"OrbitForge: Text-to-3D Scene Generation via Reconstruction-Anchored Video Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T00:12:08.733967Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.24799"},"observation_digest":"sha256:46e2f7e20295bb61fecf6b0d3848cee4bc75e82818cb397ccd8a0483e2667df1","observation_id":"f22f597b-5207-4db8-b1a3-3716645aa1d4","resolution":{"observed_at":"2026-07-04T16:49:57.946727Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.24876","last_updated":"2026-06-23T17:53:41Z","snapshot_observed_at":"2026-07-06T23:59:23.407216Z","submitted_at":"2026-06-23T17:53:41Z","title":"FLAT: Feedforward Latent Triangle Splatting for Geometrically Accurate Scene Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-26T00:11:11.534272Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.24876"},"observation_digest":"sha256:a731e60e68fe0830d1f4c9f0ad0048ebbdb4ce285c13dffd6edb8dffe3fa8bcd","observation_id":"22e8ae71-9b68-4f7c-bbc2-44ecc2b25c0e","resolution":{"observed_at":"2026-07-04T16:49:58.218574Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.26092","last_updated":"2026-07-03T12:28:57Z","snapshot_observed_at":"2026-07-12T12:05:10.075235Z","submitted_at":"2026-06-24T17:59:06Z","title":"TryOnCrafter: Unleashing Camera Trajectories for Realistic Video Virtual Try-on via a Renderable 4D Try-on Proxy","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-25T19:20:45.217627Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.26092"},"observation_digest":"sha256:4ac29838176907a6cc40e6d8f21c442617dd3b32999f2bda377c84a99ce53889","observation_id":"1a10c122-77b3-46d3-b810-bb248de981b3","resolution":{"observed_at":"2026-07-04T21:00:08.892992Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-12T12:05:10.800662Z","title":"arXiv preprint arXiv:2409.02048 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26092","last_updated":"2026-07-03T12:28:57Z","snapshot_observed_at":"2026-07-12T12:05:10.075235Z","submitted_at":"2026-06-24T17:59:06Z","title":"TryOnCrafter: Unleashing Camera Trajectories for Realistic Video Virtual Try-on via a Renderable 4D Try-on Proxy","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-12T12:05:10.800662Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.26092"},"observation_digest":"sha256:cb9a1cd94f2b34160e36788ec6baa293347fb1d7e8e9cb44093edcb4c34d26cf","observation_id":"3423f69a-05c5-479d-84a2-97cea931909a","resolution":{"observed_at":"2026-07-12T12:05:10.800662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.27071","last_updated":"2026-07-09T14:24:02Z","snapshot_observed_at":"2026-07-12T23:18:44.867152Z","submitted_at":"2026-06-25T14:15:09Z","title":"PanoImager: Geometry-Guided Novel View Synthesis and Reconstruction from Sparse Panoramic Views","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T05:07:42.790021Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27071"},"observation_digest":"sha256:e4ad676f49c66bffc5ba3fa1e57d90b3c70c36036f4b32c3ac563328c84da9eb","observation_id":"4f910c65-5ce3-4746-9d19-1cfa5cde0cc0","resolution":{"observed_at":"2026-07-04T13:29:52.114796Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-12T11:51:43.449411Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27071","last_updated":"2026-07-09T14:24:02Z","snapshot_observed_at":"2026-07-12T23:18:44.867152Z","submitted_at":"2026-06-25T14:15:09Z","title":"PanoImager: Geometry-Guided Novel View Synthesis and Reconstruction from Sparse Panoramic Views","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T11:51:43.449411Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27071"},"observation_digest":"sha256:4d5fda01af4cbc99aec80e1d29f42e512ef9cbb8b1535d6edb4e67b13df42028","observation_id":"a1da3632-718c-4c7c-af95-d5f6f053dacf","resolution":{"observed_at":"2026-07-12T11:51:43.449411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T05:14:02.088474Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:a99433d7cd6f72a9f4fd4b49c9b2d8bbe0d4cbe534161b38b8e64ca52f8ff370","observation_id":"d8528937-4785-4536-ab6a-8817a8e89cca","resolution":{"observed_at":"2026-07-04T13:29:51.208800Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.27345","last_updated":"2026-06-26T06:30:48Z","snapshot_observed_at":"2026-07-07T00:01:34.696890Z","submitted_at":"2026-06-25T17:51:02Z","title":"RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T04:34:04.281000Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27345"},"observation_digest":"sha256:86c14ecbdd2f28254a5ab53561e75d48d25fee417556a7fc8c53362955c460c2","observation_id":"adcd7768-8618-446d-b794-db079d62456b","resolution":{"observed_at":"2026-06-29T20:03:57.072474Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-07-23T13:20:15.065998Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-29T02:03:45.564122Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:bb07b682af272ec25938845ca8fc8fe6536ad13de4b188c7044aacd1f757330c","observation_id":"e15afd9f-fa51-4132-a3d6-af512022cc83","resolution":{"observed_at":"2026-07-01T18:25:57.717356Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-07-23T13:20:15.065998Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-01T06:25:58.872140Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:27f6cb9742a1f0f9fc76a1cf688e67ac543a93627c5706371ad1b7f59777ed9b","observation_id":"db159700-ba61-49b3-9387-d2e890165092","resolution":{"observed_at":"2026-07-01T09:35:40.613680Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-07-23T13:20:15.065998Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-02T20:52:28.444524Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:73f616852175e1cd1cfaa7c9a37fb2edd9203f118a0e3c9380b7854140aa851f","observation_id":"724d2f63-4c47-441b-b1a0-4cea77a16b69","resolution":{"observed_at":"2026-07-02T20:57:22.811479Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-07-23T13:20:15.065998Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-03T22:44:16.272541Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:1149ff59457cbab572abb81e2a51bea4cbd48be5562c516e252713aa2709dca0","observation_id":"d4147d72-ecb7-4af4-b8bf-63f9a4eb6a36","resolution":{"observed_at":"2026-07-03T22:49:00.869382Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-14T17:14:19.770867Z","title":"arXiv preprint arXiv:2409.02048 (2024) 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27537","last_updated":"2026-07-19T21:49:02Z","snapshot_observed_at":"2026-07-23T13:20:15.065998Z","submitted_at":"2026-06-25T20:37:39Z","title":"MemoBench: Benchmarking World Modeling in Dynamically Changing Environments","version":5},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-14T17:14:19.770867Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27537"},"observation_digest":"sha256:615f4a0df264dea8a9394270ef3e0f2e2bf4025e7f4f5fa4dd0dc0ecf8c43558","observation_id":"63b57f72-a485-4f35-b48e-4ace3deb8af3","resolution":{"observed_at":"2026-07-14T17:14:19.770867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.27575","last_updated":"2026-06-25T22:01:34Z","snapshot_observed_at":"2026-07-07T00:01:44.678954Z","submitted_at":"2026-06-25T22:01:34Z","title":"Perceptual 3D Simulation With Physical World Modeling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T01:41:37.341671Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.27575"},"observation_digest":"sha256:a2cde5f2cfd0e9e4829240d2684189fae46fbf2a13729dba5a49ba8da03b3348","observation_id":"704b5eeb-eccb-4581-be9e-b00612980853","resolution":{"observed_at":"2026-07-01T18:45:58.922304Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.31258","last_updated":"2026-06-30T07:33:46Z","snapshot_observed_at":"2026-07-07T00:04:58.486133Z","submitted_at":"2026-06-30T07:33:46Z","title":"WarpHammer: Densifying Scene Warps with 3D Object Priors for Extreme View Synthesis","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-01T06:19:53.091972Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.31258"},"observation_digest":"sha256:cd5cb5dc90580e8e92e3a9ea4e0e217e26b4917f0aaab775851b223636891089","observation_id":"e90279f8-d2f5-474e-a2a1-dbc271e7eba7","resolution":{"observed_at":"2026-07-01T09:45:39.676900Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2606.31734","last_updated":"2026-06-30T14:31:32Z","snapshot_observed_at":"2026-07-07T00:05:22.503928Z","submitted_at":"2026-06-30T14:31:32Z","title":"MemLearner: Learning to Query Context memory for Video World Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-01T05:30:56.140465Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2606.31734"},"observation_digest":"sha256:b37b7911bf0f152e0dd1393173712d63c64bf9f9876dec488fc0b3e26e66708b","observation_id":"1b1944bf-bab8-4e10-aa3c-0cda17ff2167","resolution":{"observed_at":"2026-07-01T10:25:41.810794Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2607.00832","last_updated":"2026-07-06T11:37:36Z","snapshot_observed_at":"2026-07-12T09:15:55.636324Z","submitted_at":"2026-07-01T11:54:02Z","title":"Pano2World: End-to-End 3D Generation via Unified Multi-View Sequences","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-02T13:52:00.598189Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2607.00832"},"observation_digest":"sha256:142142d0f8d7c1bbc833064bb3db44bb11bf715cac55c8d8329211d50520c267","observation_id":"e78b100b-c0d8-4d9a-a051-75cee89fb43d","resolution":{"observed_at":"2026-07-02T13:56:59.176654Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2607.01202","last_updated":"2026-07-01T17:41:00Z","snapshot_observed_at":"2026-07-07T00:06:49.412663Z","submitted_at":"2026-07-01T17:41:00Z","title":"World from Motion: Generative Dynamic Gaussian Reconstruction from Monocular Video","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-02T13:21:51.983252Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2607.01202"},"observation_digest":"sha256:bd260dee8b00f215e1a9f2d868b3c4bf6c10dcf14e4ec3e89479aea3a4171427","observation_id":"da74e07a-73a9-43a1-8278-4dc1aa3668cc","resolution":{"observed_at":"2026-07-02T13:26:58.555260Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2607.01962","last_updated":"2026-07-02T09:56:50Z","snapshot_observed_at":"2026-07-07T00:07:28.231599Z","submitted_at":"2026-07-02T09:56:50Z","title":"NeoMap: Training-free Novel-View Synthesis from Single Images and Videos","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-03T15:45:57.331627Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2607.01962"},"observation_digest":"sha256:126a55bd46df281cb1c5f37499a9b264b9235cadc436c1b1fcd5d1379b37096a","observation_id":"f7addaef-47a3-4c84-a0b9-8d253d53a8b7","resolution":{"observed_at":"2026-07-03T15:48:34.920840Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-11T23:19:53.043435Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03875","last_updated":"2026-07-04T13:36:06Z","snapshot_observed_at":"2026-07-11T23:19:52.561850Z","submitted_at":"2026-07-04T13:36:06Z","title":"MACRO: Training-free Multi-plane Attention for Closeup Render Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T23:19:53.043435Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2607.03875"},"observation_digest":"sha256:790b9512834cc9a235d4e4d901f2151cb59332a83a61f9c486823d790d046eb5","observation_id":"91bf110a-8610-482d-8719-ba51bb69825f","resolution":{"observed_at":"2026-07-11T23:19:53.043435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":"2409.02048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-07T14:03:48.606626Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","venue":"cs.CV","work_id":"af2e8736-e001-407f-b94e-21e98f89ec55","year":2024},"citing_paper":{"arxiv_id":"2607.05376","last_updated":"2026-07-06T17:54:16Z","snapshot_observed_at":"2026-07-09T23:18:25.821956Z","submitted_at":"2026-07-06T17:54:16Z","title":"MV-Forcing: Long Multi-View Video Generation via 4D-Grounded Spatio-Temporal Self-Forcing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-07T13:58:13.194386Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2607.05376"},"observation_digest":"sha256:ea67098b7d058a5f57faa1b003d3abfd8d7cab4b9ec8edd9e021b1853ffceddd","observation_id":"597c0127-6d55-4b08-87cc-d3d3f5d936b0","resolution":{"observed_at":"2026-07-07T14:03:48.608011Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-13T06:33:01.186741Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08808","last_updated":"2026-07-09T16:32:45Z","snapshot_observed_at":"2026-07-15T23:17:53.110712Z","submitted_at":"2026-07-09T16:32:45Z","title":"StereoSplat+: Feed-Forward Stereo Gaussian Splatting with Diffusion-Assisted Progressive Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T06:33:01.186741Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2607.08808"},"observation_digest":"sha256:e3307678606d781a3cdafe4a76a3f7b05d292f995b9477542638e193bdc1080d","observation_id":"f88ef044-1848-4b32-93a7-f3165d374bbd","resolution":{"observed_at":"2026-07-13T06:33:01.186741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-13T01:26:27.220907Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis.arXiv preprint arXiv:2409.02048,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09655","last_updated":"2026-07-10T17:54:14Z","snapshot_observed_at":"2026-07-15T23:18:32.931321Z","submitted_at":"2026-07-10T17:54:14Z","title":"OpenLongTail: Generative Scaling of Long-Tail Driving Data","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T01:26:27.220907Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2607.09655"},"observation_digest":"sha256:4c5616f4d955b01abb19a5d7be9ed2f2b6369a84dee9b928b9400c44e02a88c4","observation_id":"a32a24dc-e48d-4656-9858-dd80a62ac8ad","resolution":{"observed_at":"2026-07-13T01:26:27.220907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-14T03:58:47.052341Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11673","last_updated":"2026-07-14T04:32:07Z","snapshot_observed_at":"2026-07-17T23:18:13.866700Z","submitted_at":"2026-07-13T15:14:48Z","title":"ABot-3DWorld 0: A Universal World Model to Explore Any 3D Space","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T03:58:47.052341Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2607.11673"},"observation_digest":"sha256:820c2e96c2a6b8b250db72a74e75a4083d49cc2b0791e8e1058f76ce5e64b5ae","observation_id":"5c4d03df-3254-4965-9f47-f4d5b4925478","resolution":{"observed_at":"2026-07-14T03:58:47.052341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-07-14T03:51:24.547781Z","title":"arXiv preprint arXiv:2409.02048 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11689","last_updated":"2026-07-13T15:22:56Z","snapshot_observed_at":"2026-07-16T23:19:57.841128Z","submitted_at":"2026-07-13T15:22:56Z","title":"From World Action Models to Embodied Brains: A Roadmap for Open-World Physical Intelligence","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-14T03:51:24.547781Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2607.11689"},"observation_digest":"sha256:cfe87a28a0336767f2bc0e8636a53de5aea13b1bc30c468753a685e8bb4a3468","observation_id":"36ce0dc7-ada8-4ab5-897e-00b80cdf30ed","resolution":{"observed_at":"2026-07-14T03:51:24.547781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.02048/citation-record","integrity":"/paper/2409.02048/integrity","json":"/paper/2409.02048/citation-record.json","paper":"/paper/2409.02048"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis","venue":null,"work_id":"a5c56e17-09a0-442d-9bbe-e00f14649493","year":2020},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:74afba1fd00ff711b00f3e1fcc2c1a94d4c192e73f6fb6354d907cd4936360b6","observation_id":"5060a9db-5b25-4891-b2ce-41c8b452697e","resolution":{"observed_at":"2026-05-13T22:59:03.866787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d gaus- sian splatting for real-time radiance field rendering","venue":null,"work_id":"929feeff-4566-4c44-9f00-4437da4c2116","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:036a9c5b142af081d651fb5929c3b59b9db5dc001379098d40278f9399dde120","observation_id":"8151b52a-feb5-42b3-b196-0ee3298251f5","resolution":{"observed_at":"2026-05-13T22:59:03.981709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Synsin: End-to- end view synthesis from a single image","venue":null,"work_id":"aee8ef3a-c51b-4421-88a4-f92407c79672","year":2020},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:bfb9b645dd9c4952e45aeb87bf4adb307f3e6702d180fedada8822cb59a6beec","observation_id":"5d14a59c-c778-4e62-a03f-7496fd930faa","resolution":{"observed_at":"2026-05-13T22:59:03.988865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Geometry-free view syn- thesis: Transformers and no 3d priors","venue":null,"work_id":"c420b572-0999-40eb-9f35-ca488dd4e313","year":2021},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:c7337d3e0bf3581fcb7797c42b917b2cca2f98f0c81bbe73159194483e707e33","observation_id":"501a008c-1bf8-4c6c-8fb0-6265b1edf7b9","resolution":{"observed_at":"2026-05-13T22:59:03.992608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixelsynth: Generating a 3d-consistent experience from a single image","venue":null,"work_id":"a9f5c957-a190-4700-8887-02c739842b15","year":2021},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:59ed621fc8f2a53dcf96abaf6ec38c4062063ef1b6544b2daf5873748120f7ba","observation_id":"3556dbab-ea96-4fbc-96ec-1d2f8c45dc93","resolution":{"observed_at":"2026-05-13T22:59:03.996786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridging implicit and explicit geometric transformation for single-image view synthesis","venue":null,"work_id":"cfcada1b-3ab5-42db-91fd-74ec10a59fb6","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:ed163d8d3cb6fa6ca7112d54b080ac214d6ad085925a879e06edff913e96dead","observation_id":"0e8bd398-7dea-4901-979b-8e0e70343e51","resolution":{"observed_at":"2026-05-13T22:59:04.000638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stereo magnification: Learning view synthesis using multiplane images","venue":null,"work_id":"97c08725-edc1-4ddd-b001-9dccf9c95cec","year":2018},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:b009219340896ac817be37cd108d8daa4ac45d1dc33b79da7ec60ee999f25226","observation_id":"7c602b9a-e5f9-427a-aa84-c0cb3581404f","resolution":{"observed_at":"2026-05-13T22:59:04.004334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Single-view view synthesis in the wild with learned adaptive multiplane images","venue":null,"work_id":"b72adce4-fc43-4bc9-9dd3-21d88948d468","year":2022},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:10419c21b0a394dda350b261625d05a6d428b9d83ea7a102a063641463cdfe96","observation_id":"b1589fd4-28ff-4e76-ade7-853fd25494b5","resolution":{"observed_at":"2026-05-13T22:59:04.008063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Single-view view synthesis with mul- tiplane images","venue":null,"work_id":"3643a8f5-77ae-453e-8624-aefec3ba9e0d","year":2020},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:ca3d41afe9de6b213102a246034eacf189289169ccd3e08b10dd1e44b9afc871","observation_id":"20636ca0-c1e4-4280-9c1e-1ad0ecd1d8f8","resolution":{"observed_at":"2026-05-13T22:59:04.011650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"pixelnerf: Neural radiance fields from one or few images","venue":null,"work_id":"152a24b8-5ee9-4e4d-adfd-3e77d2f6dc45","year":2021},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:7964e4391bb8f47eaed4816946c2c6a435de47752b13a7c626e04f393463586f","observation_id":"b713570e-af5b-4620-9c9c-e053f5e0835c","resolution":{"observed_at":"2026-05-13T22:59:04.017104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T00:11:40.079990Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"d74fec9b-ee6c-453d-a570-e774ab1c327b","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:3a89b883ad92416955491769923d1bd1a4e4f5ad3987d4598621368543c4dccb","observation_id":"0023ae08-aa2a-4176-b4da-2dc74bace29c","resolution":{"observed_at":"2026-05-13T22:59:04.023323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ZeroNVS: Zero- shot 360-degree view synthesis from a single real image","venue":null,"work_id":"6ff5ee5c-6f00-426d-81a1-2902ec8a0057","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:fca44d4a2d29c6b18a0baead31e22a6e432e6e46bc9cacfa28ebe0ebf00cfb85","observation_id":"4ee3c483-bacd-413f-b32c-e0602d3d01c4","resolution":{"observed_at":"2026-05-13T22:59:04.027061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"e4ca27d6-6745-4c62-b064-22f9cbd4f0a4","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:c0b43097901e7855a99409aaa2691ce347d6ebb3586bb12c01a81f299c4a1c50","observation_id":"a454c80b-24a6-4d55-add4-48d94ab92880","resolution":{"observed_at":"2026-05-13T22:59:04.031169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13384","last_updated":"2023-11-23T11:40:16Z","snapshot_observed_at":"2026-07-06T16:51:06.781541Z","submitted_at":"2023-11-22T13:27:34Z","title":"LucidDreamer: Domain-free Generation of 3D Gaussian Splatting Scenes","version":2},"cited_work":{"arxiv_id":"2311.13384","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.13384","snapshot_observed_at":"2026-07-04T13:49:51.650606Z","title":"Luciddreamer: Domain-free gen- eration of 3d gaussian splatting scenes","venue":null,"work_id":"24a684d2-afbc-461d-9ff8-92fa3c51ff4c","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2311.13384","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:1c1c02e488beaf571d7d89b9e4476e1eeeebcedc6387f724cc2ababda8e3f4d5","observation_id":"aca7304d-5a6d-43be-9d9a-65958875019d","resolution":{"observed_at":"2026-05-13T22:59:03.810480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07199","last_updated":"2025-03-11T17:06:18Z","snapshot_observed_at":"2026-07-06T17:58:25.894552Z","submitted_at":"2024-04-10T17:57:41Z","title":"RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion","version":2},"cited_work":{"arxiv_id":"2404.07199","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07199","snapshot_observed_at":"2026-07-07T12:53:50.386058Z","title":"Realmdreamer: Text-driven 3d scene gener- ation with inpainting and depth diffusion","venue":"cs.CV","work_id":"1c151d37-40d6-4d69-9dce-24d3fd760e74","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2404.07199","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:025ddf0cbb32f8bd12c0c453108bac80d35c4387f628553fe85954f1bd8cf321","observation_id":"fb445e48-0e36-4096-bd8a-fe9135c806a9","resolution":{"observed_at":"2026-05-13T22:59:03.727402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.10948109","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"title =","venue":null,"work_id":"bfd7cafa-d8f4-4f13-b22d-1453e3e4ef02","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:8eda26d98da16ee0ac141299a93b19cc76a8b90b706fc4b5298f2329971965f3","observation_id":"9e2e3755-8c75-4d4b-82ce-7066d1e7a729","resolution":{"observed_at":"2026-05-13T22:59:03.687326Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-07-11T02:27:48.842637Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:dcde687cf25c98250f5254ec861e76e876dc197d5f5723fac06022894d994fdf","observation_id":"20e19241-9f9d-4c4d-8186-82bbbe15b687","resolution":{"observed_at":"2026-05-13T22:59:03.767446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12190","last_updated":"2023-11-27T13:36:04Z","snapshot_observed_at":"2026-07-06T16:35:15.777674Z","submitted_at":"2023-10-18T14:42:16Z","title":"DynamiCrafter: Animating Open-domain Images with Video Diffusion Priors","version":2},"cited_work":{"arxiv_id":"2310.12190","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.12190","snapshot_observed_at":"2026-07-04T14:59:55.949933Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":"cd60d897-1a74-482c-84b4-93dfa38c1c33","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2310.12190","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:7a0bdd4ad64f0c204e2a434c462171709bc2c50659e12adc7b56f06979e04add","observation_id":"39a1c032-97a3-4dd0-93d6-7038e883aa5d","resolution":{"observed_at":"2026-05-13T22:59:03.774856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":"3f41498c-0761-4a13-88d1-68b85f44186c","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:d61384d17c0fa2c9675979cf499e841649d443aa3d426cc1978ab9b537ced261","observation_id":"2cea950e-ef72-4d6d-90dd-c988a9d8b41b","resolution":{"observed_at":"2026-05-13T22:59:04.034486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09756","last_updated":"2024-06-14T06:46:30Z","snapshot_observed_at":"2026-07-06T18:30:46.405694Z","submitted_at":"2024-06-14T06:46:30Z","title":"Grounding Image Matching in 3D with MASt3R","version":1},"cited_work":{"arxiv_id":"2406.09756","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09756","snapshot_observed_at":"2026-07-03T15:08:32.534743Z","title":"Grounding image matching in 3d with mast3r","venue":null,"work_id":"bc219327-fe47-4a7d-b2de-43dd11edecd2","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2406.09756","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:d8b3ce6a9afa1024969e710e88de81e4631747dd4965ca680015b1ac9cb2b9a4","observation_id":"7dd91102-d02a-4bba-856a-2ffe330c00b3","resolution":{"observed_at":"2026-05-13T22:59:03.693842Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tanks and temples: Benchmarking large-scale scene reconstruction","venue":null,"work_id":"14f1fb08-08c4-4bda-afb7-543befd7999e","year":2017},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:4d0d50c623956e54032fe24836476fcf5c38cd140a82597cf6c7cdeab446676f","observation_id":"6931c474-e7df-4654-8cec-a1438d16e623","resolution":{"observed_at":"2026-05-13T22:59:04.037939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention is all you need","venue":null,"work_id":"683e1d6b-7c09-4702-ad57-0acd8f560c24","year":2017},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:242bd4c88db85a9ce551f2f678309a1e93f6830809e033e9c4e6d3c81000eebc","observation_id":"54f95291-1ef9-4e09-ad9c-51282ec33cd0","resolution":{"observed_at":"2026-05-13T22:59:04.041025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Real-time radiance fields for single-image portrait view synthe- sis","venue":null,"work_id":"42908ea4-3a8d-41f9-9679-7d60fa3c19e6","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:ea7752d6caaeb9f4b7c41ef9e693c480601fc0733f0a20aacdce1b5381b7c4d6","observation_id":"b5887ee5-ef6e-4b0b-8b6a-725e1f74a481","resolution":{"observed_at":"2026-05-13T22:59:04.043988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nofa: Nerf-based one-shot facial avatar reconstruction","venue":null,"work_id":"1a6f07f8-56aa-4ef0-8e3a-ddfbb7bb3eb5","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:490ed612fbd47da551be5ad861a86c8aaeb9d9d469fac5ca2ff7e38cb5f5daf9","observation_id":"770f853d-3bb5-4aa6-92ba-6ec46e09cfef","resolution":{"observed_at":"2026-05-13T22:59:04.046884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":"12a35922-8e7c-4285-8db6-bcd7f0d87b1d","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:a0045adc4ea4a1132f997f5a32b07f124f24c7614ace1aa9019d472a953bb90a","observation_id":"413c1bb8-5aed-425b-abdb-59c580d82e58","resolution":{"observed_at":"2026-05-13T22:59:04.049910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":"893c50ac-73f6-4abd-8d52-64ff87aa81d2","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:bd9ff4f4bea21425a3b3ff37e72942471f57d5ce217c2386b40131ab040bd4f0","observation_id":"d5af7410-ccd2-49e8-a488-0629f5529204","resolution":{"observed_at":"2026-05-13T22:59:03.814872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mvsplat: Efficient 3d gaussian splatting from sparse multi-view images","venue":null,"work_id":"a1e6f5ed-9f3e-4cbf-ab3a-09b4433996d9","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:f342381435f30bcd6687101194f5ca620ad3df451b72162297d26470a124ac18","observation_id":"7464eaef-3757-45a3-9287-fcd3d4a63759","resolution":{"observed_at":"2026-05-13T22:59:03.819383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"be9085e9-7d81-429c-8bb6-146f4273ca6c","year":2020},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:809d415dc63111fb5292181bd73dd433d15a03b79c9bed082b808cb3f27f45db","observation_id":"5cc4fd03-c0ce-44b4-9543-d7e733e6533e","resolution":{"observed_at":"2026-05-13T22:59:03.824565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion implicit models","venue":null,"work_id":"9dacba58-90a8-4262-b112-f65cc57e099f","year":2021},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:b076ebd9932503279a6562ee3acb257ec2ddb970676c05ff214a55332d6f67de","observation_id":"31b51cdd-3f9f-4b42-a7e4-9f8424cdc538","resolution":{"observed_at":"2026-05-13T22:59:03.829102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hifi-123: Towards high-fidelity one image to 3d content generation","venue":null,"work_id":"2f02e70f-ff2e-4f78-820b-a44f8b5a98bd","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:c96a986d60c095685707ce113831ca9899cc87bb82aad284a779a32e5027c562","observation_id":"8f63887e-ef8b-4862-ac39-25c91f11cc1f","resolution":{"observed_at":"2026-05-13T22:59:03.833396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Make-it-3d: High-fidelity 3d creation from a single image with diffusion prior","venue":null,"work_id":"ceaa4dc6-24de-4b79-b41f-0a335c38e8df","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:3a27002747f5320ab7e3db3ce99871e89fe1afdddbbb8f5f4d2fed0599fa3d39","observation_id":"f7a27484-b5d1-4c56-af07-6e722f3dc311","resolution":{"observed_at":"2026-05-13T22:59:03.837379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamcraft3d: Hierarchical 3d generation with bootstrapped dif- fusion prior","venue":null,"work_id":"096a25cf-1d8b-4030-99d4-6242982c8040","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:381aa4cba686bcbc69d89e285fb8597ef3f7f86fc6ec32ac911b7eb592ab37ef","observation_id":"f9dc6734-cf34-4803-9a0c-b6b22fd2d3bf","resolution":{"observed_at":"2026-05-13T22:59:03.842210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gen- erative novel view synthesis with 3d-aware diffusion models","venue":null,"work_id":"cf0dc40f-cea2-44d6-a8c3-c70e22a0080f","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:df6f5cefd61d84b1a2fb75bca4af6c2029d20ef0280fbfb173c07cd98c0d2276","observation_id":"91d9aa13-2484-4267-a802-d9a62cac73cb","resolution":{"observed_at":"2026-05-13T22:59:03.846677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":"dda28e31-87c2-45b1-b73f-d28f84760be9","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:3912e060434e533f411080d278630ffd5ac60c9f9301ebc7825a46082a000e74","observation_id":"08dc4aab-9582-46cc-ba9b-5ab24ab1acf6","resolution":{"observed_at":"2026-05-13T22:59:03.850547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-07-06T04:39:20.735523Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":"1512.03012","doi":"10.1111/2041-210x.12301","metadata_source":"pith","pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"ShapeNet: An Information-Rich 3D Model Repository","venue":"cs.GR","work_id":"b2ac5b60-daa9-435b-9369-12271e126edd","year":2015},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:ae32649c5d26d569e379e961f53b65037127bf87eb61d911071313bb9b34a378","observation_id":"5d833021-eb19-45cd-95fa-a4123e237a69","resolution":{"observed_at":"2026-05-13T22:59:03.749247Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Novel view synthesis with diffusion models","venue":null,"work_id":"2fdd2f6b-a94f-49cc-8a54-0c9ad18a8506","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:47873ba38366c846cf2e37a746ff62d2a6819840a2b3b4ed3d439d6dbd428331","observation_id":"954cf13e-487f-47d3-9f58-dd82ec3a3514","resolution":{"observed_at":"2026-05-13T22:59:03.853647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Common objects in 3d: Large-scale learning and evaluation of real-life 3d category reconstruction","venue":null,"work_id":"12747fd1-b83e-477e-a961-1a45a4e7c55b","year":2021},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:37e073dfbd080ae3db4fe6f83d9d3e2f7f29f95c58460b163b66d1533abcd939","observation_id":"a15a191e-ec30-45d2-866d-81f3e79f829f","resolution":{"observed_at":"2026-05-13T22:59:03.857059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mvimgnet: A large-scale dataset of multi- view images","venue":null,"work_id":"15d6801c-c1cd-441d-92de-f15bc248953a","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:1585998585b860574d74f1f14d7af5ca4d969fc6104156a4045560c91f1f5302","observation_id":"02ca503a-8fdd-478f-ad5d-cb6d1ab3a83c","resolution":{"observed_at":"2026-05-13T22:59:03.860467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reconfusion: 3d reconstruction with diffusion priors","venue":null,"work_id":"33905402-f04b-4be0-b341-ae706d221067","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:caf3716c5af32217d4c0d627bdf89f4ed8fc6a18cad6524b47ecdc5d7ed7f404","observation_id":"ac80f883-d9a9-4117-9841-4731432ff63e","resolution":{"observed_at":"2026-05-13T22:59:03.863783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Text2nerf: Text- driven 3d scene generation with neural radiance fields","venue":null,"work_id":"ab9d5e30-f3c9-439b-8605-63299f29ac58","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:c3f9fa50800760d7461941f36ffc5bc4d394f882e584a2e088212e555ecd3b3e","observation_id":"350f9bd5-d7c6-44b2-985e-9c6ade861b52","resolution":{"observed_at":"2026-05-13T22:59:03.978198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"26c244d0-e414-4a26-8a65-558c6f890b6d","year":2022},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:2ce3cb9eacf7c723f5a20e0d915969345b410265bcad8e220148681805d5d491","observation_id":"fdf7ef7d-4b1a-4b87-8bd3-65b3a005642f","resolution":{"observed_at":"2026-05-13T22:59:03.870528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"6ebb87f8-c193-498f-ae5b-20d8ed5fc07c","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:817e02523729b08eae7c8d34b5b7129d0e3ab3a39460aaf76ff500a9785d3e23","observation_id":"f934fa6d-c0ab-48e6-9755-ec28971eced0","resolution":{"observed_at":"2026-05-13T22:59:03.874530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"T2i- adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":"a1143c44-5545-4bd8-b39a-c4867891f5ed","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:3cd31d5786928c1450d9a8b4b1c95505e003ebb57dd09d2dd133ccd66e517f38","observation_id":"4403c5a3-ef2a-42a3-bfc8-bfb320bd5179","resolution":{"observed_at":"2026-05-13T22:59:03.878585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":"51aefa04-5cc5-4cab-91fa-f76b1605fd32","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:1d2dcae7da6361fdf89724a35400fec12c84c31250fb2864cd8a3a6ee6ece550","observation_id":"c4e38322-2472-4bc0-ad2b-e2f475491357","resolution":{"observed_at":"2026-05-13T22:59:03.882670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17933","last_updated":"2024-05-28T07:58:33Z","snapshot_observed_at":"2026-07-06T18:21:09.808086Z","submitted_at":"2024-05-28T07:58:33Z","title":"ToonCrafter: Generative Cartoon Interpolation","version":1},"cited_work":{"arxiv_id":"2405.17933","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17933","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tooncrafter: Generative cartoon interpolation","venue":null,"work_id":"8cf753ff-e7e2-40c5-baf1-140060a94890","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2405.17933","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:f5c8863fecec283fbdec4fea93e1675ae73bbd43b7a2052b5336d04a038d176a","observation_id":"d78e9b5f-94a4-4508-8169-d51a0063eadc","resolution":{"observed_at":"2026-05-13T22:59:03.781353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Make-your-video: Customized video generation using textual and structural guidance","venue":null,"work_id":"b461e2c4-ece8-4408-8b6d-33a0b2896aaf","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:6394d17899c771846b34c489fbe7326c0eb4a194f45651882a49b97634546128","observation_id":"8b5e8dd1-4fbe-41b0-bbdc-e3fc82d093a3","resolution":{"observed_at":"2026-05-13T22:59:03.886969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":"ca5420e9-8633-4db1-915d-e7bdedf5f723","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:741dd9323adf4f84baa5f6ca253e34e100763f0a9d63d22f5f5a4e195b25b1f0","observation_id":"8f61b207-e6a6-4867-8c38-2942e0db730e","resolution":{"observed_at":"2026-05-13T22:59:03.891159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":"2308.08089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-07-04T20:10:08.842410Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","venue":"cs.CV","work_id":"eb6df0b7-199d-4cc7-8711-9cd5a6e25349","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:ce259e0c75bc06ccbf06ccc19bee6ae9d1b547a9b9e1a5f15774d2ccfd7a3452","observation_id":"d1b85baf-e285-466e-a8fe-c1b5b1deb4fa","resolution":{"observed_at":"2026-05-20T13:03:58.521687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20222","last_updated":"2024-07-11T16:26:03Z","snapshot_observed_at":"2026-07-06T18:22:48.671656Z","submitted_at":"2024-05-30T16:22:22Z","title":"MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2405.20222","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20222","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mofa-video: Controllable image animation via generative motion field adaptions in frozen image-to-video diffusion model","venue":null,"work_id":"bfcae340-7c31-4f04-b994-4ccb615a7056","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2405.20222","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:692de61a845d73ae2808df152f5eb762d9586a402913774885d5b46b7fbd4919","observation_id":"9862d63b-b638-4451-9c5c-d9d78c5c4a72","resolution":{"observed_at":"2026-05-13T22:59:03.705827Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02473","last_updated":"2024-01-04T18:59:24Z","snapshot_observed_at":"2026-07-06T17:11:46.822922Z","submitted_at":"2024-01-04T18:59:24Z","title":"VASE: Object-Centric Appearance and Shape Manipulation of Real Videos","version":1},"cited_work":{"arxiv_id":"2401.02473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.02473","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vase: Object-centric appearance and shape manipulation of real videos","venue":null,"work_id":"498af67a-ccc1-4992-84da-c57b42adcefa","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2401.02473","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:f39d6f1b3e9398e96147f77fd8e3eb220eb735124276b1fe50fc218cf5047623","observation_id":"755f2238-1fd5-4dc3-885c-f969a1a193e6","resolution":{"observed_at":"2026-05-13T22:59:03.711675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":"2307.04725","doi":"10.48550/arxiv.2307.04725","metadata_source":"pith","pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","venue":"cs.CV","work_id":"1f9d1d3b-a6d6-45a9-9f13-51393c03be8a","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:92178eb79c7e07e4643a3052b3f1a4115b53c38185a3458ad8ced56dd3c1bd86","observation_id":"21f0167e-c5d2-4392-99ca-92a25ddd6287","resolution":{"observed_at":"2026-05-13T22:59:03.718854Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"009daaeb-996a-4ab5-8b40-6a52c9b04341","year":2022},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:a176f00417ed0434bc3cda9e342954847bcca571364ec3f699c49dc85916e93e","observation_id":"b1581dfc-8542-4d73-9f23-d04a03080abb","resolution":{"observed_at":"2026-05-13T22:59:03.895163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multidiff: Consistent novel view synthesis from a single image","venue":null,"work_id":"cd492021-eb15-4021-b89e-ddb9ba9621da","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:2c53c3fef320adab8e537daf992f3cad7800c20393e5f386e4844894d3074cbb","observation_id":"00afada1-ff03-4462-8b75-3b15a5672467","resolution":{"observed_at":"2026-05-13T22:59:03.900722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scannet: Richly-annotated 3d reconstructions of in- door scenes","venue":null,"work_id":"1aa479d4-8a44-4e6b-bc9e-01a74e7b137d","year":2017},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:63ef4e9111e6892cdec2d1ce588ec06860010279a69af23407ce6809cb90b47b","observation_id":"11e7060e-2579-4f32-b5a5-7a63804c6006","resolution":{"observed_at":"2026-05-13T22:59:03.907515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2406.02509","doi":"10.48550/arxiv.2406.02509","metadata_source":"pith","pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","venue":"cs.CV","work_id":"ef36842f-bbba-4a74-9df2-ec15c109c1b3","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:d01ad3fc758a13274897768f7001728cb25c1159d2b5e0b27121e88e5c9fc324","observation_id":"cac4a3a0-6a93-4b0a-900b-d14a63a5ca24","resolution":{"observed_at":"2026-05-16T19:43:33.899731Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2404.02101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-07-10T01:46:41.167891Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","venue":"cs.CV","work_id":"1c05c278-c023-4ef0-a359-25a41f1065eb","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:a047e8c9dd34a8f3dbd179dcdcdfb20a45d8482dc35d0548216690dee4933149","observation_id":"26159c90-94c6-4ce5-961d-81d9dde20e69","resolution":{"observed_at":"2026-05-13T22:59:03.761725Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Light field networks: Neural scene representations with single-evaluation rendering","venue":null,"work_id":"0f1316de-cbdf-4296-9ac4-88cc25a51cbf","year":2021},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:dc1b3fcd224c9ba742eabadb4e34ff380441894e0344bb2f6baeacf8bbfbe8d2","observation_id":"aad8629e-bb96-4b39-9038-f2856be78791","resolution":{"observed_at":"2026-05-13T22:59:03.911959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Latent-nerf for shape-guided generation of 3d shapes and textures","venue":null,"work_id":"9132d65b-56e3-4c6e-87c3-222d8b9baccc","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:c4ac5846636f73c2f6e8b462fcba3e439fe6bac2036b56688407ab6f6e7424a2","observation_id":"cb225bf0-0777-40e5-82b1-f7b637a4cf72","resolution":{"observed_at":"2026-05-13T22:59:03.915530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Plastria, “The weiszfeld algorithm: proof, amendments and extensions, ha eiselt and v","venue":null,"work_id":"72854e79-5231-49e0-96fa-e9c1f13ed8a6","year":2011},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:299d6c989259a4abd86ef98c7376ee05c466b05fa9c1950787954156d7611fe7","observation_id":"7227e290-5d48-479b-9769-1da56f0aef20","resolution":{"observed_at":"2026-05-13T22:59:03.919369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transfer- able visual models from natural language supervision","venue":null,"work_id":"7581881f-9667-4744-a750-fecef2a49718","year":2021},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:5cea07745fbffacd7350bc004f1ba6064d7bdd41903af5b61ae4ba15655ff733","observation_id":"6064283c-c4c8-4d48-8023-dc3a7230e914","resolution":{"observed_at":"2026-05-13T22:59:03.923132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10314","last_updated":"2024-05-16T17:59:05Z","snapshot_observed_at":"2026-07-06T18:15:24.541427Z","submitted_at":"2024-05-16T17:59:05Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","version":1},"cited_work":{"arxiv_id":"2405.10314","doi":"10.48550/arxiv.2405.10314","metadata_source":"pith","pith_arxiv_id":"2405.10314","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","venue":"cs.CV","work_id":"16da851d-11ab-482c-8a09-2978d97a967c","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2405.10314","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:a6ee3993d9865b58b82ae05e35705261790b19892884c0fff2cb417a73b3776f","observation_id":"72956a2d-e22b-486f-b08d-6be43e452f03","resolution":{"observed_at":"2026-05-19T21:29:51.322354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"View planning in robot active vision: A survey of systems, algorithms, and applications","venue":null,"work_id":"f28ae422-a6f3-4496-b611-98fdae34a427","year":2020},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:e884762647a27c1cf9ca28bdfdf4fb7ff70eaa6559ce2d72e4126401c13309ed","observation_id":"453b5b2d-4a7e-4e00-8943-092e90afd559","resolution":{"observed_at":"2026-05-13T22:59:03.926977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pred-nbv: Prediction- guided next-best-view planning for 3d object reconstruction","venue":null,"work_id":"a32a113f-f316-47a4-bbf0-973a20f3a7bf","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:0fba18a2395505e64656fde619cbdee3d75cc76957e3445a559476d642279598","observation_id":"7a4a5d65-e94b-4892-bbeb-b30281c6ca0e","resolution":{"observed_at":"2026-05-13T22:59:03.930744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neu-nbv: Next best view planning using uncertainty estimation in image-based neural rendering","venue":null,"work_id":"311c3eae-cf72-4dae-b8a7-2d40dd025b90","year":2023},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:532078dbac7cbee98a83df40e7392a33bb517c35554eb8949513065399657035","observation_id":"ec49238d-7f08-411a-8a5b-c17cfb997f53","resolution":{"observed_at":"2026-05-13T22:59:03.934476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An infor- mation gain formulation for active volumetric 3d reconstruction","venue":null,"work_id":"385c74d7-74f1-4c29-a6c4-d3f109a9ccb3","year":2016},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:8d58ef7fdd90bedf554a19aca12bdab7ecc26442e3111a277b85928cd262ebd6","observation_id":"a7904b55-886a-433f-b42e-7c15bdb48575","resolution":{"observed_at":"2026-05-13T22:59:03.939393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Next-best view policy for 3d reconstruction","venue":null,"work_id":"adedbe54-74ae-4bcf-b38a-79ecf6f0bd2f","year":2020},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:2c8c03c1c9ff7a529f7ff524e70a8719bf1bf0bf6f5d53cb935c636166c30ae1","observation_id":"374c18f6-7a84-4965-aff5-5967df67c930","resolution":{"observed_at":"2026-05-13T22:59:03.942202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d photography using context-aware layered depth inpainting","venue":null,"work_id":"396a6e4e-de09-4765-a021-00fdcf7d6381","year":2020},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:39aae3416f04ad92ed6b7ebb59035958625ff525d6da17e3ff4d853e50732000","observation_id":"2193e30d-9c3f-4384-9a02-748fa1237914","resolution":{"observed_at":"2026-05-13T22:59:03.945215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":"bed9a167-b33d-4419-ae66-56b51c9d4937","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:f521b7669cb72fe87425004d4e32fe1549840b4bea49579137d223a88669ff57","observation_id":"761cf61c-c3f6-441b-b728-90fc8683a820","resolution":{"observed_at":"2026-05-13T22:59:03.948351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08501","last_updated":"2020-07-16T17:53:02Z","snapshot_observed_at":"2026-07-06T09:38:53.228850Z","submitted_at":"2020-07-16T17:53:02Z","title":"Accelerating 3D Deep Learning with PyTorch3D","version":1},"cited_work":{"arxiv_id":"2007.08501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.08501","snapshot_observed_at":"2026-07-04T20:30:07.174987Z","title":"Accelerating 3D Deep Learning with PyTorch3D","venue":"cs.CV","work_id":"28c48e8f-4d02-49fb-9564-fa686720784e","year":2020},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2007.08501","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:04d5321595266f742d425d5e2cd1aed26a9d15ae4d07c01e25de780b2a7cdbdb","observation_id":"00e9c0bd-24fc-42e4-96e9-759de231d17a","resolution":{"observed_at":"2026-05-15T10:04:45.249565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":"2207.12598","doi":"10.1109/cvpr52733.2024.02494","metadata_source":"pith","pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Classifier-Free Diffusion Guidance","venue":"cs.LG","work_id":"acf2c588-c088-4a6c-938e-150ad7c666d7","year":2022},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:6265f6f32f4a446c182358103a2e86af3e53f92e3975e28e7256b4f49855e923","observation_id":"0c01df54-3e16-4b67-bb70-cd1c3b467140","resolution":{"observed_at":"2026-05-13T22:59:03.743064Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":"cce11b0c-711d-40ff-b8b2-e84c69f33e55","year":2004},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:4fb273ffbebaef408fe8095c71c93100eb659fd57a4d1ee4fa3d130e39007229","observation_id":"0b92b890-b424-4279-805e-a922aeec2bf2","resolution":{"observed_at":"2026-05-13T22:59:03.952876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"9de52128-f5a4-4c31-b050-4c137c8d3ff4","year":2018},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:31a403564a2ec78a668cc412916fc27505571a3d3d4e90c9758b238a25524482","observation_id":"20a516bb-6a8c-4312-bfae-92f39adfe119","resolution":{"observed_at":"2026-05-13T22:59:03.956966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"4de59312-da60-4835-a1f0-44922bcbbfee","year":2017},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:3130e2ac0cddb40f4ad97fb7c0ac2748338b501667029af8938b83f6afe88ba9","observation_id":"eff03e49-bb02-4cbe-a6a5-bcc81d15b28c","resolution":{"observed_at":"2026-05-13T22:59:03.961067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structure-from-motion revis- ited","venue":null,"work_id":"f033b297-d14c-409c-bce9-2e04f1c5a88b","year":2016},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:f539b76ade2728871d524a9d151f6cacff83bbaeebd7b69b2041c2dcbaa7f78e","observation_id":"b033b2f8-c8d2-4c80-8f9b-cc0927e47906","resolution":{"observed_at":"2026-05-13T22:59:03.964633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dngaussian: Optimizing sparse-view 3d gaussian radiance fields with global-local depth normalization","venue":null,"work_id":"8a8fa6b5-2000-4200-81e9-d886f63d2a90","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:4de08b834da47c927dfb7b450cc73522007f8d1959b4f75cbc4c630e110111ec","observation_id":"58bb6700-b032-4c26-a9dc-7d345c791a8a","resolution":{"observed_at":"2026-05-13T22:59:03.968500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fsgs: Real-time few-shot view synthesis using gaussian splatting","venue":null,"work_id":"0d9f1bea-f806-402d-b16b-d7d2c14578c5","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:63a229fbe4fcce7e70d8ac7742fd9103d58102038d626d754408d25e8314a4c6","observation_id":"d0f4f92d-7eae-4e2e-be9e-a28016aca3a3","resolution":{"observed_at":"2026-05-13T22:59:03.971823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20309","last_updated":"2025-07-03T22:28:07Z","snapshot_observed_at":"2026-07-06T17:53:11.000124Z","submitted_at":"2024-03-29T17:29:58Z","title":"InstantSplat: Sparse-view Gaussian Splatting in Seconds","version":6},"cited_work":{"arxiv_id":"2403.20309","doi":"10.48550/arxiv.2403.20309","metadata_source":"pith","pith_arxiv_id":"2403.20309","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"InstantSplat: Sparse-view gaussian splatting in seconds","venue":"cs.CV","work_id":"d0ce5d51-e63b-4f88-a247-2349dca192d5","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2403.20309","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:41e139a72c247bbece4eea5e77c44aab1ab64d671f95ad690db6a2dcef3d499e","observation_id":"24224cb2-0346-4d2f-9623-b02fea26e9f3","resolution":{"observed_at":"2026-05-13T22:59:03.787262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-07-06T18:47:56.109836Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:1f02eeec7a1250eab1eff849a424c802fd3179cc95fd52103a21b75b358e7f09","observation_id":"fe1b001a-3e8a-44ae-8e2c-66d23bd7fe86","resolution":{"observed_at":"2026-05-13T22:59:03.794074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pl ¨ucker coordinates for lines in the space","venue":null,"work_id":"ae387aed-f898-41a4-915b-51a0d311377f","year":2020},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:53148528189edd3eccd1e064bbac25745ba6651545aa9b17c5a6edb3036c0dab","observation_id":"3d1a05d8-a523-4a3f-a288-61dae75a8798","resolution":{"observed_at":"2026-05-13T22:59:03.975027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-23T06:31:01.910684+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":19,"verified_fuzzy":60},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-23T06:31:01.910684+00:00","source":"crossref"},{"observed_at":"2026-07-23T06:30:56.940895+00:00","source":"retraction_watch"}],"thesis":"As of 23 July 2026, this Paper Citation Record lists 79 of 79 outbound references and 89 inbound Pith citation observations for arXiv:2409.02048."}