{"as_of":"2026-08-04T03:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f88fb77d633c9680607a8f65b33a72b0a5ce09a33639a850b3714a0b956fd11c","coverage":[{"denominator":116,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T01:59:23.928725Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:34:29.328740Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-19T15:42:38.216032Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"cited_work":{"arxiv_id":"2511.00503","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.00503","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","venue":"cs.CV","work_id":"81ed134a-526a-4665-9718-6c81c4ad1ef5","year":2025},"citing_paper":{"arxiv_id":"2605.15391","last_updated":"2026-05-14T20:24:23Z","snapshot_observed_at":"2026-07-06T23:26:41.848219Z","submitted_at":"2026-05-14T20:24:23Z","title":"PanoWorld: Geometry-Consistent Panoramic Video World Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T15:41:32.971032Z"},"links":{"cited_paper":"/paper/2511.00503","citing_paper":"/paper/2605.15391"},"observation_digest":"sha256:8652991395780fdb450327a03f16d7f879004809d8da469be2050ce235af41e9","observation_id":"9e09bfb2-fed2-4b50-b718-cb3c2a3dd32d","resolution":{"observed_at":"2026-05-19T15:42:38.217877Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.00503","snapshot_observed_at":"2026-08-02T06:34:29.328740Z","title":"Diff4splat: Controllable 4d scene generation with latent dynamic reconstruction models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12503","last_updated":"2026-07-15T03:49:06Z","snapshot_observed_at":"2026-08-02T06:34:23.419238Z","submitted_at":"2026-07-14T08:35:07Z","title":"DynTrace: Tracking Dynamic Object Evidence for 4D Spatio-Temporal Reasoning in MLLMs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T06:34:29.328740Z"},"links":{"cited_paper":"/paper/2511.00503","citing_paper":"/paper/2607.12503"},"observation_digest":"sha256:0dca29741f5f0d6a905d8750779ce63489a57eedc1058e158f3294e3b5af3eba","observation_id":"76f7924b-c2cb-46f2-b27b-7d8bee34576b","resolution":{"observed_at":"2026-08-02T06:34:29.328740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2511.00503/citation-record","integrity":"/paper/2511.00503/integrity","json":"/paper/2511.00503/citation-record.json","paper":"/paper/2511.00503"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.311803Z","title":"write newline","venue":null,"work_id":"8e5fda61-e601-4df4-8204-015bee341570","year":null},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:ff0e5bdb55d78ffb87b50ed1c760701577ba51d8102e4487b31130704027a585","observation_id":"7927a99f-5709-482a-a33d-1d08441229dd","resolution":{"observed_at":"2026-05-18T02:00:40.442018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":"2305.13245","doi":"10.48550/arxiv.2305.13245","metadata_source":"pith","pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","venue":"cs.CL","work_id":"b73ad5b2-e553-4c71-b0c9-67e67ba7b158","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:d244b3c8ec2abd235e5cc15543ac0ad91ff1c57fc32aec1c68cf71592da3b6b7","observation_id":"26d35a40-550d-4192-a93d-4c9d3536b952","resolution":{"observed_at":"2026-05-18T02:00:39.496513Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18673","last_updated":"2025-05-06T13:11:14Z","snapshot_observed_at":"2026-07-06T19:58:13.816588Z","submitted_at":"2024-11-27T18:49:13Z","title":"AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers","version":4},"cited_work":{"arxiv_id":"2411.18673","doi":"10.48550/arxiv.2411.18673","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18673","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Ac3d: Analyzing and improving 3d camera control in video diffusion transformers","venue":null,"work_id":"36e974e3-9fca-4328-b671-cab2879e8b4c","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2411.18673","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:b2063d3f98d6e796dd5ef37e954e5d4d3b7e130d80afe553e0dd580d6cbeb49b","observation_id":"0408e8b3-c9ba-44bd-a6e1-0d62e8502b21","resolution":{"observed_at":"2026-05-18T02:00:39.600936Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13843","last_updated":"2024-09-24T11:28:21Z","snapshot_observed_at":"2026-07-06T15:07:29.959438Z","submitted_at":"2023-03-24T07:37:09Z","title":"CompoNeRF: Text-guided Multi-object Compositional NeRF with Editable 3D Scene Layout","version":5},"cited_work":{"arxiv_id":"2303.13843","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.13843","snapshot_observed_at":"2026-07-04T15:19:56.421811Z","title":"Componerf: Text-guided multi-object compositional nerf with editable 3d scene lay- out","venue":null,"work_id":"dba71109-bf84-4334-baf8-e09e53a8c099","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2303.13843","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:aa0e016d4918ed3dbaf5d2ceba6d6b26efb4cd098e2ba72e1fb0820d201b2891","observation_id":"ce08deb3-07ef-4448-adaf-5f60f743dcee","resolution":{"observed_at":"2026-05-18T02:00:39.661907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11647","last_updated":"2025-07-09T08:09:06Z","snapshot_observed_at":"2026-07-06T20:52:55.699004Z","submitted_at":"2025-03-14T17:59:31Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video","version":2},"cited_work":{"arxiv_id":"2503.11647","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11647","snapshot_observed_at":"2026-07-04T16:29:56.626897Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video, March 2025","venue":null,"work_id":"468e39a2-8f08-49d5-b3a6-92df4205b5f3","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2503.11647","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:f0cd8d256a9e055adeaaf9ef13025ba789fac1317b558bda5262e2a664912802","observation_id":"a64f4a9b-017f-42f2-8040-883f4e1bc8d6","resolution":{"observed_at":"2026-05-18T02:00:39.487138Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":"2308.12966","doi":"10.48550/arxiv.2308.12966","metadata_source":"pith","pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-07-10T11:37:03.214945Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","venue":"cs.CV","work_id":"cbc2bb21-b6bb-46c0-80bf-107e195ffe10","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:98db3fcf274f554e7cf8dbbcafa4f047020b0e8ff0bfa5cbcf73916385a93ad9","observation_id":"3387155c-b598-49e4-8478-2dae044f2a7c","resolution":{"observed_at":"2026-05-18T02:00:39.492500Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-07-11T02:27:48.842637Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:679f4f07b0ed4a02445e0b6615fac9daf2ba8446e600f30bfbad96d3e1953d52","observation_id":"f14f894a-3fcf-48d8-bd25-6f97cf980ec4","resolution":{"observed_at":"2026-05-18T02:00:39.634586Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Align your latents: High-resolution video synthesis with latent diffusion models","venue":null,"work_id":"b76e9787-6995-484d-b899-6099c5272934","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:d5a2129d427e3c45c4b32dd6ea62921b89b4b6423a73ab5532f24dca8119fe0e","observation_id":"ec5a360f-69ed-4ebc-8286-3f83d7797b5f","resolution":{"observed_at":"2026-05-18T02:02:18.826749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.10773","last_updated":"2020-01-29T12:13:20Z","snapshot_observed_at":"2026-07-06T08:53:28.193420Z","submitted_at":"2020-01-29T12:13:20Z","title":"Virtual KITTI 2","version":1},"cited_work":{"arxiv_id":"2001.10773","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.10773","snapshot_observed_at":"2026-07-07T22:24:11.153404Z","title":"Virtual KITTI 2","venue":"cs.CV","work_id":"c0d9c030-aa25-44e7-9cc4-72d7403f1447","year":2020},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2001.10773","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:e1670a4b937482d0116123cc8083f16fa166119df86b42c70dd59b9391210542","observation_id":"e243a2f0-a828-4d62-ad25-fe5868951eed","resolution":{"observed_at":"2026-05-18T02:00:39.501466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video depth anything: Consistent depth estimation for super-long videos","venue":null,"work_id":"349c1812-c38e-4289-8ed3-f9114aca7c81","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:0598f7003d6cabe4fe464556ae74752b4b0b7dd5a2307980c7dcdbca7bc11f87","observation_id":"01113711-6cb7-4420-a602-a7b4b462eba8","resolution":{"observed_at":"2026-05-18T02:00:40.446750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13154","last_updated":"2025-08-18T17:59:55Z","snapshot_observed_at":"2026-07-31T09:01:37.844229Z","submitted_at":"2025-08-18T17:59:55Z","title":"4DNeX: Feed-Forward 4D Generative Modeling Made Easy","version":1},"cited_work":{"arxiv_id":"2508.13154","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.13154","snapshot_observed_at":"2026-07-08T02:04:26.158592Z","title":"4dnex: Feed-forward 4d generative modeling made easy","venue":"cs.CV","work_id":"ad4eb9e0-280f-4afa-aec7-73f914c5dada","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2508.13154","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:9d227cda1af905f1780ace7a15ccc215bfbcf4ca8366bf15fb3a5694f661db1c","observation_id":"fe170c9f-ebf9-4d08-8cca-948bc239b4f6","resolution":{"observed_at":"2026-05-18T02:00:39.443968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02280","last_updated":"2024-05-23T16:27:11Z","snapshot_observed_at":"2026-07-06T18:09:29.876755Z","submitted_at":"2024-05-03T17:55:34Z","title":"DreamScene4D: Dynamic Multi-Object Scene Generation from Monocular Videos","version":2},"cited_work":{"arxiv_id":"2405.02280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.02280","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamscene4d: Dynamic multi-object scene generation from monocular videos","venue":null,"work_id":"d7bb5034-a253-4d6d-b3f6-23cdfdc32ec6","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2405.02280","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:d1c52e0b1dcf8d065902bb3fe87c0ca4d6c28113858c4bf03466a2babbd9f7fa","observation_id":"43965338-6f6f-49cf-b3ea-01fd541b674e","resolution":{"observed_at":"2026-05-18T02:00:39.667731Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamscene4d: Dynamic multi-object scene generation from monocular videos","venue":null,"work_id":"0758da76-b356-4c75-b31e-2b74ae1ddc8a","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:b537c249e971e0e57c401779fecf0fec9114047e8a34dbc4887e4d776c2a9230","observation_id":"dde266df-185d-451b-a48e-ef3e8f3d2fc2","resolution":{"observed_at":"2026-05-18T02:00:40.383999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13384","last_updated":"2023-11-23T11:40:16Z","snapshot_observed_at":"2026-07-06T16:51:06.781541Z","submitted_at":"2023-11-22T13:27:34Z","title":"LucidDreamer: Domain-free Generation of 3D Gaussian Splatting Scenes","version":2},"cited_work":{"arxiv_id":"2311.13384","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.13384","snapshot_observed_at":"2026-07-04T13:49:51.650606Z","title":"Luciddreamer: Domain-free gen- eration of 3d gaussian splatting scenes","venue":null,"work_id":"24a684d2-afbc-461d-9ff8-92fa3c51ff4c","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2311.13384","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:79d1da08162a43e1d946a2fd8965b0d0c2061f10039b1752684a6fe89f495c0e","observation_id":"8ddcc9b9-9e15-4292-99de-74ef868278d9","resolution":{"observed_at":"2026-05-18T02:00:39.605847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":"7c2985b8-5147-47b8-be8f-e376cc0b736d","year":2017},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:9034d09efb89ed807540685eb06982ad508956ce1b74d6270755e76d3747997d","observation_id":"c2e43cb9-e3a3-4a5e-8730-80dc4e3917e7","resolution":{"observed_at":"2026-05-18T02:00:40.387551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":"5f384aa8-0d7a-4f8a-82e8-c2205e6b443f","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:4690dbe752ca0793b51b0d149e77d8469b51bc734c9e4c72c44aeaa3c2cb6088","observation_id":"7c43e3ce-1380-4ae5-bd6f-eef62b422472","resolution":{"observed_at":"2026-05-18T02:00:40.402244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GraphDreamer : Compositional 3D scene synthesis from scene graphs","venue":null,"work_id":"733728b9-95f2-4088-9ca9-29e53a39e2ed","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:3a3ee5989784426484708ca7e68d82ca313d3307c90116c1d68c44e627ac5a7d","observation_id":"75eaacc6-c19c-4436-9138-6b9e5573d454","resolution":{"observed_at":"2026-05-18T02:00:40.379955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":"2307.04725","doi":"10.48550/arxiv.2307.04725","metadata_source":"pith","pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","venue":"cs.CV","work_id":"1f9d1d3b-a6d6-45a9-9f13-51393c03be8a","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:9aa6194aca34ce77361b55e2c34f516ca0b56c92f0494acfe0096c8865bce923","observation_id":"2ab72c4d-706b-4830-9944-5dc78046f7df","resolution":{"observed_at":"2026-05-18T02:00:39.453724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2404.02101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-07-10T01:46:41.167891Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","venue":"cs.CV","work_id":"1c05c278-c023-4ef0-a359-25a41f1065eb","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:96170b63dbb613e1389d19ae24e3d8637f93c07ab15698044374cf56fc61921d","observation_id":"3816882d-7b5c-46c8-8812-1b48c54af196","resolution":{"observed_at":"2026-05-18T02:00:39.516822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10592","last_updated":"2025-03-13T17:42:01Z","snapshot_observed_at":"2026-07-06T20:52:09.743730Z","submitted_at":"2025-03-13T17:42:01Z","title":"CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2503.10592","doi":"10.48550/arxiv.2503.10592","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.10592","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Cameractrl ii: Dynamic scene exploration via camera-controlled video diffusion models","venue":null,"work_id":"16b7fb48-eb39-4b7f-bf7c-9b57914e2dce","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2503.10592","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:1eaa9774b3028b7c1113d59fd2f81ec565775dc9abeca67dad532cb1adf2bb26","observation_id":"0e636d6f-460c-4ae1-bc09-f40140c02b8c","resolution":{"observed_at":"2026-05-18T02:00:39.629671Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:24:40.331398+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:24:40.331398+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"fafa2ee6-9642-4e76-9770-d1aae476a8d3","year":2020},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:f10f235ab858b1bbcea6364f4f8625bc9e437822ee9259687881d8fbf0c92adc","observation_id":"3d05de0e-292a-42d6-87f1-9ad0aba75c4f","resolution":{"observed_at":"2026-05-18T02:02:18.865573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video diffusion models","venue":null,"work_id":"e394682c-b4a7-4506-a375-89083ec8084a","year":2022},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:fa0346c56030456e01bb10e9201e5df64d70e60eb8ee7e616e94584392354871","observation_id":"1cc7da8b-c3a7-4bd3-8ae4-1e1f1619824f","resolution":{"observed_at":"2026-05-18T02:02:18.786740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"85beda94-9bd2-4d65-b785-2bc3093681b1","year":2022},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:7b600e1c0931f23444cfbd3072f96c9bfed2f7e2fd7d618911b9e3d011752928","observation_id":"e110fc33-ca41-48ac-bfd3-ef46610f876e","resolution":{"observed_at":"2026-05-18T02:02:18.881278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pl \\\"u cker coordinates for lines in the space","venue":null,"work_id":"4da57f63-90cf-439d-9cc9-125e033a702c","year":2020},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:b8ba1096b296f49f40ed0fb3c6fafe783f5e7370b1863f88f929d6326b9eac0b","observation_id":"8fb61359-9730-47d0-8c11-b52ef3ec1fb8","resolution":{"observed_at":"2026-05-18T02:02:18.851285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stereo4d: Learning how things move in 3d from internet stereo videos","venue":null,"work_id":"157306aa-668d-476d-a1c1-2de684e80c63","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:da418fd900a9bec15e0b92a6bbb62a70396c81eb66fee5dee5c2f2d44185d5b1","observation_id":"48e57958-3ee4-48fb-befc-afb3144fda94","resolution":{"observed_at":"2026-05-18T02:02:18.769774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamicstereo: Consistent dynamic depth from stereo videos","venue":null,"work_id":"c012ea2d-c6c7-465a-9740-edaa3de76bb7","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:e31e4caa143c534e185702d3c73426b6689f830b3f5fa4c9c8f8d059299ef5b7","observation_id":"46f6148e-8efb-45fd-b2cf-3af21b35a607","resolution":{"observed_at":"2026-05-18T02:02:18.766526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"3f9125c7-0eff-4f3b-93c7-1720daddd9f9","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:1cee6ea09704ffa8fac4f2ade5d3001e7759fdf3c9ac3c090db713c22f1382bf","observation_id":"4c7dda07-6e90-463c-8a8c-ba5accb2e205","resolution":{"observed_at":"2026-05-18T02:02:18.863857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"ecdc7214-58a8-4e1c-8120-7efe8560e6aa","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:02bffcd584f79fa8a979c4f50b0ce7c9855591084e5e0a5fe0675ad6f1a26d98","observation_id":"1a3c9f2b-32e0-418b-bc70-a69df77bb5e8","resolution":{"observed_at":"2026-05-18T02:02:18.856539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17421","last_updated":"2024-11-29T18:53:12Z","snapshot_observed_at":"2026-07-06T18:20:44.070255Z","submitted_at":"2024-05-27T17:59:07Z","title":"MoSca: Dynamic Gaussian Fusion from Casual Videos via 4D Motion Scaffolds","version":2},"cited_work":{"arxiv_id":"2405.17421","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17421","snapshot_observed_at":"2026-07-03T10:58:02.629387Z","title":"MoSca: Dynamic Gaussian Fusion from Casual Videos via 4D Motion Scaffolds, November 2024","venue":null,"work_id":"bead5bcc-cba8-4ac4-a900-187fe37c332c","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2405.17421","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:70c2b08440de919527cad132bff422f864e6b3febd7fb140bb602c49340fce8c","observation_id":"022e8960-2a9d-4519-a08d-caa62fe52d0e","resolution":{"observed_at":"2026-05-18T02:00:39.482861Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09756","last_updated":"2024-06-14T06:46:30Z","snapshot_observed_at":"2026-07-06T18:30:46.405694Z","submitted_at":"2024-06-14T06:46:30Z","title":"Grounding Image Matching in 3D with MASt3R","version":1},"cited_work":{"arxiv_id":"2406.09756","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09756","snapshot_observed_at":"2026-07-03T15:08:32.534743Z","title":"Grounding image matching in 3d with mast3r","venue":null,"work_id":"bc219327-fe47-4a7d-b2de-43dd11edecd2","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2406.09756","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:44a4fdab046ae7e023e944224efd7ddfbc4b9a0f61f03fff485690dbf6b9269d","observation_id":"870262c9-fbb2-4da1-a76e-a31f2cae5231","resolution":{"observed_at":"2026-05-18T02:00:39.614674Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13527","last_updated":"2024-10-03T06:26:49Z","snapshot_observed_at":"2026-07-06T18:33:41.653334Z","submitted_at":"2024-06-19T13:11:02Z","title":"4K4DGen: Panoramic 4D Generation at 4K Resolution","version":3},"cited_work":{"arxiv_id":"2406.13527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.13527","snapshot_observed_at":"2026-07-03T16:48:39.678063Z","title":"4k4dgen: Panoramic 4d generation at 4k resolution","venue":null,"work_id":"ab21db1b-9928-4b70-8385-d00cc111a9c8","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2406.13527","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:fe52ad1f62b4a5d14392b744059591264775cbc034749cd1429fc71e3bc39b97","observation_id":"368034dc-5617-4353-96f1-c2869c7daeb0","resolution":{"observed_at":"2026-05-18T02:00:39.619452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4k4dgen: Panoramic 4d generation at 4k resolution","venue":null,"work_id":"fe53ac4b-4582-41e5-8294-cd48dcbbd9ae","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:34d9876ee14b9c4484d1eba1db421ddd69901bfe4cb31c82ef91248262186788","observation_id":"a83dbfc7-9de2-4998-a471-719a8ba70e01","resolution":{"observed_at":"2026-05-18T02:02:18.842100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Matrixcity: A large-scale city dataset for city-scale neural rendering and beyond","venue":null,"work_id":"5f6dcf02-1120-4628-b53c-014f363d5fb5","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:7780220b0e9bbf871dffe76726f62515a14f8978660e456dd1a73bea745fea5e","observation_id":"91f3faf8-3c42-43e4-be46-52e534f86c02","resolution":{"observed_at":"2026-05-18T02:02:18.726070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":"ee7dd8e8-34cd-4d33-a57b-e499160d27f7","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:96a2fe28a069d0e1c9c4f1bb2d7f3c6d1c7eafc0db1cbd78b6ca1cb1800bea19","observation_id":"09d0bbba-3d01-4acc-8988-c8f1dc67b7f4","resolution":{"observed_at":"2026-05-18T02:02:18.773380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynibar: Neural dynamic image-based rendering","venue":null,"work_id":"6c2cb11d-cf53-47df-8c74-53685dd565cc","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:b8e1ae7901868f762dfb1c8fcca0ed1c6eba66a65d5b5d76b2a5891b3400d7cd","observation_id":"8b691a0f-f418-45da-8a7d-f6244694ac60","resolution":{"observed_at":"2026-05-18T02:02:18.885353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Megasam: Accurate, fast, and robust structure and motion from casual dynamic videos","venue":null,"work_id":"2f388b92-7db9-47cd-9e9d-3514d79539d8","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:de4b8222c61bd774049a4c6310c8a03c5cefff79e0ea16d0e07e36a8a648d0fa","observation_id":"02f70d7b-c33f-4a4e-b225-8b3f2cd13785","resolution":{"observed_at":"2026-05-18T02:02:18.810422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12091","last_updated":"2025-04-26T13:48:44Z","snapshot_observed_at":"2026-07-06T20:07:58.873037Z","submitted_at":"2024-12-16T18:58:17Z","title":"Wonderland: Navigating 3D Scenes from a Single Image","version":2},"cited_work":{"arxiv_id":"2412.12091","doi":"10.48550/arxiv.2412.12091","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.12091","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Wonderland: Navigating 3d scenes from a single image","venue":null,"work_id":"3c76a841-5e40-4400-90a9-6c8d930fa18a","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2412.12091","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:cc2ed821ed026b47c5efd76c68ba6e9f77d4c416f0eb9545b66896319581ba35","observation_id":"b211fd67-6299-402f-8351-48f3740567c3","resolution":{"observed_at":"2026-05-18T02:00:39.624496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Plataniotis, Sergey Tulyakov, and Jian Ren","venue":null,"work_id":"e899f76c-c140-46aa-9e09-c664a123a380","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:ee3d0f16b2871f135e202caced1f3a64d2a828665f350b308f569fc47b4c9ba8","observation_id":"1c28f6a7-98e4-48c1-9c40-7b59c95840ac","resolution":{"observed_at":"2026-05-18T02:02:18.831598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Feed- Forward Bullet-Time Reconstruction of Dynamic Scenes from Monocular Videos , December 2024 c","venue":null,"work_id":"d45253d9-ae39-4ef9-b4a9-208b32c28e69","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:8d04fe16a3af0f747cf8f7e7e1a7f65cf0b91b5e792b25df51132b6c21e25c2d","observation_id":"3ec43e5e-3e5c-4e5b-bd70-7e71e28ddc12","resolution":{"observed_at":"2026-05-18T02:02:18.782081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.03526","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T04:37:36.941611Z","title":"Feed-forward bullet-time reconstruction of dynamic scenes from monocular videos.arXiv preprint arXiv:2412.03526","venue":null,"work_id":"6573079c-d826-4be0-bfab-a0187e928bb8","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:9c2ccee532f3e5b6357830c332dff98c3f684d0a37ee315987ea9e29d3f3fff0","observation_id":"973acf80-ea03-4d9b-8f45-97dce9a4131b","resolution":{"observed_at":"2026-05-18T02:00:39.577390Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaufre: Gaussian deformation fields for real-time dynamic novel view synthesis","venue":null,"work_id":"605d7795-6196-4615-8952-6a43e9172eb1","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:5b9f98a77c262931f7e741c049e766b92571fc8e2873f0efe74f60a289500af7","observation_id":"2150c4b6-c8bd-406e-8df2-0e664e396c78","resolution":{"observed_at":"2026-05-18T02:02:18.852939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04717","last_updated":"2024-02-07T10:09:00Z","snapshot_observed_at":"2026-07-06T17:26:43.251349Z","submitted_at":"2024-02-07T10:09:00Z","title":"InstructScene: Instruction-Driven 3D Indoor Scene Synthesis with Semantic Graph Prior","version":1},"cited_work":{"arxiv_id":"2402.04717","doi":"10.48550/arxiv.2402.04717","metadata_source":"pith","pith_arxiv_id":"2402.04717","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Instructscene: Instruction- driven 3d indoor scene synthesis with semantic graph prior","venue":"cs.CV","work_id":"20e2fa85-480c-4923-81ec-7579a7a85bc7","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2402.04717","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:fbe3447668ab5ec2c97db7a5d7038570901432f51c34b1e2730f94f2d6060371","observation_id":"abc11a7a-c9bc-48ba-a7dd-b5142a249d16","resolution":{"observed_at":"2026-05-18T02:00:39.586727Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07580","last_updated":"2025-08-02T19:17:52Z","snapshot_observed_at":"2026-07-06T18:44:12.101916Z","submitted_at":"2024-07-10T12:13:39Z","title":"InstructLayout: Instruction-Driven 2D and 3D Layout Synthesis with Semantic Graph Prior","version":3},"cited_work":{"arxiv_id":"2407.07580","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.07580","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instructlayout: Instruction-driven 2d and 3d layout synthesis with semantic graph prior","venue":null,"work_id":"ce332f2b-8540-4562-8fd1-764b5b20c059","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2407.07580","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:f95cb9e0fcaa09d45a94aed200723a98d8e656d726ebed05c173a354005bc0ef","observation_id":"43186489-5d21-4922-8a09-712185706347","resolution":{"observed_at":"2026-05-18T02:00:39.596674Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16764","last_updated":"2025-01-28T07:38:59Z","snapshot_observed_at":"2026-07-06T20:27:14.226247Z","submitted_at":"2025-01-28T07:38:59Z","title":"DiffSplat: Repurposing Image Diffusion Models for Scalable Gaussian Splat Generation","version":1},"cited_work":{"arxiv_id":"2501.16764","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16764","snapshot_observed_at":"2026-07-03T16:18:37.491258Z","title":"Diffsplat: Repurposing image diffusion models for scalable gaussian splat generation","venue":null,"work_id":"17ed0479-ff33-452b-93a5-35124133b022","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2501.16764","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:297a2670b688742bc1c7a9497cc8e93dd79ebfce35f3e742ad7912c74f14d421","observation_id":"f1792f48-cce1-41bc-ab46-0efde3156d27","resolution":{"observed_at":"2026-05-18T02:00:39.563943Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaussian-flow: 4d reconstruction with dynamic 3d gaussian particle","venue":null,"work_id":"6855b77c-1a2c-4ef0-b5f0-aa8b5ccc521c","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:33c609ca7b4a353357ff48337c63204883bd76c2eb885983a0cdfe32b80bdf96","observation_id":"d87edaae-534f-459c-9f98-6e7d33b5dbf1","resolution":{"observed_at":"2026-05-18T02:02:18.869744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05573","last_updated":"2025-06-05T20:30:28Z","snapshot_observed_at":"2026-07-06T21:37:37.394452Z","submitted_at":"2025-06-05T20:30:28Z","title":"PartCrafter: Structured 3D Mesh Generation via Compositional Latent Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2506.05573","doi":"10.48550/arxiv.2506.05573","metadata_source":"pith","pith_arxiv_id":"2506.05573","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Partcrafter: Structured 3d mesh generation via compositional latent diffusion trans- formers","venue":"cs.CV","work_id":"78943aa6-b9e9-4fc1-8d71-e6bcc0b9a0b4","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2506.05573","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:2e89aff5cf7d3bab4589b6d485eb2c8f7c26e2ddad6834ff5a2a7bd3d16b7ee9","observation_id":"cc66b6bb-b7f1-4345-be0f-d899245eef00","resolution":{"observed_at":"2026-05-18T02:00:39.572893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18982","last_updated":"2025-01-31T09:28:07Z","snapshot_observed_at":"2026-07-06T20:28:52.880548Z","submitted_at":"2025-01-31T09:28:07Z","title":"OmniPhysGS: 3D Constitutive Gaussians for General Physics-Based Dynamics Generation","version":1},"cited_work":{"arxiv_id":"2501.18982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18982","snapshot_observed_at":"2026-07-03T00:57:30.546915Z","title":"Omniphysgs: 3d con- stitutive gaussians for general physics-based dynamics generation.arXiv preprint arXiv:2501.18982","venue":null,"work_id":"97b2be7b-cd3e-4bde-8626-e42d3ede91d5","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2501.18982","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:0fcf7a035b918281121688854dbb7a46528ef4036bd1dbb2cb14c1a11601e6ae","observation_id":"9167727f-9830-4e28-adf4-b7652548747d","resolution":{"observed_at":"2026-05-18T02:00:39.559600Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":"22e6a3aa-c547-491b-9afa-7c11df8c600c","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:654c506847945fe8d794a42e73c3557164424ab10e468b64444d9b0c17e7bafb","observation_id":"564474f5-3544-4bc8-b606-40e3388bc51d","resolution":{"observed_at":"2026-05-18T02:02:18.849105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flow matching for generative modeling","venue":null,"work_id":"15645a3b-33d2-4d7c-9e7c-f36e96539aa2","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:bb4fe955f212abd9e3cec9d79a55e2e2cd0564360df31b35f9a9208514fe22a8","observation_id":"48a51be1-157c-430c-9398-0537df4f5795","resolution":{"observed_at":"2026-05-18T02:02:18.813056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16767","last_updated":"2025-06-25T07:19:44Z","snapshot_observed_at":"2026-08-01T22:53:31.767507Z","submitted_at":"2024-08-29T17:59:40Z","title":"ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model","version":4},"cited_work":{"arxiv_id":"2408.16767","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.16767","snapshot_observed_at":"2026-07-07T14:33:54.364325Z","title":"Reconx: Reconstruct any scene from sparse views with video diffusion model","venue":"cs.CV","work_id":"0a07d24b-c2f2-4a48-8f62-a71df4e53f9e","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2408.16767","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:2f2ce68157c2f8fa165bd7765a507dd1df2b3695804f70f98622d4e480b6223c","observation_id":"5254776d-bffe-4324-8653-f1861d5d14dc","resolution":{"observed_at":"2026-05-18T02:00:39.555261Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"30ece2e7-3c79-4ec7-afc1-0cb2a9c0f7d9","year":2019},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:cfa28d5b3a41700c4cc13238bfb3e83aab5721b855675d70c7e1e063ce6ac1d1","observation_id":"408ae6f4-169c-4418-abb2-99abbdcbd265","resolution":{"observed_at":"2026-05-18T02:02:18.751896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spring: A high-resolution high-detail dataset and benchmark for scene flow, optical flow and stereo","venue":null,"work_id":"531a5bf7-d38e-4cbd-8100-d3132001492f","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:6c27603b3b00c2d1c958cf73421c2e1938a7ff214e423ce7d326a89cd333d0b0","observation_id":"29197bc9-fa65-400c-962c-d774b49da713","resolution":{"observed_at":"2026-05-18T02:02:18.837330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis","venue":null,"work_id":"a7c6bdc2-f851-46a2-9aee-9449c14d70c3","year":2020},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:cf7e5495fd9d27cec7a386af9371b7b18ef78e6b736e049d8f0ed214792d4ec1","observation_id":"1966b097-fc58-4115-af95-0a35e7950a31","resolution":{"observed_at":"2026-05-18T02:02:18.847003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":"e32494cc-40b1-415d-917f-d9feaa0efffc","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:71cfcc16b19f4d58a9563f1433079e875a86cf00c976d83e5cf326b5bdc30c8c","observation_id":"d891a1be-d3af-46b7-9733-917669cff72b","resolution":{"observed_at":"2026-05-18T02:02:18.788656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"u ller, Katja Schwarz, Barbara R \\","venue":null,"work_id":"eb444be5-2f01-418c-ae5d-e6e1f4a63e25","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:cd6bf24ce960dc12f6b246f52d924a2e66af68f91de1f9c4d7590841fae693e9","observation_id":"d5d45b2a-2b1a-41ec-bb6c-d1a510257759","resolution":{"observed_at":"2026-05-18T02:02:18.825692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16103","last_updated":"2023-11-28T18:16:29Z","snapshot_observed_at":"2026-07-06T16:53:18.275859Z","submitted_at":"2023-11-27T18:59:58Z","title":"Video-Bench: A Comprehensive Benchmark and Toolkit for Evaluating Video-based Large Language Models","version":2},"cited_work":{"arxiv_id":"2311.16103","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.16103","snapshot_observed_at":"2026-07-04T06:39:37.654958Z","title":"Video-bench: A com- prehensive benchmark and toolkit for evaluating video-based 10 large language models","venue":null,"work_id":"37c46a44-ccc9-4891-a106-29a0fb8d3d27","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2311.16103","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:af5feedb8e832cd09fdf711cc7ca4d77b8343eef378cc17fbdeac33578e0f877","observation_id":"f8fb1a83-acef-479f-a08f-2d2b8d26c3f7","resolution":{"observed_at":"2026-05-18T02:00:39.537569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20222","last_updated":"2024-07-11T16:26:03Z","snapshot_observed_at":"2026-07-06T18:22:48.671656Z","submitted_at":"2024-05-30T16:22:22Z","title":"MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":"2405.20222","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20222","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mofa-video: Controllable image animation via generative motion field adaptions in frozen image-to-video diffusion model","venue":null,"work_id":"bfcae340-7c31-4f04-b994-4ccb615a7056","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2405.20222","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:a04b480c1ee2a784bcabe29e67010d115d59b85da437ee0a5e3b8f8830e707fa","observation_id":"36bf1b24-fa5d-4cfb-a86a-3fd4cbe42758","resolution":{"observed_at":"2026-05-18T02:00:39.542006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12459","last_updated":"2024-10-30T12:50:27Z","snapshot_observed_at":"2026-07-06T18:32:53.080027Z","submitted_at":"2024-06-18T10:05:33Z","title":"HumanSplat: Generalizable Single-Image Human Gaussian Splatting with Structure Priors","version":2},"cited_work":{"arxiv_id":"2406.12459","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12459","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Humansplat: Generalizable single-image human gaussian splatting with structure priors","venue":null,"work_id":"9a69859c-c0e4-4c7c-8f88-98438b5743f6","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2406.12459","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:e1fc78951e3b42cb995fc7b2c4e0807b0388ae3896f25adfb9feda1257f94dc7","observation_id":"7484175f-ecb3-486f-9739-55003a1202e2","resolution":{"observed_at":"2026-05-18T02:00:39.524333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02473","last_updated":"2024-01-04T18:59:24Z","snapshot_observed_at":"2026-08-04T02:02:26.635617Z","submitted_at":"2024-01-04T18:59:24Z","title":"VASE: Object-Centric Appearance and Shape Manipulation of Real Videos","version":1},"cited_work":{"arxiv_id":"2401.02473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.02473","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vase: Object-centric appearance and shape manipulation of real videos","venue":null,"work_id":"498af67a-ccc1-4992-84da-c57b42adcefa","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2401.02473","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:e2650c797d5b22775b92c79159c3590e71ba864d2b6e0d37ca299304055372b2","observation_id":"6dce4f5e-badc-4e12-a7cc-a947710e8092","resolution":{"observed_at":"2026-05-18T02:00:39.448769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compositional 3D scene generation using locally conditioned diffusion","venue":null,"work_id":"c458c570-7635-4453-bf8d-eccfde2883a5","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:fba44f38acdf04f34057726e12e8bc9c3c654fe78f601d38b926158b184388f7","observation_id":"6ada3ad5-0161-4357-9bcd-ef0104b56f3e","resolution":{"observed_at":"2026-05-18T02:02:18.860103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"902becfe-237b-4335-a0f2-10457f7b65cd","year":2021},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:8e73024f543929d907502e7364ff2c0313fb7e2f8d7f94e24faf90d09ff5ee7b","observation_id":"eff2cec1-3ba2-4867-991c-44a1e23a1be1","resolution":{"observed_at":"2026-05-18T02:02:18.836614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":"5594cb84-e3a0-40d6-a520-288e2e8194e3","year":2020},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:1b56ff756fc9eb5faf1984b613dc284d5febb94a2be8d06aa6d5b7bef971ae43","observation_id":"3c866ad3-142a-4663-9628-cfa105c2c4e0","resolution":{"observed_at":"2026-05-18T02:02:18.874218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gen3c: 3d-informed world-consistent video generation with precise camera control","venue":null,"work_id":"ca4c4b86-55f2-4755-a096-2b49d222db1b","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:30ae36a675d9fe7e301552c570b7c9a2da4849dabbf3b4bfa384b29d33cbd1d4","observation_id":"73f31eca-0509-45b8-9206-c1af9e660a25","resolution":{"observed_at":"2026-05-18T02:02:18.810080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"53ba585f-9f7f-4950-90ef-b2279839a310","year":2022},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:1e0f8f804a78b51e1e075131b9b3919a15daaad4c11f209306b2e5811f0bc309","observation_id":"bcf792a4-f529-434b-bacb-2083ab6b48b6","resolution":{"observed_at":"2026-05-18T02:02:18.816339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"cc8befc4-8940-44d5-901a-9a8f2ef0ba84","year":2022},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:e0ddfd899763b2428101368cdb3ae07ffa9057c29ba177a1bb8d801afc377286","observation_id":"05dba755-383b-4765-bfcc-e21d93973a95","resolution":{"observed_at":"2026-05-18T02:02:18.860771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structure-from-motion revisited","venue":null,"work_id":"2856c29e-b2a7-49f2-9bfc-d8265f272610","year":2016},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:2dbf56b68f2cff229819a0b487dd84c29d40feb6f614e0ac5b2884f7d0f0a81c","observation_id":"9fcd3db9-8ee5-4a95-879a-440d93fb011c","resolution":{"observed_at":"2026-05-18T02:02:18.803375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CLIP+MLP Aesthetic Score Predictor","venue":null,"work_id":"e4c0ce5d-d4e3-4a92-a3dd-3772d78c5c2f","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:a39d317e10e6a52123fdef1acd7f9bdeb25d81616b61724e00cd636ae930e00d","observation_id":"74ddcdd7-8050-4c87-bcca-c24c5077d0d3","resolution":{"observed_at":"2026-05-18T02:02:18.799215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"c6c0e11a-db8e-4409-8425-08443e3cf20b","year":2022},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:67bbdfe7d7f5603e98cfc24a6c9f06e196f2a247ba1f7002d8967233fcd59e76","observation_id":"fb2cffc8-b7fc-41c7-9dfa-5d8f2f0884d8","resolution":{"observed_at":"2026-05-18T02:02:18.803096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03465","last_updated":"2025-03-17T06:29:41Z","snapshot_observed_at":"2026-07-06T20:31:46.181066Z","submitted_at":"2025-02-05T18:59:52Z","title":"Seeing World Dynamics in a Nutshell","version":2},"cited_work":{"arxiv_id":"2502.03465","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03465","snapshot_observed_at":"2026-07-03T16:48:39.678334Z","title":"Seeing world dynamics in a nutshell","venue":null,"work_id":"e59460d7-1f91-4b54-a66f-19c089fe5679","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2502.03465","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:699eb852c315196f3d3466bfe91016771e1916cb221c4a94c237712274ac7d57","observation_id":"757db236-f383-4d7c-9044-5dc169783a9f","resolution":{"observed_at":"2026-05-18T02:00:39.609979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Light field networks: Neural scene representations with single-evaluation rendering","venue":null,"work_id":"e6566b38-83d3-4d53-ad0b-a7af37d8a3e4","year":2021},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:02cd036c82ad3245d2215e9e62850844c0d5a1b31331cfc08f776fef6470968a","observation_id":"174a002e-4b76-49a3-b681-cc07a08f3eb7","resolution":{"observed_at":"2026-05-18T02:00:40.391492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A benchmark for the evaluation of rgb-d slam systems","venue":null,"work_id":"cc21347b-20d9-48fe-a772-d050045606ae","year":2012},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:062dce72ec09e6c8fc4dfce21c0d3f10ae5c6c31505559ffadf9452acb8eab7b","observation_id":"2b56769d-c1cb-46aa-b3fe-3a34cd75bc41","resolution":{"observed_at":"2026-05-18T02:00:40.394957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04928","last_updated":"2024-11-07T18:07:31Z","snapshot_observed_at":"2026-07-06T19:46:50.403301Z","submitted_at":"2024-11-07T18:07:31Z","title":"DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion","version":1},"cited_work":{"arxiv_id":"2411.04928","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.04928","snapshot_observed_at":"2026-07-07T14:33:54.345685Z","title":"Dimen- sionx: Create any 3d and 4d scenes from a single image with controllable video diffusion","venue":"cs.CV","work_id":"c0c2b97f-2c4b-4f39-b154-6ced939a883d","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2411.04928","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:4b597670670b7c2524380f3fae120304d51e5cf3cd826680052f482d42e60cd2","observation_id":"734942c1-68a5-4079-8643-9ed039db3bb6","resolution":{"observed_at":"2026-05-18T02:00:39.437290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13870","last_updated":"2024-06-26T10:20:11Z","snapshot_observed_at":"2026-08-02T07:09:55.963445Z","submitted_at":"2024-06-19T22:20:03Z","title":"Splatter a Video: Video Gaussian Representation for Versatile Processing","version":2},"cited_work":{"arxiv_id":"2406.13870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.13870","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Splatter a video: Video gaussian representation for versatile processing, 2024 b","venue":null,"work_id":"debfcd61-db58-4326-843a-365e9298bf60","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2406.13870","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:e997ca055d685abd0a34337b55f95f46d3752c1340b4dbf26b881ace72f109e0","observation_id":"a9c05d78-5b36-4e67-ac89-4aa8c656dec9","resolution":{"observed_at":"2026-05-18T02:00:39.699799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Splatter a video: Video gaussian representation for versatile processing","venue":null,"work_id":"b5e0e212-56d3-4cfb-bd14-c8b60cb75ae5","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:f48524d9f775027f8f90548dffc45c706679a3724a8194260acf9be56f0039b9","observation_id":"6e2283a1-25af-4b60-8595-4061d1ee0a0f","resolution":{"observed_at":"2026-05-18T02:02:18.833065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.14445","doi":"10.48550/arxiv.2503.14445","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Bolt3d: Generating 3d scenes in seconds","venue":null,"work_id":"2d66ff3d-2bb3-469e-9752-c31df092300f","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:c0a6b330b746b3eadffbfd08f6c8c06a09996897c62e0f520f163e04adfe25bb","observation_id":"db46bbbb-c787-4dc4-b170-c3b57e62d994","resolution":{"observed_at":"2026-05-18T02:00:39.712669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":"1812.01717","doi":"10.48550/arxiv.1812.01717","metadata_source":"pith","pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","venue":"cs.CV","work_id":"72f42543-17d5-49aa-ba5a-25d67ffbb88a","year":2018},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:bd84083bc039f56b90597ba256a53226e1e2ccd2aabef4bc5c5fdb10157e4547","observation_id":"071e66ef-f993-47ed-9f35-89d16f95d4c3","resolution":{"observed_at":"2026-05-18T02:00:39.718086Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":"a7a9a28c-6a63-4e88-8542-c1754c2c1c22","year":2019},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:c4d2e4cc301d6eee6589eacda2fa0661b0763c1e7f655dfc5014bd9c5f2e54d4","observation_id":"407abba8-6527-49b9-9e82-3940b651d7c4","resolution":{"observed_at":"2026-05-18T02:02:18.806483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17907","last_updated":"2023-11-29T18:55:38Z","snapshot_observed_at":"2026-07-06T16:54:33.882767Z","submitted_at":"2023-11-29T18:55:38Z","title":"CG3D: Compositional Generation for Text-to-3D via Gaussian Splatting","version":1},"cited_work":{"arxiv_id":"2311.17907","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.17907","snapshot_observed_at":"2026-07-04T06:09:37.273898Z","title":"Cg3d: Compositional generation for text-to-3d via gaussian splatting","venue":null,"work_id":"152e09c1-88f3-4c98-8c66-a3524dd9c153","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2311.17907","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:2ee328f061f6e69cfd9463161b4f0f27b9251b8e93e5b6b0890c9a7613364b71","observation_id":"4170909e-7e74-4386-a07f-e62973fde124","resolution":{"observed_at":"2026-05-18T02:00:39.693969Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04462","last_updated":"2024-12-05T18:59:41Z","snapshot_observed_at":"2026-07-06T20:02:26.756229Z","submitted_at":"2024-12-05T18:59:41Z","title":"4Real-Video: Learning Generalizable Photo-Realistic 4D Video Diffusion","version":1},"cited_work":{"arxiv_id":"2412.04462","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04462","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4real-video: Learning generalizable photo-realistic 4d video diffusion","venue":null,"work_id":"bcac7b19-a477-4c38-94bb-aba494b3beed","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2412.04462","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:826c6087a783c5530fd37c6588d1971995dcf506464d83730c84cebb5bac1cd0","observation_id":"e0dd7be5-db3d-43a0-bf72-2aad8ef45da0","resolution":{"observed_at":"2026-05-18T02:00:39.722672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11651","last_updated":"2025-03-14T17:59:47Z","snapshot_observed_at":"2026-07-06T20:52:55.699004Z","submitted_at":"2025-03-14T17:59:47Z","title":"VGGT: Visual Geometry Grounded Transformer","version":1},"cited_work":{"arxiv_id":"2503.11651","doi":"10.48550/arxiv.2503.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.11651","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":"c49e0f28-20d8-4ff4-9683-568363c784e2","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2503.11651","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:e5766f88973405415050fc19c733f02ca6bc2a5ee7c5ec6899a7da25ffe3cb17","observation_id":"f808afb6-0364-409b-8327-73ccf0b1aa32","resolution":{"observed_at":"2026-05-18T02:00:39.706494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shape of motion: 4d reconstruction from a single video","venue":null,"work_id":"01a7c4cf-0c7a-434d-babd-c3082949917b","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:82048a0d42e6c8c8cd89e07a2398d7dbb3fdd17f66a7271061eb17bc77b2f121","observation_id":"11f79d3f-80df-4729-9094-f254e7d1a060","resolution":{"observed_at":"2026-05-18T02:00:40.375906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tartanair: A dataset to push the limits of visual slam","venue":null,"work_id":"84ea6120-eb39-411c-b9d7-2adf19547911","year":2020},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:153fac50930728f2f1fee4b342099a789264bef300d2a815a0dbeed935dae798","observation_id":"dfd15fa5-2e60-40a1-b392-6d3f11759d41","resolution":{"observed_at":"2026-05-18T02:00:40.398362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video4dgen: Enhancing video and 4d generation through mutual optimization","venue":null,"work_id":"9fb293de-84d1-4e12-9bf8-cd786fe1515c","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:87838ebda268ace9e0952c81b1131347828c15b84146536764d3f045b6465531","observation_id":"8b10ae8b-207a-4219-b278-6bba7b74b6aa","resolution":{"observed_at":"2026-05-18T02:02:18.783694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"6d682446-506c-4c9f-87fe-6e2d8cc9ff63","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:664b8a49d3d259c86e7d9cffc3fb684d6ec2754000ef1d543d20bb4b9efa13d1","observation_id":"38e3e4dc-ede5-4483-8df9-740620fc92a7","resolution":{"observed_at":"2026-05-18T02:00:40.454052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"latentsplat: Autoencoding variational gaussians for fast generalizable 3d reconstruction","venue":null,"work_id":"641870b5-7b65-4ab0-afa7-a2c25e24a28d","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:1f4fbbe46a302e1e4d29de53e67231f57180a718f8d09918e6224ffd3f5b989f","observation_id":"6e3cb51e-f8c5-479a-8fe2-ee740d8be818","resolution":{"observed_at":"2026-05-18T02:02:18.813400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4d gaussian splatting for real-time dynamic scene rendering","venue":null,"work_id":"cb0ebe31-f838-42c9-a12d-719440e72fdb","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:1d8c60b3a68fcb1ee6f7f930d5568d6f734a71497dbd16915b2b8fcdb1246e6c","observation_id":"7e68dba2-4b2e-48cc-b7fd-13ea0f102502","resolution":{"observed_at":"2026-05-18T02:02:18.771759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17090","last_updated":"2023-12-28T16:10:25Z","snapshot_observed_at":"2026-08-02T07:14:02.308302Z","submitted_at":"2023-12-28T16:10:25Z","title":"Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels","version":1},"cited_work":{"arxiv_id":"2312.17090","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.17090","snapshot_observed_at":"2026-07-08T01:44:26.160588Z","title":"Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels","venue":"cs.CV","work_id":"2a0ee74c-0c50-4cd3-91ce-b75cc297715e","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2312.17090","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:cc033afc788e73da6bcfba38ed80e942f2fe5bdfcb4d1669611db3be8b35ee1e","observation_id":"1f0f968b-d2af-4a3f-9eeb-f3bd91d4b89c","resolution":{"observed_at":"2026-05-18T02:00:39.656209Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18613","last_updated":"2024-12-18T21:21:07Z","snapshot_observed_at":"2026-07-06T19:58:09.591787Z","submitted_at":"2024-11-27T18:57:16Z","title":"CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2411.18613","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18613","snapshot_observed_at":"2026-07-01T22:16:16.447075Z","title":"Barron, and Aleksander Holynski","venue":null,"work_id":"d584661b-cc63-47c9-b809-8182404b67d1","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2411.18613","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:da701e1dcf5693fbe5889743812e2021c7e70882718b3a3ac6d19953f1c7b02e","observation_id":"b7b97dd8-163a-4ae7-94c2-2ceb1dea00d7","resolution":{"observed_at":"2026-05-18T02:00:39.581924Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17470","last_updated":"2025-02-27T21:52:39Z","snapshot_observed_at":"2026-08-03T12:49:30.475401Z","submitted_at":"2024-07-24T17:59:43Z","title":"SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency","version":2},"cited_work":{"arxiv_id":"2407.17470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.17470","snapshot_observed_at":"2026-07-07T14:03:48.614659Z","title":"Sv4d: Dynamic 3d content generation with multi-frame and multi-view consistency","venue":"cs.CV","work_id":"222bc271-404d-4612-a299-23de538a73eb","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2407.17470","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:3f6848ba41446814bdeb97e6da87ca53eae090089adfa9bff8e94b93f44c07c2","observation_id":"c48a7156-6eb4-420d-b838-b5ca892aab6b","resolution":{"observed_at":"2026-05-18T02:00:39.673546Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12190","last_updated":"2023-11-27T13:36:04Z","snapshot_observed_at":"2026-07-06T16:35:15.777674Z","submitted_at":"2023-10-18T14:42:16Z","title":"DynamiCrafter: Animating Open-domain Images with Video Diffusion Priors","version":2},"cited_work":{"arxiv_id":"2310.12190","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.12190","snapshot_observed_at":"2026-07-04T14:59:55.949933Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":"cd60d897-1a74-482c-84b4-93dfa38c1c33","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2310.12190","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:0c4251050959f8dd6d0c1d4b19cf661247adaee9346a257ac2a78aa44e9b7b23","observation_id":"1cc67f2f-81b5-4349-a4dd-a5b9df4975ef","resolution":{"observed_at":"2026-05-18T02:00:39.568065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17933","last_updated":"2024-05-28T07:58:33Z","snapshot_observed_at":"2026-07-06T18:21:09.808086Z","submitted_at":"2024-05-28T07:58:33Z","title":"ToonCrafter: Generative Cartoon Interpolation","version":1},"cited_work":{"arxiv_id":"2405.17933","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17933","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tooncrafter: Generative cartoon interpolation","venue":null,"work_id":"8cf753ff-e7e2-40c5-baf1-140060a94890","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2405.17933","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:dc71dcbc6fa0f8310378e8c7fc90b050c8417ea2a27f6d37162528ec2f3f25c7","observation_id":"e4629cec-384e-4823-8fc6-f9cb298019db","resolution":{"observed_at":"2026-05-18T02:00:39.591986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Make-your-video: Customized video generation using textual and structural guidance","venue":null,"work_id":"f6b2a79b-4fa9-4ea0-b525-0372e9725c3b","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:2720cb3bd47117633ec73014f38c6c82292909b55da54977b686cd2fb85740b8","observation_id":"da696b26-b074-4d5b-9665-77d56f172806","resolution":{"observed_at":"2026-05-18T02:02:18.760449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2406.02509","doi":"10.48550/arxiv.2406.02509","metadata_source":"pith","pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","venue":"cs.CV","work_id":"ef36842f-bbba-4a74-9df2-ec15c109c1b3","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:d19160ff3501d3b352786a8b3c72ef70d9217410d7b4f3393a00e964b65abe38","observation_id":"a75b2e6f-a967-4e9d-b36a-46c8b295f49d","resolution":{"observed_at":"2026-05-18T02:00:39.533339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13928","last_updated":"2025-03-19T19:35:52Z","snapshot_observed_at":"2026-07-06T20:25:08.527025Z","submitted_at":"2025-01-23T18:59:55Z","title":"Fast3R: Towards 3D Reconstruction of 1000+ Images in One Forward Pass","version":2},"cited_work":{"arxiv_id":"2501.13928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13928","snapshot_observed_at":"2026-06-30T16:54:59.263569Z","title":"arXiv preprint arXiv:2501.13928 (2025)","venue":null,"work_id":"926b9b2f-e6e8-40a2-8816-ceea11d1d49d","year":2025},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2501.13928","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:91a96fa2ccdf046c26503282d48f3ec006a26ee57d9116a61fd5e1147819e0d7","observation_id":"f53f45c0-05d0-4fb9-9b48-5670fdc7dd41","resolution":{"observed_at":"2026-05-18T02:00:39.528944Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-07-11T00:07:42.878250Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:719cf2f988929ecbbd42b70c66cb87b5f4e16d3985f483627a6bc4dddd4b5871","observation_id":"2545b2f4-b569-434a-8c81-49d2989c0a97","resolution":{"observed_at":"2026-05-18T02:00:39.546045Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.13101","last_updated":"2023-11-19T14:50:08Z","snapshot_observed_at":"2026-07-06T16:22:34.623387Z","submitted_at":"2023-09-22T16:04:02Z","title":"Deformable 3D Gaussians for High-Fidelity Monocular Dynamic Scene Reconstruction","version":2},"cited_work":{"arxiv_id":"2309.13101","doi":"10.48550/arxiv.2309.13101","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.13101","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deformable 3d gaussians for high-fidelity monocular dynamic scene reconstruction","venue":null,"work_id":"bb973e91-b2d8-4ab6-9b92-7c3b13b2f9a4","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2309.13101","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:fde71fe88153c0c73523200da0ff8f9e23c7a190a97fe88d6fabdf6b786a5be2","observation_id":"8afad269-40e7-476c-a30c-a1d7866f02b1","resolution":{"observed_at":"2026-05-18T02:00:39.550985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deformable 3d gaussians for high-fidelity monocular dynamic scene reconstruction","venue":null,"work_id":"7c197ef7-02a6-495f-84e9-699f95c07fbe","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:8f9c401f328a1a9acf6afe3120b706a80d6e8aa35159e7896a144a4f46bc5a1d","observation_id":"8dec91e1-b6ee-4de6-a0cc-c359387026b1","resolution":{"observed_at":"2026-05-18T02:02:18.889367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes","venue":null,"work_id":"d6747e39-524a-4a90-af10-fca3384b40d0","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:c388c21760febf25c5864784cf63eaefb1c5fcc3c3a68ef464ceed9b098f7d9b","observation_id":"36c411a3-2cda-4d9c-b864-8e81389c57db","resolution":{"observed_at":"2026-05-18T02:02:18.820465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":"2308.08089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-07-04T20:10:08.842410Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","venue":"cs.CV","work_id":"eb6df0b7-199d-4cc7-8711-9cd5a6e25349","year":2023},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:330edbca6a6d0ceb0faed92910a6745b0fd9ef2f2a121562a434059cfe52d7e3","observation_id":"bf2afcb2-d5a9-467a-855b-b60514fdcd34","resolution":{"observed_at":"2026-05-20T13:03:58.521687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07472","last_updated":"2024-11-20T01:32:48Z","snapshot_observed_at":"2026-08-03T11:24:11.020036Z","submitted_at":"2024-06-11T17:19:26Z","title":"4Real: Towards Photorealistic 4D Scene Generation via Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2406.07472","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07472","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4real: Towards photorealistic 4d scene generation via video diffusion models, 2024 a","venue":null,"work_id":"5aa8a090-9034-4cdc-a4c4-0f0eb409a961","year":2024},"citing_paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-18T01:59:23.928725Z"},"links":{"cited_paper":"/paper/2406.07472","citing_paper":"/paper/2511.00503"},"observation_digest":"sha256:0b0c65d9ec305bc7f42b12e8c1b85b7c77ad79482531bbaee9a088374b1ac3e8","observation_id":"da6d8051-f630-45c8-9b4e-0835e7ebcb19","resolution":{"observed_at":"2026-05-18T02:00:39.511265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2511.00503","last_updated":"2026-04-07T13:15:23Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-11-01T11:16:25Z","title":"Diff4Splat: Controllable 4D Scene Generation with Latent Dynamic Reconstruction Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":45,"verified_fuzzy":53},"total_outbound_references":116},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 100 of 116 outbound references and 2 inbound Pith citation observations for arXiv:2511.00503."}