{"as_of":"2026-08-19T03:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fc4451b6d17226d57dd807a230773d99508efa08fa36688020e08d8f0de0ccaf","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T06:59:31.137097Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.02798/citation-record","integrity":"/paper/2607.02798/integrity","json":"/paper/2607.02798/citation-record.json","paper":"/paper/2607.02798"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Cosmos world foundation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:619f0a1ac693d3eac05851e9c59cbc17663b797e11670619ec3b167d5c692216","observation_id":"0c5b3160-2dd4-4777-b2c2-027c58e70c39","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Lyra: Generative 3d scene reconstruction via video diffusion model self-distillation.arXiv preprint arXiv:2509.19296, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:f50e232dc15022be827faa028b6aba89eabf00d6ca068b9d9c49dff768327053","observation_id":"2acf383b-1666-48ee-be86-55603b2dd5ed","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Ac3d: Analyzing and improving 3d camera control in video diffusion transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:8c3fed172f1f6b69d084ac5887b599a50aeac2b85f6e463cd3e356fbddbc0326","observation_id":"b641051e-0a8c-4eb3-9912-f373fb6cf71d","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Recammaster: Camera-controlled generative rendering from a single video","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:fcfa578c26980329f96ecdbc8aed1375b6f1ec83cd434fd18d720149589da97a","observation_id":"3e125f6e-a77a-41c1-be79-5bfb4e0de332","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:f116e8986237bf4c3653de4fb2bc9cd498dac78897a1c5d59913acbf5276a9ca","observation_id":"7eb32241-8999-47f7-8283-5cd6edb5d393","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Lumiere: A space-time diffusion model for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:8371ec0212c6d7d2e9a78996a51248601f41e8efc9b7e23929ef8374bb65478d","observation_id":"1916d094-f247-46e0-b8e0-121ae6c6bba7","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-17T12:45:30.627161Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:da0b1b9629c20579eb3620b4a921479d373fa5e31a100d233cbee696634cb634","observation_id":"e3264584-a0c6-452c-b2f2-d9e6b874fa45","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Go-with-the-flow: Motion-controllable video diffusion models using real-time warped noise","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:7cfd0f88e5f77758a79593302e3ef5cce893c721503812ee1e2ef80e030fa86b","observation_id":"86c19943-ad26-4468-a2f4-77e5f4980a5e","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Sam 3: Segment anything with concepts, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:429b3ef2702a3d4c60dbff84ae2ef20a65b03292632385da58a6ba72ed26e5bd","observation_id":"70f3f905-a710-4e55-b059-1847a665ae96","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03072","last_updated":"2025-04-03T22:49:56Z","snapshot_observed_at":"2026-08-16T12:44:07.112504Z","submitted_at":"2025-04-03T22:49:56Z","title":"How I Warped Your Noise: a Temporally-Correlated Noise Prior for Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03072","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"How i warped your noise: a temporally-correlated noise prior for diffusion models.arXiv preprint arXiv:2504.03072, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2504.03072","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:d59d864be10a440acb3cfc04e632a5ab050bb43083e6197c126a2ef6f285cc86","observation_id":"51a09343-a29c-4bbb-9f74-81f8b5eceabc","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-13T01:39:12.659510Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:cad2a4cdcfe53c078b02f59ccec434c7eae8b23614cf8739b822c40df3d12adf","observation_id":"ece77e36-243e-471c-8e05-7441f64a3e8c","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13154","last_updated":"2025-08-18T17:59:55Z","snapshot_observed_at":"2026-08-18T18:19:22.962621Z","submitted_at":"2025-08-18T17:59:55Z","title":"4DNeX: Feed-Forward 4D Generative Modeling Made Easy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13154","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"4dnex: Feed-forward 4d generative modeling made easy.arXiv preprint arXiv:2508.13154, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2508.13154","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:accbade388aed75c6530b8322d791767957d765be99dbaff36472930ee82e13d","observation_id":"a4730138-7323-4bcb-83c1-293edea95b5a","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Wan-move: Motion-controllable video generation via latent trajectory guidance.arXiv preprint arXiv:2512.08765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:1aad6d9b3ac5ed40cd6b534bce024cfd54476fdd8f69b77da17e828afad2feea","observation_id":"407f18e2-e538-4a5b-9ac8-4f788df9a69e","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Motion prompting: Controlling video generation with motion trajectories","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:09379daf39e9ca389ea696972e27d9456d1dc93279245bd823c460f02846141c","observation_id":"2fbf486a-373f-4d67-888f-18b8405b9abd","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-17T14:04:31.230742Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning.arXiv preprint arXiv:2307.04725, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:a8e5574ef25103f404b083a53043dc2d8ff54fbcb4433504dc1b3cb71f356931","observation_id":"cfd1c376-f6d0-4460-929e-b706338f01cd","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-16T17:39:09.604516Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Cameractrl: Enabling camera control for text-to-video generation.arXiv preprint arXiv:2404.02101, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:c31a28ad8da6292303025145406b8bc5c41566ff1d61664fa5669a2424773d3d","observation_id":"e7d3c7bc-f0c7-4514-8097-1c909f20e680","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:a733e83b9ef70c100189d942e7fdc45ac5f8363f3ed00add80f2d21ee4a6e124","observation_id":"703a391a-a37e-4ba0-83b4-572037be1f9c","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-08-18T00:41:06.039123Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Imagen video: High definition video generation with diffusion models.arXiv preprint arXiv:2210.02303, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:77ab04791075046db87291a61301b700d18ef0dcd23ba1b7c7d2db753c072add","observation_id":"feb6f807-ca5d-4bc5-a14a-5b9f004604f4","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Video diffusion models.Advances in neural information processing systems, 35:8633–8646, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:7833836307179a38da27fc1c5d7bcbcca91a895d5e020386217403ae9e210c54","observation_id":"6b1371f9-0397-4373-9c4f-819c0fca6059","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-08-12T19:21:15.526321Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers.arXiv preprint arXiv:2205.15868, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:e04a89e8dadeff0ecff444fafb5751d958ba85bcb0c9008a603c2ab376e394b8","observation_id":"65206bb5-844d-4088-921b-9baf1ed6c28e","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10126","last_updated":"2025-02-25T00:32:29Z","snapshot_observed_at":"2026-08-16T13:42:54.369415Z","submitted_at":"2024-06-14T15:33:00Z","title":"Training-free Camera Control for Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10126","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Training-free camera control for video generation.arXiv preprint arXiv:2406.10126, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2406.10126","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:b23f94d62fad94356b0ec1a69ffeda42155f3d40590d6b6b17750e9a6f186066","observation_id":"74be7222-a4a7-4a15-bf15-aac8749fd7fb","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10934","last_updated":"2025-08-12T18:39:13Z","snapshot_observed_at":"2026-08-14T06:25:22.731553Z","submitted_at":"2025-08-12T18:39:13Z","title":"ViPE: Video Pose Engine for 3D Geometric Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10934","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Vipe: Video pose engine for 3d geometric perception","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2508.10934","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:c38bfd6e644b564e439464f2f6681c72a876a5726414aa13065300490b97d825","observation_id":"73d02371-1657-4b9d-8436-ca6763d504ee","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"VBench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:61003e57d29a3202a5e8f565ae22fa4741a850d857957b0f3c7674e90798f03b","observation_id":"22473f04-39b6-4ec6-8556-bfabd0a5e742","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Peekaboo: Interactive video generation via masked-diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:464078fa9ae0ebcef03487cae9e1c93ed44088ae3303aa19955106d625e4e935","observation_id":"3bec5d97-9536-436f-ab92-fd30d0e71ac3","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12705","last_updated":"2025-06-17T22:33:35Z","snapshot_observed_at":"2026-07-06T21:26:01.534136Z","submitted_at":"2025-05-19T04:55:39Z","title":"DreamGen: Unlocking Generalization in Robot Learning through Video World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12705","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Dreamgen: Unlocking generalization in robot learning through video world models.arXiv preprint arXiv:2505.12705, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2505.12705","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:3c6fd45b62d4bbcc95b167c470cfa41bf588ca45eecd5fffc7eb0033f0736e66","observation_id":"05bec61a-6350-44a1-9b1e-966ccdff0e58","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Pyramidal flow matching for efficient video generative modeling.arXiv preprint arXiv:2410.05954, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:41a1f706fc556dd3cdd04ce924c9f5c91a85af08929fae0de43b2c6459b7ba63","observation_id":"9afa2aaa-4d8e-470a-8a73-d3a281b01f98","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:48b920c9359c01c631591d7dffcb30b65699dd88a7b96a603b2c1a8b0585c470","observation_id":"695fd7fd-212c-4636-827b-3b06473144c3","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Onlyflow: Optical flow based motion conditioning for video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:18cf32788f3b69c8fc2adb7d75d0bdc12133f8fda85facc0ff1a24f1994e60fe","observation_id":"f22cab89-9c06-4c00-a878-9e1f02775833","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Collaborative video diffusion: Consistent multi-video generation with camera control.Advances in Neural Information Processing Systems, 37:16240–16271, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:d2c5839231051f6737849591ac970b12a4f232cd2b85ae9bf6039d82fc0137cd","observation_id":"81bd0689-798f-4406-b272-856ada0379a8","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Generative video motion editing with 3d point tracks.arXiv preprint arXiv:2512.02015, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:0e1fd2e870aa8f7d417dcd30957db11aab537a0ccfe79b0ddb6ec9dbc6c288f1","observation_id":"4b5b06eb-a6ac-413f-81d7-0ff230f387c0","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Magicmotion: Controllable video generation with dense-to-sparse trajectory guidance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:80da496796f4be305b5eb8b07a082a72c334a96761afeaf011e69606f0ee86c2","observation_id":"d603109c-e3d0-4ab1-9299-118e7f956575","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Lightx2v: Light video generation inference framework, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:c4840bf1d183d4afb45f69a4c5de9a5bc424e7cedfcb3aa035c8e31722d22d4a","observation_id":"ea473683-9219-419a-9f9a-e61d98aaf9eb","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Equivdm: Equivariant video diffusion models with temporally consistent noise.arXiv e-prints, pages arXiv–2504, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:a42960e6c76c5808bb7da48540ebbcd3d251f4c84132231ecd31ca52cbefc735","observation_id":"fa29b8e1-86c8-48a8-8ae1-3dd27b661827","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-17T10:09:03.767186Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Movie gen: A cast of media foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:c399bce84edac6fbe960766c4df4bfaba290577c14395f0d35730d86c5eb39b0","observation_id":"5113146b-456b-4fdf-9c93-1267d0a926f0","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Gen3c: 3d-informed world-consistent video generation with precise camera control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:24c709a0c8efe5d48c5cbe5544c3b7a38fb6b07c75b9609b8f1f3ec1c2da9354","observation_id":"b4a56b0e-7fe3-4e36-ab01-f2db7e19be6c","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Motion-i2v: Consistent and controllable image-to-video generation with explicit motion modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:b5ef3f92780d2119de74266474f039288898a19139b56d858b66f1bb236cfb4b","observation_id":"51601bb5-7897-4c56-a2f6-e7521b157b60","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Time-to-move: Training-free motion controlled video generation via dual-clock denoising.arXiv preprint arXiv:2511.08633, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:8a88c680985ebfa281b95655b9299259bfb26ca9119057a62b15a38127816105","observation_id":"58dc2b39-5002-428e-a2bd-069cb12f884c","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:43f99b4a9a5a48b7c0f3ede487c855577414631acadc8440ae22530670e39811","observation_id":"d44843bb-e773-42ef-983a-26ebb887df8e","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:a4fd88f826ca655ab0fb41ddcf074cea0362669ecdf92fc6b98b02b37e29b7eb","observation_id":"632c60db-386a-4d2b-aec6-f59547fb8136","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:165e821d4cf042ddd76701c369145b3f2b2de9d18c1aaddee5d3b23725883a72","observation_id":"ebd2bae2-5ce3-4c8b-ac87-8e2d1c144cd1","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Robovip: Multi-view video generation with visual identity prompting augments robot manipulation.arXiv preprint arXiv:2601.05241, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:a0df29f4a21a35d3fd52f5d93a4556149702bc47bc28cfdf2241823340a19105","observation_id":"a4d8813f-a48a-487f-81f6-59208c30e90e","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Levitor: 3d trajectory oriented image-to-video synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:b3cdf7b67589b71365a4a10b468870b22d373bb82dea30f8c35a81f29b3d594d","observation_id":"65de68b2-de68-4171-9f69-876352185803","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01566","last_updated":"2024-02-02T16:59:48Z","snapshot_observed_at":"2026-08-19T02:09:43.653058Z","submitted_at":"2024-02-02T16:59:48Z","title":"Boximator: Generating Rich and Controllable Motions for Video Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01566","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Boximator: Generating rich and controllable motions for video synthesis.arXiv preprint arXiv:2402.01566, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2402.01566","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:2f514020d6b659c58220cfbe3dc4e4524b2b39d52ed6284fc7c3f8e1189b8b43","observation_id":"16115d73-5927-4423-a3f7-e5c24680bd0c","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Image conductor: Precision control for interactive video synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:33840c0b5a4bc5f52590a523933ae941ff4589868a96a23135cf7c258a77c309","observation_id":"9b199c29-e82c-48e4-ba11-dc029e30ce60","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE transactions on image processing, 13(4):600–612, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:38f5cb9bc9bbd2dba109aed5cad53e3c6c98de3b65f8b0b7ccc968eaf4f5f02a","observation_id":"b1a8f105-073b-413f-a437-3a1c80d0c499","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:77f15656e60f1a3bf0c119d2c3980ae2ae036eb571033c5d9e61ae82214d5c40","observation_id":"f066048a-fac3-4292-9a23-61263c0af386","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:39e2584d8825afc43ce145d645c94561d89c191988e4d58e2bce109f6935b43a","observation_id":"d76225e9-23bf-4483-83fc-7dc7cb722450","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08004","last_updated":"2025-06-09T17:59:47Z","snapshot_observed_at":"2026-08-17T13:27:17.569591Z","submitted_at":"2025-06-09T17:59:47Z","title":"Dynamic View Synthesis as an Inverse Problem","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08004","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Dynamic view synthesis as an inverse problem.arXiv preprint arXiv:2506.08004, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2506.08004","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:a2ea1fdd1952433685c06f2bdf391e22e8fd4a0be0fe0bcd507f33b8179daa1a","observation_id":"7414f65e-f947-40c3-8bd3-f2ea93f5b4c4","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Drag- nuwa: Fine-grained control in video generation by integrating text, image, and trajectory.arXiv preprint arXiv:2308.08089, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:ed27c113f828bb197c3519987976766ee1cd9b632f0240be08c04a66f20117b6","observation_id":"07a59c49-ed3d-4067-a4aa-1bc745b5babd","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Tapip3d: Tracking any point in persistent 3d geometry.arXiv preprint arXiv:2504.14717, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:d2f0e5bb4c641c0020a0cea73716f68aa15ca06208b689852e9d0a7cdac3e5b0","observation_id":"338a55f1-5809-4df3-b23c-579a3204784d","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Tora: Trajectory-oriented diffusion transformer for video generation","venue":null,"work_id":null,"year":2063},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:f1f3754e1d93f336bc460406d6534683f97da8fe8df676787098c81108b52cd6","observation_id":"21844aa5-deb3-4a9c-9f6f-9206579173a2","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Versecrafter: Dynamic realistic video world model with 4d geometric control.arXiv preprint arXiv:2601.05138, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:08fa2bfeb962ba48c89662e91fd0d42e40615de9bcbc68a78ee85616af38dd40","observation_id":"dc9a7e76-ad6f-4168-a52f-528ff6d6a194","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T06:59:31.137097Z","title":"Posecrafter: One-shot personalized video synthesis following flexible pose control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-12T06:59:31.137097Z"},"links":{"citing_paper":"/paper/2607.02798"},"observation_digest":"sha256:b08657d68487779580f73bcf652fd3683577b8b442e262adb0e20ee6f2bf5011","observation_id":"244fa066-15e4-40cf-bd5c-ccf81db97a5d","resolution":{"observed_at":"2026-07-12T06:59:31.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.02798","last_updated":"2026-07-02T22:17:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T14:40:02.617836Z","submitted_at":"2026-07-02T22:17:20Z","title":"Track the Noise, Move the World:3D-Grounded Motion-Consistent Noise for Controllable Video Generation"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2607.02798."}