{"as_of":"2026-08-08T23:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:94b2cf48d39693ca57ce0c2a45bc770810d0eac70c385e55449d55818b7fdecc","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:02:18.682158Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18924/citation-record","integrity":"/paper/2607.18924/integrity","json":"/paper/2607.18924/citation-record.json","paper":"/paper/2607.18924"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:10.203074Z","title":"Interdyn: Controllable interactive dynamics with video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:10.203074Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:c33b51c0992809ca1cd634db97a7b80427c1eb6e0f21dce469b3c64e9350a4c8","observation_id":"39af379b-a8c1-4f4e-8205-ea070ec12eff","resolution":{"observed_at":"2026-08-01T14:02:10.203074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11647","last_updated":"2025-07-09T08:09:06Z","snapshot_observed_at":"2026-08-07T17:03:10.859634Z","submitted_at":"2025-03-14T17:59:31Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11647","snapshot_observed_at":"2026-08-01T14:02:10.304420Z","title":"Recammaster: Camera-controlled generative rendering from a single video.arXiv preprint arXiv:2503.11647, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:10.304420Z"},"links":{"cited_paper":"/paper/2503.11647","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:49642349816ff6c52a551e066c5b3737f27f79cce1dc44b6b3e47fad45c46233","observation_id":"7fbb4757-15e2-4dd4-9e0d-b2f540d621dc","resolution":{"observed_at":"2026-08-01T14:02:10.304420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-01T14:02:10.415288Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond.arXiv preprint arXiv:2308.12966, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:10.415288Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:872d338a6c1499d4752818bea03bc95849869d75823f1d80d04b9e9243728bf2","observation_id":"3f4a87ab-801e-4748-923e-0df4153575e9","resolution":{"observed_at":"2026-08-01T14:02:10.415288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-01T14:02:10.504893Z","title":"Qwen2.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:10.504893Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:94c555500b815d64c5056d73f156fc2ccaddc94fe23908f72137ce72b49732ba","observation_id":"9c7bcb2a-5ced-4b84-aa37-8fbccc67db25","resolution":{"observed_at":"2026-08-01T14:02:10.504893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03520","last_updated":"2024-10-03T17:24:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T17:53:55Z","title":"VideoPhy: Evaluating Physical Commonsense for Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03520","snapshot_observed_at":"2026-08-01T14:02:10.644287Z","title":"Videophy: Evaluating physical commonsense for video generation.arXiv preprint arXiv:2406.03520, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:10.644287Z"},"links":{"cited_paper":"/paper/2406.03520","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:8bbd6afaedfe819004ecc387dab8d7f6963d411e10139c1f3767ec89590deee5","observation_id":"74dad40d-2c8f-45b8-a2fa-d53c2f3b32bc","resolution":{"observed_at":"2026-08-01T14:02:10.644287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06800","last_updated":"2025-03-09T22:49:12Z","snapshot_observed_at":"2026-08-07T17:18:26.824890Z","submitted_at":"2025-03-09T22:49:12Z","title":"VideoPhy-2: A Challenging Action-Centric Physical Commonsense Evaluation in Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06800","snapshot_observed_at":"2026-08-01T14:02:10.808123Z","title":"Videophy-2: A challenging action-centric physical commonsense evaluation in video generation.arXiv preprint arXiv:2503.06800, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:10.808123Z"},"links":{"cited_paper":"/paper/2503.06800","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:6f7bb2c7573b3aa70fd2d4173fecc3c22d4ccdf86614795d390102f72bd82004","observation_id":"a3f15e8b-0fbc-4760-a54c-db2a3b675253","resolution":{"observed_at":"2026-08-01T14:02:10.808123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:10.941318Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:10.941318Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:b824b8718cab53d33ea6e5ea7ec0dd68858be2342ba33feda338ff5f91224b84","observation_id":"4664be17-66b1-4e1f-b5cc-5b9a70c144e2","resolution":{"observed_at":"2026-08-01T14:02:10.941318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:11.107464Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:11.107464Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:2df29988d1b7e1c885e12e1902375d9ae984e6b10f9a4ca24a8ca2cacb9a4058","observation_id":"e59c0482-5063-4e04-8752-261a840c91b4","resolution":{"observed_at":"2026-08-01T14:02:11.107464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:11.382332Z","title":"Visual vibrometry: Estimating material properties from small motion in video","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:11.382332Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:fc225539d2b04e0833db9e9b8fc1b26aed73fd1ceb4837be2525a7c82a69b691","observation_id":"9a09e17a-966e-4fd9-9ea0-94a8d690936d","resolution":{"observed_at":"2026-08-01T14:02:11.382332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:11.493993Z","title":"Objaverse-xl: A universe of 10m+ 3d objects.Advances in Neural Information Processing Systems, 36:35799–35813, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:11.493993Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:e1580fb4edd65984a5edd84338ad8753a2d5d5470547a574ad69356f733cffa9","observation_id":"85148bf2-772a-4a1c-a1f7-c9c63b26f815","resolution":{"observed_at":"2026-08-01T14:02:11.493993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:11.616219Z","title":"Blenderproc2: A procedural pipeline for photorealistic rendering.Journal of Open Source Software, 8(82): 4901, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:11.616219Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:d6e9edde60a7f12c084b90f53c0e407716ab66eed2b747f769f446e433a61845","observation_id":"b6c54a3a-44a4-4ce9-ae84-8c533c2b345e","resolution":{"observed_at":"2026-08-01T14:02:11.616219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:11.710698Z","title":"Mirrorverse: Pushing diffusion models to realistically reflect the world","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:11.710698Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:48a4f1c8772ed44f4b3b5a9dc4c7e179e111e9ec291630fae2cca70008c78b13","observation_id":"dbc2bd1b-9635-4b0b-82d7-f28982aa556e","resolution":{"observed_at":"2026-08-01T14:02:11.710698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:11.831414Z","title":"Scaling rectified flow trans- formers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:11.831414Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:acaa2b25c85a7d06ef9c08b840d9d985cf5bb5e2ba6206fe6d059644bf0aa50f","observation_id":"8f24475b-81d0-4c34-a08a-cc3bf0ea5be8","resolution":{"observed_at":"2026-08-01T14:02:11.831414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:11.955755Z","title":"Narrlv: Towards a comprehensive narrative-centric evaluation for long video generation models.arXiv preprint arXiv:2507.11245, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:11.955755Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:2838273ae5a1f7ebdc7bcbfe6a87684b1e9763f93611153d5874d78a95f4ef56","observation_id":"36521154-34d1-472c-8d91-f61a6fffa3d2","resolution":{"observed_at":"2026-08-01T14:02:11.955755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:12.095730Z","title":"Force prompting: Video generation models can learn and generalize physics-based control signals.arXiv preprint arXiv:2505.19386, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:12.095730Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:6696d5d7044e0d6294a2ab20d3e611c0d7b3d3e123b37e0631566d430d933e14","observation_id":"414a52ce-de73-4b39-a273-75fa66a036f7","resolution":{"observed_at":"2026-08-01T14:02:12.095730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:12.255998Z","title":"the public 3d asset library.Avaliable online: https://polyhaven","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:12.255998Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:bd92f56a02852deb5b4f0f7a4f8339eb0ead6843819c7fb026e9b03f3faf8fb2","observation_id":"f5498bbb-d82c-4515-9c6b-28884e5eeeba","resolution":{"observed_at":"2026-08-01T14:02:12.255998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:12.452794Z","title":"Videoscore: Building automatic metrics to simulate fine-grained human feedback for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:12.452794Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:6c4c777b403d07d062ea38f0668fbe7fdd3904d442ac73eb0d713dee032955d9","observation_id":"59e4de18-6711-443b-b664-7bd091691f9e","resolution":{"observed_at":"2026-08-01T14:02:12.452794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-01T14:02:12.583962Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers.arXiv preprint arXiv:2205.15868, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:12.583962Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:b42b8785e5bcaa5f2733b87001d9c11fd6f8d6a606a45165b24ed22cc94149c0","observation_id":"c66b3ab8-8f0b-4480-b182-605d3df6f175","resolution":{"observed_at":"2026-08-01T14:02:12.583962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:12.721554Z","title":"Taming hallucinations: Boosting mllms’ video understanding via counterfactual video generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:12.721554Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:9b7ed128176b64623b49d429b6b371df2fd58222c3e034c3dcbc52f628bcc2ef","observation_id":"298fafe7-8e26-4f8a-a472-8573cbc16d2e","resolution":{"observed_at":"2026-08-01T14:02:12.721554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:12.906085Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:12.906085Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:3a91f18470c1a268ba5f6bfdcb7e7953f4eaf16efb203509f234954a290cb4ad","observation_id":"8236003d-eeca-469f-b20b-fd27879f3bad","resolution":{"observed_at":"2026-08-01T14:02:12.906085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13503","last_updated":"2024-11-20T17:54:41Z","snapshot_observed_at":"2026-07-06T19:53:17.024873Z","submitted_at":"2024-11-20T17:54:41Z","title":"VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13503","snapshot_observed_at":"2026-08-01T14:02:13.046477Z","title":"Vbench++: Comprehensive and versatile benchmark suite for video generative models.arXiv preprint arXiv:2411.13503, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:13.046477Z"},"links":{"cited_paper":"/paper/2411.13503","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:342fb6e676a57e2f9a65c50b437543aa8c24b7e19e46ef4f9b96af21c13e05f0","observation_id":"b3318902-9b5d-4783-83c0-5cd457231e6e","resolution":{"observed_at":"2026-08-01T14:02:13.046477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:13.192461Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:13.192461Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:dbe44292e53f3d2feb0e174734a9a33e0395705be1226fb234219ad5094c97b1","observation_id":"1171ecd3-deaa-4f37-a348-2e269ad19b05","resolution":{"observed_at":"2026-08-01T14:02:13.192461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-01T14:02:13.337571Z","title":"Auto-encoding variational bayes.arXiv preprint arXiv:1312.6114, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:13.337571Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:3d5815298370b2ed85da84e90724f69b771f5e77f60684751ef6d3e2054f209b","observation_id":"71c16b8c-6476-46c1-8536-145a8da26bf7","resolution":{"observed_at":"2026-08-01T14:02:13.337571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:13.525719Z","title":"Segment anything","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:13.525719Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:ad05de8e0bc1281b2deef0cdcc114dbfb93663b5e064748f0c61a153e202563f","observation_id":"6b29c610-c81e-48ed-87f9-a65e074070bf","resolution":{"observed_at":"2026-08-01T14:02:13.525719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-01T14:02:13.675414Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:13.675414Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:0d54a37ae577dba8814b61f198579d611c9f5d9b10b18691fc35b8de836e0648","observation_id":"f8b4d62d-40c2-4427-971a-387b84b56092","resolution":{"observed_at":"2026-08-01T14:02:13.675414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09595","last_updated":"2025-03-12T17:58:14Z","snapshot_observed_at":"2026-08-07T17:09:25.212342Z","submitted_at":"2025-03-12T17:58:14Z","title":"PISA Experiments: Exploring Physics Post-Training for Video Diffusion Models by Watching Stuff Drop","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09595","snapshot_observed_at":"2026-08-01T14:02:13.815589Z","title":"Pisa experiments: Exploring physics post-training for video diffusion models by watching stuff drop","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:13.815589Z"},"links":{"cited_paper":"/paper/2503.09595","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:27dae1899ccd95349ebf691a7e76f550d3b53225f2783f20fb43e8fa0f10543a","observation_id":"6c30775e-1d9b-4df1-8129-a98056dff381","resolution":{"observed_at":"2026-08-01T14:02:13.815589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19868","last_updated":"2025-02-27T08:21:03Z","snapshot_observed_at":"2026-08-07T17:43:39.369961Z","submitted_at":"2025-02-27T08:21:03Z","title":"C-Drag: Chain-of-Thought Driven Motion Controller for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19868","snapshot_observed_at":"2026-08-01T14:02:13.955651Z","title":"C-drag: Chain-of-thought driven motion controller for video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:13.955651Z"},"links":{"cited_paper":"/paper/2502.19868","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:156b42ed7588bf1084a344f62a081544ae39851d3ef28b2178929d3aeb238be1","observation_id":"122cae27-733e-43dc-8f93-fc226916eb47","resolution":{"observed_at":"2026-08-01T14:02:13.955651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:14.153902Z","title":"Wonderplay: Dynamic 3d scene generation from a single image and actions.arXiv preprint arXiv:2505.18151, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:14.153902Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:21200ca8cf4e0c9d213942321c8bd1825091d47071f8aecc966e0de3459fd4a1","observation_id":"0f76230f-6272-414c-b1b5-546a806f16a4","resolution":{"observed_at":"2026-08-01T14:02:14.153902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:14.287991Z","title":"Evaluation of text-to-video generation models: A dynamics perspective.Advances in Neural Information Processing Systems, 37:109790–109816, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:14.287991Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:09bc0a47fee921aaedb2ee21fa5d4af1a28ebe102b25e9c22c4f7b802218509b","observation_id":"72f9bfd9-dfc1-4fa8-9ad0-bc3841498d13","resolution":{"observed_at":"2026-08-01T14:02:14.287991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10076","last_updated":"2025-03-16T14:50:16Z","snapshot_observed_at":"2026-08-07T17:08:03.377778Z","submitted_at":"2025-03-13T05:54:42Z","title":"VMBench: A Benchmark for Perception-Aligned Video Motion Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10076","snapshot_observed_at":"2026-08-01T14:02:14.465886Z","title":"Vmbench: A benchmark for perception-aligned video motion generation.arXiv preprint arXiv:2503.10076, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:14.465886Z"},"links":{"cited_paper":"/paper/2503.10076","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:e67c7d107f8944938b0516212d6713127e24657e4c6dc3c61e7e69534ce60672","observation_id":"693ccdc5-3b9f-4ae3-93bb-4e40d6f1c3ff","resolution":{"observed_at":"2026-08-01T14:02:14.465886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-01T14:02:14.619727Z","title":"Flow matching for generative modeling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:14.619727Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:3cf83440a7d81b236f133c19b308eaeae8ac11296ed149bced6dd5842d1cec35","observation_id":"84a83991-d812-4afb-b2d7-27147f8af5af","resolution":{"observed_at":"2026-08-01T14:02:14.619727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16124","last_updated":"2024-07-23T02:10:50Z","snapshot_observed_at":"2026-08-07T22:23:37.324306Z","submitted_at":"2024-07-23T02:10:50Z","title":"Fr\\'echet Video Motion Distance: A Metric for Evaluating Motion Consistency in Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16124","snapshot_observed_at":"2026-08-01T14:02:14.761551Z","title":"Fr \\’echet video motion distance: A metric for evaluating motion consistency in videos.arXiv preprint arXiv:2407.16124, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:14.761551Z"},"links":{"cited_paper":"/paper/2407.16124","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:67086854b38f929b3ab18dab35e0f8728b9d51db7fca3daa234690a3d3e52d35","observation_id":"a1334b48-ec1b-43eb-b1a4-cc5ba24478a1","resolution":{"observed_at":"2026-08-01T14:02:14.761551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.01164","last_updated":"2026-05-31T11:12:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-31T11:12:30Z","title":"Towards Interactive Video World Modeling: Frontiers, Challenges, Benchmarks, and Future Trends","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.01164","snapshot_observed_at":"2026-08-01T14:02:14.937715Z","title":"Towards interactive video world modeling: Frontiers, challenges, benchmarks, and future trends.arXiv preprint arXiv:2606.01164, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:14.937715Z"},"links":{"cited_paper":"/paper/2606.01164","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:d99af937840b424caa47d9b8ea4f718f5b1216e0ff72ec15508dd493767eec6f","observation_id":"566673cd-5a49-450c-b4a3-dea030cbfaec","resolution":{"observed_at":"2026-08-01T14:02:14.937715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:15.103676Z","title":"Compositional visual generation with composable diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:15.103676Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:6805eb76333b50b713df3786be770ffe5c744cca916c3f9a39321d679412190a","observation_id":"d5db0cbd-9f5e-4bc3-9791-2d2bc4fc4e1a","resolution":{"observed_at":"2026-08-01T14:02:15.103676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:15.239485Z","title":"Physgen: Rigid-body physics-grounded image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:15.239485Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:cc5722dcbd1c5e27db5f039f3511a7be6a59d5b25d824578f7fe2356a2c95fa9","observation_id":"00c24bcb-0285-49a9-acd4-2b6df3d2d066","resolution":{"observed_at":"2026-08-01T14:02:15.239485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:15.418653Z","title":"Evalcrafter: Benchmarking and evaluating large video generation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:15.418653Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:7808ab6c6909759570d281114873a79188eb142d894eee7a7bcff07db878225e","observation_id":"23d521e8-72a0-4e82-8e4c-c55990e911a6","resolution":{"observed_at":"2026-08-01T14:02:15.418653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:15.586745Z","title":"Omni-effects: Unified and spatially- controllable visual effects generation.arXiv preprint arXiv:2508.07981, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:15.586745Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:40b363246c8777554f50952616aae42e863e8dc583feec34f642c3ca7018d2d7","observation_id":"46acbb0e-7a42-46c5-aab5-23feb77b89d6","resolution":{"observed_at":"2026-08-01T14:02:15.586745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05363","last_updated":"2024-10-07T17:56:04Z","snapshot_observed_at":"2026-08-08T09:48:34.424815Z","submitted_at":"2024-10-07T17:56:04Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05363","snapshot_observed_at":"2026-08-01T14:02:15.757818Z","title":"Towards world simulator: Crafting physical commonsense- based benchmark for video generation.arXiv preprint arXiv:2410.05363, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:15.757818Z"},"links":{"cited_paper":"/paper/2410.05363","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:446eb3a99767559a6b3318d7927b6a849a0e512dbdde04af78d027a8d7957254","observation_id":"67151adc-7dfc-4161-bb42-557c819e6246","resolution":{"observed_at":"2026-08-01T14:02:15.757818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:15.926713Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:15.926713Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:f032b27bb545e06af8c837f6a5ebeaa7b15c737f560c94a1e42f927722b95d2f","observation_id":"30b2575e-f8f5-42c3-b994-eafefd21f9a7","resolution":{"observed_at":"2026-08-01T14:02:15.926713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09038","last_updated":"2025-02-27T15:10:51Z","snapshot_observed_at":"2026-08-02T17:18:33.867969Z","submitted_at":"2025-01-14T20:59:37Z","title":"Do generative video models understand physical principles?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09038","snapshot_observed_at":"2026-08-01T14:02:16.069275Z","title":"Do generative video models understand physical principles?arXiv preprint arXiv:2501.09038, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:16.069275Z"},"links":{"cited_paper":"/paper/2501.09038","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:b7b36d409c0cfd096de88647dd35a9456298a528b422501ed68317bbdc033811","observation_id":"703dc201-a793-414a-a8de-324f9ab3b9c9","resolution":{"observed_at":"2026-08-01T14:02:16.069275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:16.205762Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:16.205762Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:b33a0687b356ab9e3a7c7ea17e71ef778af1dfa9ea1573841dc7323babcb9899","observation_id":"d1830fc2-492a-4075-97ba-60aa6bb71cf2","resolution":{"observed_at":"2026-08-01T14:02:16.205762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:16.533810Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:16.533810Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:e0c33d3c8701d0e31c68d52e17949b11f5490abaa2c06a58911d35cf8c55f7a7","observation_id":"6e61b543-aaab-4259-b2e4-6f2b3dfc0ec2","resolution":{"observed_at":"2026-08-01T14:02:16.533810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:16.674411Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:16.674411Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:22c4076c177e9200e6f205f4918cf2b7f4bbe71bca3129a18e6e0158c7ced476","observation_id":"8484d829-d3c3-4811-8e3d-32c6422d4266","resolution":{"observed_at":"2026-08-01T14:02:16.674411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-01T14:02:16.807981Z","title":"Open-sora 2.0: Training a commercial-level video generation model in $200 k.arXiv preprint arXiv:2503.09642, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:16.807981Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:57f180582fd0622e37dce5b804355ab54c20e6c2660606c1a59d3f5f12af8dc3","observation_id":"acfafd34-ebcd-4684-8db1-d275f6af47c1","resolution":{"observed_at":"2026-08-01T14:02:16.807981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:16.981257Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:16.981257Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:82b376cbf378f02c2167e87300b1f17109c11a53864b1b06e957f43c9ed5088f","observation_id":"9c0aba36-e70c-4cb8-955b-d37ac9bb439b","resolution":{"observed_at":"2026-08-01T14:02:16.981257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:17.143859Z","title":"Learning to generate object interactions with physics-guided video diffusion.arXiv preprint arXiv:2510.02284, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.143859Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:235fc16f7dd9f087d90c27407d2bdb528684edea4354d53ea768db81a73bb8dc","observation_id":"5024d79d-fa45-472a-b066-44bdb88d0a33","resolution":{"observed_at":"2026-08-01T14:02:17.143859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:17.269701Z","title":"Motion-i2v: Consistent and controllable image-to-video generation with explicit motion modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.269701Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:45c5bd448c86c30223bea5ff2764e610a08279afb209842865a4c49a90f0c1d2","observation_id":"dcc806ba-d00c-41e9-bbcb-02a9bcc869af","resolution":{"observed_at":"2026-08-01T14:02:17.269701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-01T14:02:17.430344Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.430344Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:9b510367a604d7555c1fe2ce95c63cab12842280a5673f16e4bc885e0861e820","observation_id":"fe27c9ab-efff-4f67-b6a6-666dfb03d131","resolution":{"observed_at":"2026-08-01T14:02:17.430344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:17.527740Z","title":"T2v- compbench: A comprehensive benchmark for compositional text-to-video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.527740Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:25cb0eafaa7804fe3246f525b807ce5e8c261f12548fbbc98cfaeab463cabed1","observation_id":"72062958-c053-4720-ac06-ccb67ddff37c","resolution":{"observed_at":"2026-08-01T14:02:17.527740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17189","last_updated":"2024-11-28T05:49:59Z","snapshot_observed_at":"2026-07-06T19:57:06.097199Z","submitted_at":"2024-11-26T07:59:11Z","title":"PhysMotion: Physics-Grounded Dynamics From a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17189","snapshot_observed_at":"2026-08-01T14:02:17.607444Z","title":"Physmotion: Physics-grounded dynamics from a single image.arXiv preprint arXiv:2411.17189, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.607444Z"},"links":{"cited_paper":"/paper/2411.17189","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:1ce4e30dc2f3d97eb117c7a3024052f78adc36f82551fa89b5587bc275111e16","observation_id":"9571e6c4-ff18-4c25-b4db-2c61bcdb194c","resolution":{"observed_at":"2026-08-01T14:02:17.607444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-01T14:02:17.698731Z","title":"Towards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.698731Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:12df2f96fe5ad29721a3fc2886c321b8cbc4dcab8486059b4fe4d8830392ade2","observation_id":"c97436ff-9316-40f9-ae6b-4c609624593b","resolution":{"observed_at":"2026-08-01T14:02:17.698731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-01T14:02:17.765602Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.765602Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:45af8b75d32bfd40f35671ad5bc1985e88c173f2d9052bb68bc1e60d684e013b","observation_id":"89fa2bec-e56a-4521-b4af-e9638ae24a5e","resolution":{"observed_at":"2026-08-01T14:02:17.765602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08153","last_updated":"2025-03-11T08:10:03Z","snapshot_observed_at":"2026-08-07T17:13:59.555705Z","submitted_at":"2025-03-11T08:10:03Z","title":"WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08153","snapshot_observed_at":"2026-08-01T14:02:17.849564Z","title":"Wisa: World simulator assistant for physics-aware text-to- video generation.arXiv preprint arXiv:2503.08153, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.849564Z"},"links":{"cited_paper":"/paper/2503.08153","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:1fa6f29cb556428026884ae09ab40f768fe0027da7d31878c94f1da5c04822e1","observation_id":"9d0f0a43-796d-435d-8ed6-837c78888612","resolution":{"observed_at":"2026-08-01T14:02:17.849564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-01T14:02:17.930533Z","title":"Qwen2-vl: Enhancing vision- language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.930533Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:2ca1e88cd0e874fd486f01454d069a26e1d159731cbe17f4dc2ec883d4b71d81","observation_id":"4b83aea1-688c-4e48-a6c9-a8b388e2d883","resolution":{"observed_at":"2026-08-01T14:02:17.930533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:17.998072Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:17.998072Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:913f4330a0f36fb0e76aa12d9cc31887a1737b2ca5df7fc605853ef75c968b1c","observation_id":"26810570-59e6-4e37-85d8-288fca9841aa","resolution":{"observed_at":"2026-08-01T14:02:17.998072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:18.051417Z","title":"Physanimator: Physics-guided generative cartoon animation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.051417Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:75edcff476fe4398ae9d85bd66a52a0ffa40503ab1f1294cc62112d4a8a74350","observation_id":"fccec0f7-a0e3-4733-8679-05d40ebfb28e","resolution":{"observed_at":"2026-08-01T14:02:18.051417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02918","last_updated":"2026-06-29T01:14:54Z","snapshot_observed_at":"2026-08-07T16:11:10.408396Z","submitted_at":"2025-04-03T15:21:17Z","title":"Evaluating Newtonian Mechanics in Video Generative Models with Real Physical Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02918","snapshot_observed_at":"2026-08-01T14:02:18.123112Z","title":"Morpheus: Benchmarking physical reasoning of video generative models with real physical experiments.arXiv preprint arXiv:2504.02918, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.123112Z"},"links":{"cited_paper":"/paper/2504.02918","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:35d47156b7d96ca15c50743bc80ee5839e1c8f272d08828a1e48a810349b8846","observation_id":"ba90ebb6-a518-4cc0-8c12-3e6dacd38979","resolution":{"observed_at":"2026-08-01T14:02:18.123112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:18.188573Z","title":"Adding conditional control to text-to-image diffusion models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.188573Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:408acb689c4219e0fb005cf0905fff53965d861427dd0121b480a0f1f8c0907e","observation_id":"f556f461-947a-4ff2-95fc-dc395931f5f8","resolution":{"observed_at":"2026-08-01T14:02:18.188573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:18.278100Z","title":"Tora: Trajectory-oriented diffusion transformer for video generation","venue":null,"work_id":null,"year":2063},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.278100Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:07dc8ccf07e735f09dff55a1a12770a6add3a60c8754502cd6c97c0bfd52cd79","observation_id":"d0b2b008-9992-4eca-a527-0bf009ed72b2","resolution":{"observed_at":"2026-08-01T14:02:18.278100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:18.344030Z","title":"Attention never lie: Visual attention defocus reveals and rectifies hallucinations in mllms","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.344030Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:67dcf38465d3a970d4349dfa841ee2df0a75a0b321ffd868123368589aa00ce3","observation_id":"0211c92b-4f20-4d7b-9cb1-8ba264dddddd","resolution":{"observed_at":"2026-08-01T14:02:18.344030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:18.402859Z","title":"Extending one-step image generation from class labels to text via discriminative text representation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.402859Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:6ac24ac0e7f1adff09990d72d73511cce0c516f0e7095f097772607eb00a4cd8","observation_id":"587823ea-461d-4097-94a1-78a6f409df20","resolution":{"observed_at":"2026-08-01T14:02:18.402859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-08-01T14:02:18.467232Z","title":"Vbench-2.0: Advancing video generation benchmark suite for intrinsic faithfulness.arXiv preprint arXiv:2503.21755, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.467232Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:9ae52f969a9542d9e1729be53a005381c4e06bc6459545736e2eaa3a2c45094d","observation_id":"12a80ab6-ce59-46f4-b579-44a15519e5f7","resolution":{"observed_at":"2026-08-01T14:02:18.467232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-01T14:02:18.505231Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.505231Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:435883cf5f82ed2a54a1b44dd9e5ce3e62ab04e1db93f7f87bfe84b116fe6a51","observation_id":"50ceef46-4673-42a3-9516-a86c91894d2f","resolution":{"observed_at":"2026-08-01T14:02:18.505231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:18.578051Z","title":"passes the criterion","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.578051Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:08b5f030c01b839d507c1275fe3d730e396c41f778929f4c5e2ec7becb211560","observation_id":"c438d6d5-5918-4e6b-9a0e-23f0ad30361b","resolution":{"observed_at":"2026-08-01T14:02:18.578051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:18.643398Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.643398Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:a2ff6245acfcd930d61567dcc926be05a723a18ec0c9bad7907b09ee6484227b","observation_id":"1bc49aa8-8505-4a26-a13a-6c84738bf56e","resolution":{"observed_at":"2026-08-01T14:02:18.643398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:18.682158Z","title":"yes\" if the anomaly exists or","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:18.682158Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:d9ed8af5e33db4949e179da597249270b4833dbbb8cf3636192858689e6a5b83","observation_id":"3b6ba6e2-b355-43fa-b8ed-d7544ba9999a","resolution":{"observed_at":"2026-08-01T14:02:18.682158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:02:16.366309Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T14:02:16.366309Z"},"links":{"citing_paper":"/paper/2607.18924"},"observation_digest":"sha256:4f82f577e6e60dbf7aab92448eaa1d166b09f7d51e9904b3d76909d8811695fd","observation_id":"5ce67969-a8b9-48f9-9aed-00c75f726496","resolution":{"observed_at":"2026-08-01T14:02:16.366309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18924","last_updated":"2026-07-21T10:06:55Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T05:11:00.363961Z","submitted_at":"2026-07-21T10:06:55Z","title":"Learning Explicit Physical Parameter Control and Benchmarking for Video Generation"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2607.18924."}