{"as_of":"2026-08-09T13:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61c70d2d466fb8f42c3f2b85eb58bfd01fe6fe90884c5dbd5d65c20032157895","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:44:21.070944Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18664/citation-record","integrity":"/paper/2607.18664/integrity","json":"/paper/2607.18664/citation-record.json","paper":"/paper/2607.18664"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:17.743247Z","title":"In: The Eleventh International Conference on Learning Representations (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:17.743247Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:47c4a70ec7447b233c995de10d9c540d530038a16a1e99d86815f3fe898779d0","observation_id":"4682738f-07cc-450c-bab6-33d212ab2522","resolution":{"observed_at":"2026-08-01T14:44:17.743247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-01T14:44:17.883361Z","title":"arXiv preprint arXiv:2309.16609 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:17.883361Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:b9c68a1d78dd5be9ec7a45d0c130bbf700be83aaa2d14540820c4d462b33b6b3","observation_id":"064c1889-b8d5-4661-a557-89278839390a","resolution":{"observed_at":"2026-08-01T14:44:17.883361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:18.105996Z","title":"In: The Thirty- ninth Annual Conference on Neural Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:18.105996Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:88cfb93c816d92546abf67eee095f0c27b253dda4bda7d0faba3a6c4ff20174a","observation_id":"0a7c4ad0-9a27-4228-8789-b82ac940f234","resolution":{"observed_at":"2026-08-01T14:44:18.105996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:18.214128Z","title":"Advances in neural information processing systems31(2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:18.214128Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:68fcd7568cd0a29004f5ee32cf89ebbe146e4ccd5427ebf332d335e554176d9e","observation_id":"3e6dd117-2679-475d-8418-ef73fef173bd","resolution":{"observed_at":"2026-08-01T14:44:18.214128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:18.331702Z","title":"arXiv preprint arXiv:2512.16906 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:18.331702Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:de692ae2d8d92d4677fa3cbac832ea67c12cff99b5489aa10ce899e08b4f8a24","observation_id":"f41a4b79-4a26-4fe1-9f63-4bb2db3ebe7d","resolution":{"observed_at":"2026-08-01T14:44:18.331702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:18.464076Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:18.464076Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:567fce057e1aa9773a482ab71a4e3d9c3f95d53de3ed864a826f17f814a98c9d","observation_id":"5124da43-6750-4d0b-b6bd-d62066905850","resolution":{"observed_at":"2026-08-01T14:44:18.464076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:18.567811Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:18.567811Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:c2ba5aa2b83d8715fc8d711ddbeff0bdd71fdac875dff0da5b28764ef2a63a35","observation_id":"8b7db54b-0409-45f3-8098-6171f4e785c8","resolution":{"observed_at":"2026-08-01T14:44:18.567811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:18.621133Z","title":"In: The Thirty-ninth Annual Conference on Neural Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:18.621133Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:2b9b11ad23db7a4812c7ff316b958b7fa4d76942768a471e9856e0fa3dbe96cb","observation_id":"13e708f6-393a-4c21-82bd-950dcabf3dac","resolution":{"observed_at":"2026-08-01T14:44:18.621133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:18.794994Z","title":"In: ICLR 2025 Workshop on World Models: Understanding, Modelling and Scaling (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:18.794994Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:f10d8189ccf4555321de709b12eeaef0fd3420f160dd2b41a2274e7e57b7a105","observation_id":"78c08be9-3b31-4eae-887a-b2d774652a26","resolution":{"observed_at":"2026-08-01T14:44:18.794994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-01T14:44:18.927812Z","title":"arXiv preprint arXiv:2207.12598 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:18.927812Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:b284264604e9ca992871b6092729b049d7ac02e97e3954ff1047e940ac082ec4","observation_id":"34c9b918-2a06-4045-bf22-b533087a78ce","resolution":{"observed_at":"2026-08-01T14:44:18.927812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.030225Z","title":"In: International Conference on Learning Representations (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.030225Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:4b2e2eea5ff85122a4056bc7778c4b4af1f7b41f3bec328ec2b0866caa380684","observation_id":"cda89d06-9f13-47b5-9d0f-369ca891467e","resolution":{"observed_at":"2026-08-01T14:44:19.030225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.104777Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2024) 16 Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.104777Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:85b7757539c4a733c690be8300c647160536da66cff63350aeb901979da3521f","observation_id":"f3711631-c422-4251-a935-e668955d6821","resolution":{"observed_at":"2026-08-01T14:44:19.104777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.207981Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.207981Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:af6c74ba3e8444aeef29d9ef4ce96359aa9402137c1e7f2f02d7faa9f878c367","observation_id":"7c250172-116b-44a8-88b0-20b5a4df7d5a","resolution":{"observed_at":"2026-08-01T14:44:19.207981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-01T14:44:19.320912Z","title":"arXiv preprint arXiv:2412.03603 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.320912Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:62848f1435ec86564ee0b68e6dfdaf5183a42bc35887245f39c601789922960f","observation_id":"9edfc4e8-12b0-4b46-91b7-2864f6681324","resolution":{"observed_at":"2026-08-01T14:44:19.320912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.422910Z","title":"In: Forty-second International Conference on Machine Learning (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.422910Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:af1e8b630f76cab6624417a1405febca30c011fb6339399331c2975e467a3f4e","observation_id":"f39d7c00-b292-46d2-9c39-a03f2201d00c","resolution":{"observed_at":"2026-08-01T14:44:19.422910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.536680Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.536680Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:760740402e666ec9bf376c32a970d170246a1ceaeefe7d8a8d1b93c6a771689e","observation_id":"f84a1260-73c8-4bd9-8197-2d92fd860598","resolution":{"observed_at":"2026-08-01T14:44:19.536680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.644634Z","title":"In: The Eleventh International Conference on Learning Representations (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.644634Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:15c2955fec0a5aea49976e90ee0a2ef6f8b7577f0a5642409262451016ed1131","observation_id":"a1fa52bb-b30e-4f8c-b598-d87d77a1053c","resolution":{"observed_at":"2026-08-01T14:44:19.644634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.718496Z","title":"In: European Conference on Computer Vision ECCV (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.718496Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:9424244a8f91acb92b240b7f0d5104198c5516048703d9a2fedcadc8b97e893a","observation_id":"4946216f-ec35-4dbb-9892-56a970af2f6d","resolution":{"observed_at":"2026-08-01T14:44:19.718496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.801245Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.801245Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:392678a3b9fe7a654421a65f476d5c1e62561a477b1968765e2dd343f5926aac","observation_id":"66e1ce53-ffec-423d-a130-48e1316c596b","resolution":{"observed_at":"2026-08-01T14:44:19.801245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.879318Z","title":"In: Thirteenth International Con- ference on 3D Vision (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.879318Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:d358dfafa0aa35102a2d00dde2ff5aea4d09930c73c907b4148ef90a627362a5","observation_id":"2ebb1394-19de-4e07-9893-4808ef5260ef","resolution":{"observed_at":"2026-08-01T14:44:19.879318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13211","last_updated":"2025-05-19T14:58:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-19T14:58:50Z","title":"MAGI-1: Autoregressive Video Generation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13211","snapshot_observed_at":"2026-08-01T14:44:19.944058Z","title":"arXiv preprint arXiv:2505.13211 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.944058Z"},"links":{"cited_paper":"/paper/2505.13211","citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:8bcf6a0ee1f68df662d7a44d4355dc0d418c63546a89de82dc2ce200e72528de","observation_id":"7bacff72-29b1-484c-ae39-55eeea353c93","resolution":{"observed_at":"2026-08-01T14:44:19.944058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:19.987088Z","title":"Advances in neural information pro- cessing systems30(2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:19.987088Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:4d749b6340d57fb9f911400d705569b030a80461b9af13380cf10cafc70bb63b","observation_id":"3dc23b0f-6286-45a1-b358-70fa31015712","resolution":{"observed_at":"2026-08-01T14:44:19.987088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-01T14:44:20.067048Z","title":"arXiv preprint arXiv:2503.20314 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.067048Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:acf16b7961c9b73d11aa2d90185d856ff0996d561afaec2d1693ee151f89c941","observation_id":"495b3b12-9faa-45dc-b25f-0d6f54c1093d","resolution":{"observed_at":"2026-08-01T14:44:20.067048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:20.115136Z","title":"In: The Thirty-ninth Annual Conference on Neural Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.115136Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:ff86d4ab3373f5486dc11b1c297efc924af35fbffb1beb15aa88c876f3d37b4d","observation_id":"ce9cc7bd-1715-42db-a0b9-14093278696d","resolution":{"observed_at":"2026-08-01T14:44:20.115136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09985","last_updated":"2024-01-18T14:01:20Z","snapshot_observed_at":"2026-08-07T06:47:36.460071Z","submitted_at":"2024-01-18T14:01:20Z","title":"WorldDreamer: Towards General World Models for Video Generation via Predicting Masked Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09985","snapshot_observed_at":"2026-08-01T14:44:20.192036Z","title":"arXiv preprint arXiv:2401.09985 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.192036Z"},"links":{"cited_paper":"/paper/2401.09985","citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:c5bce0f3ab1eb41dabe7eb5fed5cdb6683621b0fbba9ad69e686bb2e3f3f5e04","observation_id":"a8405e07-acc2-4b16-bcb5-82b027e61bed","resolution":{"observed_at":"2026-08-01T14:44:20.192036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:20.266371Z","title":"International Journal of Computer Vision (2024) DeforM 17","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.266371Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:7f6b1dcb645f41f6507b9c5ed31140c46f5a0cd392b1c8d70342206f7c3f4219","observation_id":"7edfd7f8-f8fa-4583-8449-cde99bcc9552","resolution":{"observed_at":"2026-08-01T14:44:20.266371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:20.364047Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.364047Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:23314d2219d17eea41bf1ec97677fb9011b723d1bad440c84aa78edf6d25e1bd","observation_id":"3a2ea56f-4346-4bba-bd57-82ee73ac31e9","resolution":{"observed_at":"2026-08-01T14:44:20.364047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T14:44:20.477378Z","title":"arXiv preprint arXiv:2505.09388 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.477378Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:089ec9319c2b0e6aca02d7dcfa489f4ec0c26b0d092cbb762b50dc3f7b41424a","observation_id":"63bcd084-bee3-4769-9e77-e33dc16459d6","resolution":{"observed_at":"2026-08-01T14:44:20.477378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-01T14:44:20.567233Z","title":"arXiv preprint arXiv:2412.15115 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.567233Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:1e871d8942045c17945d79f6c5dbdd83d275dcc085e639b7a4710e37965dac9c","observation_id":"9f0e6aca-39ee-4e02-aa3e-8a20a0a362f6","resolution":{"observed_at":"2026-08-01T14:44:20.567233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:20.641544Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.641544Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:8edfa79d7b535e3a07006eb3051eb6e77d72689f433d89fc99bda2aaca557de0","observation_id":"36f63bce-e425-4418-b42a-b08ba05328d7","resolution":{"observed_at":"2026-08-01T14:44:20.641544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:20.717885Z","title":"In: The Thirteenth International Conference on Learning Represen- tations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.717885Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:49e3b418ffd131cf152408ce0a54a3af9057e35a8ab57ef67d18127cfe61fc8c","observation_id":"952dcd95-2182-43e4-a0e3-75b4c4668718","resolution":{"observed_at":"2026-08-01T14:44:20.717885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:20.795751Z","title":"In: Christodoulopoulos, C., Chakraborty, T., Rose, C., Peng, V","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.795751Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:29b9140c0db935dc0be990311d57cbbb4d41b16790414863da60ef3663f4e3a1","observation_id":"f64f75bb-edd3-45ec-be45-32b23a361b6e","resolution":{"observed_at":"2026-08-01T14:44:20.795751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:20.954497Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.954497Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:02d8e87c1fc22864b2f210a33d2efcc1b7930eea9b8f1d843ea0ad2d0765935b","observation_id":"22068887-0546-45da-adf0-c0d9c13e736b","resolution":{"observed_at":"2026-08-01T14:44:20.954497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:21.011762Z","title":"arXiv preprint arXiv:2601.11087 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:21.011762Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:e455f526ce3caaeecfe0413e9c8651a21a5a0a0853ffc4e32b91d6d4c40bd865","observation_id":"d2c19b79-20e9-4879-bf1e-bfe492db225d","resolution":{"observed_at":"2026-08-01T14:44:21.011762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:21.070944Z","title":"A soft rubber ball is being squeezed by a hydraulic press","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:21.070944Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:29ab06c68824fdda3b080f54187fb5ab3da8cc746e527178d9d0c3f5355e6baa","observation_id":"3a8c6277-44d9-4ad5-874f-c1a69e21086c","resolution":{"observed_at":"2026-08-01T14:44:21.070944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:44:20.865464Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking","version":1},"reference_index":958,"source":"pdf_text","source_observed_at":"2026-08-01T14:44:20.865464Z"},"links":{"citing_paper":"/paper/2607.18664"},"observation_digest":"sha256:9451b2d0a1bc24fdc410a169eda2694c93151168b74106e89dd557128cb9d1a7","observation_id":"b10c93bc-d2df-4e00-b9bf-e87190fd5b31","resolution":{"observed_at":"2026-08-01T14:44:20.865464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18664","last_updated":"2026-07-21T03:23:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-01T23:55:18.410542Z","submitted_at":"2026-07-21T03:23:52Z","title":"DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.18664."}