{"as_of":"2026-08-10T23:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65ff9fd39da5c95b2377e6faff801dfb5aff75a1896e1846db31e3e51c9a7c50","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T21:29:22.063180Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23472/citation-record","integrity":"/paper/2607.23472/integrity","json":"/paper/2607.23472/citation-record.json","paper":"/paper/2607.23472"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.934247Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.934247Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:69d56a4b7e286a95a76f91a78f19ec0201764a3d47d08f5f67ee504663bd160d","observation_id":"635f0cfb-1666-455b-affa-b490c3acc9df","resolution":{"observed_at":"2026-07-30T21:29:21.934247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-30T21:29:21.938903Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.938903Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:3295ccad5583c4e649dc4bf6fc8c006b076259a0e649deb0a72cab1492978bed","observation_id":"dc00cf2b-7ab0-4a41-8e6b-1cc0a9c63ee2","resolution":{"observed_at":"2026-07-30T21:29:21.938903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.943209Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.943209Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:3257e4c0f64c1bf2833e3b72a6ee89c12f3945ff6d2f255858ed36ad4d4910e8","observation_id":"fcd3a0e4-d5c2-4cba-b15a-c33a39b0023f","resolution":{"observed_at":"2026-07-30T21:29:21.943209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.946691Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.946691Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:0317c4f66529744d97de5305e98403d737aa0ca6c6ff6fef851a969d227c66fa","observation_id":"863b6706-2ed6-4397-8a64-7e560fd18ded","resolution":{"observed_at":"2026-07-30T21:29:21.946691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09047","last_updated":"2024-01-17T08:30:32Z","snapshot_observed_at":"2026-08-04T07:40:19.403363Z","submitted_at":"2024-01-17T08:30:32Z","title":"VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09047","snapshot_observed_at":"2026-07-30T21:29:21.953818Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.953818Z"},"links":{"cited_paper":"/paper/2401.09047","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:1a2f2310f3815270e32f62db66ff0f8bbefe65e3e3d9d1d5b14d40245a62e862","observation_id":"3b135105-3c35-475d-8696-05d0f6bf9543","resolution":{"observed_at":"2026-07-30T21:29:21.953818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.957388Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.957388Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:a0d09162f4a61af239a0c7efd74831a4321abb4afb72e3e05a1f7883eeac636b","observation_id":"a5d0f21e-71e6-455a-af60-c191adb1bf77","resolution":{"observed_at":"2026-07-30T21:29:21.957388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.960337Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.960337Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:de9fbd869e0c7ff3b24d2746defcce0ba7998e6b1f0a4ed0ac0e0c39b8cc63a9","observation_id":"4d3ecdcf-2142-4856-b6e3-6be07da3ec96","resolution":{"observed_at":"2026-07-30T21:29:21.960337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.963558Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.963558Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:98fffe7f69d839dbb58590ea9d9008a13a125a1a9b4efbf9c7cf04f18aece4b0","observation_id":"e9541e45-3a81-4a88-87f1-fd1b20e5b008","resolution":{"observed_at":"2026-07-30T21:29:21.963558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.966493Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.966493Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:1d06a4bd91e66b0adf6c40eaf83e8b538122776662b627c166d658460f3bba9c","observation_id":"887138d4-d1e1-4ea1-8359-8a2f02d4be10","resolution":{"observed_at":"2026-07-30T21:29:21.966493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.969378Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.969378Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:2d213c4cd45321247ba96c5715f6f15bc0a094b9025b8ef86b8ac0a4b712991d","observation_id":"cc7b5e82-3796-48a6-bd17-3ffc068e069b","resolution":{"observed_at":"2026-07-30T21:29:21.969378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.972203Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.972203Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:a2eca55b925c4e414f53fd0b245b3d51ba9fafa6c47dc0828fc8f507f4804f6a","observation_id":"cb3bcca4-bca2-457f-b127-d3adea10d8a3","resolution":{"observed_at":"2026-07-30T21:29:21.972203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23775","last_updated":"2024-11-05T06:41:27Z","snapshot_observed_at":"2026-07-06T19:42:47.238254Z","submitted_at":"2024-10-31T09:45:00Z","title":"In-Context LoRA for Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23775","snapshot_observed_at":"2026-07-30T21:29:21.975077Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.975077Z"},"links":{"cited_paper":"/paper/2410.23775","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:491e6c2a633176232f867f5ee4d6bd87e6d42dad54f169bff24d54b6bdb0e493","observation_id":"65825cde-1d16-4043-889e-149dd1d88bf3","resolution":{"observed_at":"2026-07-30T21:29:21.975077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.978275Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.978275Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:e99c0bc96ade657c7dfc13235363318448cea8f19a8104c988f950873da9453b","observation_id":"40b005c4-053c-4cf7-8f94-d3dabd5bf9df","resolution":{"observed_at":"2026-07-30T21:29:21.978275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.980983Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.980983Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:a60d38b496b1c66ce839deef6be2d4c99b84de04a1066e2b14e5683caa54e111","observation_id":"cb2581fa-ee3f-4031-962a-423b7dcf999a","resolution":{"observed_at":"2026-07-30T21:29:21.980983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.983843Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.983843Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:3ab4728e388a7ad66048e2bf283b0638680f4a53879469f5fb99c9864c6fd6e9","observation_id":"0d064536-cfb6-4d59-81f7-2e57b284d2ab","resolution":{"observed_at":"2026-07-30T21:29:21.983843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-07-30T21:29:21.986630Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.986630Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:aca39d13c50ca9be7bf8a922ef0bbe146b73c7d3d1d81b0faedb1bf04bfc5e5a","observation_id":"e95611d8-d6a5-4077-a967-6837a6c523ab","resolution":{"observed_at":"2026-07-30T21:29:21.986630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-07-30T21:29:21.990035Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.990035Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:121ddd68c1c416bb498509842af8bb1a213cf281a3a4fa7f023ed00113ba7ee5","observation_id":"3fbb113b-438e-49a2-bec8-608bcb4236fe","resolution":{"observed_at":"2026-07-30T21:29:21.990035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.993282Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.993282Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:c695e9dcfe2c82b71ce65c2144d6f9e8df13470835768c043eaea47ddee272cd","observation_id":"c16ae30c-c32a-4791-961b-3a1b23336417","resolution":{"observed_at":"2026-07-30T21:29:21.993282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-09T23:28:59.299375Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-07-30T21:29:21.999038Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.999038Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:9a8ea42845ac28c4ba24d1bde47b69904fb7a5bc7c23e37031d5320511ceb37b","observation_id":"2bbebcd1-a9cc-4bc4-b1f6-08c7e4cabf20","resolution":{"observed_at":"2026-07-30T21:29:21.999038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-07-30T21:29:22.002543Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.002543Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:1c0c81b146b6a75f6db1631d99637862f711a8c1b7704bd2234f3f12509eaf0b","observation_id":"da9b5b91-7639-4968-8fb7-7fbd2a31cb5a","resolution":{"observed_at":"2026-07-30T21:29:22.002543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.005912Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.005912Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:4f3e08694ccdd0e776b5c3f79bddb2f2ee6f64950f6df3345a14158f7acadd9f","observation_id":"5c7cd71c-0da9-46cd-bd6c-3315e0b4d4d0","resolution":{"observed_at":"2026-07-30T21:29:22.005912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.008944Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.008944Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:710b87b5637d0cacb6bc273e41fdbcd0f8bacd3b4985f0dae961b7513f89ce18","observation_id":"d772a752-bccf-4722-86d3-6ea1889f5625","resolution":{"observed_at":"2026-07-30T21:29:22.008944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.012011Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.012011Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:bcb47db3494c4c290a0cfb07adf6b81bbe810a38e59df4d2ecd2ca2cadbe711d","observation_id":"623df62f-2a64-42fb-9203-4e1991c4dc81","resolution":{"observed_at":"2026-07-30T21:29:22.012011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.015478Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.015478Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:192ab9e63a136fd3d3f57da16b87c98074bfa8e655426699a2f407a8907caa7d","observation_id":"e68ff71b-c9cc-49da-b18d-efddb47c3b97","resolution":{"observed_at":"2026-07-30T21:29:22.015478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08503","last_updated":"2026-05-18T19:22:00Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:48:46Z","title":"Phantom: Physics-Infused Video Generation via Joint Modeling of Visual and Latent Physical Dynamics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08503","snapshot_observed_at":"2026-07-30T21:29:22.018725Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.018725Z"},"links":{"cited_paper":"/paper/2604.08503","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:a49f9564d844d98fb0668f23df333a6b33611541e1e51683b796d8740b9c8b47","observation_id":"f4615e45-dcaf-4a41-aa32-1756cfc086d9","resolution":{"observed_at":"2026-07-30T21:29:22.018725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.021817Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.021817Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:8ee91dd37d32edf45e83ab0e27af3ab433e5774c8ab97d4ab24f01f7f325b1bd","observation_id":"6e94a4b3-b38d-42d9-af27-2858836c455e","resolution":{"observed_at":"2026-07-30T21:29:22.021817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-30T21:29:22.024746Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.024746Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:2f432360ab8de07ca0980cd80ec9ce06709c7e9621dff10a1541962ce534cd42","observation_id":"fd80fe10-dd4c-4b71-80f5-ec3bce97cd68","resolution":{"observed_at":"2026-07-30T21:29:22.024746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.028323Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.028323Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:95a601a413e83f021261aefa08ca7d6d140c39d17422e70dff9df9c07e44ebb5","observation_id":"2539d937-2792-4658-aacc-fb485e4201bc","resolution":{"observed_at":"2026-07-30T21:29:22.028323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08153","last_updated":"2025-03-11T08:10:03Z","snapshot_observed_at":"2026-08-10T19:42:40.509462Z","submitted_at":"2025-03-11T08:10:03Z","title":"WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08153","snapshot_observed_at":"2026-07-30T21:29:22.031247Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.031247Z"},"links":{"cited_paper":"/paper/2503.08153","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:3cf267f5dd0539ae1339d036e369a902acefaf2d93f7029dfb6cbb8b953d7076","observation_id":"e8710bc3-4333-47b0-87e0-ec7bd9989a7c","resolution":{"observed_at":"2026-07-30T21:29:22.031247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.034555Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.034555Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:d43e2e06adb0176b5d6e057a60d92ea8b55da14df77d5a3d5286ec6124114cfb","observation_id":"b4fe99a0-c8a0-4ea1-9d29-78884daccbb5","resolution":{"observed_at":"2026-07-30T21:29:22.034555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08377","last_updated":"2026-07-03T16:46:11Z","snapshot_observed_at":"2026-08-07T16:29:46.498912Z","submitted_at":"2025-10-09T16:01:30Z","title":"UniVideo: Unified Understanding, Generation, and Editing for Videos","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.08377","snapshot_observed_at":"2026-07-30T21:29:22.037630Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.037630Z"},"links":{"cited_paper":"/paper/2510.08377","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:2f1018b37d88f9288c9c6dc6c6bdcc9ca58451eb32b37a65f62cca4f20e1b878","observation_id":"0efbaabf-c1b7-4f11-ac4b-db74755c689b","resolution":{"observed_at":"2026-07-30T21:29:22.037630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.041250Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.041250Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:6dba14eab60a7e7f71b86328e9f26f989e0f91788d16f59bc70c3f69bb5584db","observation_id":"ccd54f15-dbf8-4313-b348-c733f45ed38d","resolution":{"observed_at":"2026-07-30T21:29:22.041250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04216","last_updated":"2025-06-04T17:57:43Z","snapshot_observed_at":"2026-08-08T15:17:23.629862Z","submitted_at":"2025-06-04T17:57:43Z","title":"UNIC: Unified In-Context Video Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04216","snapshot_observed_at":"2026-07-30T21:29:22.044288Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.044288Z"},"links":{"cited_paper":"/paper/2506.04216","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:fdd695618c0471ece0d83e2d6e406b1038071ed297786f4cd6d3e8e26259f3ec","observation_id":"472d2eac-e423-4ae7-b712-c3f14bfe72bf","resolution":{"observed_at":"2026-07-30T21:29:22.044288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.047687Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.047687Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:d7ec40231c6c41d8ab64a2845417313f8f30e37193b0567b293964f4bd071f6e","observation_id":"1b0d73e5-c298-439d-a3fc-885606b02992","resolution":{"observed_at":"2026-07-30T21:29:22.047687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.054043Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.054043Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:23c348f0aaa8f19ce0e5e8f9dd2555bb8582fc1ae091577026cd774f3fa039b5","observation_id":"9ad0e839-f9aa-4ed3-b08d-199dc0919d2e","resolution":{"observed_at":"2026-07-30T21:29:22.054043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.060282Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.060282Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:098ef61ec343a059316aac21712346767d3f144496f85104ad3c4e0919406529","observation_id":"5eef571f-66e3-4d3e-b698-aee2270514e0","resolution":{"observed_at":"2026-07-30T21:29:22.060282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:22.051050Z","title":"arXiv preprint arXiv:2509.21309 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.051050Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:be2ef7088c0c889e7f9efc7855891b2f1ca43d6b96cd2cbd1bf9bdd2b25f2409","observation_id":"91fb2fa9-01f1-443f-b928-3080ba11ad64","resolution":{"observed_at":"2026-07-30T21:29:22.051050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20562","last_updated":"2026-06-26T07:28:21Z","snapshot_observed_at":"2026-08-08T08:43:10.899219Z","submitted_at":"2025-11-25T17:59:04Z","title":"PhysChoreo: Physics-Controllable Video Generation with Part-Aware Semantic Grounding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.20562","snapshot_observed_at":"2026-07-30T21:29:22.057206Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.057206Z"},"links":{"cited_paper":"/paper/2511.20562","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:d0da7f03cb8247e4f287416304cbd2c0abd9affe3576efe4e32728aa5c2d42a5","observation_id":"4b564e87-dcbd-4be2-986b-3030edeb3268","resolution":{"observed_at":"2026-07-30T21:29:22.057206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-08-10T02:47:20.223653Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-07-30T21:29:22.063180Z","title":"Rigid\", NOT","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:22.063180Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:5caf8ed6ee86676a157a4c4c70669488aa9f7365133b1b10585ce1bf4b0383c4","observation_id":"0136a70f-90c6-45de-b8b8-b13c668238de","resolution":{"observed_at":"2026-07-30T21:29:22.063180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.950117Z","title":"https://openai.com/research/ video-generation-models-as-world-simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.950117Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:b34a4bc20adf0cfd155c8bb91226b537166f9b4875bea10aff8828f6ee69e009","observation_id":"3b674f50-3494-427b-b3cb-1431a500bd74","resolution":{"observed_at":"2026-07-30T21:29:21.950117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:29:21.996114Z","title":"InProceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-30T21:29:21.996114Z"},"links":{"citing_paper":"/paper/2607.23472"},"observation_digest":"sha256:1d08a0aebeca08ccec5dfac86b4966cdb6ed106d6edeec290d6639c9d0213029","observation_id":"86cd2a33-1c2d-40e0-a631-09c1d9ee8ea7","resolution":{"observed_at":"2026-07-30T21:29:21.996114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23472","last_updated":"2026-07-26T05:55:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T18:33:16.540817Z","submitted_at":"2026-07-26T05:55:49Z","title":"VIPER: Visual In-Context Physics Reasoning for Physically Plausible Video Generation"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2607.23472."}