{"as_of":"2026-08-10T02:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:92fcc12b2db704a6d559d13b48f0075aa26580d69c3d94fe8f55e4c46dcdf61c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:10:59.227370Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:59:51.792842Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-08-07T15:10:59.227370Z","title":"T2vphysbench: A ﬁrst-principles benchmark for physical co nsistency in text-to-video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16284","last_updated":"2025-05-22T06:26:28Z","snapshot_observed_at":"2026-08-10T01:41:15.096995Z","submitted_at":"2025-05-22T06:26:28Z","title":"Only Large Weights (And Not Skip Connections) Can Prevent the Perils of Rank Collapse","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:59.227370Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2505.16284"},"observation_digest":"sha256:39d4c77ff785c0f58d581fc9cbd13e01430ad72a69ca1fc5c7f6496581047c60","observation_id":"8cb376a6-b392-45e1-bb4c-431867813afe","resolution":{"observed_at":"2026-08-07T15:10:59.227370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-08-07T14:21:00.809131Z","title":"T2vphysbench: A first-principles benchmark for physical consistency in text-to-video generation.arXiv preprint arXiv:2505.00337,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19531","last_updated":"2025-05-26T05:33:26Z","snapshot_observed_at":"2026-08-08T07:05:10.715675Z","submitted_at":"2025-05-26T05:33:26Z","title":"Minimalist Softmax Attention Provably Learns Constrained Boolean Functions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:21:00.809131Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2505.19531"},"observation_digest":"sha256:4447da0ff44819539e1d53886f54b8e340f06bcf24a1f8d0f8f16eae41af49de","observation_id":"98c36a3c-2de1-4115-adcb-e61fcb878086","resolution":{"observed_at":"2026-08-07T14:21:00.809131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-08-06T21:56:07.727890Z","title":"T2vphysbench: A first-principles benchmark for physical consistency in text-to-video gen- eration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-07T02:31:43.164112Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:07.727890Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:a0051686b27d4d111b69175e16dbed2e0559e762b0b7da280f167856af773b18","observation_id":"4e1360c3-4a96-4455-9b03-44228dfbfd3a","resolution":{"observed_at":"2026-08-06T21:56:07.727890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2507.00990","last_updated":"2026-05-13T01:35:48Z","snapshot_observed_at":"2026-07-06T21:50:35.488353Z","submitted_at":"2025-07-01T17:39:59Z","title":"Robotic Manipulation by Imitating Generated Videos Without Physical Demonstrations","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T06:36:13.144868Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2507.00990"},"observation_digest":"sha256:9ce213207484d4980577f31c26f6be8cf356ae54db015e179a6b24e15c635aaa","observation_id":"fef64780-62f8-4a40-a663-42b2b3ee5c20","resolution":{"observed_at":"2026-05-19T06:37:07.430681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-08-06T16:30:50.661700Z","title":"T2vphysbench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.13428","last_updated":"2026-05-26T08:34:24Z","snapshot_observed_at":"2026-08-06T16:22:35.916708Z","submitted_at":"2025-07-17T17:54:09Z","title":"\"PhyWorldBench\": A Comprehensive Evaluation of Physical Realism in Text-to-Video Models","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:30:50.661700Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2507.13428"},"observation_digest":"sha256:30b25df5e0f4ec6472d9c8841d8f64a8cee880b8a6fda03e01d79523ead51c75","observation_id":"55a62bf1-db40-453d-aea7-ba6bf45cd070","resolution":{"observed_at":"2026-08-06T16:30:50.661700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T23:01:13.546110Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2511.00062"},"observation_digest":"sha256:8c92d2a96d0235b0174cec44622e82dfc2dda931d5b070dbb9fb768f3072c843","observation_id":"8dc1b711-ac24-4cf6-b365-8735ce972af6","resolution":{"observed_at":"2026-05-12T23:01:13.994170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2605.07061","last_updated":"2026-05-29T22:08:19Z","snapshot_observed_at":"2026-08-03T12:53:30.755817Z","submitted_at":"2026-05-08T00:14:07Z","title":"Do Joint Audio-Video Generation Models Understand Physics?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T02:12:04.230076Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2605.07061"},"observation_digest":"sha256:ea8811704db275193650e69f05d713e700f16e1df40bdac51722adfa41c9d7dc","observation_id":"32634554-0271-4917-b4ed-3de4bbd5f381","resolution":{"observed_at":"2026-05-11T03:50:56.782530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2605.07061","last_updated":"2026-05-29T22:08:19Z","snapshot_observed_at":"2026-08-03T12:53:30.755817Z","submitted_at":"2026-05-08T00:14:07Z","title":"Do Joint Audio-Video Generation Models Understand Physics?","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T23:39:22.070629Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2605.07061"},"observation_digest":"sha256:24b8171566d0defaaa0362806c5130530dbe3ddda0726a1ff525498ecef6e707","observation_id":"9cbc7b9f-9d62-433f-81d8-56ab5f6b919b","resolution":{"observed_at":"2026-06-30T23:45:08.258303Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2605.10806","last_updated":"2026-05-11T16:30:51Z","snapshot_observed_at":"2026-07-06T23:22:42.512039Z","submitted_at":"2026-05-11T16:30:51Z","title":"PhyGround: Benchmarking Physical Reasoning in Generative World Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T05:17:30.010064Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2605.10806"},"observation_digest":"sha256:b83286927665aaf333e596c772d25c6725e240afa0578bc837f0ecd472ab19cd","observation_id":"884c5c48-e4a7-46fc-bf9a-590b8b266281","resolution":{"observed_at":"2026-05-12T05:21:28.228199Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2605.18303","last_updated":"2026-05-18T12:20:54Z","snapshot_observed_at":"2026-08-02T12:26:28.647804Z","submitted_at":"2026-05-18T12:20:54Z","title":"PH-Dreamer: A Physics-Driven World Model via Port-Hamiltonian Generative Dynamics","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-20T12:27:13.931203Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2605.18303"},"observation_digest":"sha256:37ecb1b0452f24c4df63d4fd4ffa582502804eecb85e07042663038a2febb6ac","observation_id":"741fa231-c80f-47a5-885a-456a2dbd1c26","resolution":{"observed_at":"2026-05-20T12:28:16.646475Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2605.23699","last_updated":"2026-05-22T14:51:22Z","snapshot_observed_at":"2026-07-06T23:33:53.870540Z","submitted_at":"2026-05-22T14:51:22Z","title":"CRONOS: Benchmarking Counterfactual Physical Consistency in Video Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T04:39:22.400458Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2605.23699"},"observation_digest":"sha256:af78738ce392b9ff46464deb38a6e8269193a71a5c1f71ba3893a6300fce7628","observation_id":"e8792639-617d-472f-8378-d4513c38be3f","resolution":{"observed_at":"2026-05-25T04:40:23.086631Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2605.30542","last_updated":"2026-05-28T20:18:22Z","snapshot_observed_at":"2026-07-06T23:39:48.531480Z","submitted_at":"2026-05-28T20:18:22Z","title":"Physically Viable World Models: A Case for Query-Conditioned Embodied AI","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T06:55:57.801162Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2605.30542"},"observation_digest":"sha256:e08451bd37fe2817f3d0de0af84e6372c69f03168d72293ef2871b425ac04e49","observation_id":"97aa299c-14e7-47a1-9a6d-343e9f3ca5bb","resolution":{"observed_at":"2026-06-29T09:13:16.508589Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2606.00793","last_updated":"2026-06-08T08:58:38Z","snapshot_observed_at":"2026-07-06T23:41:24.911421Z","submitted_at":"2026-05-30T16:17:33Z","title":"MBench: A Comprehensive Benchmark on Memory Capability for Video World Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T19:04:58.672464Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2606.00793"},"observation_digest":"sha256:1a40ed36a6ee5cbee255eff6eba1e85d2f2d29055e398911d5c1b3601fe586f6","observation_id":"fc290460-3cc0-4b3e-ac19-f4548e4b75d2","resolution":{"observed_at":"2026-06-28T19:22:35.134374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2606.20545","last_updated":"2026-06-18T17:55:15Z","snapshot_observed_at":"2026-08-09T08:58:43.424376Z","submitted_at":"2026-06-18T17:55:15Z","title":"Current World Models Lack a Persistent State Core","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T17:33:41.461245Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2606.20545"},"observation_digest":"sha256:e0378ac9dbf6a7a03a501fd3ecf3c6e4b4f316688d621ba5885013b686f3a980","observation_id":"974a2498-55f8-49c2-9140-f020da5e0cd5","resolution":{"observed_at":"2026-07-04T03:49:30.985413Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2505.00337","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-04T13:59:51.792842Z","title":"T 2 V P hys B ench: A first-principles benchmark for physical consistency in text-to-video generation","venue":null,"work_id":"8e0819a9-997f-40ad-9d64-220808cd9d4c","year":2025},"citing_paper":{"arxiv_id":"2606.26969","last_updated":"2026-06-25T12:42:04Z","snapshot_observed_at":"2026-08-09T16:42:06.004756Z","submitted_at":"2026-06-25T12:42:04Z","title":"Einstein World Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-26T04:47:59.575489Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2606.26969"},"observation_digest":"sha256:be1d0990b1597c01e16267da22ebe4193633789a085ebd95b8e0f617a537b50f","observation_id":"3046a4b1-67ac-4f7f-893c-a5d184e4b549","resolution":{"observed_at":"2026-07-04T13:59:51.794361Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00337","snapshot_observed_at":"2026-07-14T09:16:37.881212Z","title":"arXiv preprint arXiv:2505.00337 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10787","last_updated":"2026-07-12T14:25:04Z","snapshot_observed_at":"2026-08-06T13:12:11.216373Z","submitted_at":"2026-07-12T14:25:04Z","title":"Detecting AI-Generated Video: A Vision-Language Dual-View Survey","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-14T09:16:37.881212Z"},"links":{"cited_paper":"/paper/2505.00337","citing_paper":"/paper/2607.10787"},"observation_digest":"sha256:d967eae47806eff5d365f92e1025a69115cf36582047fee995845b70323d9b8d","observation_id":"9e410049-9217-415e-9faa-34fa82d15a79","resolution":{"observed_at":"2026-07-14T09:16:37.881212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.00337/citation-record","integrity":"/paper/2505.00337/integrity","json":"/paper/2505.00337/citation-record.json","paper":"/paper/2505.00337"},"outbound":[],"paper":{"arxiv_id":"2505.00337","last_updated":"2025-05-01T06:34:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T22:04:00.593389Z","submitted_at":"2025-05-01T06:34:55Z","title":"T2VPhysBench: A First-Principles Benchmark for Physical Consistency in Text-to-Video Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2505.00337."}