{"as_of":"2026-08-17T02:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7e1d718da0489834e45f9e69495c8a02c8e2bd2e8379a76ac5969df9034f4fd","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T18:23:22.987086Z","state":"measured"},{"denominator":90,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":90,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:23:57.855823Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T00:42:28.645519Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"cited_work":{"arxiv_id":"2605.27589","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.27589","snapshot_observed_at":"2026-08-05T00:42:28.645519Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","venue":"cs.CV","work_id":"4dd3c31f-59d3-4779-a0ca-bbd1ddd11329","year":2026},"citing_paper":{"arxiv_id":"2608.00591","last_updated":"2026-08-08T09:51:31Z","snapshot_observed_at":"2026-08-16T19:46:09.563858Z","submitted_at":"2026-08-01T11:07:24Z","title":"Why Does the Future Branch? Identifiable Closure Tests for Stochastic Physical World Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T00:42:28.416916Z"},"links":{"cited_paper":"/paper/2605.27589","citing_paper":"/paper/2608.00591"},"observation_digest":"sha256:ad65671a95a8847bd4e1f5696fe6127f476db7e3d965ddde3a58116b6a0a59de","observation_id":"1f520f89-7eaa-4ecb-8227-ad1780631dc8","resolution":{"observed_at":"2026-08-05T00:42:28.649422Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27589","snapshot_observed_at":"2026-08-14T04:23:57.855823Z","title":"What-if world: A causal benchmark for general world models in embodied scenarios.arXiv preprint arXiv:2605.27589, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08982","last_updated":"2026-08-10T00:57:48Z","snapshot_observed_at":"2026-08-16T18:52:44.011552Z","submitted_at":"2026-08-10T00:57:48Z","title":"Twin Rollouts: Noise-Coupled Counterfactual Branching in Interactive Video World Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:23:57.855823Z"},"links":{"cited_paper":"/paper/2605.27589","citing_paper":"/paper/2608.08982"},"observation_digest":"sha256:def02bce79777bfec4f66b9d22221ecbdf9fe79977c3487537a7e2e99ac3ada7","observation_id":"178f7739-2537-4975-b7bf-4b84f80cc2f0","resolution":{"observed_at":"2026-08-14T04:23:57.855823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27589","snapshot_observed_at":"2026-08-11T19:59:33.585056Z","title":"arXiv preprint arXiv:2605.27589 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09298","last_updated":"2026-08-10T08:48:06Z","snapshot_observed_at":"2026-08-16T15:00:43.372827Z","submitted_at":"2026-08-10T08:48:06Z","title":"WorldSimProbe: Diagnosing Simulator Faithfulness in Action-Conditioned World Models for Embodied Manipulation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T19:59:33.585056Z"},"links":{"cited_paper":"/paper/2605.27589","citing_paper":"/paper/2608.09298"},"observation_digest":"sha256:704be470c7facf6052576fa6faba7c8b3d7d19146ef14809a73b1c2a215fe8fe","observation_id":"94cdc256-45ce-4789-bb49-1612e101b291","resolution":{"observed_at":"2026-08-11T19:59:33.585056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.27589/citation-record","integrity":"/paper/2605.27589/integrity","json":"/paper/2605.27589/citation-record.json","paper":"/paper/2605.27589"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Don’t just assume; look and answer: Overcoming priors for visual question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:726603b3b79b256880c1290f97e0ef04542bacd4bcb41f997c08f4c0be6a982f","observation_id":"9817bffe-18d3-4a50-837e-55dd37ce36a5","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04296","last_updated":"2020-11-24T16:05:50Z","snapshot_observed_at":"2026-08-16T19:14:49.633918Z","submitted_at":"2020-10-08T23:01:13Z","title":"CausalWorld: A Robotic Manipulation Benchmark for Causal Structure and Transfer Learning","version":2},"cited_work":{"arxiv_id":"2010.04296","doi":"10.48550/arxiv.2010.04296","metadata_source":"arxiv_reference","pith_arxiv_id":"2010.04296","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arxiv.2010.04296 , arxivId =","venue":"arXiv (Cornell University)","work_id":"dc76190a-ac30-4136-bbc5-651fac495ebe","year":2010},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2010.04296","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:5eadf726f61c7d49c1fe0cad0446607aab4d430b6a14ef92440ab644b31887f2","observation_id":"c75cbfc4-9f54-4357-a9ff-a898761b3113","resolution":{"observed_at":"2026-06-29T18:23:50.372993Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:50.576913+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:50.576913+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"cited_work":{"arxiv_id":"2511.00062","doi":"10.48550/arxiv.2511.00062","metadata_source":"pith","pith_arxiv_id":"2511.00062","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"World Simulation with Video Foundation Models for Physical AI","venue":"cs.CV","work_id":"1dc393b8-98c3-43bd-8ab0-25d7c2a9705b","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2511.00062","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:63772fa1994b8f5d69a55a10a9353a617163b9416684855215c8bec891eac36a","observation_id":"7cfd86f1-b242-4fd6-92ef-9e9ec2370a0f","resolution":{"observed_at":"2026-06-29T18:23:50.356445Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Diffusion for world modeling: Visual details matter in atari.Advances in Neural Information Processing Systems, 37:58757–58791, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:fb7c45f5e20a402b186b2bb5e8311d809feea4c3ef6f48807eca467b24324c0e","observation_id":"9aab2aee-4dec-4410-9613-f22203df1d5c","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Craft: A benchmark for causal reasoning about forces and interactions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:2c0a6d6ed8545f014e98b87f720a3bd2fae7eecd3a663d461573943ccc84c01b","observation_id":"d6b6c614-3f3b-4e95-be0e-e4f949ff3ca4","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Video pretraining (vpt): Learning to act by watching unlabeled online videos.Advances in Neural Information Processing Systems, 35:24639–24654, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:80ace906750ecbcdbedb21749299eeebb39ab1abac4e485b9917cd02eb1b0518","observation_id":"12a4c019-abaa-4e24-8929-201afb63a3e9","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Phyre: A new benchmark for physical reasoning.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:893089aa262d3e4a1dc38fcdd225a31409cd0e36fa484f2ac96bb5a28b74dd97","observation_id":"3cc44c25-4f97-4711-981d-5fdb8aba95aa","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03520","last_updated":"2024-10-03T17:24:40Z","snapshot_observed_at":"2026-08-16T12:54:37.000371Z","submitted_at":"2024-06-05T17:53:55Z","title":"VideoPhy: Evaluating Physical Commonsense for Video Generation","version":2},"cited_work":{"arxiv_id":"2406.03520","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.03520","snapshot_observed_at":"2026-07-07T15:43:53.689981Z","title":"VideoPhy: Evaluating Physical Commonsense for Video Generation","venue":"cs.CV","work_id":"27ed795c-abbe-4de1-9a7a-2ecf39c354f3","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2406.03520","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:ac653b01d3ff3682ce1b62efc137b2317d8766f130479c546fe295822f019ad7","observation_id":"c91c5537-f295-4cd6-b394-257b7eeb2e4d","resolution":{"observed_at":"2026-06-29T18:23:50.440484Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06800","last_updated":"2025-03-09T22:49:12Z","snapshot_observed_at":"2026-08-16T12:51:43.372607Z","submitted_at":"2025-03-09T22:49:12Z","title":"VideoPhy-2: A Challenging Action-Centric Physical Commonsense Evaluation in Video Generation","version":1},"cited_work":{"arxiv_id":"2503.06800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.06800","snapshot_observed_at":"2026-07-04T13:19:51.020711Z","title":"Videophy-2: A challenging action-centric physical commonsense evaluation in video generation","venue":null,"work_id":"4dfe3980-dfd5-4917-95e9-179c29e4eb18","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2503.06800","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:02cd24f12f0ef61dbcd923645394a75aafcaa9798a3483a5b86910f062e43dfd","observation_id":"2dc8fd89-4e71-47a0-8c81-0f5c24d823d7","resolution":{"observed_at":"2026-06-29T18:23:50.403328Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08471","last_updated":"2024-02-15T18:59:11Z","snapshot_observed_at":"2026-08-16T15:18:58.970075Z","submitted_at":"2024-02-15T18:59:11Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","version":1},"cited_work":{"arxiv_id":"2404.08471","doi":"10.1145/3178876.3185996","metadata_source":"pith","pith_arxiv_id":"2404.08471","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","venue":"cs.CV","work_id":"f7251dcf-5341-4915-bfe7-27812387b61a","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2404.08471","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:7f096246f8c52aba5cde068ce86b0c94645b582652c03b5709428ccd9030189a","observation_id":"38e11ad2-a35f-4070-b045-60fdc2c9e13d","resolution":{"observed_at":"2026-06-29T18:23:50.405852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-05-23T01:54:34.489718+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T01:54:34.489718+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Using thematic analysis in psychology.Qualitative research in psychology, 3(2):77–101, 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:1049b3ffc0583e1428f595f7e296371d2949c63e4413c52504736958d7ab2759","observation_id":"46fb538a-0dc0-4ca4-a3ee-3eb9bcefe0d3","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:a413bbda69924a042212b1b305dec79b4532094e5943b60166f4284b985d5f05","observation_id":"2f86de51-cc75-4292-82dc-5ceede2f945c","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Genie: Generative interactive environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:4738681994b8e62ae2c37e9f41a49f5f416a668e5f2150da1e1267044a61d95e","observation_id":"91cfe143-d622-467a-a4ca-2d2f5448dc01","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"nuscenes: A multimodal dataset for autonomous driving","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:9c992df264ebcaa1eeb5cf8ef008bccdb47b65bbd4652ca0c321a03b5b8624b6","observation_id":"b9c39e98-a094-4114-bb39-cdbb2312030c","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21996","last_updated":"2026-05-28T06:02:27Z","snapshot_observed_at":"2026-08-11T02:52:16.529454Z","submitted_at":"2025-05-28T05:55:44Z","title":"VRAG: Learning World Models for Interactive Video Generation","version":4},"cited_work":{"arxiv_id":"2505.21996","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21996","snapshot_observed_at":"2026-07-04T12:49:53.226691Z","title":"VRAG: Learning World Models for Interactive Video Generation","venue":"cs.CV","work_id":"57a65211-475e-412c-a72b-f0519db0d0cb","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2505.21996","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:8d9e6584d874587e02e8f83f25ba406b10b5965f7ed7afb5457731daec474b72","observation_id":"70f85be1-409b-42f7-a307-60c01363c5cf","resolution":{"observed_at":"2026-06-29T18:23:50.443323Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Unveiling causal reasoning in large language models: Reality or mirage?Advances in Neural Information Processing Systems, 37:96640–96670, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:c31b8e5c0225bbb536b44161899deb1af0b076a5e466fecaf577c54fd660f0b4","observation_id":"2893582a-4971-4839-a496-b1445e394b71","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Veo 3.1 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:ab47f2a62b5a9c77fc82dacbad2802a5a7e62dd4d6b3f8dc775d290b6ff14f9c","observation_id":"94a86343-012c-469a-8188-95c222dcff54","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Worldscore: A unified evaluation benchmark for world generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:bef22d6939822713f53e356f72dab2c1598a43cef1153c8a6a300dd80da598ed","observation_id":"39d58627-e050-4e19-bd4d-81297e23212e","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09943","last_updated":"2025-06-11T17:10:36Z","snapshot_observed_at":"2026-08-13T03:47:33.871757Z","submitted_at":"2025-06-11T17:10:36Z","title":"CausalVQA: A Physically Grounded Causal Reasoning Benchmark for Video Models","version":1},"cited_work":{"arxiv_id":"2506.09943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09943","snapshot_observed_at":"2026-07-04T12:49:53.095154Z","title":"Causalvqa: A physically grounded causal reasoning benchmark for video models","venue":null,"work_id":"4545b7fc-2bcc-44f3-a395-c6684aede4c7","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2506.09943","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:8697014b2c148521da834713362aadaa4de0d1c0ef59ba590c3db4648c7d8531","observation_id":"5447d01b-d4c6-4827-988c-d999c60e73cf","resolution":{"observed_at":"2026-06-29T18:23:50.387373Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Physically grounded vision-language models for robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:e36d1bb44affb00b001cd0c607986c864533eee7cf1aec90c171990d8753d46c","observation_id":"bfc4ef56-7b17-4eb3-895a-5e20d9219925","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Vista: A generalizable driving world model with high fidelity and versatile controllability.Advances in Neural Information Processing Systems, 37:91560–91596, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:c21c577268f9d3d96da9067ca6ce2d677d18c984a285e97d3ceba978da1fc193","observation_id":"e07c8478-39c6-4e0f-b2fa-be1aff78a821","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Shortcut learning in deep neural networks.Nature Machine Intelligence, 2(11):665–673, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:b96e11360ee9e9df734776ea0be405932fa4fe1e89670bdd127ee002463b1deb","observation_id":"a14a540c-bb22-4d19-960b-51e86d01760c","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04744","last_updated":"2020-04-05T03:39:21Z","snapshot_observed_at":"2026-08-13T13:07:55.618967Z","submitted_at":"2019-10-10T17:52:19Z","title":"CATER: A diagnostic dataset for Compositional Actions and TEmporal Reasoning","version":2},"cited_work":{"arxiv_id":"1910.04744","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.04744","snapshot_observed_at":"2026-07-04T12:49:53.191967Z","title":"Cater: A diagnostic dataset for compositional actions and temporal reasoning","venue":null,"work_id":"0df31525-83f4-4de5-bc21-7c1e20006efb","year":2020},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/1910.04744","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:24829d6cba531f545ef3cc3b303e3a2a97d86929531b16cf477d0663b2eef3c8","observation_id":"9758491e-52e3-419f-92c0-c140056475ef","resolution":{"observed_at":"2026-06-29T18:23:50.381067Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Genie 3: A new frontier for world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:bb480d8a37ef802fed3d3efa83b29d8bfc4309acfbc1ffa76f7a6eca11955b88","observation_id":"e8feec49-3b22-47ea-869e-112fb719c402","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Agqa: A benchmark for compositional spatio-temporal reasoning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:a98426b43549befe62707a78a6cd0f1c72e7587497abd2654424b0b7548e5d89","observation_id":"bb8ee50c-75e4-4aa2-9537-016f91649e4a","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06665","last_updated":"2024-04-29T23:21:33Z","snapshot_observed_at":"2026-08-16T14:20:56.373079Z","submitted_at":"2024-02-06T17:15:33Z","title":"The Essential Role of Causality in Foundation World Models for Embodied AI","version":2},"cited_work":{"arxiv_id":"2402.06665","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06665","snapshot_observed_at":"2026-07-04T15:19:56.964124Z","title":"The essential role of causality in foundation world models for embodied AI","venue":null,"work_id":"18436477-bc09-47e8-a187-752f4c998490","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2402.06665","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:2da407b7e6ed94a3eadbe7e87ade69bb14aa9eff50d4ff1939cb0dfd5bcbe729","observation_id":"9b918a7f-00bf-4a7a-a66c-bf48fd0a7dd7","resolution":{"observed_at":"2026-06-29T18:23:50.400419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":"2301.04104","doi":"10.1126/sciadv.adu2488","metadata_source":"pith","pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Diverse Domains through World Models","venue":"cs.AI","work_id":"6aeb260f-8c7c-4f9c-b98b-067cd7c59acd","year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:376531610cbc7d39e4925a935b151783caf855b3b98088b26d46b1fe7544d25d","observation_id":"7b87d8bf-ad92-4d59-9fae-8665b2feabdd","resolution":{"observed_at":"2026-06-29T18:23:50.411638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2309.17080","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-07-10T11:47:02.949785Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","venue":"cs.CV","work_id":"313484e6-a442-4522-8e19-d07e502844a8","year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:574ab7a22bbdf0a65d29cad58476e8fe50d3c5a5ecf85b3c9188951fab5a8a73","observation_id":"c30405d9-a706-4b6d-baa1-2b79e4a6fbc7","resolution":{"observed_at":"2026-06-29T18:23:50.375342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:e0cc07c818206e9f1b5b57e13cdf22c1b11ef57ed6227ded2dae82d509d43ff5","observation_id":"6d2227b6-a2d7-40b1-aa9c-10a6e24ebbf5","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Vbench++: Comprehensive and versatile benchmark suite for video generative models.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:276064b2ec2a6bc97e2b78ee6c35150b444a59a3d52c7cf189c7e9c9417ac5a3","observation_id":"e3012064-5443-4880-b537-77fdb92113e3","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"How far is video generation from world model: A physical law perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:eb7a3012f1e2da8f9d927df2c1c394af2b54555c2edc478d9837ee8f2970cd0c","observation_id":"7fea6898-1e36-4fd8-9607-5c96b0cb4923","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":"2403.12945","doi":"10.48550/arxiv.2403.12945","metadata_source":"pith","pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","venue":"cs.RO","work_id":"13253de2-3d89-415c-8c2f-3adb25d4c337","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:97c9ae1e8b7a205ee9e9ae602c4a6cea39132435d68e2651f34cd9476f2024b1","observation_id":"05aa365d-cd2d-4a2b-9462-d5e0a366c37d","resolution":{"observed_at":"2026-06-29T18:23:50.397554Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Kie.ai ai model api platform, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:296b288655c01587b48bc5cfa5de40081ce9e49986a8390e3d6d048c09dcdfe6","observation_id":"99c92f26-4afe-4495-9a74-dd4f30599f77","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:d487fb3904da24c067947affb95edebffbc3b316590de28765afc2f92500bbfa","observation_id":"fb302278-bdc5-4002-9573-9452b2770e9c","resolution":{"observed_at":"2026-06-29T18:23:50.409119Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Causalvlbench: Benchmarking visual causal reasoning in large vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:ba77c33c9a86db76ba961938b1fd3146451f425285cbabf4b3fed96d90211448","observation_id":"84de40a7-289b-4d2d-a6e3-308ea4873384","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20694","last_updated":"2025-02-28T03:58:23Z","snapshot_observed_at":"2026-08-16T12:54:26.116596Z","submitted_at":"2025-02-28T03:58:23Z","title":"WorldModelBench: Judging Video Generation Models As World Models","version":1},"cited_work":{"arxiv_id":"2502.20694","doi":"10.48550/arxiv.2502.20694","metadata_source":"pith","pith_arxiv_id":"2502.20694","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Li, S., Wu, K., Zhang, C., and Zhu, Y","venue":"cs.CV","work_id":"33a5087c-1633-4d52-b891-f34d10b9e7c8","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2502.20694","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:76815e7d71b43809ff1572c1cb625ccd60582bda57abc825c36594e00e6c1cda","observation_id":"c95dfd25-f6ac-4c47-9198-e9458392e99a","resolution":{"observed_at":"2026-06-29T18:23:50.390311Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:51.214081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:51.214081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08105","last_updated":"2025-05-26T03:04:03Z","snapshot_observed_at":"2026-08-16T13:26:16.631432Z","submitted_at":"2024-08-15T12:04:32Z","title":"Multimodal Causal Reasoning Benchmark: Challenging Vision Large Language Models to Discern Causal Links Across Modalities","version":4},"cited_work":{"arxiv_id":"2408.08105","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08105","snapshot_observed_at":"2026-06-29T18:23:50.360163Z","title":"arXiv preprint arXiv:2408.08105 , year=","venue":null,"work_id":"8d67097f-4fbb-40bf-b656-c7cfbc408e03","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2408.08105","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:070eceed7200d48d231c817fa3da69adab1f2a3d26c3debbb4525d48c2cbdada","observation_id":"21c1f094-bd9f-4ef8-9dcf-6764cd417f65","resolution":{"observed_at":"2026-06-29T18:23:50.361767Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Physgen: Rigid-body physics-grounded image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:2282f10559b3572d5f5f06d9e7b1010fdf5a4461966c09d7f816f6e57f45409d","observation_id":"80c2dc4c-7e88-4606-a8c5-1a03c995ee08","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"G-eval: Nlg evaluation using gpt-4 with better human alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:c44633b44dd539e23747c37bae03ae6efac2049975ecff51f424a8911ac7d1c1","observation_id":"ed1683d1-5acf-4be1-a8c4-91ac7b0806a6","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Evalcrafter: Benchmarking and evaluating large video generation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:8d2e3ea568e34a4b52df4ffc04974cc41b0f8a679c969dfecc193eb295d8bb30","observation_id":"6639408d-a99a-46e7-a02d-f4e8fd88a0f6","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04556","last_updated":"2025-06-10T10:10:21Z","snapshot_observed_at":"2026-08-16T12:52:27.532287Z","submitted_at":"2025-03-06T15:47:19Z","title":"Compositional Causal Reasoning Evaluation in Language Models","version":4},"cited_work":{"arxiv_id":"2503.04556","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.04556","snapshot_observed_at":"2026-06-29T18:33:50.845917Z","title":"Com- positional causal reasoning evaluation in language models","venue":null,"work_id":"8a1189ac-9a1d-4dca-b3e3-0a11893c0ee3","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2503.04556","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:be881324a43e6fdbcf6df599543dcd3156aa93b18ae4f14f49923ca9c21ca14f","observation_id":"a45a101d-2b4d-4e0b-bc7c-ec70f494a13a","resolution":{"observed_at":"2026-06-29T18:23:50.435194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Towards world simulator: Crafting physical commonsense-based benchmark for video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:3b4c68a7925e61daba41cf4fe5bce945f0e97fde4e214e18eb71ca23ab4c6137","observation_id":"6b3c9c2e-891f-4cee-bac8-5e222da552d2","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Do gener- ative video models understand physical principles? InProceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision, pages 948–958, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:6a3c5b6860f1e9e38219b07a67bb0d5dd4e4e885b6740d681d37db10160aeeb4","observation_id":"f7fc9a5d-dec4-4ff6-b463-4303b3154eb5","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Counterfactual vqa: A cause-effect look at language bias","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:ddfbc7f4d34547d10d930cb258bc8c09db98ed6bf554c9c92e231461681b815a","observation_id":"811846ca-6884-4de8-a148-cd0805913723","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:89814520515c1c830d31161326a98baa5438173bfe55fd40eb94129086d4ea24","observation_id":"748d0ae3-bed2-4e53-88da-35f9d93547b3","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Open x- embodiment: Robotic learning datasets and rt-x models: Open x-embodiment collaboration 0","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:97805446c1150b60de68083fa164bc80e4c049ed9c014ee8ecf32dedd8bf05cf","observation_id":"2828a563-fde3-41dd-8e4a-8caa2234857d","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:d10267fb894e4b3a5e4ef10f6ce96cccbc573c70af69ca4fac7a13339630060d","observation_id":"4fd0ee5a-5488-43f6-afb2-33dede048484","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Cripp-vqa: Counterfactual reasoning about implicit physical properties via video question answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:da25370a99f79bb910b31a2818e8b66504ba6ef434d79c8c938e11b019a2d4ba","observation_id":"00d18cf0-d906-4304-82af-8ce383394ba2","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Cambridge university press, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:816edb7dc5730069be7aea894807fdc0ef008125cc46c7ea8c045fd0180fd945","observation_id":"4746c20f-93ba-45d0-8f59-4bb2c4411309","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18072","last_updated":"2024-10-23T17:56:11Z","snapshot_observed_at":"2026-08-16T13:06:31.854495Z","submitted_at":"2024-10-23T17:56:11Z","title":"WorldSimBench: Towards Video Generation Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2410.18072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.18072","snapshot_observed_at":"2026-07-08T07:14:45.281301Z","title":"Worldsimbench: Towards video generation models as world simulators","venue":"cs.CV","work_id":"fb0a629d-b02d-49d2-9009-af5192360e0b","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2410.18072","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:3f215b30a696f5d0b958c1afa2841e6a4ece4231e7585e91ee9492ef29fbaeff","observation_id":"e7fc84b7-fcc1-4d79-b2ce-08f08665d270","resolution":{"observed_at":"2026-06-29T18:23:50.414383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Toward causal representation learning.Proceedings of the IEEE, 109(5):612–634, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:d956bf1b26bcd87917f29a6f99275ea814807d4eb8a14b996931e51eba1c7689","observation_id":"96d1a665-1de3-4f34-88c1-97d690c24b7d","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13507","last_updated":"2025-12-23T17:38:46Z","snapshot_observed_at":"2026-08-14T12:08:18.712691Z","submitted_at":"2025-12-15T16:36:52Z","title":"Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model","version":3},"cited_work":{"arxiv_id":"2512.13507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.13507","snapshot_observed_at":"2026-07-10T01:46:40.967365Z","title":"Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model","venue":"cs.CV","work_id":"02efb197-4e2b-4141-8587-21b92ad92f08","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2512.13507","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:afe48cc7c3d384b57ccf216da633a620a6825767fbada702b2617b8a998c722e","observation_id":"f8a645cc-70f2-4ce5-9cf5-c13afee3d265","resolution":{"observed_at":"2026-06-29T18:23:50.358946Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-08-16T18:58:56.056540Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":"2604.14148","doi":"10.48550/arxiv.2604.14148","metadata_source":"pith","pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","venue":"cs.CV","work_id":"ceac4ea4-1ca6-4fe9-8324-880c07aec27d","year":2026},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:4650419fd18e3331d71f118b57495c4556706323da302a776fc12ccf4db47c5f","observation_id":"1e34c705-1103-45cc-9cbc-bf50363e3408","resolution":{"observed_at":"2026-06-29T18:23:50.392770Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.183783+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.183783+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.08971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:14:45.180891Z","title":"Worldarena: A unified benchmark for evaluating perception and functional utility of embodied world models","venue":null,"work_id":"be15f0b3-60ac-4f1c-ade5-14e231a98c90","year":2026},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:aaee5f9c731516d515a06c839d8d78d3f491fe65ff4593758fd4e12e81c4f6f8","observation_id":"c5020912-8b41-4953-a293-15d2da57521f","resolution":{"observed_at":"2026-06-29T18:23:50.429800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"T2v- compbench: A comprehensive benchmark for compositional text-to-video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:873b58bcd1b6ec74465e01f6470d77b8cdc0f0c028511d5b912ce8419dbd1973","observation_id":"23897052-9e9c-4964-b660-826ca03b00f2","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:cac53506cbdd25cc95be3cf42eeadb288ec3a7b457a514fc7a912a81365cdb6d","observation_id":"bdd7aa5c-58cb-4ac9-a7f7-48fddab4f1ad","resolution":{"observed_at":"2026-06-29T18:23:50.432366Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-08-15T16:15:04.223733Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2512.16776","doi":"10.48550/arxiv.2512.16776","metadata_source":"pith","pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kling-Omni Technical Report","venue":"cs.CV","work_id":"52d502bd-9d8e-4944-9bf2-cfd097cfdb4e","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:81454022fb7afe04ab2f2a4fb4af2aeb1e64bd3aefcd8c57e3c6f6f82ef019da","observation_id":"ee9f6de7-f860-4d0c-8c85-b069dd08ac54","resolution":{"observed_at":"2026-06-29T18:23:50.395028Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.73319+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Winoground: Probing vision and language models for visio-linguistic compositionality","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:ecbf445dd796aed78bf03d110a69ab37fe436866492d25fa3f4c6c5662c1acfe","observation_id":"64ae3862-2a3f-435f-a749-0f0684852523","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:894cb2b90a23ec8a6256b92415cae50e3af8f4411c95ad1493f6e881b2e04394","observation_id":"1d868501-14df-46fd-ba99-96a22601e8e2","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:e90ae9ebb6b39d24ea2e08da175108b6166fa244800f3cc7548ae75158751331","observation_id":"d0b7ad6b-b23b-4243-b012-d86f03c1d864","resolution":{"observed_at":"2026-06-29T18:23:50.437754Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01361","last_updated":"2024-01-21T21:01:12Z","snapshot_observed_at":"2026-08-16T14:55:47.462335Z","submitted_at":"2023-10-02T17:23:48Z","title":"GenSim: Generating Robotic Simulation Tasks via Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.01361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.01361","snapshot_observed_at":"2026-07-03T20:58:58.254311Z","title":"GenSim: Generating Robotic Simulation Tasks Via Large Language Models","venue":null,"work_id":"3271c6a8-beb1-40d3-bd04-82cd4585d9ae","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2310.01361","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:ad762857e8e94aa6dfef5edd8f959560ce1ba457e8f6b1b4ab913096b5563de1","observation_id":"01b56f1f-cef5-4c33-b99d-f034051f4bfe","resolution":{"observed_at":"2026-06-29T18:23:50.426578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Large language models are not fair evaluators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:0eaa166ada2bccd10662d8ebcae890bf66eb02432d83f4d5f96820225eb70c83","observation_id":"849fa882-b67a-4c3d-9470-37825e937304","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Omnidrive: A holistic vision-language dataset for autonomous driving with counterfactual reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:892a4b890065c8abc5b8be979f9bf511868e13b06a7bb2419ef82af60df633e0","observation_id":"ccc1480c-ff55-4f80-96ce-0059d1fada48","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Drive- dreamer: Towards real-world-drive world models for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:3b796b6cc1eb4ba840570dfc051994d454ae1b718259822bb1e991099e6e178d","observation_id":"3859a7cf-1f9f-40a8-bdc7-44fe4e28fd05","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00088","last_updated":"2026-01-07T09:09:57Z","snapshot_observed_at":"2026-08-16T04:26:38.567252Z","submitted_at":"2025-10-30T01:25:34Z","title":"Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail","version":2},"cited_work":{"arxiv_id":"2511.00088","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.00088","snapshot_observed_at":"2026-07-10T20:17:33.699563Z","title":"Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail","venue":"cs.RO","work_id":"eed9adfb-3fa1-4c0c-abb9-e31b79bba031","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2511.00088","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:3e95f26b391f12882196ce8ecb2b05c01f4c908897ca051bdc52e180a09b3c39","observation_id":"b6f9ff10-1ac0-4d90-8520-dcf54c305edf","resolution":{"observed_at":"2026-06-29T18:23:50.367490Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Causalbench: A comprehensive benchmark for evaluating causal reasoning capabilities of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:638de19ef55ca4684a0898cba3f13a43d2184c11b3d96966c0e1f1299b046de7","observation_id":"3a454eaf-2584-4e77-8d5c-74bd66c6e61b","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.18870","last_updated":"2025-11-25T02:52:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-24T08:22:07Z","title":"HunyuanVideo 1.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2511.18870","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.18870","snapshot_observed_at":"2026-07-10T01:46:40.932396Z","title":"HunyuanVideo 1.5 Technical Report","venue":"cs.CV","work_id":"ed898a38-b053-407c-bbce-41561510c1de","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2511.18870","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:49b33ec7d21a6ead0f317db4c18007de3247429e938112c650175947cac178b3","observation_id":"02e07769-2bae-43ab-9b93-72549519475a","resolution":{"observed_at":"2026-06-29T18:23:50.370134Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09711","last_updated":"2024-05-15T21:53:54Z","snapshot_observed_at":"2026-08-16T21:19:34.047707Z","submitted_at":"2024-05-15T21:53:54Z","title":"STAR: A Benchmark for Situated Reasoning in Real-World Videos","version":1},"cited_work":{"arxiv_id":"2405.09711","doi":"10.48550/arxiv.2405.09711","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09711","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Star: A benchmark for situated reasoning in real-world videos","venue":"arXiv (Cornell University)","work_id":"6347befe-456f-400c-8986-542b9c1fc388","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2405.09711","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:abf67998ab762b3366af2d4af861aae41646e427041dc919aeffbb1139de0654","observation_id":"0e77163e-16be-4107-86bd-f14845461c73","resolution":{"observed_at":"2026-06-29T18:23:50.384160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-05-23T14:52:47.118075+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T14:52:47.118075+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05284","last_updated":"2025-06-05T17:42:34Z","snapshot_observed_at":"2026-08-10T16:56:54.588021Z","submitted_at":"2025-06-05T17:42:34Z","title":"Video World Models with Long-term Spatial Memory","version":1},"cited_work":{"arxiv_id":"2506.05284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05284","snapshot_observed_at":"2026-07-03T17:58:47.769652Z","title":"Video world models with long-term spatial memory","venue":null,"work_id":"dbc95f37-bd69-4309-9971-934e68e24e7b","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2506.05284","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:def2fe44943460da48ebfcb01ebea43583b193f4e9880be1aba9d6b2c9c64fec","observation_id":"52cfe877-7da2-4a7f-9825-16c53dc2f7f2","resolution":{"observed_at":"2026-06-29T18:23:50.422893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Grok imagine: Multimodal image and video generation model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:8e0efec3738743430821030b32c5494b12c72095edc98593da6af8a5a5ff2d9c","observation_id":"b92568bb-c81a-411e-8341-c5a1aa543c37","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Next-qa: Next phase of question- answering to explaining temporal actions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:b6538c73313e4cdc2dc22faed3fd3c466eca5a535f6602567306961a6b111493","observation_id":"71909a19-4e14-4a2d-89fc-7428a5bbcc85","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Unisim: A neural closed-loop sensor simulator","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:5c59522c198f1ae0c2355b913dfe9c7cbc1ceb2289defbe34e264726ec6007cc","observation_id":"42b1f6a7-10fa-4aae-b144-9add24c930a7","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:afb1c3976ac038b4298d856871dfcbac04dac0427e4052d50fac780bc15fdf0b","observation_id":"39a1d28c-5111-4589-a2b1-1d18d4d3ccec","resolution":{"observed_at":"2026-06-29T18:23:50.446357Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Tenenbaum","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:668549c69f80631fffdde8c4e5f74f34dfb09e6de1325052b916bbcc0001b530","observation_id":"51c52bc1-dd3e-4674-a0fe-25c1540fdc1a","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Chronomagic-bench: A benchmark for metamorphic evaluation of text-to-time-lapse video generation.Advances in Neural Information Processing Systems, 37:21236–21270, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:e29e39cc931904f2faecf2f2bcd67bcc10cec75c333d73934a08698e36a0c1f8","observation_id":"fe3173a2-4724-4ca7-aaed-e942764f59a5","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Magicbrush: A manually annotated dataset for instruction-guided image editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:48f1830e972601248a860b6ec67d122ed8d3e7d5bf2278ccad695fce07d66650","observation_id":"c2a4d166-a776-4cf3-a84c-013c05566a01","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20995","last_updated":"2025-04-29T17:59:30Z","snapshot_observed_at":"2026-08-16T05:11:57.202898Z","submitted_at":"2025-04-29T17:59:30Z","title":"TesserAct: Learning 4D Embodied World Models","version":1},"cited_work":{"arxiv_id":"2504.20995","doi":"10.48550/arxiv.2504.20995","metadata_source":"pith","pith_arxiv_id":"2504.20995","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2504.20995 (2025)","venue":"cs.CV","work_id":"3a971c23-d9fe-4291-9743-6a2b015ce29b","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2504.20995","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:2c957f2d4ce8255e203aa6dced0c375f41f31b3db25f837c62f2e619f0d6bf36","observation_id":"94fa7883-bdb0-4bd1-a817-7a5bdcaf72ca","resolution":{"observed_at":"2026-06-29T18:23:50.417573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-08-15T12:21:16.936063Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":"2503.21755","doi":"10.48550/arxiv.2503.21755","metadata_source":"pith","pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","venue":"cs.CV","work_id":"14060202-ac5f-48e9-b91a-24d150775431","year":2025},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:8917a9ef4f1ff88e1f76280ae6648019fed18d5be77886b57799076f31d6cfdb","observation_id":"aaddc02a-7f16-4cdc-bf6f-94455700735c","resolution":{"observed_at":"2026-06-29T18:23:50.420197Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena.Advances in neural information processing systems, 36:46595–46623, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:29d9189f1dee437c5b8cdadafc22d18a9c90ea88ec43c37e1f6511a8e62143ee","observation_id":"074d939f-06d0-4a1e-af2a-f9bbfe7bae00","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06119","last_updated":"2024-07-28T05:43:43Z","snapshot_observed_at":"2026-08-16T14:20:02.282350Z","submitted_at":"2024-02-09T01:09:21Z","title":"ContPhy: Continuum Physical Concept Learning and Reasoning from Videos","version":2},"cited_work":{"arxiv_id":"2402.06119","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06119","snapshot_observed_at":"2026-07-02T20:27:22.634310Z","title":"Tenenbaum, and Chuang Gan","venue":null,"work_id":"599092a7-998e-49f6-a9f7-62c5966b971d","year":2024},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"cited_paper":"/paper/2402.06119","citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:efa7b01a64805a03c060899d9a2be33cfbc1d5c06781e959594b154e786fba6e","observation_id":"8b69a24a-8e10-4c6e-abd5-7d4fd5927f73","resolution":{"observed_at":"2026-06-29T18:23:50.378133Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.01528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:25.568577Z","title":"Drivinggen: A comprehensive benchmark for generative video world models in autonomous driving.arXiv preprint arXiv:2601.01528","venue":null,"work_id":"e93fd55e-0610-4b4d-8497-671654903083","year":2026},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:6111b5cc035c98d1bc2a36660a32e1e6287caee6b1cac8791277bfa38a88307f","observation_id":"cf347445-125c-4eb9-803a-b4dbe4dadd3f","resolution":{"observed_at":"2026-06-29T18:23:50.364767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"icy surface","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:79bb5eaf019ed0bd8ef7d42281be0ce569e4c76bd9eb55dfaf41240e17d88968","observation_id":"5b1f372b-2e01-4a1c-a441-2392f4315b05","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:100177cd052dbb04f473a7490b66202c47174b2f4df4fe911afd806714b3d737","observation_id":"81f7950d-d953-4fb8-b690-3376ce91050a","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"Video B, and (d)causal constraintsdictating which entities may and may not change","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:b5f1e035557ffac2e2d6b2ced46e83a02a2abac627ee1e693d66835c4cb62919","observation_id":"76dcdd03-15f0-4915-aaea-5b071e1a4a3f","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:15962332f1e5635d0a1c51919995f99d4e175a7a86b3218c6b7ef6856c795fb1","observation_id":"ed8f2436-848e-4f89-8d21-32970d8d222d","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:babc23e491c417857985135f5e23b80c07c26dae0063e19e1f18bdf7fa2e12f8","observation_id":"bb17f0ee-b5c6-43b7-9593-0a84eb7015c0","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:23:22.987086Z","title":"A_Adherence_Single","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-29T18:23:22.987086Z"},"links":{"citing_paper":"/paper/2605.27589"},"observation_digest":"sha256:9ce984379c0d578ec145297da47ee3052c114f34ece6b262f427b71bd5b6d1e0","observation_id":"19ab91b7-922a-4d27-a71c-f6e0d97e11ec","resolution":{"observed_at":"2026-06-29T18:23:22.987086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.27589","last_updated":"2026-05-26T19:02:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T22:24:10.474320Z","submitted_at":"2026-05-26T19:02:26Z","title":"What-If World: A Causal Benchmark for General World Models in Embodied Scenarios"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":1,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":53,"verified_exact":29,"verified_fuzzy":0},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 3 inbound Pith citation observations for arXiv:2605.27589."}