{"as_of":"2026-08-11T18:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d19fb5de4da45be5ab2488990958a23c6bc4a84f59511d348e229953d1fe469","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:59:30.123195Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07420/citation-record","integrity":"/paper/2608.07420/integrity","json":"/paper/2608.07420/citation-record.json","paper":"/paper/2608.07420"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:31.046769Z","title":"DIAMOND: Diffusion for world modeling: Visual details matter in atari","venue":null,"work_id":"e821c130-d657-4846-8e62-f36566616165","year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.771043Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:6dfa0f237577591e5028b69f949c75e9260156e6a0c42cdad4c3b93784ea3287","observation_id":"18a55230-a3d0-421e-8626-213ced7f1d97","resolution":{"observed_at":"2026-08-10T04:59:31.050712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07193","last_updated":"2018-07-27T12:40:44Z","snapshot_observed_at":"2026-07-06T06:34:19.449844Z","submitted_at":"2018-04-19T14:29:41Z","title":"Lipschitz Continuity in Model-based Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07193","snapshot_observed_at":"2026-08-10T04:59:29.778982Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.778982Z"},"links":{"cited_paper":"/paper/1804.07193","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:d47622cb528be22a46413dc7be521a131187d74917a54d1ac966c7819a240183","observation_id":"bc17e08a-d9e3-4061-b923-471599a71ac0","resolution":{"observed_at":"2026-08-10T04:59:29.778982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13320","last_updated":"2019-05-30T21:30:29Z","snapshot_observed_at":"2026-07-06T07:56:54.143277Z","submitted_at":"2019-05-30T21:30:29Z","title":"Combating the Compounding-Error Problem with a Multi-step Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13320","snapshot_observed_at":"2026-08-10T04:59:29.801091Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.801091Z"},"links":{"cited_paper":"/paper/1905.13320","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:af851ec93d7a999be64e63117dc9595dd8baee0ab033d480c3088ba70d68cc3b","observation_id":"8924a219-fff0-48f2-a868-c38026dba62f","resolution":{"observed_at":"2026-08-10T04:59:29.801091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:31.029387Z","title":null,"venue":null,"work_id":"fa14ba6c-e5d5-4809-bd96-caec9ed8b713","year":null},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.811809Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:bb3b3d3cf7057ac90c73652409a52f25875d666f8a60db09db184cd11cb55988","observation_id":"ebd0a93a-89f6-4a9e-a688-8d5e9904f08d","resolution":{"observed_at":"2026-08-10T04:59:31.033425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.915423Z","title":"Multi-timestep models for model-based reinforcement learning, 2024","venue":null,"work_id":"7b85e487-bec4-41ee-8077-9c7262c877c6","year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.831665Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:7c60042d97c24c6ef3b257b8cea869128749693e8220c5ccfd7e84556c667d17","observation_id":"1bf57239-b047-4876-97af-b141bc0ba86b","resolution":{"observed_at":"2026-08-10T04:59:30.920337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.03099","last_updated":"2015-09-23T16:35:42Z","snapshot_observed_at":"2026-08-10T07:40:27.776315Z","submitted_at":"2015-06-09T20:33:47Z","title":"Scheduled Sampling for Sequence Prediction with Recurrent Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.03099","snapshot_observed_at":"2026-08-10T04:59:29.836826Z","title":"Scheduled sampling for sequence prediction with recurrent neural networks, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.836826Z"},"links":{"cited_paper":"/paper/1506.03099","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:a9c1c96f57a088fe0ab6e4205b9cc97dc91d76d2b7c5afc8da5fee7d43bef319","observation_id":"c9756a44-3dd8-4e7a-b65d-bdea80427dd6","resolution":{"observed_at":"2026-08-10T04:59:29.836826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.842128Z","title":"Bengio, P","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.842128Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:2d55223fdab65e9b00ae3a066ed41b0542b3f3454b341b245324c6e641580c05","observation_id":"509f6108-6320-48dc-97de-017997baafdf","resolution":{"observed_at":"2026-08-10T04:59:29.842128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15391","last_updated":"2024-02-23T15:47:26Z","snapshot_observed_at":"2026-08-03T22:04:23.465893Z","submitted_at":"2024-02-23T15:47:26Z","title":"Genie: Generative Interactive Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15391","snapshot_observed_at":"2026-08-10T04:59:29.852319Z","title":"Genie: Generative interactive environments, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.852319Z"},"links":{"cited_paper":"/paper/2402.15391","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:0d8ddc0491247267916c8f663bfd093ff3ebee6537db0f0be591fb50e708bb20","observation_id":"c3745dbc-1307-4d3e-8b80-58cec1498792","resolution":{"observed_at":"2026-08-10T04:59:29.852319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.905304Z","title":null,"venue":null,"work_id":"ad9bc30d-05fc-44f8-980e-dce4a5e7d909","year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.864749Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:43834d285b2a25e9412cb114fdb12a64b0c8c7c0d54b0670096c57f826e07573","observation_id":"c5e39d5e-cb7f-46d8-9686-a160288d0aba","resolution":{"observed_at":"2026-08-10T04:59:30.908698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.880604Z","title":"Diversity is all you need: Learning skills without a reward function, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.880604Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:2b3a093bab629f572fcdf9a3a25c838eab10d946378cc06ba9b9e4471642147b","observation_id":"ecf415a8-e5bc-46ec-9d9d-bd1722164bb7","resolution":{"observed_at":"2026-08-10T04:59:29.880604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1605.07157","last_updated":"2016-10-17T20:09:56Z","snapshot_observed_at":"2026-08-08T07:55:53.520010Z","submitted_at":"2016-05-23T19:45:55Z","title":"Unsupervised Learning for Physical Interaction through Video Prediction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.07157","snapshot_observed_at":"2026-08-10T04:59:29.907634Z","title":"Goodfellow, and Sergey Levine","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.907634Z"},"links":{"cited_paper":"/paper/1605.07157","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:d150ccd24c191b72c632a425cab8f23c6aa45075b96516070e029dce8235dffa","observation_id":"8484d6b5-9a5e-4446-807b-24198e626695","resolution":{"observed_at":"2026-08-10T04:59:29.907634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.888540Z","title":"Professor forcing: a new algorithm for training recurrent networks","venue":null,"work_id":"876d5891-6b7c-4a0a-b7f1-6d2e0a207d72","year":2016},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.921602Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:144773cab109e684f56e702e2eae364c6fd4f01b0c39bbb0bea70e544bfaee67","observation_id":"2efd76cf-11c6-4d3f-aa1c-fa2dad9e4eeb","resolution":{"observed_at":"2026-08-10T04:59:30.892786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.879296Z","title":null,"venue":null,"work_id":"d22c7e69-4819-4f85-b276-599aa904c23b","year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.926815Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:3e9836a37824be2f9a5bb2e9e589b4f92c5f2a3d33d4d4f639707907769fed2c","observation_id":"eb109124-017c-4354-bbe8-85b802985da1","resolution":{"observed_at":"2026-08-10T04:59:30.882635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-10T04:59:29.931514Z","title":"World models.arXiv preprint arXiv:1803.10122, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.931514Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:629d5a4ce35cb1902d46b2567c677c3e0596f2a2ff45d58a479726132f71991b","observation_id":"7ecb51a3-1aed-4ab5-9597-832a27ff0e9e","resolution":{"observed_at":"2026-08-10T04:59:29.931514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-09T02:21:17.479736Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-10T04:59:29.945091Z","title":"Dream to control: Learning behaviors by latent imagination.arXiv preprint arXiv:1912.01603, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.945091Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:480ca2eb1887a596cacf5aeab15e705fbca56e38bbd496707f74e71594eef10b","observation_id":"b6c6053b-d93f-4d82-a187-7dda275cde1f","resolution":{"observed_at":"2026-08-10T04:59:29.945091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.869389Z","title":"Learning latent dynamics for planning from pixels","venue":null,"work_id":"e05f3c35-65c4-4eda-89a4-e8395267b4dc","year":2019},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.949219Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:aba3179ca7c19e88bae317a5b52074efd990177d85f093d26845d1edf136e534","observation_id":"51dbb2c8-847d-467c-ae8a-962a3d5465ea","resolution":{"observed_at":"2026-08-10T04:59:30.873165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-10T04:59:29.953241Z","title":"Mastering atari with discrete world models.arXiv preprint arXiv:2010.02193, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.953241Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:2afc7636a6ae681cdfa218037a4a1785eabe0b87fe100e6c2082fab0323acdb5","observation_id":"7c28e615-7198-4377-8890-398d25d81af6","resolution":{"observed_at":"2026-08-10T04:59:29.953241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.958235Z","title":"Mastering diverse control tasks through world models.Nature, pages 1–7, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.958235Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:e76777f441e5b863091ece64817e51dd1b5bd24dda80983253258fe842cf8913","observation_id":"7274d489-584c-40c0-bfbd-c42f85c0de6a","resolution":{"observed_at":"2026-08-10T04:59:29.958235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.04955","last_updated":"2022-07-19T18:14:36Z","snapshot_observed_at":"2026-08-10T15:55:33.977855Z","submitted_at":"2022-03-09T18:58:28Z","title":"Temporal Difference Learning for Model Predictive Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.04955","snapshot_observed_at":"2026-08-10T04:59:29.962056Z","title":"Temporal difference learning for model predictive control, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.962056Z"},"links":{"cited_paper":"/paper/2203.04955","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:87eab535c3c9d76036f2843291bd497ffc5bba02a7b6b03d9822f44fdee51284","observation_id":"ebd9d996-4f3e-46b1-92c9-ddf6cc0476fb","resolution":{"observed_at":"2026-08-10T04:59:29.962056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16828","last_updated":"2024-03-21T17:56:19Z","snapshot_observed_at":"2026-07-31T05:32:29.431480Z","submitted_at":"2023-10-25T17:57:07Z","title":"TD-MPC2: Scalable, Robust World Models for Continuous Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16828","snapshot_observed_at":"2026-08-10T04:59:29.965750Z","title":"Td-mpc2: Scalable, robust world models for continuous control, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.965750Z"},"links":{"cited_paper":"/paper/2310.16828","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:68a342e90acfd6220a62af25e29b81f341691873c827976e13d0e750e39f034b","observation_id":"72721181-b42e-46c8-99ea-441da93f5856","resolution":{"observed_at":"2026-08-10T04:59:29.965750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.854056Z","title":"Neural motion simulator pushing the limit of world models in reinforcement learning","venue":null,"work_id":"6e4e9d01-4428-444c-afc5-a7818762ee0f","year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.970317Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:9263cc8df18800df733eb2d92403bc80d520b627b824cba628582879a39f2653","observation_id":"abff9003-dd0a-4bde-a219-9f6b7aa5e784","resolution":{"observed_at":"2026-08-10T04:59:30.857939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07177","last_updated":"2018-04-04T06:34:26Z","snapshot_observed_at":"2026-08-09T10:10:27.648203Z","submitted_at":"2017-05-19T20:38:49Z","title":"Model-Based Planning with Discrete and Continuous Actions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07177","snapshot_observed_at":"2026-08-10T04:59:29.974197Z","title":"Model-based planning with discrete and continuous actions.arXiv preprint arXiv:1705.07177, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.974197Z"},"links":{"cited_paper":"/paper/1705.07177","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:f3180e178ac3e868234f0615b9a974ec80f33f7c7bf9f0943cad477001903241","observation_id":"9d8d26ea-6baf-49e8-8124-620a905db362","resolution":{"observed_at":"2026-08-10T04:59:29.974197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.843554Z","title":"Efros, and Sergey Levine","venue":null,"work_id":"5e617d66-ecc0-4812-ae99-1c4d122aa8d6","year":2018},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.978606Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:f74b5f48b65329352173c79891e45a3ab991a41ba5dd18809fbbe62f1065d2ed","observation_id":"7f691b9c-6c79-4130-946d-43ddc1ee227f","resolution":{"observed_at":"2026-08-10T04:59:30.847048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02385","last_updated":"2025-06-22T03:30:55Z","snapshot_observed_at":"2026-08-02T22:45:54.982294Z","submitted_at":"2024-11-04T18:53:05Z","title":"How Far is Video Generation from World Model: A Physical Law Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02385","snapshot_observed_at":"2026-08-10T04:59:29.983053Z","title":"How far is video generation from world model: A physical law perspective, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.983053Z"},"links":{"cited_paper":"/paper/2411.02385","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:1ab4912a00b9d93e8606e6b967fe7ef0fe867f120a073f8c6a30338f8c22808f","observation_id":"9c4fb1de-afc7-41ea-8918-e250a9ddf26f","resolution":{"observed_at":"2026-08-10T04:59:29.983053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.994748Z","title":"A path towards autonomous machine intelligence version 0.9","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.994748Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:f06aed273e534edf2f01fff8e223132ae0c351885957bd95ea7141fbfe51b555","observation_id":"6b7357ab-847c-43cf-8f44-66073d45d155","resolution":{"observed_at":"2026-08-10T04:59:29.994748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.006373Z","title":"Smallworlds: Assessing dynamics understanding of world models in isolated environments, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.006373Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:6eb32e04d398704a80c6c6d7ca52328098971986bdc4ce02aac06b6308887c10","observation_id":"23986565-173e-4354-ba80-9534289887bd","resolution":{"observed_at":"2026-08-10T04:59:30.006373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.826644Z","title":"Any-step dynamics model improves future predictions for online and offline reinforcement learning","venue":null,"work_id":"4a7e22f5-fdc7-46e8-9ce6-22956e49ca4e","year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.025690Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:7e1c7414ef681bd9a41a60bf085cf5cb66eb761386005dda5cbe1720c08c8476","observation_id":"ed6be7a9-5a88-49ed-9cb5-05cfc077e36e","resolution":{"observed_at":"2026-08-10T04:59:30.830802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.816138Z","title":"Adm-v2: Pursuing full-horizon roll-out in dynamics models for offline policy learning and evaluation","venue":null,"work_id":"16c3a3f8-c78e-4892-a340-f787347831b3","year":2026},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.035363Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:416f6c7767a08fd4f15a3dc7c0abb476d56c26a903e8bd5c2266d6570266c52a","observation_id":"2ec7ce6e-adeb-48f1-924e-acc3c9fe2900","resolution":{"observed_at":"2026-08-10T04:59:30.819902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.044258Z","title":"From kepler to newton: Inductive biases guide learned world models in transformers.ArXiv, abs/2602.06923, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.044258Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:255246a4b83e09c204403eaa5bd7dfb6e88afc0a3239d080c3648243405161af","observation_id":"040b0d5a-f667-4ab8-bf43-19d833ca7ea7","resolution":{"observed_at":"2026-08-10T04:59:30.044258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05740","last_updated":"2023-04-11T21:03:47Z","snapshot_observed_at":"2026-08-05T21:26:08.146481Z","submitted_at":"2021-10-12T05:07:43Z","title":"Temporal Abstraction in Reinforcement Learning with the Successor Representation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05740","snapshot_observed_at":"2026-08-10T04:59:30.049297Z","title":"Machado, Andre Barreto, Doina Precup, and Michael Bowling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.049297Z"},"links":{"cited_paper":"/paper/2110.05740","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:4999a1670791d91951b85e97d10db5f8427554867c5587f6e8306d7f73a64eb8","observation_id":"cabdb706-c5ba-4a3b-8755-0ef54ca2c5f3","resolution":{"observed_at":"2026-08-10T04:59:30.049297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.053548Z","title":"Transformers are sample-efficient world models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.053548Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:21c53760cdd9881f869d39d9b434e4555ec3f18f629b19c0382374911b32a86d","observation_id":"1b3a1c66-b37e-4734-9a9c-7773efe6e0c6","resolution":{"observed_at":"2026-08-10T04:59:30.053548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.799797Z","title":"On the difficulty of training recurrent neural networks","venue":null,"work_id":"0d8bf329-b106-4a69-96a8-e5fd11c589e4","year":2012},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.057316Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:96c4d0f5449e52696e70aa8737a54483d3b709ad8e08c8208a0ab07675adc5ba","observation_id":"ba1f3809-9950-45a9-9ba8-fbd27856e298","resolution":{"observed_at":"2026-08-10T04:59:30.803658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.07871","last_updated":"2017-12-18T21:25:53Z","snapshot_observed_at":"2026-08-10T12:32:01.327435Z","submitted_at":"2017-09-22T17:54:12Z","title":"FiLM: Visual Reasoning with a General Conditioning Layer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.07871","snapshot_observed_at":"2026-08-10T04:59:30.061059Z","title":"Film: Visual reasoning with a general conditioning layer, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.061059Z"},"links":{"cited_paper":"/paper/1709.07871","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:4624a8305989680552b1f4c5d01a95bdb624602d7b39e17eb4aad9cfdd820d9b","observation_id":"70d19c9a-ffe3-4741-9a06-b413dd1958bb","resolution":{"observed_at":"2026-08-10T04:59:30.061059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-10T04:59:30.067738Z","title":"Roformer: Enhanced transformer with rotary position embedding, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.067738Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:0084f3c6d8fe735200f25a039b73de079868559a98865d6951a9a898995bb6c8","observation_id":"7da57128-7daf-4edd-841f-644a5b705db7","resolution":{"observed_at":"2026-08-10T04:59:30.067738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.071735Z","title":"Dyna, an integrated architecture for learning, planning, and reacting.ACM Sigart Bulletin, 2(4):160–163, 1991","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.071735Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:6009a26f31c0854883aee14fbce408a3434034a3ffcb6de84df398c0d0b2293e","observation_id":"514c3c40-f568-47a9-9d94-a69c2936babe","resolution":{"observed_at":"2026-08-10T04:59:30.071735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.06018","last_updated":"2017-07-26T18:53:51Z","snapshot_observed_at":"2026-07-06T05:23:15.238465Z","submitted_at":"2016-12-19T01:09:23Z","title":"Self-Correcting Models for Model-Based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.06018","snapshot_observed_at":"2026-08-10T04:59:30.075418Z","title":"Self-correcting models for model-based reinforcement learning, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.075418Z"},"links":{"cited_paper":"/paper/1612.06018","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:78894eb25d2d07b6756682e1532b74d923cc35fb6205bab3e8b25c62568e5992","observation_id":"1cefa4cd-3179-4da4-b099-35c19afcc944","resolution":{"observed_at":"2026-08-10T04:59:30.075418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.406576Z","title":"dm_control: Software and tasks for continuous control.Software Impacts, 6:100022, 2020","venue":null,"work_id":"8aed0620-3100-46df-832c-ccf0a5c648c8","year":2020},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.084747Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:81312491f5dd6e91f84c3dc33e87ab75f88b4ffe2288dc2f6b09ee3cd2ff12d2","observation_id":"c0a12810-1087-447e-8ecc-2f3b50ba2502","resolution":{"observed_at":"2026-08-10T04:59:30.410235Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.097929Z","title":"Chang, Ashesh Rambachan, and Sendhil Mullainathan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.097929Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:657f74bdf21600a52981caf8097cc3481cabfcff37ba838fa6a918f97c51f120","observation_id":"ace92813-913a-4b2f-9108-7604b61f49b8","resolution":{"observed_at":"2026-08-10T04:59:30.097929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-10T04:59:30.107081Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.107081Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:cc43f331f5cb78ac6dd2779a1af08b7193b835ce3ba80c2477db2c592b609983","observation_id":"3dbc8750-b62b-4341-a41e-fa5a637ac7a4","resolution":{"observed_at":"2026-08-10T04:59:30.107081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.26782","last_updated":"2026-04-20T20:34:09Z","snapshot_observed_at":"2026-08-11T16:48:14.865374Z","submitted_at":"2025-10-30T17:56:43Z","title":"Cloning Deterministic Worlds: The Critical Role of Latent Geometry in Long-Horizon World Models","version":3},"cited_work":{"arxiv_id":"2510.26782","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.26782","snapshot_observed_at":"2026-08-10T04:59:30.202338Z","title":"Cloning Deterministic Worlds: The Critical Role of Latent Geometry in Long-Horizon World Models","venue":"cs.LG","work_id":"1200f75e-3678-4a34-b269-42aef8dbd2b8","year":2025},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.111088Z"},"links":{"cited_paper":"/paper/2510.26782","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:a2f96a2c1b1a848954b03b3680aa9cb04310fbc5e66cabec21feb6d67bbb85fa","observation_id":"00e1ab39-4f77-49cf-88fc-d7169a220c7d","resolution":{"observed_at":"2026-08-10T04:59:30.209152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12617","last_updated":"2023-02-24T13:26:03Z","snapshot_observed_at":"2026-07-06T14:55:26.915470Z","submitted_at":"2023-02-24T13:26:03Z","title":"Leveraging Jumpy Models for Planning and Fast Learning in Robotic Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12617","snapshot_observed_at":"2026-08-10T04:59:30.115031Z","title":"Leveraging jumpy models for planning and fast learning in robotic domains, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.115031Z"},"links":{"cited_paper":"/paper/2302.12617","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:56bd9006f82cde448782fe3487ed5a3a0220779ef4f9e7217490fef3410798cd","observation_id":"808b15e9-03b9-4a16-a966-7f99c3c59e1a","resolution":{"observed_at":"2026-08-10T04:59:30.115031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03208","last_updated":"2026-06-16T20:46:31Z","snapshot_observed_at":"2026-07-13T13:29:04.173053Z","submitted_at":"2026-04-03T17:32:36Z","title":"Hierarchical Planning with Latent World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.03208","snapshot_observed_at":"2026-08-10T04:59:30.119375Z","title":"Hierarchical planning with latent world models, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.119375Z"},"links":{"cited_paper":"/paper/2604.03208","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:8cfb5147bf6fc271fa0dd04ebc1d3bac74898450b5c04c62d8a1c8030b2e6740","observation_id":"d7cfc94c-c10d-40a2-9978-d9584051322a","resolution":{"observed_at":"2026-08-10T04:59:30.119375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-10T04:59:30.123195Z","title":"Zhao, Vikash Kumar, Sergey Levine, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.123195Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:7cb47dabc6a0d13921725187f8c33419b6667fc227511bc57f94d0d819f3a9d3","observation_id":"402418ff-d869-4e2e-a0c2-589f9658b771","resolution":{"observed_at":"2026-08-10T04:59:30.123195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:29.826523Z","title":"doi: 10.1613/jair.3912","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:29.826523Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:3d6075e1adf06f08f492ed07116b8fa08e779647ec6db9ce0a60872b7dfaeb80","observation_id":"9064f369-0960-4a8a-aac1-34655adb0efa","resolution":{"observed_at":"2026-08-10T04:59:29.826523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:59:30.783685Z","title":null,"venue":null,"work_id":"31cc67f5-85d2-42a1-8896-188d9c85c1a9","year":null},"citing_paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-10T04:59:30.102693Z"},"links":{"citing_paper":"/paper/2608.07420"},"observation_digest":"sha256:13ff45270bcd12bf74972240b1b0ced76628dbc6e27349f56ff40f9a867ce8cb","observation_id":"3ca24311-a5b0-4c36-874a-e56b581dd810","resolution":{"observed_at":"2026-08-10T04:59:30.787424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.07420","last_updated":"2026-08-07T17:05:44Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T18:12:20.129414Z","submitted_at":"2026-08-07T17:05:44Z","title":"Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":2,"verified_fuzzy":9},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2608.07420."}