{"as_of":"2026-08-07T19:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d2e534272c6e6230b79d77eb04bded7c434625fe1de354b5f09c96d11565bce4","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:03:57.872787Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.06219/citation-record","integrity":"/paper/2602.06219/integrity","json":"/paper/2602.06219/citation-record.json","paper":"/paper/2602.06219"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:55.452503Z","title":"Diffusion for world modeling: Visual details matter in atari.Advances in Neural Information Processing Sys- tems, 37, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:55.452503Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:59ca86bd7d47d2cd79dca4029fb57566881b3ecee9466f2e26e7b69c55a6c771","observation_id":"cebd7c78-9047-44b0-9a55-8ac96f97ff2d","resolution":{"observed_at":"2026-08-03T04:03:55.452503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:55.509758Z","title":"First order model-based rl through decoupled backpropagation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:55.509758Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:067b89f4cc25dfce17f304f337e8a630b09103d6d68c4bcb67e4f54e02362c0a","observation_id":"608d48c3-97b4-4f94-8ae1-54d81e4ced4d","resolution":{"observed_at":"2026-08-03T04:03:55.509758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:55.568348Z","title":"Sample-efficient reinforce- ment learning with stochastic ensemble value expansion","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:55.568348Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:c4836e30cb110e45b76487d8fb7f23b1a5f92478fd638649088a8d48b2872476","observation_id":"13d19bea-9c3f-43f0-b51c-5409a67823db","resolution":{"observed_at":"2026-08-03T04:03:55.568348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:55.657636Z","title":"Soloparkour: Constrained reinforcement learning for visual locomotion from privileged experience","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:55.657636Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:7462185b98cac48119852527d9e430da16c73bf37b75d86e5c4c169c1c82df4b","observation_id":"717707db-0e74-4b12-a98f-c20e760d5999","resolution":{"observed_at":"2026-08-03T04:03:55.657636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:55.759638Z","title":"Cat: Constraints as terminations for legged locomotion reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:55.759638Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:4c77299fe2ebb9d4f2995638505592f6d485c50e4a3e5ef8695b3c6da5b64a70","observation_id":"fd44f585-4173-4798-89dd-648e29713ef3","resolution":{"observed_at":"2026-08-03T04:03:55.759638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:55.869682Z","title":"Diffu- sion forcing: Next-token prediction meets full-sequence diffusion.Advances in Neural Information Processing Systems, 37, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:55.869682Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:dfbc267dc5e5d58d6a847e195ca73422ae956ee1230a6d61f0034c96a1069b5a","observation_id":"91e11f48-61b2-4a08-b27a-11f79d867a3b","resolution":{"observed_at":"2026-08-03T04:03:55.869682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:55.952967Z","title":"Extreme parkour with legged robots","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:55.952967Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:24a37384360a2d53c076d3258dc28b95dc16c7088d2067392ed46a5a619d0d4f","observation_id":"1cd695da-a2e2-4c94-bcd5-8f8e359f0244","resolution":{"observed_at":"2026-08-03T04:03:55.952967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.022004Z","title":"Deep reinforcement learning in a handful of trials using probabilistic dynamics models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.022004Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:c7f450814300affdbf45b56dfb8a819aa4f552e64415190026c2b34835ff4eca","observation_id":"4c4436d8-b8f3-4ee6-9ea7-e28d8d8a0941","resolution":{"observed_at":"2026-08-03T04:03:56.022004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.119720Z","title":"Model- augmented actor-critic: Backpropagating through paths","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.119720Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:c1bd91f5f37b874b3c48cb68cfc08c1c123d6e746bc1c15602878a01b90d243e","observation_id":"274f3b92-1545-4ad3-be73-a0b1fd2ec2c9","resolution":{"observed_at":"2026-08-03T04:03:56.119720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12557","last_updated":"2025-06-23T14:26:35Z","snapshot_observed_at":"2026-07-06T19:34:32.629776Z","submitted_at":"2024-10-16T13:34:40Z","title":"One Step Diffusion via Shortcut Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12557","snapshot_observed_at":"2026-08-03T04:03:56.241350Z","title":"One step diffusion via shortcut models.arXiv preprint arXiv:2410.12557, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.241350Z"},"links":{"cited_paper":"/paper/2410.12557","citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:728b050235700fc3cad7f3617b01d320bd38ec6c6a1f8b5d72da021c5f9196d5","observation_id":"2efb367e-e2e2-4b4c-98d6-c0745027ebd8","resolution":{"observed_at":"2026-08-03T04:03:56.241350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02466","last_updated":"2025-02-24T06:56:00Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:47:03Z","title":"PWM: Policy Learning with Multi-Task World Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02466","snapshot_observed_at":"2026-08-03T04:03:56.304547Z","title":"Pwm: Policy learning with multi-task world models.arXiv preprint arXiv:2407.02466, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.304547Z"},"links":{"cited_paper":"/paper/2407.02466","citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:ffdc3c0d91d377bc08713b52a8c783dfb5b240363cb56f67296907e78db5c697","observation_id":"c724f07f-d680-4eaa-8913-584157685fc4","resolution":{"observed_at":"2026-08-03T04:03:56.304547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.359770Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.359770Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:2078bfae1483bd905a28d9593e6b12817992d2954032b6ba3bbc5352bccfa08d","observation_id":"3bdc782b-677e-4961-995e-aa2203481aee","resolution":{"observed_at":"2026-08-03T04:03:56.359770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-03T04:03:56.421007Z","title":"Soft actor-critic algorithms and applications","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.421007Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:39804310be8484ebadd7904b864619dfbb62cb8a1d6ac9c1a98ef6c9edbc7253","observation_id":"f273cae3-e53d-4d1c-8099-b10c5b7bf316","resolution":{"observed_at":"2026-08-03T04:03:56.421007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.512264Z","title":"Mastering atari with discrete world models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.512264Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:eb9c278ee0e172bb879a8836664e26840833304c152a8cf1d1c0fb67392c274b","observation_id":"8ed3ffc5-301e-433f-ad70-63d8859bbd60","resolution":{"observed_at":"2026-08-03T04:03:56.512264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.576353Z","title":"Mastering diverse control tasks through world models.Nature, 640(8059):647–653, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.576353Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:fde36c3f958da0112d44e32189fd8892e77d9e8077632473b959daafd5960a73","observation_id":"1797ab77-6b56-453b-9833-8cf4aadf30b5","resolution":{"observed_at":"2026-08-03T04:03:56.576353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24527","last_updated":"2025-09-29T09:42:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T09:42:27Z","title":"Training Agents Inside of Scalable World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24527","snapshot_observed_at":"2026-08-03T04:03:56.709533Z","title":"Training agents inside of scalable world models.arXiv preprint arXiv:2509.24527, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.709533Z"},"links":{"cited_paper":"/paper/2509.24527","citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:e0b370ea93e875f0294fea598cbca1d0d6bac9f25ef6e8031c9e5966e2bd1f76","observation_id":"1dae7f2e-5e52-447f-ad6b-0dc8b684048c","resolution":{"observed_at":"2026-08-03T04:03:56.709533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.764465Z","title":"Temporal difference learning for model predictive control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.764465Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:f001736661d6448bd8ad478fdb7979602150e119050d99b20102cf11f5e7e003","observation_id":"8bd46494-f7ad-4d65-843d-ebdc11dad254","resolution":{"observed_at":"2026-08-03T04:03:56.764465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.815535Z","title":"Td-mpc2: Scalable, robust world models for continuous control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.815535Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:5ab00260edb28354e14341ebb8535762afed35b150c6fd9444e823cc41eaa6a2","observation_id":"b294454d-15bb-4b10-908a-2439cc741e2a","resolution":{"observed_at":"2026-08-03T04:03:56.815535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.851729Z","title":"Axial attention in multidimensional transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.851729Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:2dbff861e4cda8e93f8dcbe9fcec807653f82dc6f0f8a97c72040ac3e9ae3b1c","observation_id":"f2d99499-4fa2-432b-abe9-c8419db54712","resolution":{"observed_at":"2026-08-03T04:03:56.851729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.894275Z","title":"Anymal parkour: Learning agile navigation for quadrupedal robots.Science Robotics, 9(88), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.894275Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:b9584bdcc051c61f7e781ec25b84b114c91ed8267c3d8bc8f2288120bf4157bc","observation_id":"7894fed2-e8ea-468b-ab6a-011544c9e6a7","resolution":{"observed_at":"2026-08-03T04:03:56.894275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.943761Z","title":"When to trust your model: Model-based policy optimization.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.943761Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:a41acf5aeb02c93a3ee46eaa864c2211d910e025f462bccdf0a55beb6dd475fc","observation_id":"3a485370-5fbd-4fd7-9c99-f655702be553","resolution":{"observed_at":"2026-08-03T04:03:56.943761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:56.982842Z","title":"An introduction to zero-order op- timization techniques for robotics.arXiv preprint arXiv:2506.22087, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:56.982842Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:2f085b836a859a73822123f40ab3324ca8d4a4eeb3591de0c479c8fc1150d668","observation_id":"2ef21bb8-960e-4aaa-ae35-38e21a5bd598","resolution":{"observed_at":"2026-08-03T04:03:56.982842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.050055Z","title":"Elucidating the design space of diffusion-based genera- tive models.Advances in neural information processing systems, 35, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.050055Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:5f25f7a764cf330b37e5c8616c9cf21ad1514a25712e5205d630c6409bffba4e","observation_id":"ccabee6a-3e02-44cf-9d84-af06f7ee6482","resolution":{"observed_at":"2026-08-03T04:03:57.050055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.107713Z","title":"Worldplanner: Monte carlo tree search and mpc with action-conditioned visual world models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.107713Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:4b0377451d9a2dec5edf7c1c5309718aef88683ccd7a099433b7c81ec5c062af","observation_id":"df6bf141-15b5-44d8-9223-40f48002be56","resolution":{"observed_at":"2026-08-03T04:03:57.107713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.156493Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.156493Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:9e3e0cf5c50ad95418a01ea22ec287ace2657de2a62c037bf3b027845cbd8b4e","observation_id":"7492b502-ac9d-46c7-8e19-84a0a6989370","resolution":{"observed_at":"2026-08-03T04:03:57.156493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.188916Z","title":"Model-ensemble trust-region policy optimization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.188916Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:795f23c13823162c25895eb668624fa1bcb6f30ea3a841be08ec17f0c477848a","observation_id":"e0761d95-cec3-4e75-ac75-d3b31b234931","resolution":{"observed_at":"2026-08-03T04:03:57.188916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09637","last_updated":"2022-03-17T22:24:38Z","snapshot_observed_at":"2026-08-05T13:40:53.290916Z","submitted_at":"2022-03-17T22:24:38Z","title":"Investigating Compounding Prediction Errors in Learned Dynamics Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.09637","snapshot_observed_at":"2026-08-03T04:03:57.233115Z","title":"Investigating compounding prediction errors in learned dynamics models.arXiv preprint arXiv:2203.09637, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.233115Z"},"links":{"cited_paper":"/paper/2203.09637","citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:0c49847daf4dd9e0d40ed2b4450c620e8f26934195d187122b70073976a6bf5c","observation_id":"7fc70c44-37dd-40bb-921f-be63a0b09f29","resolution":{"observed_at":"2026-08-03T04:03:57.233115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.291026Z","title":"Uncertainty-aware robotic world model makes offline model-based reinforcement learning work on real robots, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.291026Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:be26fec39df782795f5477a3720b3b78828a25df389e8c65f24327ea24ec4b71","observation_id":"b6976a91-c4cc-45fc-8d59-41aaaccc3f66","resolution":{"observed_at":"2026-08-03T04:03:57.291026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.339066Z","title":"Lightzero: A unified benchmark for monte carlo tree search in general sequential decision scenarios.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.339066Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:e4f512a672e60b829eb87c41582f93ca2e0d1a4c498cd5ae4bf655079a0b2d8b","observation_id":"05e9cd88-4604-4802-b826-dc9ca8633bd0","resolution":{"observed_at":"2026-08-03T04:03:57.339066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10667","last_updated":"2025-01-03T08:57:39Z","snapshot_observed_at":"2026-07-06T18:31:32.118399Z","submitted_at":"2024-06-15T15:24:15Z","title":"UniZero: Generalized and Efficient Planning with Scalable Latent World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10667","snapshot_observed_at":"2026-08-03T04:03:57.371531Z","title":"Unizero: Generalized and effi- cient planning with scalable latent world models.arXiv preprint arXiv:2406.10667, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.371531Z"},"links":{"cited_paper":"/paper/2406.10667","citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:c891d089792db913a6b051cf8dbfcd13c782d30c6902b3f7face249e65d184dd","observation_id":"0386dd37-9f4a-4a13-a693-4c3b69f845db","resolution":{"observed_at":"2026-08-03T04:03:57.371531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.432886Z","title":"Mastering atari, go, chess and shogi by planning with a learned model.Nature, 588(7839):604– 609, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.432886Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:fc2e8d4b15b135f55d6a4404d96ead090c8a0b3794a5db06c4f7341b14bd0002","observation_id":"405f2d97-f906-405a-87e0-74cc059c0235","resolution":{"observed_at":"2026-08-03T04:03:57.432886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-03T04:03:57.494654Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.494654Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:c22972f7066b3c335ac2eeaf11424cf63970794610563b2e2f242cc54c88001d","observation_id":"6356dc6a-a18e-4fb4-9367-af66dd7ac47b","resolution":{"observed_at":"2026-08-03T04:03:57.494654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.541954Z","title":"Daydreamer: World models for physical robot learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.541954Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:9756ee28ef05aa3c6528e4457c149e21bd38c2a7415d1b1f41467ceeec56f87a","observation_id":"9a25fdc2-75bd-4c72-a838-842dd2ab67b2","resolution":{"observed_at":"2026-08-03T04:03:57.541954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.589844Z","title":"Learning to combat compounding- error in model-based reinforcement learning, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.589844Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:4365b9228ea8b49cf125cf8f6f8d935cbc5a72b331b144014931943aff509e3f","observation_id":"ffeffede-261d-4132-aaac-cf171f13466e","resolution":{"observed_at":"2026-08-03T04:03:57.589844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.642074Z","title":"Stabilizing rein- forcement learning in differentiable multiphysics simula- tion.International Conference on Learning Representa- tions (ICLR), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.642074Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:e51e25214749941c6ee6e27f6b964ae74cd94e9d531ae427f423ac8b65c48240","observation_id":"d091cfb9-1912-45bc-a529-f29e813084e4","resolution":{"observed_at":"2026-08-03T04:03:57.642074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.680034Z","title":"Rank2reward: Learning shaped reward functions from passive video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.680034Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:708a2e6a3c37d28a3928a46315f908d0389af9b81ba9a57ef477fb4e0ae9c16c","observation_id":"4445579d-62d0-436d-8a35-942cc6bcfa18","resolution":{"observed_at":"2026-08-03T04:03:57.680034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.716066Z","title":"Zhao, Vikash Kumar, Sergey Levine, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.716066Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:b9ec3b91ca161a8405d7d32be0e9531bcebac4429292932bb2c6175d6f3f4dd1","observation_id":"306fc9f4-dff9-4422-a5e2-76d025c93d45","resolution":{"observed_at":"2026-08-03T04:03:57.716066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:03:57.810275Z","title":"Sim-to-real transfer in deep reinforcement learning for robotics: a survey","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.810275Z"},"links":{"citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:8ed8ccb7bf78fd9fe4c03dda2ea732bf17c7b1eb5169e7a93788fd592ab55d93","observation_id":"087ca447-38d7-4023-9947-fc8b91fecbf6","resolution":{"observed_at":"2026-08-03T04:03:57.810275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05665","last_updated":"2023-09-12T03:01:55Z","snapshot_observed_at":"2026-07-06T16:17:04.004519Z","submitted_at":"2023-09-11T17:59:17Z","title":"Robot Parkour Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05665","snapshot_observed_at":"2026-08-03T04:03:57.872787Z","title":"Robot parkour learning.arXiv preprint arXiv:2309.05665, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T04:03:57.872787Z"},"links":{"cited_paper":"/paper/2309.05665","citing_paper":"/paper/2602.06219"},"observation_digest":"sha256:ebcd76c54fb06fb5fe35f977c1e74483e47ca75f783f12fc5f7ea34cdfc573a2","observation_id":"6799c458-a3c1-45b7-a582-e722a8acc9be","resolution":{"observed_at":"2026-08-03T04:03:57.872787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.06219","last_updated":"2026-06-01T20:55:42Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-03T04:03:55.072444Z","submitted_at":"2026-02-05T21:57:41Z","title":"Coupled Local and Global World Models for Efficient First Order RL"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2602.06219."}