{"as_of":"2026-08-08T07:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e211dfb1b9be87ec2ca5531f1ca407fdaab779cc9ddfce6f654f95aa02866719","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:02:10.268300Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18589/citation-record","integrity":"/paper/2607.18589/integrity","json":"/paper/2607.18589/citation-record.json","paper":"/paper/2607.18589"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1806.01261","last_updated":"2018-10-17T17:51:36Z","snapshot_observed_at":"2026-07-06T06:42:54.610341Z","submitted_at":"2018-06-04T17:58:18Z","title":"Relational inductive biases, deep learning, and graph networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01261","snapshot_observed_at":"2026-08-01T15:02:07.135079Z","title":"Battaglia, Jessica B","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.135079Z"},"links":{"cited_paper":"/paper/1806.01261","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:e3e177ba1b4afc3aea66edfbd2f5ec1accaf1cf308366bd9ec628da3f45eab3e","observation_id":"7175be2c-5a82-4c74-83cd-8182aa26c547","resolution":{"observed_at":"2026-08-01T15:02:07.135079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.185967Z","title":"Interpreting emergent planning in model-free reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.185967Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:fb6e608c7b51dd784c43566f2856546c3d18002dda1a91ee238f44e381c75f05","observation_id":"21c47137-978d-45ae-b1c3-b57e1e39931c","resolution":{"observed_at":"2026-08-01T15:02:07.185967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.266292Z","title":"Cohen and Howard Eichenbaum.Memory, Amnesia, and the Hippocampal System","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.266292Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:919c4021e2de39b813516bfa189bccb4d9f9a85986051bd0a764c4937988ccaf","observation_id":"ad7b2732-9443-42a4-89f4-fa3688995c6d","resolution":{"observed_at":"2026-08-01T15:02:07.266292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06258","last_updated":"2025-08-04T03:29:30Z","snapshot_observed_at":"2026-07-06T20:33:48.242475Z","submitted_at":"2025-02-10T08:48:10Z","title":"Emergent Response Planning in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06258","snapshot_observed_at":"2026-08-01T15:02:07.349920Z","title":"Emergent response planning in LLMs, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.349920Z"},"links":{"cited_paper":"/paper/2502.06258","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:71c0897ca117eed1024f35d4da0d77c942bad8018320bb1e62b85b715996ae50","observation_id":"88b8a5a6-bec6-4c7b-8845-698c480b8931","resolution":{"observed_at":"2026-08-01T15:02:07.349920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.430836Z","title":"On the integration of space, time, and memory.Neuron, 95(5):1007–1018,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.430836Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:39922532fce2ffddf499ee1d5396af1cd18366175c8aaadc63abadf0716f7a48","observation_id":"eda69215-df16-4d0e-b26e-cb5c3d912bac","resolution":{"observed_at":"2026-08-01T15:02:07.430836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.556389Z","title":"IM- PALA: Scalable distributed deep-RL with importance weighted actor-learner architectures","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.556389Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:87e2c86e299db23f942f6bbb9d267701b40fdcde705eab151af8c39b3db1a3f2","observation_id":"139b592d-c656-4a31-a783-721bdb8889f1","resolution":{"observed_at":"2026-08-01T15:02:07.556389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.641623Z","title":"Hybrid computing using a neural network with dynamic external memory.Nature, 538(7626): 471–476, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.641623Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:444fe1ee9c3fba010e5cb7887b9c7ccdfe4dff2b6c2a0d072dbc9f1e1960d774","observation_id":"138a9800-8a70-47c1-85af-933b6add9294","resolution":{"observed_at":"2026-08-01T15:02:07.641623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.07771","last_updated":"2017-03-14T21:27:03Z","snapshot_observed_at":"2026-08-03T22:03:58.240131Z","submitted_at":"2016-12-22T19:57:35Z","title":"Highway and Residual Networks learn Unrolled Iterative Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.07771","snapshot_observed_at":"2026-08-01T15:02:07.707423Z","title":"Srivastava, and Jürgen Schmidhuber","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.707423Z"},"links":{"cited_paper":"/paper/1612.07771","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:b4acdf32280eabed1ac489d75e328bd02ca9aad562f7ca65d087e00f35a9b725","observation_id":"f0211f95-3e38-422b-b997-ee3247d0b762","resolution":{"observed_at":"2026-08-01T15:02:07.707423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.755937Z","title":"An investigation of model-free planning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.755937Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:552a830804723280f9eaa840397214f931a636eb3b5a6580d8f3c811ead63872","observation_id":"65152fbd-010f-41d6-a396-a23689fac086","resolution":{"observed_at":"2026-08-01T15:02:07.755937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-01T15:02:07.858752Z","title":"World models, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.858752Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:5b05357f5908574b2fb1e3840254ea3cace693dbd194aef3cfb5d5d83055a228","observation_id":"8a999ab7-8275-4085-83e2-8241eccc7856","resolution":{"observed_at":"2026-08-01T15:02:07.858752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.942708Z","title":"Learning latent dynamics for planning from pixels","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.942708Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:f1da5c6b848f979c10ec4aaaf5b00b2fb55f2a4d1c123b148c2d9d2d0ac60524","observation_id":"2e6ceb7b-c584-4c50-bc92-d9583185caef","resolution":{"observed_at":"2026-08-01T15:02:07.942708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-01T15:02:08.014108Z","title":"Mastering diverse domains through world models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.014108Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:a81385f05cd73c3f8f84690884babf89405a3ab7f9eeef601976a4a242d27c1b","observation_id":"85994764-c10a-4269-9d1a-861554acd880","resolution":{"observed_at":"2026-08-01T15:02:08.014108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00877","last_updated":"2024-06-02T21:57:32Z","snapshot_observed_at":"2026-07-06T18:24:05.440881Z","submitted_at":"2024-06-02T21:57:32Z","title":"Evidence of Learned Look-Ahead in a Chess-Playing Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00877","snapshot_observed_at":"2026-08-01T15:02:08.102796Z","title":"Evidence of learned look-ahead in a chess-playing neural network","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.102796Z"},"links":{"cited_paper":"/paper/2406.00877","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:eeac33a8e56d43765ce25a2bc20e6faceb6cc27aa6792bb8747a1e710dbe99f7","observation_id":"18781938-fef4-4540-bbc8-5594c53a825e","resolution":{"observed_at":"2026-08-01T15:02:08.102796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.196707Z","title":"An empirical exploration of recurrent network architectures","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.196707Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:a228269dc59c271b20391a78422849a2d208f5ae81417249c43eae225c68672f","observation_id":"dc309a59-8dd9-49f8-bf1f-fdb5ddcc6e27","resolution":{"observed_at":"2026-08-01T15:02:08.196707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16236","last_updated":"2020-08-31T11:09:32Z","snapshot_observed_at":"2026-08-06T23:24:28.908251Z","submitted_at":"2020-06-29T17:55:38Z","title":"Transformers are RNNs: Fast Autoregressive Transformers with Linear Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16236","snapshot_observed_at":"2026-08-01T15:02:08.396594Z","title":"Transformers are RNNs: Fast autoregressive transformers with linear attention, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.396594Z"},"links":{"cited_paper":"/paper/2006.16236","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:6acdaf2e88b75abb3811af35f886429008bb245d877fc77d53bb21eb5e41dbe7","observation_id":"a313df4e-2275-461a-ae53-5a001b719130","resolution":{"observed_at":"2026-08-01T15:02:08.396594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.466587Z","title":"Neural rela- tional inference for interacting systems","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.466587Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:038d6c4b1ecde777d5e765fbf6f991e4d2838650d4d7b567cf282d18961ee4f2","observation_id":"9e2f8787-29d7-45c7-a28e-2339186de769","resolution":{"observed_at":"2026-08-01T15:02:08.466587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.626712Z","title":"Actor-critic algorithms","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.626712Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:b5d0640c891aca1ceaba80c5888b63e366f4ba09d568e6508b7d6eccf7aedfc8","observation_id":"6e5ce3d9-56da-43db-aee4-ec5054d8097e","resolution":{"observed_at":"2026-08-01T15:02:08.626712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3389/neuro.01.023.2009","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Frontiers in Neuroscience","work_id":"1cacccc5-bf2d-4083-9f40-3630ae99729b","year":2009},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.690441Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:4dda39a118a6eb967bf63da14616a383df3e59d1fd922d8467c18b05ef39f839","observation_id":"c44de500-899b-4947-9050-536b1ec00fa1","resolution":{"observed_at":"2026-08-01T15:03:26.606056Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.746027Z","title":"Lambert, Brandon Amos, Omry Yadan, and Roberto Calandra","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.746027Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:047ec9b845e60f284349aa2c47e492780005c0235786bc69efe5ff8e3adab846","observation_id":"2d2ae8f8-48b3-4f16-976f-e7f402591358","resolution":{"observed_at":"2026-08-01T15:02:08.746027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.922477Z","title":"Hopkins, David Bau, Fernanda Viégas, Hanspeter Pfister, and Martin Wattenberg","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.922477Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:ec58c36c22d01eedb913fa7286e1eda4c67e5a2f13e63c2a99286ac624fcd76a","observation_id":"286f2150-bd29-4b40-b0b9-82e858668d62","resolution":{"observed_at":"2026-08-01T15:02:08.922477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.006973Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.006973Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:45506765b699e785b0ff8374878080651e652e7e1f31d5f19a8f46d2f52779e9","observation_id":"569930b3-89d8-4396-bee1-3f84ae1ac784","resolution":{"observed_at":"2026-08-01T15:02:09.006973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.076782Z","title":"Puterman.Markov Decision Processes: Discrete Stochastic Dynamic Programming","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.076782Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:db2268c5dd0f7f28825e8e29c4f2e5a8ba0c5e1835b4f3d6efb14288669f15a1","observation_id":"ce5a85a2-29a5-436e-b039-69de08bd295f","resolution":{"observed_at":"2026-08-01T15:02:09.076782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.02217","last_updated":"2021-04-28T07:24:49Z","snapshot_observed_at":"2026-08-05T15:08:02.538782Z","submitted_at":"2020-07-16T17:52:37Z","title":"Hopfield Networks is All You Need","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.02217","snapshot_observed_at":"2026-08-01T15:02:09.136169Z","title":"Hopfield networks is all you need, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.136169Z"},"links":{"cited_paper":"/paper/2008.02217","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:2519fd586fc45cce9ad6934fe9969b856c19fa2bc1a39fc38da3f900f43e1dfb","observation_id":"cd3c98ed-e35a-43e1-b6a5-f08151da5aae","resolution":{"observed_at":"2026-08-01T15:02:09.136169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.218368Z","title":"Graph networks as learnable physics engines for inference and control","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.218368Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:e90ea0a7e73bb80db1b359e39cb84a853ae812ef8a9d206f3dd0fa06e55ed20f","observation_id":"9edd9547-3fac-45e2-be9d-574496b522ba","resolution":{"observed_at":"2026-08-01T15:02:09.218368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.287298Z","title":"Mastering Atari, Go, chess and shogi by planning with a learned model.Nature, 588:604–609, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.287298Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:6ec35fb9c6d731f0d4190ce6dc02c253be6adba4689bdbcf090c88a7ed56c9f1","observation_id":"ac27f4c3-5c54-43a9-801a-857e34f1ff64","resolution":{"observed_at":"2026-08-01T15:02:09.287298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-01T15:02:09.336271Z","title":"High- dimensional continuous control using generalized advantage estimation, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.336271Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:676ff0bf12ee502d3a4f1d6091179032e8b703927ce038b3a6ffb0dab4f6de2f","observation_id":"6b0b7c34-eba7-403b-9b54-8390918c4124","resolution":{"observed_at":"2026-08-01T15:02:09.336271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.394919Z","title":"Convolutional LSTM network: A machine learning approach for pre- cipitation nowcasting","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.394919Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:40d980de7baadcb3bb28403f937a247da7e2b8df7a8ecc438af01c4947ca9022","observation_id":"bf603cd5-7c34-4adb-af4c-6f0ea007a2c7","resolution":{"observed_at":"2026-08-01T15:02:09.394919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.474318Z","title":"Mastering the game of Go without human knowledge.Nature, 550(7676):354–359,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.474318Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:b279dfdf0f7f2dc9c959c82b961d0cb685cde39cc48874043df7233e50008889","observation_id":"9ebfd173-a3ee-426f-a151-d7e6ecc25506","resolution":{"observed_at":"2026-08-01T15:02:09.474318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.615278Z","title":"Stachenfeld, Matthew M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.615278Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:590bec4cbe8275557d3fe67a6b33ed59f8585eadf8cba0d6eb240da5fef9f14e","observation_id":"153f4473-7cae-4ddd-a47c-295c64da6971","resolution":{"observed_at":"2026-08-01T15:02:09.615278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.683089Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.683089Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:4dac72b55d38020d50511224940b034138b4974ae9a169e440299ab43f553929","observation_id":"7426db5f-acd1-4232-b5e2-2e942bee1e69","resolution":{"observed_at":"2026-08-01T15:02:09.683089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.766727Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.766727Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:ef72a168a9781fd08d65d93af20bc097052c558d21a374cfbec7dc3a8570d3d8","observation_id":"0c6ce0aa-c901-4507-8cae-3d0ea4318df8","resolution":{"observed_at":"2026-08-01T15:02:09.766727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.547129Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.547129Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:9d6c94dfe1505afb14a9a841eed1801ed0c50dcc1d66d63abe2d45c4f169eba5","observation_id":"20b2035b-40d6-4146-b760-48eb02093e87","resolution":{"observed_at":"2026-08-01T15:02:09.547129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.878998Z","title":"Planning in a recurrent neural network that plays Sokoban,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.878998Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:de7a3bd3f909d5b43e171a1da5065268543600c16c055ccb326d124a78307fd1","observation_id":"7772a4fc-a757-49ac-bcc4-5dbddaaccfeb","resolution":{"observed_at":"2026-08-01T15:02:09.878998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:10.036252Z","title":"Path channels and plan extension kernels: A mechanistic description of planning in a Sokoban RNN","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.036252Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:a051135718001acffb4e40c45a6d5019be763b549aedff5740a5bb62179395fc","observation_id":"bd602923-92c8-4cd6-92f7-a79a6cd34349","resolution":{"observed_at":"2026-08-01T15:02:10.036252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:10.088740Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.088740Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:9349b5fd34b20978ee052b4921aa3cdd6349c810cbfc18545d5b12b7868369c2","observation_id":"db1077a8-e2d7-49f4-a838-744d92e3954c","resolution":{"observed_at":"2026-08-01T15:02:10.088740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.824297Z","title":"Sutton, David McAllester, Satinder Singh, and Yishay Mansour","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.824297Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:6bb4c6d45dc16239f23bebd81e6639e725c02660a9cba7adb809fd759e82b9aa","observation_id":"95a08ea6-0310-4a8f-9221-8dfeafe319c4","resolution":{"observed_at":"2026-08-01T15:02:09.824297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01830","last_updated":"2018-06-28T14:59:32Z","snapshot_observed_at":"2026-07-06T06:43:09.251512Z","submitted_at":"2018-06-05T17:39:12Z","title":"Relational Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01830","snapshot_observed_at":"2026-08-01T15:02:10.268300Z","title":"thinking","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.268300Z"},"links":{"cited_paper":"/paper/1806.01830","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:332a74fd5b55cf5494139325330af2da009f868f13278eb0975734924a529749","observation_id":"b25fdc25-e292-4093-b69e-82f660107eeb","resolution":{"observed_at":"2026-08-01T15:02:10.268300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:10.199082Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.199082Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:37618c6663e3d177ab17c3f59986efcc050e8d934d8931101b2a4c35cea2650a","observation_id":"501173ea-6396-4676-8443-578983c9e80c","resolution":{"observed_at":"2026-08-01T15:02:10.199082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.857631Z","title":"URL https://proceedings.mlr.press/v120/lambert20a","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":770,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.857631Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:7da5c530b34524f01a07ba3fbf4ae55b906626c0ee6c7c169fb51c272562da94","observation_id":"5eb28650-6644-43d2-b345-51c3ab44724b","resolution":{"observed_at":"2026-08-01T15:02:08.857631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:10.141206Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":1948,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.141206Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:abec84216dd1a07d7ebf8cdd946f672526f451f9ee7263dfaaa09a8917cfe5f8","observation_id":"68313b1b-94db-4319-b0d4-28ef8993c0eb","resolution":{"observed_at":"2026-08-01T15:02:10.141206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.291294Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.291294Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:dd23b2b3b3611aaf6680c290b4ee8c4f191e0b0003de31ab60739987c317fb0f","observation_id":"e1600f04-ab11-4765-8a3a-72b140fb7e4c","resolution":{"observed_at":"2026-08-01T15:02:08.291294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.489269Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.489269Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:35eb460fb526c03ba25bc1ca4a0939dc8c92da5fbf919f0b92f25605393c131d","observation_id":"5950a635-ce08-4ff7-b107-71c8205766f9","resolution":{"observed_at":"2026-08-01T15:02:07.489269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15421","last_updated":"2025-05-30T00:08:56Z","snapshot_observed_at":"2026-08-08T06:45:42.034627Z","submitted_at":"2024-07-22T06:57:34Z","title":"Planning in a recurrent neural network that plays Sokoban","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15421","snapshot_observed_at":"2026-08-01T15:02:09.968163Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.968163Z"},"links":{"cited_paper":"/paper/2407.15421","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:bf2aaf6bfe442533fc20b36d7d32f228f52d5ab284aee9275de742e337d86539","observation_id":"a902f4d8-9798-4d43-8998-298549eba040","resolution":{"observed_at":"2026-08-01T15:02:09.968163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T23:07:05.199302Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2607.18589."}