{"as_of":"2026-08-12T09:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bdb05ae486c09a84255d0ebc81313661c583b15790a7b278a6d7d3118535ad55","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T23:57:02.653534Z","state":"measured"},{"denominator":105,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":105,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":52,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:28:18.643656Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"doi_reference","source_observed_at":"2026-07-11T00:47:41.987004Z","state":"measured"}],"external_citation_measurements":[{"count":1051,"observed_at":"2026-07-11T00:47:41.987004Z","source":"doi_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-09T02:21:17.479736Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T01:16:36.399272Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/1912.01603"},"observation_digest":"sha256:52df92e2026bbb2506ec611a624bb8882eba1193d9c356e336d8d6371de7b8e4","observation_id":"740144c2-903b-4025-b819-b4a2f3099d1f","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T01:27:31.813680Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2010.02193"},"observation_digest":"sha256:fb79b3cc50b1be7f941f48a0495f40c1e283c821c5ccfe9d658a54a5cc327fa5","observation_id":"8ef18542-cc46-45cc-bd32-aa5d08957d03","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2211.15657","last_updated":"2023-07-10T07:25:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-28T18:59:02Z","title":"Is Conditional Generative Modeling all you need for Decision-Making?","version":4},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-05-15T15:35:10.593969Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2211.15657"},"observation_digest":"sha256:c74423d67fa340ff2419c1b49a50049e90026b181e3340619ce5db5c44ad9705","observation_id":"b32641dd-c370-4285-bfd6-b12be9f104dd","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T09:08:21.677362Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2301.04104"},"observation_digest":"sha256:0d09d5a148809edae8ce331328f6a9490b01ab2686e115c8fe652839bd4f7796","observation_id":"cd5bdfc2-fab3-4c3a-87e3-07c7e4759dd1","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-08-11T14:28:18.643656Z","title":"Mastering Atari , Go , Chess and Shogi by Planning with a Learned Model","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.12237","last_updated":"2024-12-16T17:51:14Z","snapshot_observed_at":"2026-08-11T14:19:26.463235Z","submitted_at":"2024-12-16T17:51:14Z","title":"Equivariant Action Sampling for Reinforcement Learning and Planning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T14:28:18.643656Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2412.12237"},"observation_digest":"sha256:9470dbaf696cea8f45fec04f2d399418bff9cfe3514e4aefaff262607848e128","observation_id":"836a8968-455d-4585-912e-99970718225f","resolution":{"observed_at":"2026-08-11T14:28:18.643656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-08-07T15:23:19.096967Z","title":"Schrittwieser, I","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.15345","last_updated":"2025-05-23T11:18:10Z","snapshot_observed_at":"2026-08-12T03:31:36.344688Z","submitted_at":"2025-05-21T10:19:49Z","title":"Hadamax Encoding: Elevating Performance in Model-Free Atari","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:23:19.096967Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2505.15345"},"observation_digest":"sha256:3ecacbbdbac25dcb65ae67fb5ba1a53108892f003116da3f7d66172365201f98","observation_id":"1e325a2f-7316-4ab6-bb5b-e88de0f04010","resolution":{"observed_at":"2026-08-07T15:23:19.096967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2505.15858","last_updated":"2026-04-06T08:10:41Z","snapshot_observed_at":"2026-07-06T21:28:01.596548Z","submitted_at":"2025-05-21T01:26:23Z","title":"Search-Based Multi-Trajectory Refinement for Safe C-to-Rust Translation with Large Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T14:36:14.709972Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2505.15858"},"observation_digest":"sha256:343f56c4aed5521f0a348fe09cbe9c99bc50d89bc8029f22c85fcacb26c1bfbd","observation_id":"a0bd6c8f-4511-4359-a094-7cf928d285bc","resolution":{"observed_at":"2026-05-22T14:36:40.902504Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-08-07T04:42:27.946692Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.10138","last_updated":"2026-05-26T19:10:13Z","snapshot_observed_at":"2026-08-09T21:45:32.789653Z","submitted_at":"2025-06-11T19:36:17Z","title":"Path Channels and Plan Extension Kernels: a Mechanistic Description of Planning in a Sokoban RNN","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:27.946692Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2506.10138"},"observation_digest":"sha256:93b2d2f6aa509f0f83d17f35664602fbc421512a3dc89217a1e71475dc2a5ab2","observation_id":"153600d2-89b4-48e2-b783-c3a6f7d4ff8b","resolution":{"observed_at":"2026-08-07T04:42:27.946692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2507.12549","last_updated":"2026-04-28T23:40:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-16T18:01:26Z","title":"The Serial Scaling Hypothesis","version":4},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-19T04:08:11.344622Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2507.12549"},"observation_digest":"sha256:e0d9a4211222f1344ad361e6fca61361b3aa1de145eb4c605ddccbf2623107c6","observation_id":"325612bb-76e1-4fee-ba98-6d6b5f4dd786","resolution":{"observed_at":"2026-05-19T04:12:02.429713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-08-05T22:06:19.678869Z","title":"P.; and Silver, D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.07522","last_updated":"2025-08-11T00:53:52Z","snapshot_observed_at":"2026-08-10T09:00:44.500380Z","submitted_at":"2025-08-11T00:53:52Z","title":"Evolutionary Optimization of Deep Learning Agents for Sparrow Mahjong","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T22:06:19.678869Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2508.07522"},"observation_digest":"sha256:c84fe555a8f7938c6c5d246c1056ac14d190ba7ee7653c2e4f6b0452636c8520","observation_id":"37899805-d3a8-4eca-9aa3-9f73fabb337d","resolution":{"observed_at":"2026-08-05T22:06:19.678869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-08-04T16:58:12.980404Z","title":"CoRR abs/1911.08265(2019), http://arxiv.org/abs/1911.08265","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2509.11233","last_updated":"2025-09-14T12:20:38Z","snapshot_observed_at":"2026-08-10T00:41:12.405586Z","submitted_at":"2025-09-14T12:20:38Z","title":"TransZero: Parallel Tree Expansion in MuZero using Transformer Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T16:58:12.980404Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2509.11233"},"observation_digest":"sha256:424da25b4b85f5a57f9ff7d9db9e27adcd96e249e6f3bcf2ee337034d4a6b31b","observation_id":"fd4a96a0-65d4-4244-a14b-056c4870268d","resolution":{"observed_at":"2026-08-04T16:58:12.980404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2509.24527","last_updated":"2025-09-29T09:42:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T09:42:27Z","title":"Training Agents Inside of Scalable World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T02:05:52.431747Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2509.24527"},"observation_digest":"sha256:69695adb88200d89c66e76b1f46b6bda02d3789b31e8d1693e88abc741d7cbfc","observation_id":"f6ea2bd0-f48a-4b74-8cd9-18e3aa597b52","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2512.10226","last_updated":"2026-04-14T00:44:42Z","snapshot_observed_at":"2026-08-11T16:16:14.069064Z","submitted_at":"2025-12-11T02:22:07Z","title":"Latent Chain-of-Thought World Modeling for End-to-End Driving","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T23:16:41.916869Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2512.10226"},"observation_digest":"sha256:9eac0e6b73a0384f7822911244354ad7c3f6485702f89c441fd9f406ff213217","observation_id":"0aff5ca6-ef4a-4541-9ccd-b8f3539a0589","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2512.21648","last_updated":"2026-04-26T10:57:37Z","snapshot_observed_at":"2026-08-11T13:16:16.240365Z","submitted_at":"2025-12-25T12:25:26Z","title":"Variance-Aware Prior-Based Tree Policies for Monte Carlo Tree Search","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-16T19:35:25.261161Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2512.21648"},"observation_digest":"sha256:5e98609058520c5ee9f4dea4da205e4bac0ebfe69fe9c7a975cc60d2afd3f1a1","observation_id":"32e42319-a270-48e8-aa0a-0d3aaf776b89","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2512.24497","last_updated":"2026-05-18T09:26:59Z","snapshot_observed_at":"2026-07-31T22:57:41.701920Z","submitted_at":"2025-12-30T22:50:03Z","title":"What Drives Success in Physical Planning with Joint-Embedding Predictive World Models?","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-21T15:33:24.616338Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2512.24497"},"observation_digest":"sha256:a32e3fa9c2d9d5189df6bdeca479fd0eb0767a4894c6e90e9a1403839a71fcde","observation_id":"aac7798c-3ff3-49f5-88da-6695b44cfdbf","resolution":{"observed_at":"2026-05-21T15:34:14.849799Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2602.01505","last_updated":"2026-05-06T16:04:38Z","snapshot_observed_at":"2026-08-11T14:55:55.889399Z","submitted_at":"2026-02-02T00:35:42Z","title":"Optimal Sample Complexity for Single Time-Scale Actor-Critic with Momentum","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T08:12:57.430291Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2602.01505"},"observation_digest":"sha256:802ae27b4ce5a4abb0c5daa0ac57e823a68b2202d6a813df4636b43c2610cd06","observation_id":"6dfb7745-6c8e-413a-99b2-f91f3d872264","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2604.04518","last_updated":"2026-04-06T08:29:33Z","snapshot_observed_at":"2026-08-11T15:59:57.446987Z","submitted_at":"2026-04-06T08:29:33Z","title":"Reproducibility study on how to find Spurious Correlations, Shortcut Learning, Clever Hans or Group-Distributional non-robustness and how to fix them","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T20:22:13.004346Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2604.04518"},"observation_digest":"sha256:6c1de6a33a09fd16e513b30d097a6e8b8f6e697eb2468309bc2f02024c6092f9","observation_id":"5a43d936-5686-48d8-8d95-f96df85c58b1","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2604.25859","last_updated":"2026-05-02T20:40:07Z","snapshot_observed_at":"2026-08-11T10:33:33.290444Z","submitted_at":"2026-04-28T16:58:52Z","title":"Privileged Foresight Distillation: Zero-Cost Future Correction for World Action Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T15:42:10.954090Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2604.25859"},"observation_digest":"sha256:4419018fc2988ff094ba61de02cf8105d2499d48f625826cdbfd1327ed0ba409","observation_id":"9c0cc5bc-6019-46f6-ae9b-395aff5c13fa","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.00940","last_updated":"2026-05-01T04:22:16Z","snapshot_observed_at":"2026-08-11T13:08:01.985960Z","submitted_at":"2026-05-01T04:22:16Z","title":"Interpretable experiential learning based on state history and global feedback","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-09T19:11:58.128793Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.00940"},"observation_digest":"sha256:27234378dcd96a7b97e64247c13f06a2e5752cc89dd8e9cbbb4b2586634e82b5","observation_id":"6a694690-95e8-4a5b-8768-08771c91c5f7","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.01694","last_updated":"2026-05-03T03:19:42Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T03:19:42Z","title":"Latent State Design for World Models under Sufficiency Constraints","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T15:55:31.825583Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.01694"},"observation_digest":"sha256:7c7ab36b62d6e5180eb0427fa1da49e1f98a9ea17e4cdb3983dcee9e01f9df7e","observation_id":"238997d7-fd19-4156-86ab-cfa807ed87d0","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.03434","last_updated":"2026-05-05T07:14:53Z","snapshot_observed_at":"2026-07-06T23:16:20.322265Z","submitted_at":"2026-05-05T07:14:53Z","title":"Quantum Hierarchical Reinforcement Learning via Variational Quantum Circuits","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T17:24:49.763003Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.03434"},"observation_digest":"sha256:485e171a85e80c97ef2a58447925d0d963f8b6a4e841e75645e4bf7044c8ae3f","observation_id":"5d042b98-0993-4efa-b50e-99f2f9e47f23","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.06373","last_updated":"2026-05-07T14:52:37Z","snapshot_observed_at":"2026-08-11T18:00:42.925701Z","submitted_at":"2026-05-07T14:52:37Z","title":"Beyond the Independence Assumption: Finite-Sample Guarantees for Deep Q-Learning under $\\tau$-Mixing","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-08T05:01:53.381535Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.06373"},"observation_digest":"sha256:a05bfb8b9db510526de5f792254ffdbe2ed9a9fd1af83cba70d0d7175d4656f2","observation_id":"6287f7af-0b07-461c-a6d8-62c7989292d4","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.08982","last_updated":"2026-05-21T09:52:14Z","snapshot_observed_at":"2026-08-11T13:11:56.297077Z","submitted_at":"2026-05-09T14:54:07Z","title":"PMCTS: Particle Monte Carlo Tree Search for Principled Parallelized Inference Time Scaling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T02:50:05.912942Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.08982"},"observation_digest":"sha256:b14afaedc021298c683738d7fb71f2b3a5e2f0fd0998d9d01c188eaf098f8103","observation_id":"e4ecb6f7-e826-4767-b0f2-a8a6f0798d33","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.08982","last_updated":"2026-05-21T09:52:14Z","snapshot_observed_at":"2026-08-11T13:11:56.297077Z","submitted_at":"2026-05-09T14:54:07Z","title":"PMCTS: Particle Monte Carlo Tree Search for Principled Parallelized Inference Time Scaling","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T09:54:26.251503Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.08982"},"observation_digest":"sha256:9d0397934e92bd911b4db7428cb27672199e9fecc4d8541456720e13e9d24fef","observation_id":"00320184-a98e-453d-ac6a-d884111b680d","resolution":{"observed_at":"2026-05-22T09:54:46.063301Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.09364","last_updated":"2026-05-10T06:27:20Z","snapshot_observed_at":"2026-08-11T06:51:53.423293Z","submitted_at":"2026-05-10T06:27:20Z","title":"Multi-scale Predictive Representations for Goal-conditioned Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T03:35:37.739085Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.09364"},"observation_digest":"sha256:13f4b364120845810f2a59a90071325e2dddc96a8a2c4bca8aff75e23654f0e2","observation_id":"a95139fb-0756-464c-9da7-548599e45f03","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.12653","last_updated":"2026-05-12T18:58:03Z","snapshot_observed_at":"2026-08-11T06:50:32.276721Z","submitted_at":"2026-05-12T18:58:03Z","title":"Plan Before You Trade: Inference-Time Optimization for RL Trading Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-14T21:25:12.504050Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.12653"},"observation_digest":"sha256:6d4b642ce2935a019b0e9b558311a4971bfcc5a27a2cca8adb6d19897329f2ef","observation_id":"2c775e6a-d6d8-4b07-a121-221c4d73152c","resolution":{"observed_at":"2026-05-16T23:57:02.849350Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.15053","last_updated":"2026-05-15T02:16:20Z","snapshot_observed_at":"2026-08-01T22:38:16.506764Z","submitted_at":"2026-05-14T16:46:26Z","title":"TFGN: Task-Free, Replay-Free Continual Pre-Training Without Catastrophic Forgetting at LLM Scale","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-19T17:06:12.280460Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.15053"},"observation_digest":"sha256:a2c0b9ec66b4b1da23dbb6c43e9115f566ff384db7d73644ffd91baf3f7fd0bb","observation_id":"8a29e827-628e-43af-b350-c8f21629d059","resolution":{"observed_at":"2026-05-19T17:07:41.583577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.19341","last_updated":"2026-05-19T04:29:03Z","snapshot_observed_at":"2026-08-02T09:32:52.742127Z","submitted_at":"2026-05-19T04:29:03Z","title":"HalluWorld: A Controlled Benchmark for Hallucination via Reference World Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-20T05:52:53.880521Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.19341"},"observation_digest":"sha256:ded6102150918f6371cc2870e4607d4f2d1bcc8e93167ed0cd08ddc5a8ab8f4b","observation_id":"5b7addc5-168b-4dfe-80f3-dd04510a01ec","resolution":{"observed_at":"2026-05-20T05:53:04.201148Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.19503","last_updated":"2026-05-20T07:37:16Z","snapshot_observed_at":"2026-08-01T16:57:53.244755Z","submitted_at":"2026-05-19T07:54:40Z","title":"ARC-RL: A Reinforcement Learning Playground Inspired by ARC Raiders","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T05:28:50.354662Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.19503"},"observation_digest":"sha256:bc5c79e6476517ee0c5ef716b986d694bda515c2233105c28301fa454e647440","observation_id":"3ec4a674-5653-4680-8bbe-abac63264efa","resolution":{"observed_at":"2026-05-20T05:33:03.812197Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.19503","last_updated":"2026-05-20T07:37:16Z","snapshot_observed_at":"2026-08-01T16:57:53.244755Z","submitted_at":"2026-05-19T07:54:40Z","title":"ARC-RL: A Reinforcement Learning Playground Inspired by ARC Raiders","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T07:36:12.214949Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.19503"},"observation_digest":"sha256:f5be07365ea72e384806739647899474e1926abea3d7425141c356b437bb7e34","observation_id":"b6832880-bbe5-437d-821d-7eb5b780736e","resolution":{"observed_at":"2026-05-21T07:39:48.420072Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.24152","last_updated":"2026-05-26T06:41:34Z","snapshot_observed_at":"2026-07-06T23:34:13.859813Z","submitted_at":"2026-05-22T19:19:32Z","title":"Neuro-Inspired Inverse Learning for Planning and Control","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T16:07:16.957620Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.24152"},"observation_digest":"sha256:75971a04ee7af2cd687a278fd415226e139c0affa1b32d8f0f02f9c4c4dadbf5","observation_id":"d64ab1db-89d8-4758-afb4-4190cdcb4eb8","resolution":{"observed_at":"2026-06-30T16:14:52.778744Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.24517","last_updated":"2026-05-23T11:08:46Z","snapshot_observed_at":"2026-08-01T19:56:38.196339Z","submitted_at":"2026-05-23T11:08:46Z","title":"ECHO: Terminal Agents Learn World Models for Free","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T14:57:03.095107Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.24517"},"observation_digest":"sha256:5c4b1e434251b8a10b6bddfec617f7c3a54222075a241407b537773141ccc779","observation_id":"55b995ea-83ab-4955-912e-1ce083567e06","resolution":{"observed_at":"2026-06-30T15:04:46.066623Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.29360","last_updated":"2026-05-28T04:58:15Z","snapshot_observed_at":"2026-08-11T15:44:13.401213Z","submitted_at":"2026-05-28T04:58:15Z","title":"MiraBench: Evaluating Action-Conditioned Reliability in Robotic World Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T07:46:28.469913Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.29360"},"observation_digest":"sha256:8e9db03ac9c0a2a977edd499b218a3c5e42be22ff4e5dcee861f989a496d1867","observation_id":"4460d82b-8089-4b4a-9bac-c3b7c43e1e7c","resolution":{"observed_at":"2026-06-29T07:53:13.179300Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.30542","last_updated":"2026-05-28T20:18:22Z","snapshot_observed_at":"2026-07-06T23:39:48.531480Z","submitted_at":"2026-05-28T20:18:22Z","title":"Physically Viable World Models: A Case for Query-Conditioned Embodied AI","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-29T06:55:57.801162Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.30542"},"observation_digest":"sha256:ef58f968465d6729dd281c3c0d33086a237293bf9c6bba39da526153920d8e9c","observation_id":"563cd976-d1fa-4cea-8fcd-9e795712a046","resolution":{"observed_at":"2026-06-29T09:13:16.528091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2605.31464","last_updated":"2026-05-29T15:56:08Z","snapshot_observed_at":"2026-07-06T23:40:36.926513Z","submitted_at":"2026-05-29T15:56:08Z","title":"GPU Forecasters: Language Models as Selective Surrogates for Kernel Runtime Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T23:09:57.297404Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2605.31464"},"observation_digest":"sha256:df82caf11f9bb5a4ab128b78557f3d91acd581cd07baedc14301c965d0b57c61","observation_id":"de0c8f94-cba7-4ac8-b9a7-7dc7a5a179f1","resolution":{"observed_at":"2026-06-28T23:12:46.188973Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.00089","last_updated":"2026-05-23T16:28:59Z","snapshot_observed_at":"2026-08-02T10:41:58.052096Z","submitted_at":"2026-05-23T16:28:59Z","title":"Can Predicted Dynamics Exist in the Physical World?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T13:02:21.832944Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.00089"},"observation_digest":"sha256:67f249b1e8990f4732c2feffb1119b2d8de5337740506326f37b489e78f2901d","observation_id":"827cb0a4-d083-4405-bc59-b0d277d43980","resolution":{"observed_at":"2026-06-30T13:04:39.065722Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.00090","last_updated":"2026-05-23T16:48:03Z","snapshot_observed_at":"2026-08-03T02:45:28.018918Z","submitted_at":"2026-05-23T16:48:03Z","title":"Silent Failures in Physical AI: A Literature Review of Runtime Action Authorization for Autonomous Systems","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-30T12:59:06.201024Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.00090"},"observation_digest":"sha256:ab47cd138816d8d32c79e81bf1d4bad5885a3ff0fb87ae4f8c6861f2f47d01db","observation_id":"3df8379d-fe57-4761-95b1-3d3990d6571b","resolution":{"observed_at":"2026-06-30T13:04:39.459819Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.06556","last_updated":"2026-06-04T10:43:14Z","snapshot_observed_at":"2026-08-09T06:57:25.072034Z","submitted_at":"2026-06-04T10:43:14Z","title":"Robots Need More than VLA and World Models","version":1},"reference_index":128,"source":"arxiv_source","source_observed_at":"2026-06-28T01:01:33.530167Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.06556"},"observation_digest":"sha256:b86bd05f63ecb2709142f4cadcee39677b521729775293bfcefcc646bcd2125f","observation_id":"d5d48e0c-370d-4108-89e3-9ab9e4922e10","resolution":{"observed_at":"2026-06-28T01:11:28.893372Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.09032","last_updated":"2026-06-08T04:58:52Z","snapshot_observed_at":"2026-08-08T16:04:03.893985Z","submitted_at":"2026-06-08T04:58:52Z","title":"Bridging the Agent-World Gap: Text World Models for LLM-based Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T17:05:22.625169Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.09032"},"observation_digest":"sha256:2c70f646b95de5d6b8eb472654eb5e8820c8d984f65bcd18a969f0510363cf17","observation_id":"5c28508f-2868-49f4-9f4e-0609fa3cb50c","resolution":{"observed_at":"2026-06-27T17:11:05.581961Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.10044","last_updated":"2026-06-28T13:25:07Z","snapshot_observed_at":"2026-08-08T08:43:11.131713Z","submitted_at":"2026-06-08T18:16:04Z","title":"Business World Model","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T10:26:00.717776Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.10044"},"observation_digest":"sha256:15738cb7f0f9185cd3e8d1003b4fc33fe88ad9f9d96893b742c12dd51e7cc36a","observation_id":"d787f317-1077-4bdf-ae82-93315e9aa765","resolution":{"observed_at":"2026-06-30T10:34:36.063813Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.10359","last_updated":"2026-06-09T03:18:44Z","snapshot_observed_at":"2026-08-06T13:21:05.581233Z","submitted_at":"2026-06-09T03:18:44Z","title":"ReflectiChain: Epistemic Grounding in LLM-Driven World Models for Supply Chain Resilience","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T13:37:20.058710Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.10359"},"observation_digest":"sha256:dc5dd95c0b0f6a6d530943be89550305b4e55918217f22798611990336ac3623","observation_id":"147385d6-71f9-4d0a-893e-3df221224863","resolution":{"observed_at":"2026-06-27T13:40:57.247355Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.12783","last_updated":"2026-06-11T00:52:39Z","snapshot_observed_at":"2026-08-06T06:14:00.330112Z","submitted_at":"2026-06-11T00:52:39Z","title":"A Tutorial on World Models and Physical AI","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T07:27:11.745750Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.12783"},"observation_digest":"sha256:17d590f3c1e59903af54680f17b51528a3bdb5b5ed0b6c0b1c0c074f32d0225d","observation_id":"d8050637-4a82-427b-af3b-d87f50a4ee5e","resolution":{"observed_at":"2026-06-27T07:30:41.015511Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.18208","last_updated":"2026-06-16T17:37:27Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:37:27Z","title":"Looped World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T01:49:57.105358Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.18208"},"observation_digest":"sha256:08b264b53abcefc6392cd808edcf271d5232cfe479cd87b0012aeab35cc18b0c","observation_id":"90acd6ed-15b2-4554-9134-e0b26bcb4e54","resolution":{"observed_at":"2026-06-27T01:50:21.207727Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.21297","last_updated":"2026-06-19T10:21:04Z","snapshot_observed_at":"2026-07-06T23:56:21.824303Z","submitted_at":"2026-06-19T10:21:04Z","title":"NASDAQ: Normalized Observation Space Dynamics-Augmented Q-Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T14:39:59.778081Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.21297"},"observation_digest":"sha256:10b4e427dcbf6638387a91cffc1e446f6d78da1bdb6bcd088f0a7700551161f4","observation_id":"d762848a-12b6-45b7-b3ca-c60cffc899a8","resolution":{"observed_at":"2026-06-26T14:49:32.413823Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.22449","last_updated":"2026-06-21T11:46:49Z","snapshot_observed_at":"2026-07-31T01:23:25.610752Z","submitted_at":"2026-06-21T11:46:49Z","title":"Self-Evolving Cognitive Framework via Causal World Modeling for Embodied Scientific Intelligence","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T11:05:44.688725Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.22449"},"observation_digest":"sha256:a041fcf76cc2e10aab29be40834deb1d7d02c56bbbd0f2f35fc052e4033fbad9","observation_id":"04c1852d-b0c8-4448-ae86-153ac9bc8b40","resolution":{"observed_at":"2026-06-26T11:09:23.329390Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":1},"reference_index":183,"source":"pdf_text","source_observed_at":"2026-06-26T08:09:57.542558Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:aa5ba4e65fae7f247d3cfa60dec3f8b2b587028fb28662c9afb9a8005528a242","observation_id":"175f8e93-d004-4694-8b71-bc36b2604629","resolution":{"observed_at":"2026-07-04T11:09:46.258896Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-08-02T10:27:18.390194Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model.Nature, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":2},"reference_index":171,"source":"pdf_text","source_observed_at":"2026-08-02T10:27:18.390194Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:83755be9d472aed416099c0164354bcd02fe78e10e9970d315bbc2e9d3b5902d","observation_id":"8dd53e14-6c8d-49b8-b648-046595ee24f9","resolution":{"observed_at":"2026-08-02T10:27:18.390194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2607.06401","last_updated":"2026-07-07T15:31:32Z","snapshot_observed_at":"2026-08-03T02:43:03.919769Z","submitted_at":"2026-07-07T15:31:32Z","title":"A Definition and Roadmap for World Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-08T07:10:33.826140Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2607.06401"},"observation_digest":"sha256:1b4de6be3a0aa6df84e71ffab225f0271f81c2ac853c9fc904912643d24a07e8","observation_id":"cc5a233e-a12e-4b3c-84da-e362d1963ef2","resolution":{"observed_at":"2026-07-08T07:14:44.355812Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":"1911.08265","doi":"10.1038/s41586-020-03051-4","metadata_source":"doi_reference","pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","venue":"cs.LG","work_id":"964ed935-1570-495e-a162-9182456934cc","year":2019},"citing_paper":{"arxiv_id":"2607.06640","last_updated":"2026-07-07T14:45:17Z","snapshot_observed_at":"2026-08-09T09:10:01.399367Z","submitted_at":"2026-07-07T14:45:17Z","title":"The Rank-One Corner: How Much Value Equivalence Does a Task Need from a World Model?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T00:46:05.174910Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2607.06640"},"observation_digest":"sha256:14c7910e85a0d9db43bd4e81ddf85d94f33a8fa599d805cf265ae6eb47becd8e","observation_id":"2a000284-4c95-41bb-9b52-0072ed5e25ff","resolution":{"observed_at":"2026-07-11T00:47:42.015170Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:38.761479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-08-03T09:55:54.826178Z","title":"Lillicrap and David Silver , title =","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.29294","last_updated":"2026-07-31T11:12:31Z","snapshot_observed_at":"2026-08-08T01:10:37.586600Z","submitted_at":"2026-07-31T11:12:31Z","title":"Sample Efficient Hierarchical Reinforcement Learning via Best Policy Identification","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-03T09:55:54.826178Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2607.29294"},"observation_digest":"sha256:f01dc5440aa93e3d29e077918ec03200b86dce9999a2f1ebd2a4b42822609f34","observation_id":"b782cc45-4b09-48b5-b09a-6a3f84248914","resolution":{"observed_at":"2026-08-03T09:55:54.826178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-08-04T19:45:35.186511Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-07T23:22:57.641630Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":220,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:35.186511Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:e6c67b0ca29d042227f7cebcb04636e286ffee29d84aeb20f4a3d9872600e39c","observation_id":"27dd0e8d-7c85-4c6b-a960-06d8785d7087","resolution":{"observed_at":"2026-08-04T19:45:35.186511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08265","snapshot_observed_at":"2026-08-07T00:14:10.585654Z","title":"MasteringAtari, Go, chessandshogibyplanningwithalearnedmodel","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-07T23:09:56.055766Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":136,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:10.585654Z"},"links":{"cited_paper":"/paper/1911.08265","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:41c63c2ce135a38fd860f02ebced3e2eb79ca5fe85272db0a6f06b7640a560d5","observation_id":"0a9b3376-327b-4d55-a4d5-7c7bf8780bd1","resolution":{"observed_at":"2026-08-07T00:14:10.585654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1911.08265/citation-record","integrity":"/paper/1911.08265/integrity","json":"/paper/1911.08265/citation-record.json","paper":"/paper/1911.08265"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1806.05780","last_updated":"2019-09-05T02:31:13Z","snapshot_observed_at":"2026-07-06T06:44:58.350748Z","submitted_at":"2018-06-15T01:35:03Z","title":"Surprising Negative Results for Generative Adversarial Tree Search","version":4},"cited_work":{"arxiv_id":"1806.05780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1806.05780","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lipton, and Animashree Anandkumar","venue":null,"work_id":"89d8a872-e25f-4e79-971e-9aad2c2d136a","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1806.05780","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:6afa1072dc7e0cf354badc9556ad01b76a559b1cf35a5e32983ed31d22167d93","observation_id":"f67b3ed9-2b9a-4e02-8ee7-3ffa90927141","resolution":{"observed_at":"2026-05-16T23:57:02.726748Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The arcade learning environment: An evaluation platform for general agents","venue":null,"work_id":"dd383516-d2cf-40d5-b95c-99ff0ca6f83d","year":2013},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:100fa52e327b4bbd535ece4c89eff34a45d0ccdcbefd5c7a22a4590ff6d23a43","observation_id":"47fdb076-c1bf-4440-866a-b7fa821c06f8","resolution":{"observed_at":"2026-05-16T23:57:02.830260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Superhuman ai for heads-up no-limit poker: Libratus beats top profes- sionals","venue":null,"work_id":"2356edfc-3c56-477c-848e-709319c2218b","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:fe4494b02cfc82a897767299c29c176a5f7d52d5b10f31200f084ca185ab403a","observation_id":"41dad89d-0db1-412d-b1b4-ee0cac0fee35","resolution":{"observed_at":"2026-05-16T23:57:02.832408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03006","last_updated":"2018-02-08T18:54:44Z","snapshot_observed_at":"2026-08-10T08:09:15.605315Z","submitted_at":"2018-02-08T18:54:44Z","title":"Learning and Querying Fast Generative Models for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1802.03006","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.03006","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning and Querying Fast Generative Models for Reinforcement Learning","venue":"cs.LG","work_id":"45700551-6f99-4914-b123-083e4ac20e0a","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1802.03006","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:91b1a554f24e1baeb5697f07971fb1506a6f926c2a315d26b1d529c3b171e26e","observation_id":"850ad890-cefd-4d17-be50-e8ff5057c1ec","resolution":{"observed_at":"2026-05-16T23:57:02.695798Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Joseph Hoane, Jr., and Feng-hsiung Hsu","venue":null,"work_id":"313124b1-b65d-4318-85e2-cb28a84a6476","year":2002},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:d4dea1ccac11f953e5d677627257a4fa0ef471bf1eecffb4fbbc4c8be72c6ac6","observation_id":"6d8453fa-62f3-4265-9019-b7273c2e6d3d","resolution":{"observed_at":"2026-05-16T23:57:02.834230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"03ed447e-0c41-415e-8eac-5d92b2073883","year":2008},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:d38303e822a52a611666943acdb578bb69f768a56c1ecc7b3221aa17aa643eb1","observation_id":"1f130c5c-ab9d-40fb-8249-184f0e55837b","resolution":{"observed_at":"2026-05-16T23:57:02.836680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efﬁcient selectivity and backup operators in monte-carlo tree search","venue":null,"work_id":"a7060129-28f7-497b-b964-45ebce8a8c58","year":2006},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:586426b141c7cf74fe8c0305971aa09a0079fbc426eee82d6d227d89b16190ff","observation_id":"69af9c69-2ff6-442e-8e02-16b1645a474d","resolution":{"observed_at":"2026-05-16T23:57:02.838898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deisenroth and CE","venue":null,"work_id":"0a31695b-28cd-43cf-9724-b49181a8eed4","year":2011},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:8a7fad3a0feb09c42b3ee50dede80d4e4f947143f717bb7bcd93da626b64886c","observation_id":"14fb4b99-a142-43fe-9565-25cd41a5420e","resolution":{"observed_at":"2026-05-16T23:57:02.841113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Impala: Scalable distributed deep-rl with importance weighted actor-learner architectures","venue":null,"work_id":"ed068e00-3fdc-411d-b137-f3a2f6343222","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:0e06ed08023204ef98ef3f2d6322ae2fc85d3456a9c644fea1d327d09f3c25a9","observation_id":"f283646a-e748-4ee6-8e91-d7e05a13b041","resolution":{"observed_at":"2026-05-16T23:57:02.843539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TreeQN and ATreec: Differ- entiable tree planning for deep reinforcement learning","venue":null,"work_id":"3a011bd4-c87f-406d-801e-1b6dee6f1a43","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:f6de9c4d89cb50a6a5956b06e0064900d90ceb25ec60949d6b22560947c5e20c","observation_id":"66298709-2fac-49e7-95c6-fd3805e3aeea","resolution":{"observed_at":"2026-05-16T23:57:02.846106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bellemare","venue":null,"work_id":"6bf1b5ea-653f-4ca8-b0ce-7410e20ea694","year":2019},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:2af1a4260640286dac8b9a14b216784ee1136450102f2105ed706264e73476b8","observation_id":"958132af-1f46-4bed-91a0-69e5fcbd0f69","resolution":{"observed_at":"2026-05-16T23:57:02.848487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://cloud.google.com/tpu/","venue":null,"work_id":"1981920a-67bd-465c-baf3-baefd30c45ac","year":2019},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:a70050d70e31955b0ff60d386dd9d56040c11efb74ddb12b765632184c9528dc","observation_id":"7814ce43-c286-4e56-a7d9-e68e412a13e9","resolution":{"observed_at":"2026-05-16T23:57:02.729764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":"836369e3-5a45-4c80-9427-5980ee9da934","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:2f450d9ffb52786eb26b41c1fe4d58f6fd859acb2b31a9912cb3df0a5cc43b1d","observation_id":"f8f0c2d2-e132-4e02-a646-40e90e41e41c","resolution":{"observed_at":"2026-05-16T23:57:02.733364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.04551","last_updated":"2019-06-04T18:13:09Z","snapshot_observed_at":"2026-07-06T07:14:03.735574Z","submitted_at":"2018-11-12T04:30:10Z","title":"Learning Latent Dynamics for Planning from Pixels","version":5},"cited_work":{"arxiv_id":"1811.04551","doi":"10.48550/arxiv.1811.04551","metadata_source":"pith","pith_arxiv_id":"1811.04551","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning Latent Dynamics for Planning from Pixels","venue":"cs.LG","work_id":"146fc4a4-6db2-43a9-a57f-4dd133c0d315","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1811.04551","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:b354d1f6d5402869d1a591bfd18d6047036f95a4bddaa5c182942046c7afe223","observation_id":"85d24a34-2b7e-4ae5-b2de-7912233cd40c","resolution":{"observed_at":"2026-05-16T23:57:02.700121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Identity mappings in deep residual networks","venue":null,"work_id":"e7545a21-c1cf-4bb0-ac17-c640b9621d5b","year":2016},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:e7ba2bf74dc2d5120f008da9013810a7c585cf206abe2a14592fdecf25215e7b","observation_id":"8eb01c14-f80d-4f4a-8494-ffe15e532c27","resolution":{"observed_at":"2026-05-16T23:57:02.736815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning con- tinuous control policies by stochastic value gradients","venue":null,"work_id":"fa25cc06-ab2a-4ca0-b44e-272e7b3bfce2","year":null},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:9ef7460b3b46d96d9211e8d01354db3dcaa9a1ec9aac772eab9cebd756010486","observation_id":"96aeb3e6-2412-4533-ba0d-d0dd688d9ec4","resolution":{"observed_at":"2026-05-16T23:57:02.740106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rainbow: Combining improvements in deep reinforcement learning","venue":null,"work_id":"7bee01cd-a431-4fff-b5ae-9af9842e1ebf","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:08ca2c6c4197cadce21ebc81d13364c7d1a167fc4e4e10e9e39645ba6192268e","observation_id":"d9167401-482e-428e-a86f-28c812c8693d","resolution":{"observed_at":"2026-05-16T23:57:02.743289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Distributed prioritized experience replay","venue":null,"work_id":"edd6c384-d42d-4b2c-a5ab-5898cd1a7638","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:1e4bf01e7e07497a6ad185ab957a5f76481758014177b6115866397b18bbbae5","observation_id":"a6f1298d-f5f0-432b-8251-7aaba8562357","resolution":{"observed_at":"2026-05-16T23:57:02.746293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.05397","last_updated":"2016-11-16T18:21:29Z","snapshot_observed_at":"2026-08-08T00:00:13.424932Z","submitted_at":"2016-11-16T18:21:29Z","title":"Reinforcement Learning with Unsupervised Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":"1611.05397","doi":null,"metadata_source":"pith","pith_arxiv_id":"1611.05397","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement Learning with Unsupervised Auxiliary Tasks","venue":"cs.LG","work_id":"8ac80d7b-b24c-4128-9798-b3a9b02ad56d","year":2016},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1611.05397","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:3b34ff6524587e41d18b9e40e25d4baa8f1907c802ad1f85160022e960202a80","observation_id":"c6802c97-daf4-4b12-9d7e-9a0ff4941d5d","resolution":{"observed_at":"2026-05-16T23:57:02.713011Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00374","last_updated":"2024-04-03T14:26:32Z","snapshot_observed_at":"2026-08-12T07:29:47.947863Z","submitted_at":"2019-03-01T15:40:19Z","title":"Model-Based Reinforcement Learning for Atari","version":5},"cited_work":{"arxiv_id":"1903.00374","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.00374","snapshot_observed_at":"2026-06-30T09:34:34.510750Z","title":"Model- based reinforcement learning for atari","venue":null,"work_id":"edc1a23e-c421-4569-ab9e-83b204eeb0fa","year":1903},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1903.00374","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:186d4386646619da1569a6cfb6fa3da6b7578f2b13bc70db4a55a0a17e09c5ef","observation_id":"e0fad99e-53ff-4f40-84a9-9bcdfe01dde8","resolution":{"observed_at":"2026-05-16T23:57:02.717722Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recurrent experience replay in distributed reinforcement learning","venue":null,"work_id":"0ac09b10-f69a-422f-a184-fd651a3e997c","year":2019},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:cf8f298a01db88195fe25f454c8c9a17ff080bcca35b4dd997d31ba2216cf3c0","observation_id":"17072e63-8556-44b8-af32-8ef51e2c9250","resolution":{"observed_at":"2026-05-16T23:57:02.749167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bandit based monte-carlo planning","venue":null,"work_id":"f09595d0-ed7e-4f0a-aa08-d04bab53a40c","year":2006},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:69147f068297c7e4256e995b71f976f82e318e2db21c1e2bc4a47c55a0a4eeea","observation_id":"3c1bcef0-c9ab-4991-a176-1a6aa3f58506","resolution":{"observed_at":"2026-05-16T23:57:02.752193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet classiﬁcation with deep convolutional neural networks","venue":null,"work_id":"c753f575-cd8e-4d6c-a151-5248e195cf00","year":2012},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:0f49368f49341ded26b62ef9d27d515d23cc7d7fc39bc6c2da86b564e89c877d","observation_id":"254031f8-f6bf-46ad-a21f-8db1998b22e5","resolution":{"observed_at":"2026-05-16T23:57:02.755470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning neural network policies with guided policy search under un- known dynamics","venue":null,"work_id":"ea30c665-4619-45e5-b08b-32203e454cf4","year":2014},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:5c8abb4a7f6f4e0d2f85341296c2b2cccf92a66d53be75ffc642874c9cf61870","observation_id":"37613040-69a5-4e44-9cf7-e9908b9597af","resolution":{"observed_at":"2026-05-16T23:57:02.758423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":"ec5bb2d3-8cbc-435d-9538-51e1ab16ca1e","year":2015},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:d5a4b98d7ea139225a9482d0ffff0ace86b3fad46340025b3e614c9cc0d675dd","observation_id":"bb6b7c9b-a100-40b7-9dbd-19cdde420b81","resolution":{"observed_at":"2026-05-16T23:57:02.762032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepstack: Expert-level artiﬁcial intelligence in heads-up no-limit poker","venue":null,"work_id":"48991218-b555-4a50-8756-03063ad75b07","year":2017},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:89274f76d05eca5c5058a5fb279625e32fad26fc01dc7508bc514d096e54ef9e","observation_id":"f0b29ec6-617d-490e-a37f-4bf07468b120","resolution":{"observed_at":"2026-05-16T23:57:02.765092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1507.04296","last_updated":"2015-07-16T09:27:06Z","snapshot_observed_at":"2026-07-06T04:23:57.382398Z","submitted_at":"2015-07-15T16:56:56Z","title":"Massively Parallel Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1507.04296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1507.04296","snapshot_observed_at":"2026-07-03T21:58:58.509567Z","title":"Massively Parallel Methods for Deep Reinforcement Learning","venue":"cs.LG","work_id":"f6212f1d-bf11-4c66-aa54-7e2059a84b4b","year":2015},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1507.04296","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:274e42ab88e2f4aa6db6bf8ec1337b67087c0d4c43f7ce8e4438de7eecbe2b99","observation_id":"8bf9cb1f-2c11-4458-81f8-48c7c7903ee3","resolution":{"observed_at":"2026-05-16T23:57:02.708622Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Value prediction network","venue":null,"work_id":"93788c9e-5ef5-4737-bb34-48b22e9be125","year":2017},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:ebf8dcca3c3235543a0bda8493ee8eef97e35f5dc9eae414a457ff97af69cbd5","observation_id":"3f86b047-0301-4fe5-b0e0-69c65159aa59","resolution":{"observed_at":"2026-05-16T23:57:02.767646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openai ﬁve","venue":null,"work_id":"49b72293-daab-4124-b7fd-3c784f5f45fb","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:11ef660e9e1b25c1bc2b0fbd4fdc48617566a1b7dbb82fa109f40370bb55c06d","observation_id":"bb8e60d7-3d76-4d96-b782-dddd162d705e","resolution":{"observed_at":"2026-05-16T23:57:02.770558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11593","last_updated":"2018-05-29T17:19:59Z","snapshot_observed_at":"2026-07-06T06:41:51.126097Z","submitted_at":"2018-05-29T17:19:59Z","title":"Observe and Look Further: Achieving Consistent Performance on Atari","version":1},"cited_work":{"arxiv_id":"1805.11593","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.11593","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Observe and Look Further: Achieving Consistent Performance on Atari","venue":"cs.LG","work_id":"ee69eca1-a740-4f43-9d71-4e4c505992c8","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1805.11593","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:f5a0d54fa65a8c40b52eca62ad10619eb8fd9e897414c21fc2586820c49d21f1","observation_id":"bc4c4361-9b85-4b13-83bb-c101922b820c","resolution":{"observed_at":"2026-05-16T23:57:02.685637Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Puterman","venue":null,"work_id":"a4aa3725-d484-4ac3-94f6-f672a5130577","year":1994},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:1d73af7ccee2448883368601815b6f2738d484c835abee6db4ae569c3a667afa","observation_id":"87ab1b69-46d2-44c8-98c0-cde3faa70176","resolution":{"observed_at":"2026-05-16T23:57:02.773269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-armed bandits with episode context","venue":null,"work_id":"6b47eb49-dde9-4812-a2fc-a6ed596ffab3","year":2011},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:b4ff6c1359b41fedeb849edb84a0b78021edeaaa82d0db4ac3891d0d999b06f0","observation_id":"386f2f18-4978-4100-86b1-90169a213fad","resolution":{"observed_at":"2026-05-16T23:57:02.776344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Single-player monte-carlo tree search","venue":null,"work_id":"688f4290-f929-4549-ac77-180a76ce3f13","year":2008},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:296ee65b2d2ae7a9ff3339a2cb79f5197c7075f8823bc1d8897b14543ee0223f","observation_id":"9779a4cf-d356-469d-be48-7cb230c2d7c4","resolution":{"observed_at":"2026-05-16T23:57:02.778927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A world championship caliber checkers program","venue":null,"work_id":"ad0688eb-097c-47d9-96d5-cccefb398061","year":1992},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:2d892ee078d3e072b5de9935ca0b742693962fffcb3daeb3336a844307f6e575","observation_id":"093952d3-7e07-4641-a151-c4b114d1909f","resolution":{"observed_at":"2026-05-16T23:57:02.781764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prioritized experience replay","venue":null,"work_id":"b0519e5a-e961-4d50-b7b9-d94c17007fe4","year":2016},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:3046610da7842df49fda82b22e440db35347bbf5b3b86fe38023861891f29aeb","observation_id":"8ed3d4ed-79f3-4d03-b5b6-ada6e2e727c5","resolution":{"observed_at":"2026-05-16T23:57:02.784350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11583","last_updated":"2019-11-18T12:51:59Z","snapshot_observed_at":"2026-08-12T05:32:49.871660Z","submitted_at":"2019-09-25T16:20:46Z","title":"Off-Policy Actor-Critic with Shared Experience Replay","version":2},"cited_work":{"arxiv_id":"1909.11583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.11583","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Off-policy actor-critic with shared experience replay","venue":null,"work_id":"5624587e-9b7f-463b-9b1e-4e8a3ffa1165","year":1909},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1909.11583","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:17570b4d1d55794a0bed88cdf134587df4bf536f779a6f65b3c5fa512a915e51","observation_id":"4a6996f9-e7bc-4557-b09f-92ebef272e44","resolution":{"observed_at":"2026-05-16T23:57:02.722726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Planning chemical syntheses with deep neural networks and symbolic ai","venue":null,"work_id":"077dfa39-e830-4026-a37d-52d1d60cdbc5","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:2ecf80014b96b26377e50819e44eebdeecc319f05c5eddab7a7c492be1c2c69a","observation_id":"3fd9c814-6b8e-4701-8fd4-ddc0d35ad7fc","resolution":{"observed_at":"2026-05-16T23:57:02.787323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"25d95bad-1fc1-41e5-9dd1-5af3a481b60d","year":2016},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:21b60082046a2a3fe250fa86071868ad92beac99b737bb2132fb1c5b816fb4e5","observation_id":"b9c6b31f-1f78-4346-86b2-c196ae142330","resolution":{"observed_at":"2026-05-16T23:57:02.789649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and go through self-play","venue":null,"work_id":"81d02f28-5b8e-4218-b627-d9279648c4fc","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:b6e30af4fe747596337aaf69a464676e3c90744f9fcd769c5f1d1fac86efe709","observation_id":"bfb86e4b-0720-4e25-b019-3193b76aba26","resolution":{"observed_at":"2026-05-16T23:57:02.792280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mastering the game of go without human knowledge","venue":null,"work_id":"cdfea063-21c6-4b6e-9139-26653bbadabd","year":2017},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:85876e162114777190b66ccd90792b6302fa7bab7aa4da0f044038bc714e38f9","observation_id":"6b468431-02d3-460c-860a-e5ecb0f13ac5","resolution":{"observed_at":"2026-05-16T23:57:02.795248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The predictron: End-to-end learning and planning","venue":null,"work_id":"5cf206d2-1148-42fb-a172-fa7a3e728421","year":2017},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:9e71086099c2a5131128fc72532fea5cb82257b5c503c2dae61f6cdf54bdee4b","observation_id":"ce920628-85e6-443e-890c-d8ce03e84daa","resolution":{"observed_at":"2026-05-16T23:57:02.797657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sutton and Andrew G","venue":null,"work_id":"1f7e1c73-a9b1-4032-b3cc-678d731e2160","year":2018},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:3f8cfb642f5013afbf38fce0f5fa65049093a75b4d3e8e9d023c4f881b81dec8","observation_id":"88b4b50d-25e0-41f4-af69-c6033217d329","resolution":{"observed_at":"2026-05-16T23:57:02.800372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Between mdps and semi-mdps: A framework for temporal abstraction in reinforcement learning","venue":null,"work_id":"64f2e379-4df3-4da2-aa4f-abac19cfd196","year":1999},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:d8558963cbec831e36838ac7907d229c201b612eec7453925e34e81c95d2b6b9","observation_id":"6aa88cb8-6df8-4dc5-8db5-7ad9ac7c6a84","resolution":{"observed_at":"2026-05-16T23:57:02.803079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Value iteration networks","venue":null,"work_id":"f6c673cf-0fe6-418d-ac7c-1e3ac0af8e04","year":2016},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:804b53423185a6f06beea704673f87fc2afe3f0129e7f650398414ad26b4b9c7","observation_id":"fdbfe59d-acea-4252-9dba-8c4faaebfc65","resolution":{"observed_at":"2026-05-16T23:57:02.805511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05243","last_updated":"2019-06-12T16:57:00Z","snapshot_observed_at":"2026-08-06T12:11:44.996719Z","submitted_at":"2019-06-12T16:57:00Z","title":"When to use parametric models in reinforcement learning?","version":1},"cited_work":{"arxiv_id":"1906.05243","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1906.05243","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When to use parametric models in reinforcement learning?","venue":null,"work_id":"669d7af6-45b8-47b7-af20-c676da4ffcd1","year":1906},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1906.05243","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:a4897eac9221fb109c23bffdca06389a1ff9b25b3a3253e9c003db3a8753b0d5","observation_id":"ba69073c-6c0c-4b2d-b316-1b3a46b49117","resolution":{"observed_at":"2026-05-16T23:57:02.691186Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grandmaster level in StarCraft II using multi-agent reinforcement learning","venue":null,"work_id":"8d042cb6-f4fd-467d-908e-095a1334cf0c","year":2019},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:db360bffdaf27abf80ef0cb943e4ec26da50c4e6176e3647abdfd9b86052cc94","observation_id":"a0e4ff10-e316-44b4-bf1f-53a703adff2b","resolution":{"observed_at":"2026-05-16T23:57:02.808671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Planning and scheduling","venue":null,"work_id":"8ade43ad-83a0-43b4-9c33-3892138fbd38","year":2013},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:136f91334d41b469cc0cd5d59251bf8b4ccc4d44741cc469f0f17f692338a8c6","observation_id":"6be1ff4f-c805-41c7-9ecc-88bb65c7ec96","resolution":{"observed_at":"2026-05-16T23:57:02.811663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.02251","last_updated":"2015-06-18T16:59:43Z","snapshot_observed_at":"2026-08-10T19:14:52.309412Z","submitted_at":"2015-02-08T13:57:59Z","title":"From Pixels to Torques: Policy Learning with Deep Dynamical Models","version":3},"cited_work":{"arxiv_id":"1502.02251","doi":null,"metadata_source":"pith","pith_arxiv_id":"1502.02251","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From Pixels to Torques: Policy Learning with Deep Dynamical Models","venue":"stat.ML","work_id":"295470ae-324f-4c98-bb1a-057990bb87d0","year":2015},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"cited_paper":"/paper/1502.02251","citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:74cbfb879ca2676f1b8881ec41651aa9b52541995a0de66a7f7cf3028343f6db","observation_id":"99b68e8a-8573-463b-ae42-3f0d3217ff85","resolution":{"observed_at":"2026-05-16T23:57:02.704498Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Embed to control: A locally linear latent dynamics model for control from raw images","venue":null,"work_id":"051816db-ee0d-44d9-abff-443361022692","year":2015},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:a816351db994c8ca4ef27faf34aecde3332f4b5ea24c01a92b7c79128946f288","observation_id":"db0ae163-1312-41d9-92ce-a0188abda6ed","resolution":{"observed_at":"2026-05-16T23:57:02.814933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AlphaZero had access to a perfect simulator of the true dynamics process","venue":null,"work_id":"8fd9247a-d587-4154-9152-eac9b6bdbe15","year":null},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:fef149789073d3e0bbfcc612682dc218388280648fb29e30a8993ca7f60c4c5f","observation_id":"034fcf6d-ef96-4f2e-9c17-1bcfa64e37ae","resolution":{"observed_at":"2026-05-16T23:57:02.819150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AlphaZero used the set of legal actions obtained from the simulator to mask the prior produced by the network everywhere in the search tree","venue":null,"work_id":"8a28235c-418e-4dfe-b4a3-fff4e92025e2","year":null},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:b8da135af08f329f4b3c4c5cab80d011d86a030523fe5f27280786a895310608","observation_id":"399d8136-256a-4f17-bb8a-3fdec9a99a03","resolution":{"observed_at":"2026-05-16T23:57:02.822130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AlphaZero stopped the search at tree nodes representing terminal states and used the ter- minal value provided by the simulator instead of the value produced by the network","venue":null,"work_id":"7bd851d5-e56c-466a-9bae-9bb786f72c46","year":null},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:e6864be4140a11a3223da1f205d4d5c8459efa1b6fb5bc0667fa5285e9f0d5e2","observation_id":"b9717457-22f7-4b3f-a202-8c568cb7e7be","resolution":{"observed_at":"2026-05-16T23:57:02.825072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In the experiments reported in this paper, we always unroll for K = 5 steps","venue":null,"work_id":"4883a9ff-5ed9-4c32-8501-18bb2e8c594e","year":null},"citing_paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T23:57:02.653534Z"},"links":{"citing_paper":"/paper/1911.08265"},"observation_digest":"sha256:3041df18a2d0f59d027e7c745fe6eccae6a48c5395dc1a09616b300b5d1ff0cf","observation_id":"50d9ab1e-4ae5-4369-89af-1eaed46cba74","resolution":{"observed_at":"2026-05-16T23:57:02.827329Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1911.08265","last_updated":"2020-02-21T18:05:30Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T08:38:07.984092Z","submitted_at":"2019-11-19T13:58:52Z","title":"Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":9,"verified_fuzzy":40},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 52 inbound Pith citation observations for arXiv:1911.08265."}