{"as_of":"2026-08-12T03:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:208d4920ef453968ddac7a0d6fa1dfc81567aff397548b411822a4a9717a723d","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:30:30.809999Z","state":"measured"},{"denominator":86,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":86,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T03:13:07.963343Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T03:14:31.657309Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"cited_work":{"arxiv_id":"2505.21731","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21731","snapshot_observed_at":"2026-07-08T03:14:31.657309Z","title":"Preprint","venue":"cs.LG","work_id":"380780b8-99da-4735-ada5-84aece5ca464","year":2025},"citing_paper":{"arxiv_id":"2506.15787","last_updated":"2026-05-11T09:25:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T18:10:30Z","title":"SLR: Automated Synthesis for Scalable Logical Reasoning","version":6},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T08:47:17.008113Z"},"links":{"cited_paper":"/paper/2505.21731","citing_paper":"/paper/2506.15787"},"observation_digest":"sha256:9cc97cfa78f8b71a9fadf71147322b3fead7cbbf3642495c73495660ab90c65d","observation_id":"5c9da058-ebd4-4926-989a-b3dc64a38a1e","resolution":{"observed_at":"2026-05-19T08:52:13.803998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"cited_work":{"arxiv_id":"2505.21731","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21731","snapshot_observed_at":"2026-07-08T03:14:31.657309Z","title":"Preprint","venue":"cs.LG","work_id":"380780b8-99da-4735-ada5-84aece5ca464","year":2025},"citing_paper":{"arxiv_id":"2510.18184","last_updated":"2026-05-11T08:31:20Z","snapshot_observed_at":"2026-08-11T05:17:32.682135Z","submitted_at":"2025-10-21T00:21:04Z","title":"ActivationReasoning: Logical Reasoning in Latent Activation Spaces","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T05:43:45.863209Z"},"links":{"cited_paper":"/paper/2505.21731","citing_paper":"/paper/2510.18184"},"observation_digest":"sha256:158c3aec54063bc260da963bd9abde6fe186cbf316cbf60f1a2d7da95a49d83b","observation_id":"f075b78c-d9a8-42c9-a05a-53de452c851b","resolution":{"observed_at":"2026-05-18T05:45:56.222552Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"cited_work":{"arxiv_id":"2505.21731","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21731","snapshot_observed_at":"2026-07-08T03:14:31.657309Z","title":"Preprint","venue":"cs.LG","work_id":"380780b8-99da-4735-ada5-84aece5ca464","year":2025},"citing_paper":{"arxiv_id":"2604.16871","last_updated":"2026-04-18T06:41:59Z","snapshot_observed_at":"2026-08-10T22:40:36.305811Z","submitted_at":"2026-04-18T06:41:59Z","title":"GRAIL: Autonomous Concept Grounding for Neuro-Symbolic Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T07:20:32.282630Z"},"links":{"cited_paper":"/paper/2505.21731","citing_paper":"/paper/2604.16871"},"observation_digest":"sha256:86f42622fd41c8a343a7050317295d6d65ebc20a06be53b3b7f8ebb964479aab","observation_id":"2155e889-86ac-4ca7-ab09-c222f376b1ea","resolution":{"observed_at":"2026-05-10T07:21:55.178067Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"cited_work":{"arxiv_id":"2505.21731","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21731","snapshot_observed_at":"2026-07-08T03:14:31.657309Z","title":"Preprint","venue":"cs.LG","work_id":"380780b8-99da-4735-ada5-84aece5ca464","year":2025},"citing_paper":{"arxiv_id":"2607.06522","last_updated":"2026-07-07T17:27:59Z","snapshot_observed_at":"2026-08-02T11:32:48.615721Z","submitted_at":"2026-07-07T17:27:59Z","title":"Bridging Physical Reasoning and Task Generalization via Visual Action Outcome Reasoning Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T03:13:07.963343Z"},"links":{"cited_paper":"/paper/2505.21731","citing_paper":"/paper/2607.06522"},"observation_digest":"sha256:7b14f74ee3f25bfb69b1e622e1e3d258cc598258aed0e15a0d9fbab9ca968e29","observation_id":"048c7cc3-3145-45d9-b093-68c9ca79fa90","resolution":{"observed_at":"2026-07-08T03:14:31.658780Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21731/citation-record","integrity":"/paper/2505.21731/integrity","json":"/paper/2505.21731/citation-record.json","paper":"/paper/2505.21731"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:22.452178Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:22.452178Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:78e91bdce534d931cf92cc42a9ab8e60bd68ac28aaa90568e7f14a842a3d1bdc","observation_id":"134c8065-0c24-4436-a59c-2deac18b0316","resolution":{"observed_at":"2026-08-07T13:30:22.452178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:22.556997Z","title":"S., Courville, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:22.556997Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:705aa69cb5dccccfbc31bfc1874eff7cf0a2f9b867313977246f257e264332a6","observation_id":"579804ee-f6ef-4f18-b9aa-e86cb09b64bb","resolution":{"observed_at":"2026-08-07T13:30:22.556997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:46.781981Z","title":"R., Smith, K","venue":null,"work_id":"0ce2dde0-2332-4630-ba7b-c8a27b0c60a4","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:22.674956Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:6ae8f7c91e4719c43d7d2609b00d533563171b8c5c8e59c82bf6ff477523cbe1","observation_id":"9240cbd6-8e12-459f-9fb3-d2e7dbcd135a","resolution":{"observed_at":"2026-08-07T13:30:46.919899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:46.595525Z","title":"The option-critic architecture","venue":null,"work_id":"fefac9f9-c0aa-476f-8f69-66bb7708b2a5","year":2017},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:22.737487Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:305109f017ccbd51c20e297effb3cb852fbef8397f17bec8681897658e01c0f7","observation_id":"120536c2-1522-4d03-bdf1-a65d55a067c8","resolution":{"observed_at":"2026-08-07T13:30:46.687208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:46.295088Z","title":"P., Piot, B., Kapturowski, S., Sprechmann, P., Vitvitskyi, A., Guo, Z","venue":null,"work_id":"719e9a75-5892-4b9a-80ae-48c5bd3b8582","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:22.820055Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:95213196c0fb09a74141eb6ce1232936da37432614fc26f199949beebebe39ad","observation_id":"74c003d1-e5d9-44f1-9a6a-9f5a283bd392","resolution":{"observed_at":"2026-08-07T13:30:46.435022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:46.055321Z","title":"P., Sprechmann, P., Vitvitskyi, A., Guo, Z","venue":null,"work_id":"c0be8d85-1407-4b32-9678-179b9deb6e4e","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:22.893975Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:6fa3716ade9043fa4e87101ef4d49be2ca481e8afcca950f6cda7cad7b383813","observation_id":"1f3b2b39-9776-401d-9db0-14d438427cd6","resolution":{"observed_at":"2026-08-07T13:30:46.153627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:45.889659Z","title":"L., Saxe, R., and Tenenbaum, J","venue":null,"work_id":"f6cd1883-a15f-4ad9-8007-94657f7cf2e2","year":2009},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.026307Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:0f97ecf925b13e30308158a68596bc1104859192fa00bc25a86c6d2138511b5a","observation_id":"3e94862e-7013-40fa-af7f-cde9bfa1abab","resolution":{"observed_at":"2026-08-07T13:30:45.954955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:45.643913Z","title":"H., Wang, R., and Manchester, I","venue":null,"work_id":"e3843292-058f-4bfd-a377-56f5f01f965e","year":2024},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.121760Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:093bfda0efa69b011b11f8870d612e014f1d5a2521e33642bf63d1c05dfa8f4b","observation_id":"676bf4e1-ca45-4d46-9246-d7fcfec8388d","resolution":{"observed_at":"2026-08-07T13:30:45.757560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:45.461136Z","title":"Verifiable reinforcement learning via policy extraction","venue":null,"work_id":"749412a8-0f4e-4d44-8ff9-70eb0c17eb90","year":2018},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.225533Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:029e0895462ddec25d9167377cdfdf1546e62706061bafb8b331ffbffa78829b","observation_id":"93433e11-e145-468c-88f0-837ad138f22c","resolution":{"observed_at":"2026-08-07T13:30:45.550446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:45.313899Z","title":"W., Hamrick, J","venue":null,"work_id":"a54f03a3-30e0-4e71-ad12-2dfd28245251","year":2013},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.305350Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:e18c7902d26d29daeb9bd0ade0c2a9eaeffb3b43bb5fb031c70b7889f81763f7","observation_id":"06f56c74-38ea-435e-87ac-e127784cdfcc","resolution":{"observed_at":"2026-08-07T13:30:45.383378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:23.367460Z","title":"G., Naddaf, Y., Veness, J., and Bowling, M","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.367460Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:06fc3fa95ac689787b7dc4627a1c1e15ed18272c6a56f3fab5e4fd31f3689977","observation_id":"6e85f31b-bc9e-4260-949f-471045e0b002","resolution":{"observed_at":"2026-08-07T13:30:23.367460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:45.115180Z","title":"G., Dabney, W., and Munos, R","venue":null,"work_id":"1879dd1e-70f4-427a-a425-72d802afb0e0","year":2017},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.454742Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:08976969cd4b785ad203f004f29218edfb7483b24e11c14486ae0963e2e5b90c","observation_id":"b3246711-7ea7-4c6b-895d-d87bc759b5b8","resolution":{"observed_at":"2026-08-07T13:30:45.228526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:44.985372Z","title":"Multi-objective causal bayesian optimization","venue":null,"work_id":"34765a8a-3263-4d96-9eb2-9bd51e685916","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.584889Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:a8abf85c9822e3c84f4248cb477fec4ea90ae930141cc02c261b36f3b0f3ecec","observation_id":"e238dab9-de2e-4ac4-ad4d-371827d9f625","resolution":{"observed_at":"2026-08-07T13:30:45.014623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:44.813278Z","title":"Deep reinforcement learning via object-centric attention","venue":null,"work_id":"97143a02-6827-4fbb-b6e3-3b6d893a13ae","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.672931Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:904a8dc521822b1325a662dab2d2c2e383e7578626d913bb1ad5677a820bccfd","observation_id":"794a1c90-393d-4399-9eb5-66c28a46ef36","resolution":{"observed_at":"2026-08-07T13:30:44.883287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:44.612425Z","title":null,"venue":null,"work_id":"bc62a6db-cf66-491e-9473-a65b351ed4d0","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.745902Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:4613f1d66243fefb49709e014f40d6a02319b2ae88c9536d380769115d2c6f35","observation_id":"5d18e6fa-2960-40d7-aecc-abc79588d168","resolution":{"observed_at":"2026-08-07T13:30:44.722421Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:44.423053Z","title":"Galois: boosting deep reinforcement learning via generalizable logic synthesis","venue":null,"work_id":"b501af99-5c5c-466e-b731-339cb204b990","year":2022},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.806792Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:1136eff9d3694a061a03e73199f21a7688a5239a7b5e3885b63aad1da32b9a8c","observation_id":"8ff71175-8dfa-4725-bdc8-ad8f8a12984e","resolution":{"observed_at":"2026-08-07T13:30:44.505967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:44.251721Z","title":null,"venue":null,"work_id":"d471af39-2dea-45e1-a89f-97de1f148de9","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.874994Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:52ffdba680adf6d74d290e103241e80734783b0d723b21192e65e624b32abc25","observation_id":"e3853768-dce4-4b87-b112-96e7cb60e8ae","resolution":{"observed_at":"2026-08-07T13:30:44.345921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:44.080994Z","title":"Quantifying generalization in reinforcement learning","venue":null,"work_id":"13439ed5-44b9-47b4-b30f-b506966213ae","year":2019},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:23.981980Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:202741df376cbf124116892e6165a18d54e441ef0dc219a45a35e2d10c5504e0","observation_id":"2789924c-4570-4ff5-8eb3-f36a3fc34d0a","resolution":{"observed_at":"2026-08-07T13:30:44.164387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:43.893522Z","title":"Leveraging procedural generation to benchmark reinforcement learning","venue":null,"work_id":"03fbfe01-2122-4dbe-9ed6-d48858bc4d64","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.057439Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:2c0679bc80c21cba9b213bcbdd862670efea93c63c71bf93c68c1a5bef7ec779","observation_id":"d32eb536-fd92-4c5c-8127-380f4323e35f","resolution":{"observed_at":"2026-08-07T13:30:43.981249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:43.649470Z","title":"and Lake, B","venue":null,"work_id":"0a26f3f4-706f-44f2-aad0-f73816fd5677","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.117765Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:be3050c1c50b7817f236ffa640db8f53cc9be4f524b6f68e15393cb9cf86b03a","observation_id":"1875bd8c-6f3a-4eec-827f-aceaac255c8f","resolution":{"observed_at":"2026-08-07T13:30:43.774743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:43.378483Z","title":"D., Gershman, S","venue":null,"work_id":"3f770c8b-11e1-4b1b-976b-64889212b748","year":2011},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.181658Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:48daf12ead3f16b4d9c7cc43adefd3e78b3737849249d9ff722a0afd800c4e10","observation_id":"2d2d5b48-bc6a-4b93-8c68-f22df1a3d950","resolution":{"observed_at":"2026-08-07T13:30:43.483560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:43.124150Z","title":"S., and Kersting, K","venue":null,"work_id":"0d193681-e02d-414e-86ee-5ad48027efa5","year":2023},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.237690Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:c074c69000ca19eb741f973f2ef6d85e4d1546e6ee81d41bff3792478731f1cc","observation_id":"7e1e23fd-16b9-49fe-9537-00a9ab938a20","resolution":{"observed_at":"2026-08-07T13:30:43.259217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:42.896526Z","title":"Boosting object representation learning via motion and object continuity","venue":null,"work_id":"197d62aa-d7fe-4d6e-9a2b-34b172bee615","year":2023},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.294299Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:07b0e7e143a44f2e0e17703a0f5770fcefa708dae84b2a0cf1f1d54f4b10beb4","observation_id":"192e05ac-606d-4493-90f7-fd5428b00371","resolution":{"observed_at":"2026-08-07T13:30:43.011284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:42.688162Z","title":"OCAtari : O bject-centric Atari 2600 reinforcement learning environments","venue":null,"work_id":"8e642b3f-678d-4868-8f14-5234b8db13b5","year":2024},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.378097Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:3e98ddedd1db7c25cbc67465e2b487c8cf838d556e09ecb4f8324db448d31118","observation_id":"ee4bc06d-c081-4e95-8911-71830373944b","resolution":{"observed_at":"2026-08-07T13:30:42.782945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:42.462097Z","title":"Interpretable concept bottlenecks to align reinforcement learning agents","venue":null,"work_id":"acf0ff67-c093-407f-8637-282d53749add","year":2024},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.604945Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:ad98fc3161c6cad03dc6d836ef000b873b11a4894640e144b8ec8fd67034cdea","observation_id":"272d3c3e-472b-44ce-af8b-119f3d5d9b35","resolution":{"observed_at":"2026-08-07T13:30:42.579471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:42.201701Z","title":null,"venue":null,"work_id":"403a3448-7ff9-466c-930c-d6385380fb03","year":1989},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.734745Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:7eb826d65ff09e1a4451b71bc5ad299ce54bc3f956eca95df3406909d752b6a0","observation_id":"538e8492-d9ea-45d7-95de-6fb302af25e2","resolution":{"observed_at":"2026-08-07T13:30:42.334222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:42.004047Z","title":"L., Koch, J., Sharkey, L","venue":null,"work_id":"30d8445c-2363-4102-bc14-da9931bb124b","year":2022},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.797068Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:adee98f8b38176ed56528dffb568729eeb9599f78acad1064bc37472729816c7","observation_id":"5dcd3f36-6599-4907-8580-4ad6d661b94e","resolution":{"observed_at":"2026-08-07T13:30:42.088428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:41.728290Z","title":"P., and Kersting, K","venue":null,"work_id":"df566125-d37c-4915-b0eb-dd6e6dea2927","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.864805Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:e95b8bce001166edf772b30a407973503706632c890e271c071cc2c6a74dfcc5","observation_id":"a5b9b7e6-bde0-4aa0-bb9b-febde3c9e8b9","resolution":{"observed_at":"2026-08-07T13:30:41.859081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:41.505750Z","title":"and Rothkopf, C","venue":null,"work_id":"6dccbe0c-3f8f-4ebe-aac2-8bb82068d229","year":2011},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.984867Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:d9dcf86818c2748935f16ef46deb9c9d9dbedac5756514d1a450ff6500881767","observation_id":"1913a38d-58be-46bb-a9ac-f74471f60e8b","resolution":{"observed_at":"2026-08-07T13:30:41.623553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:41.254149Z","title":null,"venue":null,"work_id":"659f00de-a7e2-4876-9df1-26f44a95b602","year":2008},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:25.094899Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:749e70e709e259e3c44bc8d282e6bcedeb2044c5e1bf6a7b1723e628efbb2f1d","observation_id":"72705a8d-f14d-4c78-8a7f-40cc153c6b8d","resolution":{"observed_at":"2026-08-07T13:30:41.364656Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:41.009252Z","title":"IMPALA: scalable distributed deep-rl with importance weighted actor-learner architectures","venue":null,"work_id":"47320858-5296-4b3c-a04b-1f207b639181","year":2018},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:25.305027Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:b6393cde7acf919e131fc74f6cacef1f92ae40a74dddfddfa9d983c6dcf5c18d","observation_id":"a1873249-222c-4f9c-b53c-03303b19f054","resolution":{"observed_at":"2026-08-07T13:30:41.125147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:40.767409Z","title":"C., and Bowling, M","venue":null,"work_id":"bd13c2d3-e7e2-42f7-ad69-ff1fc3e3b52e","year":2018},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:25.475266Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:ba8600b9727db1bb8c5451ae526f43cfbc2b45cf472c5caee9ad84fb15198835","observation_id":"d9b21243-9d79-402b-9e35-bea9e6f6dfb7","resolution":{"observed_at":"2026-08-07T13:30:40.860028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:40.592432Z","title":null,"venue":null,"work_id":"ab6f362b-55a0-4b63-8c30-2cfd1754f034","year":1988},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:25.675365Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:d8404c11f093b7996ac9beae32e581a0807e4116391dc6fe69bd85e338c9369c","observation_id":"56c903a7-f8ff-4d4a-881a-61bf55a5e9df","resolution":{"observed_at":"2026-08-07T13:30:40.665376Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:40.353873Z","title":"S., Brendel, W., Bethge, M., and Wichmann, F","venue":null,"work_id":"8a57d7d5-43ce-4b5b-b7b2-4612b26808c1","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:25.814825Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:4f905325ac4ee9c3f1773a798cdd4798e25498d8b3325ab4520bed895608d007","observation_id":"6dae4b7e-fa38-46c8-81f0-6a578433c42e","resolution":{"observed_at":"2026-08-07T13:30:40.441644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:40.144046Z","title":"Atari agents, 2022","venue":null,"work_id":"2c031a73-6428-472a-8fc9-1c900901e596","year":2022},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:25.934736Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:7a5ae013fa2a07c9a5ece02bc8992b5d73e637573084a3b59a5cc5971429eb90","observation_id":"3faca16e-e516-4a4a-948d-fd86a99f5976","resolution":{"observed_at":"2026-08-07T13:30:40.241239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:39.971368Z","title":"Visualizing and understanding atari agents, 2018","venue":null,"work_id":"458d267a-7913-44f2-aca7-e6bf079e008c","year":2018},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:26.012180Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:e2cfd58b4bccbfc1d0150821269069e00af8df2e3b1df1cc6fbdff6df2bc3f02","observation_id":"fb6793f3-a24a-450f-9b6e-40fa850c6464","resolution":{"observed_at":"2026-08-07T13:30:40.033921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:39.781751Z","title":"E., Pechenizkiy, M., and Mocanu, D","venue":null,"work_id":"1ba50548-a8f9-48c7-8f74-4126fda5e8ff","year":2023},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:26.125076Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:3df73b808cc02d97b8b15674a3e67c22e499859010070250d3db3ff216a984ea","observation_id":"125c1fff-cf81-47e1-b668-68c8000dccd9","resolution":{"observed_at":"2026-08-07T13:30:39.842610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:39.640762Z","title":"H., Codel, C., Hofmann, K., Houghton, B., Kuno, N., Milani, S., Mohanty, S., Liebana, D","venue":null,"work_id":"5b66091d-fc0b-4457-a20d-2a83ac0dda4e","year":2019},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:26.256710Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:3f210a73eb35f26a411e426ce8c759527091d5da2b4dbfc7e9464c97d05f2f17","observation_id":"73d9257c-f359-48fd-8b32-23d3db41e002","resolution":{"observed_at":"2026-08-07T13:30:39.699258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:26.384892Z","title":"Benchmarking the spectrum of agent capabilities","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:26.384892Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:aa2e618eb010658e77cb825faecd1853509a95c003ee7222eb04ce10531d75e6","observation_id":"9a7df026-9a1b-4b49-a424-f7216e3cff77","resolution":{"observed_at":"2026-08-07T13:30:26.384892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:39.503773Z","title":"P., Ba, J., and Norouzi, M","venue":null,"work_id":"af27df26-e73c-4b9f-9b7e-df40ad60060f","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:26.458693Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:def6967474030bb23028bf0e6f33acdfab9dde43cf2674ffd6b06d6dc58a1328","observation_id":"b3c179ad-7de0-4550-8f6e-d5f6a1068edb","resolution":{"observed_at":"2026-08-07T13:30:39.571980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:39.308393Z","title":"T., Wang, Z., Heess, N., and Riedmiller, M","venue":null,"work_id":"0588a592-274b-494c-8031-dc5ecef3c117","year":2018},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:26.572422Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:483483383ddc4d41a14451d3d041bdae161b4105ad6a436f35f872e475bac6cd","observation_id":"3721e626-eb9e-4732-9136-39e1c5ee2159","resolution":{"observed_at":"2026-08-07T13:30:39.420596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:39.140301Z","title":"S., and Kersting, K","venue":null,"work_id":"a93aa809-d04e-4630-bb25-bc5fadd74d59","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:26.897578Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:7440b7214c554a1b7fcd116ba109d13f5b7e5972f9b421f9454d30b635c7f4ad","observation_id":"43a621b7-75ef-42e1-8da8-92d65c9bd741","resolution":{"observed_at":"2026-08-07T13:30:39.230738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:38.966244Z","title":"Rainbow: Combining improvements in deep reinforcement learning","venue":null,"work_id":"d0276f70-4fd7-4f63-9eaa-40b76299c8ec","year":2018},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:26.997295Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:fa778d2bf608c01f25ea6c26b408092bd7c401c3080adb3c5f3a3edf2b1bf8e6","observation_id":"2b74f479-a4cf-4d98-9bf0-f2d7c1359a53","resolution":{"observed_at":"2026-08-07T13:30:39.073626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:38.758890Z","title":null,"venue":null,"work_id":"c4cd97ec-951d-47b0-ad08-341546a91c1c","year":2022},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:27.126459Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:72efa372c8557f3cf0ea1822049fd026b96869eab94c7db98b72fa61613b5470","observation_id":"fb38c080-68fd-458f-a903-44f960647f4e","resolution":{"observed_at":"2026-08-07T13:30:38.820110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:38.481819Z","title":"Adversarial examples are not bugs, they are features","venue":null,"work_id":"64b07463-2fc3-42b6-ae33-d55218315812","year":2019},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:27.264745Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:d6d0a2b7bdc44eeeb63534d007fbd915507dca3e89f0a818d9c8e7033ee6c456","observation_id":"ace4704a-3670-496e-a8fc-0b06c0e4dfc1","resolution":{"observed_at":"2026-08-07T13:30:38.594220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:38.297590Z","title":"and Luo, S","venue":null,"work_id":"0a735004-f61d-4aa2-a288-c92f646b3145","year":2019},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:27.445351Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:9df4905ed6c473befdbd0c6d2f18e009f1c756da3fa5165b36e8026d7a93578d","observation_id":"d3edb5b0-824d-4d0d-9ff6-85cb10855569","resolution":{"observed_at":"2026-08-07T13:30:38.383136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:38.042366Z","title":"u ml, J., W \\","venue":null,"work_id":"ea10dbe7-cb50-4e6f-98d7-679177cfcb9c","year":2024},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:27.574379Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:fbc48182f559faadc07238e222854a1a5e55034b4386eb8d34a6c56f9bd9431d","observation_id":"c78e215e-f521-4030-a423-853442247cc7","resolution":{"observed_at":"2026-08-07T13:30:38.193348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:37.839775Z","title":null,"venue":null,"work_id":"2670c8e8-d82e-454f-9f78-74bca5121514","year":2024},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:27.676237Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:5cec77f631ce1eb39bf396bbff359703b965ee5c23e84501fcfe4176b99647fb","observation_id":"5fa309cf-6886-46a4-9340-698ea206b8d3","resolution":{"observed_at":"2026-08-07T13:30:37.958212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:37.669017Z","title":"Objective robustness in deep reinforcement learning","venue":null,"work_id":"82c7dded-e254-496b-a866-faae034c1531","year":2021},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:27.864819Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:a54bda191431afead11a8465cc1a70945c286c1a83b9e86e7172c6a207db8c66","observation_id":"34622877-14ce-42c2-bf3b-178fba0114c7","resolution":{"observed_at":"2026-08-07T13:30:37.735890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:37.437900Z","title":"Interpretable and editable programmatic tree policies for reinforcement learning","venue":null,"work_id":"a797f8ff-10f2-4cd0-9b8d-fff898b7f093","year":2024},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:27.954897Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:b0f33239a754d32897c52417cf9ff3756a6488aef2ae06a7e6eed5abc508c1fa","observation_id":"771a805f-c648-46b6-b2de-da1f8133fceb","resolution":{"observed_at":"2026-08-07T13:30:37.509789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:37.201278Z","title":"R., Holyoak, K","venue":null,"work_id":"897a9087-5ffb-4ec4-86dd-01db94ec0763","year":2017},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.045609Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:af5cfec1e62f5afe040c8b0879a5eb4baddd48d6613362828c45b8e01153ffdf","observation_id":"652f6741-6d1d-4d1e-908e-582af4b86c39","resolution":{"observed_at":"2026-08-07T13:30:37.340172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:36.952469Z","title":"M., Ullman, T","venue":null,"work_id":"792a7bef-e89f-455c-982a-38cc6b0f9593","year":2017},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.234741Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:9cc581b302a7dbc5cfb5ba62e96d700ffdc83ee20b8563d460a12764dd3da9cf","observation_id":"ac3a0fcf-ceda-46c7-a5a6-bda62020c866","resolution":{"observed_at":"2026-08-07T13:30:37.056247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:36.739135Z","title":"Sub-policy adaptation for hierarchical reinforcement learning","venue":null,"work_id":"32882aeb-de62-4535-a88f-a5220f2bf5b1","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.504315Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:68d3e37455a9feb282af24f61aa843663a37ae47f1278b16e4643be80de30a68","observation_id":"42422dfc-9f94-4c5c-b909-9aee2fe4f6ee","resolution":{"observed_at":"2026-08-07T13:30:36.831752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:36.575239Z","title":"V., Sun, W., Singh, G., Deng, F., Jiang, J., and Ahn, S","venue":null,"work_id":"100bf64d-4547-4e45-a2ba-32a7c199f288","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.556179Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:52f5e9d4342902e5ee4d1432ea439f5833b646618782f60f93927dd06e62bbd6","observation_id":"598fa7ff-51f2-45ac-a73d-90793e8269d8","resolution":{"observed_at":"2026-08-07T13:30:36.669772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:36.380931Z","title":"Hierarchical programmatic reinforcement learning via learning to compose programs","venue":null,"work_id":"23440670-6df3-4bee-ae38-dc884f257c13","year":2023},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.633760Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:f530cec569c9afc036861a2b120c8ae1a1236a9615a677b8e0b0002cdd198ef9","observation_id":"ceb82f8c-577a-4884-9a0a-99e86ccf5c7e","resolution":{"observed_at":"2026-08-07T13:30:36.480713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:36.141412Z","title":"Insight: End-to-end neuro-symbolic visual reinforcement learning with language explanations","venue":null,"work_id":"fac8d9ce-21ad-4fee-bd70-10a45f7f9611","year":2024},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.691611Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:487a239e363bfb7160306c34015c2889b6d6d50164083339bf63c7eeb2eb65af","observation_id":"50aa84f4-1e8c-4128-8a12-7f0b80986f43","resolution":{"observed_at":"2026-08-07T13:30:36.280885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:35.971047Z","title":"C., Bellemare, M","venue":null,"work_id":"e73c0305-8edb-4386-9a6b-79a926e1c380","year":2018},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.735806Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:06751188f87bb2c94a6c34f0a1f403189a584c430171d1dd4ba4ac2fba22d6d4","observation_id":"386998f7-4044-41c3-bbe8-9e66f93a7bf9","resolution":{"observed_at":"2026-08-07T13:30:36.044746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:35.780330Z","title":"Sympol: Symbolic tree-based on-policy reinforcement learning","venue":null,"work_id":"562cc43a-50e8-4649-a934-282db3926641","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.802987Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:16477b60e15e7aecc50798c60b74daae1c3517d67426b3f2559e6c69d37a67fb","observation_id":"e4e9ae23-f78e-4359-b390-7e22ea1572c6","resolution":{"observed_at":"2026-08-07T13:30:35.888727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:35.680499Z","title":"The perception of causality","venue":null,"work_id":"91faa9ed-6714-4ca6-9e80-842e99714ba8","year":1963},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.843655Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:041c111a4f3f519064c430d688efdd85fe1817809badec39cdcc8e8dfd711426","observation_id":"7d34ea38-5ea1-44ef-8262-bd700c754bdb","resolution":{"observed_at":"2026-08-07T13:30:35.718227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:35.472719Z","title":"H., Mohanty, S","venue":null,"work_id":"e6451426-2333-4cb4-94e2-e8ceeb0f87a1","year":2019},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.908966Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:1f6507049388c5f732a343ff6a64a982bc0e0219d6e9554dd376edddffed2b23","observation_id":"77127910-8ab2-488c-8786-10902b1bfd82","resolution":{"observed_at":"2026-08-07T13:30:35.582517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:35.240062Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":"6cbe0953-3bd6-41b4-a535-46b27c992fcb","year":2015},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:28.937695Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:0bcd78e92914e001f11324351fb3889a0caf8e7947063ca93e920212704e3ca2","observation_id":"2c7a38ea-21a3-4d72-926f-d05e7791c194","resolution":{"observed_at":"2026-08-07T13:30:35.329174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:35.085428Z","title":"Robust reinforcement learning: A review of foundations and recent advances","venue":null,"work_id":"9daaabea-9761-491b-94b1-61237531daf8","year":2022},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.064298Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:c6f773cf7c29cc03de24b61bb29790b2cefa55d885005ae12c0b188a041c2673","observation_id":"018f80ff-5a84-45c3-96e3-90b647baadb7","resolution":{"observed_at":"2026-08-07T13:30:35.141234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:34.878059Z","title":null,"venue":null,"work_id":"ceeade83-62c2-4e0b-bfde-79832f99b5b4","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.173116Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:fb70a8920d2aba2409d41e5c328b7288cacd405bb42e4ca3c47abc3b0aeb1527","observation_id":"ec94d5bb-fd7d-4491-8498-c7a512511dda","resolution":{"observed_at":"2026-08-07T13:30:34.956408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:34.640646Z","title":"Robust adversarial reinforcement learning","venue":null,"work_id":"ea1db18b-7409-4352-a0e5-35c7df89d6a9","year":2017},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.286940Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:2a880c590a5bbd1b5c5af055a43ef902afd5210335e353e121e0d65a78c3cf20","observation_id":"158dd0aa-e211-4d10-a186-61d7b3457e33","resolution":{"observed_at":"2026-08-07T13:30:34.763140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:34.448849Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":"b0226319-9d2e-48d0-9972-d41411298aba","year":2017},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.350658Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:5c5665fb7eca2249544bcca4f5012e92aacebb1597c20ad799eff5cdbc85f469","observation_id":"2d042f70-164f-4593-b547-6cd503594f5b","resolution":{"observed_at":"2026-08-07T13:30:34.536879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:34.289243Z","title":null,"venue":null,"work_id":"5bbec59e-021a-4e19-9602-a8095c78dbd4","year":1997},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.457219Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:0e25578e5d07d5fa083e13b7a133437b6bfc33a7e55702120ac4133a7d1a99d0","observation_id":"f62cab48-44ef-4e73-8924-5be07c177370","resolution":{"observed_at":"2026-08-07T13:30:34.369761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:34.028120Z","title":"Reinforcement learning in strategy-based and atari games: A review of google deepminds innovations","venue":null,"work_id":"046723f4-3594-4419-990c-a4377c0c6b10","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.569395Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:03765b7826361bff13c62ddc90358b4784b52893b1429948e2dabf5e91293dbd","observation_id":"b6a6d657-8ed5-46e8-8baa-6591eb1263a1","resolution":{"observed_at":"2026-08-07T13:30:34.128710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.849789Z","title":"S., and Kersting, K","venue":null,"work_id":"26755664-8e0e-4abf-8d20-0122bb766127","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.630331Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:23f5b2f3b20850792ff3a929ea933d20f4df2f3b0916729ffa95d7a21dafe9db","observation_id":"bc146152-e5cc-4cf7-8cc7-2a845f72e286","resolution":{"observed_at":"2026-08-07T13:30:33.938188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.698389Z","title":null,"venue":null,"work_id":"247f2c90-c24a-4f7d-b719-2a32ef64b7cb","year":2021},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.709457Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:7d211a6bce85baf0645ed6479ac2ca29089ca72c6721599f804b413dc0e1d061","observation_id":"2af951df-e7fb-45db-8a30-46dff3455326","resolution":{"observed_at":"2026-08-07T13:30:33.797320Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.528128Z","title":"Right for the right concept: Revising neuro-symbolic concepts by interacting with their explanations","venue":null,"work_id":"ca3d3ace-b760-4606-b549-68f3e10e08eb","year":2021},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.785574Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:7e9c560a9f555275b5fa2ffdaeabdf221b0129da08d1c7d81792f2d969c43163","observation_id":"2782b6a3-9823-4960-8ea0-16a72533fb0c","resolution":{"observed_at":"2026-08-07T13:30:33.618260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.303183Z","title":null,"venue":null,"work_id":"7dfb7868-50e0-48a9-a0ac-f2782438d2d2","year":2023},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.900069Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:7744fc8a1f510a12797a060850b4bac59adf1a5f7ac3a36101037490e62d6704","observation_id":"19b5f7dd-0862-41ac-822c-551180500649","resolution":{"observed_at":"2026-08-07T13:30:33.411410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.101417Z","title":"Scaling up robust mdps using function approximation","venue":null,"work_id":"73f64bab-656e-4afe-811a-5e590b165fa7","year":2014},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:29.943136Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:ee51193913ebd71f0079defd6e85b2d59ca463db2948df250a0878d97ba81dae","observation_id":"c10350ad-2fc0-4750-8a28-538e0e119e4c","resolution":{"observed_at":"2026-08-07T13:30:33.215847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.878953Z","title":null,"venue":null,"work_id":"797a6910-38b4-4cca-98d3-4cd785f7bbc7","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.039935Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:d9752f3cbe0dde1175c88a66a505641762a5ccb3726da4fc66bf44f7e9d51cd9","observation_id":"708b08cd-e187-4ad1-a846-7433ecc88d27","resolution":{"observed_at":"2026-08-07T13:30:32.968146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.640974Z","title":"B., Kemp, C., Griffiths, T","venue":null,"work_id":"88266a5c-7f51-4e30-86db-e277a0941485","year":2011},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.172366Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:4b70ba8e60678ae9ec0c679bdc78f8ae88c4b61d1fe9f1d070de55a038b9a189","observation_id":"c367caee-a864-4c4e-97a4-095f854d039f","resolution":{"observed_at":"2026-08-07T13:30:32.742695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.404451Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":"2875efdf-8ee7-4be6-8879-15b71e28ba51","year":2017},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.251354Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:8f2ffd5862599cda56be996a7cc62d8f13cea43ed5e49f8da3a634b4a91e5fc0","observation_id":"9653dbf1-59c0-470e-aa83-7587194e3c4e","resolution":{"observed_at":"2026-08-07T13:30:32.543806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.225834Z","title":"Munchausen reinforcement learning","venue":null,"work_id":"aedc98b1-5e99-4a22-85d0-00da9438a267","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.293466Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:e5e3168f0bd0bb2b90c496197cace6dd58878d3bd01fe488108ac43a6d35b683","observation_id":"c63006ba-c43e-43cf-a3ae-9d99a38d283d","resolution":{"observed_at":"2026-08-07T13:30:32.305476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.006965Z","title":"Iterated q -network: Beyond one-step bellman updates in deep reinforcement learning","venue":null,"work_id":"a8e724c7-4fb1-4c5b-8ee9-790b140bac27","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.390115Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:64e1a793d59d38147a8eaadd3371d0f46a3567b146548d3043cb4141dd46b256","observation_id":"b8709bae-7a9d-4bd2-8a38-4d87fa0cd5ae","resolution":{"observed_at":"2026-08-07T13:30:32.116826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.716108Z","title":"S., Rothkopf, C","venue":null,"work_id":"3cdddbb2-a251-4310-ab80-d0a4a1997c29","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.468977Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:a1d537b379090c2c9c9eaf3bfa3f5181b17384a44e402f2f59edd0846a8d6734","observation_id":"d59baca6-7d38-4c74-9488-745f91582963","resolution":{"observed_at":"2026-08-07T13:30:31.868781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.479878Z","title":"Towards generalizable reinforcement learning via causality-guided self-adaptive representations","venue":null,"work_id":"cbba4349-6239-417a-8576-df0ad7eedabd","year":2025},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.538591Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:708c9aa9f83db6fc852bbfee498d0f34df7904439e53d401fb7d6e0a95d89010","observation_id":"b1696a84-ee83-4107-b976-6c316e03bc37","resolution":{"observed_at":"2026-08-07T13:30:31.586099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.285383Z","title":"F., Raposo, D., Santoro, A., Bapst, V., Li, Y., Babuschkin, I., Tuyls, K., Reichert, D","venue":null,"work_id":"8113ce6f-3741-470e-85a5-e9659df666a2","year":2018},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.653772Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:1383450fe8111456731fea4681e27d72ced5c9aafd9601f371feb1faf30dece8","observation_id":"fe302e13-807a-468f-8082-8bba517d5958","resolution":{"observed_at":"2026-08-07T13:30:31.382070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.153706Z","title":"Natural environment benchmarks for reinforcement learning","venue":null,"work_id":"b43af2ed-f7be-42e5-aaac-b71fd1980bd9","year":2018},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.724744Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:5254aea380f13d2aea17c5ce1320df17df3f548a196dcdb8c43edb4175918f2e","observation_id":"73f0200f-3136-4fa3-8639-6d9f4bf4ded3","resolution":{"observed_at":"2026-08-07T13:30:31.221306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.943360Z","title":"N., et al","venue":null,"work_id":"f4546b8e-755c-472c-b390-9669e8e0471e","year":2020},"citing_paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:30.809999Z"},"links":{"citing_paper":"/paper/2505.21731"},"observation_digest":"sha256:debc3aeccb1c35915ee07ec365b17c6aebb541d44d33205e189979db660e456c","observation_id":"2129f278-c5a9-4432-95c8-9ab95c88d773","resolution":{"observed_at":"2026-08-07T13:30:31.003953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21731","last_updated":"2025-05-27T20:21:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T10:55:11.170110Z","submitted_at":"2025-05-27T20:21:46Z","title":"Deep Reinforcement Learning Agents are not even close to Human Intelligence"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":66},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 4 inbound Pith citation observations for arXiv:2505.21731."}