{"as_of":"2026-08-08T18:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ecf2a69420a493d9c3c0d1b664125f1b213c93c0ce7c91a67f4f8d0eba3adef2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:10:07.379760Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:59:44.516619Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-07T12:10:07.379760Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00563","last_updated":"2025-09-08T18:56:14Z","snapshot_observed_at":"2026-08-07T12:00:27.421702Z","submitted_at":"2025-05-31T13:43:41Z","title":"Understanding Behavioral Metric Learning: A Large-Scale Study on Distracting Reinforcement Learning Environments","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T12:10:07.379760Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2506.00563"},"observation_digest":"sha256:5ee91ba7744fe2f20685ae6f1ef40a6929cc204b78482565c10c72073ddbb36b","observation_id":"9049565e-2b4a-44b2-8be0-bc466da837ba","resolution":{"observed_at":"2026-08-07T12:10:07.379760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-07T10:53:07.128785Z","title":"Smith, I","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04147","last_updated":"2026-07-17T06:06:23Z","snapshot_observed_at":"2026-08-07T11:19:43.382488Z","submitted_at":"2025-06-04T16:41:55Z","title":"SLAC: Safe and Efficient Real-Robot Reinforcement Learning via Unsupervised Simulation Pre-Training","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:53:07.128785Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2506.04147"},"observation_digest":"sha256:fd5685ab643a4c47d16bda2c5f48e80dcd09a655f44ee2b210e182410d598e2b","observation_id":"008756a5-6252-4f50-a846-96a0130fb978","resolution":{"observed_at":"2026-08-07T10:53:07.128785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-07T00:31:46.391421Z","title":"Smith, I","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13762","last_updated":"2025-06-16T17:59:48Z","snapshot_observed_at":"2026-08-07T11:31:54.704087Z","submitted_at":"2025-06-16T17:59:48Z","title":"Touch begins where vision ends: Generalizable policies for contact-rich manipulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:31:46.391421Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2506.13762"},"observation_digest":"sha256:452f54c6b7f6ce1de8a54c88293094fb893551f14a25fc7628b455fb006a8464","observation_id":"d833eb6d-4ee0-4940-8d2c-d12b39720723","resolution":{"observed_at":"2026-08-07T00:31:46.391421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-04T09:48:07.562879Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.13704","last_updated":"2026-06-03T03:31:14Z","snapshot_observed_at":"2026-08-04T09:47:43.934006Z","submitted_at":"2025-10-15T16:01:30Z","title":"Simplicial Embeddings Improve Sample Efficiency in Actor-Critic Agents","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-04T09:48:07.562879Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2510.13704"},"observation_digest":"sha256:bffb80b589b931e2f25b2f279d07347c3a70c581a34896b01991262b8929970c","observation_id":"52a55d8a-da05-415b-b158-c3d4ab448f53","resolution":{"observed_at":"2026-08-04T09:48:07.562879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-04T07:06:51.320227Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.27048","last_updated":"2026-07-10T16:45:48Z","snapshot_observed_at":"2026-08-04T07:06:47.791270Z","submitted_at":"2025-10-30T23:33:07Z","title":"SpikeATac: A Multimodal Tactile Finger with Taxelized Dynamic Sensing for Dexterous Manipulation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T07:06:51.320227Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2510.27048"},"observation_digest":"sha256:94525bddfb00d59dbbc37a84b66fd0393aa3b9ca639cee1db1e2d07d7e0414c5","observation_id":"4b78d0c1-9b47-4201-9aa8-9af4373338c9","resolution":{"observed_at":"2026-08-04T07:06:51.320227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2601.14617","last_updated":"2026-04-03T08:41:56Z","snapshot_observed_at":"2026-08-03T01:04:57.001639Z","submitted_at":"2026-01-21T03:19:32Z","title":"UniCon: A Unified System for Efficient Robot Learning Transfers","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T12:58:56.857747Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2601.14617"},"observation_digest":"sha256:06672fcf8fa40722de75a8027152c9a85ad619e4a934e79fc1131705c532e09b","observation_id":"518df3ee-2b6b-4322-a7f9-e53688b1326b","resolution":{"observed_at":"2026-05-16T13:00:54.948804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2602.09580","last_updated":"2026-06-05T16:14:20Z","snapshot_observed_at":"2026-08-03T02:53:08.103634Z","submitted_at":"2026-02-10T09:28:20Z","title":"SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T03:36:09.272019Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2602.09580"},"observation_digest":"sha256:bdaf018ebb0861b24dc3dda9c054c58400c1822df423c707af9318d39ee65282","observation_id":"fd58f5fa-15bc-4e3f-8b5c-c38985818e96","resolution":{"observed_at":"2026-05-16T03:37:13.821187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-03T02:55:50.745366Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning.arXiv preprint arXiv:2208.07860, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.09580","last_updated":"2026-06-05T16:14:20Z","snapshot_observed_at":"2026-08-03T02:53:08.103634Z","submitted_at":"2026-02-10T09:28:20Z","title":"SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T02:55:50.745366Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2602.09580"},"observation_digest":"sha256:95b8c92a579207ce323e5e6f175d5a0dbb008b1cdbd30f3527eb8edea7aaf80a","observation_id":"d0b0b0e8-b22e-47a1-9907-9cab4e547686","resolution":{"observed_at":"2026-08-03T02:55:50.745366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-08-02T21:36:16.982549Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning.arXiv preprint arXiv:2208.07860, 2022.(Cited on pages 3 and 21)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.20220","last_updated":"2026-07-22T18:26:39Z","snapshot_observed_at":"2026-08-06T17:49:21.760460Z","submitted_at":"2026-02-23T10:34:15Z","title":"What Matters for Simulation to Online Reinforcement Learning on Real Robots","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T21:36:16.982549Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2602.20220"},"observation_digest":"sha256:5782b535f0f11fe5cdfd12cc9936bc4a0cdd6dd78337c9db8c99db163c53405d","observation_id":"ec06c701-36de-4cb1-b092-0e80c8cf97d6","resolution":{"observed_at":"2026-08-02T21:36:16.982549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2603.15759","last_updated":"2026-05-12T15:04:33Z","snapshot_observed_at":"2026-07-06T22:49:19.323519Z","submitted_at":"2026-03-16T18:00:23Z","title":"Simulation Distillation: Pretraining World Models in Simulation for Rapid Real-World Adaptation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T09:49:03.333757Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2603.15759"},"observation_digest":"sha256:0d9ca3ab02912cd28fa4f670785a40264960ce8f142f7efe5a274b6cc7068d7e","observation_id":"abfc8f1f-7e80-4579-9867-f33f589a7c45","resolution":{"observed_at":"2026-05-15T09:49:54.489556Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.09595","last_updated":"2026-06-09T02:45:20Z","snapshot_observed_at":"2026-08-06T01:08:43.975335Z","submitted_at":"2026-05-10T15:16:07Z","title":"Neuromorphic Reinforcement Learning for Quadruped Locomotion Control on Uneven Terrain","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-12T04:24:33.237352Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.09595"},"observation_digest":"sha256:1130480a3f9f83c8c4cc1d97a4838502dfcbecb6a66fcbfd05420ff206b7faa4","observation_id":"b4e40f6f-1ea1-41b7-b80c-14d9493a5469","resolution":{"observed_at":"2026-05-12T06:16:29.172728Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.09595","last_updated":"2026-06-09T02:45:20Z","snapshot_observed_at":"2026-08-06T01:08:43.975335Z","submitted_at":"2026-05-10T15:16:07Z","title":"Neuromorphic Reinforcement Learning for Quadruped Locomotion Control on Uneven Terrain","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-30T22:48:25.063920Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.09595"},"observation_digest":"sha256:7a4b3809ff1cf155ec48f763624854e4c89aa5c763102396270c876c1e6eeea7","observation_id":"8703c14d-c0d9-4ca6-9564-fba6b44f6171","resolution":{"observed_at":"2026-07-01T13:45:45.934686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-06T08:24:06.705324Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T05:33:19.038889Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:89a6f4d4b3d71eed2d046238fabe984d44c23583cbc550ff691a85d4bfb8fb13","observation_id":"aabff9cb-616a-448c-8fc2-bf1ec5898f58","resolution":{"observed_at":"2026-05-12T05:36:24.566962Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-06T08:24:06.705324Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T06:27:38.643667Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:cd6609123afeeceffea171d902cc98b6ae46da6db0afe2df15153cd2e9170f7f","observation_id":"24c88951-5282-45be-81dc-f913bedbfa8a","resolution":{"observed_at":"2026-05-13T06:32:24.777585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-06T08:24:06.705324Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T23:04:12.943222Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:05be0bd1a7dadf5665fb29f9bb57adf86fa1c74f72a527aabb0f5245cb4ab8f1","observation_id":"f047453d-503a-48b7-86ac-4d39acb90258","resolution":{"observed_at":"2026-05-20T23:09:12.669798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2605.14350","last_updated":"2026-05-14T04:22:24Z","snapshot_observed_at":"2026-07-06T23:25:49.545418Z","submitted_at":"2026-05-14T04:22:24Z","title":"Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-15T03:05:36.871497Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2605.14350"},"observation_digest":"sha256:2b0f5715de0979263df9d2988b048dc3302bcddf06b15a79aedfa4e493cabc94","observation_id":"cbbc3c3e-e3a0-492d-94aa-786dc12e75b3","resolution":{"observed_at":"2026-05-15T03:08:59.660784Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2208.07860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.07860","snapshot_observed_at":"2026-07-04T09:59:44.516619Z","title":"A walk in the park: Learning to walk in 20 minutes with model-free reinforcement learning","venue":null,"work_id":"8c87b112-8a91-4108-b930-67af41cc8a3a","year":2022},"citing_paper":{"arxiv_id":"2606.23640","last_updated":"2026-06-22T17:30:24Z","snapshot_observed_at":"2026-08-02T09:22:48.099895Z","submitted_at":"2026-06-22T17:30:24Z","title":"Learning Process Rewards via Success Visitation Matching for Efficient RL","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-26T09:20:35.062060Z"},"links":{"cited_paper":"/paper/2208.07860","citing_paper":"/paper/2606.23640"},"observation_digest":"sha256:3e32158f9e88d4ee96d72cb7fb69aa9f12ca3e4cbf959898c98ca45d11e1fc70","observation_id":"49d4e92b-8c72-4978-ab81-c257e0044bf5","resolution":{"observed_at":"2026-07-04T09:59:44.518538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2208.07860/citation-record","integrity":"/paper/2208.07860/integrity","json":"/paper/2208.07860/citation-record.json","paper":"/paper/2208.07860"},"outbound":[],"paper":{"arxiv_id":"2208.07860","last_updated":"2022-08-16T17:37:36Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T07:51:14.255787Z","submitted_at":"2022-08-16T17:37:36Z","title":"A Walk in the Park: Learning to Walk in 20 Minutes With Model-Free Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2208.07860."}