{"as_of":"2026-08-12T15:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb0b4255c4562f79c61183d711e6b1c8ed05606c00dd0367cbbe5467f819c51d","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:23:52.220954Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.15525/citation-record","integrity":"/paper/2412.15525/integrity","json":"/paper/2412.15525/citation-record.json","paper":"/paper/2412.15525"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.786272Z","title":"J., Guez, A., Sifre, L., Van Den Driessche, G.,","venue":null,"work_id":"3df5fff6-1a46-4c44-bc3e-80b17b9d4ed0","year":2016},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.088354Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:389fd7d8c5b48be4c2be8969a5f43f9e7a4b4f2068a2ef53e26bbc7682e1b28f","observation_id":"ee948536-6e97-4115-a26d-e417bbbafb9f","resolution":{"observed_at":"2026-08-11T11:23:52.790921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.094753Z","title":"& Lowe, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.094753Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:33a6519cfc942e485b65bed0a2dbdd6aa67917c7b64b77be2f54b3263fae17d6","observation_id":"c72c0a62-00e0-4909-be00-1d0c3bd20b57","resolution":{"observed_at":"2026-08-11T11:23:52.094753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00374","last_updated":"2024-04-03T14:26:32Z","snapshot_observed_at":"2026-08-12T07:29:47.947863Z","submitted_at":"2019-03-01T15:40:19Z","title":"Model-Based Reinforcement Learning for Atari","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00374","snapshot_observed_at":"2026-08-11T11:23:52.100069Z","title":"H., Czechowski, K.,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.100069Z"},"links":{"cited_paper":"/paper/1903.00374","citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:cce06ed4ab8a6a5b91ed8ca986e718644c88098809737266afb5f1d1cecf2cf3","observation_id":"20d829a7-db11-4cba-bb44-56cb4091336e","resolution":{"observed_at":"2026-08-11T11:23:52.100069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.653992Z","title":"M., Mathieu, M., Dudzik, A., Chung, J.,","venue":null,"work_id":"d66a630d-ad89-4bc1-abdd-bb80bead7f74","year":2019},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.106464Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:36fa17f229a9388335b902662e19c9de1ec932acc37b1893ffe38677f1a2ff27","observation_id":"abb64ba2-14ff-40aa-a127-886e5cc8106b","resolution":{"observed_at":"2026-08-11T11:23:52.766016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.638506Z","title":"V., Pong, V., Dalal, M., Bahl, S., Lin, S., & Levine, S","venue":null,"work_id":"4d96143f-b4b1-4d01-b32b-40d06988a6d8","year":2018},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.111805Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:44d6da2cc485c01f0dfe1b523995193d31484a3705ca8042fe719b5607d4c95a","observation_id":"aaf52ea6-bc68-4705-a91f-b1bf26132dbf","resolution":{"observed_at":"2026-08-11T11:23:52.643377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.623403Z","title":null,"venue":null,"work_id":"bdf6bace-5dba-41a0-bb4e-8c00b43b6e0f","year":2024},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.116537Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:6a3dba9f54100fbce455008c6fd7ea8be9c0b98042ce1c62061b003ad4bc6291","observation_id":"ff463f6c-6f91-426d-9fa9-b4bb652d9a3b","resolution":{"observed_at":"2026-08-11T11:23:52.628038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.607322Z","title":null,"venue":null,"work_id":"6a41820f-aa7c-4f4a-8bb6-bc63acde3d4c","year":2018},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.121836Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:e1c845d0c8ba6c50115d533f97bfccf3e124120a45e666a6d8ccf95f4fc56f8c","observation_id":"a5a2def7-25d8-49f8-a87b-08ccddf25903","resolution":{"observed_at":"2026-08-11T11:23:52.612125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11372","last_updated":"2024-09-23T22:58:39Z","snapshot_observed_at":"2026-08-12T07:45:29.163340Z","submitted_at":"2024-01-21T02:17:16Z","title":"Back-stepping Experience Replay with Application to Model-free Reinforcement Learning for a Soft Snake Robot","version":2},"cited_work":{"arxiv_id":"2401.11372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.11372","snapshot_observed_at":"2026-08-11T11:23:52.366572Z","title":"Back-stepping Experience Replay with Application to Model-free Reinforcement Learning for a Soft Snake Robot","venue":"cs.RO","work_id":"89789e37-1090-4d92-8368-94bc66e469b4","year":2024},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.126421Z"},"links":{"cited_paper":"/paper/2401.11372","citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:96b6a07a6eb61d78e287409220afd846ae36848a7c0a9586e6967048208e89fb","observation_id":"2110bbbd-d837-4da6-b532-0c192ff94837","resolution":{"observed_at":"2026-08-11T11:23:52.373639Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.592703Z","title":null,"venue":null,"work_id":"c0c3cf34-1548-42df-ae4a-5c0a5e070976","year":2013},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.130898Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:ecd7dfcccc8509a040426a6f2ce6d8a33ecf86bcfd15ded94806c114ddd23c08","observation_id":"594e5f24-921d-449b-931c-9df6de424eb1","resolution":{"observed_at":"2026-08-11T11:23:52.597253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.578573Z","title":null,"venue":null,"work_id":"902045cc-23e5-488b-9157-a7d1845867eb","year":2019},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.135465Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:838db2a527b91bfc07949deceb2e87c589a6cc57bbf06485fee276dcefaf54b8","observation_id":"1683824f-b3c7-4e4b-ac51-6ecacc3ed447","resolution":{"observed_at":"2026-08-11T11:23:52.582740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.564212Z","title":"& Zaremba, W","venue":null,"work_id":"fd3d725e-a0f6-4f76-b6b3-a4c8d78f59db","year":2017},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.140057Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:413ebe4544f83deb34cd9e66392af9dd76bbaafc2b290944abf7bb426afbc73a","observation_id":"5d326a4a-6789-4f9d-8100-4f9953d06c71","resolution":{"observed_at":"2026-08-11T11:23:52.568752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.549029Z","title":null,"venue":null,"work_id":"fb32f9a2-0839-4683-a3b6-a23b7e57f920","year":2019},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.145377Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:5c0f47142c9e2a71589d546bf27d7ba19063129db1f8aa9389074e34bfda7986","observation_id":"628ed079-3e85-416a-b17b-c3a15db27c25","resolution":{"observed_at":"2026-08-11T11:23:52.553765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.533010Z","title":null,"venue":null,"work_id":"1debfe75-0e50-4b30-861d-7f2710fda123","year":2023},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.151080Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:a7b602628aed494079554cff47e989988bd42dba971624fa767b867087ecd177","observation_id":"70b5e737-b450-4733-bef6-7125e85f91cd","resolution":{"observed_at":"2026-08-11T11:23:52.538510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08299","last_updated":"2022-09-02T10:46:40Z","snapshot_observed_at":"2026-08-09T20:13:54.024607Z","submitted_at":"2022-01-20T17:06:42Z","title":"Goal-Conditioned Reinforcement Learning: Problems and Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08299","snapshot_observed_at":"2026-08-11T11:23:52.156041Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.156041Z"},"links":{"cited_paper":"/paper/2201.08299","citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:df96b7af192a5d7145f0f2b4e8deef57efd64c7346afd5941063957ac83deef7","observation_id":"21986ddc-3d25-41ff-80b2-d8ad2f3d0980","resolution":{"observed_at":"2026-08-11T11:23:52.156041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06070","last_updated":"2018-10-09T23:19:52Z","snapshot_observed_at":"2026-08-11T23:28:11.336169Z","submitted_at":"2018-02-16T18:57:57Z","title":"Diversity is All You Need: Learning Skills without a Reward Function","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06070","snapshot_observed_at":"2026-08-11T11:23:52.161155Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.161155Z"},"links":{"cited_paper":"/paper/1802.06070","citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:9fbb7a541595977415e60816f729917cb13693d0d0eb62b23fd7dd20a7cd2d14","observation_id":"506994fa-973e-4d78-978a-df3227f9df8c","resolution":{"observed_at":"2026-08-11T11:23:52.161155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.517713Z","title":"(2015, June)","venue":null,"work_id":"39d9f0e3-0333-421c-9688-5ab41f05730c","year":2015},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.166506Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:cb9c1e7bb1dadc3d68c8270c3875564299d24e81166ef84fff273f1a034aa318","observation_id":"260b84fa-e1f0-41d4-97a4-edc948c34c14","resolution":{"observed_at":"2026-08-11T11:23:52.522538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.501768Z","title":null,"venue":null,"work_id":"97c35e32-3e3e-4784-b513-d084446d225f","year":2022},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.171466Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:4ab5fc25a4fb37e772de4afa45dd1eb81a0ecb6fe30776574af8e3a8c9ed27be","observation_id":"197f04bb-9052-485c-a08c-46405d0f5904","resolution":{"observed_at":"2026-08-11T11:23:52.507357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.485057Z","title":"(2018, July)","venue":null,"work_id":"54aff1fb-3805-4871-91b6-d912d9b2b799","year":2018},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.176502Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:16819ff24e42d5abccf6406b3fe5d3907fea7f7bbd1f81ba943e030dcc6ff5b2","observation_id":"6918f1ee-718b-4e54-90ff-8edefedd6518","resolution":{"observed_at":"2026-08-11T11:23:52.490360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.467323Z","title":"& Andreas, J","venue":null,"work_id":"5e3d5834-c638-4953-a863-e0fc34b1ee4c","year":2023},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.181705Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:cbcb719a08d314524fb831c287f015773b07acfa19a523c59c1d1dc42015aefc","observation_id":"cb69359c-7139-4e74-aedc-89e10e6207d8","resolution":{"observed_at":"2026-08-11T11:23:52.472690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12122","last_updated":"2021-02-23T07:57:41Z","snapshot_observed_at":"2026-07-06T09:31:19.187163Z","submitted_at":"2020-06-22T10:22:08Z","title":"Learning with AMIGo: Adversarially Motivated Intrinsic Goals","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12122","snapshot_observed_at":"2026-08-11T11:23:52.186907Z","title":"B., Rocktäschel, T., & Grefenstette, E","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.186907Z"},"links":{"cited_paper":"/paper/2006.12122","citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:734adeabfad909bd23b7914fb712c00069fa6f41025bf57e2bb903ebf1466c6b","observation_id":"039ad112-0708-46f8-ad3b-b11794a45969","resolution":{"observed_at":"2026-08-11T11:23:52.186907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.452476Z","title":null,"venue":null,"work_id":"632b03f9-372f-4376-a671-2be104566066","year":2019},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.192029Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:8dae38ea3d119bd224ec2daf8c224a91331f63236420ebd2675282bdb98cd519","observation_id":"e25d8748-daaa-47f4-ba87-613a9f9c5c17","resolution":{"observed_at":"2026-08-11T11:23:52.456856Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.435919Z","title":"(2020, November)","venue":null,"work_id":"47f48fae-9c1b-461c-9a8d-8944a14c1c10","year":2020},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.196911Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:07966fca1e33b48bcd2a8de1730402e64ea6360886259e3ecc5a8c5dff7ada24","observation_id":"fae3ab1e-3bc9-48f4-a955-479c152e888f","resolution":{"observed_at":"2026-08-11T11:23:52.441212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.11359","last_updated":"2018-11-28T02:35:24Z","snapshot_observed_at":"2026-07-06T07:17:31.201039Z","submitted_at":"2018-11-28T02:35:24Z","title":"Unsupervised Control Through Non-Parametric Discriminative Rewards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.11359","snapshot_observed_at":"2026-08-11T11:23:52.201953Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.201953Z"},"links":{"cited_paper":"/paper/1811.11359","citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:e8935a274f879ee1f4404ab6f0bcbf480049dab7cf9883c6d296f9a827673311","observation_id":"3c551a7b-743d-45c6-927a-e2841118046a","resolution":{"observed_at":"2026-08-11T11:23:52.201953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09464","last_updated":"2018-03-10T18:11:25Z","snapshot_observed_at":"2026-08-10T08:18:58.848796Z","submitted_at":"2018-02-26T17:20:14Z","title":"Multi-Goal Reinforcement Learning: Challenging Robotics Environments and Request for Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09464","snapshot_observed_at":"2026-08-11T11:23:52.207476Z","title":"& Zaremba, W","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.207476Z"},"links":{"cited_paper":"/paper/1802.09464","citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:9a9f62f5bcce651331e50ca76a0f3a19c83e1e12c52c89949c03e8c0405b659f","observation_id":"e3203062-8536-40da-925c-4ab8701f25b9","resolution":{"observed_at":"2026-08-11T11:23:52.207476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.419541Z","title":"M., Xu, T., Lai, H., Chen, X","venue":null,"work_id":"4232dc2d-f213-4e3f-af60-c5f0adfd2121","year":2024},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.212567Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:a6fce6b82dc52cb9c6e4719839c2846f2e118566c765049847c50d2d30eda772","observation_id":"601365df-83ae-49e4-832e-1abf8c00416c","resolution":{"observed_at":"2026-08-11T11:23:52.424334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.05952","last_updated":"2016-02-25T17:55:31Z","snapshot_observed_at":"2026-07-06T04:37:00.543211Z","submitted_at":"2015-11-18T20:54:44Z","title":"Prioritized Experience Replay","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.05952","snapshot_observed_at":"2026-08-11T11:23:52.216636Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.216636Z"},"links":{"cited_paper":"/paper/1511.05952","citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:1690e83447ceaa646b8992eca50e602fae28515dfe4bc4f7130c664c8a1d1cd0","observation_id":"3abacde9-07d6-4ab2-808e-7aed573aea25","resolution":{"observed_at":"2026-08-11T11:23:52.216636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:23:52.402990Z","title":null,"venue":null,"work_id":"9aa116ad-7736-46d4-a66e-768731657b72","year":2019},"citing_paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T11:23:52.220954Z"},"links":{"citing_paper":"/paper/2412.15525"},"observation_digest":"sha256:16e8ad92ecc0df48efdc4c0a579012186b500e9b7641c0d109ca4497a80112b3","observation_id":"d138ae0f-d48d-418c-97cf-4a6d68c66b3d","resolution":{"observed_at":"2026-08-11T11:23:52.408095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.15525","last_updated":"2024-12-20T03:31:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T11:18:59.311025Z","submitted_at":"2024-12-20T03:31:23Z","title":"Generalized Back-Stepping Experience Replay in Sparse-Reward Environments"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2412.15525."}