{"as_of":"2026-08-11T03:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ae8727d535987660b291a9c135595afb96a184956d6fbb3c8f1be91354b3109e","coverage":[{"denominator":114,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T04:59:48.867927Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.23551/citation-record","integrity":"/paper/2605.23551/integrity","json":"/paper/2605.23551/citation-record.json","paper":"/paper/2605.23551"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conference on robot learning , pages=","venue":null,"work_id":"ae662726-369c-458f-a840-86abfec49953","year":2020},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:2625cd55f789c60e055b011ff9d004ec2b150045dfb45ec23544cd71539b3c87","observation_id":"7961bee5-a112-487a-bd60-ddabe681431b","resolution":{"observed_at":"2026-05-25T12:57:01.423648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"64dfed08-efbb-4079-b6ca-7cac267e9bff","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:905ccec68776590a6c7200da8042a907273afa98ffa1c34be48c7262d506585e","observation_id":"a16838a9-f417-4c83-9946-74c0e8a4a4fc","resolution":{"observed_at":"2026-05-25T12:57:01.575568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T06:53:25.009525Z","title":"Journal of Artificial Intelligence Research , volume=","venue":null,"work_id":"4857cd29-23cd-48dc-8c89-620895dff27d","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:18ba4618bfd612140a01e6e4c3c38fa54097609068d9f6800c303c2690b60bfd","observation_id":"315a79eb-78c1-4694-90c0-d90a39c0a746","resolution":{"observed_at":"2026-05-25T12:57:01.484391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"76bd43ac-afdd-42c1-8184-fb933c3ee264","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:c92302ee798be03d4f2b6e98e7b262fffbaf29b88d74153027ef457a8f85ad0d","observation_id":"c0ece404-a0d2-4333-8909-7edada3627c6","resolution":{"observed_at":"2026-05-25T12:57:01.584995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11054","last_updated":"2025-04-15T10:41:11Z","snapshot_observed_at":"2026-08-09T18:24:56.614284Z","submitted_at":"2025-04-15T10:41:11Z","title":"Zero-Shot Whole-Body Humanoid Control via Behavioral Foundation Models","version":1},"cited_work":{"arxiv_id":"2504.11054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.11054","snapshot_observed_at":"2026-07-04T06:09:37.577828Z","title":"arXiv preprint arXiv:2504.11054 , year=","venue":null,"work_id":"66c9e13a-450a-4e2d-9104-8e55cb0bd1ae","year":2025},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2504.11054","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:261e097a2d0cf7901c6540a0d3ef17a2de57be5f91f6fab05887c3bdd568aea5","observation_id":"6a2f622b-2058-4c6c-a11e-e448d1d12550","resolution":{"observed_at":"2026-05-25T05:00:21.537945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00166","last_updated":"2023-09-29T22:10:01Z","snapshot_observed_at":"2026-08-06T01:29:08.189946Z","submitted_at":"2023-09-29T22:10:01Z","title":"Motif: Intrinsic Motivation from Artificial Intelligence Feedback","version":1},"cited_work":{"arxiv_id":"2310.00166","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.00166","snapshot_observed_at":"2026-07-03T20:48:55.285309Z","title":"arXiv preprint arXiv:2310.00166 , year=","venue":null,"work_id":"b6b68037-632c-4260-a152-653b9576ff75","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2310.00166","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:a8cd62caf900b22ed6f31306e88725a8388439973b165227eaab7cd491164234","observation_id":"2e722bf5-783c-4481-9561-1108d5eb2fa6","resolution":{"observed_at":"2026-05-25T05:00:21.663285Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"0e92b0c1-9715-4693-acdf-03ea33f52ed4","year":2023},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:2a3a3a34ac55948c2e116782d5ab85a4eab8c643403f54b78c512a9e94c8aaee","observation_id":"d7caebe9-fba8-4260-87e4-feff2fb38eae","resolution":{"observed_at":"2026-05-25T12:57:01.524859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"505fe870-7b3b-49f3-b4ef-261dff880bb0","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:16d721f28fccf79770d522891abbc397da8e3b6fa79298c4f2d022827fa547f9","observation_id":"04b214b9-2cd9-47d1-a915-e5f05c97720b","resolution":{"observed_at":"2026-05-25T12:57:01.568548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"a2e5edc2-c0bb-4be8-9d90-ce377b9adcf2","year":2021},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:fdb078594f1f0c8997015885837ddbcf04417ba869d53a78aa102e69a16aefbf","observation_id":"e75e4df8-c569-4d05-beda-a7e8497dd2e5","resolution":{"observed_at":"2026-05-25T12:57:01.541304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f4ce3e1c-a8c3-4290-987f-73ad1de78750","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:0e8177d1429f65f1d783a990a1dfdcc9546e809d334e88cdc922a84ebe5869ad","observation_id":"2906fe8f-0016-4733-be55-b8b02bb9a0fb","resolution":{"observed_at":"2026-05-25T12:57:01.466953Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-08-10T15:50:18.915523Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":"2503.20020","doi":"10.48550/arxiv.2503.20020","metadata_source":"pith","pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini Robotics: Bringing AI into the Physical World","venue":"cs.RO","work_id":"f7c5ce10-8364-4fbe-964f-2802b81c3a98","year":2025},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:58ee607dae6a0afb362c48abdfb5ac332971a77e1310b833ee4ebc25165a8ccd","observation_id":"a45f585a-296b-4527-b6a8-904ab5850da4","resolution":{"observed_at":"2026-05-25T05:00:21.583816Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:f5ae3f60bf101e8167a87c2515756aec40c4fb24cb75d845128ca84303973b3c","observation_id":"8cb2d91e-f0ab-4b4b-93f5-abfc129419d8","resolution":{"observed_at":"2026-05-25T05:00:21.477574Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:e99f65788f42dd64596c449005ba9cc986b5ae35b78679edb5a22206eaba6394","observation_id":"c4627554-16c5-4e2b-94d5-1dd7930edf1e","resolution":{"observed_at":"2026-05-25T05:00:21.520946Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:54.466839Z","title":"Conference on Robot Learning , pages=","venue":null,"work_id":"df57e51e-ad25-457a-ab4e-1cfebbcf218f","year":2023},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:c379b1b89d2ddb63b8bcf8a7e43dab58f749ef77a1654592d0b88d45166514c7","observation_id":"f3fb4c0b-1927-44a7-977b-e59e0188b80e","resolution":{"observed_at":"2026-05-25T12:57:01.477436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"913d1362-345c-4391-b26b-d77571d21630","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:ead74e13efed90c0b274dad2bb24d1ec94ea6176182f105e3eaee58e7dabef91","observation_id":"6a4ca8bc-91ed-4b78-954a-85245891bfc5","resolution":{"observed_at":"2026-05-25T12:57:01.544628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.06288","last_updated":"2026-07-02T13:49:52Z","snapshot_observed_at":"2026-08-09T23:29:14.568865Z","submitted_at":"2025-10-07T04:23:48Z","title":"BuilderBench: The Building Blocks of Intelligent Agents","version":4},"cited_work":{"arxiv_id":"2510.06288","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.06288","snapshot_observed_at":"2026-07-04T17:29:59.472021Z","title":"arXiv preprint arXiv:2510.06288 , year=","venue":"cs.AI","work_id":"d6629afe-cc8d-46c7-a6d1-e120af6f2470","year":2025},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2510.06288","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:e94810de263ec6f3883ccddcee634f6a17158dd2c0a4f83b3d9e3891ad591e67","observation_id":"cf1a0114-2d41-4081-b34c-7c9b33f57b67","resolution":{"observed_at":"2026-07-03T02:17:06.786158Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2018 , Eprint =","venue":null,"work_id":"f552733e-7a10-40bb-a368-40feec6dcdbb","year":2018},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:38fd20e31f57939b65491b2faf3625f0c1fe72327581a0d2fd68c37876470e64","observation_id":"da2f1530-f2f4-4c42-a335-feee5608f20b","resolution":{"observed_at":"2026-05-25T12:57:01.507632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"4aa2118d-3a82-4836-a164-8d5f26272d58","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:01930d3ee46939e554cc4f67db5a7ffba9bbada16102d8db932774aabb88f99b","observation_id":"2e2787a9-54ed-4345-b671-8df58a559dc1","resolution":{"observed_at":"2026-05-25T12:57:01.446206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23208","last_updated":"2025-03-03T14:29:16Z","snapshot_observed_at":"2026-07-06T19:42:21.306600Z","submitted_at":"2024-10-30T16:59:41Z","title":"Kinetix: Investigating the Training of General Agents through Open-Ended Physics-Based Control Tasks","version":2},"cited_work":{"arxiv_id":"2410.23208","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.23208","snapshot_observed_at":"2026-07-01T15:45:48.346998Z","title":"T., Coward, S., and Foerster, J","venue":null,"work_id":"6d9caeb9-e973-4a9a-bdd9-45dd0b111158","year":2025},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2410.23208","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:323ff91ba05dd0617ef554cc0a00120d392e03d794e5d0e9636fa5df5531c836","observation_id":"7d22abfe-ce9f-4e39-b8dc-cfa365bc10ae","resolution":{"observed_at":"2026-05-25T05:00:21.489363Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-07T08:29:46.650400Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.16291","doi":"10.18653/v1/2023.emnlp-main.118","metadata_source":"pith","pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","venue":"cs.AI","work_id":"ffe0d207-86cf-4742-a100-e988ac8b9676","year":2023},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:761358fc50681e6d13ce45eb49c6012ff76d89179391d62ad4dd23c24c2fc331","observation_id":"3ef1e195-e349-4932-b880-d53e3e348c03","resolution":{"observed_at":"2026-05-25T05:00:21.516277Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"5e8498eb-a44c-42ab-9911-9e66275f9a8d","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:fd9f394fc94b8e80d615d3c1c701eb9d587a316724b9cfd5ccae9569c583ba22","observation_id":"d1abf87b-8d5c-4919-abb5-9f968147e5d0","resolution":{"observed_at":"2026-05-25T12:57:01.456752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"f870e388-db50-4373-ae08-4898e6ce3eca","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:8ff7a0bba86d3ff246e67c24917b29531172ffb06958887d326896bd707ad0ed","observation_id":"9aa08fed-919f-4404-9eb1-079bd2f68469","resolution":{"observed_at":"2026-05-25T12:57:01.374046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13440","last_updated":"2019-07-29T18:10:30Z","snapshot_observed_at":"2026-08-10T19:41:28.414659Z","submitted_at":"2019-07-29T18:10:30Z","title":"MineRL: A Large-Scale Dataset of Minecraft Demonstrations","version":1},"cited_work":{"arxiv_id":"1907.13440","doi":"10.48550/arxiv.1907.13440","metadata_source":"arxiv_reference","pith_arxiv_id":"1907.13440","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:1907.13440 , year=","venue":"arXiv (Cornell University)","work_id":"ccb3cca0-dca9-4e79-97de-4aff642180ce","year":1907},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1907.13440","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:25a70e9119d954ecdff6f1cf8434db17af536e60da6815c515cab059a4e91b95","observation_id":"3afd91e9-6962-47f8-9d81-3ecc8af6eb4f","resolution":{"observed_at":"2026-05-25T05:00:21.543656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.01954","last_updated":"2018-05-11T21:48:52Z","snapshot_observed_at":"2026-08-06T03:56:45.024415Z","submitted_at":"2018-05-04T22:36:58Z","title":"Behavioral Cloning from Observation","version":2},"cited_work":{"arxiv_id":"1805.01954","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.01954","snapshot_observed_at":"2026-07-10T21:47:36.364240Z","title":"Behavioral Cloning from Observation","venue":"cs.AI","work_id":"ddf563f4-ca68-4fd1-824f-ac3a4cedbe8d","year":2018},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1805.01954","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:be06198df36734ae6d153afbb39d3660377109935da5115c18528c9caf022fab","observation_id":"3aecd854-b30e-4f25-aca5-a52a33681fae","resolution":{"observed_at":"2026-05-25T05:00:21.572482Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":"2006.09359","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-07-08T22:35:40.693821Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","venue":"cs.LG","work_id":"f0a11265-1acf-4ffc-a822-08bd04b6bddf","year":2020},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:2e0b92f0b1c547ceb9852c8418a1aa509aa5ecf3ed6702a01c9307b9eab4eff4","observation_id":"cb776ba7-16d5-43d2-81ba-8edff57e7726","resolution":{"observed_at":"2026-05-25T05:00:21.621221Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14045","last_updated":"2025-06-16T22:36:32Z","snapshot_observed_at":"2026-08-07T00:16:34.774752Z","submitted_at":"2025-06-16T22:36:32Z","title":"Discovering Temporal Structure: An Overview of Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.14045","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14045","snapshot_observed_at":"2026-07-04T15:29:55.591686Z","title":"arXiv preprint arXiv:2506.14045 , year=","venue":null,"work_id":"cba277d3-02b1-4978-8b71-b7e000236cfa","year":2025},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2506.14045","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:9cad9911acb60354835d3f096587f48d81301046a0a327f07e2cb3f99c16ec49","observation_id":"147e6cef-b883-4081-ae84-422b6bb24fed","resolution":{"observed_at":"2026-05-25T05:00:21.500920Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.03673","last_updated":"2017-01-13T11:15:22Z","snapshot_observed_at":"2026-07-06T05:18:15.988050Z","submitted_at":"2016-11-11T12:14:45Z","title":"Learning to Navigate in Complex Environments","version":3},"cited_work":{"arxiv_id":"1611.03673","doi":null,"metadata_source":"pith","pith_arxiv_id":"1611.03673","snapshot_observed_at":"2026-07-04T17:39:59.701075Z","title":"Learning to Navigate in Complex Environments","venue":"cs.AI","work_id":"51fe10f2-5461-40dc-9454-9e096d67cc18","year":2016},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1611.03673","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:11fd4e4c324b20d68ed84c4989ab919bbd4ad34a5b07a7d956d823e26c36350c","observation_id":"ec42ee3c-5fb4-42d8-85a4-a4b2ffc0ec64","resolution":{"observed_at":"2026-05-25T05:00:21.549820Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06865","last_updated":"2019-02-28T18:32:24Z","snapshot_observed_at":"2026-07-06T07:33:58.446265Z","submitted_at":"2019-02-19T02:36:14Z","title":"Hyperbolic Discounting and Learning over Multiple Horizons","version":3},"cited_work":{"arxiv_id":"1902.06865","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.06865","snapshot_observed_at":"2026-07-04T07:59:40.672011Z","title":"Hyperbolic Discounting and Learning over Multiple Horizons","venue":"stat.ML","work_id":"51f63390-d969-4c7e-9fb6-d78e4e61f71d","year":2019},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1902.06865","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:d6cea0ebbb723e6e09fb839c9ce7b9d2e666c2f071b6d427b2918a2d1f55a374","observation_id":"f6d4cf75-d180-4879-9156-f155d5329d87","resolution":{"observed_at":"2026-05-25T05:00:21.506088Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.05397","last_updated":"2016-11-16T18:21:29Z","snapshot_observed_at":"2026-08-08T00:00:13.424932Z","submitted_at":"2016-11-16T18:21:29Z","title":"Reinforcement Learning with Unsupervised Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":"1611.05397","doi":null,"metadata_source":"pith","pith_arxiv_id":"1611.05397","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement Learning with Unsupervised Auxiliary Tasks","venue":"cs.LG","work_id":"8ac80d7b-b24c-4128-9798-b3a9b02ad56d","year":2016},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1611.05397","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:3f6c7429ec1fa34c3e53e6ad8e5513af0a965f6f28a728e714a6f55f35020fdd","observation_id":"8eea4d83-7326-4c82-a23f-34cf9df350d7","resolution":{"observed_at":"2026-05-25T05:00:21.601916Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.07626","last_updated":"2018-12-18T20:01:41Z","snapshot_observed_at":"2026-07-06T07:22:04.461006Z","submitted_at":"2018-12-18T20:01:41Z","title":"Universal Successor Features Approximators","version":1},"cited_work":{"arxiv_id":"1812.07626","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.07626","snapshot_observed_at":"2026-06-29T22:24:00.767730Z","title":"Universal Successor Features Approximators","venue":"cs.LG","work_id":"078d8d23-c0c6-48dc-98c4-6bd0fc86aacd","year":2018},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1812.07626","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:ad62b3e54bacf288ae0ea1e3c7979fc443f93c0cb8fcefe171d8ce7fd232a93e","observation_id":"31fc6575-c593-4bb9-a0f1-0c21938c4b25","resolution":{"observed_at":"2026-05-25T05:00:21.700458Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"d7dc3877-37c0-4583-8b2d-1cd6d2c8037d","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:ac1bc0df0453d1c53c6620084f85ada32b41c9da4d2207d7765d2840b0a80f8e","observation_id":"9c327f67-a01a-4f04-95f2-d07215f29f27","resolution":{"observed_at":"2026-05-25T12:57:01.547812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural computation , volume=","venue":null,"work_id":"8524fe9f-6baf-44f4-8d1a-1f01a620ee0d","year":1993},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:5f0253b3bcf41198d945b8af5e3a526b091037a45f84315d0c199e45c95bfd0f","observation_id":"a88801fd-8088-4c84-b230-143fa3a4df48","resolution":{"observed_at":"2026-05-25T12:57:01.554122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11584","last_updated":"2022-08-15T21:42:10Z","snapshot_observed_at":"2026-07-06T13:34:33.453082Z","submitted_at":"2022-07-23T19:23:29Z","title":"Hierarchical Kickstarting for Skill Transfer in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2207.11584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2207.11584","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2207.11584 , year=","venue":null,"work_id":"9a1fbd0d-cd65-48a7-9e1c-fbf489e24ca7","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2207.11584","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:3431fc8d7d2470f384dabf762560212995fcbea8f1126a44166144b759a00321","observation_id":"526afce0-ef2f-4557-a3bb-674007da9afe","resolution":{"observed_at":"2026-05-25T05:00:21.511181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00338","last_updated":"2026-05-08T15:17:41Z","snapshot_observed_at":"2026-08-02T17:36:08.274992Z","submitted_at":"2025-08-30T03:42:10Z","title":"Scalable Option Learning in High-Throughput Environments","version":3},"cited_work":{"arxiv_id":"2509.00338","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00338","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable Option Learning in High-Throughput Environments","venue":"cs.LG","work_id":"5c4e25be-54d5-42ef-afee-8b4285d6df63","year":2025},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2509.00338","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:ce29df2dce8b85c66a2794c0561c009016df6e30f8bd9edb98e0692bd630c179","observation_id":"dc6ba414-7684-4b28-a3dd-a017583416f4","resolution":{"observed_at":"2026-05-25T05:00:21.471448Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00987","last_updated":"2023-10-16T05:05:56Z","snapshot_observed_at":"2026-08-10T19:16:41.967177Z","submitted_at":"2023-09-02T16:55:48Z","title":"Sequential Dexterity: Chaining Dexterous Policies for Long-Horizon Manipulation","version":2},"cited_work":{"arxiv_id":"2309.00987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.00987","snapshot_observed_at":"2026-07-08T06:04:34.678310Z","title":"arXiv preprint arXiv:2309.00987 , year=","venue":"cs.RO","work_id":"c90e23d2-b482-4318-b3f7-eceddf19c9de","year":2023},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2309.00987","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:73b7204a8699f7d0d99c80b36fe1b70b1d4197738109c0bc5bad2006a4c52867","observation_id":"12fd6869-7060-46ea-aee3-bf96aaf85a19","resolution":{"observed_at":"2026-05-25T05:00:21.566848Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.04168","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T04:17:36.873024Z","title":"Horizon reduction makes rl scalable","venue":null,"work_id":"db2ae55e-02f3-419b-a8bd-b9e557314eb0","year":2025},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:a237a9298c721605924bbaf19f37557cd2a9d3634d08aa42810103a44b363bf8","observation_id":"6b16c95b-f9f3-4828-8393-082ad9e219ba","resolution":{"observed_at":"2026-05-25T05:00:21.560997Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08542","last_updated":"2024-12-11T16:59:31Z","snapshot_observed_at":"2026-08-06T06:54:24.482893Z","submitted_at":"2024-12-11T16:59:31Z","title":"MaestroMotif: Skill Design from Artificial Intelligence Feedback","version":1},"cited_work":{"arxiv_id":"2412.08542","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08542","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2412.08542 , year=","venue":null,"work_id":"e9cf863d-bda7-4e79-90da-b2127c3c8a68","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2412.08542","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:038111818d03e3184a8be820956ec5a1c674b708793aab3cfed6c2948467d18d","observation_id":"868116f4-dc41-43b7-a744-ee1ee21c8bbc","resolution":{"observed_at":"2026-05-25T05:00:21.652397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:46:29.455754Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"5d6a1403-19f3-4962-a92c-2291b3eb9f8c","year":2017},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:6c77463408aa91b30e3ff0ea86726ce396026c691f9dcb958ba7924d1c04e8f6","observation_id":"b2011ab4-890f-41ae-beb2-679805a13431","resolution":{"observed_at":"2026-05-25T12:57:01.587809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"06fb2744-dc0e-4f48-bec5-050c39218577","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:2c7f38d3cc2f3d1372c565af04793c67e6560f5922806a7c5e0d43a93c31b1a5","observation_id":"b7b87d10-ee0a-4ff8-b236-b4a149ce309a","resolution":{"observed_at":"2026-05-25T12:57:01.561903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"ba5ee62d-1523-4b43-b73f-4c186a4bc067","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:08944d507d6521503c497ffce672268471f346d390a3f613049ccadba351144b","observation_id":"e123c072-9f1d-48c0-a510-62d46af8208a","resolution":{"observed_at":"2026-05-25T12:57:01.550926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":"79a5f7c4-cd30-453d-8cba-9b990f89fae7","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:2089b4e7437ea315773aebc08c3c383d3a064387185da3b62a49e48099293e2e","observation_id":"4e2ff345-7152-4ba6-8c8a-51b372ae5c0d","resolution":{"observed_at":"2026-05-25T12:57:01.431765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2000 , publisher=","venue":null,"work_id":"079e1492-ee36-4196-8b5d-f1de37d8fc66","year":2000},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:93e37592abf58d9c0a49bfc73447a82fa9273bde2934428a863dbd580381b119","observation_id":"54ac1196-a2a8-40bc-9f76-09dc4f1bcfa3","resolution":{"observed_at":"2026-05-25T12:57:01.435531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T06:43:30.619307Z","title":"Artificial intelligence , volume=","venue":null,"work_id":"fa8ffd0d-696d-4d4d-86f1-83c82c56f23e","year":1999},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:83c8b022d3fd72c74d672bba1432b77ab6a4c25fc53b1ed5e9949a4cb2cf6aa1","observation_id":"0651c3de-8e89-4d83-a92b-5feb2c742f29","resolution":{"observed_at":"2026-05-25T12:57:01.413137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20092","last_updated":"2025-02-13T18:38:13Z","snapshot_observed_at":"2026-08-09T00:27:34.912875Z","submitted_at":"2024-10-26T06:06:08Z","title":"OGBench: Benchmarking Offline Goal-Conditioned RL","version":2},"cited_work":{"arxiv_id":"2410.20092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20092","snapshot_observed_at":"2026-07-03T04:17:36.875832Z","title":"arXiv preprint arXiv:2410.20092 , year=","venue":null,"work_id":"f84e0fbd-005f-4e9d-9d5f-4c39b8222a5d","year":2024},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2410.20092","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:635c38fc9b494414c232517d3dfc9b998f8e636896163d551a8fb95fe0db84d1","observation_id":"ae08cfba-9d06-4283-8e67-ce8456143eb3","resolution":{"observed_at":"2026-05-25T05:00:21.633420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1910.00177","doi":"10.48550/arxiv.1910.00177","metadata_source":"pith","pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","venue":"cs.LG","work_id":"ab561983-ab59-4f04-a11e-a467ddde4848","year":2019},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:7b8660b1182b38c3ef40ec61034252d20b4ff10ffba95a9ed662b0798b00cd95","observation_id":"4f95f1fa-c1d1-4f82-b71c-d32fc125678b","resolution":{"observed_at":"2026-05-25T05:00:21.626940Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"35c7d97c-d80b-4601-9f6e-7ef641572532","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:555a876cf6afc8554a4d414dd9b0f554e99eb6f47d96410e166edc0c95ca1fbd","observation_id":"0a415b36-e065-4b2e-bc6b-10067df9ce6d","resolution":{"observed_at":"2026-05-25T12:57:01.571520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06088","last_updated":"2020-10-02T19:49:10Z","snapshot_observed_at":"2026-08-11T00:34:37.369946Z","submitted_at":"2019-12-12T17:26:47Z","title":"Learning to Reach Goals via Iterated Supervised Learning","version":4},"cited_work":{"arxiv_id":"1912.06088","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1912.06088","snapshot_observed_at":"2026-07-04T06:49:37.764826Z","title":"arXiv preprint arXiv:1912.06088 , year=","venue":null,"work_id":"6801049a-1c75-4e1b-8b08-a29a6178bfd8","year":1912},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1912.06088","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:fd4b8ec437aec3b8e022ea6d863cc12b4c4a272a7d173057b25e059c76827ccb","observation_id":"eaa4089d-ea58-428a-b5cd-a7c926920358","resolution":{"observed_at":"2026-05-25T05:00:21.639083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conference on robot learning , pages=","venue":null,"work_id":"b2dc5426-1285-496a-8210-c9bca5f05603","year":2020},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:dd8f0ad5860e2e3973ff74c1e598d69588e44627a42ab8cc0fd337b8e60c7c61","observation_id":"e27b7d8b-5414-41da-a25d-6e676f823416","resolution":{"observed_at":"2026-05-25T12:57:01.463213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.08909","last_updated":"2021-04-19T18:33:47Z","snapshot_observed_at":"2026-08-11T03:22:05.879340Z","submitted_at":"2020-11-17T19:58:56Z","title":"C-Learning: Learning to Achieve Goals via Recursive Classification","version":2},"cited_work":{"arxiv_id":"2011.08909","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.08909","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2011.08909 , year=","venue":null,"work_id":"90cf7c98-c699-4a9a-ae4a-862e17a18ba7","year":2011},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2011.08909","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:9577696704f07b80e55779195985f0ddf2c0a8c2c32a09aa285c2dfc75602516","observation_id":"846e3748-e828-486b-83c9-29c33591af77","resolution":{"observed_at":"2026-05-25T05:00:21.589341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"dcd56711-44d9-4aed-acae-2a209b787b04","year":2018},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:66cbade38bee4d5033e1abe2e067b1572c62d365ddbe5cc97eb4ed4e2141c11f","observation_id":"fc2f3646-0276-4458-9396-0280357e7851","resolution":{"observed_at":"2026-05-25T12:57:01.402492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"61923ed4-06ea-4127-a089-d7c90b225b30","year":2014},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:96e7b237fa384a8949a48ec15ec3927e75efdf1203d833dddf127e286321bcb9","observation_id":"885896cf-0c3d-459a-9d1c-e5fe1b38b8d7","resolution":{"observed_at":"2026-05-25T12:57:01.409632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":"1509.02971","doi":"10.1137/22m1480409","metadata_source":"pith","pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Continuous control with deep reinforcement learning","venue":"cs.LG","work_id":"41a65444-c819-4303-a1f1-b075aa86d40c","year":2015},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:17fb42c0fdba6691948be57cb47b2e1dc42d3f5961ca800014dbb8d0ce880d8e","observation_id":"ce0fc860-4ccc-4ca8-a2a6-61b51c3934bd","resolution":{"observed_at":"2026-05-25T05:00:21.483375Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nature , volume=","venue":null,"work_id":"9b4c5e51-bf8c-42d0-8834-0abfab458321","year":2021},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:7070d954d2e73bdb9f82d19333dc63e25a887f9db73fd7770f13fd0f47e94d64","observation_id":"4779c07b-4e72-4a7e-9571-6c42f3976cbf","resolution":{"observed_at":"2026-05-25T12:57:01.416733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T06:53:24.996054Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"4bd1691c-8ede-4829-8952-b36556534621","year":2017},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:105c8bf5ee0b003ca54826090f9eb1c80802db050ea5446c1568788beec486d8","observation_id":"ce1b883d-2e32-4132-b26f-8ce2c0493491","resolution":{"observed_at":"2026-05-25T12:57:01.538058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1312.5602","doi":"10.48550/arxiv.1312.5602","metadata_source":"pith","pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Playing Atari with Deep Reinforcement Learning","venue":"cs.LG","work_id":"736a8ddf-e365-4940-ad58-4699fddedb86","year":2013},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:8a9fbe845513da7b2c33cffb5d7dc33cb550b7d5a3ba9d8e84ec9376e76be3e5","observation_id":"8c9da459-5b8c-4daa-90df-bc2a10a74395","resolution":{"observed_at":"2026-05-25T05:00:21.494563Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Machine learning , volume=","venue":null,"work_id":"15236db4-ba67-4457-ba1f-f1c64db32413","year":1992},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:2c967fc261ed8ef2f431b23f48495fd7da97ab5309a51309c73d28e50680d2c5","observation_id":"920fddf6-6555-4cf3-bf43-a19a0b0c4c17","resolution":{"observed_at":"2026-05-25T12:57:01.442679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2004.07219","doi":"10.48550/arxiv.2004.07219","metadata_source":"pith","pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","venue":"cs.LG","work_id":"47082e4e-a4a5-418b-bf4f-4667355065fc","year":2020},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:1e9f17a20616a6495a5cb532f7a32b836f528539da20c99be2e276811c201780","observation_id":"ef85e69b-e9fa-42b6-933e-aa3bc3ad74af","resolution":{"observed_at":"2026-05-25T05:00:21.689776Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the IEEE conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"12aa46cb-ace2-495c-9b91-0e34834f7dc4","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:4123b1d628eebae464cb21a749f7ba736639698475d76e0e33453fdd4403608f","observation_id":"e0436518-a597-4e1c-974c-4726733cabe1","resolution":{"observed_at":"2026-05-25T12:57:01.398659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.09605","last_updated":"2018-06-22T18:31:24Z","snapshot_observed_at":"2026-08-10T09:42:34.366913Z","submitted_at":"2018-06-22T18:31:24Z","title":"Many-Goals Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1806.09605","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.09605","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Many-Goals Reinforcement Learning","venue":"cs.LG","work_id":"10be6d04-490e-4ab6-813f-19c2b5837110","year":2018},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1806.09605","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:8413642dc983fa1e7a375a41cb040c8669477d42b6497c6ff92b0a5083d04c7a","observation_id":"5d0c34b7-8fae-4051-8653-58bab0a66ea1","resolution":{"observed_at":"2026-05-25T05:00:21.657746Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4e293a98-4a22-477f-90eb-d7a5c2c9d63f","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:964fd99fdf93431f3dc4fc6f3e77ce2413cf265afdf652bc0be9490ca22cabb6","observation_id":"af11f00a-4282-4325-9e56-b635d0a93919","resolution":{"observed_at":"2026-05-25T12:57:01.420141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":"1607.06450","doi":"10.1007/978-3-319-32025-0","metadata_source":"pith","pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Layer Normalization","venue":"stat.ML","work_id":"20a2d720-0046-4c7c-bcd6-327ec8143f69","year":2016},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:0c0b71e3c3d54640738fdea943cca2daac92d1ac66da2b9ba04c50f5f395b0a9","observation_id":"eb2b5552-7d7f-4699-82e8-3b48a3d2d0f0","resolution":{"observed_at":"2026-05-25T05:00:21.684218Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.11052","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2408.11052 , year=","venue":null,"work_id":"f9e535c2-b74c-4dcf-bb61-30989835ae57","year":2024},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:16a07998819b624e460657e2b70e02aa6c49f348a95554cdf1cd980f9e64137f","observation_id":"70734cf4-43ff-4de7-880b-923e86a2359a","resolution":{"observed_at":"2026-05-25T05:00:21.709103Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:5372298f68e82e695641669d67af389be26f761a623057b6f6cebf0532f93ed5","observation_id":"73d42602-341a-40bf-975d-70201b6ec09c","resolution":{"observed_at":"2026-05-25T05:00:21.668563Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"3fafc9dc-ab4c-4772-9126-189cfcfea46c","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:e425765ac3918098c62804b30e022ff192e817bd2064d1253c99a607356fa578","observation_id":"5b7e3e47-31ef-4c09-8f70-88c4dfb12a9c","resolution":{"observed_at":"2026-05-25T12:57:01.494184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The 10th International Conference on Autonomous Agents and Multiagent Systems-Volume 2 , pages=","venue":null,"work_id":"2e555df0-182e-4e6c-961f-38fd5b8cb5f6","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:cda1bd1346dfd04b80f3af42f6ad7fdeb8fcb3b4ffabfcfed8b76a17493799b6","observation_id":"db47cb35-2c49-4215-a073-e2b38020a232","resolution":{"observed_at":"2026-05-25T12:57:01.395011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IJCAI , volume=","venue":null,"work_id":"40cd143e-640e-4c97-bc8d-2966295a539e","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:df4081527a36ec43e16d0e8be07be6efe3a8e26aa0ff1c3f207b14336256c5cc","observation_id":"16c29563-3d04-4352-96e6-1e7fcea12a45","resolution":{"observed_at":"2026-05-25T12:57:01.470470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":"1812.05905","doi":"10.48550/arxiv.1812.05905","metadata_source":"pith","pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Soft Actor-Critic Algorithms and Applications","venue":"cs.LG","work_id":"bb49c9fb-03b2-4226-9edb-50186b8193e4","year":2018},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:a7aa2cd1aa21ada2178900a2f8fd21f0a249411ddbfc78b85e0e36fb37cc8be1","observation_id":"eacdfee5-c726-48e8-9c5e-b414eb30ab37","resolution":{"observed_at":"2026-05-25T05:00:21.526534Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T21:38:16.985704+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T21:38:16.985704+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T21:38:16.985704+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04811","last_updated":"2025-04-21T20:21:44Z","snapshot_observed_at":"2026-08-10T00:29:50.092385Z","submitted_at":"2024-07-05T18:49:07Z","title":"Simplifying Deep Temporal Difference Learning","version":6},"cited_work":{"arxiv_id":"2407.04811","doi":"10.48550/arxiv.2407.04811","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.04811","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"N., and Martin, M","venue":"arXiv (Cornell University)","work_id":"f0d1dabe-e780-4d33-931c-b0acc3715bd2","year":2024},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2407.04811","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:d6e85f8b07423118cf529fc965a97f8a7710cb88555acd85b23989c7600d0e8f","observation_id":"e7d2bc9c-9f63-4cf8-a1f9-e1d79c416930","resolution":{"observed_at":"2026-05-25T05:00:21.532243Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"4bd78fcd-1f26-45b9-a5a2-1c3792fba837","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:ebfaf0981f0589dcd3bc02287e7d5971c8e550719f6f80134afdf2beb5d8cc74","observation_id":"f80e38c8-199e-4fe1-8cc7-bebed9280699","resolution":{"observed_at":"2026-05-25T12:57:01.384666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"64b56ac3-9719-4b5e-933c-324d3abc7bcf","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:81e1a4d93d575a1ab823d61c58c079adf5a44efe70ce33ce2e6539ea411af0ff","observation_id":"44bb25ba-61cb-4204-add1-c02635e983d4","resolution":{"observed_at":"2026-05-25T12:57:01.366741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.06780","last_updated":"2022-02-12T20:02:13Z","snapshot_observed_at":"2026-08-08T06:33:33.529614Z","submitted_at":"2021-09-14T15:49:31Z","title":"Benchmarking the Spectrum of Agent Capabilities","version":2},"cited_work":{"arxiv_id":"2109.06780","doi":"10.48550/arxiv.2109.06780","metadata_source":"arxiv_reference","pith_arxiv_id":"2109.06780","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2109.06780 , year=","venue":"arXiv (Cornell University)","work_id":"5e62dca0-4c02-4683-96ad-e647234eceee","year":2021},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2109.06780","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:99cf36245f3db83c6d100d84d182c5934073dc394fe0e0040491dbd20c1c0d30","observation_id":"80a7b6c3-2c47-4eb9-866c-864ba20e75fa","resolution":{"observed_at":"2026-05-25T05:00:21.614820Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"042f262c-aa2e-4425-895b-8276529256d0","year":2015},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:e015627673e6e5877b3681f71964479df1233221a37a477611c0146aa1a3a6b4","observation_id":"14c65b74-d112-4edc-a2f9-b3902e17f95f","resolution":{"observed_at":"2026-05-25T12:57:01.534626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:46:29.412244Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"7eb8f595-dc80-4171-b5b3-d43f7af787fc","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:eb8bdbcbf40fe781b486b88ded1328b822cb88ddfde7672bd7f1187ad71658f6","observation_id":"fe773cd8-9cc1-4806-9486-bcd15ebd1fa2","resolution":{"observed_at":"2026-05-25T12:57:01.528166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Machine Learning (","venue":null,"work_id":"f6574d18-b41d-4315-a2c2-e31daa7cfdb7","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:402e281dabeba5421d27115b683d54aa6875e740ff6cd6ed299729c7dc027607","observation_id":"7a8831ee-3cfd-4403-b88b-82736032b44a","resolution":{"observed_at":"2026-05-25T12:57:01.521396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"b8289994-dc95-4b14-92f7-5cc4559f248b","year":2020},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:93955bc69423a8b86359cb40d57478c4c37295bb2e493c9fa0e9b0021bacd6b0","observation_id":"01acba80-1166-4f20-b8b3-18800cafee6a","resolution":{"observed_at":"2026-05-25T12:57:01.406126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00344","last_updated":"2024-06-07T18:52:13Z","snapshot_observed_at":"2026-08-11T00:49:45.752873Z","submitted_at":"2023-11-01T07:37:27Z","title":"A Definition of Open-Ended Learning Problems for Goal-Conditioned Agents","version":4},"cited_work":{"arxiv_id":"2311.00344","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00344","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2311.00344 , year=","venue":null,"work_id":"f9ca5234-e146-44e0-b713-c045c3607528","year":2023},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2311.00344","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:6e8b098fe84bf1cc8aa4bbecf2f9f0e3c87a2d9a2860a5e636825ed2141b4e21","observation_id":"960eb8c0-b296-49d8-8770-ba4ec4b33cca","resolution":{"observed_at":"2026-05-25T05:00:21.578724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"6e521aa4-549d-4dee-9e41-68240e441f8e","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:f6071a3355d2b205979b1a4ecf9937a4916507e844d427d251e0831cd1ca9290","observation_id":"574a5cd4-1088-4430-a1c7-83e2a9d2d359","resolution":{"observed_at":"2026-05-25T12:57:01.391584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"14a7b369-9620-4ab4-82a3-8551962aaf56","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:7c29346b4d2a04fe33582d9129c89c38f92f6c5f5217cc00db67e28717aa7e77","observation_id":"8e198f6e-2fe0-4161-9e0a-af65635bb283","resolution":{"observed_at":"2026-05-25T12:57:01.459865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Journal of Artificial Intelligence Research , volume=","venue":null,"work_id":"b4aa553a-bbb2-4afb-8242-70841605757f","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:13d93178497d6af97274b792f511e7e2008fb87bcc02345dfd87f5d98002ce10","observation_id":"d3e86cb2-797a-4d85-aad2-bf8ef8050021","resolution":{"observed_at":"2026-05-25T12:57:01.370407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"eaf89b35-7d40-43bf-a4e4-81465cb9e778","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:283fa12c9f14761e1367ac60f2154eac46cd5e5a4b7861a7dc5a7297414bada7","observation_id":"c891ce14-c4c5-4631-a7f8-9d52c4e9f273","resolution":{"observed_at":"2026-05-25T12:57:01.346744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"1f38ca69-b531-45fb-b29e-3d1f92cbb01d","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:7a6f5a046fc141d0fd2d9855f6de0d272c16414942a4bfb77c864f723d36f810","observation_id":"be9215cb-7e43-45ee-8a72-03a2fa6983f6","resolution":{"observed_at":"2026-05-25T12:57:01.350470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12894","last_updated":"2018-10-30T17:44:42Z","snapshot_observed_at":"2026-07-06T07:11:32.319931Z","submitted_at":"2018-10-30T17:44:42Z","title":"Exploration by Random Network Distillation","version":1},"cited_work":{"arxiv_id":"1810.12894","doi":"10.48550/arxiv.1810.12894","metadata_source":"pith","pith_arxiv_id":"1810.12894","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploration by Random Network Distillation","venue":"cs.LG","work_id":"5a87fef6-96e2-4d5b-91ec-1a7c9a43cab9","year":2018},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1810.12894","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:44fbcb9b34fcfef40e46ab9248a266e9a8123e3876560850e97ea6982055cf70","observation_id":"56c712f0-855a-4375-ab82-ccc97cb66663","resolution":{"observed_at":"2026-05-25T05:00:21.554660Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.12292","last_updated":"2020-02-29T16:12:58Z","snapshot_observed_at":"2026-08-10T22:27:45.925100Z","submitted_at":"2020-02-27T18:03:16Z","title":"RIDE: Rewarding Impact-Driven Exploration for Procedurally-Generated Environments","version":2},"cited_work":{"arxiv_id":"2002.12292","doi":"10.48550/arxiv.2002.12292","metadata_source":"arxiv_reference","pith_arxiv_id":"2002.12292","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2002.12292 , year=","venue":"arXiv (Cornell University)","work_id":"2d43b8b8-ad54-4100-b5d2-5022a4d363a8","year":2002},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/2002.12292","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:b4534a200faa9506bb52dccfea5ebabf563bdb0bbbef78faaa911d505a965424","observation_id":"e96c06e7-53f4-4751-8899-5b4665cb798f","resolution":{"observed_at":"2026-05-25T05:00:21.466068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:02:41.371632Z","title":"Entropy , volume=","venue":null,"work_id":"ed339a2c-d386-4a27-83b2-eadc7ae05443","year":2023},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:a6455314cfe366956ce1ea7f047f38e05bcf7f519f98d05385c74d24d8526858","observation_id":"7cf73214-8b61-4398-b3a5-9fd7cd2867fe","resolution":{"observed_at":"2026-05-25T12:57:01.490846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"d141d767-fc92-4c45-84cd-54a8cbb3a80c","year":2018},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:1abe6ceec4062556755297cc5908a05acfb180a26a24244031ed711ac342ad93","observation_id":"116034c1-e875-404c-a858-9d451bfb6c70","resolution":{"observed_at":"2026-05-25T12:57:01.487765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:ce09e977f3e7c00ff62c4960bdb3be3a64a3c837b0b74c48b353d731d8fe0d78","observation_id":"b9f52f1f-f1da-4758-a06c-ae5928b5502b","resolution":{"observed_at":"2026-05-25T05:00:21.678792Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T21:21:25.800335Z","title":"Nature , pages=","venue":null,"work_id":"2ed07fc3-1bbe-4bc7-b8e2-23865d712461","year":2025},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:5baa6dfaaf93e158e1355eb3b5738d0e9133d3085cdedd87ffe5d66038251180","observation_id":"597888dd-253a-47c2-ab93-68b044a2a121","resolution":{"observed_at":"2026-05-25T12:57:01.453208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:02:41.373294Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"6caa30e6-7ab6-427a-bb3f-b9985b476b70","year":2020},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:bdcb010ba612bb3a372b55bfbc9c12a48572ef49d5cb421f22a076a84c445543","observation_id":"e9527016-f94a-4781-84b0-beff608333b3","resolution":{"observed_at":"2026-05-25T12:57:01.439103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"984c8e1d-950b-429d-9d73-8877216f9138","year":2019},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:0e939f9b3f29eef04e975a95df4e8a7e69cddc57d7c9bc3db9c3c429fc2f4a44","observation_id":"36c734ad-10da-473d-9624-179a8c35cca7","resolution":{"observed_at":"2026-05-25T12:57:01.377621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.01732","last_updated":"2017-03-06T05:51:42Z","snapshot_observed_at":"2026-08-09T14:19:09.221373Z","submitted_at":"2017-03-06T05:51:42Z","title":"Surprise-Based Intrinsic Motivation for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1703.01732","doi":null,"metadata_source":"pith","pith_arxiv_id":"1703.01732","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Surprise-Based Intrinsic Motivation for Deep Reinforcement Learning","venue":"cs.LG","work_id":"7c0eadc2-c7bd-4ab3-9c29-ef09d845fd39","year":2017},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1703.01732","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:cd6a0c5e38e6fcaada900eb236c2037390f9ff6baee00de7b07e19e9fa531012","observation_id":"386a7fe4-01fd-451e-ae61-29e541b42bef","resolution":{"observed_at":"2026-05-25T05:00:21.607495Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Journal of artificial intelligence research , volume=","venue":null,"work_id":"3399192c-50e3-44bb-baff-f4a7dad8afbe","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:18e3548147ee1d0e1f6e01a1ca2f63526f408676c8e3ac4bae9836c74cc24b94","observation_id":"75c33fa0-2482-4649-aa5b-9f3764f58fce","resolution":{"observed_at":"2026-05-25T12:57:01.381166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:57:59.381366Z","title":"1998 , publisher=","venue":null,"work_id":"71417202-4096-4c43-b2a2-046ff8db0a0e","year":1998},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:e925ce05f55685545253f5b3f84ee0d033b176a4bb59b968e32b45a9321d7579","observation_id":"5903cdbe-c17b-4ac0-b5ed-df1d5af37b29","resolution":{"observed_at":"2026-05-25T12:57:01.480970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"004d7ac2-0038-49b8-80fa-0432a219d7a9","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:9c00fa1f54922c3506fd7d810e76370b1737b167d4880a65eb9437842a41d7d0","observation_id":"ab88ab2e-0103-4b12-9ff2-f8fb29d9ae77","resolution":{"observed_at":"2026-05-25T12:57:01.531362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1954 , publisher=","venue":null,"work_id":"eff17d4d-441b-4ef2-be10-6761df6caa92","year":1954},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:c49e9fe38a711c0d5ae1568d2ace193626d1d2921a5a5008bdd8538aebabe7ca","observation_id":"b3405a3b-b26c-4de9-b5fb-ebbb7e822a8f","resolution":{"observed_at":"2026-05-25T12:57:01.504166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2013 , publisher=","venue":null,"work_id":"8cb9ef0b-e1fc-4817-8f1d-b76a13fd4a2e","year":2013},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:c1c295d54b60ffe557fec5d3082c36fd783928364deda21d1846bef82fb8c1b7","observation_id":"a3030b80-f81e-4b42-8bb3-93ba10df4500","resolution":{"observed_at":"2026-05-25T12:57:01.362927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Annual Review of Developmental Psychology , volume=","venue":null,"work_id":"6409b062-7103-419c-b941-487bfb58e343","year":2020},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:4184db81b7a513e9ae193b82fc22acd69dac817dd29cd5c9693e4d88ed50fc96","observation_id":"84ef7c20-efba-4a2a-8be8-c33560fcee94","resolution":{"observed_at":"2026-05-25T12:57:01.582191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T06:53:24.933626Z","title":"Artificial intelligence , volume=","venue":null,"work_id":"7b18c3d8-a603-41e0-885a-e6a0bd8f081c","year":1998},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:659f16d9c4fb45de5bb86c2053adb31997615328bce3943c755d8c28677d380f","observation_id":"e9253500-14a0-4a74-9d8f-14b6f0219acc","resolution":{"observed_at":"2026-05-25T12:57:01.565350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Transactions on Autonomous Mental Development , volume=","venue":null,"work_id":"b9d302a1-7649-4c43-8582-4dd46286dca8","year":2010},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:893ac33680b3f72cbca1488fe4cdac24bd37e89f8abadab17ebb3e6460256d09","observation_id":"8d5b2268-0905-4a0d-bbca-e8ad29649a9c","resolution":{"observed_at":"2026-05-25T12:57:01.388352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"0d6b94ec-1263-43bf-aa3a-3466ef7f0a6e","year":null},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:91fb1858501164ea24fbb409dff868983c74660a7327552bd1411ddbd3f55ae7","observation_id":"5d9d719f-0331-4b7d-9abf-3f8d58efb927","resolution":{"observed_at":"2026-05-25T12:57:01.427918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Frontiers in psychology , volume=","venue":null,"work_id":"eadf8426-70d1-4d95-8766-7a0986c51cc2","year":2014},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:2b202d2f456df1f9cf0fd996ba03a1785a69be8a1373966ccc3f3e2e45195516","observation_id":"710013d0-10f1-4f8c-9d45-f7bda8d4f959","resolution":{"observed_at":"2026-05-25T12:57:01.359885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":24,"parse_uncertain":0,"unresolved":3,"verified_exact":16,"verified_fuzzy":57},"total_outbound_references":114},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 114 outbound references and 0 inbound Pith citation observations for arXiv:2605.23551."}