{"as_of":"2026-08-19T02:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:59d7fd977b918b16519251e16ebad1267ebd1bbc7b607adbb41c757e0ed0f2e2","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:02:25.268972Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T19:24:48.899301Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:17:57.466822Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.03172","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03172","snapshot_observed_at":"2026-07-03T10:17:57.466822Z","title":"Chuck, F","venue":null,"work_id":"1f368283-82ff-4831-94cf-d88b2db09424","year":2025},"citing_paper":{"arxiv_id":"2606.11525","last_updated":"2026-06-10T00:06:24Z","snapshot_observed_at":"2026-07-06T23:50:35.052764Z","submitted_at":"2026-06-10T00:06:24Z","title":"Learning Object Manipulation from Scratch via Contrastive Interaction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T10:10:21.427118Z"},"links":{"cited_paper":"/paper/2505.03172","citing_paper":"/paper/2606.11525"},"observation_digest":"sha256:56c5f5e5e5e4a315a2729e9cd584a1e8f08edeab1194ca8bcae4a4527388ec92","observation_id":"bff3c7ac-d901-474e-ae20-3a9ccb9cd32b","resolution":{"observed_at":"2026-07-03T10:17:57.468138Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03172","snapshot_observed_at":"2026-07-11T19:24:48.899301Z","title":"Null counterfactual factor interactions for goal-conditioned reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04409","last_updated":"2026-07-05T17:02:40Z","snapshot_observed_at":"2026-08-13T11:30:46.774675Z","submitted_at":"2026-07-05T17:02:40Z","title":"Learning Task-Sufficient World Models by Synergizing Agentic Exploration and Structured Modeling","version":1},"reference_index":128,"source":"arxiv_source","source_observed_at":"2026-07-11T19:24:48.899301Z"},"links":{"cited_paper":"/paper/2505.03172","citing_paper":"/paper/2607.04409"},"observation_digest":"sha256:abe77a7a88482c90805739bc5fa38cbf766e64797204915ac121dcba362b4b9d","observation_id":"025d3946-0f75-4394-ad5f-2c47d0b01249","resolution":{"observed_at":"2026-07-11T19:24:48.899301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.03172/citation-record","integrity":"/paper/2505.03172/integrity","json":"/paper/2505.03172/citation-record.json","paper":"/paper/2505.03172"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:24.904907Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.904907Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:2ab7bfc9db12c156ec1d7fa4fd328f656307b824a9d37e9210dbdde72af88612","observation_id":"de6667e7-e93d-4165-939d-cf26975d4f22","resolution":{"observed_at":"2026-08-16T00:02:24.904907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.535668Z","title":"f-policy gradients: A general framework for goal-conditioned rl using f-divergences","venue":null,"work_id":"5a817448-9d51-4be3-8f4a-b83daf1bc0ee","year":2023},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.913450Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:e7dfec78b63350116b6e6ff501a1e71ffa7dc27a53b1513d18234ae468d3b375","observation_id":"aaf233bf-ed7f-489c-9693-4f304d4a8890","resolution":{"observed_at":"2026-08-16T00:02:26.540873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:24.919694Z","title":"Hindsight experience replay","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.919694Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:50c89d3db7b0cfab30dbd02fd88e3e3714153923fdbe01a1ac3199aacce0d661","observation_id":"1c2b49ea-3dbd-403a-a73d-6ec5d2cac94a","resolution":{"observed_at":"2026-08-16T00:02:24.919694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.511801Z","title":"Addressing hindsight bias in multigoal reinforcement learning","venue":null,"work_id":"f27f20c3-ccc5-4da1-ba95-8f9864a6572b","year":2021},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.924745Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:209556bb3d11120b97961daca82beb5e82a8cbbafb2f711451d93f4cb019ec3f","observation_id":"497559a4-9810-4424-85fc-a60e506f6a78","resolution":{"observed_at":"2026-08-16T00:02:26.515983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10992-021-09601-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.322990Z","title":"Causal sufficiency and actual causation","venue":null,"work_id":"cb4be934-3a91-49b6-bf50-585b93433003","year":2021},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.935744Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:ee329c38f5e37a3f4ef8c7b5adf85e2e0bbde380727fa14c2df16e23aeb83075","observation_id":"8cf70840-a663-42f3-a81e-9eb18edec4ca","resolution":{"observed_at":"2026-08-16T00:02:25.337356Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-16T06:31:05.323602+00:00","source":"paper_reference_links","state":"open"},"event_date":"2021-08-27","event_type":"correction","notice_doi":"10.1007/s10992-021-09632-6","provenance":{"observed_at":"2026-07-11T03:08:57.661574+00:00","source":"crossref","source_record_id":"10.1007/s10992-021-09632-6->10.1007/s10992-021-09601-z:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1302.3562","last_updated":"2013-02-13T14:12:34Z","snapshot_observed_at":"2026-08-17T06:12:29.554126Z","submitted_at":"2013-02-13T14:12:34Z","title":"Context-Specific Independence in Bayesian Networks","version":1},"cited_work":{"arxiv_id":"1302.3562","doi":null,"metadata_source":"pith","pith_arxiv_id":"1302.3562","snapshot_observed_at":"2026-08-16T00:02:25.766848Z","title":"Context-Specific Independence in Bayesian Networks","venue":"cs.AI","work_id":"bd7c4fc0-808f-4f8b-82d3-ad7e862316d9","year":2013},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.941077Z"},"links":{"cited_paper":"/paper/1302.3562","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:5f87026490adba00c2a9b193f8278bd0b4fe1a688948f9392502950bb4dbec9c","observation_id":"d9b65a1e-9b31-4ab0-84f9-c7e0b81904c8","resolution":{"observed_at":"2026-08-16T00:02:25.774506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.06272","last_updated":"2018-11-15T10:08:58Z","snapshot_observed_at":"2026-08-17T05:50:28.481844Z","submitted_at":"2018-11-15T10:08:58Z","title":"Woulda, Coulda, Shoulda: Counterfactually-Guided Policy Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.06272","snapshot_observed_at":"2026-08-16T00:02:24.946891Z","title":"Woulda, coulda, shoulda: Counterfactually-guided policy search","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.946891Z"},"links":{"cited_paper":"/paper/1811.06272","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:eedb11ebae2ad9fe172e2fdc4261516b90c6f39aeaa186dec1ee14016a8d9402","observation_id":"ea98d967-7b78-40d3-bb19-480c09067b4d","resolution":{"observed_at":"2026-08-16T00:02:24.946891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:24.954473Z","title":"Goal-conditioned reinforcement learning with imagined subgoals","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.954473Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:875408dc03aeda051d0353294fb853f3a9693947f4d380e4209a566122fc60c1","observation_id":"6b00cb03-36e2-4c9f-b0c3-ae3ea758f87c","resolution":{"observed_at":"2026-08-16T00:02:24.954473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.490451Z","title":"Hypothesis-driven skill discovery for hierarchical deep reinforcement learning","venue":null,"work_id":"368f3ebd-a60b-4908-b32b-b64912c98f3b","year":2020},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.959823Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:c37741fa64edde6c854b7c71c09bcaee80ec9d6f35f352798a8c8dc65a9b3963","observation_id":"e2f64428-e9f8-4850-a6a0-8d3ef6b2e09e","resolution":{"observed_at":"2026-08-16T00:02:26.494914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09509","last_updated":"2024-10-20T01:41:59Z","snapshot_observed_at":"2026-08-16T15:23:30.459840Z","submitted_at":"2023-06-15T21:06:54Z","title":"Granger Causal Interaction Skill Chains","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09509","snapshot_observed_at":"2026-08-16T00:02:24.964605Z","title":"Granger-causal hierarchical skill discovery","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.964605Z"},"links":{"cited_paper":"/paper/2306.09509","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:1c7e8972793013948615e382469612e5365eface8ed47961bab12d626abe9a2e","observation_id":"a4c09fbe-3bdd-4baa-81cc-c63ed4e91e9c","resolution":{"observed_at":"2026-08-16T00:02:24.964605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03113","last_updated":"2024-05-06T02:13:08Z","snapshot_observed_at":"2026-08-17T20:01:45.476177Z","submitted_at":"2024-05-06T02:13:08Z","title":"Robot Air Hockey: A Manipulation Testbed for Robot Learning with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03113","snapshot_observed_at":"2026-08-16T00:02:24.969506Z","title":"Robot air hockey: A manipulation testbed for robot learning with reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.969506Z"},"links":{"cited_paper":"/paper/2405.03113","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:f28db558826989d4c2095b2869a48349fdb63fb99210b1f1a4890d76e279e59e","observation_id":"347c151f-ea00-4823-8b1f-b36e9d55d65a","resolution":{"observed_at":"2026-08-16T00:02:24.969506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10883","last_updated":"2024-04-16T20:04:29Z","snapshot_observed_at":"2026-08-16T14:00:22.680120Z","submitted_at":"2024-04-16T20:04:29Z","title":"Automated Discovery of Functional Actual Causes in Complex Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10883","snapshot_observed_at":"2026-08-16T00:02:24.974838Z","title":"Automated discovery of functional actual causes in complex environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.974838Z"},"links":{"cited_paper":"/paper/2404.10883","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:48aeedc48b54f2ea24c4c47177687abf54ec0353820435958feb0844b6f1cf51","observation_id":"e14721c9-eac5-404e-be67-44a32ceb19f5","resolution":{"observed_at":"2026-08-16T00:02:24.974838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:24.980431Z","title":"Curriculum-guided hindsight experience replay","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.980431Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:9e402e4d090740489247db129a06c4c963a1fd09b2636a2e1df31943e2d8e8a1","observation_id":"b89904c0-198e-4a33-bacd-6cfcf916570f","resolution":{"observed_at":"2026-08-16T00:02:24.980431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.468153Z","title":"Learning dynamic attribute-factored world models for efficient multi-object reinforcement learning","venue":null,"work_id":"9a686761-3e0d-44a1-ab5e-5f2102fda319","year":2024},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.986363Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:b416662e348a986164d5d95bdd7f6f96cd007d8dbddc3e67c2b8615e8b5db940","observation_id":"901e6cd5-7640-4c2d-8f7a-9d64bbc02f08","resolution":{"observed_at":"2026-08-16T00:02:26.472752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.454020Z","title":"Relay policy learning: Solving long-horizon tasks via imitation and reinforcement learning","venue":null,"work_id":"b7147336-a770-4900-a1f8-18828b62062b","year":2019},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.991298Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:7273be04c8d1b7f92e4e5fffd84e0f4ee301c9cdc40c4d25af15e7fd32dedd97","observation_id":"33454f7b-fb16-42d7-8369-32512884e7bb","resolution":{"observed_at":"2026-08-16T00:02:26.458696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:24.995505Z","title":"Actual causality","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:24.995505Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:787baf6440dc7b4c9955ebd6f028c1e0fc65da355f60f946ac619cc30175c177","observation_id":"11573ea3-6cae-465f-b17b-fa77e955c625","resolution":{"observed_at":"2026-08-16T00:02:24.995505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.430868Z","title":"On discovery of local independence over continuous variables via neural contextual decomposition","venue":null,"work_id":"e661b1ac-2ed9-4a05-b8db-7d65d2202a5c","year":2023},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.000679Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:4725d48cd10765be3bf3ae1bf692ef37f292fd3b49e1b630499ecba21a57ebb7","observation_id":"1fe0ca21-43b8-47bf-ab36-7d506e0cabc1","resolution":{"observed_at":"2026-08-16T00:02:26.435643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.007507Z","title":"Learning to achieve goals","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.007507Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:59e2d5b410921f57819d1617c39abb960e434cd4e11bf7a102a7bbf7e0408d7a","observation_id":"7cb131d4-bb69-4184-8b2f-cb81319c0a60","resolution":{"observed_at":"2026-08-16T00:02:25.007507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.405640Z","title":"Efficient reinforcement learning in factored mdps","venue":null,"work_id":"4fdbe7ae-e688-4e08-8ddf-68158a9d9352","year":1999},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.012806Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:4df0c17e7bcf229172a4f51d7dc3010ebf5bdefd9d7b5522158cb30519a0d18c","observation_id":"64188320-6b22-498b-a0d5-fddf62337026","resolution":{"observed_at":"2026-08-16T00:02:26.411332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.391067Z","title":"What can i do here? learning new skills by imagining visual affordances","venue":null,"work_id":"da8df05a-f794-438b-94a0-c10795c8e9f9","year":2021},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.017720Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:0b3af252e4a73e2535288de2d7e29fa17d24bd405d21d42e3c4ffffcc0557ed6","observation_id":"b736f29e-43fa-49e3-a952-8c7579c6b737","resolution":{"observed_at":"2026-08-16T00:02:26.395144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-16T00:02:25.022369Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.022369Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:d3c9c408102d95e309ca998df7c490f3fb893e023acfd72a8b50ac1c178d587d","observation_id":"08c0191a-3917-4590-aedf-585cac56f6bd","resolution":{"observed_at":"2026-08-16T00:02:25.022369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.031963Z","title":"Kipf and Max Welling","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.031963Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:ce9497af935fbe26353ab1c0d16710b3a1b877a9b78799151e5369b01c7a5091","observation_id":"eaba6b82-8999-4235-af03-402bbeb4dc9f","resolution":{"observed_at":"2026-08-16T00:02:25.031963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02070","last_updated":"2018-09-07T00:31:16Z","snapshot_observed_at":"2026-08-14T18:32:05.285246Z","submitted_at":"2018-09-06T16:08:39Z","title":"ARCHER: Aggressive Rewards to Counter bias in Hindsight Experience Replay","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02070","snapshot_observed_at":"2026-08-16T00:02:25.039191Z","title":"Archer: Aggressive rewards to counter bias in hindsight experience replay","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.039191Z"},"links":{"cited_paper":"/paper/1809.02070","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:06635eada8363af2ffc35f1c53115f756169afabcfb2e25548aed6075ca4e210","observation_id":"ec83703a-3704-4f1f-ac43-febae58e29ea","resolution":{"observed_at":"2026-08-16T00:02:25.039191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.369100Z","title":"Generalized hindsight for reinforcement learning","venue":null,"work_id":"b4857081-e039-439d-bd37-1d1b4cbfffc3","year":2020},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.050032Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:06617fedda432850fd72f4a297a377aea6fe63fe6ef3df81bace4bcff6b69dea","observation_id":"8c6db143-3ac0-48c4-8935-75f18d73d6a2","resolution":{"observed_at":"2026-08-16T00:02:26.374154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-16T00:02:25.056399Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.056399Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:7ab0aa1dc293a2c6e57bd0ea1a269bfd597e5995e3dd0db0de5c7f0940d02868","observation_id":"d8eabd5f-6da3-4de4-8012-715d8c3d65be","resolution":{"observed_at":"2026-08-16T00:02:25.056399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.347896Z","title":"Biscuit: Causal representation learning from binary interactions","venue":null,"work_id":"5ab6ccff-34ef-4af5-aa59-49c33fe0220a","year":2023},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.061782Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:3cf56cd5862a5fe70ea39c85a3e84aa296d6b16177407bc3b058df3571db9f0a","observation_id":"083a4f31-92d2-467e-997a-3848e65441e2","resolution":{"observed_at":"2026-08-16T00:02:26.354071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.324346Z","title":"Goal-conditioned reinforcement learning: Problems and solutions","venue":null,"work_id":"3d0b8235-f77e-450b-a926-620a6f45afb1","year":2022},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.066705Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:db288079228bb2dd50fcc326caa4587898d1f51a58767edf0ca164a6ca86c94a","observation_id":"f56e2e25-3703-468f-8073-2fc7b8334295","resolution":{"observed_at":"2026-08-16T00:02:26.330026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.306305Z","title":"Physgen: Rigid-body physics-grounded image-to-video generation","venue":null,"work_id":"d83f5170-8e3a-4024-919f-368e099820df","year":2024},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.073188Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:0e88e178020db72e5d7ff228ddd51389294479ffec7e607e3916596f99a01fcf","observation_id":"555f929e-1d8c-490b-9fa8-e45597252d4f","resolution":{"observed_at":"2026-08-16T00:02:26.311597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.290449Z","title":"Offline goal-conditioned reinforcement learning via f -advantage regression","venue":null,"work_id":"8a8b6deb-bfdb-421f-89d3-6c3ded0646a3","year":2022},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.080061Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:2d7038c728a378ad6c6ed4a5f1af5a6fd8715906774ea6986c931eb8916b667f","observation_id":"8037f7f6-1063-421e-a8dd-7364ef221da9","resolution":{"observed_at":"2026-08-16T00:02:26.295375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.110794Z","title":"Localizing external contact using proprioceptive sensors: The contact particle filter","venue":null,"work_id":"4422b8e1-b825-4cd4-b8bf-46e066d5a7e9","year":2016},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.088740Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:a6a0051e7d24fa2beb92611e7f06baae741aba0e7f69f2be5a3178e639fa2d5b","observation_id":"f06681ba-d77f-4a70-af52-7756408c7417","resolution":{"observed_at":"2026-08-16T00:02:26.115530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.093915Z","title":"Visual reinforcement learning with imagined goals","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.093915Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:2aa8c766be3c8c024048287906e35cca54695149054954d57e94be0b3d3d1983","observation_id":"4b96771a-884f-41a5-b09f-60736a0b059e","resolution":{"observed_at":"2026-08-16T00:02:25.093915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.099785Z","title":"Causality","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.099785Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:1b2d72225c143068cbd87852d9032bafb9fbe90102f033ddf271f55319e5dd14","observation_id":"4c52e925-0e37-491a-af7d-ad9ceca80905","resolution":{"observed_at":"2026-08-16T00:02:25.099785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:26.070953Z","title":"Counterfactual data augmentation using locally factored dynamics","venue":null,"work_id":"b3b095bd-eacf-4af1-b6b2-20e4563ef7a6","year":2020},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.104966Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:d91c4d28e07f1cef231943080230f6b6ef4659c49f87b2ecbfc338c292437a54","observation_id":"d84bafcf-d95c-4be6-9b24-5ff82f80e882","resolution":{"observed_at":"2026-08-16T00:02:26.076691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.116309Z","title":"Mocoda: Model-based counterfactual data augmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.116309Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:43393102965623e974f6a36d0dda35345954f2e8e099257cf2a0c5f95b7d7b5f","observation_id":"1d96526e-bb26-4d23-ad12-ff9b3663c434","resolution":{"observed_at":"2026-08-16T00:02:25.116309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.121572Z","title":"Markov decision processes","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.121572Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:b07b6da32aca5394803e5db4ac80721bd090d29706a15485bc8044167bb80285","observation_id":"e28dce80-3ce6-4c9b-a68e-26866d0816f1","resolution":{"observed_at":"2026-08-16T00:02:25.121572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.126440Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.126440Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:2cfe08f9eea7e56f680ab025d0a2aad3941b744769fb6f2c45de91565cc3a206","observation_id":"117f1dbd-9441-4200-82cf-ced734e30d91","resolution":{"observed_at":"2026-08-16T00:02:25.126440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.131560Z","title":"The graph neural network model","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.131560Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:6c959214d282531759c4ce0464f42ba019ea20ac03aabca8bc20c80b37561c87","observation_id":"11b11c4f-3665-4f2b-9cf4-3a7e8eaeaf13","resolution":{"observed_at":"2026-08-16T00:02:25.131560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.05952","last_updated":"2016-02-25T17:55:31Z","snapshot_observed_at":"2026-08-15T17:33:32.559096Z","submitted_at":"2015-11-18T20:54:44Z","title":"Prioritized Experience Replay","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.05952","snapshot_observed_at":"2026-08-16T00:02:25.143483Z","title":"Prioritized experience replay","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.143483Z"},"links":{"cited_paper":"/paper/1511.05952","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:08967e188e2bc4087a9d6370d23a69014dbb97fc6065630af2a313bef8833139","observation_id":"84dba734-a45f-4546-962b-d469b55778ba","resolution":{"observed_at":"2026-08-16T00:02:25.143483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.152826Z","title":"Causal influence detection for improving efficiency in reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.152826Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:a6906925f78525e2b1f481c5d846b16690cfd49c51c7493553a9edba8e0e4770","observation_id":"02fcd7de-b522-435c-a793-75cdde9175aa","resolution":{"observed_at":"2026-08-16T00:02:25.152826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.978391Z","title":"Smore: Score models for offline goal-conditioned reinforcement learning","venue":null,"work_id":"73a66ced-8af8-4672-91ee-7e3331b8548b","year":2024},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.159468Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:40c264c69018126fbe57e246103e4e2995c241f03377b8d6baf2c15f1386e44e","observation_id":"bec3d182-b5fc-419f-b86a-d48ec9c88165","resolution":{"observed_at":"2026-08-16T00:02:25.983311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.957589Z","title":"Score models for offline goal-conditioned reinforcement learning","venue":null,"work_id":"6c11b17a-d2c1-406f-a69d-23b340756195","year":2024},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.166116Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:d946472199dac2daa1810af4060d8d36aa7158fe0dd379c3754fb8965d15abc4","observation_id":"e9dcec3e-b5cf-4566-a532-c35284aee9c5","resolution":{"observed_at":"2026-08-16T00:02:25.964040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.174953Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and go through self-play","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.174953Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:6ae769adb7920a6a283b7c4861154cd04fa2fe8004ed03c24db81e864309d1c0","observation_id":"aff5685e-73cb-454f-b8d7-8c97effb158a","resolution":{"observed_at":"2026-08-16T00:02:25.174953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.180306Z","title":"Solving olympiad geometry without human demonstrations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.180306Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:e27620212a3d9e79f3d2d31b72d61d56da69fad1a82180bd232f46a778936aaa","observation_id":"891fbc53-ae02-419c-9758-ce37d2ec00d4","resolution":{"observed_at":"2026-08-16T00:02:25.180306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18917","last_updated":"2024-12-12T10:39:06Z","snapshot_observed_at":"2026-08-18T05:00:48.578941Z","submitted_at":"2024-05-29T09:19:50Z","title":"Causal Action Influence Aware Counterfactual Data Augmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18917","snapshot_observed_at":"2026-08-16T00:02:25.185951Z","title":"Causal action influence aware counterfactual data augmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.185951Z"},"links":{"cited_paper":"/paper/2405.18917","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:3c44db8a106e545282cb69da294f32190503192d3e0f037d3437d8cd360b9bb1","observation_id":"4c7f8914-8684-4053-8bb2-873979bda6a2","resolution":{"observed_at":"2026-08-16T00:02:25.185951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.192053Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.192053Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:dedc5fcdc703a0887506527d41f4fae953f1294f9aee3d2ab7b7bb57fbcd7b0a","observation_id":"3c9694a1-6e85-4b2f-b5a1-3c054f8ce88c","resolution":{"observed_at":"2026-08-16T00:02:25.192053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.13452","last_updated":"2022-06-27T17:02:53Z","snapshot_observed_at":"2026-08-16T16:50:04.303900Z","submitted_at":"2022-06-27T17:02:53Z","title":"Causal Dynamics Learning for Task-Independent State Abstraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.13452","snapshot_observed_at":"2026-08-16T00:02:25.200321Z","title":"Causal dynamics learning for task-independent state abstraction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.200321Z"},"links":{"cited_paper":"/paper/2206.13452","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:a12c6eea2259d27b35f1108e5fdfad6e0fc02ab5f9d4cbad92c9e7da17ac25aa","observation_id":"d4bac299-5dae-44a9-9cd8-b16f77860cc3","resolution":{"observed_at":"2026-08-16T00:02:25.200321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.896243Z","title":"Elden: Exploration via local dependencies","venue":null,"work_id":"8a94324f-af16-4b15-9e8b-03b58e62f56b","year":2023},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.205055Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:66d0056e43bcd793d03f0b134e5c17e85be3379c21468e5468995b2bc986f741","observation_id":"a80bbe70-abd3-4c69-9ab0-402f937277ea","resolution":{"observed_at":"2026-08-16T00:02:25.902091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.09275","last_updated":"2019-08-14T10:36:39Z","snapshot_observed_at":"2026-08-15T19:03:00.346833Z","submitted_at":"2019-05-22T17:59:32Z","title":"COBRA: Data-Efficient Model-Based RL through Unsupervised Object Discovery and Curiosity-Driven Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.09275","snapshot_observed_at":"2026-08-16T00:02:25.212560Z","title":"Cobra: Data-efficient model-based rl through unsupervised object discovery and curiosity-driven exploration","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.212560Z"},"links":{"cited_paper":"/paper/1905.09275","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:9eb52599f9e92257ee1888ccf91dae2bd56c3b383f7f322846b94e1e402aa24e","observation_id":"4f4e152f-e565-4ec5-9e26-7d537ab0056c","resolution":{"observed_at":"2026-08-16T00:02:25.212560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.219170Z","title":"Outracing champion gran turismo drivers with deep reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.219170Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:26bfa495754eab30d1404e6a640c0dae5b02adf06776a298055cd7d4968a9f0c","observation_id":"042e9aa3-1da7-4197-a4c8-5476fce69c01","resolution":{"observed_at":"2026-08-16T00:02:25.219170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08039","last_updated":"2020-05-24T08:15:29Z","snapshot_observed_at":"2026-08-14T17:13:50.995356Z","submitted_at":"2019-02-20T12:31:23Z","title":"Curiosity-Driven Experience Prioritization via Density Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.08039","snapshot_observed_at":"2026-08-16T00:02:25.226592Z","title":"Curiosity-driven experience prioritization via density estimation","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.226592Z"},"links":{"cited_paper":"/paper/1902.08039","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:4eb13dc5c27d91a63b3c80c177f1f16bbf5feb5bfc0cf80fe7325910984d03e3","observation_id":"9c04bc77-5ad6-483b-ae2e-7c6af0732dfe","resolution":{"observed_at":"2026-08-16T00:02:25.226592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.873496Z","title":"Maximum entropy-regularized multi-goal reinforcement learning","venue":null,"work_id":"03955d1a-9c75-424d-bc30-9c244861047a","year":2019},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.234966Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:17c727a631b98157f6c591e57c03a4170900fc9b7215da17cf26599456c5e520","observation_id":"85a1196c-7b75-47d1-b2b8-eaf8cdba2867","resolution":{"observed_at":"2026-08-16T00:02:25.879303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.854852Z","title":"How does goal relabeling improve sample efficiency? In Forty-first International Conference on Machine Learning, 2024","venue":null,"work_id":"af1dbf32-14b3-48f2-aa99-6fc10e1a6b8f","year":2024},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.240414Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:112d3efe890d48fd530bdd5f820822657a8215d3b154cab3421cb04c5f07397f","observation_id":"a930b131-6e99-4118-b918-6fc59d69e033","resolution":{"observed_at":"2026-08-16T00:02:25.861404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-08-19T01:31:41.184872Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-08-16T00:02:25.246913Z","title":"robosuite: A modular simulation framework and benchmark for robot learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.246913Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:94e6c81f2f881788fa2757ec89e9fc1bc24117746d4f0175f7e587bec50f4bfa","observation_id":"2c4382d2-cbca-406f-af04-dc7c68dbf861","resolution":{"observed_at":"2026-08-16T00:02:25.246913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.255816Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.255816Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:3053bb5e2549b8908ea71c0330a8f47c8a71bdb2f7b424c3d53be486722c8aa1","observation_id":"5ab8f9aa-2e65-4e48-a791-8e9435aa32e6","resolution":{"observed_at":"2026-08-16T00:02:25.255816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:02:25.263362Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.263362Z"},"links":{"citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:1485f5a4c52e7e8136a301a66f0fd78ca208e76ccd731ce541d548aa933edae6","observation_id":"5b1e1e92-0ad5-4bae-a639-a9de573b3632","resolution":{"observed_at":"2026-08-16T00:02:25.263362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.12000","last_updated":"2020-04-07T12:48:26Z","snapshot_observed_at":"2026-08-06T14:00:25.895988Z","submitted_at":"2019-09-26T09:34:48Z","title":"CoPhy: Counterfactual Learning of Physical Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.12000","snapshot_observed_at":"2026-08-16T00:02:25.268972Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T00:02:25.268972Z"},"links":{"cited_paper":"/paper/1909.12000","citing_paper":"/paper/2505.03172"},"observation_digest":"sha256:2ad3f675352df4179b639db2b42dc0829573191ec4b08fad8fd31dea48c98932","observation_id":"9453b88d-3fba-4aaa-8122-965978f53a6b","resolution":{"observed_at":"2026-08-16T00:02:25.268972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.03172","last_updated":"2025-05-06T04:32:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T05:51:22.495131Z","submitted_at":"2025-05-06T04:32:47Z","title":"Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":2,"verified_fuzzy":20},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 2 inbound Pith citation observations for arXiv:2505.03172."}