{"as_of":"2026-08-08T11:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:268aa846c5a98c17b075cba3fc2cdccb15576aeb5868b60d9ec9013e8470c468","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:51:37.495684Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T01:13:11.483599Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:38:55.871103Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"cited_work":{"arxiv_id":"2507.14901","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.14901","snapshot_observed_at":"2026-07-03T20:38:55.871103Z","title":"arXiv preprint arXiv:2507.14901 , year=","venue":null,"work_id":"0ad7ef3f-d394-4143-87c9-b257ceb74b4f","year":null},"citing_paper":{"arxiv_id":"2606.18089","last_updated":"2026-07-05T17:40:26Z","snapshot_observed_at":"2026-07-12T13:34:39.011240Z","submitted_at":"2026-06-16T15:55:28Z","title":"From Reasoning Traces to Reusable Modules: Understanding Compositional Generalization in Language Model Reasoning","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-06-27T01:13:11.483599Z"},"links":{"cited_paper":"/paper/2507.14901","citing_paper":"/paper/2606.18089"},"observation_digest":"sha256:ac37a466fe3893a5cf7e91fee506d5457f6f53df3dcf4e35cab019b03139ed32","observation_id":"750427c3-6156-4f82-80be-4ce14ec2e6ed","resolution":{"observed_at":"2026-07-03T20:38:55.872495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.14901/citation-record","integrity":"/paper/2507.14901/integrity","json":"/paper/2507.14901/citation-record.json","paper":"/paper/2507.14901"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.345101Z","title":"Mastering the game of Go with deep neural networks and tree search","venue":null,"work_id":"9f0ddcf7-67e8-41ff-9ef0-bc945a76fa33","year":2016},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.266533Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:bbfcf7ab3958054ec9b1bac5837f2c29a031d42d1d3606bd9b2180d3747e5764","observation_id":"c996a0ed-63c1-43bc-acea-b116e46d4fae","resolution":{"observed_at":"2026-08-06T15:51:38.350707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T15:51:37.272028Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.272028Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:0fc4ee214d4815c9e75a5bca28d0f559a99b904faf0af6533a00769c7d59350b","observation_id":"d3a92e27-364d-4403-8015-737a8d3a7b7d","resolution":{"observed_at":"2026-08-06T15:51:37.272028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.323060Z","title":"Reinforcement learning in robotics: A survey","venue":null,"work_id":"0ffd70f6-99f6-4a39-ba07-34372f35ad8c","year":2013},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.278064Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:27222b2268372731c2010f6c2f4f0fb1d62599ca1779458465481e062de006ba","observation_id":"13efe497-c48a-4eb8-b7f2-aa9cd992a0a9","resolution":{"observed_at":"2026-08-06T15:51:38.330692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.294369Z","title":"Resource management with deep reinforcement learning","venue":null,"work_id":"42e568fa-251b-4dbb-b9f4-70f3d2ff65e3","year":2016},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.283822Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:d7ab0cb309553d1c8e635091e926fe28193669cbee3aeac6339510f0eab40f3a","observation_id":"9c5ddcdc-76b8-4b30-b285-98c9dcfb7fc1","resolution":{"observed_at":"2026-08-06T15:51:38.302120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-08-06T15:51:37.289123Z","title":"End to end learning for self-driving cars","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.289123Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:ad9e061003d4994002f92fe6e543dfb383d1ac6dbd06358136eaab83cea25ee3","observation_id":"f6bc40c8-296c-41b7-831f-8d63d4b72b9c","resolution":{"observed_at":"2026-08-06T15:51:37.289123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.271994Z","title":"Reinforcement learning based recommender systems: A survey","venue":null,"work_id":"4419be4c-c13e-4478-8b29-0f58bfcc1918","year":2022},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.294637Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:e8b4a9f44aca2358d4f0ed5c11d335cb8bb389b741a6e9c4d38b9c76991e1e84","observation_id":"5f3ee64d-9fcd-4e88-934d-8000b51c2f17","resolution":{"observed_at":"2026-08-06T15:51:38.277061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.252288Z","title":"A review on reinforcement learning: Introduction and applications in industrial process control","venue":null,"work_id":"8c245379-2f2d-4d49-8789-0a907901b5ba","year":2020},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.301545Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:f07a81184f58dce64ee5620a2495569c3d24cc4d2e88ee1d6162ee1e6d9c4d09","observation_id":"b8c337f6-bd16-4313-b1f4-08e289837d3c","resolution":{"observed_at":"2026-08-06T15:51:38.259262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.229654Z","title":"Targeted Reduction of Causal Models","venue":null,"work_id":"e97dd02d-7b7a-427d-9794-1a9e0218d923","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.306817Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:c8d05223c3891e51130126fda21d5c1a73550f58fad7d94c8799dedd42ef861c","observation_id":"d5e13382-5942-4d95-a0a0-e8ae69e58dcd","resolution":{"observed_at":"2026-08-06T15:51:38.237252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.187221Z","title":"Causality","venue":null,"work_id":"7de4bc0b-6be1-445a-8f0d-2db010bbffbf","year":2009},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.316979Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:84de355d3027ba336835bda1f10b97d31444a0de614225ebfb5628034257a357","observation_id":"dc779504-5c2d-4899-9bac-a3eba4581158","resolution":{"observed_at":"2026-08-06T15:51:38.192843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.165159Z","title":"Elements of Causal Inference – Foundations and Learning Algorithms","venue":null,"work_id":"dab998fd-4593-472a-9358-dcc8c882a61f","year":2017},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.321785Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:780b94e53c6e74a11a1e63ea1db68301f0be9510f9b8b44dc17b61c6fc0a3225","observation_id":"3d7f21a3-a9c1-4a92-96a6-5a3cba8a0666","resolution":{"observed_at":"2026-08-06T15:51:38.171955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.143092Z","title":"Abstracting Causal Models","venue":null,"work_id":"8d4c0e75-61c3-41b4-be07-3554c5fb0729","year":2019},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.327967Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:7cfb5f6c5829a87961f0645d3ba741a663a3a76befcdbcb5ffd837bdf48339fd","observation_id":"1842fbfd-2e17-4c27-baa7-6860a213115d","resolution":{"observed_at":"2026-08-06T15:51:38.151157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.123000Z","title":"Approximate Causal Abstractions","venue":null,"work_id":"e66d8b0a-284e-4e61-b608-5e1392f37abe","year":2020},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.333042Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:57088e0583c6603deef12939b63b24555aa3af139325365906d958716ad8ff92","observation_id":"39bc8457-3cd2-4e20-bcb0-5b1bd2e8210a","resolution":{"observed_at":"2026-08-06T15:51:38.128006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.103001Z","title":"Causal Abstraction with Soft Interventions","venue":null,"work_id":"f7f19eb2-4527-426c-be94-04bfea1c065d","year":2023},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.337908Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:5b2b9c63e87b70445441b5d4116a9faab7b4de8205a04798895416cd9ee37321","observation_id":"7694d6ea-c01d-4faa-aaf3-59cc967fae51","resolution":{"observed_at":"2026-08-06T15:51:38.108359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.080873Z","title":"Compositional abstraction error and a category of causal models","venue":null,"work_id":"6aa727b0-9b5f-4f1c-a0c1-c44e276837d3","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.343403Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:03aeb34280dd7521bcad3b04a80126fdae23fe4aea96d5de86c9ded87dd78884","observation_id":"e58c0533-2ce7-4186-8d35-9ec41c874277","resolution":{"observed_at":"2026-08-06T15:51:38.086804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04709","last_updated":"2025-05-08T23:00:37Z","snapshot_observed_at":"2026-08-07T20:10:01.593677Z","submitted_at":"2023-01-11T20:42:41Z","title":"Causal Abstraction: A Theoretical Foundation for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04709","snapshot_observed_at":"2026-08-06T15:51:37.348803Z","title":"Causal abstraction for faithful model interpretation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.348803Z"},"links":{"cited_paper":"/paper/2301.04709","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:f0119040bef93c9c2482f681f80c5d76022f634407502bf5619dd21af3b74f4a","observation_id":"4ecdeea4-ca1e-4230-8825-1855bc0ca1db","resolution":{"observed_at":"2026-08-06T15:51:37.348803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.056071Z","title":"Visual causal feature learning","venue":null,"work_id":"34b5ba42-62c0-4974-8aad-e18bf979e85c","year":2015},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.354099Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:6278161546f500d71c0594b38fb6254b1f36dd42ab6858e5f41b5ae3e9d173ce","observation_id":"ef440e19-8954-40df-8a91-650817e81f34","resolution":{"observed_at":"2026-08-06T15:51:38.064441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.036682Z","title":"Causal consistency of structural equation models","venue":null,"work_id":"1377acfc-46b6-469e-91ae-c7bfbd49af6e","year":2017},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.358642Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:6369f1abb5308392ec7a8069e7bddf3b0f9590b5573887d69101347c0ebdeadc","observation_id":"442984d5-a9f9-4ade-b3e0-cd46dd24725e","resolution":{"observed_at":"2026-08-06T15:51:38.042834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.017739Z","title":"Homomor- phism Autoencoder–Learning Group Structured Representations from Observed Transitions","venue":null,"work_id":"d3f7faee-c43e-4f34-b4c6-b7d7e705effd","year":2023},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.363208Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:04659ab9bce315d47d24f39af82218a9c3e294176ce9e11d89f2c93912d89412","observation_id":"78cf3f97-fb04-412d-ad77-fc8b2fef3ff5","resolution":{"observed_at":"2026-08-06T15:51:38.024586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T15:51:37.368467Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.368467Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:a84ae5967dcddc72102db4692cf4fb943232984114d2d1ff787ee5c6f79accb3","observation_id":"cfe8954d-212a-4e89-a73b-2bbd02d0cc79","resolution":{"observed_at":"2026-08-06T15:51:37.368467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.994536Z","title":"Learning to play table tennis from scratch using muscular robots","venue":null,"work_id":"58262990-d177-4d72-9731-cf16fc97cbc3","year":2022},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.373740Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:3be312b9957bbc353ddb71e41e8ee315193227658bf2469c2d0a4c0eac912c13","observation_id":"8191d131-a17a-4d61-8fad-91056cfc21e6","resolution":{"observed_at":"2026-08-06T15:51:38.000926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.978171Z","title":"Safe & accurate at speed with tendons: A robot arm for exploring dynamic motion","venue":null,"work_id":"5977a44e-4412-4005-9514-ad84ee70a7e8","year":2024},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.378670Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:faf9dd82c4c50b6caf4b9c1ff6420262e3f5a9d14596770dc54e1df9905f5fe0","observation_id":"94589efd-bd16-4145-8b33-daccf0f594cf","resolution":{"observed_at":"2026-08-06T15:51:37.983185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.961650Z","title":"Explainable reinforcement learning: A survey and comparative review","venue":null,"work_id":"98598850-104c-45cd-b656-fbb760da1863","year":2024},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.383546Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:2bb7c299e8695c37d5c2e3927af81064a69a89802745e94b969312c92011a96e","observation_id":"9cee4fc6-7cd1-419b-ab02-b0d7cbe61986","resolution":{"observed_at":"2026-08-06T15:51:37.967569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.945082Z","title":"Visualizing and understanding Atari agents","venue":null,"work_id":"00912c0d-69b3-4720-a95c-6d8b7d2112cc","year":2018},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.389396Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:c5f72200e85c201669d07fa4384474c1593c07d2cf8e822e34f6c33f24fdc599","observation_id":"073134fe-be44-444b-a248-1261899fbdd7","resolution":{"observed_at":"2026-08-06T15:51:37.950030Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.928748Z","title":"Transparency and explanation in deep reinforcement learning neural networks","venue":null,"work_id":"dd9ceb53-e07c-44c1-8e85-3cd72008cdd2","year":2018},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.394262Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:76db386e88afe3536f05fd9b80ef1039409fb1430a844d0e2a3c0cd89e3a2b9b","observation_id":"422b1cd2-0d11-49dc-ae39-b79406e8d39f","resolution":{"observed_at":"2026-08-06T15:51:37.933941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.912353Z","title":"Towards interpretable reinforcement learning using attention augmented agents","venue":null,"work_id":"958ada96-f0fe-43ee-b566-6a2384a547c9","year":2019},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.400049Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:a702afc185faa70474cba4723201a428d02639f76503aaabec4b7e7300ed729c","observation_id":"0d0c8e15-c119-4931-85b4-07b1195709af","resolution":{"observed_at":"2026-08-06T15:51:37.918084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.894822Z","title":"Explainable robotic systems: Under- standing goal-driven actions in a reinforcement learning scenario","venue":null,"work_id":"f25e131b-4fbd-4100-9f4e-1bdeefb46c1e","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.404901Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:11ea68f59b97fa47123f11f746a6dc7470239b261d700731cf09f464804cc86d","observation_id":"2f817359-2cf9-4f5b-b3ed-8c2149af47a4","resolution":{"observed_at":"2026-08-06T15:51:37.900836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.878856Z","title":"Explaining reinforcement learning to mere mortals: An empirical study","venue":null,"work_id":"d33264e6-e985-4d1a-a8a8-91f386608f54","year":2019},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.410288Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:ae26038c95d94469c5ed0f1f41036a3b72503cf57702228860f6d3e424fc4ed0","observation_id":"0731a134-e957-444a-bc9f-6ead1652a7bf","resolution":{"observed_at":"2026-08-06T15:51:37.883975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.862033Z","title":"Learning \"what-if\" explanations for sequential decision-making","venue":null,"work_id":"721e1470-060b-442d-ad56-c4326e0d5807","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.415048Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:85d84c617b8394f92ea90457d642acae3e475af2ba8567a47bfb16f4cdef9df9","observation_id":"72e5ddf2-be85-4494-929f-e2850e358765","resolution":{"observed_at":"2026-08-06T15:51:37.867244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.844229Z","title":"Graying the black box: Understanding DQNs","venue":null,"work_id":"ebb927ec-ec4b-4462-b44b-fb4408d2e943","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.419818Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:da04204574d96cb3119ae3d96e7ea57f8aaea2caf182c3f80652e04350421498","observation_id":"a54b121b-5235-4e93-8eee-1d2dfbd287c8","resolution":{"observed_at":"2026-08-06T15:51:37.849813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.827357Z","title":"Generation of policy-level explanations for reinforcement learning","venue":null,"work_id":"c60cac84-0e01-4ee3-9724-63bf57ade5e1","year":2019},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.425178Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:1809f484b85dcb81581ae6f25573bcbae90e93f528bd581b34707e7c35b841e4","observation_id":"ee84d02c-791a-4b0f-a01d-1ece076cd3c5","resolution":{"observed_at":"2026-08-06T15:51:37.833618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.806419Z","title":"TLdR: Policy summarization for factored SSP problems using temporal abstractions","venue":null,"work_id":"414f15cf-dfcc-4986-b2b7-2fb47f5178bd","year":2020},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.430381Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:1c11ee382ba5e8eb7c02846707de904284cc43d2ca0d289c01f4749d6154e6ce","observation_id":"9267c37f-385a-4c34-a9c2-cec05a521d51","resolution":{"observed_at":"2026-08-06T15:51:37.812888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.788725Z","title":"Explainable reinforcement learning through a causal lens","venue":null,"work_id":"5fa47f21-558d-44dc-9dc0-9d83c26ec0bf","year":2020},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.436342Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:52491802b543b9155a4589b2015e02a663bdf0365c2856dbc30d79d49de36ab2","observation_id":"f290b596-ced0-4c63-b473-c29dd69035af","resolution":{"observed_at":"2026-08-06T15:51:37.795008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.772170Z","title":"Causal abstractions of neural networks","venue":null,"work_id":"9007c8fa-7191-4e91-96e5-f6b6923979f8","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.441148Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:93b96a0ca6b784d42e65a0e04bebe98941b0a529959d4d60784d8170b16710b1","observation_id":"d0371ab7-c37f-4c11-9fb1-b4cd23cf7617","resolution":{"observed_at":"2026-08-06T15:51:37.777692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.755388Z","title":"Segment anything","venue":null,"work_id":"5364d725-19d4-45d1-b55a-17957f041b15","year":2023},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.446132Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:aaefd98f1367a36f0df9a2d67b4d0b7c6c9b8597677668522440b48dcb67d1b2","observation_id":"32c7e9ef-373c-46ad-a735-46ac73f5df31","resolution":{"observed_at":"2026-08-06T15:51:37.760111Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.739125Z","title":"Grad-CAM: Visual explanations from deep networks via gradient-based localization","venue":null,"work_id":"da5bf658-627b-4f49-ba3d-b4529a18f0df","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.453979Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:35e2013a380fa87a1f23c987154c7df4e9af7bdb222e68677aba88824b362b57","observation_id":"c6d279c7-9ac4-4e9c-96c7-7fdf2563759d","resolution":{"observed_at":"2026-08-06T15:51:37.744252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.721196Z","title":"Foundations of structural causal models with cycles and latent variables","venue":null,"work_id":"c8b14d2a-dd46-456b-8720-63dc2c4213c1","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.459902Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:e58841a9e42bea2bb5e109f2c32e9badfa6b21d2520bbf1ffe78785b4703a5d6","observation_id":"506935a4-89b3-441b-8d66-ae28f18e397e","resolution":{"observed_at":"2026-08-06T15:51:37.727134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.704349Z","title":"Dependence, correlation and gaussianity in independent component analysis","venue":null,"work_id":"81b9d523-cf3a-4b2d-8edb-c177ad569b00","year":2003},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.466360Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:f6a0071b4c4b2236b462b09172ce7bd1360f5fbbde78164888c306f5b007c339","observation_id":"0f986416-cc18-4aaf-b1d5-2d6a3fa1cbeb","resolution":{"observed_at":"2026-08-06T15:51:37.709254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.686046Z","title":"Stable-Baselines 3: Reliable reinforcement learning implementations","venue":null,"work_id":"be0eec90-227c-44a7-be0c-5321ad8d6645","year":2021},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.471536Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:533732a5680ff0921e503eb110aaf070cbc1c175e175a8b0a467a211984be407","observation_id":"1fcdcd2d-dcc3-4c41-9ec7-25fe42b0c189","resolution":{"observed_at":"2026-08-06T15:51:37.692501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T15:51:37.477154Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.477154Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:7a8579c3a96789ed3280df2cac9c578639374779d90b41ab9082ce0b93a791b8","observation_id":"814cd2cb-92ff-4d17-a93c-72f28dd5e93e","resolution":{"observed_at":"2026-08-06T15:51:37.477154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.667274Z","title":"The high-level model has (n+1) endogenous variables {Y, Z1,","venue":null,"work_id":"021025a1-ed1c-4956-b558-e2f7498f5c91","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.482934Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:3a65ed68eb5da74142ab9fa749d11674053a86d7f022192736f3ad61f15bc3f5","observation_id":"bf472ef0-6772-40db-b29b-1bce7b2d9b99","resolution":{"observed_at":"2026-08-06T15:51:37.673668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.646891Z","title":"The exogenous variables {W0, W1,","venue":null,"work_id":"a23a8f2b-8815-496c-8614-aaba361925ef","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.489483Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:1fda98313ec33057d38072b06a2dfb3d00ee5b6837f1b47d91b826d59a3e57fc","observation_id":"c7b768c2-5b5a-4aed-b5e3-e492691afd4f","resolution":{"observed_at":"2026-08-06T15:51:37.653791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:37.627853Z","title":"(id − f1)−1","venue":null,"work_id":"68cd8c10-d6f3-40bd-a7df-235d9234591b","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.495684Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:54632a50bf981f879aed62269f43b23cf6c1234de2771039b3bdac7ab7fc23d6","observation_id":"b4eb86eb-1987-477e-bc8b-154b844b785d","resolution":{"observed_at":"2026-08-06T15:51:37.634033Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:51:38.206175Z","title":null,"venue":null,"work_id":"352110fa-cfc7-40ad-8022-145d1d82f20a","year":null},"citing_paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:37.312001Z"},"links":{"citing_paper":"/paper/2507.14901"},"observation_digest":"sha256:68fb4a1daa82f1c1f8376c7de5007e5b2da4451e4ae863f97db8fb931b3ef8c4","observation_id":"824cb148-9f02-49f3-90c1-c643ed51f9a8","resolution":{"observed_at":"2026-08-06T15:51:38.211855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14901","last_updated":"2025-07-20T10:25:24Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-06T15:42:28.374381Z","submitted_at":"2025-07-20T10:25:24Z","title":"Learning Nonlinear Causal Reductions to Explain Reinforcement Learning Policies"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2507.14901."}