{"as_of":"2026-08-10T07:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:28db13d3947ccc0846480fb0c46fd225e87a30b80a314ef893ee0f8b2aac1ce0","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:46:26.728164Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.19244/citation-record","integrity":"/paper/2510.19244/integrity","json":"/paper/2510.19244/citation-record.json","paper":"/paper/2510.19244"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.624960Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.624960Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:8203a2b42fccc110c31afee1b0e7dbf38f139ec5db237ff6b62210aac81c4eb2","observation_id":"8b3257b1-52fc-49a4-ae6b-788b2213cc33","resolution":{"observed_at":"2026-08-04T08:46:26.624960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.628199Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.628199Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:d85bc0d7532e0e726f7fbcc823f504b8015824043d48199039c077bb241a5cd6","observation_id":"362f6e4c-6384-4201-aeea-b546682cea6f","resolution":{"observed_at":"2026-08-04T08:46:26.628199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.631545Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.631545Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:769e1745eebbcd18e7eabb83e1071133b1e2fbe1093333750e3095774e1a6eff","observation_id":"cd2512e0-79df-4cba-bd8e-2b5c9981cc77","resolution":{"observed_at":"2026-08-04T08:46:26.631545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14645","last_updated":"2025-04-20T15:01:19Z","snapshot_observed_at":"2026-08-07T16:00:45.817527Z","submitted_at":"2025-04-20T15:01:19Z","title":"Surrogate Fitness Metrics for Interpretable Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14645","snapshot_observed_at":"2026-08-04T08:46:26.634515Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.634515Z"},"links":{"cited_paper":"/paper/2504.14645","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:492b1aaaf8cfcd271497279cb865bdfafc0893b5ddb8ed140e738c85ffe258d8","observation_id":"b9b7391a-ce56-44d2-971f-3435bb785123","resolution":{"observed_at":"2026-08-04T08:46:26.634515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.640695Z","title":"M.; and S im s ek, \\\"O","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.640695Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:0597ca20f53b047c55dc7caac304302dba7a26f039e3ef170fc0f1e3e2e28e1f","observation_id":"f43c197e-732c-484c-ac87-8c34257d5eee","resolution":{"observed_at":"2026-08-04T08:46:26.640695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07797","last_updated":"2025-07-31T17:02:05Z","snapshot_observed_at":"2026-08-07T15:47:47.186706Z","submitted_at":"2025-05-12T17:48:28Z","title":"A Theoretical Framework for Explaining Reinforcement Learning with Shapley Values","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07797","snapshot_observed_at":"2026-08-04T08:46:26.643481Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.643481Z"},"links":{"cited_paper":"/paper/2505.07797","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:0577ccff4dfbf14ef24e5b0f25f2d04b4a8a846037967df92b4a1cf0466b33ec","observation_id":"8fafc73c-94ae-4d1c-83ea-ff5f1f9de63f","resolution":{"observed_at":"2026-08-04T08:46:26.643481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.646234Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.646234Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:38c37b964f516b8895b6482f62c7bcc848fdc2803870d9f336e0f296136d2d32","observation_id":"466d44f1-46bb-459b-b397-dd11c561836f","resolution":{"observed_at":"2026-08-04T08:46:26.646234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02651","last_updated":"2024-05-23T01:04:11Z","snapshot_observed_at":"2026-08-06T16:39:13.609184Z","submitted_at":"2024-02-05T00:48:56Z","title":"Vision-Language Models Provide Promptable Representations for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02651","snapshot_observed_at":"2026-08-04T08:46:26.649019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.649019Z"},"links":{"cited_paper":"/paper/2402.02651","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:0986f7fc84ef348e97c9b2e963b0267d16642da37ad20126bc5d33d6705bd2a0","observation_id":"4215f0bb-b83a-415c-b9d3-b3c9b386ecce","resolution":{"observed_at":"2026-08-04T08:46:26.649019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06869","last_updated":"2025-02-08T05:30:31Z","snapshot_observed_at":"2026-08-08T19:12:44.055177Z","submitted_at":"2025-02-08T05:30:31Z","title":"A Survey on Explainable Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06869","snapshot_observed_at":"2026-08-04T08:46:26.651930Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.651930Z"},"links":{"cited_paper":"/paper/2502.06869","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:f1cde930621ef4ab8fff47a891ce45617d1f5f629f3971a522ff4ae02313b6ec","observation_id":"0712794e-c8e0-494b-bdb3-83cfa4fc9922","resolution":{"observed_at":"2026-08-04T08:46:26.651930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.654700Z","title":"G.; P \\'e rez-Aracil, J.; Salcedo-Sanz, S.; and Pedreira, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.654700Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:c6fb663b78bfb1c83058cfaadbe1e364a2443d28069a6de7cf8b4c269b6b90ca","observation_id":"d77278bd-decf-4c06-aec8-1b42732f1e48","resolution":{"observed_at":"2026-08-04T08:46:26.654700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.657274Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.657274Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:1c2a252e788b6d810906b5b122ebc86c913ddd7ccaf74a311739ac6b100b49f9","observation_id":"000a4127-7276-43f3-a03a-079f4c9ae5dc","resolution":{"observed_at":"2026-08-04T08:46:26.657274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12701","last_updated":"2025-05-19T04:41:54Z","snapshot_observed_at":"2026-08-07T15:43:31.133450Z","submitted_at":"2025-05-19T04:41:54Z","title":"Counterfactual Explanations for Continuous Action Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12701","snapshot_observed_at":"2026-08-04T08:46:26.659681Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.659681Z"},"links":{"cited_paper":"/paper/2505.12701","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:fef457dea4089b3bf2e5e95f3421b1dbafaefe02b4071c4df23989b240409df9","observation_id":"532d6a33-4a7a-46a5-a2c2-9d631e8354be","resolution":{"observed_at":"2026-08-04T08:46:26.659681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-09T00:13:56.083722Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-08-04T08:46:26.662381Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.662381Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:73eca71fffbbac50f8a47432cde7e6f53df71eeb7d9c8b5cc696c6b5fb069904","observation_id":"ed9024be-4180-4384-af60-c34f0e2c26fc","resolution":{"observed_at":"2026-08-04T08:46:26.662381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.01272","last_updated":"2021-12-20T17:43:52Z","snapshot_observed_at":"2026-08-09T20:02:48.882572Z","submitted_at":"2020-06-01T21:20:04Z","title":"Shapley explainability on the data manifold","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.01272","snapshot_observed_at":"2026-08-04T08:46:26.665058Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.665058Z"},"links":{"cited_paper":"/paper/2006.01272","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:79289408b050ca091812df77d4935b5d8d5a425996ec06f0e112ebbb59d85678","observation_id":"28070c0e-c9f8-453e-9822-c86f5b06c55d","resolution":{"observed_at":"2026-08-04T08:46:26.665058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.667646Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.667646Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:0eefa02d6d7947c959de31954ca41c5b417a154ece335e04784e41a132c7aab1","observation_id":"3d3286d2-e69f-4c69-8e80-bac2839c1aa8","resolution":{"observed_at":"2026-08-04T08:46:26.667646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.670141Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.670141Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:73c72cfb020a0f5b2165be4b52230a1dc218ca485243153cd87f7d6ae8f05a67","observation_id":"63cc7d27-472a-4830-b41f-27794148edbf","resolution":{"observed_at":"2026-08-04T08:46:26.670141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.672537Z","title":"S.; Claessens, B.; and Develder, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.672537Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:1099d95379410cac80aa4d2f85ffe1c0d78b43139e8cdc166e8247d0fbe58a2f","observation_id":"470c8c2d-c8a7-42bf-af7b-a1837c438abd","resolution":{"observed_at":"2026-08-04T08:46:26.672537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.674980Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.674980Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:ca4d670dd9b4efe080ce35236c6042d36f0957cca17441dd0ed80c8925916952","observation_id":"1dfff01c-962b-46a7-8e57-0fdcc2ce48f3","resolution":{"observed_at":"2026-08-04T08:46:26.674980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.677654Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.677654Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:96b57f674c91332b62bd862b06001f98cd85b9b87bdede958e481f2d227b8f18","observation_id":"812d1326-7e05-455f-aaa1-76ed775978b8","resolution":{"observed_at":"2026-08-04T08:46:26.677654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.680065Z","title":"W.; and Liang, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.680065Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:457ed30ba5ce62c9702aa3d931e617a5c4ea1f89336cd78e3dbd25da4d3649f7","observation_id":"51a5d485-54ad-43a5-9c59-528b3d08c80d","resolution":{"observed_at":"2026-08-04T08:46:26.680065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08322","last_updated":"2025-03-11T11:34:06Z","snapshot_observed_at":"2026-08-07T17:13:19.964033Z","submitted_at":"2025-03-11T11:34:06Z","title":"Evaluating Interpretable Reinforcement Learning by Distilling Policies into Programs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08322","snapshot_observed_at":"2026-08-04T08:46:26.682385Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.682385Z"},"links":{"cited_paper":"/paper/2503.08322","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:79bae39e4708998245964b3b7faf20dd8b24586ef250b17f3d8407e8e3e40c19","observation_id":"79dd1d11-5e3c-4c8f-992c-b5e6808738fd","resolution":{"observed_at":"2026-08-04T08:46:26.682385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09858","last_updated":"2025-01-16T22:11:03Z","snapshot_observed_at":"2026-08-10T01:15:21.981754Z","submitted_at":"2025-01-16T22:11:03Z","title":"From Explainability to Interpretability: Interpretable Policies in Reinforcement Learning Via Model Explanation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09858","snapshot_observed_at":"2026-08-04T08:46:26.685458Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.685458Z"},"links":{"cited_paper":"/paper/2501.09858","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:e82809acd276248f030a063efe344e74fdd7a2ab0a166d787a7eb04673965f6d","observation_id":"464d1cbb-98f9-4ce7-a4be-20f7b31a4141","resolution":{"observed_at":"2026-08-04T08:46:26.685458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.688170Z","title":"M.; and Lee, S.-I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.688170Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:e49e96396e2e69add8efebdd5d7b1bade61511575b1d239c9bd2e217b8a4815c","observation_id":"76ee77d2-9276-4483-89a8-51502b16a82a","resolution":{"observed_at":"2026-08-04T08:46:26.688170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.690881Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.690881Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:c8418ac40b6a27e11e0129a6565796727f113c0f2258cd5a3bcbdc733f761b9b","observation_id":"4efc6863-1804-45e9-a780-4bcf80df4ce8","resolution":{"observed_at":"2026-08-04T08:46:26.690881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.693279Z","title":"Y.; Hasan, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.693279Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:607a322479585391d8d7d5444606bbd7dafbae9fb43e30b0fffd0f8463b4d26d","observation_id":"a2c587ab-27ea-4bae-a820-883fa1d9302a","resolution":{"observed_at":"2026-08-04T08:46:26.693279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.695896Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.695896Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:8915e1ac8779be568ec0355754016cbe97d8f9530b462c85ecba2ce8c17f9add","observation_id":"ee34eeb7-c300-4226-a1d8-ee845a2627a2","resolution":{"observed_at":"2026-08-04T08:46:26.695896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.699117Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.699117Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:dc464e3b80e9fd72f07483712148f02d4a9b5045ee5d5e03fec2341edc9caff5","observation_id":"49e7af5e-9361-4e2d-a518-40299d9ac1ab","resolution":{"observed_at":"2026-08-04T08:46:26.699117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.701462Z","title":"D., Anurag Koul; and Fern, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.701462Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:f65a0c1c4fa1ff47cdc82cd36a69af0aa6735221fd64662d15d2e3ff06c84198","observation_id":"535a25e9-8e80-48db-9141-25e5b5be310a","resolution":{"observed_at":"2026-08-04T08:46:26.701462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23678","last_updated":"2026-05-15T17:27:46Z","snapshot_observed_at":"2026-08-02T04:30:21.704758Z","submitted_at":"2025-05-29T17:20:26Z","title":"Grounded Reinforcement Learning for Visual Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23678","snapshot_observed_at":"2026-08-04T08:46:26.703872Z","title":"J.; Kumar, A.; and Fragkiadaki, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.703872Z"},"links":{"cited_paper":"/paper/2505.23678","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:9fe3f2bfdf311f2da0d27f33c21837365b31986b2cf41d5154e598ec90a05a12","observation_id":"e1bf4d76-6509-42d2-9c2e-88f700a68b26","resolution":{"observed_at":"2026-08-04T08:46:26.703872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.706419Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.706419Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:21fdfe58ab11b9f65e9f46f33c9f09c04fc0a34f9e1a7efacb477b2f9b9be6d6","observation_id":"ccb213e2-2375-481a-b662-a149210a1c45","resolution":{"observed_at":"2026-08-04T08:46:26.706419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.708876Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.708876Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:0fc276d7a19bfc459c6c0963e80a0310722085f5c53da0b55f18f63ef1fce2e4","observation_id":"e812e5d7-e431-4261-bd8a-6e87f424f756","resolution":{"observed_at":"2026-08-04T08:46:26.708876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.711206Z","title":null,"venue":null,"work_id":null,"year":1953},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.711206Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:0625ffab13b2b77b063f73e6a14f66e40c4b419f7d01b57052039ac0d95447a7","observation_id":"3545e650-20c3-4b2e-8b38-1b06b2742a93","resolution":{"observed_at":"2026-08-04T08:46:26.711206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.713628Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.713628Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:c172c6e41355d2a3fc17a0406a9451a1c34676b416e8399119fa0ffcfdd36a87","observation_id":"e6ca16ca-b53f-4013-b912-5ea9d495c896","resolution":{"observed_at":"2026-08-04T08:46:26.713628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.716001Z","title":"S.; and Barto, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.716001Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:d0eee8da799b2d385ccc2104a3f74ccb7ba6dd6f5d02cffca3c80d32f7f6e1e9","observation_id":"d9a8cb9c-3c03-46a6-9272-10d1995a6e90","resolution":{"observed_at":"2026-08-04T08:46:26.716001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.718870Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.718870Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:dcb7134317a2cbb9cd0e26a839a606d3f4718e2232223d88896712d660cdbd2f","observation_id":"8f6ea3a5-230e-47a8-96af-764fc33aecd0","resolution":{"observed_at":"2026-08-04T08:46:26.718870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.721210Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.721210Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:ab5c27a2813710f2d41cf1cddf0a325e7fb1c01ec7925f4dd6c9ea2c144f51dc","observation_id":"fada0d9f-ef3e-4cb8-9cf1-557163108409","resolution":{"observed_at":"2026-08-04T08:46:26.721210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.723467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.723467Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:0823330c4d8f1dccc2fd53bbdb1df6302ba0c0085d9203fdc034cce88e6c2260","observation_id":"840cd4f7-9d69-4749-a699-ec745fc912f1","resolution":{"observed_at":"2026-08-04T08:46:26.723467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.725644Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.725644Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:79ad75b7951e708628690c6bc5fa50a32ba7d8ec6597fb424aa3ecea08a3cf86","observation_id":"445f7345-a679-4281-874e-67fd700147d0","resolution":{"observed_at":"2026-08-04T08:46:26.725644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:46:26.728164Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.728164Z"},"links":{"citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:a0ec913fcec31433a316d7a24f38c02770a896a7595c524aaf46fa450a9f3bee","observation_id":"aa332c7a-21c0-4fae-a253-36a0563f48e2","resolution":{"observed_at":"2026-08-04T08:46:26.728164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2510.19244."}