{"as_of":"2026-08-17T20:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a9ef47bb29a0f3a0f6e3fdc8ea42bd60d81451207f73e32afd19d2f81bb7c5d4","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T18:33:32.153884Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2512.05291/citation-record","integrity":"/paper/2512.05291/integrity","json":"/paper/2512.05291/citation-record.json","paper":"/paper/2512.05291"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:30.387691Z","title":"M., Lee, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:30.387691Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:f3ffe502dd202ed16d6027f915d4b36ed8b4afe7f395f977c6fda3bbb2ffcd7e","observation_id":"2496cb22-c4e3-41f9-8f9c-7f8155e8f9ba","resolution":{"observed_at":"2026-08-03T18:33:30.387691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03825","last_updated":"2017-06-12T19:53:30Z","snapshot_observed_at":"2026-08-14T20:54:30.978618Z","submitted_at":"2017-06-12T19:53:30Z","title":"SmoothGrad: removing noise by adding noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03825","snapshot_observed_at":"2026-08-03T18:33:31.130837Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:31.130837Z"},"links":{"cited_paper":"/paper/1706.03825","citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:aadd16df0722cafcf745bd957f3aa6c7d934cd20697bbed178bd6dd23e238ce1","observation_id":"29604792-5a35-41fd-9543-2141069f6c27","resolution":{"observed_at":"2026-08-03T18:33:31.130837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:31.248424Z","title":"Sutton, R","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:31.248424Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:809a7a7626d1c650e988e4cb91836583d98b5b96de7b791b3562fcc75ba5e4ce","observation_id":"a9116c7c-6255-4427-9815-8076074123e8","resolution":{"observed_at":"2026-08-03T18:33:31.248424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.03557","last_updated":"2020-05-08T02:06:12Z","snapshot_observed_at":"2026-08-16T13:48:41.926654Z","submitted_at":"2020-05-07T15:42:31Z","title":"Non-asymptotic Convergence Analysis of Two Time-scale (Natural) Actor-Critic Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.03557","snapshot_observed_at":"2026-08-03T18:33:31.358619Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:31.358619Z"},"links":{"cited_paper":"/paper/2005.03557","citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:7486cca75581395a70bd665d57090ef3688758b9e77ccb4b931720347ed10742","observation_id":"21564185-c876-47dc-8331-4d0d8d2f8743","resolution":{"observed_at":"2026-08-03T18:33:31.358619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:30.601490Z","title":"and Stafford, R","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:30.601490Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:f1067f0a277fb4de36a3c925ac5887ea850762018f687af94661596bd396bd40","observation_id":"427666f4-ce4f-4cc4-b8c9-ef250a8ea1f1","resolution":{"observed_at":"2026-08-03T18:33:30.601490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:31.634751Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:31.634751Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:51e5ddf75e9051c1c507b2b01237269b25b23d9e1738008a91d0a02d16b37158","observation_id":"eac04f48-6a4f-4da0-87d5-7a3422883377","resolution":{"observed_at":"2026-08-03T18:33:31.634751Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:31.864452Z","title":"And we can estimate∇hJ(h,Σ)by sampling nstate-action pairs{s ι,a ι, rι,s ι+1}and approximating with the average","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:31.864452Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:4bffd7727bb04f12c4b28758d7425561d9e5e7020011ca64f5c52c8f1a4746e7","observation_id":"c36d954c-5b04-4776-a755-ffda1c429b9d","resolution":{"observed_at":"2026-08-03T18:33:31.864452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:32.004575Z","title":"•L V: Lipschitz drift of the Value Critic w.r.t","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:32.004575Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:d618f16eef4632f8b8ca1067453fdf45e9595680ddc7f49c3d28104a0cbf7f19","observation_id":"87880c67-f3b6-4967-b664-4df91e1b00f7","resolution":{"observed_at":"2026-08-03T18:33:32.004575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:32.153884Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:32.153884Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:87a04a62a5a506bd503f5aaf7d55a07a98235830db7d662020ffe04f483a70fa","observation_id":"7ba9ed94-d3d1-48f1-8e95-78e53b34d319","resolution":{"observed_at":"2026-08-03T18:33:32.153884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:30.869371Z","title":"why should i trust you?","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:30.869371Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:925d0f5d02eac9ac81002e27168198974b636e23e3199420e93e3e6a6ba6eec9","observation_id":"48955584-846a-4728-b3f1-94eece15405c","resolution":{"observed_at":"2026-08-03T18:33:30.869371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:31.487578Z","title":"C.(2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:31.487578Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:f6aa0e5c77dc5be36a80dae4094283669b20ce6ce243d814281503e3f0b71602","observation_id":"0913e07c-64f7-4f6a-916f-3d3886df5a8a","resolution":{"observed_at":"2026-08-03T18:33:31.487578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:30.694318Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:30.694318Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:4e49f8d5a033dd83d2c30a838ba81f852da121da2d2128a8fc876f6e4846e945","observation_id":"c7811080-c610-42e4-bdca-dd70f73d62d3","resolution":{"observed_at":"2026-08-03T18:33:30.694318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:30.456211Z","title":"S., Ghavamzadeh, M., and Lee, M","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:30.456211Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:5ec922d679d793e99cb503205f85d950f2ac19064cba6917ce6896f3f931f578","observation_id":"9a867a2e-b8f9-4207-9c7b-b93e13d643b0","resolution":{"observed_at":"2026-08-03T18:33:30.456211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-03T18:33:30.980790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:30.980790Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:cc8c6264babe169b50d510279dbb0212c8fc2758c74563ee374d92266afed039","observation_id":"76039406-68ea-4829-9b33-b8230444318c","resolution":{"observed_at":"2026-08-03T18:33:30.980790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:30.793488Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":204,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:30.793488Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:17dfbc94669f1cc9b3c6f64cdefa30bf4c291657d4a237b32fb26bbe694a4f8f","observation_id":"84eff719-2992-4401-aa0e-b3d5a56a45e7","resolution":{"observed_at":"2026-08-03T18:33:30.793488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:31.754950Z","title":"Figure9showsthatdeepRLalgorithmsareabletodiscoversignificantlybettersolutions in high-dimensional state space","venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":1000,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:31.754950Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:07b66723e393381e9d30424898af0cea66290db5245722876cdb816722603239","observation_id":"16377af2-0633-4dcd-90f5-8b18e1f85b3b","resolution":{"observed_at":"2026-08-03T18:33:31.754950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:33:30.523825Z","title":"and Tsitsiklis, J","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T18:33:30.523825Z"},"links":{"citing_paper":"/paper/2512.05291"},"observation_digest":"sha256:68b5f3803a156156fc59b5c7d2c4cd6c4d2f993407dcc75b066c552a3a43f125","observation_id":"9177df29-b6e3-4600-aeae-7d17eb3a6dcc","resolution":{"observed_at":"2026-08-03T18:33:30.523825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.05291","last_updated":"2026-06-05T06:54:58Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T19:09:50.807524Z","submitted_at":"2025-12-04T22:28:43Z","title":"SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2512.05291."}