{"as_of":"2026-08-18T14:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:02d6939cf19b81ce3b449b60326411fe473c212659c46da68addb380f394ddbd","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T16:53:06.017613Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.07235/citation-record","integrity":"/paper/2607.07235/integrity","json":"/paper/2607.07235/citation-record.json","paper":"/paper/2607.07235"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.063838Z","title":"Python package for fitting quinlan’s cubist v2.07 regression model, 2021","venue":null,"work_id":"4dfcb88d-7ad7-4974-8d75-83880dc093b5","year":2021},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:48c25c2539de228f8477ee9613f120d77f41488c9cff1e2ac10d3b59f33b7f60","observation_id":"d13b15b2-a0a1-465b-a90d-65867880b9f7","resolution":{"observed_at":"2026-07-09T16:56:22.065117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.097937Z","title":"Verifiable reinforcement learning via policy extraction","venue":null,"work_id":"80a5309e-fab0-4e09-bd74-67f0cd7a35b6","year":2018},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:7ea2c217b0c8c34beeb25bc3b3b3f511ec2a379c10fdcb96167b30a0a087467f","observation_id":"c644c8f6-02f5-4014-a759-8bcfb25c3d3d","resolution":{"observed_at":"2026-07-09T16:56:22.099049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.090349Z","title":null,"venue":null,"work_id":"f078ab7b-1c52-4384-8e1b-16610d949fd8","year":1984},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:a119c7349179d45904f81ee94df63354c25eb4f33ce8c9e0274026965e374273","observation_id":"47cb0b25-5d92-4780-b0bf-e8725e7ec847","resolution":{"observed_at":"2026-07-09T16:56:22.091323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.037101Z","title":"Human-friendly explanations checklist for reinforcement learning: XRL H-F-E checklist","venue":null,"work_id":"83607059-0b59-4843-be15-576aaa29c961","year":2025},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:6cc04b2b17b565db173329cac395825db9a325563de3b468352380b619fbae01","observation_id":"685465ab-640a-47f8-84db-10939e2da171","resolution":{"observed_at":"2026-07-09T16:56:22.039218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.015708Z","title":"Distilling deep reinforce- ment learning policies in soft decision trees","venue":null,"work_id":"4aa3ce99-b5c5-4ca0-9ff2-4a887fdb2984","year":2019},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:8ac3e34320702b2885f3ac367d1130409b1ef990dc42dfbbce1f77d4409160d0","observation_id":"213c33aa-b82d-4074-b332-35cade58528f","resolution":{"observed_at":"2026-07-09T16:56:22.017268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.027193Z","title":null,"venue":null,"work_id":"36810cfd-652e-4f61-92d7-3044455a826e","year":2022},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:5192bd874cf73b863fd7f89c53c44fc7788741ddb6ab3705c1eaab909658fa8d","observation_id":"e93305bb-d254-433b-a4ea-c2404ac14e71","resolution":{"observed_at":"2026-07-09T16:56:22.028507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.068080Z","title":"Danesh, Anurag Koul, Alan Fern, and Saeed Khorram","venue":null,"work_id":"5f7cd56f-af37-4f70-b2d6-92088089e545","year":2021},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:2a2dbb36b79b8fec276923f18fc61149af7310a9cfe2ec4758a40c4c64909477","observation_id":"bf191f6a-d96e-4e7a-a605-ffa4268f31d1","resolution":{"observed_at":"2026-07-09T16:56:22.070466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.013852Z","title":"Nat., 602(7897):414–419, 2022","venue":null,"work_id":"996bc218-6127-4f4d-8e2b-7c42ad6362e1","year":2022},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:022b40254a3bb894a941b81ee50e4926803a44565c9aacf97c568a19da777c09","observation_id":"2dc6b056-16d4-4c06-9c1a-a99b471b753d","resolution":{"observed_at":"2026-07-09T16:56:22.015053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.018298Z","title":"Dhebar, Kalyanmoy Deb, Subramanya Nageshrao, Ling Zhu, and Dimitar P","venue":null,"work_id":"5c3e4e23-927b-4d14-9556-1fa50f8f24f7","year":2024},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:88327d4a9a183114816528e18b4ee8a22452dd6131ecb942650daf846a27e59c","observation_id":"7746d357-3d9f-4f4f-9ea6-fb9d67cc2265","resolution":{"observed_at":"2026-07-09T16:56:22.019691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.041399Z","title":null,"venue":null,"work_id":"fb7d3884-fabf-4d65-821c-c04e0a72430a","year":1955},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:4679e1989b2d828efec95e0d426a01e73f58d0bf40db73c4083a9b4482ab3ff0","observation_id":"74501045-2520-41ee-acdf-acb870ba33a7","resolution":{"observed_at":"2026-07-09T16:56:22.042377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.076364Z","title":"Regulation (eu) 2024/1689 of the European parliament and of the council – the EU artificial intelligence act","venue":null,"work_id":"68eb6076-2a56-4e4b-a23b-3095876d2a63","year":2024},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:b485d7b0d732fc13c52380868a6d13bbcb7a1bbd516c3433ea98869aa3bf4304","observation_id":"c0de06a7-4dd9-419c-b583-56ed1d87367f","resolution":{"observed_at":"2026-07-09T16:56:22.077568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.008026Z","title":"Friedman and Bogdan E","venue":null,"work_id":"2c8f1777-a9c7-49a2-ba7e-7e84d5695562","year":2008},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:547a5301aef5cd62e22a4fce60df48dc50ee722d2f3caa9a756048fae9254a4f","observation_id":"cfa56d4e-ab65-4866-a2f9-9b5912dbab40","resolution":{"observed_at":"2026-07-09T16:56:22.009057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.101214Z","title":"A brief overview of rule learning","venue":null,"work_id":"a312a8ff-ff8f-4ad1-b39b-28d795adf122","year":2015},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:2d206cf7a278f8f1a876ad57e9d747b2ad69807bab39cdd269f489d045403938","observation_id":"93851ed9-3e39-4bd9-bb09-36835039d819","resolution":{"observed_at":"2026-07-09T16:56:22.106379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.083360Z","title":null,"venue":null,"work_id":"486b935e-15e9-4c10-8555-b668f408dabc","year":2025},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:ce0bde108adf28ff855308cde8205ed5d72b815896a5306e9e56f9190cef695e","observation_id":"d67330f3-9a35-45fe-905f-592c27bcc33d","resolution":{"observed_at":"2026-07-09T16:56:22.084515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":"2411.15594","doi":"10.1016/j.xinn.2025.101253","metadata_source":"pith","pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on LLM-as-a-Judge","venue":"cs.CL","work_id":"2676656a-67bd-4ad5-bad6-cb6f5fcdbfbe","year":2024},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:e35e31eb86cb65376884f444ca825152eb5a465b9ab2c48ef2458d51b7b8db09","observation_id":"3f5f482a-1e6c-476d-bf59-4a377e12fe44","resolution":{"observed_at":"2026-07-09T16:56:21.674000Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:01.818871+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:01.818871+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.001567Z","title":null,"venue":null,"work_id":"edb1df9f-af13-49ff-8187-bb252501bde6","year":2018},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:24c5ca4ba485d8e6c85a2660fdd75e5ff2e1f3f4ee77cb1cab1855281556e7eb","observation_id":"d7d4ee45-1bd8-4dde-bf82-9ebf448f27d6","resolution":{"observed_at":"2026-07-09T16:56:22.003015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.052807Z","title":"Learning finite state representations of recurrent policy networks","venue":null,"work_id":"ea1be66d-28c5-4f44-bb10-6800c238559f","year":2019},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:1fab0eb587aa7e1b4a35266ac19cd22351a988241dd8f9965e27b4317529a322","observation_id":"f99e9ce1-69f6-413a-9d06-8a686d43081f","resolution":{"observed_at":"2026-07-09T16:56:22.055753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.005636Z","title":"Explainable classification by learning human-readable sentences in feature subsets.Information Sciences, 564:202–219, 2021","venue":null,"work_id":"241fc07b-8043-4ac0-bf12-fa00a4513f4d","year":2021},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:33ebb596a59b84ef0dca5fbdac12e5ab1d61615809f562c35e309286b83c6f7e","observation_id":"769f059c-c660-4cc2-9b26-791feef37131","resolution":{"observed_at":"2026-07-09T16:56:22.007452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.009603Z","title":"Lillicrapet al.Continuous control with deep reinforcement learning","venue":null,"work_id":"99689935-a250-4dd4-8b2e-01fa9e541bae","year":2016},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:945e12ffff38dc461b3d726d42a6eb5fc3d0542369a37363db05839e64af294d","observation_id":"1206e76b-5c05-4169-bff6-f8148d56437a","resolution":{"observed_at":"2026-07-09T16:56:22.010951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.079979Z","title":"Alqahtani, and Dongwon Lee","venue":null,"work_id":"9bb182e4-523f-4cff-b636-41b86c511acf","year":2022},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:920c6dba4e4cf8d929ad53e38ac381b3710625524a3489e7ce7649676316d318","observation_id":"653a5e48-9ee6-451b-b680-dfe9f34bfb6a","resolution":{"observed_at":"2026-07-09T16:56:22.081017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.062406Z","title":null,"venue":null,"work_id":"c84e8309-5e1d-46c5-881b-36160314ddfa","year":1956},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:442563392cc02de8a74b6eea474848c0186140200880a18745d5cbbe13f0150b","observation_id":"422663d0-ccbb-4452-8c2e-a7fd69dd1d6a","resolution":{"observed_at":"2026-07-09T16:56:22.063446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.987753Z","title":"Explainable reinforcement learning: A survey and comparative review.ACM Comput","venue":null,"work_id":"5fd24bbc-0ae6-4e6a-ab9e-09c8b4e52719","year":2024},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:9dd2d9eb7575069034927634bbcc006422362973038950d047f458be8e7d1c59","observation_id":"1ab5adf6-a080-4d14-a526-e327dbbbd2d6","resolution":{"observed_at":"2026-07-09T16:56:21.989528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.058423Z","title":"Kamhoua, Evangelos E","venue":null,"work_id":"85e37bbc-fd45-444b-b477-0cb64ce74175","year":2022},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:40b892e167283a8d013cf870230002389b17f835409ee7ef290b222a00445b37","observation_id":"5d88f84d-040b-4768-ac90-970c7d0134c6","resolution":{"observed_at":"2026-07-09T16:56:22.059576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.056293Z","title":null,"venue":null,"work_id":"8d4dd43e-a145-4997-8a36-dd25561d38d2","year":2015},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:ed402cae990e15d3396aec7f000d13a106d61d8b95bbf985c545b034d1bf956a","observation_id":"d0fdb178-45c9-4a57-9a30-de84758c925d","resolution":{"observed_at":"2026-07-09T16:56:22.057517Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.985937Z","title":"3 edition, 2025","venue":null,"work_id":"dc2ea223-1839-4a85-a6d8-1b69d880f7b0","year":2025},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:571e6130bc08bcad64c5337aa0d6249faded157c3b1ea5883ab31fee0defa6fa","observation_id":"6d488690-24bd-4629-8e35-487316bad41c","resolution":{"observed_at":"2026-07-09T16:56:21.987245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.993875Z","title":"Efficient memory-based learning for robot control","venue":null,"work_id":"035e6751-aec1-4dda-84f6-eb1af8f0aa29","year":1990},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:e47db4dd9e73d9c915203307587abda8ffd5474cae78c37cf9b83f8a632b0622","observation_id":"fbe6d7b3-5e1f-4339-9612-a3be336ea5f1","resolution":{"observed_at":"2026-07-09T16:56:21.995544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.025864Z","title":"Murthy, Simon Kasif, and Steven Salzberg","venue":null,"work_id":"65d0263b-d6e5-4564-a096-ea999c060281","year":1994},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:37dad7a5ad40cc3e6ce7b8e435cd7c29770e05a7d7549e47d35869b625c1d8a6","observation_id":"fc266ee8-879e-4638-8826-8ec2aeaf73b0","resolution":{"observed_at":"2026-07-09T16:56:22.027433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.011484Z","title":"Interpretable approximation of a deep reinforcement learning agent as a set of if-then rules","venue":null,"work_id":"b1ed9e0f-a712-4019-9d9f-192219c99687","year":2019},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:e68805e9163bfffa8d069ceeaa8a6b57ecf61fbb91f04da6a9a0db40d804b902","observation_id":"cb5b3011-e81c-4668-837f-23de375eabef","resolution":{"observed_at":"2026-07-09T16:56:22.013297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.034923Z","title":"Paleja, Yaru Niu, Andrew Silva, Chace Ritchie, Sugju Choi, and Matthew C","venue":null,"work_id":"d1691058-5906-4f8d-aabb-3a657b2c5d6f","year":2022},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:f8febdff54577692c5941bc0fb46d7da32916060cc3dc6d58cfd1dc5fd91773a","observation_id":"6d67ead8-cbdd-41cd-ac66-e00ce4abcbc9","resolution":{"observed_at":"2026-07-09T16:56:22.036323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.020038Z","title":"Pedregosa, G","venue":null,"work_id":"9e85fc05-20c5-4de2-8dd6-4d58a472827e","year":2011},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:cc995a01cee99e42d1ad05d024b838973b100211f4c3534b9643d79c3a0bbcf1","observation_id":"9f6a714a-8a3c-49b5-acf2-577cf2499034","resolution":{"observed_at":"2026-07-09T16:56:22.023236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.980928Z","title":null,"venue":null,"work_id":"d35f973c-46e5-46b7-955a-8b7750837baa","year":1952},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:70c685a67a13a3d4156aab1f8c231672e1dabc4433b5874c8907162aaa3db4f0","observation_id":"9c639cd4-da2d-41e6-9cc6-2d8a6db4812f","resolution":{"observed_at":"2026-07-09T16:56:21.982012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.030448Z","title":"Ross Quinlan","venue":null,"work_id":"861a43ee-cffb-431f-ad81-71ff9f62ab41","year":1992},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:f5545c66d170ee25539589928f563105121d4589dddaf5a1b45a201826abbc28","observation_id":"504888b7-0506-4e27-9881-620a2cab9a4d","resolution":{"observed_at":"2026-07-09T16:56:22.034200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.067625Z","title":"Stable-baselines3: Reliable reinforcement learning implementations.Journal of Machine Learning Research, 22(268):1–8, 2021","venue":null,"work_id":"ccdf21f5-878e-41de-b90a-153717bb3858","year":2021},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:934b26811f56d8a61b350b1aaf7c325a7c01dbcaa5730ea425954d2912fb5456","observation_id":"5cda610f-ba57-4118-97dd-25822006bb91","resolution":{"observed_at":"2026-07-09T16:56:22.068902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.054826Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":"f1dccc95-dd35-487c-85a6-fe8d24471c9e","year":2011},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:59759094ebef28b58b0c724e9be2affa6a1b7a1b97bc35a8eeda840177dc5f9a","observation_id":"d1b7f56c-5b2e-40bd-9152-2b025e867298","resolution":{"observed_at":"2026-07-09T16:56:22.056142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.976841Z","title":"Multiple comparisons of treatment against control under unequal variances using parametric bootstrap.J","venue":null,"work_id":"c00a7f7d-2b79-4348-94b6-f8c26f845f3d","year":2023},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:6660da3c23371952e9de035d1cf5a51a73a3402c3d188616fbbe32cfdb708127","observation_id":"657474ab-3c12-493e-8ec5-46fc67590adf","resolution":{"observed_at":"2026-07-09T16:56:21.978131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.978847Z","title":"Safety verification of decision-tree policies in continuous time","venue":null,"work_id":"0b2a1cf8-316a-4954-83f2-8d95cd72687d","year":2023},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:6682953f844cf08a738305ab9f6a95c16b1557d505f0948ba15013a38637ca1d","observation_id":"67da4504-f114-4d75-a4b3-6a52adbea991","resolution":{"observed_at":"2026-07-09T16:56:21.980371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.969100Z","title":"Neurolinear: From neural networks to oblique decision rules","venue":null,"work_id":"1c15319c-937c-4569-952e-116422420f28","year":1997},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:865a80cff4c1f1d75857209d6e2a673e554e8ca21f6bb5e7d15e6e34f943d8d0","observation_id":"abf16751-2c03-4149-9aad-b297dde4a5f1","resolution":{"observed_at":"2026-07-09T16:56:21.970683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.044425Z","title":"Gombolay, Taylor W","venue":null,"work_id":"9c0c6a23-2b88-4ade-944e-4e3a735505a4","year":2020},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:c064be4dce6f6aae3427f5ebc191c2369a1a3594692426f6e234062420ae7790","observation_id":"8437b6d3-d31c-4f56-a624-5de0a498a6ef","resolution":{"observed_at":"2026-07-09T16:56:22.045822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.039753Z","title":"Ried- miller","venue":null,"work_id":"60baf689-b985-4c7c-a7d1-07a30a566b43","year":2014},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:102d85b328e442c603292e5ebcb43f80c33f396b56fee19e644a61370fe436af","observation_id":"a4949673-3fad-4d6d-a15a-1150e7490ad2","resolution":{"observed_at":"2026-07-09T16:56:22.040900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.967656Z","title":null,"venue":null,"work_id":"0d583751-4756-476e-8bba-9cf259cd1f9e","year":2016},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:45da3ceab27295f45c0514410ad067740554695fe4f2ecc491a8c17fe74c10cd","observation_id":"e0048019-6512-4c09-a4f1-089dc430a567","resolution":{"observed_at":"2026-07-09T16:56:21.968729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.088762Z","title":"TLdR: Policy summa- rization for factored SSP problems using temporal abstractions","venue":null,"work_id":"504eaa14-9e9f-4696-859f-9576965d3553","year":2020},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:0562c181e63b3e1ab62591a7c6d5bd7ed05274114a065ce14dccb1d130edaf8f","observation_id":"cc790010-7856-4531-bad3-284be3ce8126","resolution":{"observed_at":"2026-07-09T16:56:22.089865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.992147Z","title":"Sutton and Andrew G","venue":null,"work_id":"51abf036-a6e9-4d33-a68d-cdff1e82f494","year":2018},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:fa160d784f73207ca38eab82f217f3edc742d380bf62220325c72021a58c9599","observation_id":"e34875ba-c9e8-4968-ab0d-1d5dc811298c","resolution":{"observed_at":"2026-07-09T16:56:21.993176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.997837Z","title":"Lopez-Miguel, Sebastian Tschiatschek, and Ezio Bartocci","venue":null,"work_id":"98d03334-ef8c-4189-bcd4-d04f9b03f093","year":2025},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:98ab032d34b64b87be568d79381c8225b01ed7a8970789407168ecae9f8c8048","observation_id":"0e389471-d6f8-4aea-a3cb-8f7cefb001cc","resolution":{"observed_at":"2026-07-09T16:56:21.999448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.081621Z","title":"Thorndike","venue":null,"work_id":"7ca75dec-7ea7-4c6f-ae21-d9e242e9588d","year":1953},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:c0df60c8f711362eb815a9cb74e70594b60b4a4d96e5ac1d39181baca9fa047c","observation_id":"b2feae48-b140-4c81-9a4a-c78ee8a53fff","resolution":{"observed_at":"2026-07-09T16:56:22.082832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.078291Z","title":"Generation of policy-level explanations for reinforcement learning","venue":null,"work_id":"0419241f-f3b8-4a30-9d09-e4c3874d325b","year":2019},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:94189a95cdad4149f9e671abbc1dea03b11f0bd63ad63befbee5eb810b8b6064","observation_id":"d98dba57-a15d-49a8-8e9f-1708c110b5cd","resolution":{"observed_at":"2026-07-09T16:56:22.079475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:55dbc87b7de49ac3f3c6b792baacdf127d3b4ca32c56471cb0d24d816d79b872","observation_id":"6c9c76c7-1fe5-4fdf-b0b9-3e424e276304","resolution":{"observed_at":"2026-07-09T16:56:21.670208Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-08-13T22:24:37.672685Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":"2407.17032","doi":"10.48550/arxiv.2407.17032","metadata_source":"pith","pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","venue":"cs.LG","work_id":"5382dc1c-a327-49b9-afda-4794d5847698","year":2024},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:87605c0228ef930681e4f63860381a7aa166750ec74241dfff164975534326d3","observation_id":"a4705d3e-e105-4f68-9e88-d2764c5588fd","resolution":{"observed_at":"2026-07-09T16:56:21.666207Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-13T20:21:08.751241+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T20:21:08.751241+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.099578Z","title":"Executive Office of the President","venue":null,"work_id":"95cea6fd-ff92-4199-a082-010f904cbddb","year":2023},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:8f0b7a7953007966ca58deccb95f5e6802ca136952cfc18bac8d4d07cfb770fb","observation_id":"cba36f43-343a-45ae-bd76-acf8d6a454bd","resolution":{"observed_at":"2026-07-09T16:56:22.100554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.092239Z","title":"Self-interpretable reinforcement learning via rule ensembles","venue":null,"work_id":"b8a939b7-ebbe-4cd8-9be4-f8a6e9609c04","year":2025},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:509bd7c3b0810499c612b074fe36fdc7a603564cec87918e4accd909e294c585","observation_id":"948337c1-0488-4ae7-8b7a-4bc249936672","resolution":{"observed_at":"2026-07-09T16:56:22.093513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.024173Z","title":"The actions from this model are compared to the ones that the original RL agent would have taken in those states","venue":null,"work_id":"289fbaec-5421-4858-b2f8-058774d5874c","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:38d1305983e0754b7034df92d9a84d5eab512c0fba5a89c378ab583f334e6695","observation_id":"0e460d45-83ff-4207-8ca3-c8e768b14fce","resolution":{"observed_at":"2026-07-09T16:56:22.026645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.074472Z","title":"This refinement step is repeated until performance degrades or no more useful data can be collected","venue":null,"work_id":"dc7057cf-1313-4850-b273-5892f3b6c30f","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:85f7c0e8fb49c0783bb8f49061178fb2c8358f5e0621fa6eccec6f54fa0e000b","observation_id":"7bd66b88-918d-437b-9f67-bf654aab4fe3","resolution":{"observed_at":"2026-07-09T16:56:22.075805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.085102Z","title":"This places the focus on the states where the RL policy and the learned model differ the most","venue":null,"work_id":"782a462d-159d-4da9-9846-eadd83372372","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:0f4dca9fdfd8e75de77c75a0c54e03cef0c982dba8d7e9e544fd2475f4a3b13b","observation_id":"1af34b8b-c51e-4424-b9b9-2b0b75536c6f","resolution":{"observed_at":"2026-07-09T16:56:22.086454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.069404Z","title":null,"venue":null,"work_id":"7650a5ef-c27d-4edd-a601-484c492c764f","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:33e5be149e5cf874ea3252658aed31cf2ae91eac0526481b1762d3a2ec43b0e1","observation_id":"127fe472-e26f-493a-8e61-f66560c1c166","resolution":{"observed_at":"2026-07-09T16:56:22.070614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.072726Z","title":"comb-as & random-rs-nm","venue":null,"work_id":"d922695d-610e-4094-954a-f6c5dda01284","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:a52c3a21f27a7aa69cf10a27b731c2ed4ee4afd950d4e4fb08dcb30ced5f24b0","observation_id":"ed889c6d-2ae5-438f-a0fc-b8dabb7bdc3a","resolution":{"observed_at":"2026-07-09T16:56:22.073943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.062148Z","title":null,"venue":null,"work_id":"2928d3a8-27c2-4f2b-ba6b-6a126b582f3b","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:7a81f1c803a903e6d7668a3c70d419d3730959a7d79c6ba4b6e9066770ab5e73","observation_id":"35a6da98-cee6-4468-805b-46332dbc47cb","resolution":{"observed_at":"2026-07-09T16:56:22.063283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.096175Z","title":"The following section shows how to understand the results with an example","venue":null,"work_id":"c832cff9-b282-4b93-9f77-f73b04d8b668","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:cce993bc5c4b98a34eafa8d5244835ad377c23e703300c0603b3f7de861b8fa2","observation_id":"e010f38e-c86f-4eba-a7b4-83e73276cafd","resolution":{"observed_at":"2026-07-09T16:56:22.097387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.058667Z","title":null,"venue":null,"work_id":"21f8e9db-594d-4621-89e0-48626b1817ce","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:268582124e0245db6c0df9ef01bf2ace673404b0de3d9907500aa221e4ce55e8","observation_id":"a7357b0c-4a9f-4d8a-a416-73bac1155633","resolution":{"observed_at":"2026-07-09T16:56:22.059838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.072918Z","title":null,"venue":null,"work_id":"f26078c3-26a0-422e-b075-443470a3e7b7","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:a9ddcb413a970a3cbb2521af3c244351e0556907b1006e7d7db94a1ddb38dd48","observation_id":"b721386b-6df8-446a-bde8-14d76c6c1f66","resolution":{"observed_at":"2026-07-09T16:56:22.074084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.077453Z","title":null,"venue":null,"work_id":"55e043b5-347d-41f7-8865-b41751abaee9","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:7fde2c62d8967ed84759416e81c18b1209937520ca09cab2f0fe15e9e474372e","observation_id":"b85219db-6e94-4f80-b593-ba8c39e1b37e","resolution":{"observed_at":"2026-07-09T16:56:22.078662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.070983Z","title":null,"venue":null,"work_id":"8cfbff01-c044-4fbc-9598-0015d771a380","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:3c62eaf2e7fd8d1fb75d91912b82c3f226068a035aff377c258306666e8b9f08","observation_id":"85c4759a-fb28-474a-a388-4678b482837f","resolution":{"observed_at":"2026-07-09T16:56:22.072292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.079708Z","title":null,"venue":null,"work_id":"73e338fc-47c4-41af-9266-b0ffc067d7ee","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:30221833e4705e41e18b3fa3f08095fdcc8fdaad7cfdaa5c036894061965bef5","observation_id":"fb216f47-85d1-4a0b-8455-d946f9af4081","resolution":{"observed_at":"2026-07-09T16:56:22.080829Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.083215Z","title":null,"venue":null,"work_id":"c3466bc9-f7b5-479a-94b2-f37fbcdc25f0","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:c8d21ae11b162d50d81372648b3a4abdeeaa7f82dc3c26d885669cca676e69b7","observation_id":"18e1c178-c83a-4d71-b66a-c9c5267b017d","resolution":{"observed_at":"2026-07-09T16:56:22.084403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.084978Z","title":"What is the policy at the edge of this region?","venue":null,"work_id":"19368d56-4f5c-4854-92cc-88dd85f24853","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:033993b16f9f33a779a66f7cb7cb39e0dd410b6100c7c7182ef58b16bb2f7a2a","observation_id":"d365ca1f-06a0-478c-bbde-46b5dc80b8ea","resolution":{"observed_at":"2026-07-09T16:56:22.086763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.050525Z","title":"3: Slight perturbations cause noticeable changes in the explanation or in the operating modes it captures, while preserving core decision logic","venue":null,"work_id":"f66410c2-b1d4-4d0d-bb39-e98add06634b","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:db6fcd5654fc340d58ef1b63d68e9a7b56377d0db98ad3b1c380f0ae981a0aa6","observation_id":"b876cb71-3b20-45e0-92fa-d4e5b26c700b","resolution":{"observed_at":"2026-07-09T16:56:22.052216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.041902Z","title":"3: The explanation reveals sources of bias, but fails to capture causes, e.g., resulting from the 21 environment","venue":null,"work_id":"e8602798-6b06-4bf1-8bdb-ebdc2f78c57d","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:e84eb29c662e9bc9f35297e9bdc49115ca8f01d534cb86992f55d1cba7afc91b","observation_id":"bed4a64f-a5d4-4437-a1f7-107e8917e971","resolution":{"observed_at":"2026-07-09T16:56:22.043363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.087290Z","title":"3: The explanation supports reasoning about either policies with deviating behavior or slight environment variations, but not both","venue":null,"work_id":"2a08ea3d-275e-4b1a-b10d-eb6bf53b04f8","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:77ef074baa38b92dd291af7c232e989560587647f2b8e506299516927a3af7dc","observation_id":"375f1842-8ac9-4583-bca2-6a2cd8f5dc41","resolution":{"observed_at":"2026-07-09T16:56:22.091722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.028179Z","title":null,"venue":null,"work_id":"afdc20a3-877f-4a96-827f-d425e5efc40a","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:0dec58f9f7631c6afd94c3f8e15ccb2683d6ecedde453b9c05d4321a76f9f532","observation_id":"6e306947-83ad-40ba-b2a6-2852e104f473","resolution":{"observed_at":"2026-07-09T16:56:22.029711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.037308Z","title":"3: Some factors leading to a decision are omitted and verification and validation requires substantial engineering","venue":null,"work_id":"0debfc33-420d-4f55-a640-e8f507e13068","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:841c0f71d13e896adf4399ff6b667f9110f1ab05f027d1af07cc8d47c840aedc","observation_id":"e64e9a70-a9b6-4bec-aee0-f2ceb0ab848c","resolution":{"observed_at":"2026-07-09T16:56:22.038898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.035117Z","title":"3: The explanation contains relevant details, but also details that are not necessary","venue":null,"work_id":"14091455-1b18-4e80-904c-305053d5ca4c","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:66633a7cde705ed1d8c615a096496b07e50fccb02ab83d7c0e09096328beb8bd","observation_id":"955f42ba-9f85-4bb2-b3b3-81559205f441","resolution":{"observed_at":"2026-07-09T16:56:22.036509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.081362Z","title":"3: The explanation provides some insight, but modifications require familiarity with the control policy","venue":null,"work_id":"0da90584-06db-48b9-aaa7-b6ad109bccac","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:52c78f911116bbcf814fd61a3c4dbf5a124081df8164c9453919f1a44da34da2","observation_id":"72d855b9-a287-411e-92ab-aa9c4b99fe54","resolution":{"observed_at":"2026-07-09T16:56:22.082706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.006295Z","title":"3: Some partitions reflect expected operating modes, while some are arbitrary","venue":null,"work_id":"e25ae328-653a-4cf0-bdec-4b0c19e4adf3","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:cac0b1525feda1ad96b82665a025778db9de124add9e9b347f3bd2bfb6af8055","observation_id":"f3d43360-672a-49e0-83e8-6f520afbfbca","resolution":{"observed_at":"2026-07-09T16:56:22.007732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.008426Z","title":"3: Some regions have partial semantic meaning, but others are small, fragmented, or unrelated to the environment’s dynamics","venue":null,"work_id":"89bdb7d4-1459-4ff5-9d7b-8cd5e07a564c","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:c0532f64faa8a3e46985324a7d262f85f3639ee50e8ca7135846dec2f6a10d2d","observation_id":"a914d9ac-5b10-470c-be13-6ab3ad290f8a","resolution":{"observed_at":"2026-07-09T16:56:22.009859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.959735Z","title":"3: Users need to consider various regions and alternative decisions to trace failures, and failure causes cannot be unambiguously deduced","venue":null,"work_id":"e696b61d-1300-422f-a4ca-347c9d52e2a5","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:2c742b9192f70391f31163f2407e4b4b22cbec9ba66edf1c64279ae79dbbdef1","observation_id":"aeb792bc-872a-42fa-84ba-ae2523590321","resolution":{"observed_at":"2026-07-09T16:56:21.961642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.087015Z","title":"3: Users knowing the environment understand the aspects of system dynamics that prompted the definition of several regions, while others do not correspond to system dynamics","venue":null,"work_id":"b0b0f49e-55ff-4f27-bdcc-6bd7494d88b1","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:0bb6c7d320d0226ddccd4a81dec9c2c8799ae38ab54426351b591604ae70965a","observation_id":"d79d700e-942f-4407-a557-4f6927388a67","resolution":{"observed_at":"2026-07-09T16:56:22.088259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.046401Z","title":"They balance granularity and interpretability while maintaining clear semantic links to the envi- ronment’s dynamics","venue":null,"work_id":"732197ab-9b97-4424-ba64-7a9e7355138c","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:b3710e691dd293fcad769793244b3caacaec51904e216aaac5b2470925e93690","observation_id":"64aa95c2-2d6a-4eb5-a167-07bb6fdb2de1","resolution":{"observed_at":"2026-07-09T16:56:22.047836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.063986Z","title":"Regions capture essential dynamics without redundancy, balancing simplicity and completeness","venue":null,"work_id":"ed05b3b6-d155-42d1-985c-7143f0c95cb2","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:101d91d80262470c1ca669b4e1fd57ae97393ea4ac675adef0890ec36dc79689","observation_id":"3f39e2a3-e693-40fa-ad9d-82afdd8a6bce","resolution":{"observed_at":"2026-07-09T16:56:22.067481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:22.094335Z","title":"Parameters are interpretable and contribute to clear, concise explanations","venue":null,"work_id":"07affb04-7c3a-4592-87c9-be10c13e0ec6","year":null},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:ea85d7000cb19c2306b317ce9ce9aaf15623725670fda65270755040ba85adea","observation_id":"c85dc003-bf56-484f-85b0-b699c21aeccb","resolution":{"observed_at":"2026-07-09T16:56:22.095605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:56:21.983763Z","title":"rel. improvement","venue":null,"work_id":"43200a15-9e8a-4060-8b28-51eb624dd161","year":2019},"citing_paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-09T16:53:06.017613Z"},"links":{"citing_paper":"/paper/2607.07235"},"observation_digest":"sha256:d56cd665e3b8d38e6ae651019773e0f253f506f01b8d582c1855293a1ab1c09e","observation_id":"0d9c212c-2f87-4c7e-939c-557bd899d03a","resolution":{"observed_at":"2026-07-09T16:56:21.985115Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.07235","last_updated":"2026-07-08T10:16:17Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T00:08:24.666683Z","submitted_at":"2026-07-08T10:16:17Z","title":"ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":18,"verified_exact":2,"verified_fuzzy":56},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 0 inbound Pith citation observations for arXiv:2607.07235."}