{"as_of":"2026-08-09T03:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b886158343e6cd7a2950b5cddf87136c6f05c9c0d6d61df7a180be5b3fb557fa","coverage":[{"denominator":175,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T14:02:55.681719Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16210/citation-record","integrity":"/paper/2607.16210/integrity","json":"/paper/2607.16210/citation-record.json","paper":"/paper/2607.16210"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.128461Z","title":"Verifying Global Two-Safety Properties in Neural Networks with Confidence , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.128461Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:947d8388abd88de8b9390c58edba1e085ecc6c1a13388c29e538ebb673862e27","observation_id":"775c723e-81df-435e-9866-72cca0146453","resolution":{"observed_at":"2026-08-02T14:02:54.128461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.199809Z","title":"Formal Methods for ML-Enabled Autonomous Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.199809Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:4e9276c58ca147cc4ca39ec5967315ac135e7c56ffc2ba3222cdc89a968c4d18","observation_id":"85c72701-09a1-497c-9a34-3c711073e0cd","resolution":{"observed_at":"2026-08-02T14:02:54.199809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.282110Z","title":"International Journal on Software Tools for Technology Transfer , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.282110Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:ccbac62c9870573a01f08c166c9157934e86681f31792258a53013fea54a450f","observation_id":"38092ef7-facd-412c-a791-b75d191a54fc","resolution":{"observed_at":"2026-08-02T14:02:54.282110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.293450Z","title":"CAV , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.293450Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:60b9722463feeb08d0664b0dff9cff191cd5d97a05ce887ceaa47f210092201b","observation_id":"0eef7a90-2eeb-41ea-bfa3-cd892fd27f5f","resolution":{"observed_at":"2026-08-02T14:02:54.293450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00263","last_updated":"2022-04-30T13:12:33Z","snapshot_observed_at":"2026-07-06T13:05:23.190497Z","submitted_at":"2022-04-30T13:12:33Z","title":"Complete Verification via Multi-Neuron Relaxation Guided Branch-and-Bound","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.00263","snapshot_observed_at":"2026-08-02T14:02:54.347830Z","title":"arXiv preprint arXiv:2205.00263 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.347830Z"},"links":{"cited_paper":"/paper/2205.00263","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e9e4b2e9bbd48b08a40749b23a489df274b52663681e9b5047fa18e7447c88b3","observation_id":"1e6f262d-a70b-4e84-a067-704f1e9c9a91","resolution":{"observed_at":"2026-08-02T14:02:54.347830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.361856Z","title":"International Conference on Formal Modeling and Analysis of Timed Systems , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.361856Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:6bc9bba298390a0efb1b69efe060c16d5dd117e501f8ea5aa49dd2af6561dfa0","observation_id":"cf3191d2-145e-43de-ba28-919abe31674d","resolution":{"observed_at":"2026-08-02T14:02:54.361856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.364678Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.364678Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:5655ea87a33082432cb6dcc56b675edfb32851d59f8283f9c6727e5a3ea7070d","observation_id":"64367a46-990d-4857-a652-015a21c6245b","resolution":{"observed_at":"2026-08-02T14:02:54.364678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.367725Z","title":"Proceedings of the ACM on Programming Languages , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.367725Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f50e2d3b4a2f56c621a3b43159fe8acad41af11b7b131a6da27145e390a4f59b","observation_id":"7bb573b5-6643-417e-b9ad-77a43ecbd849","resolution":{"observed_at":"2026-08-02T14:02:54.367725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.370534Z","title":"The Probabilistic Termination Tool Amber , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.370534Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:69328151e34300983846bc74b4503280fff34162e4c825194e0693ffe358ead4","observation_id":"4c8dee03-651c-49ab-83f5-b4c7c47d6e29","resolution":{"observed_at":"2026-08-02T14:02:54.370534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.376144Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.376144Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:2a352be39b0ed7870ed4186eae8c8b870613ea99510bd6f581b8ad52d3f62c21","observation_id":"958ffb89-fe6a-43a9-8fad-d467ce980f40","resolution":{"observed_at":"2026-08-02T14:02:54.376144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.381104Z","title":"Lopez-Miguel and Sebastian Adam and Ezio Bartocci and Thomas Eiter and Martin Tappler , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.381104Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:816a6289c7b2d0c894a12dc6c6af4695fbd1e4264490dc38308ba3b3331d7c9f","observation_id":"f4ce62e7-ab40-44ad-aead-6a280367398e","resolution":{"observed_at":"2026-08-02T14:02:54.381104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2025/1264","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the Thirty-Fourth International Joint Conference on Artificial Intelligence,","venue":null,"work_id":"aa6e1249-c678-49d1-9107-406a43ee720d","year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.386374Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:566492008be0363701becddc9a851f98d164ffcf753de5311ad9af77ffaa2914","observation_id":"b47aa3c9-f381-4bbf-83d4-92dca484ff46","resolution":{"observed_at":"2026-08-02T14:03:33.338011Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.391796Z","title":"Yun and Peizhi Niu and Xusheng Luo and Changliu Liu , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.391796Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:9aaee3f40f68e13deb1b4ed501d1fb3f93fef9869ae03e4b46eaece15c6440cc","observation_id":"7f57d7da-d093-4a36-b05b-081710e97866","resolution":{"observed_at":"2026-08-02T14:02:54.391796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.395784Z","title":"Donti and Changliu Liu and Enrico Marchesini , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.395784Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:412c071af1fd0ba25018c23319e5cb17886e453380197e1270837dcd0f2fc380","observation_id":"9ede5dc4-2df1-4be3-b639-0107d5c401d6","resolution":{"observed_at":"2026-08-02T14:02:54.395784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-02T14:02:54.401533Z","title":"Christiano and John Schulman and Dan Man","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.401533Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:2cb540fec6133195b5395c3e73eebb6edec01444cbe01e80161e048a3ee7752e","observation_id":"757218a8-9bd6-4894-be10-ae47ad59f567","resolution":{"observed_at":"2026-08-02T14:02:54.401533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.407560Z","title":"Conference on Artificial Intelligence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.407560Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:08e49aa6b739274c21166a5114408b7a8f9b6372c2a3a7c8b6f0bd39697244e6","observation_id":"9dab8827-1a78-475e-89e7-6d97a7009439","resolution":{"observed_at":"2026-08-02T14:02:54.407560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.412473Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.412473Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:c8fdcd79433dcaf7d6460ca8291fd72c01462576a99a2f15ea9d0c466208377c","observation_id":"8b3a9b81-2009-4079-afdd-bdd487d30815","resolution":{"observed_at":"2026-08-02T14:02:54.412473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.418769Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.418769Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:b04b216233991cf13b3a368eaf914f2c0a0b1fa79d90b82f7ec7c34df32f087f","observation_id":"0293e842-18c7-4ef1-9bc8-9509c7927d28","resolution":{"observed_at":"2026-08-02T14:02:54.418769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.423945Z","title":"Proceedings of the 2023 International Conference on Autonomous Agents and Multiagent Systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.423945Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:54236c68741051839d2a25bffe84f2a9de87199ca3834d966b97c3337c906a2e","observation_id":"abf9afab-3eda-4290-b432-6c1bf519ada3","resolution":{"observed_at":"2026-08-02T14:02:54.423945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.429639Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.429639Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:45e9df87076949bee4ccf1c7d43ec42923125640ccce01d642be8cabe4648eb5","observation_id":"ae1e88b9-290e-4cdc-b5c0-463a1e67bd57","resolution":{"observed_at":"2026-08-02T14:02:54.429639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.434588Z","title":"2025 , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.434588Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:1984e6f28de8e1097e4dfd433226be9c875b0c9ac1d04279a25ffbb069167f0d","observation_id":"7bd54849-0944-40de-af52-7d1d4e809b51","resolution":{"observed_at":"2026-08-02T14:02:54.434588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.439294Z","title":"IJCAI , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.439294Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:22d2dbff77b763bf48741c5c4cafaa0683d09456c80f34503ccc2e1186213bce","observation_id":"8bea831f-7f75-4af5-8c7f-683077cf1fc9","resolution":{"observed_at":"2026-08-02T14:02:54.439294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.444739Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.444739Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:3d3bcad6d13161acada645f80b9ae3222b7334bd00c9e2684c340c32e5c49cb1","observation_id":"a3eecd15-44ef-4e1b-92a4-31a0a39a10c4","resolution":{"observed_at":"2026-08-02T14:02:54.444739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.450046Z","title":"Tools and Algorithms for the Construction and Analysis of Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.450046Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e422e23bf75f52442b1c393d763b75c91a533649bd74e010c9a16b6e750f1c6a","observation_id":"f1cf0f00-b126-4987-96fd-5617fa5e2a0d","resolution":{"observed_at":"2026-08-02T14:02:54.450046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.455306Z","title":"International Conference on Machine Learning , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.455306Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:6497df264414b339cfd4c01e6fc1f8a20903756e6e0d53e88675919f09939b36","observation_id":"f39dad8d-0c24-4f33-88c1-ed9716e2c576","resolution":{"observed_at":"2026-08-02T14:02:54.455306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.459469Z","title":"2022 , url =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.459469Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:7e08514f2b178bbd863cafd7fcf16827cc6a9ecb9e65dfb4a879a3c764ece3b3","observation_id":"920f6f33-e92e-4d12-9f1d-4e44554fc2d7","resolution":{"observed_at":"2026-08-02T14:02:54.459469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.465126Z","title":"Towards Hierarchical Task Decomposition using Deep Reinforcement Learning for Pick and Place Subtasks , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.465126Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:be773dd268fb9b3e2c75f1a8adb5a441476a352697ac39c4037a18be595f51e2","observation_id":"e258d0de-3275-459f-9d64-e861479af162","resolution":{"observed_at":"2026-08-02T14:02:54.465126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.470222Z","title":"International Conference on Computer Aided Verification , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.470222Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e263547cfe161ad361ba6fa17d18900b377762dabe9b0348dcbbd3b11575e220","observation_id":"2acdd3e2-153b-41a6-8227-d6a02052b44d","resolution":{"observed_at":"2026-08-02T14:02:54.470222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.474294Z","title":"2021 , isbn =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.474294Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:c56b4021da9ddcf6522e40774fa3a8f892e7bb243e8ed77a24fd1f160fd0aff0","observation_id":"83a91d41-b1b1-4948-bfee-ec2db7a21f3a","resolution":{"observed_at":"2026-08-02T14:02:54.474294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.480867Z","title":"CAV , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.480867Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f0ecce443fefac2d65dbf91213813a092ca9d4b5b52ce28b0d74de8da13be16d","observation_id":"f4ac6ec9-5ed6-4252-88f8-b345a5bf2a9d","resolution":{"observed_at":"2026-08-02T14:02:54.480867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.485366Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.485366Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:9fffbc392e1381957c0f4b151b2e468ec12bb7b5b4e5b4d360ddd04410d84d06","observation_id":"096f35b5-1885-49dd-8e38-87438550458a","resolution":{"observed_at":"2026-08-02T14:02:54.485366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23903","last_updated":"2025-09-05T15:41:39Z","snapshot_observed_at":"2026-08-05T13:27:13.023088Z","submitted_at":"2024-10-31T13:05:46Z","title":"Neural Network Verification with PyRAT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23903","snapshot_observed_at":"2026-08-02T14:02:54.489903Z","title":"arXiv preprint arXiv:2410.23903 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.489903Z"},"links":{"cited_paper":"/paper/2410.23903","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:1595e3973d85c0dd5bf97cdad4d7e5f696457e9181513b3a5dac7d06d85445ad","observation_id":"41b728e9-918d-4a99-926d-63c45eba8c66","resolution":{"observed_at":"2026-08-02T14:02:54.489903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.495437Z","title":"International Conference on Formal Modeling and Analysis of Timed Systems , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.495437Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:624bfd910cce2cb199bedc958cf78734dba7047f7eded1799ac27012ea0eb0ed","observation_id":"563b9d86-8252-479d-9e67-d93dd5c64cbc","resolution":{"observed_at":"2026-08-02T14:02:54.495437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.499588Z","title":"HSCC , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.499588Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:bba7c1b429f10220388956c1384ed54d3d730122e4df2ce201a36ba07ae36340","observation_id":"81196328-c092-49ac-8171-98b7a99d1f46","resolution":{"observed_at":"2026-08-02T14:02:54.499588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.503860Z","title":"FMAS , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.503860Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:7a463b5a6bc5083db3194a53b6dd899d0041418d176ea6fdd8e13cdaac5a1c00","observation_id":"297d5b24-c32b-4458-9d35-c926bd4ebdca","resolution":{"observed_at":"2026-08-02T14:02:54.503860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.508400Z","title":"CCS , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.508400Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:79fedd35106fbe8f846aceb359c51823b3f3ecc8f152b8600687e9988eae0022","observation_id":"3436bda5-114e-437d-9a12-206eada7a556","resolution":{"observed_at":"2026-08-02T14:02:54.508400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.515357Z","title":"Proceedings of the 26th ACM International Conference on Hybrid Systems: Computation and Control , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.515357Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:515e300677575e01b497481f805dd16c955bd975cf6c07a2a3d7ec84b3b9805f","observation_id":"e7f8e6dc-42be-4a03-b9bc-2a166314f0a2","resolution":{"observed_at":"2026-08-02T14:02:54.515357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.521862Z","title":"CAV , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.521862Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:c4819d0a44b7f4e7a3e32cc2b10e2a3490cbf0d681dba1f19eca22ddc6c76a4f","observation_id":"abb7a3f9-abc2-435a-adc6-400aa85f9f22","resolution":{"observed_at":"2026-08-02T14:02:54.521862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.526634Z","title":"IJCAI , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.526634Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:8cbb69dddd80bf24003138f198be8d0dac1c79b7267941cc964d8ae94fbd8511","observation_id":"d0a931f4-e53b-4e4b-bd22-4ffa4c0eaad4","resolution":{"observed_at":"2026-08-02T14:02:54.526634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.532408Z","title":"NeurIPS , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.532408Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:a86dedafdac70c808cd92323776996f618aa0e4616e806c0f04d29b1c81ec0c8","observation_id":"f6ec1425-faf6-41b0-9069-e6d53b3a2a52","resolution":{"observed_at":"2026-08-02T14:02:54.532408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.536543Z","title":"NFM , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.536543Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:6dce9b0a8923d83cf1a8c686a2ce015006e88de788c830b7b8b21d283c6e2843","observation_id":"5230a4ec-394c-4ba2-9386-9a9cc401d060","resolution":{"observed_at":"2026-08-02T14:02:54.536543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.542073Z","title":"arXiv preprint arXiv:2401.XXXX , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.542073Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:5dfc20d756221814df80cf6b92a3a15d30d445e57d409812090fc501cc24ca62","observation_id":"4ab8e62a-0713-49ec-9133-efd3e05a3666","resolution":{"observed_at":"2026-08-02T14:02:54.542073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.546362Z","title":"ATVA , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.546362Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:3046b45b97be31c271c6b1b66049519a0ff9bac339197535473ffccbea8130cb","observation_id":"3c105dbb-9691-4795-8a4e-84a44bca20a4","resolution":{"observed_at":"2026-08-02T14:02:54.546362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.552002Z","title":"ICLR , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.552002Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:55b674865354ce889a176f1823140284fdc671e553956a4047bbadda22fc3ac8","observation_id":"dc0b26a0-8df5-4078-8828-727f88da68f3","resolution":{"observed_at":"2026-08-02T14:02:54.552002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.557035Z","title":"NeurIPS , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.557035Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:b766f0b66858249c698d29ed8b603c90f7dca9ff8d89d15036973be0d2af9852","observation_id":"49a3af2e-5889-4c3e-b1a3-b19fb2a7d164","resolution":{"observed_at":"2026-08-02T14:02:54.557035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.562984Z","title":"Proceedings of Machine Learning Research vol , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.562984Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:78ee418c0c7919c55ef832bfa3b37974a475e14939182add4197067e98e84478","observation_id":"0c5f1a02-251a-44de-9d2a-e722920fb95a","resolution":{"observed_at":"2026-08-02T14:02:54.562984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.571918Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.571918Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:7d855409ea2a5a1b4ecaddb70ef88e6894313bc51cdf04293d8283ad62e453e7","observation_id":"014e5340-a219-48ff-8279-c5e6dc3a3f8e","resolution":{"observed_at":"2026-08-02T14:02:54.571918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.579508Z","title":"IEEE Access , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.579508Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:5df80f188136eea6af8444b17ea81c888dd5af33d3a9a180e3d80e0cff8e40a0","observation_id":"2d221fb6-8f5a-43f9-9fd8-396b5aaf526d","resolution":{"observed_at":"2026-08-02T14:02:54.579508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.584806Z","title":"Journal of the American statistical association , volume=","venue":null,"work_id":null,"year":1963},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.584806Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e84080b5b7e0d4308c4c5dc8f17e6ee8ff7907b40af7f01538cbd0a412e64087","observation_id":"6f9fa095-f511-483d-a305-8f7d8aab5a2e","resolution":{"observed_at":"2026-08-02T14:02:54.584806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.591861Z","title":"Neural networks , volume=","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.591861Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:0b47ff6000f744000473772a4b9954dfdf5b1eac290a85c056b21c69d9d6cf3f","observation_id":"c59fe1c0-967b-460d-ae15-234b6492a7b7","resolution":{"observed_at":"2026-08-02T14:02:54.591861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.609331Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.609331Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:be762f9e11af5d98b26a76007f93c0fc47557591fce6ad314c1ab1d9913b7c34","observation_id":"971b887f-a444-4b73-a526-dd422d790993","resolution":{"observed_at":"2026-08-02T14:02:54.609331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.614212Z","title":"International Conference on Formal Modeling and Analysis of Timed Systems , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.614212Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:81c4fb29359ffa783eb0c2f38f16e0074248b6163fa5542e8d10223e388642f2","observation_id":"d92b994c-efc5-4433-a3cf-2b2161027d12","resolution":{"observed_at":"2026-08-02T14:02:54.614212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.624387Z","title":", author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.624387Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f17290c98dce38a4af01eaf1b63d0d48a4287277ba2b591a8a78107bda5f8c7a","observation_id":"89bc9ba0-61c9-4113-a8ea-17cd5961a361","resolution":{"observed_at":"2026-08-02T14:02:54.624387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.640847Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.640847Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:20bcb3a36207c1216d752a7012453ecbf57d3341e7c3bc44d05a9f005d565f12","observation_id":"74138e14-8826-4fd5-864b-4d617a281900","resolution":{"observed_at":"2026-08-02T14:02:54.640847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.648543Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.648543Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:9db010e6f97c4f7842edd90734e11abc24c139bec168e2aeca6dd2534923a80a","observation_id":"323101d5-117d-414f-b8bf-f189fa9a5ca3","resolution":{"observed_at":"2026-08-02T14:02:54.648543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.654109Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.654109Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:8ee157c1a8f1cfe63b2db9b5b15758008d529bbb8e5c5ee21370ea79f540705c","observation_id":"aca4cc9d-9d1b-4b5b-875d-b2326cc0ec93","resolution":{"observed_at":"2026-08-02T14:02:54.654109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.659378Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.659378Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:fd5c512816615a776dc5896b57d65da478a7fe9c582527bc55a475d5eabb621c","observation_id":"78880f66-0f38-44d1-8962-22b2270a2e56","resolution":{"observed_at":"2026-08-02T14:02:54.659378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.666736Z","title":"Journal of artificial intelligence research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.666736Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:4440fb856bd7dc88210e093a60d2342ef8977bf33d722072ee7696e0d4b1a21c","observation_id":"8a1ee006-076b-4079-9841-b93457f8cf59","resolution":{"observed_at":"2026-08-02T14:02:54.666736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.675611Z","title":"Communications of the ACM , volume=","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.675611Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:b42b87bce36a0b048ffc2303765df8b9715454315eedff4ba76f65996b952683","observation_id":"b3a3c11d-0eb9-4c67-8122-194c26dd1eb2","resolution":{"observed_at":"2026-08-02T14:02:54.675611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.682299Z","title":"Journal of the ACM , volume=","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.682299Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:178d7cd1f2a3d2b95d587276f5cb747b8d0016ad215687e6772391a0ecef746c","observation_id":"6e37a39f-3867-4aae-a621-ac5b5f2f26da","resolution":{"observed_at":"2026-08-02T14:02:54.682299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.687097Z","title":"Nature , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.687097Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:a223b8d77035a71e35024b3c7b34cbd4cad2cd74d5417240fa2392138da10420","observation_id":"93679887-0aee-47c0-b20b-d06399a8f453","resolution":{"observed_at":"2026-08-02T14:02:54.687097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.692049Z","title":"Theoretical Computer Science , volume=","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.692049Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:42d3a1ae9243edeea826d0dfa1842e64ce4935418015c27f3a317bbe06f58f44","observation_id":"57f12127-635a-4d99-908d-6997d28ecc1b","resolution":{"observed_at":"2026-08-02T14:02:54.692049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.705462Z","title":"International Journal on Software Tools for Technology Transfer , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.705462Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:018f1201aa7299df4c09614953185511220f7192bda0ccb55c4279042fca9a5f","observation_id":"90c10f2f-666a-4e14-97a4-059b66d4532d","resolution":{"observed_at":"2026-08-02T14:02:54.705462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.740220Z","title":"International Symposium on Automated Technology for Verification and Analysis , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.740220Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e539613ed8d162abb2d33f7a1e128a82648307229f49c186a2cc793029ea4b5c","observation_id":"531a90c2-e617-435f-b36b-188c7612fd46","resolution":{"observed_at":"2026-08-02T14:02:54.740220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.768220Z","title":"2024 , author =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.768220Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:2f77daad295bfea9f35a223295e27abb6b9ad6c8421ea67737fb4a633a1f38b4","observation_id":"cfa273dd-02a2-4abf-9d18-645d8bb325d9","resolution":{"observed_at":"2026-08-02T14:02:54.768220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.804276Z","title":"CAV , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.804276Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:104046ba5f1c214de268026232d761eea7ff30361aa9711d803bbbbdca76ad7f","observation_id":"5824362f-801b-42d3-a6ec-f5d9bcc4b32c","resolution":{"observed_at":"2026-08-02T14:02:54.804276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.842203Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.842203Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:b18decd27cb4d920e9461bb7b57f89ad2ba08546ee60f29781d5c67efec4a132","observation_id":"8565109e-8942-4a3d-9ef5-217ce055e4ec","resolution":{"observed_at":"2026-08-02T14:02:54.842203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.869582Z","title":"Robust Explainable AI , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.869582Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:4dd3ec46729a350d8912e441c082220901d5d5e08286f31c989c86c93796533c","observation_id":"af3bfcfa-170c-44aa-aa02-89063c9c8b9b","resolution":{"observed_at":"2026-08-02T14:02:54.869582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.905797Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.905797Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e99bd307fdcb00a7cf4f978dedaf0f01e2e5d318d0c71f299e0d845b0bd9b83b","observation_id":"bbb6c472-4f12-4455-8855-2b94e543c78c","resolution":{"observed_at":"2026-08-02T14:02:54.905797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.958941Z","title":"NeurIPS , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.958941Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:886db6a05f9f1a2f59a5c95a1b16a1560acf9a76d8c5f613dbd6c97bf9875fb1","observation_id":"943878ce-a8de-42df-a3dc-82a7e0d24683","resolution":{"observed_at":"2026-08-02T14:02:54.958941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:54.995727Z","title":"2021 , url=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:54.995727Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:d59d84a5c4df4ba8ae60673391481b166d7570bfac54776340ac0f5d7ce05462","observation_id":"03911a8a-f695-48b3-a965-0669feddc1e0","resolution":{"observed_at":"2026-08-02T14:02:54.995727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.033686Z","title":"ACM Computing Surveys , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.033686Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:7625eceb25018ba91a6801d5d7fd5abc5ba36e486b99a464a2a4c48cee28ae40","observation_id":"52020d09-4066-460c-b632-f28f9448bc7a","resolution":{"observed_at":"2026-08-02T14:02:55.033686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.069185Z","title":"ECAI 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.069185Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:181ee6e423bd9dad8733492f0f43677337fa9b30651ad743a0ff81bac79e7c16","observation_id":"010b501b-ef72-4907-a1cf-7d6ba92d360d","resolution":{"observed_at":"2026-08-02T14:02:55.069185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.089719Z","title":"nature , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.089719Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f0166304990b21b832663558b448a68c625b89267f9e5e977981de45abefbf57","observation_id":"4ee141e6-8558-42f0-9fde-9d144bea2df3","resolution":{"observed_at":"2026-08-02T14:02:55.089719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.124338Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.124338Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:21b1f36ceafa98807278dad0d5c73fbe63014c4a441adc1529bed6b4ca18b697","observation_id":"4e375cdc-b22f-47ec-9fe5-6fc54d5ec9fe","resolution":{"observed_at":"2026-08-02T14:02:55.124338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.160969Z","title":"Donti , booktitle=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.160969Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:3ad11dc4868e9c2f32ce4e6d27cfd80ac13f01f3d7a318a4a3a84a779c50956e","observation_id":"6a6b4412-fcd0-46db-976e-ca43aebec610","resolution":{"observed_at":"2026-08-02T14:02:55.160969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.196682Z","title":"International Journal on Software Tools for Technology Transfer , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.196682Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:a520d414003d63a8c80b83700da05be4fccec6271f07d871856198132b533419","observation_id":"1b60c397-ad43-455b-8056-435162418a65","resolution":{"observed_at":"2026-08-02T14:02:55.196682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.224359Z","title":"NeurIPS , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.224359Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e0d7a912ea5b27328073e79d109b68d416e27e41e1d12bc5132b934aa90bd569","observation_id":"0b9c2366-563e-404b-83a6-c14fd5c971e7","resolution":{"observed_at":"2026-08-02T14:02:55.224359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.251676Z","title":"1999 , publisher=","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.251676Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:f51b609c3eddef475ee168638d437f5cc7e9dd1b0a04fd37d1ad167e38242e60","observation_id":"8e7d879f-362a-4a1f-acdc-c128fde46231","resolution":{"observed_at":"2026-08-02T14:02:55.251676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.272170Z","title":"Neural computation , volume=","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.272170Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:fc813b36dd291b20267f5700e8a08d182e3354b31a8a9961a5e5d302fe3c44c2","observation_id":"414c199a-f3a5-4ea2-85cb-0f01701e8cb1","resolution":{"observed_at":"2026-08-02T14:02:55.272170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.307261Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.307261Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e908604c25f019cb0fdff3a712d3833a83e382cdd6924141e424df1216dc6917","observation_id":"d2cccf2f-fbab-46ce-aa84-7be495856e89","resolution":{"observed_at":"2026-08-02T14:02:55.307261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.337055Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.337055Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:392ac8080a66860fc81c306f10fccd41b8ee1b2f9d47ba7eb83e608551cbaf47","observation_id":"ebc62ea5-cfed-4a3b-9123-4bea9e39ce5d","resolution":{"observed_at":"2026-08-02T14:02:55.337055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.351664Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.351664Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:615aae2251a73ec31a09e46ccf10c98c0cf0a93be0bc9a304ebbbeac822723da","observation_id":"267ac7d6-1e73-43f6-8c57-5d3c19c9dc06","resolution":{"observed_at":"2026-08-02T14:02:55.351664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.369178Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.369178Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:e2c25034f732f217a6722a8aaeda43a4be76ba980343332c50161dec0ec865ce","observation_id":"23f3a4d8-052a-4fea-8919-bad91ef4d93d","resolution":{"observed_at":"2026-08-02T14:02:55.369178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.373586Z","title":"AIRO 2023 Artificial Intelligence and Robotics 2023 , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.373586Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:93df645a7a94eb1e99be6d6806b4975f86488527f893ae0e103259154a8d13a2","observation_id":"767ecfe2-7179-4cee-bd26-58660cf3dcfd","resolution":{"observed_at":"2026-08-02T14:02:55.373586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.382529Z","title":"arXiv preprint arXiv:2507.05405","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.382529Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:0854049d54f74290cec44adaaaf1a7a6c074fc178df9707e581b32eff0d1922a","observation_id":"80c8ccec-6cea-41fc-8e13-8cabfb51ef99","resolution":{"observed_at":"2026-08-02T14:02:55.382529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.390517Z","title":"Proceedings of the Thirty-Third International Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.390517Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:51bdca54413d72b119e560bd55896c394391124d07072e0f083bf4e6459543a7","observation_id":"4116d49e-bb85-449c-9896-9eb6235d536d","resolution":{"observed_at":"2026-08-02T14:02:55.390517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.399981Z","title":"Artificial intelligence , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.399981Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:9ebfc19b957ca58f05fbfea38fce8de6cd3e8154e2e5855bf27b229759e48773","observation_id":"2931b84e-f4e2-4adb-822e-962a4da2ee26","resolution":{"observed_at":"2026-08-02T14:02:55.399981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.407455Z","title":"ACM computing surveys (CSUR) , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.407455Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:b3fa677047b254252aa6bd7338d10cc66410faf2a88257d9bce9621c91a9d1e3","observation_id":"2f26bfd6-2030-40b8-b290-c1c0a0f0d783","resolution":{"observed_at":"2026-08-02T14:02:55.407455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.417626Z","title":"ICML , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.417626Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:967b8f5447ec6210051c853f002a47939162d828ac82fbe7f54a7e741bfb5e3b","observation_id":"1bbd02ca-b8fb-4007-a46d-8b73c1b50f8b","resolution":{"observed_at":"2026-08-02T14:02:55.417626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.440725Z","title":"IEEE SP , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.440725Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:af5dd9c46d4199086799cfb64a22f23362122c2e63e516a3c92fb99bcac2ea47","observation_id":"4eeabf37-24e6-44ee-9e92-34cb65dd2e49","resolution":{"observed_at":"2026-08-02T14:02:55.440725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.462479Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.462479Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:56c1c1899bd674b18dd5e0864ef44b233d5b8525c25ebab4ae33401965731e10","observation_id":"079ecc48-afec-443d-8582-8f07f85e30a1","resolution":{"observed_at":"2026-08-02T14:02:55.462479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16760","last_updated":"2023-12-28T00:46:35Z","snapshot_observed_at":"2026-07-06T17:09:02.167931Z","submitted_at":"2023-12-28T00:46:35Z","title":"The Fourth International Verification of Neural Networks Competition (VNN-COMP 2023): Summary and Results","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16760","snapshot_observed_at":"2026-08-02T14:02:55.491202Z","title":"arXiv preprint arXiv:2312.16760 , year=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.491202Z"},"links":{"cited_paper":"/paper/2312.16760","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:7d521f6a5cd07924b8ac587d8b38775502c5148858d0e3ffb16837a0169c6386","observation_id":"59233193-e98d-450a-9add-ccb3a88c43bc","resolution":{"observed_at":"2026-08-02T14:02:55.491202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10376","last_updated":"2023-02-16T08:06:35Z","snapshot_observed_at":"2026-07-06T14:33:03.656499Z","submitted_at":"2022-12-20T15:58:01Z","title":"The Third International Verification of Neural Networks Competition (VNN-COMP 2022): Summary and Results","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10376","snapshot_observed_at":"2026-08-02T14:02:55.508412Z","title":"arXiv preprint arXiv:2212.10376 , year=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.508412Z"},"links":{"cited_paper":"/paper/2212.10376","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:67d489f46c158d99ea5c82c94edf990e2807637acb2d2cbb3c45bd5fa2f4f5ad","observation_id":"0f76bff9-0b22-4059-b292-21ca6ec4c09e","resolution":{"observed_at":"2026-08-02T14:02:55.508412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.527167Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.527167Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:37252e0731f5bf2544d3f3d7fe33f4ffe9709575b6730758fe3d2e75c5673379","observation_id":"683db619-3cea-4af8-a56e-9a84ed772d34","resolution":{"observed_at":"2026-08-02T14:02:55.527167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17556","last_updated":"2025-07-10T09:08:34Z","snapshot_observed_at":"2026-07-06T18:20:52.408832Z","submitted_at":"2024-05-27T18:00:03Z","title":"Solving Probabilistic Verification Problems of Neural Networks using Branch and Bound","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17556","snapshot_observed_at":"2026-08-02T14:02:55.555451Z","title":"arXiv preprint arXiv:2405.17556 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.555451Z"},"links":{"cited_paper":"/paper/2405.17556","citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:38c0e36cc61c1e7302ff78580e74a75b184b07219fd9991f29ecc25db90fa375","observation_id":"2f1fd7d4-ed2d-45cd-a4a0-1fc8cb6de161","resolution":{"observed_at":"2026-08-02T14:02:55.555451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.582987Z","title":"Neural networks , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.582987Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:319486f70a5cc101d4e0179108f16f97b96e99389845f5146ddd5f1932532e21","observation_id":"4d0bcbbd-a203-4a5c-86b7-9373ed481c95","resolution":{"observed_at":"2026-08-02T14:02:55.582987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.617854Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.617854Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:1463ebfb3c7fb3207aad2be54dc44360eedffcfb76e5be763aba46f6779c4948","observation_id":"b0c11868-7673-420c-917b-7405c7c8dc44","resolution":{"observed_at":"2026-08-02T14:02:55.617854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.646147Z","title":"2019 IEEE/ACM 41st International Conference on Software Engineering: New Ideas and Emerging Results (ICSE-NIER) , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.646147Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:cf5bbb52a69f12994233b8f58c580ae86b7d6fb5793caae9bc57d649217caee7","observation_id":"a938b48e-e2b1-4364-a641-3157a942d0ee","resolution":{"observed_at":"2026-08-02T14:02:55.646147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T14:02:55.681719Z","title":"NeurIPS , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-02T14:02:55.681719Z"},"links":{"citing_paper":"/paper/2607.16210"},"observation_digest":"sha256:6fe8b329328d9ed0f4527d9ecd9267ac26626b657300268b24af156b05974d69","observation_id":"76167bdf-6244-42e0-9bc5-2eec6faf5cb8","resolution":{"observed_at":"2026-08-02T14:02:55.681719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16210","last_updated":"2026-05-14T12:32:57Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T14:42:18.559295Z","submitted_at":"2026-05-14T12:32:57Z","title":"A Survey on the Verification of Reinforcement Learning Policies"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":175},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 175 outbound references and 0 inbound Pith citation observations for arXiv:2607.16210."}