{"as_of":"2026-08-23T22:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77cb452673f342ebacd01ff3ead21f8ac5c4fab1f3a296208d13b71ede5d0943","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:20:07.679615Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.01619/citation-record","integrity":"/paper/2505.01619/integrity","json":"/paper/2505.01619/citation-record.json","paper":"/paper/2505.01619"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.521180Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.521180Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:27e822e280a9df949ec5e7dbfadfda0b822a1c6a55655ee1964b43b39fdc9f2d","observation_id":"b940988a-71e5-4797-ac48-ad5511145f17","resolution":{"observed_at":"2026-08-16T04:20:07.521180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.196817Z","title":"Constrained policy optimization","venue":null,"work_id":"f2cac780-caa3-4cbb-9671-33b56cf69ee2","year":2017},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.529200Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:b0cfae70ec695fa38b43f68f190c0da390187c6f39277bcb79cbc7c8fdb95fc7","observation_id":"2e652224-cab4-4ffb-91fd-ef858eef02fd","resolution":{"observed_at":"2026-08-16T04:20:08.202587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.180824Z","title":"Constrained Markov decision processes: stochastic modeling","venue":null,"work_id":"e618ad46-7dc6-4f42-aa9d-85fa6e1e5a2c","year":1999},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.534910Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:4ff25c4bdf1746ddc4605b4570feb9249aa331282ee09a23dd05b0e64aaefe5a","observation_id":"4e7de232-1e9d-463e-ba9e-2e7a7fd0f35f","resolution":{"observed_at":"2026-08-16T04:20:08.185937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.165974Z","title":"and Yarats, D","venue":null,"work_id":"08619d68-c391-45f1-a7ea-9633da443eec","year":2020},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.541455Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:23a29431d94fc5624fd5646140a87546b92e0cd2d80812279a108946adc4307f","observation_id":"6ff90d14-c569-4cac-84e4-14d8371ca33a","resolution":{"observed_at":"2026-08-16T04:20:08.170203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.546851Z","title":"D., Chernova, S., Veloso, M., and Browning, B","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.546851Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:b82c5f362903f003a180f3f19085b4da0597f6f1096ff1e3a93cf35775655572","observation_id":"e94de879-c529-44ad-9ba6-4b44a193f9b4","resolution":{"observed_at":"2026-08-16T04:20:07.546851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.140732Z","title":"I., Kroese, D","venue":null,"work_id":"d1690f60-ae41-45a6-81d4-dd2576d43897","year":2013},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.552344Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:b7a0236a72e078abeba4a92fb5a0e22d42558a3d23da81422f67afb0820395ca","observation_id":"5a8e5b6e-6c4f-486d-ac96-33b8ac014e08","resolution":{"observed_at":"2026-08-16T04:20:08.144917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.124960Z","title":"W., Yuan, Z., Zhou, S., Panerati, J., and Schoellig, A","venue":null,"work_id":"84acad38-1b61-4805-9844-fa0759291841","year":2021},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.558028Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:c87101db78600b041ac2f77fad1c2a2c51f78cf85e14c45575e88b9718f32021","observation_id":"ed966bc6-15dc-405f-9af9-de4b18f0e7a2","resolution":{"observed_at":"2026-08-16T04:20:08.129889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.108248Z","title":"B., Chernova, S., Taylor, M","venue":null,"work_id":"5ed02633-1f69-4c88-b7f2-aa713e920c20","year":2015},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.563471Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:be686968716c0983fbe4d88557b89b6b9f283459d2402499d3decb2578d62897","observation_id":"8569d491-7140-44d3-a7c2-0247f0858564","resolution":{"observed_at":"2026-08-16T04:20:08.114330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.091992Z","title":"Class-prior estimation for learning from positive and unlabeled data","venue":null,"work_id":"89d62d4a-39a0-4d0f-9fac-e9fcd05890b8","year":2016},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.568321Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:719df89302f6d97e55d287d6caac0aa7e9f8ded75740237dbe71aecf7a0ede02","observation_id":"b2c95931-e823-491d-94c5-c44bbdf5ce6a","resolution":{"observed_at":"2026-08-16T04:20:08.097363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.076086Z","title":"Convex formulation for learning from positive and unlabeled data","venue":null,"work_id":"bfff48cb-2b72-4c8c-94ff-0e0322c9bb16","year":2015},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.573370Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:153e72d514de97bd8576f1f9362812f2aedd4b6d2a786637a5b26a33dcbaaa86","observation_id":"1d23f29f-e721-44cb-929f-6de3b87b2ca8","resolution":{"observed_at":"2026-08-16T04:20:08.081625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.058676Z","title":"C., Niu, G., and Sugiyama, M","venue":null,"work_id":"5cccf618-2546-4009-a549-2862d8ce246b","year":2014},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.578248Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:0eb99299506669dcce79ebfefb9a1b502ecafe167435ced6ce1c6b2ffb1969db","observation_id":"d6dc3696-36f3-4d8e-ac3b-e00a21dd537d","resolution":{"observed_at":"2026-08-16T04:20:08.064154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.041536Z","title":"and Fern \\'a ndez, F","venue":null,"work_id":"5f63d3b8-9a48-45e5-b913-8bff82ae1c61","year":2015},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.583120Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:7ddbc2534bd6a8c8f4aa5da9e9c5302bb8e41d606511cfdcd125bef810dd3d86","observation_id":"6e6523a1-d1cf-4683-befe-ad65d4281149","resolution":{"observed_at":"2026-08-16T04:20:08.046820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.024446Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"a33b68f0-e637-4fd5-86ed-09daf7fb9cc2","year":2018},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.588244Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:953014ad989f9e84a984b370c7c945a9a474fe9a0b1247b65d95017549ac4d89","observation_id":"ea193771-c9ce-4993-b89b-3fee9cce4a1c","resolution":{"observed_at":"2026-08-16T04:20:08.030374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:08.005628Z","title":"M., and Udluft, S","venue":null,"work_id":"c9545f3a-70e0-4cf3-897d-a9886eb5b3c6","year":2008},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.593656Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:57a9ac25f4859447720b07b45c3400bea0578601ce69019f6a335dbaac7f4b06","observation_id":"b8685725-eac6-40df-af0c-20e6c70eb458","resolution":{"observed_at":"2026-08-16T04:20:08.010991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.989571Z","title":"and Ermon, S","venue":null,"work_id":"66645594-20b5-417e-a775-0723342be42a","year":2016},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.599289Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:bb27a0bcb92757720e373c1c62c577c59ca007655d5323d89151a51be6f2f178","observation_id":"b3dbcf0d-0198-4476-87bd-72c5b72b9ba8","resolution":{"observed_at":"2026-08-16T04:20:07.994125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.973080Z","title":"Estimating the class prior and posterior from noisy positives and unlabeled data","venue":null,"work_id":"dc91c243-af3e-46d3-a36f-f82d0e03f255","year":2016},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.604902Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:fe75507e5c920816bb54328c23e0a12d40b5849e2f498f5333aeee5788e96961","observation_id":"633bb447-93b2-44fb-8bc7-e68c9aee534e","resolution":{"observed_at":"2026-08-16T04:20:07.978682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.954526Z","title":"C., and Sugiyama, M","venue":null,"work_id":"8fb4bb9c-cd4c-4c78-9d0f-c20f88ef4c9a","year":2017},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.611375Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:21c16dad2335a130e73c3d6dd85462ceed68460281fc8db69f665e66a158b490","observation_id":"2ac314da-3507-4e5a-954f-4c0355d3aea1","resolution":{"observed_at":"2026-08-16T04:20:07.960424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.938552Z","title":"and Whiteson, S","venue":null,"work_id":"6e1793bd-5103-4d05-a8dd-d28cbeef8f6a","year":2011},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.616021Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:8b9af1b009a6acd44cb0ac4efdc4257f7e94fe9e45ea10dc3464dd2c517001f6","observation_id":"6501394d-9c11-4fdd-adde-9a0e8c8ba590","resolution":{"observed_at":"2026-08-16T04:20:07.943181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09303","last_updated":"2023-06-16T17:54:06Z","snapshot_observed_at":"2026-08-16T15:23:34.841529Z","submitted_at":"2023-06-15T17:31:26Z","title":"Datasets and Benchmarks for Offline Safe Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09303","snapshot_observed_at":"2026-08-16T04:20:07.620593Z","title":"Datasets and benchmarks for offline safe reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.620593Z"},"links":{"cited_paper":"/paper/2306.09303","citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:01c7fa305aae019069b855a884eb0cda9682cf16449a3ceea4354f58cc21d3e5","observation_id":"1a8ba416-5a3b-41c9-8587-6202ec5da25c","resolution":{"observed_at":"2026-08-16T04:20:07.620593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.921322Z","title":"Accelerating reinforcement learning with learned skill priors","venue":null,"work_id":"88eeef95-7f31-4aec-a2e8-829032ff4604","year":2021},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.625607Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:a9183c8c79ed4f33700915efeee33077c060c3113ef910a7e3b8af6a09bcad27","observation_id":"41c9a7bc-00ea-4a1d-9189-dd3567acd8bd","resolution":{"observed_at":"2026-08-16T04:20:07.926362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.903535Z","title":null,"venue":null,"work_id":"59ddc8ea-cac3-40c5-85af-8c3669066523","year":1997},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.630272Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:003f03e8740730b6dd3d36451a40db48e8c0c97b01e2695df4a7c8466d5f774e","observation_id":"1537fd58-5cb5-45d2-8bc2-87cdf2612475","resolution":{"observed_at":"2026-08-16T04:20:07.909372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.887318Z","title":"Z., Chow, Y., Dai, B., and Wichers, N","venue":null,"work_id":"1a4d614a-8ed1-407c-9a99-7226c408cbf1","year":2022},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.634715Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:95be39d1ac08ee489cde39b9d5cf7efc4d524d00d311a018efae51892c40c4e4","observation_id":"5eeecff8-20f1-4ea4-b35d-3f569ba98ded","resolution":{"observed_at":"2026-08-16T04:20:07.892208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.638867Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.638867Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:569b2d03065510de4bfbfe80af47091969bdaa4a99ec51b877dda8d80660cc8e","observation_id":"766aca5d-9e73-4b97-9d9a-f0df56895cbe","resolution":{"observed_at":"2026-08-16T04:20:07.638867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.860189Z","title":"J., and Mannor, S","venue":null,"work_id":"35181a4b-c106-4b30-a9f3-b4b9c50e1f85","year":2019},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.643096Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:e30228a6db1ff9995e91aceb6859b994e370b7804854a549ed6e78604b77b03e","observation_id":"cdf8284f-1f32-49d0-8c10-159336ca78fa","resolution":{"observed_at":"2026-08-16T04:20:07.864938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.845229Z","title":"E., Levine, S., Borrelli, F., and Goldberg, K","venue":null,"work_id":"4a54f48f-c9dc-4f6f-9a4a-1e4b06fcda83","year":2020},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.647242Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:ab1d922a32b5159e131101ef4f25b210e760d37a31d5d664ffc86c540513c455","observation_id":"857a098a-4497-4070-a807-7829f023c6a3","resolution":{"observed_at":"2026-08-16T04:20:07.849796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.830993Z","title":"E., Ibarz, J., Finn, C., and Goldberg, K","venue":null,"work_id":"f7f601c4-e1b9-4b08-a419-e2c9db79c794","year":2021},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.651486Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:c48c8e32a65679f548c0aec3b967d121e159c7eafa838399ab4ba4c77a858fe4","observation_id":"9a31f6ff-12c5-44e9-b278-3d3902d08782","resolution":{"observed_at":"2026-08-16T04:20:07.835399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.814890Z","title":"Safe reinforcement learning by imagining the near future","venue":null,"work_id":"1b4482b0-b593-4a15-b904-2d6143415e9f","year":2021},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.656103Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:1d2a9c451d871f3e6ef3075849c1361435e0e9ce8a642e01e8b54d16996d6364","observation_id":"365bd791-b859-4526-b9d5-99dfe3bb4365","resolution":{"observed_at":"2026-08-16T04:20:07.819937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.797527Z","title":"and Schwartz, A","venue":null,"work_id":"83b39a44-9960-4cc0-a18e-7fa800187dcb","year":1994},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.660572Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:14c6291537f6354053b24ed95153123d7844ee0eba083f1447eef7718c941c0d","observation_id":"7e7f6d9a-385b-43f1-b9d3-a6c71e49122c","resolution":{"observed_at":"2026-08-16T04:20:07.802886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.781124Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":"c1fee56f-6a18-449d-b4bd-8329d20c1ec8","year":2012},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.665973Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:066974a27c023a40272f97182fd53fec2c268a722f2a17727ffe29f116966c5a","observation_id":"e20d8d03-20a2-4e4d-971b-0b0210c2c1bc","resolution":{"observed_at":"2026-08-16T04:20:07.786159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.764882Z","title":"E., Xu, S., and Peng, H","venue":null,"work_id":"cdff9f8d-0a86-4a0a-b209-ff0db7eecc55","year":2020},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.670620Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:3959893b1636857f4ed3c10a6b2e56940bd8fcbfcc64105d7364eb9ee55a6db6","observation_id":"a214cb6b-7bd7-4c46-a5ec-a741b7f63fd2","resolution":{"observed_at":"2026-08-16T04:20:07.770215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.746707Z","title":"and Denil, M","venue":null,"work_id":"bd54a0c2-2732-44ce-a518-670bb4eeb596","year":2021},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.675090Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:ed5f14340c08de39a0a796ff1aa7ec4f312a1128f68ae967a913185073515b75","observation_id":"dc18d33f-69e3-4cf7-9d3e-e8e148c35098","resolution":{"observed_at":"2026-08-16T04:20:07.753073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:20:07.728928Z","title":"Constraints penalized q-learning for safe offline reinforcement learning","venue":null,"work_id":"41ab78ac-a8d7-456e-8e37-97dd67cfce87","year":2022},"citing_paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T04:20:07.679615Z"},"links":{"citing_paper":"/paper/2505.01619"},"observation_digest":"sha256:01af9bdce556cb6b6179b5df679ae81f252cf0d9163375ffd6f7c94bc807fe29","observation_id":"0c785921-f0ee-4e6f-8554-c851a40d1f1d","resolution":{"observed_at":"2026-08-16T04:20:07.735682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.01619","last_updated":"2025-05-02T22:48:27Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T04:12:22.140489Z","submitted_at":"2025-05-02T22:48:27Z","title":"Skill-based Safe Reinforcement Learning with Risk Planning"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2505.01619."}