{"as_of":"2026-08-09T13:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a37cc3d9247eec400d47fb7539268848b6ab7dd72b93f1f2f240879274157f16","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:21:18.453588Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T18:23:51.471687Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2206.04436","last_updated":"2022-09-17T12:52:26Z","snapshot_observed_at":"2026-08-09T10:17:13.567358Z","submitted_at":"2022-06-09T11:57:54Z","title":"Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04436","snapshot_observed_at":"2026-08-08T13:21:18.453588Z","title":"Towards safe reinforcement learning via constraining conditional value-at-risk","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07279","last_updated":"2025-05-16T17:18:02Z","snapshot_observed_at":"2026-08-08T13:12:33.630286Z","submitted_at":"2025-02-11T05:48:51Z","title":"Exploratory Diffusion Model for Unsupervised Reinforcement Learning","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T13:21:18.453588Z"},"links":{"cited_paper":"/paper/2206.04436","citing_paper":"/paper/2502.07279"},"observation_digest":"sha256:49773ab2997d34ee30f4cfb042ba3f282ba18bbda295d30cb76b314be5db693b","observation_id":"6ba8d291-d21f-4541-8de4-667a1bc26e33","resolution":{"observed_at":"2026-08-08T13:21:18.453588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04436","last_updated":"2022-09-17T12:52:26Z","snapshot_observed_at":"2026-08-09T10:17:13.567358Z","submitted_at":"2022-06-09T11:57:54Z","title":"Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk","version":2},"cited_work":{"arxiv_id":"2206.04436","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.04436","snapshot_observed_at":"2026-06-29T18:23:51.471687Z","title":"Towards safe reinforcement learning via constraining con- ditional value-at-risk.arXiv preprint arXiv:2206.04436","venue":null,"work_id":"5ae9c267-1303-41de-92ca-f1de3140caba","year":2022},"citing_paper":{"arxiv_id":"2604.25379","last_updated":"2026-04-28T08:43:39Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T08:43:39Z","title":"Safe-Support Q-Learning: Learning without Unsafe Exploration","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T16:36:35.746034Z"},"links":{"cited_paper":"/paper/2206.04436","citing_paper":"/paper/2604.25379"},"observation_digest":"sha256:6bd3693a3282b0045cf32155480e010b00ac09b9d2fb713be9a6bc24cd38bdb8","observation_id":"dc94ecf2-b14e-4606-9da9-7e38a8cbf109","resolution":{"observed_at":"2026-05-11T23:36:38.384687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04436","last_updated":"2022-09-17T12:52:26Z","snapshot_observed_at":"2026-08-09T10:17:13.567358Z","submitted_at":"2022-06-09T11:57:54Z","title":"Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk","version":2},"cited_work":{"arxiv_id":"2206.04436","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.04436","snapshot_observed_at":"2026-06-29T18:23:51.471687Z","title":"Towards safe reinforcement learning via constraining con- ditional value-at-risk.arXiv preprint arXiv:2206.04436","venue":null,"work_id":"5ae9c267-1303-41de-92ca-f1de3140caba","year":2022},"citing_paper":{"arxiv_id":"2605.11975","last_updated":"2026-05-18T06:36:11Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:36Z","title":"Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:24.455817Z"},"links":{"cited_paper":"/paper/2206.04436","citing_paper":"/paper/2605.11975"},"observation_digest":"sha256:1c80b9fb95b1772bee178929d79397a9f28de02825fe35c6b3e572a62f8478cd","observation_id":"1c3b1850-98a9-4cf8-925e-9adbab47625c","resolution":{"observed_at":"2026-05-13T07:32:30.558232Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04436","last_updated":"2022-09-17T12:52:26Z","snapshot_observed_at":"2026-08-09T10:17:13.567358Z","submitted_at":"2022-06-09T11:57:54Z","title":"Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk","version":2},"cited_work":{"arxiv_id":"2206.04436","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.04436","snapshot_observed_at":"2026-06-29T18:23:51.471687Z","title":"Towards safe reinforcement learning via constraining con- ditional value-at-risk.arXiv preprint arXiv:2206.04436","venue":null,"work_id":"5ae9c267-1303-41de-92ca-f1de3140caba","year":2022},"citing_paper":{"arxiv_id":"2605.11975","last_updated":"2026-05-18T06:36:11Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:36Z","title":"Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T22:48:55.661356Z"},"links":{"cited_paper":"/paper/2206.04436","citing_paper":"/paper/2605.11975"},"observation_digest":"sha256:a9d397c62254563d155a8dca233732861470941e3907db894d38df18c4b0b457","observation_id":"5cbfbc4c-9f0e-48d4-85e7-a1569461087c","resolution":{"observed_at":"2026-05-20T22:49:10.087416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04436","last_updated":"2022-09-17T12:52:26Z","snapshot_observed_at":"2026-08-09T10:17:13.567358Z","submitted_at":"2022-06-09T11:57:54Z","title":"Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk","version":2},"cited_work":{"arxiv_id":"2206.04436","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.04436","snapshot_observed_at":"2026-06-29T18:23:51.471687Z","title":"Towards safe reinforcement learning via constraining con- ditional value-at-risk.arXiv preprint arXiv:2206.04436","venue":null,"work_id":"5ae9c267-1303-41de-92ca-f1de3140caba","year":2022},"citing_paper":{"arxiv_id":"2605.18841","last_updated":"2026-05-13T03:34:13Z","snapshot_observed_at":"2026-08-05T22:27:31.931509Z","submitted_at":"2026-05-13T03:34:13Z","title":"From Cumulative Constraints to Adaptive Runtime Safety Control for Nonstationary Reinforcement Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-20T21:48:43.143169Z"},"links":{"cited_paper":"/paper/2206.04436","citing_paper":"/paper/2605.18841"},"observation_digest":"sha256:f8fdd612a07ad944879a6c97444871614864c2d5e8c99e175e3fa2621bf2ec6e","observation_id":"a71f6cd2-6674-455f-8347-ecfe90e2629e","resolution":{"observed_at":"2026-05-20T21:49:05.114084Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04436","last_updated":"2022-09-17T12:52:26Z","snapshot_observed_at":"2026-08-09T10:17:13.567358Z","submitted_at":"2022-06-09T11:57:54Z","title":"Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk","version":2},"cited_work":{"arxiv_id":"2206.04436","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.04436","snapshot_observed_at":"2026-06-29T18:23:51.471687Z","title":"Towards safe reinforcement learning via constraining con- ditional value-at-risk.arXiv preprint arXiv:2206.04436","venue":null,"work_id":"5ae9c267-1303-41de-92ca-f1de3140caba","year":2022},"citing_paper":{"arxiv_id":"2605.18842","last_updated":"2026-05-13T04:10:10Z","snapshot_observed_at":"2026-08-07T21:40:01.056353Z","submitted_at":"2026-05-13T04:10:10Z","title":"Safe Continual Reinforcement Learning under Nonstationarity via Adaptive Safety Constraints","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-20T21:36:33.206033Z"},"links":{"cited_paper":"/paper/2206.04436","citing_paper":"/paper/2605.18842"},"observation_digest":"sha256:f9c332bc66e87b227daec4fdb07ab029b9bc809f88dd1c5342e8ef42a4ce66a9","observation_id":"05e9885e-4538-479d-b2e2-a0d16cc6e6ca","resolution":{"observed_at":"2026-05-20T21:39:03.494657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04436","last_updated":"2022-09-17T12:52:26Z","snapshot_observed_at":"2026-08-09T10:17:13.567358Z","submitted_at":"2022-06-09T11:57:54Z","title":"Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk","version":2},"cited_work":{"arxiv_id":"2206.04436","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.04436","snapshot_observed_at":"2026-06-29T18:23:51.471687Z","title":"Towards safe reinforcement learning via constraining con- ditional value-at-risk.arXiv preprint arXiv:2206.04436","venue":null,"work_id":"5ae9c267-1303-41de-92ca-f1de3140caba","year":2022},"citing_paper":{"arxiv_id":"2606.27766","last_updated":"2026-06-26T06:51:16Z","snapshot_observed_at":"2026-08-05T05:40:05.365084Z","submitted_at":"2026-06-26T06:51:16Z","title":"RS-Diffuser: Risk-Sensitive Diffusion Planning with Distributional Value Guidance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T05:05:39.828659Z"},"links":{"cited_paper":"/paper/2206.04436","citing_paper":"/paper/2606.27766"},"observation_digest":"sha256:770903766e4ca1b7773da22ae7a114915dabc3fd433f92f533357266a9680a9b","observation_id":"e17d63f0-0f87-4ffb-be31-d327e799068b","resolution":{"observed_at":"2026-06-29T18:23:51.473150Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04436","last_updated":"2022-09-17T12:52:26Z","snapshot_observed_at":"2026-08-09T10:17:13.567358Z","submitted_at":"2022-06-09T11:57:54Z","title":"Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04436","snapshot_observed_at":"2026-08-01T12:15:44.291124Z","title":"arXiv preprint arXiv:2206.04436 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21646","last_updated":"2026-07-21T23:52:07Z","snapshot_observed_at":"2026-08-05T15:35:37.445197Z","submitted_at":"2026-07-21T23:52:07Z","title":"Adjustment Speed as a Safety Constraint for Nonstationary Reinforcement Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-01T12:15:44.291124Z"},"links":{"cited_paper":"/paper/2206.04436","citing_paper":"/paper/2607.21646"},"observation_digest":"sha256:fa77ec702b9e978bd4fd0f9c8ea509ac286a92234d2eb59e9051726ca9a27c45","observation_id":"22d283e7-d656-469e-95aa-2ca0173342cf","resolution":{"observed_at":"2026-08-01T12:15:44.291124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2206.04436/citation-record","integrity":"/paper/2206.04436/integrity","json":"/paper/2206.04436/citation-record.json","paper":"/paper/2206.04436"},"outbound":[],"paper":{"arxiv_id":"2206.04436","last_updated":"2022-09-17T12:52:26Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T10:17:13.567358Z","submitted_at":"2022-06-09T11:57:54Z","title":"Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2206.04436."}