{"as_of":"2026-08-08T13:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3aba0a22e42ed1dba12ea91e0cddd698bca79d681017296c3257bb07ea01a6a7","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:16:20.393795Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.08793/citation-record","integrity":"/paper/2507.08793/integrity","json":"/paper/2507.08793/citation-record.json","paper":"/paper/2507.08793"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.265612Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.265612Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:6b64f349c642085bf3fec140313cc8e9c631809761f1db586d028b7be58391cd","observation_id":"85169c1f-2474-4d32-83e2-6cd9c6e5e37d","resolution":{"observed_at":"2026-08-06T18:16:20.265612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.157631Z","title":"Achiam, D","venue":null,"work_id":"5eddd56e-2c73-41d7-8775-e84c491402fc","year":2017},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.269571Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:360cdf31b5fefbc629e036a77246e77dc7f45448e0ff05cc944cb369d35ceae1","observation_id":"c78ee23a-94d1-49ca-bc49-83ae64b7d3c4","resolution":{"observed_at":"2026-08-06T18:16:21.161608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.146671Z","title":null,"venue":null,"work_id":"f2eb6d34-87ac-42d3-b342-63d831b3aff9","year":1999},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.273446Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:2dac1a1978a21f7b2259d2d24133ae8b865ad0f349d3059a0f0ab1975c39b863","observation_id":"2f5bf2da-7395-4026-812e-6925e8ab4106","resolution":{"observed_at":"2026-08-06T18:16:21.150769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"books/9781315","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.887102Z","title":"URL https://www.taylorfrancis.com/ books/9781315140223","venue":null,"work_id":"1c4568d3-b235-46f6-b3ce-d5fdcfdeb8e7","year":null},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.276699Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:e92ffe1eba68ae655520f6d337c35ef90041ff7ac1217fec47df314aa1348bdd","observation_id":"99b136a4-d6b1-492d-a280-04ebd9a2de28","resolution":{"observed_at":"2026-08-06T18:16:20.894237Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.136706Z","title":null,"venue":null,"work_id":"b2a3818c-00a5-4318-8526-c458a51f06db","year":2023},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.280342Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:f85af74a4cb04b035273890b606f94d55d1b3edbb7f6b2438d3aa6f0a359dbad","observation_id":"10da4b1f-745e-4bd6-8a2a-ff00fb672a0e","resolution":{"observed_at":"2026-08-06T18:16:21.140079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.14497","last_updated":"2021-04-26T17:38:23Z","snapshot_observed_at":"2026-07-06T10:09:06.864468Z","submitted_at":"2020-10-27T17:54:25Z","title":"Conservative Safety Critics for Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.14497","snapshot_observed_at":"2026-08-06T18:16:20.283541Z","title":"Bharadhwaj, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.283541Z"},"links":{"cited_paper":"/paper/2010.14497","citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:9a95fb866feb909a3ba79a2263bbe7537bc54d99c6f3dd66099b14904ec2b75d","observation_id":"334bd6ef-b2c9-4c2d-ba11-59d06e5ab319","resolution":{"observed_at":"2026-08-06T18:16:20.283541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.126707Z","title":null,"venue":null,"work_id":"63379256-14a7-4199-b605-5770b3d46c8a","year":2020},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.286739Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:d438df54ee56bf36384fe4ac5ecd77a5100fd801efbc6a7ffa3b6dd41b23f353","observation_id":"ba9042e4-53ec-492e-8a96-3a0cc5d3d1c0","resolution":{"observed_at":"2026-08-06T18:16:21.130433Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-47229-0_2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"URL http://link.springer.com/ 10.1007/978-3-030-47229-0_2","venue":"SpringerBriefs in applied sciences and technology","work_id":"0745d967-1407-4746-8a56-16f77bc6d457","year":null},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.289970Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:d5d3a3b4e8c106075f60182cd9ac2de7792bcb7c7a9e64eb7a027d3c4d88f3d6","observation_id":"7d8f4cf1-db2b-43b1-88be-fe6ddf946b78","resolution":{"observed_at":"2026-08-06T18:16:20.475703Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.293032Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.293032Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:5649dd59fc888109696f7f994d0a05e63d6c48417a187b1580f290d9f87ead4d","observation_id":"3e23013e-a1d1-4cd9-a6ea-3d81be2ab9db","resolution":{"observed_at":"2026-08-06T18:16:20.293032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.115920Z","title":"Ciosek, Q","venue":null,"work_id":"6c5a9efd-a6d3-40e9-9124-304796b56bab","year":null},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.295752Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:7499836a08e02c04f1766ec4fb800842d8dc16fd2d32635322ae57ff953a51d3","observation_id":"ba5f3ea4-0f02-4be8-88ee-5a62995611e9","resolution":{"observed_at":"2026-08-06T18:16:21.120210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.308109Z","title":"Dulac-Arnold, N","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.308109Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:8f135e816991e0318667c3b84103854b579f1dc44fb663287905e46188ee399d","observation_id":"b050d13b-5ec4-46a6-bf6e-12b04d4ac8d1","resolution":{"observed_at":"2026-08-06T18:16:20.308109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.095308Z","title":"Dabney, G","venue":null,"work_id":"d7f97587-37e8-4727-9373-7d70e0504329","year":2018},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.302262Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:2ab13dae3dd31bc2bd50f897527588254a605487cec000688d633c48499a6600","observation_id":"36653d98-fc44-4a9f-a91c-8973f5741982","resolution":{"observed_at":"2026-08-06T18:16:21.099351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.305386Z","title":"Dabney, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.305386Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:6c3123031ba17d64f4c41bf6e6f1858a25b706f8df06c0e43c020f3aa322f676","observation_id":"4ec4054a-f3c8-489c-8506-0d43678497a7","resolution":{"observed_at":"2026-08-06T18:16:20.305386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.059469Z","title":"Greenberg, Y","venue":null,"work_id":"ea0b646f-46ab-4b5f-80d5-bdf38f1a188a","year":2022},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.316924Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:e944b6b9af0fa282736f9d61d3495b2adbefdbde8880d8c389c3c1a7b7eb6d5f","observation_id":"77a55356-524b-47a7-801b-9d4772fe226e","resolution":{"observed_at":"2026-08-06T18:16:21.063895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.084048Z","title":"Fujimoto, H","venue":null,"work_id":"17f53127-a725-4cc2-87da-3bd7d57bdf20","year":2018},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.311329Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:3159a367c2b83c6e83140c6996705a63883271a53403bb343cab3d39a00c272f","observation_id":"745ac99c-5d23-439a-be08-3cf46bbcad79","resolution":{"observed_at":"2026-08-06T18:16:21.088505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.072045Z","title":"García and F","venue":null,"work_id":"5cdd01fc-067d-43e6-b6b2-4f2d9bbe7313","year":2015},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.314227Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:c01e01e3666c81784571963f1be285756774799263af79150dff1596d735916e","observation_id":"01fe2aeb-8e51-4a3b-b952-f56908b13312","resolution":{"observed_at":"2026-08-06T18:16:21.076617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.326107Z","title":null,"venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.326107Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:7591e20f67008928c38e4ba76a3feeeb7b9a84e73abcb9aee2f396eb165d599f","observation_id":"9918112f-688d-42f7-b36c-f6bf42fe7645","resolution":{"observed_at":"2026-08-06T18:16:20.326107Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-04T09:15:33.903637Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-06T18:16:20.319931Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.319931Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:af41a1eeaed9af3db0b0f6192ef7bcad56a9b127b448c235c11801113699a62b","observation_id":"ad4d0621-b059-413d-ba5f-73b60461ee9c","resolution":{"observed_at":"2026-08-06T18:16:20.319931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.048858Z","title":"Haarnoja, A","venue":null,"work_id":"e15a3757-ce23-42a8-a18f-341b51f2d468","year":2018},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.323308Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:fe58084405ec0e6f0e82fb13b0b0479f8d7b0bdfcbf220e9a6ca1fd9937ec7b9","observation_id":"9966e55c-d5c0-4251-9c88-586fc86cd7cb","resolution":{"observed_at":"2026-08-06T18:16:21.052577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.015279Z","title":null,"venue":null,"work_id":"8819d02c-834a-4e54-a733-1e73e789ae1a","year":null},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.337702Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:1f2645885395b65948741d099f7102922ccd9d03941359f1d6f713f83a90779d","observation_id":"b68dd2f5-9d4c-477c-ae23-a25e9150fd55","resolution":{"observed_at":"2026-08-06T18:16:21.019625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.037893Z","title":null,"venue":null,"work_id":"6dfb3041-3813-4b81-bba4-55ed468b09a0","year":2023},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.328938Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:63623f28ee3ce4bb9c0bde6130aa1394a0b72c894b8921cde0c453c193d4b15b","observation_id":"0eeb7a3e-fd78-417b-92aa-728371c21407","resolution":{"observed_at":"2026-08-06T18:16:21.042172Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.027053Z","title":"Keramati, C","venue":null,"work_id":"1dc97563-7c75-488f-af0f-ae512f6d1ce4","year":null},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.331991Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:cfff349df0bce4f404fda9e233e78d492733cc33160e38aebe898e9c7450344d","observation_id":"fc086859-bab3-4ba1-b69b-9e59d962a00a","resolution":{"observed_at":"2026-08-06T18:16:21.031236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.971911Z","title":null,"venue":null,"work_id":"32058f37-632f-4d7f-86a7-e68c00042587","year":2022},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.353103Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:4e772e3c86f20d599e5b82a797b3e15b7808cc72d991ebe129c7b7df67af7f03","observation_id":"8bd58267-2152-4bb0-9453-8ab9cf38b511","resolution":{"observed_at":"2026-08-06T18:16:20.976093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14547","last_updated":"2025-06-29T01:33:14Z","snapshot_observed_at":"2026-07-06T09:16:26.306280Z","submitted_at":"2020-04-30T02:23:15Z","title":"DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14547","snapshot_observed_at":"2026-08-06T18:16:20.355708Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.355708Z"},"links":{"cited_paper":"/paper/2004.14547","citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:054682013c8acabaa3bf014d8013f31def301660b2a1a693a9831613afd9eb4a","observation_id":"bca846fa-3090-4fc3-ba8d-7e77f042793d","resolution":{"observed_at":"2026-08-06T18:16:20.355708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03765","last_updated":"2022-04-06T12:03:06Z","snapshot_observed_at":"2026-07-06T10:39:09.501772Z","submitted_at":"2021-02-07T10:28:09Z","title":"Tactical Optimism and Pessimism for Deep Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2102.03765","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.03765","snapshot_observed_at":"2026-08-06T18:16:20.713559Z","title":"Tactical Optimism and Pessimism for Deep Reinforcement Learning","venue":"cs.LG","work_id":"e6350f0c-ac59-4d62-b516-0eb346c09ce6","year":2021},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.358680Z"},"links":{"cited_paper":"/paper/2102.03765","citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:c6d3106774d78a9c378c1942abc6b518445da4921d0a98bb750f6ef467bfd992","observation_id":"d257a5e6-d71b-4f49-a9c7-5a43b13e2e6c","resolution":{"observed_at":"2026-08-06T18:16:20.718766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.994133Z","title":null,"venue":null,"work_id":"fc29b89e-9f96-4212-af25-642701f16430","year":null},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.343777Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:8e0c58cb3ddc3b9e5e5a79eadb33b5dee37f4ea233d92fddd64a4fd06565ce25","observation_id":"74203ad6-def4-49b4-85ca-687e5551bbbd","resolution":{"observed_at":"2026-08-06T18:16:20.998791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"technical-paper/2161159","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.697189Z","title":null,"venue":null,"work_id":"567d9117-baab-4838-888a-d04b2289f461","year":2000},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.364763Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:74544c5b5d2ce92aeb4353073cf19a6d52d8d66ce3ce26239acb0ab3649a42aa","observation_id":"78a4e5e6-dcbf-4294-9b69-d7654619a108","resolution":{"observed_at":"2026-08-06T18:16:20.703420Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v38i12.29303","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.438560Z","title":null,"venue":null,"work_id":"a11799a8-4ba9-445f-b5d0-ede843264a9d","year":2024},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.349913Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:3cb85df6a2e379195e81f600e8342642d67f16bcbce086ed918b6f406099c3fc","observation_id":"b4c21e26-a11c-475a-b109-3033e8a6e107","resolution":{"observed_at":"2026-08-06T18:16:20.441495Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.936702Z","title":null,"venue":null,"work_id":"403680d6-d9f4-44ab-88e8-e78bcd5a94e5","year":2021},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.370301Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:7f27862510e84b0a37ad62027643c9caf316f95845ed548c4c7dca876d22725f","observation_id":"adf571f2-2d9b-4da3-a3ff-d4f315a56704","resolution":{"observed_at":"2026-08-06T18:16:20.939983Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.372943Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.372943Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:dc5552fc000452e9b670cf2acb02ea4a1794c31c52c71328f5f88ac8075fed34","observation_id":"e1ad41e0-ce4d-4b1e-b54c-5fac5d801768","resolution":{"observed_at":"2026-08-06T18:16:20.372943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0322.33609","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.557142Z","title":null,"venue":null,"work_id":"97169868-e53e-4e47-924b-2d104467fb29","year":2019},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.376120Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:b2770e2583e8b133c7d943f185432f8703f638932e36730852991551a56d2305","observation_id":"97ef87c4-b94b-486f-ad08-c56f2dcb999d","resolution":{"observed_at":"2026-08-06T18:16:20.561857Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.960392Z","title":null,"venue":null,"work_id":"8bf60c98-88d4-4eb4-bc52-a7ddc3920f05","year":2019},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.361963Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:fcdacf0a33b0fdd714ec9154f41ca34c779fb950a41e2fdf0e5c6c2a25ef86e7","observation_id":"703b8e56-3691-4e62-ad75-8c511594ad38","resolution":{"observed_at":"2026-08-06T18:16:20.964679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.926271Z","title":null,"venue":null,"work_id":"46f6bf0c-f60a-40c7-9301-f53d841553f5","year":2024},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.382439Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:0c7c25424bafea1700455f9e3e840c7b3feb06c0e87a9741c2ee341a4c94aee9","observation_id":"e6964274-f112-403c-b9e0-2a9a18052baf","resolution":{"observed_at":"2026-08-06T18:16:20.930157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.947415Z","title":"Tessler, D","venue":null,"work_id":"8e12da9c-4a22-425a-8682-17b491be7fad","year":2019},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.367484Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:b4e8f3fec2344abcd816a984d59237e8ca69044b047d82f5d1730539147e4bd1","observation_id":"ec6ea63c-bac9-4904-a80c-032fc1db6deb","resolution":{"observed_at":"2026-08-06T18:16:20.951144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.914833Z","title":null,"venue":null,"work_id":"79aac85e-8bc5-4a6e-93a0-695c7c55aa46","year":2024},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.388298Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:3af1139c831306c30a291c2ee25e0e3e4b1348fff588611bf1470fb75ef6f1da","observation_id":"466639f7-ea84-4fd5-94c4-5b60e111bde7","resolution":{"observed_at":"2026-08-06T18:16:20.919047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.901908Z","title":"Zhang, L","venue":null,"work_id":"c2f73865-724b-464a-bb85-3165277f66af","year":null},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.391082Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:7429475ee40d8709904d58d413027757c7ef831092e4672d22a4f543b3a24c56","observation_id":"9e10b2c1-e853-4d7c-9a37-1416399ce2cb","resolution":{"observed_at":"2026-08-06T18:16:20.906535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03225","last_updated":"2023-10-05T00:47:09Z","snapshot_observed_at":"2026-07-31T03:55:19.899654Z","submitted_at":"2023-10-05T00:47:09Z","title":"Safe Exploration in Reinforcement Learning: A Generalized Formulation and Algorithms","version":1},"cited_work":{"arxiv_id":"2310.03225","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.03225","snapshot_observed_at":"2026-08-06T18:16:20.492797Z","title":"Safe Exploration in Reinforcement Learning: A Generalized Formulation and Algorithms","venue":"cs.LG","work_id":"5c03cd0d-185b-4603-b426-22a0155e43d6","year":2023},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.379226Z"},"links":{"cited_paper":"/paper/2310.03225","citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:a695909435ac08d56cddb87a810bfef12fc27fbedac7226f90261455af80ed78","observation_id":"fa70d111-8315-46e7-86fc-53ef2dc3324f","resolution":{"observed_at":"2026-08-06T18:16:20.497430Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10994-022-06187-8","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.427689Z","title":null,"venue":null,"work_id":"8c92fb25-6d10-4a03-88ec-27524416a8b2","year":2023},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.385189Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:e7966b4191dbd569564da4fea15f5003692c956b964c87e506ebfe9c4a16bfac","observation_id":"2a5500dd-42b4-4b0a-952e-edb90df12121","resolution":{"observed_at":"2026-08-06T18:16:20.431760Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.105719Z","title":null,"venue":null,"work_id":"aa8b950b-25ec-4fc5-9343-b7775ce561e3","year":2019},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.298759Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:c741cef5d13614b2791cc5238e982d1506ec3c011ce07940b8a3cd9267e044c5","observation_id":"be203779-3d81-4970-b384-1ee06a6e0440","resolution":{"observed_at":"2026-08-06T18:16:21.109610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.334853Z","title":"doi: 10.1609/aaai.v34i04.5870","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.334853Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:5ee8b53bb59afe27882d54c05e1afd41ee2d436bd326e7fb79affac52b878fda","observation_id":"e978abee-f9f8-4fb1-9531-6719dd66cf2b","resolution":{"observed_at":"2026-08-06T18:16:20.334853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.393795Z","title":"ISBN 978-1-956792-00-3","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.393795Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:e67cce94f0357fe052ac463251fdf1b5936244404eb4cd5097b92a15cc38bb48","observation_id":"ae520bbf-23d7-44d0-adc9-d448710220e9","resolution":{"observed_at":"2026-08-06T18:16:20.393795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:21.005249Z","title":null,"venue":null,"work_id":"65672a58-5c4c-43a8-b072-084e03446f16","year":2023},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.340539Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:aa15be80f82965d178b8087eb36bc90d66d13b1b925306013b8c3cf38d3b442d","observation_id":"9f84d7af-92f0-49e0-93ce-2b9c63d4c135","resolution":{"observed_at":"2026-08-06T18:16:21.008867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:16:20.983424Z","title":null,"venue":null,"work_id":"780bb1e7-a4ea-4df4-b431-2285078d8ef0","year":null},"citing_paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:20.346831Z"},"links":{"citing_paper":"/paper/2507.08793"},"observation_digest":"sha256:9576d1958ee58e58851169fca2955ee1c3b6c48956bf6dd19c21d48a5689a6e7","observation_id":"07e3f8b1-c3f4-4b66-bc30-2748635f41c4","resolution":{"observed_at":"2026-08-06T18:16:20.987053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.08793","last_updated":"2025-08-27T12:33:06Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T18:06:41.404197Z","submitted_at":"2025-07-11T17:54:54Z","title":"Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":24,"verified_exact":7,"verified_fuzzy":10},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2507.08793."}