{"as_of":"2026-08-08T18:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2ebbfdc9559588c27c3b7fb3ed6066d0db689e73f918752a4bd0879e339f2b69","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:20:29.464007Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:49:42.827587Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-06T21:20:29.464007Z","title":"[Yang et al., 2020] Tsung-Yen Yang, Justinian Rosca, Karthik Narasimhan, and Peter J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.00485","last_updated":"2025-07-01T06:59:59Z","snapshot_observed_at":"2026-08-08T10:33:12.141821Z","submitted_at":"2025-07-01T06:59:59Z","title":"PNAct: Crafting Backdoor Attacks in Safe Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T21:20:29.464007Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2507.00485"},"observation_digest":"sha256:d74644ed2a4cd291d983d4e5455c8ccd32889a2ce02899272cac81e80082b789","observation_id":"c45262ad-fe4e-41fd-b2cf-23cf9243c6ec","resolution":{"observed_at":"2026-08-06T21:20:29.464007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-06T05:26:39.944282Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.01883","last_updated":"2025-08-06T13:50:53Z","snapshot_observed_at":"2026-08-08T13:28:02.704323Z","submitted_at":"2025-08-03T18:35:55Z","title":"Proactive Constrained Policy Optimization with Preemptive Penalty","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:26:39.944282Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2508.01883"},"observation_digest":"sha256:0671ed480455c06bb250b034a9875ef32acae4b9478fdda9b2d3f5165486b5b6","observation_id":"69baed02-188c-4f37-84b3-29394e97d553","resolution":{"observed_at":"2026-08-06T05:26:39.944282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-05T19:28:42.568008Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.12518","last_updated":"2025-08-17T22:51:27Z","snapshot_observed_at":"2026-08-06T05:26:23.208699Z","submitted_at":"2025-08-17T22:51:27Z","title":"Towards Adaptive External Communication in Autonomous Vehicles: A Conceptual Design Framework","version":1},"reference_index":145,"source":"pdf_text","source_observed_at":"2026-08-05T19:28:42.568008Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2508.12518"},"observation_digest":"sha256:20182d9f452121947445d1aa95c18de4fb432246b891f9cbd91e4556c58146b7","observation_id":"5bd81fc8-9bc4-4a4e-ba30-9110a2ae3d83","resolution":{"observed_at":"2026-08-05T19:28:42.568008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-05T16:13:08.329208Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.18884","last_updated":"2025-08-26T09:59:44Z","snapshot_observed_at":"2026-08-05T16:13:06.922080Z","submitted_at":"2025-08-26T09:59:44Z","title":"HAEPO: History-Aggregated Exploratory Policy Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:08.329208Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2508.18884"},"observation_digest":"sha256:2cf1bf329d290606f382c2c671a7b23d191501784044fdb87ae1e8957258b6cc","observation_id":"54f2db2d-3e3b-4647-bc16-4aba70695daa","resolution":{"observed_at":"2026-08-05T16:13:08.329208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2512.06600","last_updated":"2026-05-08T14:44:19Z","snapshot_observed_at":"2026-07-06T22:37:59.340166Z","submitted_at":"2025-12-06T23:57:03Z","title":"Learning Reachability of Energy Storage Arbitrage","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T00:09:57.342909Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2512.06600"},"observation_digest":"sha256:ead519aa8fac8d082b3024775b53e9072b9cd6b18e333971788207a9fb26c7bc","observation_id":"9d66733f-0c55-4b67-b2d9-06229e753e3c","resolution":{"observed_at":"2026-05-17T00:11:23.314646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.11688","last_updated":"2026-05-12T07:46:03Z","snapshot_observed_at":"2026-07-31T18:15:17.654469Z","submitted_at":"2026-05-12T07:46:03Z","title":"Shaping Zero-Shot Coordination via State Blocking","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T07:42:23.260464Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.11688"},"observation_digest":"sha256:048d1a0b03e29470cb6c4a39f408ebcc276096886aa833e8af0daf7fe83b0820","observation_id":"74cbb9dd-b34a-4e9a-a670-d1f326ae747b","resolution":{"observed_at":"2026-05-13T07:42:30.202198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.11975","last_updated":"2026-05-18T06:36:11Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:36Z","title":"Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:24.455817Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.11975"},"observation_digest":"sha256:8a92b23bcb1424a63d129d2f118b4b2ab870e71254ffdb72014d9d3cd2082836","observation_id":"3707cb9f-bf1c-4307-94ab-185a1bb1573f","resolution":{"observed_at":"2026-05-13T07:32:30.563478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.11975","last_updated":"2026-05-18T06:36:11Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:36Z","title":"Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T22:48:55.661356Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.11975"},"observation_digest":"sha256:14f6ee6bf8ba893a7042ba02dfe5d5fb596bbf9fb90418b8ec661298675e99db","observation_id":"377cdaa2-8b56-4df6-8339-484b1c0cc31d","resolution":{"observed_at":"2026-05-20T22:49:10.091288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.14174","last_updated":"2026-05-13T22:53:47Z","snapshot_observed_at":"2026-08-03T09:16:07.224221Z","submitted_at":"2026-05-13T22:53:47Z","title":"Safety-Constrained Reinforcement Learning with Post-Training Reachability Verification for Robot Navigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T04:52:48.491036Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.14174"},"observation_digest":"sha256:61eedc9d21134eccdcb4ea4a6a20afb9e044a7ab54384c50ec1e7d4d7fd80d13","observation_id":"b65ad3bb-b558-49a0-a9b5-dbc898cded5a","resolution":{"observed_at":"2026-05-15T04:55:03.697736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2605.14246","last_updated":"2026-05-14T01:23:09Z","snapshot_observed_at":"2026-08-06T16:04:07.693127Z","submitted_at":"2026-05-14T01:23:09Z","title":"Action-Conditioned Risk Gating for Safety-Critical Control under Partial Observability","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T02:50:40.285132Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2605.14246"},"observation_digest":"sha256:b2658462092d334fd3fb8e61c94b2cc4458e08130d2993662d3192639082b3da","observation_id":"5302c802-cf66-4d30-9860-41e11ba0c694","resolution":{"observed_at":"2026-05-15T02:53:33.836749Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2606.22579","last_updated":"2026-06-21T16:29:25Z","snapshot_observed_at":"2026-08-02T07:11:59.062207Z","submitted_at":"2026-06-21T16:29:25Z","title":"Stationary Robust Mean-Field Games under Model Mismatches","version":1},"reference_index":193,"source":"arxiv_source","source_observed_at":"2026-06-26T10:50:40.841967Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2606.22579"},"observation_digest":"sha256:54905daad0542bac11b96c46d2403c2899545945764ddd8f289f843609a9b870","observation_id":"f72318d1-fc15-43de-9c53-e04372183f8b","resolution":{"observed_at":"2026-07-04T08:49:42.828921Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2606.27861","last_updated":"2026-06-26T08:59:38Z","snapshot_observed_at":"2026-08-05T13:23:45.156625Z","submitted_at":"2026-06-26T08:59:38Z","title":"PPO-EAL: Exact Augmented Lagrangian Proximal Policy Optimization for Safe Robotic Control","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T04:49:22.328169Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2606.27861"},"observation_digest":"sha256:27eda42c5e3a4b7aeb45667eb99f99c4abd26eb0e1eeaf1a0e17ce4d4ab8117c","observation_id":"72aa2f1c-96ae-495b-a307-7c421392e84d","resolution":{"observed_at":"2026-06-29T19:13:53.387161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":"2010.03152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-07-04T08:49:42.827587Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":"75762d92-0be1-48c0-853c-6ea6bcc061d7","year":2010},"citing_paper":{"arxiv_id":"2606.28217","last_updated":"2026-06-26T16:08:36Z","snapshot_observed_at":"2026-08-01T15:13:27.815981Z","submitted_at":"2026-06-26T16:08:36Z","title":"Towards Value-Constrained Credit Assignment in Fully Delegated AI Cooperatives","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T04:27:10.983662Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2606.28217"},"observation_digest":"sha256:dfd90efd4c92108ecba811206e8971e8dbfa9e0e14afa63de243af7da5a551ef","observation_id":"358b8717-05b9-4301-89fc-6bd17154ec29","resolution":{"observed_at":"2026-07-01T16:55:51.013454Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2010.03152/citation-record","integrity":"/paper/2010.03152/integrity","json":"/paper/2010.03152/citation-record.json","paper":"/paper/2010.03152"},"outbound":[],"paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T10:02:11.078138Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2010.03152."}