{"as_of":"2026-08-11T06:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:88983844e3141576fd48cbfbcfdd03bd7a2c8ec57d8e4d1a9e84d667acb52bc3","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:07:26.803812Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.19473/citation-record","integrity":"/paper/2504.19473/integrity","json":"/paper/2504.19473/citation-record.json","paper":"/paper/2504.19473"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s42064-022-0151-3","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:26.831165Z","title":"On-board modeling of gravity fields of elongated asteroids using hopfield neural networks,","venue":null,"work_id":"ea1c9302-669b-41ce-84e0-f0fdad9fef53","year":2023},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.683371Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:77b3911dc2625b56cafc973b2c457dacd5f0581b7c5ab8f7064dfa8c475f1ed8","observation_id":"5d023f3e-39c2-435f-bd6b-33d076157027","resolution":{"observed_at":"2026-08-10T19:07:26.837935Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.706623Z","title":"Closed-loop deep neural network optimal control algorithm and error analysis for powered landing under uncertainties,","venue":null,"work_id":"c8581de5-779f-4d66-ac2d-5bb42854e574","year":2023},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.688978Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:a947b6f84f94fdf32869d06e8177ede74aeecf6258905aac23b576226a2a7d59","observation_id":"8b592808-8018-40a6-a342-e49d4e29bea4","resolution":{"observed_at":"2026-08-10T19:07:27.711491Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:26.693949Z","title":"Low-thrust trajectory optimization with averaged dynamics using analytical switching detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.693949Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:0dc81d736d4be7d689333cd10807f4e923bd33df06ef082cca3376b6ea91b625","observation_id":"2ad480ca-b268-4649-8f35-1517b31f40aa","resolution":{"observed_at":"2026-08-10T19:07:26.693949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1047675","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.548183Z","title":"Spacecraft relative motion control near an asteroid with uncertainties: a lyapunov redesign approach,","venue":null,"work_id":"bd53e8ca-fc47-4cdd-9200-a32e14776752","year":2024},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.699386Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:31d65a4830ca0b36cdbd16ccb59f0f8a24606764ff209fa3cd7eaf9815d32b76","observation_id":"a2b98f5b-5cd6-405e-8825-7ec9afc729a6","resolution":{"observed_at":"2026-08-10T19:07:27.555654Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.682327Z","title":"Robust controller design: recent emerging concepts for control of mechatronic systems,","venue":null,"work_id":"ef137aeb-a085-4f8f-a923-6c531c223372","year":2020},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.704194Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:29b86e66e6d36c92da76d599bf661fbb64a20f889917c3767d623606b63d23ea","observation_id":"a54c82de-6522-4043-a85b-54837c272d11","resolution":{"observed_at":"2026-08-10T19:07:27.686799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.667903Z","title":"Dynamic-matching adaptive sliding mode control for hypersonic vehicles,","venue":null,"work_id":"6bbaea0e-15e4-405e-8d39-19b8f3e997b2","year":2024},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.708523Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:1b2861acd79371c28fca40837254685db79bdb14b01e385dccb73d5fc50df153","observation_id":"2385b37d-0a4a-4aa7-92d2-9ab2c084c961","resolution":{"observed_at":"2026-08-10T19:07:27.672649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.653781Z","title":"Adaptive non-affine control for the short-period model of a generic hypersonic flight vehicle,","venue":null,"work_id":"d32ec3a6-f4bf-4cbf-aa4d-d5e51c57beca","year":2017},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.713807Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:5c87f7a378b63b7c51c0b81a83825df537405ff7e92be72991ad241d4bf6c853","observation_id":"c5f5b0f6-8aa6-4a46-ac6d-23860c172ade","resolution":{"observed_at":"2026-08-10T19:07:27.658557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-10T19:07:26.717901Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.717901Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:1850ea16d9531f8e86dbc086d2a81c6174cf4de292e5762c6ac8c496ca6fce79","observation_id":"6cff9f8a-0f11-42d6-aebb-f775f0f2304e","resolution":{"observed_at":"2026-08-10T19:07:26.717901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.05477","last_updated":"2017-04-20T18:04:12Z","snapshot_observed_at":"2026-07-06T04:09:39.172428Z","submitted_at":"2015-02-19T06:44:25Z","title":"Trust Region Policy Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.05477","snapshot_observed_at":"2026-08-10T19:07:26.722448Z","title":"Trust Region Policy Optimization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.722448Z"},"links":{"cited_paper":"/paper/1502.05477","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:85d5fab6d1c67da0e73fdb2131311ec6f8839d87ca5366c94d3d378d42761bd1","observation_id":"408ee20d-2e28-4309-be90-04869ea8ff0d","resolution":{"observed_at":"2026-08-10T19:07:26.722448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13303","last_updated":"2021-07-08T09:00:05Z","snapshot_observed_at":"2026-07-06T09:59:23.065400Z","submitted_at":"2020-09-24T21:05:46Z","title":"Sim-to-Real Transfer in Deep Reinforcement Learning for Robotics: a Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13303","snapshot_observed_at":"2026-08-10T19:07:26.726567Z","title":"Sim-to-Real Transfer in Deep Reinforcement Learning for Robotics: a Survey,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.726567Z"},"links":{"cited_paper":"/paper/2009.13303","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:81c6ce5f83ad1217e66763ad8d9b12410f3041ca387e3d9398468bb2355ded7f","observation_id":"abb060e0-6109-43e4-ba82-5fb638c7e877","resolution":{"observed_at":"2026-08-10T19:07:26.726567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.09627","last_updated":"2019-08-06T10:43:58Z","snapshot_observed_at":"2026-07-06T06:20:44.630032Z","submitted_at":"2018-01-29T17:04:45Z","title":"Barrier-Certified Adaptive Reinforcement Learning with Applications to Brushbot Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.09627","snapshot_observed_at":"2026-08-10T19:07:26.730845Z","title":"Safety- aware adaptive reinforcement learning with applications to brushbot JOURNAL OF IEEE TRANSACTIONS ON AEROSPACE AND ELECTRONIC SYSTEMS 10 navigation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.730845Z"},"links":{"cited_paper":"/paper/1801.09627","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:433dad3b6093834c8638e29a52b1823bd40acc45191776658d0e23c227b5c6e8","observation_id":"550fe7e3-904a-49a1-95f0-0384484d2bb7","resolution":{"observed_at":"2026-08-10T19:07:26.730845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.05065","last_updated":"2017-07-18T05:30:28Z","snapshot_observed_at":"2026-07-06T05:42:36.249572Z","submitted_at":"2017-05-15T04:06:22Z","title":"AirSim: High-Fidelity Visual and Physical Simulation for Autonomous Vehicles","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.05065","snapshot_observed_at":"2026-08-10T19:07:26.735864Z","title":"AirSim: High-Fidelity Visual and Physical Simulation for Autonomous Vehicles,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.735864Z"},"links":{"cited_paper":"/paper/1705.05065","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:82b3bd6604967b5e31ae773a9532b0dc33cfa73ea2de76794386ca88eb598dda","observation_id":"e58b9143-ad2d-47d1-aa8e-2385561639e1","resolution":{"observed_at":"2026-08-10T19:07:26.735864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.06408","last_updated":"2016-12-05T15:43:55Z","snapshot_observed_at":"2026-08-06T04:59:47.452085Z","submitted_at":"2016-09-21T02:36:33Z","title":"Control Barrier Function Based Quadratic Programs for Safety Critical Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.06408","snapshot_observed_at":"2026-08-10T19:07:26.740133Z","title":"Control Barrier Function Based Quadratic Programs for Safety Critical Systems,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.740133Z"},"links":{"cited_paper":"/paper/1609.06408","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:bcb7f674a804ae8a061391ebcdd53652965c08c3fb88fa7570dde908744094f2","observation_id":"4776e85a-f68f-473b-99c5-ed8650b9e466","resolution":{"observed_at":"2026-08-10T19:07:26.740133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.638318Z","title":"Safe Model-based Reinforcement Learning with Stability Guarantees,","venue":null,"work_id":"0389cca9-70a7-40aa-99bf-8599b6d7ca18","year":2017},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.744073Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:7b184cb64bfdde95a156fdc6bf6c8590a65d2c19d06cdbcf78e1b9f6d57e4805","observation_id":"f51b634e-fb27-45e7-a700-3605670d09b8","resolution":{"observed_at":"2026-08-10T19:07:27.642607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.622620Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":"d9c7eaab-21d1-4fa8-b7ed-fdf9eb6b1d89","year":2015},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.748674Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:c73fb2148ce0508cc02590e7f10bb879b6dd76ac6e20c91c4fb9fdcf6655fd84","observation_id":"5242f092-8c65-40a1-9ea7-503e8db1ba10","resolution":{"observed_at":"2026-08-10T19:07:27.628013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-10T19:07:26.752852Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.752852Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:85eb878aba5fe9e36325f3ef5575a93138b9b971f5899dedb59b4c72d0a071b1","observation_id":"c9204ebb-5759-44d1-955b-d8dc51b0f9e4","resolution":{"observed_at":"2026-08-10T19:07:26.752852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.607839Z","title":"Mastering the game of Go without human knowledge,","venue":null,"work_id":"ae6e7e01-f21d-4783-a36f-1408a708de72","year":2017},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.756916Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:f0bf421fa8ea5763e3918738bc5929b1cfa56df32d49ccf2957f8dd05369c7fe","observation_id":"0ee57554-639d-40fb-a528-beac0fc4225a","resolution":{"observed_at":"2026-08-10T19:07:27.612070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.594182Z","title":"Local gaussian process regression for real time online model learning,","venue":null,"work_id":"0b6ad539-9a11-46c4-b703-01daae870785","year":2008},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.761005Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:31cee97b0db9c7d458234e5d16ae6e17fa137f0c7fb077844ae55a0b6fc2c48e","observation_id":"c3529b1b-6a7a-4b97-a8fa-df7e8a89ddad","resolution":{"observed_at":"2026-08-10T19:07:27.598229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/9982038","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.355365Z","title":"Safe reinforcement learning for legged locomotion,","venue":null,"work_id":"ae9ebfdc-d52f-4985-a29b-3618b1855892","year":2022},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.764451Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:be571590b62dbea6f8d9955d6f043c193236b7cba1b80e9d478120bdca6a7405","observation_id":"3b93faa9-bc65-4336-8e57-e5d46278effe","resolution":{"observed_at":"2026-08-10T19:07:27.363776Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.580164Z","title":"Safe exploration techniques for rein- forcement learning – an overview,","venue":null,"work_id":"e4859985-07b5-4842-8dc3-fa6a28d05d26","year":2014},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.768682Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:2e93cfde2b130e00a68280a97e658dfbcfb68a15b11ea6ce13df6d603df24bce","observation_id":"bd54feb0-b0ee-40c0-b401-15b7642ad4ad","resolution":{"observed_at":"2026-08-10T19:07:27.583961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-10T17:16:29.612396Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-10T19:07:26.773019Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.773019Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:654bcc3e922ef506e6cc92e3b2ba7170fdaf750c1ccd4671344edaa83fd7b03f","observation_id":"20725de9-232b-41e8-a263-8590bbf9b5d7","resolution":{"observed_at":"2026-08-10T19:07:26.773019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06397","last_updated":"2024-03-12T02:13:51Z","snapshot_observed_at":"2026-08-04T00:41:58.339755Z","submitted_at":"2024-03-11T03:17:33Z","title":"DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2403.06397","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.06397","snapshot_observed_at":"2026-08-10T19:07:27.253105Z","title":"DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning","venue":"cs.LG","work_id":"61fc7a69-dad5-4bd6-9516-cb5e8f695702","year":2024},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.776904Z"},"links":{"cited_paper":"/paper/2403.06397","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:ec9e6ea4997a02023f37c3bf7bbe23d79f9c76d0ce264ff5f37ea19e8306dbaf","observation_id":"ce3faa09-bcd3-43ac-988d-e3b31c5ba09f","resolution":{"observed_at":"2026-08-10T19:07:27.258215Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/8493361","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.227168Z","title":"A General Safety Framework for Learning- Based Control in Uncertain Robotic Systems,","venue":null,"work_id":"d53d36ba-9bde-495c-b91a-d8ef656a24b9","year":2019},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.781223Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:1387b397dac20d5445525d95cb63334c1bd84b585a9d51da1db87d5d226400bf","observation_id":"b8226d37-9466-4480-af53-8a12def94caf","resolution":{"observed_at":"2026-08-10T19:07:27.234890Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01290","last_updated":"2018-08-08T21:27:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T09:50:50Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01290","snapshot_observed_at":"2026-08-10T19:07:26.785644Z","title":"Soft actor-critic: off-policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.785644Z"},"links":{"cited_paper":"/paper/1801.01290","citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:421c678c0b6ecaf80686754b954e0560e833a714dfdd241e94658e65e3d4e2d9","observation_id":"950f1b90-39a6-4f60-84e5-232bfb1ae72d","resolution":{"observed_at":"2026-08-10T19:07:26.785644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/7079382","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.122327Z","title":"Torque saturation in bipedal robotic walking through control lyapunov function-based quadratic programs,","venue":null,"work_id":"2e71a944-d3b1-4b59-8819-effa626f4f16","year":2015},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.790789Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:c75aaccd64e4a89f9048396cf7c136e5cf4dfa80e2fc795c1e9880cefe03dcce","observation_id":"5f341022-f17f-447c-9de4-7b97ffc216f9","resolution":{"observed_at":"2026-08-10T19:07:27.129039Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/7170931","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.015637Z","title":"Adaptive cruise control: experimental validation of advanced controllers on scale-model cars,","venue":null,"work_id":"cc82e835-9c28-4fd5-9b23-58eb897f6c71","year":2015},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.794907Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:b861d80ebb5453c2d155d0a6091a91e839a6d8a0450d94e4fe64ed5f78b4b51c","observation_id":"0f9120d7-a448-4c64-b80e-0ee14f902d29","resolution":{"observed_at":"2026-08-10T19:07:27.022998Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/6709752","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:26.931378Z","title":"Rapidly exponentially stabilizing control lyapunov functions and hybrid zero dynamics,","venue":null,"work_id":"f3659d5f-5843-46c2-9eb4-2da6668ff727","year":2014},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.799519Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:adca541aba7b1da68a6a94db985969e2c88e343f64517440d3397e4326dcf3af","observation_id":"6bfc1b15-0323-4324-be71-ccdd6ae4f90c","resolution":{"observed_at":"2026-08-10T19:07:26.939616Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:07:27.566731Z","title":"Online actor–critic algorithm to solve the continuous-time infinite horizon optimal control problem,","venue":null,"work_id":"071f7db4-a92b-4270-aad8-f2f9b0d677ba","year":2010},"citing_paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:07:26.803812Z"},"links":{"citing_paper":"/paper/2504.19473"},"observation_digest":"sha256:2b5e8537bfc75832c596392ee114711f21a0012c60df7eaededd71d7dfc7a84b","observation_id":"375a64be-9743-4d71-90c0-179fa289ae99","resolution":{"observed_at":"2026-08-10T19:07:27.571085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.19473","last_updated":"2025-01-18T08:04:00Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T18:59:46.259174Z","submitted_at":"2025-01-18T08:04:00Z","title":"Stability Enhancement in Reinforcement Learning via Adaptive Control Lyapunov Function"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":8,"verified_fuzzy":9},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2504.19473."}