{"as_of":"2026-08-06T04:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa1b02c1bb7da4bb5cb7bce458c802d8f435aeee42da1866443bd26fe1c90649","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T02:40:03.682435Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.15512/citation-record","integrity":"/paper/2502.15512/integrity","json":"/paper/2502.15512/citation-record.json","paper":"/paper/2502.15512"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A physics-guided reinforcement learning framework for an autonomous manufacturing system with expensive data","venue":null,"work_id":"b7dd36aa-c401-4a80-ab76-d30152af7437","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:d45a3cf3425baa81bc094b37b83b5f3f90ffdb1d58b19f4753cab2628ccc9f5f","observation_id":"c349b77e-068d-4cca-92bf-515ec005a4b1","resolution":{"observed_at":"2026-05-23T06:27:39.200909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advanced PID control","venue":null,"work_id":"c472341e-4cc9-4953-9c69-64a574abba1e","year":2006},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:3b733496f084c6742330e88c48002986ccc3a2619cd48e9c4c034439f028085c","observation_id":"9aba3bb3-af68-4754-8858-d969f65a1029","resolution":{"observed_at":"2026-05-23T06:27:39.213747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01909","last_updated":"2023-09-05T02:45:18Z","snapshot_observed_at":"2026-07-06T16:14:17.621050Z","submitted_at":"2023-09-05T02:45:18Z","title":"A Survey on Physics Informed Reinforcement Learning: Review and Open Problems","version":1},"cited_work":{"arxiv_id":"2309.01909","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01909","snapshot_observed_at":"2026-07-03T19:18:54.913266Z","title":"A survey on physics informed reinforcement learning: Review and open problems","venue":null,"work_id":"e2f8f7c0-5107-4281-9df3-464291af68b0","year":2023},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/2309.01909","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:7b24315568ab38b44dd484dfb264808f45ffe672e71b8290e27f5236433dbd06","observation_id":"9c7f80c5-7dd9-49d8-b555-71f9eebd0cf5","resolution":{"observed_at":"2026-05-23T02:42:26.293441Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prototype-based models in machine learning","venue":null,"work_id":"342dac4d-acdc-48e7-b9fe-271c8d0f8920","year":2016},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:93481c3410c1bb886d0448fe1a4a73d3aa187db599c05c3be69e6ceac2445b8e","observation_id":"1fff2f63-b0cd-441d-b764-9518f286da66","resolution":{"observed_at":"2026-05-23T06:27:39.210825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":"1606.01540","doi":"10.1109/jssc.2019","metadata_source":"pith","pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"OpenAI Gym","venue":"cs.LG","work_id":"6af98f3f-f074-41ae-a689-7dd7b4b8efde","year":2016},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:399dbc2bbb7d3a69b96f1de1fad7829a2424df7da8248f143a7afc3af6a9d125","observation_id":"99a50a8e-026c-41c2-9751-c5f8bf00e804","resolution":{"observed_at":"2026-05-23T02:42:26.315288Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safe learning in robotics: From learning-based control to safe reinforcement learning","venue":null,"work_id":"3c091a75-65c8-4323-bc40-479eff4b7f62","year":2022},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:e578ea6f3405c682d4aa3017e16d06cd90f6708f4cec59684d5893aadc88e9d2","observation_id":"193896f4-e404-4c88-9e01-94bbffa55f4f","resolution":{"observed_at":"2026-05-23T06:27:39.227931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpretable end-to-end urban autonomous driving with latent deep reinforcement learning","venue":null,"work_id":"d5b7ea6f-c6d8-4960-8957-80ebab3c1688","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:d6d4b848b49a9efbf333bd01e9aa2fbbb9c455aef0419934f833d408b618ae3c","observation_id":"78347013-2f85-4614-955f-348ca4567532","resolution":{"observed_at":"2026-05-23T06:27:39.206862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Physics-guided reinforcement learning for 3d molecular structures","venue":null,"work_id":"9adad1d4-5c1b-4d46-912a-211fa377ca50","year":2019},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:3d78e72e2f667648900b78e10f4f880ed53130134aaf7e839dc713323ca7429b","observation_id":"75c2705b-f772-4424-b21b-6d03f03a8284","resolution":{"observed_at":"2026-05-23T06:27:39.223810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpretable and explainable logical policies via neurally guided symbolic abstraction","venue":null,"work_id":"63c89945-b536-40e5-9961-617a7a6ae315","year":2024},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:f5870f8e34129e174d912a04dd531108d0040f052112178e898d263a36c2d956","observation_id":"13d5793c-50ea-4179-a14b-de9c5597d2fb","resolution":{"observed_at":"2026-05-23T06:27:39.220590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmarking deep reinforcement learning for continuous control","venue":null,"work_id":"a94af3f4-462d-4776-879a-5d8d256f9f72","year":2016},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:96942369661c5aa1eb89c3f17d2265e01ee27d7f51934f62d552fd28c9ec69ac","observation_id":"cf3f62af-8e64-44e6-82c1-c3faa4714998","resolution":{"observed_at":"2026-05-23T06:27:39.217098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.03012","last_updated":"2017-04-10T18:41:28Z","snapshot_observed_at":"2026-08-03T00:43:34.331942Z","submitted_at":"2017-04-10T18:41:28Z","title":"Stochastic Neural Networks for Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1704.03012","doi":null,"metadata_source":"pith","pith_arxiv_id":"1704.03012","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stochastic Neural Networks for Hierarchical Reinforcement Learning","venue":"cs.AI","work_id":"09b8fd06-8b43-491c-b1a1-63c1aad7d9f8","year":2017},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/1704.03012","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:e09177a7b5a0aa8e4e44ca68395b33d7a68e700717dd4d2ebd7a477188fae8c9","observation_id":"452c511d-c0eb-4c31-a4eb-46580ba0df12","resolution":{"observed_at":"2026-05-23T02:42:26.324544Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Addressing function approximation error in actor-critic methods","venue":null,"work_id":"eb19a21a-10c4-42e9-a64f-034081d6914f","year":2018},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:034de3d14ba6a65cbeb6bac4e70396400cd23d010b35684de9d2426da4a88a2b","observation_id":"42e2581d-16fd-4479-a537-b93a5ecba98e","resolution":{"observed_at":"2026-05-23T02:47:28.059358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A review on deep reinforcement learning for fluid mechanics","venue":null,"work_id":"c6a1c448-a251-4692-acb1-c06b8ff945c7","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:d2fe947c131ce28905d09a00f7ace8d4dd2b5c74be1d055df35833373eb1824a","observation_id":"59520c8e-b53d-4969-9b98-f0f8883c0280","resolution":{"observed_at":"2026-05-23T02:47:28.068772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on interpretable reinforcement learning","venue":null,"work_id":"97bc9137-cd28-4cb6-82c3-e21600a5756d","year":2024},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:9e6de9b01b97e17d8e88cb41896a96fb9ada484904eb48a688d477649eb7b6c2","observation_id":"a23a2301-0777-4cbe-8267-963e3de7cccf","resolution":{"observed_at":"2026-05-23T02:47:28.065689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A review of safe reinforcement learning: Methods, theories and applications","venue":null,"work_id":"619823f9-6894-4710-84c5-a67de8cf3d71","year":2024},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:ac7b73eca5703b7a02481a2325d9e726669c15d4136cfb8e786ba4dee68c65a8","observation_id":"45e0ea0e-23d8-46d1-9386-63ffcc1031b2","resolution":{"observed_at":"2026-05-23T02:47:28.062653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"0228f23f-e090-4a05-901c-0587ed09a87d","year":2018},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:5240599769c78f9c7b77736fdcece622d455b9758f02ad6bb0a157f3ddd4019e","observation_id":"9ea5faa5-7b7b-47b1-ba71-c7c5ef92175a","resolution":{"observed_at":"2026-05-23T02:47:28.055832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Actor-critic reinforcement learning for control with stability guarantee","venue":null,"work_id":"558d88c7-ddbc-4684-a38b-e34e87364008","year":2020},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:0e8c701c6d805f9d2e38a3dd82598c18845a4d651d8ad766fe1e07f06b8ebac1","observation_id":"85d132cd-be19-4642-9330-7d1f415da506","resolution":{"observed_at":"2026-05-23T02:47:28.052144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpretable policies for reinforcement learning by genetic programming","venue":null,"work_id":"ac10ace4-25cf-4de1-adc2-0afffd2bbe08","year":2018},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:5962cac82bdc0e8b6891037498a67b1cec2c6e1e3d5a6b4a2a39460cffef1a7d","observation_id":"4a7c7343-8297-4b67-8bb9-f6243bf2b358","resolution":{"observed_at":"2026-05-23T02:47:28.048364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Port-metriplectic neural networks: thermodynamics-informed machine learning of complex physical systems","venue":null,"work_id":"5ca4e5ce-612d-482f-9a3d-872412ad888e","year":2023},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:4ca2bfc1bca48298de07ba98a1cf4e15c5842a41f569a4567fab260c9bdbc12f","observation_id":"65b6fbef-d9cf-4f5a-8006-af75285c1226","resolution":{"observed_at":"2026-05-23T02:47:28.044188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Explainability in deep reinforcement learning","venue":null,"work_id":"d66d9bac-c36d-4ca9-b342-0adb4cb1fd74","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:7c3ca22b63d83bc5e699046d4d98cd19bfe6005fbe462ac86f0e42fd301117d7","observation_id":"419e37fd-206d-48c2-9583-6d85224512f5","resolution":{"observed_at":"2026-05-23T02:47:28.040692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural logic reinforcement learning","venue":null,"work_id":"cfacbe64-fc5a-4a11-8573-238d2c4d6b6e","year":2019},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:2c559ebf291a397ba31a38842f978af56d1675d02b581580d43db855ceafc838","observation_id":"f1562c10-7e9b-431e-8c19-f9afbd018edd","resolution":{"observed_at":"2026-05-23T02:47:28.037576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stability-certified reinforcement learning: A control-theoretic perspective","venue":null,"work_id":"df5c8e79-6eff-4b23-827c-9ce65dde4568","year":2020},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:50d72d32464b9be85163e7a9eeb9f74978df84e8d75662b6176eeae4d8c2e420","observation_id":"c72a680b-fde3-4dc6-a0b2-379657e7f048","resolution":{"observed_at":"2026-05-23T02:47:28.033775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Creativity of ai: Automatic symbolic option discovery for facilitating deep reinforcement learning","venue":null,"work_id":"56d77e83-ea44-4e39-9b11-0c54b4f09078","year":2022},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:f24aa76afc69b0ee4db480963a3def344524abe9a26325488c2f8a4ab6b232fd","observation_id":"e90ed270-e90f-43e9-9d23-fbd646d55c56","resolution":{"observed_at":"2026-05-23T02:47:28.029973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The joint spectral radius: theory and applications, volume 385","venue":null,"work_id":"b8a9dc57-a916-4b2e-bd9b-d772e7a0577a","year":2009},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:487b12d1cf4ea3bdeac8f6198c98f08f8fdc16bfcea3c545c9a2bf0eecf5a711","observation_id":"be0d59e4-5a91-4cb2-8618-9728106d9312","resolution":{"observed_at":"2026-05-23T02:47:28.026337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Increasing the safety of adaptive cruise control using physics-guided reinforcement learning","venue":null,"work_id":"eb20a9a6-9388-42b2-bbdc-8807f34e5208","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:38d7849cd987cbf746c142e7d57796aca27cbc3333b9e4447f37170072469160","observation_id":"c59cfb71-4a99-403e-a3d6-eeef1feee493","resolution":{"observed_at":"2026-05-23T02:47:28.022813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable deep reinforcement learning for vision-based robotic manipulation","venue":null,"work_id":"16b96506-cb0b-429f-9968-7fde1787b35f","year":2018},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:ddadcda43e8a5f2eac01d56ea0eedb2050527e131e66f9e4746fa1837257962d","observation_id":"465a715c-76c4-46c3-b821-3a609abb1d23","resolution":{"observed_at":"2026-05-23T02:47:28.019446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards interpretable deep reinforcement learning with human- friendly prototypes","venue":null,"work_id":"9f1a93a3-48c2-4ef7-a880-fd826b6bea44","year":2023},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:fecd5d6ecdafdd8dbe65edd91a42b4a4a0158c2eda48983b613c16e5f3b8eeca","observation_id":"6aff1960-4525-41a3-a701-6e281835af69","resolution":{"observed_at":"2026-05-23T02:47:28.015771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A framework for output-feedback symbolic control","venue":null,"work_id":"3d762f5a-1b43-4688-9d7e-8671c396a70f","year":2022},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:b67ace612114d7ebe1ef750e0e3a27e932ab796243359db2f865c9fb1a56ee7d","observation_id":"64cab1ab-8c32-4e5f-b1b7-12bf3e111825","resolution":{"observed_at":"2026-05-23T02:47:28.012014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:0acf028d650bdf2ad912d4149d87cc82025f6d6c7b05c2abacef3d9bb759cd37","observation_id":"f0f2c210-b341-4ece-8d7c-2584c82315f2","resolution":{"observed_at":"2026-05-23T02:42:26.319650Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Floquet theory: a useful tool for understanding nonequilibrium dynamics","venue":null,"work_id":"283d7e5c-32ed-46be-99c0-ac2d2c6b9f3c","year":2008},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:94a753dd0f0b194b0343888160bf20841cf188aa0c7fe8d60015f5b3f0ae5901","observation_id":"07bda07e-54e3-4f65-8551-b573968df6f0","resolution":{"observed_at":"2026-05-23T02:47:28.008552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Discovering symbolic policies with deep reinforcement learning","venue":null,"work_id":"e6dde358-e1ab-4f10-b638-b1e081f50214","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:e0f848da02d3345d7f13b9597e50278fdfed4505b9235780a55eff4d54209f25","observation_id":"c4420ebb-5092-4e90-9538-33e873ecdcd6","resolution":{"observed_at":"2026-05-23T02:47:28.004902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":"1509.02971","doi":"10.1137/22m1480409","metadata_source":"pith","pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Continuous control with deep reinforcement learning","venue":"cs.LG","work_id":"41a65444-c819-4303-a1f1-b075aa86d40c","year":2015},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:027d7d8a628818279446761623884dc0422128aef167856f9dd868e9e760b0a3","observation_id":"2c0e2e7d-d365-4a6c-bd55-678a997c8b5f","resolution":{"observed_at":"2026-05-23T02:42:26.329367Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Physics-informed dyna-style model-based deep reinforcement learning for dynamic control","venue":null,"work_id":"ace9d386-0df9-424a-83d6-15c2542e193d","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:7f1a8d0132ec9e30146bafacd76e8809647f9d1bcab6cd306ef97b73ae3204f2","observation_id":"4364ce0e-d7c2-40f5-9aab-46beeb70a2f3","resolution":{"observed_at":"2026-05-23T02:47:28.001452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sdrl: interpretable and data-efficient deep reinforce- ment learning leveraging symbolic planning","venue":null,"work_id":"f9381f83-b1df-4663-bf5a-1ee4e64ed054","year":2019},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:5b1efad42694392981ff2d21c5789df624a53b976783ded900767b2fed39ff2b","observation_id":"32a90823-30a2-41eb-87e0-a8dd465845e4","resolution":{"observed_at":"2026-05-23T02:47:27.997305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Task-oriented koopman-based control with contrastive encoder","venue":null,"work_id":"a6c76c6d-706f-4c0d-9cf2-7a30193f1ae2","year":2023},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:1d2a3348c87d4ad801a1b31f341a36923d2f44e3ad007d6d5f71925923743c69","observation_id":"3b2b3718-b5f4-42de-b2b6-8c2fb13d4094","resolution":{"observed_at":"2026-05-23T02:47:27.993255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:26:11.170811Z","title":"Isaac gym: High performance gpu-based physics simulation for robot learning","venue":null,"work_id":"0030cc37-96fe-4a3f-8467-389bf587b861","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:0b278d8804dce4503a950355aa369ca55de53cb06d7c6be9d3bb22c18fca747e","observation_id":"aea2d30d-1cc4-4afe-87d5-424a50e5819b","resolution":{"observed_at":"2026-05-23T02:47:27.989681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards interpretable reinforcement learning using attention augmented agents","venue":null,"work_id":"53e51738-30ed-4c1a-b2b3-afab1217c6c0","year":2019},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:10c382564b389a35bb4ca483a07e16255e7f37c9ddec2507ce6a521163be743a","observation_id":"c1149a70-afcb-4bc7-9765-2782fd95d0f3","resolution":{"observed_at":"2026-05-23T02:47:27.985727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data-efficient hierarchical reinforcement learning","venue":null,"work_id":"218560c6-0200-4060-96b9-ff1a01c880ce","year":2018},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:98bdd0de8d379f0d1b8a7b5cfc9739de73f59e799323dc1c1992630dd4a53906","observation_id":"b2f63fc3-622a-4518-9c7e-c72632712c61","resolution":{"observed_at":"2026-05-23T02:47:27.982335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive optics control using model-based reinforcement learning","venue":null,"work_id":"c2500263-c3ba-4dcc-b405-607b573885b3","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:567c498af5dd95bf988d4bfa57958ef8080daa605062470251d4665680c76e12","observation_id":"87ebd9c3-56e2-4e3c-ba65-74ed189539b7","resolution":{"observed_at":"2026-05-23T02:47:27.978797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hierarchical reinforcement learning: A comprehensive survey","venue":null,"work_id":"b1f471e2-97d7-46fb-a4db-296e96c68ee3","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:079481a834bc401222b0bcec374045e90253dce2d62eeeba6b2e050d29fbe918","observation_id":"4a571edc-518b-4715-8cd4-cf7af0ab3739","resolution":{"observed_at":"2026-05-23T02:47:27.975594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Artificial neural networks trained through deep reinforcement learning discover control strategies for active flow control","venue":null,"work_id":"47e4e9e9-eac2-407a-93d4-5e053a7fdf46","year":2019},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:351b9156a9a6df8c6bd5d15bd166c063c6594ea55902057c4d767112bab8f100","observation_id":"cdb813c0-4650-4b48-b5aa-21e757eb9ee1","resolution":{"observed_at":"2026-05-23T02:47:27.971831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rl baselines3 zoo","venue":null,"work_id":"5852786d-f3f9-43a7-a414-90e13f3f03d2","year":2020},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:5fc450c93beef10733b948a40301369bc93287f05ed742b732b4e15ae4592ca5","observation_id":"97737316-ca5a-46dc-922f-68d2fb6a92b0","resolution":{"observed_at":"2026-05-23T02:47:27.968311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Symbolic optimal control","venue":null,"work_id":"b6208b5d-4e2b-4570-a426-1ce0ae5d532e","year":2018},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:d329740b37663f0c8c131bbbbeaae6169082946c3b289a0983f34f1927358205","observation_id":"4bca8be7-e66d-4bbe-b7db-e3985a88244e","resolution":{"observed_at":"2026-05-23T02:47:27.957784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02290","last_updated":"2026-05-01T05:16:59Z","snapshot_observed_at":"2026-07-06T17:39:24.823145Z","submitted_at":"2024-03-04T18:19:48Z","title":"Koopman-Assisted Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2403.02290","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.02290","snapshot_observed_at":"2026-07-04T06:09:37.566507Z","title":"Koopman-Assisted Reinforcement Learning","venue":"cs.AI","work_id":"2d0f6a8c-480b-41b8-946a-2a4670c84595","year":2024},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/2403.02290","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:dc95a901166b2d072c159a9e24395e09ab854d8ea324de7f6b0a401302e99b7b","observation_id":"a65c1ddf-07d6-4fb5-8ad1-801d6759e38b","resolution":{"observed_at":"2026-05-23T02:42:26.298255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:b13d576b2117599c0b9b618c9eaca8ab73e98c62da0488f2c650d740315b3027","observation_id":"10f3e79d-7bde-444e-9326-370b6cc7ce65","resolution":{"observed_at":"2026-05-23T02:42:26.311611Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multivariable feedback control: analysis and design","venue":null,"work_id":"5f8f6b77-0399-4c4a-a915-6366ffc233b4","year":2005},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:b2570566621e6427805e9acb6f75bad535c703b8bb9a36f492ad22a3792ef114","observation_id":"828587b2-f24d-4bca-a19a-17806c6290ee","resolution":{"observed_at":"2026-05-23T02:47:27.953556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning: An introduction","venue":null,"work_id":"cc2e162c-dc65-49a6-a26e-83fa4165ee92","year":2018},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:424385dd3bf02441805a4e6256babe2b079943fc8f598193a00e1bb9fecb72cb","observation_id":"a739c9d4-e140-4e12-acd3-95a31917d67f","resolution":{"observed_at":"2026-05-23T02:47:27.949570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive control schemes for improving the control system dynamics: a review","venue":null,"work_id":"ef995f43-23de-44a5-8ff8-c3828d6924ee","year":2014},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:ba888fe74f1fc3b66fb6ac46022ac1df3b1720af9668112299383e0244fb7c03","observation_id":"e43d820c-42a7-499a-866d-481d7b514ab8","resolution":{"observed_at":"2026-05-23T02:47:27.945662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Programmati- cally interpretable reinforcement learning","venue":null,"work_id":"72a36a19-a0e7-4301-98dd-a712c7eec648","year":2018},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:9f44b980e6c26c9eb6a1becb9e866c40d035c7f2cb60f0590a4f52896f934066","observation_id":"772417c5-760a-4a51-8a4a-031cfcaff0ce","resolution":{"observed_at":"2026-05-23T02:47:27.942233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toward physics-guided safe deep reinforcement learning for green data center cooling control","venue":null,"work_id":"a64d78ee-e81a-45a5-bc4b-93dfb6cce766","year":2022},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:fd263ad068725dc47bd2a2180da48678939eeee89e614c40f585c7f37412e2fe","observation_id":"1b09397f-e531-41d9-9161-522b91990976","resolution":{"observed_at":"2026-05-23T02:47:27.938534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Embed to control: A locally linear latent dynamics model for control from raw images","venue":null,"work_id":"65e9d677-d92d-4649-9d68-266f8a139047","year":2015},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:fa279bfa07307aa74cccd5ece2b6048b98dea618458cc6e3985fcf8d42d56935","observation_id":"0fd57d0d-b651-4487-a58e-a49d75a053e5","resolution":{"observed_at":"2026-05-23T02:47:27.934569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model-based deep reinforcement learning for accelerated learning from flow simulations","venue":null,"work_id":"4d51be5e-594e-44ad-94cd-ee0d8eb9eafa","year":2024},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:febcd919f5f65a46cb3763caaa08d36cae85e086fb0327eee642d49cc2a6bc41","observation_id":"0edb3ebc-e1eb-4e69-9b1e-6699f5bb7487","resolution":{"observed_at":"2026-05-23T02:47:27.929844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Koopman q-learning: Offline reinforcement learning via symmetries of dynamics","venue":null,"work_id":"75c1a017-59af-46e7-9923-6ee5dbfaf063","year":2022},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:b674e74aeecf6441ca7330ac67f0c1ceb722ddd867c5539f29776494800bad86","observation_id":"ac632e95-beb2-481f-93dd-5fca2298f115","resolution":{"observed_at":"2026-05-23T02:47:27.925423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Explainable ai and reinforcement learning—a systematic review of current approaches and trends","venue":null,"work_id":"0065807b-bb45-48b5-98d1-4840c766b75f","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:4bd2583a08821e58b1c2867c31116e4b1e015881713fb8c051dd12ba54b31cc0","observation_id":"9cefdb83-2489-4ad0-bdb5-47c92a1a6f3e","resolution":{"observed_at":"2026-05-23T02:47:27.921582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpretable deep reinforcement learning for optimizing heterogeneous energy storage systems","venue":null,"work_id":"4876c698-218f-438e-9305-54bdfd52a897","year":2023},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:19dbf3630d88f29740987c9233f60894fc9658c28d3442a5d2436da05c3d4fc9","observation_id":"ec8834d7-f48d-42bb-b67c-4d6277ddb407","resolution":{"observed_at":"2026-05-23T02:47:27.917910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with prototypical representations","venue":null,"work_id":"2dcf7232-e451-4e6e-a9f3-4bf402286563","year":2021},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:9c59d2e5cb84763a730cf711a61e812053efb086046f45adfd2d78aaa6e6c68b","observation_id":"9ca08366-51eb-4abf-a3da-5cd797a88c8a","resolution":{"observed_at":"2026-05-23T02:47:27.914253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning deep neural network representations for koopman operators of nonlinear dynamical systems","venue":null,"work_id":"025e9837-a925-4f4f-a1a2-2b234f702a7a","year":2019},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:d8800e6dbb8c8fd5e4501c1697c3fe9409eadcdc051d77e8bdab8f76a2dfb69c","observation_id":"fb99fedc-e1fb-4498-a2e0-5c50a1bf25c0","resolution":{"observed_at":"2026-05-23T02:47:27.911106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09559","last_updated":"2023-09-27T01:35:48Z","snapshot_observed_at":"2026-07-06T14:53:24.125710Z","submitted_at":"2023-02-19T12:37:07Z","title":"Physics-guided deep reinforcement learning for flow field denoising","version":2},"cited_work":{"arxiv_id":"2302.09559","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.09559","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Physics-guided deep reinforcement learning for flow field denoising","venue":null,"work_id":"17b8bf11-8651-4037-8fdc-ffc5cebfe371","year":2023},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/2302.09559","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:582c84ffad0bd6d57674fd73b0e4dc4338f42ba4d3d59134e4010d1d5a1cf5a2","observation_id":"c93227d7-4e0f-425d-8825-03dccf4737ab","resolution":{"observed_at":"2026-05-23T02:42:26.307645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12090","last_updated":"2025-02-23T06:55:10Z","snapshot_observed_at":"2026-08-05T11:10:44.135200Z","submitted_at":"2023-04-24T13:35:11Z","title":"Reinforcement Learning with Knowledge Representation and Reasoning: A Brief Survey","version":2},"cited_work":{"arxiv_id":"2304.12090","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.12090","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with knowledge representation and reasoning: A brief survey","venue":null,"work_id":"be5f17c1-d2bb-4bfb-b31c-44a56a7896a9","year":2023},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/2304.12090","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:87782fa266444fb345227c60a4097e2b79d598cd016473d2f06daac4ddf84812","observation_id":"0c00b2d7-491c-4093-a2c3-93c7a1a1f2b2","resolution":{"observed_at":"2026-05-23T02:42:26.303074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Concept learning for interpretable multi-agent reinforcement learning","venue":null,"work_id":"a88faf53-2aca-4444-9690-37338fe8c11f","year":2023},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:26d9c1c7bd882339ee97b4f092897cf0ec571936c3a06f9081ee310054c23cb7","observation_id":"e8506046-1596-4cc7-92c0-af26ebb60351","resolution":{"observed_at":"2026-05-23T02:47:27.907108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stable and safe reinforcement learning via a barrier-lyapunov actor-critic approach","venue":null,"work_id":"790dedae-37ea-4f21-bab0-d2691a8d610a","year":2023},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:95b0c671ded9b538afb97d368fe94d5bb829894c7ded1704b46175153078b0c6","observation_id":"94074562-7029-400c-860b-813b2b3ab8d0","resolution":{"observed_at":"2026-05-23T02:47:27.903611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09110","last_updated":"2025-08-22T20:31:51Z","snapshot_observed_at":"2026-07-06T17:44:21.659847Z","submitted_at":"2024-03-14T05:17:39Z","title":"SINDy-RL: Interpretable and Efficient Model-Based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2403.09110","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.09110","snapshot_observed_at":"2026-06-08T02:04:40.609057Z","title":"Sindy-rl: Interpretable and efficient model-based reinforcement learning","venue":null,"work_id":"749ecfa0-82d3-4a93-a056-0dda1422d211","year":2024},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"cited_paper":"/paper/2403.09110","citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:66af5002150f21efd94c639ff2611052f0cc5a2dbcb16b461b21e5cd535b7aca","observation_id":"aa233022-9321-42f6-8bc4-38466dc18011","resolution":{"observed_at":"2026-06-08T02:04:40.609057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"16aa8709-5713-43fa-a7d1-1d5693b4be37","year":null},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:8120f972efdaa56f25102a2e41eee20eb3c1ba0a8803a109dfd86152c41159a8","observation_id":"c46037d8-c4c0-42e3-bbfd-91c9ac0d7df4","resolution":{"observed_at":"2026-05-23T02:47:27.900000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0e4a4160-57a8-43b6-ab93-eec4749b2ece","year":null},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:ea3b6ec6d1ff90940ccdceb6256004dd6afc5a447ff7265bd1bdf9a1561fc00d","observation_id":"22acc8f1-d848-45e6-8909-2eddc799d9b1","resolution":{"observed_at":"2026-05-23T02:47:27.896623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4987de37-8ff4-4fdc-9ae8-01531c585a3d","year":null},"citing_paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning","version":5},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-23T02:40:03.682435Z"},"links":{"citing_paper":"/paper/2502.15512"},"observation_digest":"sha256:a18c1ece8dc536cca79938ddaf77f2916443333dfc524622d3b9251afa1f5ca2","observation_id":"f755ab7e-8914-4c8c-8e78-cc7a177adc1f","resolution":{"observed_at":"2026-05-23T02:47:27.893103Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.15512","last_updated":"2026-04-08T20:41:44Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T18:16:51.995546Z","submitted_at":"2025-02-21T15:09:39Z","title":"SALSA-RL: Stability Analysis in the Latent Space of Actions for Reinforcement Learning"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":10,"verified_fuzzy":52},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2502.15512."}