{"as_of":"2026-08-09T07:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13a53aef0fc3a546c57a3a804bfe13c293713958ec36b04070a0ab130253b7ac","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T23:37:37.171131Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23930/citation-record","integrity":"/paper/2607.23930/integrity","json":"/paper/2607.23930/citation-record.json","paper":"/paper/2607.23930"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.160629Z","title":"Outplaying elite table tennis players with an autonomous robot,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.160629Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:227a40c429f450bee1a14f70872a7dd53f842c5b10ae317a4f4811cdb597a60a","observation_id":"1bbc07d9-ebb0-4236-b113-96f8d7a09c60","resolution":{"observed_at":"2026-07-31T23:37:31.160629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.317125Z","title":"Champion- level drone racing using deep reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.317125Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:e89b668a780de78a2baea7de2a589dcd58ec620faa4abf750fd414bb1035a864","observation_id":"140524d7-9607-46c9-8105-2437a0a61992","resolution":{"observed_at":"2026-07-31T23:37:31.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.414569Z","title":"Precise and dexterous robotic manipulation via human-in-the- loop reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.414569Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:f22db81d2baa85f82dedf4b82117e80e03b6f15f9aa2258c17271610ddc13727","observation_id":"7b9fadfa-a4a1-403d-9a1b-c142711b2585","resolution":{"observed_at":"2026-07-31T23:37:31.414569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.488459Z","title":"Outracing champion gran turismo drivers with deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.488459Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:a9dc24fe179aca503441cc342909a93884c588058282971b2c20f3228c9ceb69","observation_id":"8b7a38c4-ffe8-43ef-943a-cb18c72288a3","resolution":{"observed_at":"2026-07-31T23:37:31.488459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.556221Z","title":"Anymal parkour: Learning agile navigation for quadrupedal robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.556221Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:65122600dfc90e3e8b441c58247c4eb1ac04fd16dcc3bd80f926aa1ec2e32676","observation_id":"26e9148c-d34b-4797-91e4-ac2e891e7a7a","resolution":{"observed_at":"2026-07-31T23:37:31.556221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.597220Z","title":"Learning agile and dynamic motor skills for legged robots,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.597220Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:8fb0b627857b8b7cd565c0878e6dee7c7b2b67303942ff7eb82a84c9765b6eee","observation_id":"ed00369e-9565-40bd-9f68-d50c1fe200fa","resolution":{"observed_at":"2026-07-31T23:37:31.597220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.647258Z","title":"Safe reinforcement learning for arm manipulation with constrained markov decision process,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.647258Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:8ae2f003a04dfa450bd1b08dd1f5b8538ff1549ba9c9dccbea4fd16563e15e8d","observation_id":"51d157f4-8b4c-443b-ba9f-6063ea6e3bae","resolution":{"observed_at":"2026-07-31T23:37:31.647258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.714471Z","title":"Safety-polarized and prioritized reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.714471Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:bf1e06af74bc6988a78ccf6fcf272aebfbc7a7a0d4c95987c4f55ed3708685cc","observation_id":"e3cbc3a5-f3f8-4ee7-bcd6-19365e383edf","resolution":{"observed_at":"2026-07-31T23:37:31.714471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.791209Z","title":"Safe reinforcement learning via projection on a safe set: How to achieve optimality?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.791209Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:a81bf53aac95bc43c665c95dedeb3624ff9606c2e1044aef90c6c9737d842a3a","observation_id":"a7e78457-9dda-42aa-b74f-3d30e56716a0","resolution":{"observed_at":"2026-07-31T23:37:31.791209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:31.926907Z","title":"Data-driven mpc for quadrotors,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:31.926907Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:ac95935e0e8d695fc321db1489a5a805e6d9cc740d5510ccf55126cf35023286","observation_id":"08a1dacb-f2ba-45a9-aa94-b99ef7d88106","resolution":{"observed_at":"2026-07-31T23:37:31.926907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:32.033809Z","title":"Learning-based model predictive control: Toward safe learning in control,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:32.033809Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:b208ec3caf0e38f65208b39f5a55115ac47c09936702c224f24a416d12f94ca0","observation_id":"f6dbd278-b43c-439c-9e13-28334e45c3a3","resolution":{"observed_at":"2026-07-31T23:37:32.033809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:32.142211Z","title":"Model predictive control: Theory and practice—a survey,","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:32.142211Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:6f1a888ce18d99f343fbe0e6ab7e6199bf155489f59de259e30dd827441a8ab0","observation_id":"dff3ef18-9193-4841-92bd-16e03c48275c","resolution":{"observed_at":"2026-07-31T23:37:32.142211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:32.254929Z","title":"Constrained model predictive control: Stability and optimality,","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:32.254929Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:2413b5b9e7e26b1a17112213e20b519851974194be310f58816d04ca9704d4e3","observation_id":"a882a382-337f-48a8-a805-4006c0196ea4","resolution":{"observed_at":"2026-07-31T23:37:32.254929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:32.361481Z","title":"Borrelli, A","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:32.361481Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:d8112859dcbf4231cdb899d03c62acd970544540a3dbef9628baefce958e4c9c","observation_id":"984c636a-611d-45d9-b122-e5fcceea6d08","resolution":{"observed_at":"2026-07-31T23:37:32.361481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02133","last_updated":"2025-02-04T09:06:07Z","snapshot_observed_at":"2026-08-02T19:04:37.126962Z","submitted_at":"2025-02-04T09:06:07Z","title":"Synthesis of Model Predictive Control and Reinforcement Learning: Survey and Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02133","snapshot_observed_at":"2026-07-31T23:37:32.474394Z","title":"Synthesis of model predictive control and reinforcement learning: Survey and classification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:32.474394Z"},"links":{"cited_paper":"/paper/2502.02133","citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:190c4a43f3ce4fb611493c90215da2739d35d804e632264bcb850d17db60a90d","observation_id":"06f682ac-07e5-4bab-a559-715e7fb69552","resolution":{"observed_at":"2026-07-31T23:37:32.474394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:32.583132Z","title":"Value function approximation and model predictive control,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:32.583132Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:829c852982d1296d01e5dc37166a2af6e1856f7dc94c4220b8ae44999a8e53be","observation_id":"6d34f5f2-9027-460d-b25b-04380b0c897e","resolution":{"observed_at":"2026-07-31T23:37:32.583132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:32.706447Z","title":"Ac4mpc: Actor-critic reinforcement learning for guiding model predictive control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:32.706447Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:28a0bb320e723e3f085ba99c96e26a9afe998851d81ab5d89c2345beb172276e","observation_id":"5421fe9a-7189-4f68-933a-c64a5f68a26b","resolution":{"observed_at":"2026-07-31T23:37:32.706447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:32.773752Z","title":"Plan online, learn offline: Efficient learning and exploration via model-based control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:32.773752Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:f92bf875bec95f0826b254ab8ff063bfc5e50dd02e0a7da5dab7aafe4acf3f40","observation_id":"8851ddbb-4c5b-4ce9-aa27-1a35e15a26c3","resolution":{"observed_at":"2026-07-31T23:37:32.773752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:32.897005Z","title":"An overview of the action space for deep reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:32.897005Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:3b5622e50641f811cc8405068e61cb6320bc210093a8bfdfb571be1919a77183","observation_id":"9ae6c267-dc97-423c-9fd4-fb1819da0851","resolution":{"observed_at":"2026-07-31T23:37:32.897005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:33.020268Z","title":"Where to go next: Learning a subgoal recommendation policy for navigation in dynamic environments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:33.020268Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:a5cad28fe5c817a472133b2ea69bdec536b4c7566dd97ec99b233bf65af76080","observation_id":"5273995f-2fdf-40db-bfab-593aafc2434d","resolution":{"observed_at":"2026-07-31T23:37:33.020268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:33.149391Z","title":"Learning interaction-aware guidance for trajectory optimization in dense traffic scenarios,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:33.149391Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:414a03275ea68c825ff5ddd4ecf060fffbfdeda2a549199fcf57ccdff7360c91","observation_id":"205936b1-c56f-4302-98f8-00a6db88cc27","resolution":{"observed_at":"2026-07-31T23:37:33.149391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:33.311370Z","title":"A hierarchical approach for strategic motion planning in autonomous racing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:33.311370Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:0cdecd48df146e9c60c773bfeb10bd260b3238a25dae2017379f8fdfcffce31b","observation_id":"e2346ac2-a7e7-429c-8561-b2740bf6a9e1","resolution":{"observed_at":"2026-07-31T23:37:33.311370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:33.447723Z","title":"Parameterization approach of the frenet transformation for model predictive control of autonomous vehicles,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:33.447723Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:e53e353f9d67cb6be4ccd8684cea641613846bf35a92f5b28ed01e6e3c06a86b","observation_id":"13b88ac6-93f0-4610-a044-e2d58a5dd05b","resolution":{"observed_at":"2026-07-31T23:37:33.447723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:33.573441Z","title":"Reinforcement learning and model predictive control for robust embedded quadrotor guidance and control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:33.573441Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:8de855ac2ae555f5047a91af6bc0d5c0a9ccf1fef05ac05a9c0b9259f259adbf","observation_id":"2332591b-ad8d-4649-97cc-574f8d4cc14d","resolution":{"observed_at":"2026-07-31T23:37:33.573441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:33.735622Z","title":"Rein- forcement learning-based receding horizon control using adaptive control barrier functions for safety-critical systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:33.735622Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:36bb7bee9d930c978c5e853fcfb77c0b6db1fefad1fe17947c43e532fd474cbc","observation_id":"9324325f-ae63-47ca-a08b-c5451ad45e31","resolution":{"observed_at":"2026-07-31T23:37:33.735622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:33.837970Z","title":"Adaptive stochastic nonlinear model predictive control with look-ahead deep reinforcement learning for autonomous vehicle motion control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:33.837970Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:fd846063faef05414bf978ccbd00393bf21e65f2c9f647ef13c0f30a9acb4498","observation_id":"b116aa46-fa0d-4621-9511-433881fe6051","resolution":{"observed_at":"2026-07-31T23:37:33.837970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:33.894623Z","title":"Learning when to drive in intersections by combining reinforcement learning and model predictive control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:33.894623Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:6022de140e4253c2408c3b69fe0173cbf4b56cab824d555b2e82d8deeddc352c","observation_id":"17ad1c49-6797-400c-9a2f-ad6a33ec1638","resolution":{"observed_at":"2026-07-31T23:37:33.894623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:34.000667Z","title":"Safe reinforcement learning with chance- constrained model predictive control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:34.000667Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:0fdc8c42c89a51e0209ef14e57a640476f147d6509d77f9d459579e169f139c8","observation_id":"f8e5c7f5-81f5-4431-90fa-59af27b863ce","resolution":{"observed_at":"2026-07-31T23:37:34.000667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:34.143230Z","title":"A safe reinforcement learning driven weights-varying model predictive control for autonomous vehicle motion control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:34.143230Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:a5127b10398a24a6aa64ff477faee37a56bbd6767a81e0e58bc72a983f68943c","observation_id":"360cc65b-7cde-4c29-9608-4e4abcbd2d6f","resolution":{"observed_at":"2026-07-31T23:37:34.143230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:34.272904Z","title":"Learning robot trajectories subject to kinematic joint constraints,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:34.272904Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:529baa5faa9ba213dbbdc2bfbf977c0c777165b9b3d7f73478e22033094cbf67","observation_id":"5bdc051c-9acd-44e6-ba30-b13f3e1fd27d","resolution":{"observed_at":"2026-07-31T23:37:34.272904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:34.445651Z","title":"Action mapping: A reinforcement learning method for constrained-input systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:34.445651Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:0a740977744bdb483b356418d670cb1eb0e560925de2d5e1db159d57e06860e7","observation_id":"a2b3a499-39d8-4a52-93e8-381ab65930f0","resolution":{"observed_at":"2026-07-31T23:37:34.445651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:34.635612Z","title":"Action mapping for reinforcement learning in continuous environments with constraints,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:34.635612Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:be4dab731fc2de8b5977dcb1fde7e94ec5032b1fad8ee7a9450c4e30da3eb7e4","observation_id":"9c1669de-640a-45f0-912e-51e378398cfa","resolution":{"observed_at":"2026-07-31T23:37:34.635612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:34.794983Z","title":"Optimal transportation by orthogonal coupling dynamics,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:34.794983Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:b3ec47af077443c1d3c344fbdb7e3742f195c1a0b2dbe02583fa575cee598085","observation_id":"c6efc1b0-4074-4989-9f81-f4ac7cf3826e","resolution":{"observed_at":"2026-07-31T23:37:34.794983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:34.934987Z","title":"Learning for control: An inverse optimization approach,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:34.934987Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:71558ed542882a367ba700f457dec3bf37856dede22a8ad1263fc5c3b8601eb9","observation_id":"f7e8288d-5524-4432-bd48-139a84b626bc","resolution":{"observed_at":"2026-07-31T23:37:34.934987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:35.055082Z","title":"Inverse optimization via learning feasible regions,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:35.055082Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:2cdf4a1f95afe2b94ec33ca3c15909f3feb09bc0813e1410af830436e460b3a9","observation_id":"d98b4aef-1ae5-43b6-9c6c-c630c697bcf2","resolution":{"observed_at":"2026-07-31T23:37:35.055082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:35.212287Z","title":null,"venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:35.212287Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:ab7e32ba24b7e4b75abc1cf8308a9ff3124b86e452f773115ed4a834d394135b","observation_id":"d1c56e6d-e590-46a3-854d-060efeb3ec1c","resolution":{"observed_at":"2026-07-31T23:37:35.212287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:35.338751Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:35.338751Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:902b337f5eb1c8d9b0356d71ce7103baab41f7a112f8000246f280c09336fab1","observation_id":"9a27364b-6308-4899-a245-b1a0ce2785bb","resolution":{"observed_at":"2026-07-31T23:37:35.338751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:35.463864Z","title":"Spivak,Calculus, 4th ed","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:35.463864Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:41d8e9249d8b43042d80cb6e12d51ee2014ae014070656bbcb0ea62652396615","observation_id":"0c7818ef-5ee1-40ce-8489-363fc8c18a83","resolution":{"observed_at":"2026-07-31T23:37:35.463864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:35.592646Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:35.592646Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:c97abb640ac8a07065cebe6a95ebc8eaa9f3280d03972a65cd547e76fb3822da","observation_id":"bd290e3a-d287-41ff-ba29-363d7dab019d","resolution":{"observed_at":"2026-07-31T23:37:35.592646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:35.758399Z","title":"Method and apparatus for low-complexity trajectory planning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:35.758399Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:4ac55b6fb37f5df47369257614df07b9b930dd832668c2374f04886e321655a0","observation_id":"27473b78-0dd8-4f28-8c1e-5dd4a9cf8805","resolution":{"observed_at":"2026-07-31T23:37:35.758399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:35.864689Z","title":"A dual active-set solver for embedded quadratic programming using recursive LDLT updates,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:35.864689Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:9afa2c4543735271d793e36ff9429a1941b07667d8469a1fb6036283c3855af3","observation_id":"dbcb85a8-deeb-4079-ad47-437f59cc2fbd","resolution":{"observed_at":"2026-07-31T23:37:35.864689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:35.969132Z","title":"The quickhull algorithm for convex hulls,","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:35.969132Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:ea00dab0621a068e30d3f3cb32414ce1c932773c578bf3aba1c9bf0f5888ece9","observation_id":"0c4d4ae2-e3d9-4973-9959-f07a4212bad0","resolution":{"observed_at":"2026-07-31T23:37:35.969132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:36.149058Z","title":"qpsolvers: Quadratic Programming Solvers in Python,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:36.149058Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:7f24310859ab48cc2ae03108033aaec3a5bffb81864b7741e901079eaecd7e89","observation_id":"d3798944-2005-4f09-8aaf-615665ba63ba","resolution":{"observed_at":"2026-07-31T23:37:36.149058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:36.255041Z","title":"Universal value function approximators,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:36.255041Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:22e813cf4714394f051cbe5b1e505e9b9d69afc8fddaf24bebe712a6fadb6750","observation_id":"e354d531-deb3-4713-a0d7-cd672119eaa6","resolution":{"observed_at":"2026-07-31T23:37:36.255041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:36.406654Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:36.406654Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:c7bc4d58ed62c6000e9627e8c78d9e7c8eda2ff28297620f6f6ee5199ed701bf","observation_id":"b0edaec6-b428-47ec-88d4-f6b98f80ca07","resolution":{"observed_at":"2026-07-31T23:37:36.406654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:36.599805Z","title":"Bigger, regularized, optimistic: scaling for compute and sample efficient continuous control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:36.599805Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:a293ed93d748779d082f24f6c5c5035e087dc648799922b69f0151681653c2f3","observation_id":"a428e23b-fd8e-4153-9bb4-a24cada78010","resolution":{"observed_at":"2026-07-31T23:37:36.599805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15280","last_updated":"2025-05-29T14:58:32Z","snapshot_observed_at":"2026-08-07T17:59:24.158127Z","submitted_at":"2025-02-21T08:17:24Z","title":"Hyperspherical Normalization for Scalable Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15280","snapshot_observed_at":"2026-07-31T23:37:36.767776Z","title":"Hyperspherical normalization for scalable deep reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:36.767776Z"},"links":{"cited_paper":"/paper/2502.15280","citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:65ca9b819fcde7c7a79d58fdaed0e9f1ec43d2347249eacff7f276d5440edae2","observation_id":"dfa1387d-f957-4d8f-83a9-a6d4ab728197","resolution":{"observed_at":"2026-07-31T23:37:36.767776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:36.926027Z","title":"Intrinsic benefits of categorical distributional loss: Uncertainty-aware regularized exploration in reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:36.926027Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:a7cb3d8c92401b961b72bbe6211acfc4ac1b4eb9462af89c5be44c142c85e32c","observation_id":"26477c0f-64cb-4794-9149-74b4750d8c87","resolution":{"observed_at":"2026-07-31T23:37:36.926027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:37.066334Z","title":"Stop regressing: Training value functions via classification for scalable deep rl,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:37.066334Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:aca9c7b791148d6eded73ea7f35c943501d10857e63c4c27487e91bdf638fa4b","observation_id":"de07e80b-b6bc-4cea-b686-71e975f28dd5","resolution":{"observed_at":"2026-07-31T23:37:37.066334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:37:37.171131Z","title":"1000 layer networks for self-supervised rl: Scaling depth can enable new goal-reaching capabilities,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-31T23:37:37.171131Z"},"links":{"citing_paper":"/paper/2607.23930"},"observation_digest":"sha256:bc90e0b1e55a6d844b92191bab065bde0625e6049fdf4963878ccab04f8a8738","observation_id":"59e03b47-68e1-4557-96d0-3058cc643644","resolution":{"observed_at":"2026-07-31T23:37:37.171131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23930","last_updated":"2026-07-27T02:01:14Z","latest_version":1,"primary_category":"eess.SY","snapshot_observed_at":"2026-08-04T10:27:24.241702Z","submitted_at":"2026-07-27T02:01:14Z","title":"Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2607.23930."}