{"as_of":"2026-08-17T12:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83f6d0a0415c4f64b7c8558effe26a9a959a803d9f74494c2c56202440a8e3e8","coverage":[{"denominator":99,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":99,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:35:49.596258Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T22:56:33.073457Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T22:58:23.930563Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"cited_work":{"arxiv_id":"2504.15425","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15425","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solving multi-agent safe optimal control with distributed epigraph form marl","venue":null,"work_id":"e3a5084e-ba48-4deb-a8ab-b7469aa47d54","year":2025},"citing_paper":{"arxiv_id":"2604.00429","last_updated":"2026-04-12T23:45:52Z","snapshot_observed_at":"2026-08-13T07:35:24.678231Z","submitted_at":"2026-04-01T03:15:49Z","title":"Distributed Safety-Critical Control of Multi-Agent Systems with Time-Varying Communication Topologies","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T22:56:33.073457Z"},"links":{"cited_paper":"/paper/2504.15425","citing_paper":"/paper/2604.00429"},"observation_digest":"sha256:fe3e6fde857be0e7517b18c4949bdb7259f11dbee4dce49a802f6981e44b70d3","observation_id":"e8d1989e-45f5-44b0-bf8c-d9b029676de5","resolution":{"observed_at":"2026-05-13T22:58:23.933705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.15425/citation-record","integrity":"/paper/2504.15425/integrity","json":"/paper/2504.15425/citation-record.json","paper":"/paper/2504.15425"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.100505Z","title":"Constrained policy optimization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.100505Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d252c26344163f29c6651c5dcba97b745f365e5e74e181642a2762e31ba9e1e1","observation_id":"021ed894-e2a8-4fad-af50-233bc9b42bc9","resolution":{"observed_at":"2026-08-16T11:35:49.100505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.105943Z","title":"Learning transferable cooperative be- havior in multi-agent team","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.105943Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:ed027b860301e5e5b13afca74ab3bfdc168d232a204cd5ff7d2cb244d4b6222b","observation_id":"3f762109-487a-40e7-a875-1da5a0add65d","resolution":{"observed_at":"2026-08-16T11:35:49.105943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.111335Z","title":"Constrained Markov decision processes","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.111335Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e1f1bb8514499bec59b9bec81c1d734869821009b32474dd10a70cb9c9d854d2","observation_id":"f011d933-34b0-4ec8-956f-40751c62e234","resolution":{"observed_at":"2026-08-16T11:35:49.111335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.116234Z","title":"Casadi: a software framework for nonlinear optimization and optimal con- trol","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.116234Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:3605eb0fc22e5edb2b384873818941b70e05c40fcce1d20092ceff4fc2eb70c4","observation_id":"bddfa60f-aab9-4940-a474-151512c7062a","resolution":{"observed_at":"2026-08-16T11:35:49.116234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.121126Z","title":"Hamilton-jacobi reachability: A brief overview and recent advances","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.121126Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:fc37d29c60475e6d29e9a1b3b18d570b1c17f664578b16c838ad04abfb2102c7","observation_id":"ba6db136-ebf3-4e72-8c1b-16766ba2e162","resolution":{"observed_at":"2026-08-16T11:35:49.121126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.125942Z","title":"Dynamic programming and optimal control: Volume I, volume 4","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.125942Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5667976b69d335126857dff161f7b6c706fb7222f4050860ce5922355e5decd5","observation_id":"66e5c626-3936-4ea5-98fb-f527b5901967","resolution":{"observed_at":"2026-08-16T11:35:49.125942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.131262Z","title":"Synthesis of minimum-cost shields for multi-agent systems","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.131262Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:9100e606d093db257cf5afec31f730a2236186098c1ed9ad23d5addaa04c3d22","observation_id":"647f9e09-641c-4aa1-b5cb-6078b0a34493","resolution":{"observed_at":"2026-08-16T11:35:49.131262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.136145Z","title":"An actor-critic algorithm for constrained markov decision processes","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.136145Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e635faa268484a275ab4a81d9c05c99f9332d768c0c3624e5e127456982a301a","observation_id":"01d8c8e2-5ed1-4d53-b4da-b702c9846195","resolution":{"observed_at":"2026-08-16T11:35:49.136145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.141464Z","title":"Stochastic Approximation: A Dynamical Systems Viewpoint, volume 48","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.141464Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0057551c45291a9893430b5496c0083c0fd094ec0593a41f76e9c472ae7abe19","observation_id":"387cca71-61aa-4619-9945-16a5dd173f73","resolution":{"observed_at":"2026-08-16T11:35:49.141464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.146263Z","title":"Convex optimization","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.146263Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:1b819479d1be03b4bd6834a4be33356ceee9afee32b76e2969e3edd02d1b6c00","observation_id":"f2eede24-1a56-4d49-8870-c9075d9289b3","resolution":{"observed_at":"2026-08-16T11:35:49.146263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.12553","last_updated":"2021-03-23T13:54:21Z","snapshot_observed_at":"2026-08-17T01:53:23.152402Z","submitted_at":"2021-03-23T13:54:21Z","title":"Safe Multi-Agent Reinforcement Learning through Decentralized Multiple Control Barrier Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.12553","snapshot_observed_at":"2026-08-16T11:35:49.151496Z","title":"Safe multi-agent reinforcement learning through decentralized multiple control barrier functions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.151496Z"},"links":{"cited_paper":"/paper/2103.12553","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e3ef3900d650bcbbe94c3030de3f23b110cea3f966c8dbd46879bdf1aa48d3f5","observation_id":"b3dae811-fdde-4419-b16c-879328c11f8f","resolution":{"observed_at":"2026-08-16T11:35:49.151496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.156876Z","title":"A new hybrid quadratic/bisection algorithm for finding the zero of a nonlinear function without using derivatives","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.156876Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:67011cd3ba72930a960909c0332dbd5ef4dc65bff0f7fb7696ad026d387324eb","observation_id":"47be9f9e-05d5-44dd-8c33-ac89b9305b93","resolution":{"observed_at":"2026-08-16T11:35:49.156876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.161771Z","title":"Socially aware motion planning with deep re- inforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.161771Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:b326335c504771c6a2151f547be1446870469e58e9a592f25756e47273cfc72a","observation_id":"1182b6e9-eee5-4d80-9d2c-bf4c05b5cc3c","resolution":{"observed_at":"2026-08-16T11:35:49.161771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.166199Z","title":"Decentralized non-communicating multiagent col- lision avoidance with deep reinforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.166199Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c7561c252c62fb6bc9d277a55eac59cca8bc7c1beed42c2471499accb44f7130","observation_id":"4924cc63-5136-465e-8dee-b868114ab8ec","resolution":{"observed_at":"2026-08-16T11:35:49.166199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.170705Z","title":"On the duality gap of constrained cooperative multi-agent reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.170705Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:3a679b69fab7f4cc0d5b4fb219ca66cf198d86ef887d061523ab3e2b631a1fd6","observation_id":"2986275c-4cda-40fe-b0ac-f6f90ac66d74","resolution":{"observed_at":"2026-08-16T11:35:49.170705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.175559Z","title":"Computational aspects of distributed optimization in model predictive control","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.175559Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:47729d23e4d73fe0dfe9f72d988737d080f5413a2d1a8358fa079d418b1f131c","observation_id":"dfd586fa-ea56-4f86-b855-92705b94571f","resolution":{"observed_at":"2026-08-16T11:35:49.175559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.180383Z","title":"De- tecting, localizing, and tracking an unknown number of moving targets using a team of mobile robots","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.180383Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c2716b5e744a7bf23752390fcb66ecc5a2a2c87596041705d89b6c3c682064f6","observation_id":"e1c51361-7511-40ce-b559-ece92db3f9bd","resolution":{"observed_at":"2026-08-16T11:35:49.180383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.185205Z","title":"Provably efficient gener- alized lagrangian policy optimization for safe multi-agent reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.185205Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:85cd3e034fbe88e82454127ab68211a113a9f2d25df1fd1b64c13fc4a5219703","observation_id":"357a9e3c-ec56-4522-860a-ca97b7967865","resolution":{"observed_at":"2026-08-16T11:35:49.185205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.11196","last_updated":"2021-02-02T18:30:53Z","snapshot_observed_at":"2026-08-16T18:49:44.304654Z","submitted_at":"2021-01-27T04:27:06Z","title":"Safe Multi-Agent Reinforcement Learning via Shielding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.11196","snapshot_observed_at":"2026-08-16T11:35:49.190136Z","title":"Safe multi-agent reinforcement learning via shielding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.190136Z"},"links":{"cited_paper":"/paper/2101.11196","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:dfc29ead2c7974a3e13ca1f8b9c8466c56ec4b5d1fed443de3881a474e295cb1","observation_id":"81d691fe-8670-41e6-b37e-f155dddd9993","resolution":{"observed_at":"2026-08-16T11:35:49.190136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.194900Z","title":"Safe multi- agent reinforcement learning via shielding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.194900Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:edd9cad656325432509b9faa49516a477acbe9d451b1243d00b717e3bdd02524","observation_id":"e0024367-a868-409e-8988-6a3c1dbe99a2","resolution":{"observed_at":"2026-08-16T11:35:49.194900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.199462Z","title":"Mo- tion planning among dynamic, decision-making agents with deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.199462Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:91e66e2993144a6c1d0bba8d4e88210e41a98fc498a016f558796b74cddddbe6","observation_id":"5101e1bb-d11f-46c4-b075-44e424cad64b","resolution":{"observed_at":"2026-08-16T11:35:49.199462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.955434Z","title":"A distributed model predictive control strategy for constrained multi- agent systems: The uncertain target capturing scenario","venue":null,"work_id":"b0fcd561-1333-4ef0-b0b0-f9113b20fe6f","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.203864Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5c4e6db9909a36c26e5366b122beaee6df81587ddb3e75b40a65c7b624a26eac","observation_id":"a2625dc9-4098-48a1-a000-2456fb48fdf1","resolution":{"observed_at":"2026-08-16T11:35:50.960217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.939055Z","title":"Counterfactual multi-agent policy gradients","venue":null,"work_id":"81a6d375-e9da-42c8-ada3-e6c1f249683b","year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.208585Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:638e71d39be280d78619d0c7573be386585d90caeb3f9c5e816710ee9b36e663","observation_id":"a37f3fec-48f4-496b-9e91-42bd4d4dca69","resolution":{"observed_at":"2026-08-16T11:35:50.944198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.213377Z","title":"Iterative reachability estimation for safe reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.213377Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d9097eaa0800e63826f1ccf4a0cfaf1769db1271707117c6ed8433cad58c1691","observation_id":"a36e666d-7a33-4222-aba9-4073d813675b","resolution":{"observed_at":"2026-08-16T11:35:49.213377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.911026Z","title":"Learning safe control for multi- robot systems: Methods, verification, and open chal- lenges","venue":null,"work_id":"dfb644d2-c9b4-494c-8280-5692390b34c0","year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.218177Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d2f0c045061d45b79e7fc83f4d46798e4fd2e858eed7b1618b2d7b09f9ba8932","observation_id":"3ca00963-31c1-42f3-99d1-b440454e11c5","resolution":{"observed_at":"2026-08-16T11:35:50.916330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.893666Z","title":"A reinforce- ment learning framework for vehicular network routing under peak and average constraints","venue":null,"work_id":"5963e79d-2ef8-4db0-86f1-5569428db8fa","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.222823Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:6c6fbac0930a9fdf39667da0261724cfd04636b1854f6cfd9a3ae0a80ee1a9f4","observation_id":"2e19ab2a-784e-41e9-9806-908398d7a7fc","resolution":{"observed_at":"2026-08-16T11:35:50.899242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.877036Z","title":"Crazyflie 2.0 quadrotor as a platform for research and education in robotics and control engineering","venue":null,"work_id":"cc98aaa4-0956-4a0e-8ac4-94f8aa84e00c","year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.228778Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:3f7f3c6f3f478768e4cd404341b815ae406ebcac7dbe85af8bb404e0b030ef63","observation_id":"7e679174-932b-4bb9-9733-7274dc2c81d5","resolution":{"observed_at":"2026-08-16T11:35:50.882587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.234123Z","title":"Snopt: An sqp algorithm for large-scale constrained optimization","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.234123Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:95ca8a6e9716484691dd1d88ee3b7b1e901140a3edbd1dce4fcda1466c981531","observation_id":"6f6e2a00-a966-4689-a670-3e1230b068cd","resolution":{"observed_at":"2026-08-16T11:35:49.234123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.847438Z","title":"Nonlinear model predictive control: theory and algorithms","venue":null,"work_id":"f96afe2d-e0a4-4321-8ed9-df460fed257f","year":2013},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.239025Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c93788afa87b358327b9a043c5eaef01df963f48f1b09017b7cf28f99b3ff748","observation_id":"c7c38f09-8592-41a2-b2e7-97f7db9891a4","resolution":{"observed_at":"2026-08-16T11:35:50.853203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02793","last_updated":"2022-02-10T07:08:47Z","snapshot_observed_at":"2026-08-16T17:51:26.635412Z","submitted_at":"2021-10-06T14:17:09Z","title":"Multi-Agent Constrained Policy Optimisation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02793","snapshot_observed_at":"2026-08-16T11:35:49.243705Z","title":"Multi-agent constrained policy optimisation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.243705Z"},"links":{"cited_paper":"/paper/2110.02793","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e183acbf46b8e4d1438bc69ec4b520c1b17f486921a3df547a141045ebf13abf","observation_id":"cd1c5b7b-32eb-4073-a64f-0fea3ec9c907","resolution":{"observed_at":"2026-08-16T11:35:49.243705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-16T16:58:50.532049Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-16T11:35:49.248824Z","title":"A review of safe reinforcement learning: Methods, theory and applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.248824Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d4e9bacff836c54bcb6f5085a65bd5e3b02b8cb4ff9a2ee7986f2b2ae9efc19c","observation_id":"75bcca73-1d38-4d39-b5ae-6474eddf8218","resolution":{"observed_at":"2026-08-16T11:35:49.248824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.827715Z","title":"Safe multi-agent reinforcement learning for multi-robot control","venue":null,"work_id":"3073c058-db53-491e-bfb4-69c453b7ae8d","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.253790Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:8a36577623c721280f55ac365062115adb1d8cfd164f6b485e5389bd120298cc","observation_id":"df65dcad-5e97-4d33-84b7-8389674db06d","resolution":{"observed_at":"2026-08-16T11:35:50.834594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.811968Z","title":"Coordinated reinforcement learning","venue":null,"work_id":"817460c9-78ac-4578-b8f0-cbf4580503c3","year":2002},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.258380Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:1a035fc139a59ca58d7e5d45a977067fc1ec58b9aec86f640816982eaaf0c3a1","observation_id":"7fe7dc21-ca19-41c5-a1c5-f1443941b0a2","resolution":{"observed_at":"2026-08-16T11:35:50.816795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.794691Z","title":"Deep recurrent q-learning for partially observable mdps","venue":null,"work_id":"a92a6803-7339-4de3-87d7-0171f624ad0e","year":2015},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.263244Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:83b249dfdcb3cd2156ae591c14ac83d69252b2ae8904ca8d7cf83dde97252666","observation_id":"bce72a09-d609-4b10-9671-4cce7b9d10ed","resolution":{"observed_at":"2026-08-16T11:35:50.800028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.777800Z","title":"Autocost: Evolving intrinsic cost for zero-violation reinforcement learning","venue":null,"work_id":"fb31fa0a-4921-4185-ac30-9a7366b7ae27","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.269034Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:3667270ef617cb2fd747ef67f68297d26f142463a828898c05c04f1148fedf72","observation_id":"efc781f4-8330-4f9e-8ab0-b0fa59a789d6","resolution":{"observed_at":"2026-08-16T11:35:50.782922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.759631Z","title":"Safedreamer: Safe reinforcement learning with world models","venue":null,"work_id":"2275e54a-3d34-453c-9c59-42698e0c624c","year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.273968Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:eb124122a97f9dfc3aac0e2e24eab1c16d3986cfe42efd99fd9ab76aa86ac82d","observation_id":"60b7bea2-7cf5-4183-ab78-6e180f5141a5","resolution":{"observed_at":"2026-08-16T11:35:50.765390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.741260Z","title":"Distributed optimization in multi-agent robotics for industry 4.0 warehouses","venue":null,"work_id":"bbd89a06-820f-423e-86af-5c66fb4116f5","year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.280957Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f6e11f46c3d3b92793807789ddd527a5ad2238286dd14ef01635c54e3b714138","observation_id":"bcef9d51-07e5-449c-8798-89fdffd4bdb4","resolution":{"observed_at":"2026-08-16T11:35:50.747003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.721350Z","title":"Cmix: Deep multi- agent reinforcement learning with peak and average con- straints","venue":null,"work_id":"33a3ad4b-10bc-4021-adfa-f4885d5dae6f","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.286188Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:76d4f375e9af1299d623f131f2152ff46b2c027d14631fe33ec1b1fecf2091ec","observation_id":"ea097793-3e3b-4905-be52-a3a255c5c929","resolution":{"observed_at":"2026-08-16T11:35:50.728160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.699802Z","title":"Towards optimally decentralized multi-robot collision avoidance via deep reinforcement learning","venue":null,"work_id":"dfd5090e-ef92-4017-a201-877fc08b9e3a","year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.290715Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c05622f137d7295a49713122bd409370ba787d64504e31a865fa355805587edc","observation_id":"1406ba9c-9992-4145-9e9c-3710efa7d9fc","resolution":{"observed_at":"2026-08-16T11:35:50.705889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.682371Z","title":"Multi-agent actor- critic for mixed cooperative-competitive environments","venue":null,"work_id":"43ecf879-347d-4d96-b99f-81d47790ffa7","year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.295450Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:59a2417e808f0e833270411be1359772bb645f5c973f1b7431bd6052fb893dae","observation_id":"08f7fcea-19d9-480d-a403-5c4ed1d81e61","resolution":{"observed_at":"2026-08-16T11:35:50.687627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.664994Z","title":"Decentralized policy gradient descent ascent for safe multi-agent reinforcement learning","venue":null,"work_id":"31d3e1ee-eaef-481c-a6c0-d50445d261b9","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.300993Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0ea131f9a5ada4a7f59a32be26c4b640d58c27505f96a51ce938ff5bb6dae91a","observation_id":"1ec2c0d6-124d-4e49-8d1c-7e4796f40a9c","resolution":{"observed_at":"2026-08-16T11:35:50.670639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.647773Z","title":"Trajectory generation for multiagent point-to-point transitions via distributed model predictive control","venue":null,"work_id":"a5c23dc2-c37a-4d87-86c8-15bdb00803ab","year":2019},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.306462Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:73e5b46156de129d2a93c14afdea3c4d72867cef2708e1e2e7988d016f094712","observation_id":"37f2e7e6-78ba-46cb-8ac7-34d294efe1ca","resolution":{"observed_at":"2026-08-16T11:35:50.653222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.629210Z","title":"Online trajectory generation with distributed model predictive control for multi-robot motion planning","venue":null,"work_id":"c3fcc92d-c32f-486f-b9fe-d77aa07679a3","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.311335Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f89c7455c0e688a30a03238512e900664db53c91094ceeb779b304f4c68b5f7b","observation_id":"94b03caa-0cb1-4e78-8c51-3b1b3280dc16","resolution":{"observed_at":"2026-08-16T11:35:50.634565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.316420Z","title":"On reachability and minimum cost optimal control","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.316420Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:a5be2abcd4fb366f7e0157298e32c5d0976511fc5b27a8c909e04f6fd05af856","observation_id":"3d62944b-59f5-43d1-a914-1388f859acdf","resolution":{"observed_at":"2026-08-16T11:35:49.316420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.10868","last_updated":"2017-05-30T21:08:16Z","snapshot_observed_at":"2026-08-14T20:57:08.544504Z","submitted_at":"2017-05-30T21:08:16Z","title":"Lifelong Multi-Agent Path Finding for Online Pickup and Delivery Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.10868","snapshot_observed_at":"2026-08-16T11:35:49.321247Z","title":"Lifelong multi-agent path finding for online pickup and delivery tasks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.321247Z"},"links":{"cited_paper":"/paper/1705.10868","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:6012279fc0cece438fc802e3b1f5091ed9fd850172e1f09abe7baee6de6abe0b","observation_id":"a67092fb-f45b-4168-8ce2-1c802594f8d9","resolution":{"observed_at":"2026-08-16T11:35:49.321247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.599724Z","title":"Hamilton–jacobi formulation for reach–avoid differential games","venue":null,"work_id":"f9c677da-b627-49af-b7b0-11d29d35a416","year":2011},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.326900Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:67540d45a119764e8870a533d45a853a6099a00f6588d52d572b11df39e841ca","observation_id":"93311ed5-1199-4c60-9bf5-029f404aa922","resolution":{"observed_at":"2026-08-16T11:35:50.605556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.582214Z","title":"Safe value functions","venue":null,"work_id":"2dbcd26b-a714-4b65-bca2-b58f17c5a558","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.331833Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:af7b2ad16952a893126d655bc7652d733ea4547ac1bff0af00907d13fc9b3a39","observation_id":"bfd02cfa-a22b-4953-be02-47eba0a8793a","resolution":{"observed_at":"2026-08-16T11:35:50.587653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.564698Z","title":"Shield decentralization for safe multi-agent reinforce- ment learning","venue":null,"work_id":"875abaf3-0d51-48e1-ac22-1c6afdf07c6a","year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.337215Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5cdbd2a693772fa662cbf16ccf183d342023dfd60c5a33ceab28bbe639132ed4","observation_id":"bc854208-b398-4db6-beec-579021b599d8","resolution":{"observed_at":"2026-08-16T11:35:50.570150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.342067Z","title":"A time-dependent hamilton-jacobi formulation of reachable sets for continuous dynamic games","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.342067Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:24bdb714dedce8a33de6a041c1de0e0762c7b909a5064dc0fb591f33a1378e5e","observation_id":"140a3280-0ba2-4594-8868-3c5926e56dfd","resolution":{"observed_at":"2026-08-16T11:35:49.342067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.535216Z","title":"Distributed model predictive safety certification for learning-based control","venue":null,"work_id":"335a46fe-3d2f-4424-827b-fd4baa4d3e2f","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.346763Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:de80e8703f219bf1435cd851f27799a43a9c16aeccbdfb4bcac0bf428c09826b","observation_id":"e0fec4a7-ff8b-4d82-a8bc-93d754141da9","resolution":{"observed_at":"2026-08-16T11:35:50.540428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.518601Z","title":"Scalable multi-agent reinforcement learning through intelligent information aggregation","venue":null,"work_id":"0ee21788-c497-43ba-b1fc-ff4dfe373af2","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.351927Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f18fdc24db59b73bc502e90a60866b524d70d3ed5ee37d0d514d7295623ba999","observation_id":"2f02698a-e874-44db-974c-e81feffb43b8","resolution":{"observed_at":"2026-08-16T11:35:50.523861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.500702Z","title":"Distributed optimization for control","venue":null,"work_id":"0b846216-2aef-4090-9535-90798214df3d","year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.356555Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:37618ebcbb5886d21bf1ae081ad1b4738b2d60aaecfbcd9c4858d26e9c16c583","observation_id":"fd4865da-e1d0-4b21-a8d3-347e590770d3","resolution":{"observed_at":"2026-08-16T11:35:50.506329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.361981Z","title":"Numerical opti- mization","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.361981Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e527ae701a2b43432259db6d482b5ffa0e1432a9f342039d961404c2f7824230","observation_id":"a9691ad1-2670-49cf-b45e-2c22cdba0e9c","resolution":{"observed_at":"2026-08-16T11:35:49.361981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.474048Z","title":"Facmac: Factored multi- agent centralised policy gradients","venue":null,"work_id":"10d8b399-87af-4bd0-a32a-f890f2ab3e03","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.366973Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:29c6a9f15f6e226caea4ca7e9f94233ad756599b0d54d76c9b5fd5ace854b095","observation_id":"13192686-87fe-4a3b-9a5c-6f1a74d3a50f","resolution":{"observed_at":"2026-08-16T11:35:50.479369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10658","last_updated":"2022-06-07T20:30:04Z","snapshot_observed_at":"2026-08-16T17:19:38.234420Z","submitted_at":"2022-02-22T03:57:23Z","title":"Decentralized Safe Multi-agent Stochastic Optimal Control using Deep FBSDEs and ADMM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10658","snapshot_observed_at":"2026-08-16T11:35:49.372051Z","title":"Decentralized safe multi- agent stochastic optimal control using deep fbsdes and admm","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.372051Z"},"links":{"cited_paper":"/paper/2202.10658","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:97d5c817dc1777e159ee19bb662c0f17f29477d9a360123acbae1be0cad875b6","observation_id":"21340052-cdf4-4616-b3b5-61c0855e9881","resolution":{"observed_at":"2026-08-16T11:35:49.372051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.457520Z","title":"Learning safe multi-agent control with decentralized neural barrier certificates","venue":null,"work_id":"1d49f7c1-f829-4eec-9620-acb1fff295df","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.377313Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:7f34964b15fab4f29a6399acde3c1f0cea6564aa2278a1219ece1ff91b76eeac","observation_id":"aabf5350-5c2b-4d98-8168-1bd78439b3fb","resolution":{"observed_at":"2026-08-16T11:35:50.462917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.441444Z","title":"Weighted qmix: Expanding monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":"ed64febe-721b-4fd3-9b0b-841691a56c0b","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.382001Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d8116f53d6136e172ec4348f7127578c62868ca8f017163c86692b64dbce1389","observation_id":"f2d235d6-6442-4c49-b465-007add8b0b91","resolution":{"observed_at":"2026-08-16T11:35:50.446467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.425329Z","title":"Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":"843ff2e0-9a81-47d2-aa3e-ca8fa3452ccb","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.386675Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:2b929671091e0064b545dfbdbb39eb60ceb9b315c73bec22ed004a3a15cb7f5c","observation_id":"9146e6a4-38c0-47b9-b853-b50494f6c11c","resolution":{"observed_at":"2026-08-16T11:35:50.430474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.409343Z","title":"A stochastic approx- imation method","venue":null,"work_id":"f9c12aca-c737-424f-9d74-47cccfc6899d","year":1951},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.391565Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d25df7e32acc8aa961fe33e2c1137673939bee019cc259a8a37cc5c9f6192a5f","observation_id":"bd3fb1fe-ecc5-4994-8921-57747eb556e1","resolution":{"observed_at":"2026-08-16T11:35:50.414429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.392837Z","title":"Con- strained markov decision processes via backward value functions","venue":null,"work_id":"4d45caa7-c20e-45e2-8214-c0326b0a860f","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.396466Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:3769f9db9e75ae454d1479697560e76bc7cf6ae9765c62fc6d0e80b9170f047f","observation_id":"3c9c3079-afe6-4d49-845b-79ebf0a70db0","resolution":{"observed_at":"2026-08-16T11:35:50.398173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.375701Z","title":"Trust region policy optimiza- tion","venue":null,"work_id":"4a12bc7c-3f4c-4688-b115-83eeaffd6a36","year":2015},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.401269Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0beb9e08e11ea680f9e92fbf536c4b3872d66b1bfda6904378e464abb0e230ad","observation_id":"d6075347-e324-4dba-8847-a101ca763e47","resolution":{"observed_at":"2026-08-16T11:35:50.381182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-15T05:06:05.489107Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-16T11:35:49.405908Z","title":"High-dimensional continuous control using generalized advantage estimation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.405908Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f6365b7fe3254b50b05f88fd23f2204420fde090f77eddb09b2d084d6f438eda","observation_id":"3b10c4ad-aecd-42e6-93e6-5b509e001dc4","resolution":{"observed_at":"2026-08-16T11:35:49.405908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T11:35:49.411092Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.411092Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:61509e8010eb60e4d1d38cad97b9bbe3b8422d52af646490a83eea6f5909854b","observation_id":"fee63235-7e9a-4da2-a553-945bc6e6ac5b","resolution":{"observed_at":"2026-08-16T11:35:49.411092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.358411Z","title":"Multi-agent motion planning for dense and dynamic environments via deep reinforcement learning","venue":null,"work_id":"887fc0d9-6856-492a-87b1-e8aa67ad5bcf","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.415932Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:83eac5977181c9ff6562240de154f26f860ec66939ad832495cb2e9f2783a828","observation_id":"3adb61f4-599e-4493-8fef-ffab520f8d3c","resolution":{"observed_at":"2026-08-16T11:35:50.363450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03509","last_updated":"2021-05-10T02:23:20Z","snapshot_observed_at":"2026-08-11T19:52:55.524234Z","submitted_at":"2020-09-08T04:04:04Z","title":"Masked Label Prediction: Unified Message Passing Model for Semi-Supervised Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03509","snapshot_observed_at":"2026-08-16T11:35:49.420858Z","title":"Masked label predic- tion: Unified message passing model for semi-supervised classification","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.420858Z"},"links":{"cited_paper":"/paper/2009.03509","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c7a014dc86d5de1bcf4bebafd0c5ba349032f7c38ccbcbe378deb860d46bbee4","observation_id":"41fad7e6-d630-4b0c-ba21-c3394c99f9dd","resolution":{"observed_at":"2026-08-16T11:35:49.420858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.341992Z","title":"Solving stabilize-avoid optimal control via epigraph form and deep reinforce- ment learning","venue":null,"work_id":"f37d5a52-71c3-479e-b00c-ea91c9db4613","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.426325Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:380c9817f8ec8cd8eecacd3e477fbb507c18890c734cd6fd60c2ad871105a2dc","observation_id":"1309f659-a663-49a7-8ca9-119b5083d7bb","resolution":{"observed_at":"2026-08-16T11:35:50.347386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.325666Z","title":"Solving minimum-cost reach avoid using reinforcement learning","venue":null,"work_id":"806d021e-2fbf-4857-94f6-f7c09d688c17","year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.431478Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f6c106d6dfdca9ee599f65cdc8b795cb09ed249314aa3defe0d80a6e55c81408","observation_id":"29aebdd6-f22a-4bed-ab12-78370cd16582","resolution":{"observed_at":"2026-08-16T11:35:50.330772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.306265Z","title":"Predictive control of aerial swarms in cluttered environ- ments","venue":null,"work_id":"77ac596f-959c-4d6d-9426-039d1934f57c","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.436382Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:403e90ad6c2dfa14f86d79b9299c98cb5ef1afcc2fc39249227aae4929101084","observation_id":"bf9028ad-636b-40e7-baee-5aa78a81ff94","resolution":{"observed_at":"2026-08-16T11:35:50.311938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-08-14T20:53:35.783079Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-16T11:35:49.441863Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.441863Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5ad4efcd0692cce1484f10c2911e7515f972e7f8492c7fd41e16d38e69a5a7de","observation_id":"1926dfd9-129d-44d3-9ebb-4915cc2c9790","resolution":{"observed_at":"2026-08-16T11:35:49.441863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.288705Z","title":"Mankowitz, and Shie Mannor","venue":null,"work_id":"4c0fac26-4f0a-4df0-abae-b5af9d8dfbd4","year":2019},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.447051Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:dca77d0cbbad2df05962a1db27b617244474f8e10eb6f07b733b6a5bac867b67","observation_id":"54313299-44bc-4c9e-ba05-01afdf70c610","resolution":{"observed_at":"2026-08-16T11:35:50.293658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.271465Z","title":"A game theoretic approach to controller design for hybrid systems","venue":null,"work_id":"951fe303-4d77-4f4b-8704-a6cf7d11e39a","year":2000},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.452061Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:be5ed07cccc1d94dd8cf1fa5dac86d26cf056b26d52e2222f4166aebc842606e","observation_id":"1522d750-8cc9-46c0-92a8-36bb1816632f","resolution":{"observed_at":"2026-08-16T11:35:50.276454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.255083Z","title":"Decentralized multi-agent planning using model predictive control and time-aware safe corridors","venue":null,"work_id":"d1548c7d-cf2a-4433-a936-f61b0e15fc50","year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.456929Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:422fe75b1760cab1d2590d28b4d823394e23e864d922d11704aceb7bd416a505","observation_id":"fcfdc6fa-dcc9-44db-82af-7ef417761499","resolution":{"observed_at":"2026-08-16T11:35:50.260275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.236685Z","title":"Initial guess generation for aircraft landing trajec- tory optimization","venue":null,"work_id":"10ffb2c3-f88f-4079-89d5-c98e1b131f6a","year":2011},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.461859Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:a4a46d6f78ae7810c4bfa025ddbffb595caefc953ca2a2258d8267a2acf4ab10","observation_id":"f2d69c81-cba1-4274-9b0a-19aa5399a1d1","resolution":{"observed_at":"2026-08-16T11:35:50.241930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.01062","last_updated":"2021-10-04T01:36:59Z","snapshot_observed_at":"2026-08-13T21:57:18.537825Z","submitted_at":"2020-08-03T17:52:09Z","title":"QPLEX: Duplex Dueling Multi-Agent Q-Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.01062","snapshot_observed_at":"2026-08-16T11:35:49.466812Z","title":"Qplex: Duplex dueling multi-agent q- learning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.466812Z"},"links":{"cited_paper":"/paper/2008.01062","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:237ca22a567de8b07c66da22535e276e16999f70b4fa7157435e1535692a3dc5","observation_id":"85c5ed1a-92ab-48d1-ad9b-02b126e0355f","resolution":{"observed_at":"2026-08-16T11:35:49.466812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.220131Z","title":"A synthesis approach of distributed model predictive control for homogeneous multi-agent system with collision avoidance","venue":null,"work_id":"3beeb956-d082-4c02-adc8-49a96821566d","year":2014},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.472565Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:a5df1d07c8a1e2f8f468bfd872880f2aa91944249d8cdde2ae61b3180cef267f","observation_id":"587b983f-2f82-460d-b4f8-21478fb37347","resolution":{"observed_at":"2026-08-16T11:35:50.225310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.478723Z","title":"Multi-agent deep reinforcement learning for urban traffic light control in vehicular networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.478723Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:11756db00305e7bd42bc7e235caeb7d4f8a05bfd8ebeb4d70952526008782643","observation_id":"04916c6e-b7d6-41bc-be07-e2a7093bf891","resolution":{"observed_at":"2026-08-16T11:35:49.478723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06281","last_updated":"2023-04-13T06:08:10Z","snapshot_observed_at":"2026-08-16T15:40:48.117157Z","submitted_at":"2023-04-13T06:08:10Z","title":"Model-based Dynamic Shielding for Safe and Efficient Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06281","snapshot_observed_at":"2026-08-16T11:35:49.483573Z","title":"Model-based dynamic shielding for safe and efficient multi-agent re- inforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.483573Z"},"links":{"cited_paper":"/paper/2304.06281","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:7240b7338aef9d4ebf7de0f436a35bbcd95c115454855e4615b740472e7cb1b6","observation_id":"abafd294-d515-4529-a413-1c0fd57fab81","resolution":{"observed_at":"2026-08-16T11:35:49.483573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.190505Z","title":"Crpo: A new approach for safe reinforcement learning with convergence guarantee","venue":null,"work_id":"ea6aca92-f147-4e36-aecd-4c4790949b1f","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.488687Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:7399a809158313eec54cd24e0226805567428abd83a693f1d4056ec03a2c1390","observation_id":"1f6914fa-a1f2-4d92-8206-66da2e5e14e4","resolution":{"observed_at":"2026-08-16T11:35:50.196643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03939","last_updated":"2020-06-09T05:20:11Z","snapshot_observed_at":"2026-08-16T05:24:45.162976Z","submitted_at":"2020-02-10T16:48:03Z","title":"Qatten: A General Framework for Cooperative Multiagent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03939","snapshot_observed_at":"2026-08-16T11:35:49.493384Z","title":"Qat- ten: A general framework for cooperative multiagent re- inforcement learning","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.493384Z"},"links":{"cited_paper":"/paper/2002.03939","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:1f87c26864d034159dd29cc11b178e439e79280b720d74221e4c58bdb09ef555","observation_id":"71321466-c55e-4511-a348-002b28d81941","resolution":{"observed_at":"2026-08-16T11:35:49.493384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.172630Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games","venue":null,"work_id":"3b7c621b-c02b-406c-90f0-408a0abc0a47","year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.499001Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f5359682baef5ae2c9eeac09076fec31eaa183fa8b6706cb47f934672afe22b6","observation_id":"69237a14-51b7-4de9-a903-c724df5cc2e1","resolution":{"observed_at":"2026-08-16T11:35:50.178088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.155717Z","title":"Reachability constrained reinforcement learning","venue":null,"work_id":"06fa3397-a8de-4ec8-bc81-a38d9c7f9f2f","year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.504513Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5d9cdba914a6f86de07097e2f74b9b0c6a8d22d803c1417c4be44924ae79d8cb","observation_id":"9095540a-b7ea-4b7b-9411-59b023a5f2e6","resolution":{"observed_at":"2026-08-16T11:35:50.161635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.137945Z","title":"Safe reinforcement learning using robust mpc","venue":null,"work_id":"989964eb-825a-4928-b675-bdafc927c3fa","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.509472Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0aa3859ac5674ca3dead17c417da031aeaac265b7d93a2c9758004783a0dc2b8","observation_id":"b2c0f567-268e-4b73-9e38-2d1f76ccf2b8","resolution":{"observed_at":"2026-08-16T11:35:50.143568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.118041Z","title":"Fully decentralized multi-agent re- inforcement learning with networked agents","venue":null,"work_id":"52c57e29-1cf1-4453-a1f8-e50523f8663e","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.514827Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5fe939722a844ce6d18758ccbb74ff622bdd0c1dd6c0e7453044085b44bda191","observation_id":"73060d35-0d38-480d-bfe0-fee0857b7def","resolution":{"observed_at":"2026-08-16T11:35:50.124360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.099771Z","title":"Multi- agent reinforcement learning: A selective overview of theories and algorithms","venue":null,"work_id":"695bb1ac-438a-43b0-8b21-82071eaed986","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.520678Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d381f6fb9bcbfdd5f0d996c4982c37b947ac42448dafa31a8180bf390c941d37","observation_id":"ffe68379-54e4-4d0b-a739-3bd8773eda9e","resolution":{"observed_at":"2026-08-16T11:35:50.105282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.083661Z","title":"Neu- ral graph control barrier functions guided distributed collision-avoidance multi-agent control","venue":null,"work_id":"97e98829-bc88-488f-8075-bfc268efaae0","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.525301Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:4e576e2059e7c62e981ac0bfc17f3783c394af5840efed3b0aaf78823b3e280b","observation_id":"6eb47d82-ce9b-450e-a34e-ae2cb5161338","resolution":{"observed_at":"2026-08-16T11:35:50.088952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.067182Z","title":"Discrete GCBF proximal policy optimization for multi-agent safe optimal control","venue":null,"work_id":"4d7fe1a1-52a2-47cd-8120-ad221db6fd9f","year":2025},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.530170Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:4a7badf5d18c7b80208b98d297ddd273691d9e9bd754a1fb11fe814b0c1aa867","observation_id":"cc55ae64-209c-4442-a094-ae8e0610b2d1","resolution":{"observed_at":"2026-08-16T11:35:50.072861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.050612Z","title":"GCBF+: A neural graph control barrier function framework for distributed safe multiagent control","venue":null,"work_id":"438f835b-d0d8-4878-97dc-b95100c0982e","year":2025},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.534940Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:311495278e9a2e10cac601329c56ef6b8132d88037b7c71d176f3064c66fd8f8","observation_id":"56eb93fb-3c0f-401d-b7cd-674dd7a7498e","resolution":{"observed_at":"2026-08-16T11:35:50.055969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.12639","last_updated":"2019-12-28T03:03:04Z","snapshot_observed_at":"2026-08-10T20:31:22.283484Z","submitted_at":"2019-10-25T01:26:04Z","title":"MAMPS: Safe Multi-Agent Reinforcement Learning via Model Predictive Shielding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.12639","snapshot_observed_at":"2026-08-16T11:35:49.539360Z","title":"Mamps: Safe multi-agent reinforcement learning via model pre- dictive shielding","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.539360Z"},"links":{"cited_paper":"/paper/1910.12639","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:a47d717cc223b126adaa1355add0e58112df1272c14aec418b2e897c233885c6","observation_id":"89e57848-5be3-4969-8f1a-b94fca74a625","resolution":{"observed_at":"2026-08-16T11:35:49.539360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.034944Z","title":"Model-free safe control for zero-violation reinforcement learning","venue":null,"work_id":"55c21faf-4d6b-4068-b2bf-0d39e5551e2e","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.544295Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:8e853a4a28b5459559246b8aa9eab49164d768b0a7e08c86354b2b19c0aec4c3","observation_id":"cc1d6b07-680b-41d2-9377-4f86753bcc21","resolution":{"observed_at":"2026-08-16T11:35:50.040156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.018455Z","title":"Multi-agent first order con- strained optimization in policy space","venue":null,"work_id":"5b358919-639a-4349-8618-e096a7884950","year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.549368Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:ffbf620fe220e40ee1e63d7825f3dc37c9d42ab536e1c49e1b3dc4bc5a8b757a","observation_id":"02e63a0a-c108-48df-95a8-786b32f80c81","resolution":{"observed_at":"2026-08-16T11:35:50.023762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.001794Z","title":"Fast, on-line collision avoidance for dynamic vehicles using buffered voronoi cells","venue":null,"work_id":"67735304-1d57-45d3-ad8a-09b8df94f1a0","year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.555561Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:fa073ac276dd9714c5d33bf0ac3a8bd16591350d1cfd57aad3e1f14f6f3290f7","observation_id":"c23fb004-13ae-4b79-bebd-59a7e5ab4f6f","resolution":{"observed_at":"2026-08-16T11:35:50.006851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.985143Z","title":"Trajectory optimization for nonlinear multi-agent systems using decentralized learning model predictive control","venue":null,"work_id":"7e021acc-0dab-4332-9885-a32fa231a013","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.560635Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:03ac4d7e6295efa6383ac87eb52aa3e0a3f687cd55de17bb186e62166fbc82b7","observation_id":"d8b0142c-0fc5-41ba-b1f1-3b1efdd930f5","resolution":{"observed_at":"2026-08-16T11:35:49.990352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.968016Z","title":"In other words, for a given z0, the value at the kth timestep is only a function of zk and xk instead of the z0 and the entire trajectory up to the kth timestep","venue":null,"work_id":"7a813b15-7166-4912-98dc-5ff87ac5d7e3","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.565966Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:2b725925f8bf8a7e815a03c26a59c0c1b3b960993ed4e7f69e4281bb5cd70b26","observation_id":"26b1b56b-96f7-4307-bc1d-b75711f7a03f","resolution":{"observed_at":"2026-08-16T11:35:49.972993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.950259Z","title":null,"venue":null,"work_id":"7f2fa280-0004-49d4-858c-9f19e4df252a","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.570731Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0fbf55a974377445c1b82067c5c435bf0fadee48f2a8dd08d933ed256ba74176","observation_id":"f0cdaa1e-0e66-4000-aae9-24dc084b845f","resolution":{"observed_at":"2026-08-16T11:35:49.955745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.933675Z","title":null,"venue":null,"work_id":"8fd1f0e5-4a32-43fd-aff7-9ebe6369387f","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.575826Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:277a81a2a8be701bcd7bbe516b237a07dba56f41559cb80fc1ed144193e4710d","observation_id":"6cffaff4-cbbf-4eac-8f7f-8c27fe1a09b2","resolution":{"observed_at":"2026-08-16T11:35:49.938382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.917831Z","title":null,"venue":null,"work_id":"027631a2-8526-41d5-8b23-fa3357dd5cdc","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.580801Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:11034a72edb62c14eaa4d16c73dce99d7f50c7f96b1731bef1ecbaffd7009955","observation_id":"53d0bdd6-665c-4045-a16d-ea6f6b03ab4d","resolution":{"observed_at":"2026-08-16T11:35:49.922510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.900945Z","title":"APPENDIX D ALGORITHM PSEUDOCODE We describe the centralized training process of Def-MARL in Algorithm 1 and the distributed execution process in Algorithm 2","venue":null,"work_id":"32797875-2f22-42a1-a246-cadc7f13d961","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.585636Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:4cf50818908cb992b830289f7041fb793d29bb65e7da3a76e37d88b76074768e","observation_id":"be1d4854-de22-48a7-876d-7e1571c4931d","resolution":{"observed_at":"2026-08-16T11:35:49.907043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.882680Z","title":"E⊆{ (i,j )|i∈V a,j ∈V} is the set of edges, denoting the information flow from a sender node j to a receiver agent i","venue":null,"work_id":"7f6105ab-fded-4fcd-ac0c-1fc6c968fa53","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.590785Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e3fe6e8862b06267ec9a894011cbbe0429c9e0efca3d78247a4a03da5d05e868","observation_id":"99cdc52b-244d-4645-aa18-6dae73dd4be0","resolution":{"observed_at":"2026-08-16T11:35:49.889638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.864235Z","title":null,"venue":null,"work_id":"4a13c137-9418-433a-888d-5bd101df6961","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.596258Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:88895fe96a41ab579fd2473d2f2990730e61b5dfa67124c4e67f7c3d56e8ebd5","observation_id":"2884d2e1-7170-4d80-beb3-d044cd74f8c9","resolution":{"observed_at":"2026-08-16T11:35:49.870781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T12:30:54.403736Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL"},"reference_resolution":{"displayed":99,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":56},"total_outbound_references":99},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 99 of 99 outbound references and 1 inbound Pith citation observation for arXiv:2504.15425."}