{"as_of":"2026-08-10T22:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:490d57c181fbcfef99b652eec312460892d97f2ce918d1a9183d8f3654035276","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:35:18.236786Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:43:45.813958Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-04T12:16:13.904932Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2507.05251","doi":"10.48550/arxiv.2507.05251","metadata_source":"pith","pith_arxiv_id":"2507.05251","snapshot_observed_at":"2026-08-04T12:16:13.904932Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","venue":"cs.RO","work_id":"b9558add-1b4a-48e5-878f-e879eda52ee7","year":2025},"citing_paper":{"arxiv_id":"2510.14479","last_updated":"2026-06-01T09:22:06Z","snapshot_observed_at":"2026-08-09T00:45:48.372979Z","submitted_at":"2025-10-16T09:23:48Z","title":"Optimality-Based Control Space Reduction for Infinite-Dimensional Control Spaces","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:45.813958Z"},"links":{"cited_paper":"/paper/2507.05251","citing_paper":"/paper/2510.14479"},"observation_digest":"sha256:1c0fe1adfdf528eb90e4d05b54f115d05b9d8891d3e232ae1b2046ba233bb6b2","observation_id":"d8de6b98-7696-4ccd-8a98-ed089e04fca8","resolution":{"observed_at":"2026-08-04T09:49:30.139004Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05251","snapshot_observed_at":"2026-08-03T16:52:51.218277Z","title":"arXiv preprint arXiv:2507.05251","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.11944","last_updated":"2026-05-28T11:10:14Z","snapshot_observed_at":"2026-08-03T16:52:46.785804Z","submitted_at":"2025-12-12T14:01:24Z","title":"A Review of Learning-Based Motion Planning: Toward a Data-Driven Optimal Control Approach","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T16:52:51.218277Z"},"links":{"cited_paper":"/paper/2507.05251","citing_paper":"/paper/2512.11944"},"observation_digest":"sha256:0aa19810534826cdd58f9388f1b64f5c5d41e7abf281d0a5f2fc6a8d56d5dc69","observation_id":"a621fc51-a9c7-4e6e-87cf-ae048b3bd736","resolution":{"observed_at":"2026-08-03T16:52:51.218277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.05251/citation-record","integrity":"/paper/2507.05251/integrity","json":"/paper/2507.05251/citation-record.json","paper":"/paper/2507.05251"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.897130Z","title":null,"venue":null,"work_id":"18b74a9c-880c-4982-bfa4-e0aff4bc54c4","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.442274Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:857eab260cfefc73827bfa3b2f8c17b96ca98a7964fb83e4ec38926090a8b4fd","observation_id":"9fc4fd64-7de0-4799-a444-af4d8e4d4c89","resolution":{"observed_at":"2026-08-06T19:35:29.933684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.813824Z","title":"Common- road: Composable benchmarks for motion planning on roads","venue":null,"work_id":"c3e5b7ef-0e7c-484a-bfe0-19efb72cdc2c","year":2017},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.521246Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:17ac22ad90cddac2d69ecda6db97d2c9498532d1b3c880375682922a665af8bb","observation_id":"c1900ad3-64b1-4f45-b219-1360e0c4918f","resolution":{"observed_at":"2026-08-06T19:35:29.853056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.673591Z","title":"Reinforced Cur- riculum Learning For Autonomous Driving In Carla","venue":null,"work_id":"ad901b5a-a180-4de2-bc8c-abdc811a8917","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.624485Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:88ad9569513c403c105b49a199bbaee75c76a44da6be3e828e1e5b4e76d6aad3","observation_id":"53adcf0d-b4fb-42a8-87df-0fe2174a49a2","resolution":{"observed_at":"2026-08-06T19:35:29.713976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.583903Z","title":"Traffic Signal Control Using Hybrid Action Space Deep Reinforcement Learning","venue":null,"work_id":"8ed11147-2e7d-418d-a2a8-4a39a8da78dd","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.699913Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:8659c3c230e417a8127df162c3850a3612c78554998f752405f76f08f50dbab5","observation_id":"6fd755e0-a064-4e65-8124-3a4e5e157d0d","resolution":{"observed_at":"2026-08-06T19:35:29.617128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.491397Z","title":"OpenAI gym","venue":null,"work_id":"5930b664-a69f-4d58-83ca-84d826fee10a","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.806563Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:b1c2a0cfe9e2580f26df5e9cba82ed71481c36128af8ee6c326e3a075a93c328","observation_id":"334a5765-4fc9-4553-a2a7-9c035a6370c4","resolution":{"observed_at":"2026-08-06T19:35:29.532670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.386733Z","title":"GRI: General Reinforced Imitation and its Application to Vision-Based Autonomous Driving, May 2022","venue":null,"work_id":"180bdaf5-1a92-4a97-96ae-428ab279e451","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.870649Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:ac6570df01dc48017ecf2f1738484cff0cd439ae5985bbab556a5ab654200ba2","observation_id":"5fb24d38-05ae-4caf-a0c9-f090ef109464","resolution":{"observed_at":"2026-08-06T19:35:29.424861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.250703Z","title":"Learning to drive from a world on rails, October 2021","venue":null,"work_id":"8f670f25-a75b-4c5c-905f-fb4e3ad55031","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.005963Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:3afe0b4e5455edd55bef3365101db37ada0b5f5ec154b7ba4ddb3464e8bc800f","observation_id":"59736d64-fcef-449d-ac90-4d24f2688fcd","resolution":{"observed_at":"2026-08-06T19:35:29.335035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.177516Z","title":"Context- Aware Meta-RL With Two-Stage Constrained Adaptation for Urban Driving","venue":null,"work_id":"b2f5cff1-8eab-4714-862b-26037970c81e","year":2024},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.136113Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:3631b2dfc992729fd492ccae52243a1e41d1b1069d0406fc684b6cb0b1944549","observation_id":"9dc4f863-806d-4c97-a51d-a7d5c47f4ab9","resolution":{"observed_at":"2026-08-06T19:35:29.206796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.105077Z","title":"Context - Enhanced Meta-Reinforcement Learning with Data-Reused Adaptation for Urban Autonomous Driving","venue":null,"work_id":"f052e048-1469-436c-ac1d-b879d8d91113","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.245983Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:2a46191f1dc46fb7d6a891ba8ea9df55f9feb057be0b944440ab1e548e61a8a6","observation_id":"689a04e5-44c6-44d0-88b8-22a0cf0e1cd5","resolution":{"observed_at":"2026-08-06T19:35:29.126503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.028679Z","title":"CARLA: An Open Urban Driving Simulator","venue":null,"work_id":"a18f2416-3c06-4d34-848c-5db0b92223c3","year":2017},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.345319Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:15527c2d8a3df4c2e8aa00d318b28ba4da5490763e4c4589f9e642306a043e8e","observation_id":"ffa34a45-ba45-4ba1-8cfa-d3d4138f8b73","resolution":{"observed_at":"2026-08-06T19:35:29.055142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.944533Z","title":"Deep reinforcement learning in large discrete action spaces","venue":null,"work_id":"b430a0d4-2595-4b4d-a76b-6204cdf0da72","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.447711Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:e0b2a3c6edf31426f29383fac8427eea59bfcd1d7ac59a63615f7d8cac846047","observation_id":"149ca7bd-b8c3-428a-b9d4-de4889b9a991","resolution":{"observed_at":"2026-08-06T19:35:28.976461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.815546Z","title":"DQN-based Reinforcement Learning for Vehicle Control of Autonomous Vehicles Interacting With Pedestrians","venue":null,"work_id":"be0dc751-a12e-49e1-b58d-90fbfd2ade76","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.558039Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:34c387865439ee897c390274d1fc04d2e71569f69b50baf4a35199a926f94428","observation_id":"99f276d1-200a-42cb-bd4a-05d3f44e7a3e","resolution":{"observed_at":"2026-08-06T19:35:28.890398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.712260Z","title":"Growing Action Spaces, June 2019","venue":null,"work_id":"2a29d0a4-fe0f-43df-b99b-74c5a8474795","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.637587Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:df9d576449fa320f8f43ac34ec089f25dfdfc717686c1774662b79486e74991e","observation_id":"663f4c56-2539-4fe0-8de0-1873ae08e5c4","resolution":{"observed_at":"2026-08-06T19:35:28.751579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1049/itr2.12593","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Intersection decision making for autonomous vehicles based on improved PPO algorithm","venue":"IET Intelligent Transport Systems","work_id":"6d969192-fa86-4dd0-8e06-c8caf433bb1c","year":2024},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.747612Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:53cca95cd4868c4519350ac1387f3cecd327fc56dc1a1e8c5e4d72f50e16c1f4","observation_id":"b46ce158-6fc0-4b5c-8213-a9785438fccd","resolution":{"observed_at":"2026-08-06T19:35:18.393221Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.576911Z","title":"Interactive fiction games: A colossal adventure","venue":null,"work_id":"91bb80bb-73d7-4f2b-98ec-78e622af1553","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.830034Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:91cf48bacd928d53e48d2009663e538efe474ab2caac4806283156d9d7f6720b","observation_id":"f2c2f208-0116-4f94-a753-37087525948f","resolution":{"observed_at":"2026-08-06T19:35:28.648965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.352285Z","title":"Le, and Hartwig Adam","venue":null,"work_id":"cd077b79-f6ac-4326-90db-c97fa5566935","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.903360Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:8506c9cc850451def68040f433031ec3ba5c99d0e9030a4ff4c57304190f6b92","observation_id":"99c252ac-a11f-464b-8646-41672b982707","resolution":{"observed_at":"2026-08-06T19:35:28.455633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.093074Z","title":"A closer look at invalid action masking in policy gradient algorithms","venue":null,"work_id":"b368a5a1-13ba-4cc1-aed6-43bf1cc8754f","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.018125Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:1733542d7aea69b5778e0bbcae1b1c4b180d584fbcb8377a89d527bee6838a74","observation_id":"6c0e69ee-7d55-44c6-9f80-59b39fd7e660","resolution":{"observed_at":"2026-08-06T19:35:28.242679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:27.847437Z","title":"Safe Reinforcement Learning on Autonomous Vehicles","venue":null,"work_id":"6f4bbf84-1f70-4520-a7c5-28d2c502508c","year":2018},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.119280Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:34463748ee9b93428956d9d82177c6339c1c0094c7feea234971dafae26c1130","observation_id":"5d538448-78ae-4dfb-9936-16531bead1d8","resolution":{"observed_at":"2026-08-06T19:35:27.960322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:27.523961Z","title":"Action Space Shaping in Deep Reinforcement Learning, May 2020","venue":null,"work_id":"b521f87b-88a5-4fde-b0f9-e64410cc4aea","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.250752Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:5a2f73671e0977d16d733a361eb38c55c9cc946d1a975e1946b6710717848f23","observation_id":"f3849438-59b6-42e1-83de-f94a1feca6b4","resolution":{"observed_at":"2026-08-06T19:35:27.674671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:27.265534Z","title":"ViZDoom: A doom-based AI research platform for visual reinforcement learning","venue":null,"work_id":"8a824546-4576-4139-991c-ecb1e192f842","year":2016},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.337773Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:89cd3d5a845f2fe9eb00049e308e453c53694f9bf83899e7d0bf8a63752378c2","observation_id":"9bc8423a-2445-4464-863b-4e4244ce7cd7","resolution":{"observed_at":"2026-08-06T19:35:27.368120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:26.972561Z","title":"Learning to Drive in a Day","venue":null,"work_id":"e7cb9a83-b5b1-4af1-b956-bdcb6d58d2f6","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.409707Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:f665b24091029bfbec96c6d0e1a9777dd73062afd7f9c842cd5743343559dd1a","observation_id":"aea4bded-93c0-4b60-9660-0e0fa64d05bb","resolution":{"observed_at":"2026-08-06T19:35:27.092805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:26.637235Z","title":"Al Sallab, Senthil Yogamani, and Patrick P ´erez","venue":null,"work_id":"5140ed27-967e-4aa6-b853-412131d46cbc","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.491956Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:7dcdc3a814487502dccd1649cf230322b7f82a4b067295a4b8b0ffb79d5a79cf","observation_id":"d0d9bdae-bd92-4acd-baae-0eaf97b79ac9","resolution":{"observed_at":"2026-08-06T19:35:26.809362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:26.396205Z","title":"The highD dataset: A drone dataset of naturalistic vehicle trajectories on german highways for validation of highly automated driving systems","venue":null,"work_id":"57ca870c-c940-4b6d-8e6b-7b258c0cdebb","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.558801Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:71f41ae9244e3ccb1debc2394e2055f853482ca6b484f870563bce758d985cb4","observation_id":"f02a4db6-d690-4fc5-805c-da61787141c7","resolution":{"observed_at":"2026-08-06T19:35:26.510666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:26.173433Z","title":"Safe Rein- forcement Learning for Autonomous Lane Changing Using Set-Based Prediction","venue":null,"work_id":"ec5bbdd2-a805-4d98-9e12-58dd3774b230","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.630752Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:d741706bf76a872d577e4e1457786d01fec79b907bd682321f840e1bd829f3af","observation_id":"7ad0b9aa-ca5b-4d67-a791-5aa303a2d370","resolution":{"observed_at":"2026-08-06T19:35:26.278660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:25.916932Z","title":"HyAR: Addressing discrete- continuous action reinforcement learning via hybrid action representa- tion","venue":null,"work_id":"cac61b18-e541-475a-afa0-0f9aa53df9f4","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.710596Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:c414385f1495b80ae11d1b4aeec074e2626cb5c375f2ee7aa9a18372e65f21f5","observation_id":"db0289f5-b275-475d-988a-74b909036a0b","resolution":{"observed_at":"2026-08-06T19:35:26.052693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:25.599401Z","title":"Think2Drive: Efficient Reinforcement Learning by Thinking in Latent World Model for Quasi-Realistic Autonomous Driving (in CARLA-v2), July 2024","venue":null,"work_id":"1e07363d-ef07-4bad-aa25-d54281f856a3","year":2024},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.814516Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:c5740d82a6302be626747d145cf4fafb15db5d9949f54ee03b6a2aa5d19563e2","observation_id":"65bd2261-1c5d-49b2-812d-c9aecfc4dd66","resolution":{"observed_at":"2026-08-06T19:35:25.758917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:25.347200Z","title":"MetaDrive: Composing diverse driving scenarios for generalizable reinforcement learning","venue":null,"work_id":"200a4c09-69b1-40e5-92db-bab781078237","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.886884Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:0367d5fc1279ab4ec671d5f26c445a36c9b09be6625f579e90fca3e726bdba89","observation_id":"0ed34ddc-d396-4fef-b85a-93f64f023e9f","resolution":{"observed_at":"2026-08-06T19:35:25.455788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:25.064724Z","title":"Achieving sample and computational efficient reinforcement learning by action space reduction via grouping","venue":null,"work_id":"7dd0afa3-4b3d-431a-84eb-bb315898869e","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.982447Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:3623d13f824bc0c21a5d111e240736e4e357d3873944184fbc211b735db9ca07","observation_id":"375cd1d9-c71e-4195-94f0-78ee279c5b17","resolution":{"observed_at":"2026-08-06T19:35:25.197833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:24.845602Z","title":"Achieving Sample and Com- putational Efficient Reinforcement Learning by Action Space Reduction via Grouping, June 2023","venue":null,"work_id":"9acd188e-16c7-413b-b86c-d35cec18720c","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.075874Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:aeafefbf63ec3ff437156f3c34984d272c25ac4d0c09753c161bb1837c431dd7","observation_id":"44c8e0b2-3c75-49ee-939e-c83a5dcee611","resolution":{"observed_at":"2026-08-06T19:35:24.949058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-06T19:35:16.155246Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.155246Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:99514d1d2a53bfe64541a6bae6297a60baadfa0fbfccb528ddc59c73750ec0c0","observation_id":"76a749f2-12ba-4d56-b0d2-8082b5e5640d","resolution":{"observed_at":"2026-08-06T19:35:16.155246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:24.547741Z","title":"Exact Reduction of Huge Action Spaces in General Reinforcement Learning, December 2020","venue":null,"work_id":"6f30a13e-892e-4dfb-8d5c-6a504de391b2","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.225499Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:f220aa88b883538e27add892dda9e458579eae03ef5c3f4295d6f9e5c673a650","observation_id":"9fc94ac8-d326-40f5-ac27-16311114e2e9","resolution":{"observed_at":"2026-08-06T19:35:24.700651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:24.231661Z","title":"Webotstm: Professional mobile robot simulation, 2004","venue":null,"work_id":"f15cbfda-5e87-4696-847c-125632946efc","year":2004},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.294312Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:9357fd37c77561284f16d3f9db32e7b20ca3c6f8c8a1d56304f4814dae7b8c86","observation_id":"96c4f514-51c7-469d-b405-4c276e8df0fd","resolution":{"observed_at":"2026-08-06T19:35:24.360677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:23.908855Z","title":"Safe and Psychologically Pleas- ant Traffic Signal Control with Reinforcement Learning using Action Masking","venue":null,"work_id":"4d8c1bde-4421-4393-aaf2-d3a95b00be00","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.373175Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:c8bcf8069c98ecfb8f2e586ba1424dbfe21b94c4523332a2aaae244b0c769939","observation_id":"f4fd03d3-6e6a-4865-89a8-306030c4c856","resolution":{"observed_at":"2026-08-06T19:35:24.075537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:23.652146Z","title":"Bergasa, Carlos G ´omez-Hu´elamo, Rodrigo Guti ´errez, and Alejandro D ´ıaz-D´ıaz","venue":null,"work_id":"67880ea1-f5ef-4a4f-9f65-1531444cb799","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.483722Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:473ab8285671fa96445b885038fe5dd9c1fcdb2657045e1d881cc227d7af7c7d","observation_id":"212c8caa-d03d-4b59-8905-45d12334e313","resolution":{"observed_at":"2026-08-06T19:35:23.787443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:23.319709Z","title":"Stable-baselines3: Reliable reinforcement learning implementations","venue":null,"work_id":"11694826-1320-411a-89f5-1fa0bc67424f","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.568058Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:3c9459b292b29d3f46e3882fddab711eafa1c6f2bdedde73f8bb2c9a600ee65b","observation_id":"b826fcc2-c788-4bb1-a2f6-4dcdbf7e4b79","resolution":{"observed_at":"2026-08-06T19:35:23.493672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:23.003794Z","title":"Fuzzy Action-Masked Reinforcement Learning Behav- ior Planning for Highly Automated Driving","venue":null,"work_id":"1e6fac6e-8c11-4b18-974a-2e3b4f4a629b","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.638214Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:d413ebe54545956b6457e59f39db98c6aa8930ab6dc46a0c36c716fcf7edd327","observation_id":"0d295925-6ef8-4bf6-93d3-34659de18bdb","resolution":{"observed_at":"2026-08-06T19:35:23.149061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:22.707136Z","title":"Proximal Policy Optimization Algorithms, August 2017","venue":null,"work_id":"d60ce162-8346-4aab-90ea-101fa7d4c1ef","year":2017},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.711748Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:f72125322cd0e8ba39a1fcc558146910081e64ff2ebc04086062e0f9b620c510","observation_id":"3a5418d4-9ca9-4bfd-bfdd-9be8be64216a","resolution":{"observed_at":"2026-08-06T19:35:22.853825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:22.436309Z","title":"Autonomous driving in CARLA using deep reinforcement learning","venue":null,"work_id":"f3123441-9081-471a-b07e-c21a06ac1b51","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.813469Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:025d7b3f1a562f0a9eb8aa938ad5634843af60f0f46d8d83b814143180cbebb1","observation_id":"18e281a0-e802-4c1f-b258-650a4140d0d9","resolution":{"observed_at":"2026-08-06T19:35:22.583252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:21.896785Z","title":"Excluding the irrelevant: Focusing reinforcement learning through continuous action masking","venue":null,"work_id":"76a83311-17aa-4837-9dde-4317fb48382d","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.978913Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:f9e050a0fdff165ed5ccebe39dd8c1daa7e2456663e7b8e66b0c07811642f6c5","observation_id":"3b577942-8ade-404e-b1f1-21321b7076b9","resolution":{"observed_at":"2026-08-06T19:35:22.006831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:21.680871Z","title":"Dynamic Action Space Handling Method for Reinforcement Learning Models","venue":null,"work_id":"188240d7-41c9-4130-86ed-9c5ffec06099","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.062317Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:b08bd3dffbdb8aba96cb1baf653a88c867d44234e1373be7ae17634b088a2896","observation_id":"d0b5efd1-7fbd-4119-a93e-83ce832133f4","resolution":{"observed_at":"2026-08-06T19:35:21.780596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.08946","last_updated":"2019-01-25T04:01:24Z","snapshot_observed_at":"2026-08-10T05:50:34.316767Z","submitted_at":"2017-11-24T12:45:30Z","title":"Action Branching Architectures for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1711.08946","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.08946","snapshot_observed_at":"2026-08-06T19:35:18.493475Z","title":"Action Branching Architectures for Deep Reinforcement Learning","venue":"cs.LG","work_id":"0d0b6731-c5a0-401d-bdf9-ec48cf632e8c","year":2017},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.156537Z"},"links":{"cited_paper":"/paper/1711.08946","citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:559bf4ed4cd9dce512c6edff408f59dea3d338058eae550e8db9a0e12193a26d","observation_id":"1973575f-24fe-4150-a094-6280a79cb4f8","resolution":{"observed_at":"2026-08-06T19:35:18.555669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:21.443699Z","title":"Action Branch- ing Architectures for Deep Reinforcement Learning, January 2019","venue":null,"work_id":"1f45ba4d-5c86-4594-93b0-d64f63ea30b1","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.231928Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:18163aa6087398c2cbd3bcf6bf843d73d92f7b312d4769f623b01cde20038373","observation_id":"5c216267-9c44-40b9-8454-5e19527aa9d5","resolution":{"observed_at":"2026-08-06T19:35:21.564230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:21.205948Z","title":"End-to-End Model-Free Reinforcement Learning for Urban Driving using Implicit Affordances, March 2020","venue":null,"work_id":"f862b565-f5d7-400f-a95b-ea104495643d","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.331281Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:a63c3d9f89d3e783a03cf78ca2fecf9b50b9adaa799e58ad9603ba4303a9e3d3","observation_id":"97820b29-a8d0-4ed4-b318-1590455f929f","resolution":{"observed_at":"2026-08-06T19:35:21.309590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:20.945953Z","title":"Deep Reinforcement Learning With Action Masking for Differential-Drive Robot Navigation Using Low-Cost Sen- sors","venue":null,"work_id":"d4ac89e7-7bdc-46dd-819e-7b2f25d7810e","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.403180Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:b52dad90568df3d4ae1f4b68d627251246a95f3baa90321d6cad6b7777a2c38f","observation_id":"319b9b1f-28f5-4a08-b871-066a79d248e5","resolution":{"observed_at":"2026-08-06T19:35:21.080173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:20.693294Z","title":"Pure-past action masking","venue":null,"work_id":"d91f0805-2722-4052-a87d-592a2e93d78d","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.482379Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:76647c39075c1ba41e0772e5e55b7981764f1b6a28788812c72d357cc2a8975d","observation_id":"0ac7ed44-e6cb-42ab-9355-a187a696e8a4","resolution":{"observed_at":"2026-08-06T19:35:20.822863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:20.445313Z","title":"StarCraft II: A new challenge for reinforcement learning","venue":null,"work_id":"89e95134-2571-47c3-b6e1-3fb0251b051a","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.585693Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:18c92d207a073ca1af3c8715652599c69bbdbb976b27443696b6d40c93aec951","observation_id":"f2f6cb88-32b9-4952-b86a-af956dc6f340","resolution":{"observed_at":"2026-08-06T19:35:20.567637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:20.224744Z","title":"A Versatile and Efficient Reinforcement Learning Framework for Autonomous Driving, March 2022","venue":null,"work_id":"965c3ddc-2249-4827-9fd2-e34f2e27fe42","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.682736Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:d1c91c9c67710358f75b93de0831e5c486adcf9150737117b08b5e9ed1b8b1f2","observation_id":"0263943c-b9b9-4d00-8401-a96d94806213","resolution":{"observed_at":"2026-08-06T19:35:20.331689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:19.943949Z","title":"Continuous control for automated lane change behavior based on deep deterministic policy gradient algorithm","venue":null,"work_id":"afe1bf03-3e25-4ca8-be15-d5516c459d13","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.752763Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:979ec3c54204c3b1c28f089e87fd32fd74e3e4d301ba872fbe9436429aa75e7e","observation_id":"6ab01e6b-4ba2-4ad5-a88a-bf3d78533dc9","resolution":{"observed_at":"2026-08-06T19:35:20.083635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:19.652080Z","title":"Learning State-Specific Action Masks for Reinforcement Learning","venue":null,"work_id":"f704bd23-b258-45cc-8788-0091e45ae38b","year":2024},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.825011Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:49ab05033e3fcb95d623014e552d2af8ee06aba630b745e09b570d5a573dcf74","observation_id":"2ee4d27e-e7ac-4887-810c-3d69c2399e21","resolution":{"observed_at":"2026-08-06T19:35:19.804011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:19.423507Z","title":"Reinforce- ment Learning-based Autonomous Parking with Expert Demonstrations","venue":null,"work_id":"d3cee417-f01e-46e2-9efe-c80b77b3f497","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.887216Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:22a7c6e3517b52bf66e6c279eb7d4bd9d69bdbfb48cd41069ed2de802cc56162","observation_id":"5c3fc09b-326a-459c-9cd5-12c5911dc05f","resolution":{"observed_at":"2026-08-06T19:35:19.510879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:19.191509Z","title":"Fuzzy sets, fuzzy logic, and fuzzy systems: selected papers , volume 6","venue":null,"work_id":"06ab73d9-39bb-4122-aafa-33322e57ce0d","year":1996},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.966481Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:50b00dd9d7ea026b84ab816531eb813146aa9e62087c450942ccc7e4c5961e49","observation_id":"145f4dd3-be69-4947-b553-e384636a30e2","resolution":{"observed_at":"2026-08-06T19:35:19.297539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:18.984159Z","title":"Mankowitz, and Shie Mannor","venue":null,"work_id":"a7c2ce19-bf13-441a-aed5-752a914967c3","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:18.034084Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:f9f9fd3a47aa1ffee8a14ae8fe024e8e8736d0ab2db384d8d0c594fc076a9808","observation_id":"5ed83298-c693-4d05-a919-43bcf6c19a7f","resolution":{"observed_at":"2026-08-06T19:35:19.082395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:18.856983Z","title":"Lexicographic Actor-Critic Deep Reinforcement Learning for Urban Autonomous Driving","venue":null,"work_id":"4984d7f9-0543-4965-952d-0cf2f482b644","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:18.084907Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:ef4ac6617c18a21bcf3113d42eb34ab29eb5bbc252a7167fc70a864da8592d2d","observation_id":"d0dde9e4-07c7-468c-a605-1d29f20f1d30","resolution":{"observed_at":"2026-08-06T19:35:18.904729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:18.766384Z","title":"End-to-End Urban Driving by Imitating a Reinforcement Learning Coach, October 2021","venue":null,"work_id":"02797592-5a86-4c23-a5c3-4d4d38d51e29","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:18.161447Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:b5c6875ff9caead64221842a77d3130d5fccf608e2805981e10bf05ed3dee5fa","observation_id":"e7f801c5-5545-4e84-b6a2-31dc90b26e3c","resolution":{"observed_at":"2026-08-06T19:35:18.812416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:18.641816Z","title":"SMARTS: An open-source scalable multi-agent RL training school for autonomous driving","venue":null,"work_id":"ba62e10d-ccde-488a-9bf8-faffad6b9c13","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:18.236786Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:c5752537391139b9cd024f4f8268e790c6973f60d2da6bbf1cd3c8aa11bca5e6","observation_id":"568eaff2-4f33-4dd9-95dd-db46b4859fdc","resolution":{"observed_at":"2026-08-06T19:35:18.698875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:22.155951Z","title":null,"venue":null,"work_id":"662ab074-2244-48ac-92d4-15a229cbd67b","year":2025},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.905871Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:7993ed26d7eb455049d0a3f0f600e1b65393cbe80eb8086e9883137bcd887492","observation_id":"4b70ed98-1cab-4701-aa5d-855a8f17a524","resolution":{"observed_at":"2026-08-06T19:35:22.298894Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":2,"verified_fuzzy":51},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 2 inbound Pith citation observations for arXiv:2507.05251."}