{"as_of":"2026-08-16T16:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7b8af35dc1c5e4692cae2ea4ff039d79c89b93eab422efc68cb31729acacce0","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:56:33.569294Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:43:05.773872Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18304","snapshot_observed_at":"2026-08-04T10:43:05.773872Z","title":"Sharpening the spear: Adaptive expert- guided adversarial attack against drl-based autonomous driving policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09041","last_updated":"2026-06-05T03:00:50Z","snapshot_observed_at":"2026-08-16T03:17:16.311904Z","submitted_at":"2025-10-10T06:21:36Z","title":"Robust Driving Control for Autonomous Vehicles: An Intelligent General-sum Constrained Adversarial Reinforcement Learning Approach","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T10:43:05.773872Z"},"links":{"cited_paper":"/paper/2506.18304","citing_paper":"/paper/2510.09041"},"observation_digest":"sha256:0a3a31e402246365cc2cec3ed3dd3d53a7f51a4533d0c412059d850376781746","observation_id":"95ae24ad-af80-4897-9669-998938547369","resolution":{"observed_at":"2026-08-04T10:43:05.773872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.18304/citation-record","integrity":"/paper/2506.18304/integrity","json":"/paper/2506.18304/citation-record.json","paper":"/paper/2506.18304"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.686037Z","title":"To the best of our knowledge, we are the first to integrate expert knowledge into adversarial attack training for DRL-based autonomous driving policies","venue":null,"work_id":"1c9fdb2a-6f4a-4e8d-9088-e519db02e48b","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.157258Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:5a619e5ae8243c4e6b554a0447e41a34aeee42291c56508d7055a4d0d1f47e33","observation_id":"3ef42dad-52b3-4cf5-8b4a-74e72f59770b","resolution":{"observed_at":"2026-08-15T18:56:36.691626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.664807Z","title":"This design enables the expert to better capture diverse attack policies across various scenarios","venue":null,"work_id":"264d492b-52ba-4318-9104-4a5e23ea55c4","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.163824Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:fb217b3573f3eee3df7e08cd61f1357f41381f34ce237b83c697a883834b2add","observation_id":"85cb1c72-e10c-4994-a8f7-a2acb83d43c8","resolution":{"observed_at":"2026-08-15T18:56:36.670496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.642903Z","title":null,"venue":null,"work_id":"ee12ad51-ce32-4a83-9b2d-c1c1ba3ba613","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.171417Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:815ef1bfb675d09f9d1132eac6d9ed0c6259adc814e9027ea8367f886c8e401e","observation_id":"0f2fa9d1-8971-406f-b59c-761310dafc93","resolution":{"observed_at":"2026-08-15T18:56:36.649202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.14519","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:35.970336Z","title":"A survey of decision-making and planning methods for self- driving vehicles,","venue":null,"work_id":"0a713c45-08b7-4182-aa74-657d6e0eb51d","year":2025},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.235839Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:55519335eac242725cb969f0c8e12c4a07ef6c747c51615da584c77b6d458947","observation_id":"9fe5ed70-ca57-49b3-b167-f896021149e1","resolution":{"observed_at":"2026-08-15T18:56:35.985854Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.599380Z","title":"However, effective attack opportunities are temporally sparse and context-dependent","venue":null,"work_id":"6b5d135b-d2d3-443e-a9b8-bf6cedd1d601","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.184839Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:1ab3bd18e027c81e941c2587784d0981f930ccb88b43951b095ccaae5ab78ccc","observation_id":"00030726-57f7-4015-bd39-fc5e9457694a","resolution":{"observed_at":"2026-08-15T18:56:36.606831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.576077Z","title":"However, such trial -and- error exploration is highly inefficient, especially under strict attack budgets and sparse rewards","venue":null,"work_id":"e5bc7527-90dd-41ff-a2a1-206e02edebe7","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.190660Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:9c0a7d7da14e172ccc6c73f4a1e8226ec86e0376b40af6c3bdb1d2326b87ffb3","observation_id":"aef0fcb7-dfe1-468d-9432-a8bd2b6d4d80","resolution":{"observed_at":"2026-08-15T18:56:36.582464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.557737Z","title":"This su boptimality can mislead adversary training and limit its overall effectiveness if left unaddressed","venue":null,"work_id":"0b73c796-6d94-4ead-b54e-c29264b0b1e3","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.196959Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:293352842d9785fc90adc66d48434629ea3c6e9e22989d299b2afc6504b79cda","observation_id":"4f7670d0-1e3a-434b-9939-5edc417d6e93","resolution":{"observed_at":"2026-08-15T18:56:36.563050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.538487Z","title":null,"venue":null,"work_id":"866e680e-4259-40ff-8d9e-82333e1fe9a7","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.203668Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:2db7b6dc4c0fc5a792436791ba82f0dfad5664fca74657d1de51504aa844d9b1","observation_id":"f57b6625-88a0-4445-b8bb-1a900366bfa2","resolution":{"observed_at":"2026-08-15T18:56:36.545058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.210984Z","title":"A Survey on Recent Advancements in Autonomous Driving Using Deep Reinforcement Learning: Applications, Challenges, and Solutions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.210984Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:8b7631d6028e8ec469d8e606910392151f4695398b23442173de311b148e1d50","observation_id":"26aa3e26-97b8-44bf-affe-a31e4181d839","resolution":{"observed_at":"2026-08-15T18:56:33.210984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.217580Z","title":"Reinforcement Learning -Based Multi-Lane Cooperative Control for On -Ramp Merging in Mixed - Autonomy Traffic,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.217580Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:12d868f636c7388f5ab86accda19f852c5d7023102a3a011bb524842c3c8b1ea","observation_id":"92e6c27b-75a5-4c5e-95dd-38115bfaf42e","resolution":{"observed_at":"2026-08-15T18:56:33.217580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.226642Z","title":"Research on Autonomous Driving Deci sion-making Strategies based Deep Reinforcement Learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.226642Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:5ab50622885fa02e93a0a377219925cade44064f8c34bc1055103b1a4d93d028","observation_id":"16d21b7b-e2f2-46f7-9314-32f1a287bb55","resolution":{"observed_at":"2026-08-15T18:56:33.226642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.517458Z","title":"Seeing is not Believing: Robust Reinforcement Learning ag ainst Spurious Correlation,","venue":null,"work_id":"43d3737b-bffa-4334-b860-5968a61c2c28","year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.241250Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:e6e966469b89637daf509f3aa0f96b5cc258d8b78e6173d99b3a970da33ffc2a","observation_id":"6fce662c-136a-4718-8ad9-8fc65bccb48d","resolution":{"observed_at":"2026-08-15T18:56:36.524163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.246845Z","title":"Adversarial Machine Learning Attacks and Defences in Multi- Agent Reinforcement Learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.246845Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:89c571be61b38c9ef3dd035ed039c68acbdc4ec32b2d2eb0602cb1bbccd1ad3d","observation_id":"ded85b9e-4810-43f9-b791-56ef3fa5bddb","resolution":{"observed_at":"2026-08-15T18:56:33.246845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.253093Z","title":"Adversarial Attacks and Countermeasures on Image Classification-based Deep Learning Models in Autonomous Driving Systems: A Systematic Review,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.253093Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:bbd780d7fbb2ce188a11fac9f1541cde8385e3ece4ff506681dabd19772b388c","observation_id":"e68f759b-4fbe-410f-b2c7-e35e55a79df3","resolution":{"observed_at":"2026-08-15T18:56:33.253093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.258683Z","title":"Targeted Attack on Deep RL-based Autonomous Driving with Learned Visual Patterns,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.258683Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:c8fb88c6f5e566d70b290437b4bf975eca62c77160cde778380e68113a8a37a4","observation_id":"96039cf8-a467-4ce3-aa93-ced6ef78f96d","resolution":{"observed_at":"2026-08-15T18:56:33.258683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.265292Z","title":"Adversarial Deep Reinforcement Learning for Improving the Robustness of Multi -agent Autonomous Driving Policies,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.265292Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:5daf022c69e57227952aedb1d022f9d8a82eea983c21365bbacd74dbceb2fde2","observation_id":"147cd533-1506-4083-9fc9-95252425be7e","resolution":{"observed_at":"2026-08-15T18:56:33.265292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.271471Z","title":"Deep learning adversarial attacks and defenses in autonomous vehicles: a systematic literature review from a safety perspective,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.271471Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:501aa180478cb7451c2d93e8b71c8accf27f433407c259efdcd0eea2fcaaa87f","observation_id":"8277e85e-a7e7-4ec5-93c6-a2ccfc2cd8cb","resolution":{"observed_at":"2026-08-15T18:56:33.271471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.eng.2023.10.005","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.733667Z","title":"Toward Trustworthy Decision -Making for Autonomous Vehicles: A Robust Reinforcement Learning Approach with Safety Guarantees,","venue":null,"work_id":"780098c3-845e-4bdb-8403-3a5e24e147af","year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.336985Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:dc63a4c8e5d9189ba5dfa9a9817ee3d36d98fe378d562bdbcd7cba8c03e03057","observation_id":"9fd17436-f455-4271-99db-25a41934d6dd","resolution":{"observed_at":"2026-08-15T18:56:33.741537Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.291700Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.291700Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:be5455756903ee29679bd6232a23a75d36481ee19acefa7946cb7d40113f0ae2","observation_id":"15b2146f-5a85-47bf-8f8b-558c5f5f2d9c","resolution":{"observed_at":"2026-08-15T18:56:33.291700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v34i04.5953","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.754504Z","title":"Reinforcement Learning from Imperfect Demonstrations under Soft Expert Guidance,","venue":null,"work_id":"e2c122c6-6611-4c5c-a09e-12f6ea461b7e","year":2020},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.299422Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:e9690b86565e29f147e277223dc9e5f0ed1081f881aab31e533781e9dc2395f5","observation_id":"bb755b30-1fa6-4f13-ba8a-87d10a14f013","resolution":{"observed_at":"2026-08-15T18:56:33.764421Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.306090Z","title":"Recent advances in reinforcement learning-based autonomous driving behavior planning: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.306090Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:a5d192d0fa2c1c53cbe9ae3ff0dd05e5dd541310278f9371b506691d37e9fa7b","observation_id":"302a6fc2-8347-4604-92b8-9b98703d4e9c","resolution":{"observed_at":"2026-08-15T18:56:33.306090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.312917Z","title":"A Preference- Based Multi- Agent Federated Reinforcement Learning Algorithm Framework for Trustworthy Interactive Urban Autonomous Driving,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.312917Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:7724c10c9871502a9126239e9372c2798b24ac8c040e6c92da4e347aa23c5905","observation_id":"8898c395-8e19-482a-88be-53b3dc6cb241","resolution":{"observed_at":"2026-08-15T18:56:33.312917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.325711Z","title":"Boosting Offline Reinforcement Learning for Autonomous Driving with Hierarchical Latent Skills,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.325711Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:62db6dd4f4d2bfe94aa74b97af6122914e3f24a5feefdbe5c0210624a91a3dd2","observation_id":"83b1444e-f274-4420-b9f2-a44d700771bd","resolution":{"observed_at":"2026-08-15T18:56:33.325711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.331326Z","title":"Event-Triggered Model Predictive Control with Deep Reinforcement Learning for Autonomous Driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.331326Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:867352f01f68ad0627826e4e2ef626c8dba490db0681c5ce59203e9af9e3be6f","observation_id":"98a6280a-3e53-468b-9708-e92b43276e43","resolution":{"observed_at":"2026-08-15T18:56:33.331326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.342986Z","title":"Self -Learned Autonomous Driving at Unsignalized Intersections: A Hierarchical Reinforced Learning Approach for Feasible Decision-Making,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.342986Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:607eecbabfd7134c3b9c3c866245513d548c9b1d36d4a5bbdff7074fe4331fb6","observation_id":"f9e543e6-17f9-4048-8b83-fc4636fb4c2d","resolution":{"observed_at":"2026-08-15T18:56:33.342986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00858","last_updated":"2024-09-05T08:07:27Z","snapshot_observed_at":"2026-08-16T13:22:15.314724Z","submitted_at":"2024-09-01T22:20:32Z","title":"Trustworthy Human-AI Collaboration: Reinforcement Learning with Human Feedback and Physics Knowledge for Safe Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00858","snapshot_observed_at":"2026-08-15T18:56:33.348675Z","title":"Trustworthy Human- AI Collaboration: Reinforcement Learning with Human Feedback and Physics Knowledge for Safe Autonomous Driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.348675Z"},"links":{"cited_paper":"/paper/2409.00858","citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:43db076ca6035e42b5980ce11c60e0966ddd3236aaffd98a55727c1456fcc52a","observation_id":"a44129a3-d993-43b2-a601-f92e984021de","resolution":{"observed_at":"2026-08-15T18:56:33.348675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.33849","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:34.887786Z","title":"Human-Guided Deep Rein forcement Learning for Optimal Decision Making of Autonomous Vehicles,","venue":null,"work_id":"e00b531b-d9eb-4dfe-ba70-c534cb934891","year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.354931Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:f7e3010f404dc07e840bb1b6020ec01de569b5236dfd431e2583af8edc392b9a","observation_id":"177a1090-081e-4050-acc9-db83ad4f70a8","resolution":{"observed_at":"2026-08-15T18:56:34.899391Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04447","last_updated":"2024-08-08T13:18:53Z","snapshot_observed_at":"2026-08-16T13:27:41.219920Z","submitted_at":"2024-08-08T13:18:53Z","title":"Reinforcement Learning from Human Feedback for Lane Changing of Autonomous Vehicles in Mixed Traffic","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04447","snapshot_observed_at":"2026-08-15T18:56:33.360309Z","title":"Reinfor cement Learning from Human Feedback for Lane Changing of Autonomous Vehicles in Mixed Traffic,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.360309Z"},"links":{"cited_paper":"/paper/2408.04447","citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:36e57525897c612b4d0cd4ca448e9d3a94f148700fbacead8dfc99f32265ee81","observation_id":"e714d9b8-96d3-44c9-a19a-fea23c7ce9b6","resolution":{"observed_at":"2026-08-15T18:56:33.360309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.366236Z","title":"Fear -Neuro-Inspired Reinforcement Learning for Safe Autonomous Driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.366236Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:f9e1d9984692b0afc69c3769ecee19dc7f93afcc16da84f681b8cebaba6369e1","observation_id":"c9155677-1803-46a2-9135-f1c59ddda8cb","resolution":{"observed_at":"2026-08-15T18:56:33.366236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.496782Z","title":"Efficient learning of safe driving policy via human -ai copilot optimization,","venue":null,"work_id":"a89dfd4a-5535-45ca-af29-a7da2d65bfa7","year":2022},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.372535Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:52b38779d676c544a28f4014cb6c061b91c188e6636428c40ed8d3b246864973","observation_id":"123ce22a-ca8d-4c2c-9c37-91551e3927b4","resolution":{"observed_at":"2026-08-15T18:56:36.504014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.378693Z","title":"Attention-Based Highway Safety Planner for Autonomous Driving via Deep Reinforcement Learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.378693Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:a95ceaf885e6cf404d6263d2b80b944a02a6c35ddfcad820608e6c81f94b8f7d","observation_id":"2569da4d-c42b-4acf-b70a-1db0b141d2cf","resolution":{"observed_at":"2026-08-15T18:56:33.378693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.443036Z","title":"Robust lane change decision for autonomous vehicles in mixed traffic: A safety-aware multi- agent adversarial reinforcement learning approach,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.443036Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:944909802f440ed45864e52db080cde7d029a05fa07e03fd55a3ecd1fcaede84","observation_id":"28eec071-8ceb-49bd-a7de-e451dca61b93","resolution":{"observed_at":"2026-08-15T18:56:33.443036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.399336Z","title":"An Analysis of Adversarial Attacks and Defenses on Autonomous Driving Models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.399336Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:e76b49b2e93823506945dd4f6aa0b15e1150cdbe0af6bdf37782738e9ff04305","observation_id":"6f5dd68a-3a4f-4e3b-a734-5117c220107a","resolution":{"observed_at":"2026-08-15T18:56:33.399336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.408623Z","title":"Robust Decision Making for Autonomous Vehicles at Highway On -Ramps: A Constrained Adversarial Reinforcement Learning Approach,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.408623Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:58fe774d641490abd75402f642e74a314ee07d8eb38cc0d357025b806c1441ae","observation_id":"d36043f1-4a92-4fc9-9365-5e0c48c775fa","resolution":{"observed_at":"2026-08-15T18:56:33.408623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.424656Z","title":"Ro bust Lane Change Decision Making for Autonomous Vehicles: An Observation Adversarial Reinforcement Learning Approach,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.424656Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:6d0106b53adc9956f65637c1204fa33157c5d7fa7b9c820aa691b30bb5b83a0a","observation_id":"eb64e09e-9f19-4e36-a9c6-c953c583d564","resolution":{"observed_at":"2026-08-15T18:56:33.424656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.624207Z","title":null,"venue":null,"work_id":"2ae0ef80-19c9-4f31-8262-10c597e8c59c","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.178152Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:a5e6be45a853a79c8cc443e9819c275270ca626fa9e41ad42493bbf832df186c","observation_id":"94eec6f9-32a1-4bb6-836b-ae57cc2cf6bd","resolution":{"observed_at":"2026-08-15T18:56:36.630112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.431203Z","title":"Adversarial Stress Test for Autonomous Vehicle Via Series Reinforcement Learning Tasks with Reward Shaping,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.431203Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:5c177015783e7b2cfd5b39f9bee98d60bbf8e0151bc42605d2f9bbe05c113cec","observation_id":"7b043aba-3017-42c0-a18e-be460810a009","resolution":{"observed_at":"2026-08-15T18:56:33.431203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16996","last_updated":"2024-11-26T00:00:27Z","snapshot_observed_at":"2026-08-16T03:17:34.734337Z","submitted_at":"2024-11-26T00:00:27Z","title":"CRASH: Challenging Reinforcement-Learning Based Adversarial Scenarios For Safety Hardening","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16996","snapshot_observed_at":"2026-08-15T18:56:33.437273Z","title":"CRASH: Challenging Reinforcement-Learning Based Adversarial Scenarios for Safety Hardening,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.437273Z"},"links":{"cited_paper":"/paper/2411.16996","citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:12c13b5501622e7b9a70ee8766996a74db3222c2b8a31290e8fe2f3c73062491","observation_id":"29e136e5-7578-412d-ad74-f618a41f1c4c","resolution":{"observed_at":"2026-08-15T18:56:33.437273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.450365Z","title":"ATS -O2A: A state-based adversarial attack strategy on deep reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.450365Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:2bbc46c8a2c8c3fc326a1f15cadc6f9e64f74ea16b138a98441bb2e01038412d","observation_id":"1fad2bb0-8876-4232-8c5e-aac59446bca2","resolution":{"observed_at":"2026-08-15T18:56:33.450365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.456651Z","title":"Stealthy and Efficient Adversarial Attacks against Deep Reinforcement Learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.456651Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:e9853108238fee194714794c4612703216205a47ae97595018a8b62c824bd00e","observation_id":"5c56e247-bcda-420c-b8b4-3260169e8558","resolution":{"observed_at":"2026-08-15T18:56:33.456651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.462650Z","title":"Attacking Deep Reinforcement Learning with Decoupled Adversarial Policy,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.462650Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:fed0cc0c0f0242b26511b71400dd84b5d2e2cdb1ae63ba03cb26415b55445fae","observation_id":"73ea08ee-e43c-4d7e-93e1-1adb3d701afe","resolution":{"observed_at":"2026-08-15T18:56:33.462650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18511","last_updated":"2024-12-24T15:50:10Z","snapshot_observed_at":"2026-08-16T15:23:57.863966Z","submitted_at":"2024-12-24T15:50:10Z","title":"Large Language Model guided Deep Reinforcement Learning for Decision Making in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18511","snapshot_observed_at":"2026-08-15T18:56:33.467788Z","title":"Large Language Model guided Deep Reinforcement Learning for Decision Making in Autonomous Driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.467788Z"},"links":{"cited_paper":"/paper/2412.18511","citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:42ed1825ddaf931222035afa581c25f90e3b1134e542106e5998a7edfe3cac6f","observation_id":"5adc17a3-0cbd-4d22-8e9d-5ffdc1188dd9","resolution":{"observed_at":"2026-08-15T18:56:33.467788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.477053Z","title":"Safe Driving via Expert Guided Policy Optimization,","venue":null,"work_id":"c935fe6b-95c7-40cb-8f15-a8c8fca81ec7","year":2022},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.474966Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:f3311959423b98812e8d3b0893f2efdc59b98a96b57b37b4b99659fc6cbc000a","observation_id":"70321af2-e088-4d05-bd97-9ee7a313c200","resolution":{"observed_at":"2026-08-15T18:56:36.482474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.482311Z","title":"Efficient Deep Reinforcement Learning With Imitative Expert Priors for Autonomous Driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.482311Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:8e870163343202d12454c8ab82f9ad9b672e54ccc183217c650a7c42ba272443","observation_id":"20f01549-cd68-4d49-989c-28aaf87514f4","resolution":{"observed_at":"2026-08-15T18:56:33.482311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.452160Z","title":"Measuring Robustness to Natural Distribution Shifts in Image Classification,","venue":null,"work_id":"c50cb772-ca05-4c89-a247-fb0f56c55e63","year":2020},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.489076Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:859479ff165763b7cffbbbd71c8979fbd46766b501616b44b38e7470a6dcadc5","observation_id":"93d7fe91-9842-479c-a0bc-9c904a35d185","resolution":{"observed_at":"2026-08-15T18:56:36.459868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.273556Z","title":"Stable- baselines3: Reliable reinforcement learning implementations,","venue":null,"work_id":"3eafc04a-1dc1-4f90-a3c7-5429554ff87c","year":2021},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.557702Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:63304fdea3636085d7ce8027e16ec9c0228b488512bf7ab61651b6c2463f2717","observation_id":"9092fd49-3e8f-4d5d-bf33-dfad048c915b","resolution":{"observed_at":"2026-08-15T18:56:36.285159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.502500Z","title":"Adaptive Mixtures of Local Experts,","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.502500Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:c9395b4282c5451a9c989143367bd20b63b91b65deddccddeac1f61b225b9b0d","observation_id":"7fb6d4dd-3d7a-4f01-9608-831fae20b8d9","resolution":{"observed_at":"2026-08-15T18:56:33.502500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.402203Z","title":null,"venue":null,"work_id":"2ab7e0cc-0f1c-4698-9eb3-9d5c7b1d8195","year":2018},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.508108Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:3569fd95ccc5081c821c437ac4a4e8ad7e6dd5182b7aa7bf6e00d94efdd7934f","observation_id":"d96e01f9-83fd-45e3-9e3d-a420b062d60c","resolution":{"observed_at":"2026-08-15T18:56:36.409826Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.379798Z","title":"Simple and Scalable Predictive Uncertainty Estimation using Deep Ensembles,","venue":null,"work_id":"ba24913d-8af8-4bb1-a7e5-8cb6d18fcbf8","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.515969Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:ef1fc3459f47ee4a4ad8d02f00425421d95c349779d559a5d4ba63f66d390fb8","observation_id":"d8a25aba-3119-4757-8a42-74924023118a","resolution":{"observed_at":"2026-08-15T18:56:36.387476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T18:56:33.528103Z","title":"Proximal Policy Optimization Algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.528103Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:d818775f0a05f3d82d2fc4424f3848a1c776bdd9a7aee850752ef3e54c7a3eb4","observation_id":"59274537-557b-46f6-8d5b-51e5f2cfcb86","resolution":{"observed_at":"2026-08-15T18:56:33.528103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.535019Z","title":"Energy- Constrained Safe Path Planning for UAV- Assisted Data Collection of Mobile IoT Devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.535019Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:0f5e44cd600918b6ba0cbe58bea1c464223e6df744f39d76655740983b8226a2","observation_id":"7e891b41-4a91-46f2-adad-fb3ecb4c05fe","resolution":{"observed_at":"2026-08-15T18:56:33.535019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.541356Z","title":"Soft Actor-Critic: Off- Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.541356Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:f1f86218914925b0dd7af6b2a91a7bd5a2a467a9bec543ca6f1680af85e5a55a","observation_id":"446fa816-f283-44b4-9745-82ab8e8fed96","resolution":{"observed_at":"2026-08-15T18:56:33.541356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.546825Z","title":"Addressing Function Approximation Error in Actor-Critic Methods,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.546825Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:18681647da3c3832830faa0fa6f56fc775b738ea846dac58c4506c276953f528","observation_id":"b48263d4-3f0b-47b5-8262-2017ddfce80c","resolution":{"observed_at":"2026-08-15T18:56:33.546825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.308099Z","title":"Hybrid Policy Optimization from Imperfect Demonstrations","venue":null,"work_id":"f59cef86-475b-46bd-b186-98173b57a33d","year":null},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.552602Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:9188d9f7283a3ec8d3287aa0f2cb2dc2e36bb6d158ba0a39f244d886b5c4d7df","observation_id":"b41572be-10d5-46e1-9417-d16a6dd05a29","resolution":{"observed_at":"2026-08-15T18:56:36.317456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:33.563827Z","title":"Explainable Deep Adversarial Reinforcement Learning Approach for Robust Autonomous Driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.563827Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:b4b60030915b74aceddeb36482ccdf3799dc50ece5a8103e4682ebfce08372c5","observation_id":"48565531-8f4a-40e3-b435-95cc3700edd0","resolution":{"observed_at":"2026-08-15T18:56:33.563827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.02533","last_updated":"2017-02-11T00:39:39Z","snapshot_observed_at":"2026-08-16T03:14:49.760924Z","submitted_at":"2016-07-08T21:12:11Z","title":"Adversarial examples in the physical world","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.02533","snapshot_observed_at":"2026-08-15T18:56:33.569294Z","title":"Adversarial examples in the physical world,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.569294Z"},"links":{"cited_paper":"/paper/1607.02533","citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:8dc914bfe72352d3b7154f218175f3ccac53e357c6ac7df52541b96bdaed27c7","observation_id":"2edd9515-e5eb-4ebc-acf8-4ee99160bdb8","resolution":{"observed_at":"2026-08-15T18:56:33.569294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.359853Z","title":"[Online]","venue":null,"work_id":"a8393089-ffa3-4203-b31d-7e87a8a8907d","year":2025},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.522758Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:f6a9a88a3d8befb0cc05492204baecd17c8f61268199f388cb00073df6190f0d","observation_id":"187756f9-232b-48d6-97a0-1953725993e3","resolution":{"observed_at":"2026-08-15T18:56:36.365838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:56:36.423458Z","title":"Available: https://proceedings.neurips.cc/paper_files/paper/2020/hash/d8330f857a 17c53d217014ee776bfd50-Abstract.html","venue":null,"work_id":"b0d11cc8-0933-4037-9716-feb39ce67b1b","year":2020},"citing_paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T18:56:33.495747Z"},"links":{"citing_paper":"/paper/2506.18304"},"observation_digest":"sha256:6f2bf2ea0090cf567b5b9877f4da9f90a96e0b8bd44827776df78b84498c87b2","observation_id":"0eb340f7-cae1-4fd7-8331-db578031af72","resolution":{"observed_at":"2026-08-15T18:56:36.435780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.18304","last_updated":"2025-06-23T05:42:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T03:17:17.853237Z","submitted_at":"2025-06-23T05:42:49Z","title":"Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":40,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 1 inbound Pith citation observation for arXiv:2506.18304."}