{"as_of":"2026-08-06T16:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e45eaa60103f7b773f23a4eedea3e5a58b7958fabb61aae518805c463f945256","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T14:13:18.951079Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T18:37:03.489316Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T03:06:29.991156Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.20102","snapshot_observed_at":"2026-08-03T18:37:03.489316Z","title":"Steerable adversarial scenario generation through test-time preference alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04733","last_updated":"2026-05-28T14:42:29Z","snapshot_observed_at":"2026-08-05T14:12:49.288484Z","submitted_at":"2025-12-04T12:17:25Z","title":"E3AD: An Emotion-Aware Vision-Language-Action Model for Human-Centric End-to-End Autonomous Driving","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T18:37:03.489316Z"},"links":{"cited_paper":"/paper/2509.20102","citing_paper":"/paper/2512.04733"},"observation_digest":"sha256:da4903c8ee6931c702a5c45dc46b6d11ed37c96e05fe8583d6732059adb260de","observation_id":"c2ade741-bd71-42f6-9a97-e89e143b69c6","resolution":{"observed_at":"2026-08-03T18:37:03.489316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"cited_work":{"arxiv_id":"2509.20102","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.20102","snapshot_observed_at":"2026-07-02T03:06:29.991156Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","venue":"cs.AI","work_id":"c902d6ef-b603-4849-9883-d4c4d20c5457","year":2025},"citing_paper":{"arxiv_id":"2606.03678","last_updated":"2026-06-02T14:01:23Z","snapshot_observed_at":"2026-08-06T06:18:54.220724Z","submitted_at":"2026-06-02T14:01:23Z","title":"EvoDrive: Pareto Evolution for Safety-Critical Autonomous Driving via Self-Improving LLM Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T10:21:16.202424Z"},"links":{"cited_paper":"/paper/2509.20102","citing_paper":"/paper/2606.03678"},"observation_digest":"sha256:e0305cb4b63a1d3fa51d1760072371e252b18c41e53884ac1bee6eae0ad7e455","observation_id":"97f9eb0a-d90c-4e22-90f2-15c057003030","resolution":{"observed_at":"2026-07-02T03:06:29.992845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.20102","snapshot_observed_at":"2026-07-11T19:04:23.977767Z","title":"arXiv preprint arXiv:2509.20102 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04451","last_updated":"2026-07-05T18:26:14Z","snapshot_observed_at":"2026-08-06T09:15:06.959441Z","submitted_at":"2026-07-05T18:26:14Z","title":"CCFM: Collision-Constrained Flow Matching for Safety-Critical Scenario Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T19:04:23.977767Z"},"links":{"cited_paper":"/paper/2509.20102","citing_paper":"/paper/2607.04451"},"observation_digest":"sha256:b46dd337e4aaca7c2bb9e90791714d7cc8f0b9a47233db3c38f1b84b4b563af3","observation_id":"32f5e6f3-c04f-4215-93cd-a861f215ec99","resolution":{"observed_at":"2026-07-11T19:04:23.977767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.20102","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Steerable adversarial scenario generation through test-time preference alignment.arXiv preprint arXiv:2509.20102, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/2509.20102","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:715d10829d23b9264808191f96d146df601a48dbd5ebd7c3e3764ec3d81607d5","observation_id":"7a92c527-ae9e-4254-a376-df972b415a06","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.20102/citation-record","integrity":"/paper/2509.20102/integrity","json":"/paper/2509.20102/citation-record.json","paper":"/paper/2509.20102"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.311803Z","title":"write newline","venue":null,"work_id":"8e5fda61-e601-4df4-8204-015bee341570","year":null},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:708c08b225dd59b811fc80f9f5c8359c08df685a0d81bf0ff1bcf387e0c09ed0","observation_id":"96b68671-c7a5-4b99-869f-e7098f405370","resolution":{"observed_at":"2026-05-18T14:16:28.313288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.04836","last_updated":"2023-03-01T22:17:16Z","snapshot_observed_at":"2026-07-06T13:50:57.502239Z","submitted_at":"2022-09-11T10:44:27Z","title":"Git Re-Basin: Merging Models modulo Permutation Symmetries","version":6},"cited_work":{"arxiv_id":"2209.04836","doi":"10.48550/arxiv.2209.04836","metadata_source":"arxiv_reference","pith_arxiv_id":"2209.04836","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"K., Hayase, J., and Srinivasa, S","venue":"arXiv (Cornell University)","work_id":"8c0fbfc8-e48f-47ae-8450-a926e13ba4c5","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/2209.04836","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:4e598f984bf80a99fc905bba68be1a2eb099cdfacc8ffc717e9077e7080153ae","observation_id":"def83f11-7578-417a-8d9f-ce686c4b2ff8","resolution":{"observed_at":"2026-05-18T14:16:27.855345Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An end-to-end curriculum learning approach for autonomous driving scenarios","venue":null,"work_id":"6363a437-a96c-4fab-81b8-b0de52fcc404","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:73ca462dc460cf8ffffff4660d609649428036b4483c10eb7d83e11a00fdbfa9","observation_id":"0c21d985-49eb-4a28-b5c2-e8bbf083077d","resolution":{"observed_at":"2026-05-18T14:16:28.315624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":"2212.08073","doi":"10.48550/arxiv.2212.08073","metadata_source":"pith","pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Constitutional AI: Harmlessness from AI Feedback","venue":"cs.CL","work_id":"faaaa4e0-2676-4fac-a0b4-99aef10d2095","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:217ba274c9aff755cb4112ee6e7c21ab130f9af3e3886d13ecb8fefc76500461","observation_id":"096cb082-a1b7-425f-8831-765cee55cd92","resolution":{"observed_at":"2026-05-18T14:16:27.850639Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T07:38:15.114855+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T07:38:15.114855+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advdo: Realistic adversarial attacks for trajectory prediction","venue":null,"work_id":"976e20aa-9b4a-44b0-872b-0b3a72c8444f","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:7e0d60673cdb1cb981466fb792e9ad8ed7f6a8270d0084eaccfb86ef36d1baa8","observation_id":"4d5e9b7e-b9bc-40d6-be25-89af16a76ded","resolution":{"observed_at":"2026-05-18T14:16:28.320224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with human feedback for realistic traffic simulation","venue":null,"work_id":"7b4be73b-bf52-49ca-99b5-3fe557dd4b1c","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:56c38598df8d0bb60eb952a43b510b2d8b90c1aa387d53b3fd05c222eabd0b57","observation_id":"d515af7c-3b2a-4391-8e87-23af76559141","resolution":{"observed_at":"2026-05-18T14:16:28.318014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safe-sim: Safety-critical closed-loop traffic simulation with diffusion-controllable adversaries","venue":null,"work_id":"bc0bbb75-1738-405e-9c10-6bc349fd99b2","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:89018f2c87aa9adc3c54c830724def36e75b3c19473a53df450dcfea4b111d12","observation_id":"8b1dff08-ee9a-49ad-882b-c4cc72270f38","resolution":{"observed_at":"2026-05-18T14:16:28.322451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02983","last_updated":"2024-10-11T05:32:17Z","snapshot_observed_at":"2026-07-06T18:25:40.229186Z","submitted_at":"2024-06-05T06:26:15Z","title":"FREA: Feasibility-Guided Generation of Safety-Critical Scenarios with Reasonable Adversariality","version":3},"cited_work":{"arxiv_id":"2406.02983","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02983","snapshot_observed_at":"2026-07-02T03:06:29.951549Z","title":"Frea: Feasibility-guided generation of safety-critical scenarios with reason- able adversariality","venue":null,"work_id":"b990d82b-e6da-4ad8-9290-7d349e23ce6c","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/2406.02983","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:ed533d78d9632239b869775d29dd360af266526e64a4486626625c1404366e37","observation_id":"fc4c54ac-658d-497d-892f-12368b2a34f2","resolution":{"observed_at":"2026-05-18T14:16:27.889600Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.03344","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rift: Closed-loop rl fine-tuning for realistic and controllable traffic simulation","venue":null,"work_id":"d2e01296-48a9-4554-9bcd-60c391cc905d","year":2025},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:f37cf5670c8dcf4c24383cb30b0353cd9a60626dcad018060c2e857a91ce5094","observation_id":"8b5c9039-7b4d-4add-80d1-710a9fb27ee9","resolution":{"observed_at":"2026-05-18T14:16:27.877397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-objective optimization","venue":null,"work_id":"4694ce81-31d8-4028-a5bc-e468c777f4c3","year":2016},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:c4e2cfb27bdf59f19ea15b029d04362f515211f9748efaa9a3959c572504c675","observation_id":"c42e6b52-7812-4170-87f6-29c49d1e5ed8","resolution":{"observed_at":"2026-05-18T14:16:28.288497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to collide: An adaptive safety-critical scenarios generating method","venue":null,"work_id":"b36c65fe-5747-4439-9583-4eeb8b3348cb","year":2020},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:cac177ce7e985d4209405deb575be95837c4e21df15ddd7f817db861fc60bec4","observation_id":"ab5be468-afd4-4c70-9d84-b5725a323113","resolution":{"observed_at":"2026-05-18T14:16:28.276781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on safety-critical driving scenario generation—a methodological perspective","venue":null,"work_id":"63f38c96-b03e-4a03-a64f-21e7d29cbf35","year":2023},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:694b5d535bb5fc81bfd9968421fe2d66ad0a7056a01943a3de7bdc57d5fafee7","observation_id":"c11763fe-be53-4a6c-966d-b0247cfe37c2","resolution":{"observed_at":"2026-05-18T14:16:28.267222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large scale interactive motion forecasting for autonomous driving: The waymo open motion dataset","venue":null,"work_id":"45574927-2bb2-4290-8663-bbc6926ae5bb","year":2021},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:ab8f3f6a6bd80cfbd8e816a50c10d734473169f0dd17a7042918dd0c60a34a46","observation_id":"357d0ebf-bdab-420e-828a-ea6427881cbf","resolution":{"observed_at":"2026-05-18T14:16:28.232353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intelligent driving intelligence test for autonomous vehicles with naturalistic and adversarial environment","venue":null,"work_id":"06b2dcab-3037-48a8-8b2b-c57ae45b5417","year":2021},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:cf46239f9edbb57852cad9bf4f58005a30237b13c2ec4763aabc1361b746fc8d","observation_id":"6f6ae13e-4f45-4bac-8f15-8ed3bb8628e0","resolution":{"observed_at":"2026-05-18T14:16:28.254471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dense reinforcement learning for safety validation of autonomous vehicles","venue":null,"work_id":"01940b41-5882-429c-85bb-5a87dad6db30","year":2023},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:06444a80bbb043917915c21446d861955459a94d878734bd1b14e0aa4a05f65b","observation_id":"1d00c788-461e-45b9-815b-faaeee64b89f","resolution":{"observed_at":"2026-05-18T14:16:28.247024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Linear mode connectivity and the lottery ticket hypothesis","venue":null,"work_id":"359e4f21-aada-4697-8d91-71dfd427f4c5","year":2020},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:77d741ae6f75c0df20a0df8219dea5171a2248b36e22d7d05562780ddcd99435","observation_id":"25474396-0864-43f0-822c-da59bd6bf09f","resolution":{"observed_at":"2026-05-18T14:16:28.242004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Addressing function approximation error in actor-critic methods","venue":null,"work_id":"e3bb0585-245e-412a-912f-b92da01426a6","year":2018},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:808f0d018f7320fe8a855ee996ea097d64622bf44ba194e8e361f5224162b374","observation_id":"335dbcfd-3fde-4b09-b7fc-528a046b0121","resolution":{"observed_at":"2026-05-18T14:16:28.279572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Densetnt: End-to-end trajectory prediction from dense goal sets","venue":null,"work_id":"6e79fb0c-1113-4d59-906f-89842445d1bf","year":2021},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:35cc0b04ae4c592056e972ae08930cc583164605b30aa5ff5876bb9168c11d24","observation_id":"8044280c-04d0-4c01-852b-43b4e3118188","resolution":{"observed_at":"2026-05-18T14:16:28.227749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"King: Generating safety-critical driving scenarios for robust imitation via kinematics gradients","venue":null,"work_id":"a162136b-15e2-4ed7-a231-ec31ec98a024","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:8c6777aa4124988b993f2c8fa1326b9ea04fe1303a2c381f72b146a25611a298","observation_id":"e7c3f884-3d5d-434b-9319-be65a634b306","resolution":{"observed_at":"2026-05-18T14:16:28.286090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04089","last_updated":"2023-03-31T15:27:01Z","snapshot_observed_at":"2026-08-03T22:12:27.993418Z","submitted_at":"2022-12-08T05:50:53Z","title":"Editing Models with Task Arithmetic","version":3},"cited_work":{"arxiv_id":"2212.04089","doi":"10.48550/arxiv.2212.04089","metadata_source":"pith","pith_arxiv_id":"2212.04089","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Editing Models with Task Arithmetic","venue":"cs.LG","work_id":"28899541-90d9-4f1f-b938-8b0f6410c843","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/2212.04089","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:062071498289d6ab0ecc442037f4b16053b75fdc48e1f3ebd50ae4b0fded3a5e","observation_id":"d1a9eeff-4119-4adb-9ab7-ba5872437a4d","resolution":{"observed_at":"2026-05-18T14:16:27.864655Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep learning without poor local minima","venue":null,"work_id":"eb5437e6-70af-4b12-b478-d8d4a9a4d58c","year":2016},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:78c0573373c3dc052e0532ff2b836703ef30a4e4784909cf0afe8eb9b5d4dbf2","observation_id":"16b5cfc4-7d22-43a2-8ad1-db5d19f394e0","resolution":{"observed_at":"2026-05-18T14:16:28.310501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training adversarial agents to exploit weaknesses in deep control policies","venue":null,"work_id":"38aec7d4-1abf-412f-af18-2e4ef5b7e8ee","year":2020},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:28d5c20bbe2d2cb597d557a1b55cf81f69750af75ad1cd6741ea8cfcfa18b66f","observation_id":"c2c05b3d-2c6e-4ac6-963d-41d57077597a","resolution":{"observed_at":"2026-05-18T14:16:28.308204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metadrive: Composing diverse driving scenarios for generalizable reinforcement learning","venue":null,"work_id":"c6068495-1092-4b97-ae55-1db885f7891d","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:a7a35accfdd00676115e213ad5e9aa03c57d3b0e01b6cb979874f6b8924ddf66","observation_id":"c58a82aa-f9b1-461c-99f0-dc4cfe5b0505","resolution":{"observed_at":"2026-05-18T14:16:28.303294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Curse of rarity for autonomous vehicles","venue":null,"work_id":"3cc54157-37f8-4a78-b661-dd0990ddebee","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:363bf5dca27bbcfa25316dc9db6e7c9a4517bdfe90bf5b5501690beb573582d8","observation_id":"01b8332f-e789-46b6-9b42-4f6eb318d573","resolution":{"observed_at":"2026-05-18T14:16:28.300824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01233","last_updated":"2025-03-03T06:56:39Z","snapshot_observed_at":"2026-07-06T20:45:32.493589Z","submitted_at":"2025-03-03T06:56:39Z","title":"PEO: Improving Bi-Factorial Preference Alignment with Post-Training Policy Extrapolation","version":1},"cited_work":{"arxiv_id":"2503.01233","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01233","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Peo: Improving bi-factorial preference alignment with post-training policy extrapolation","venue":null,"work_id":"3a2bbb5f-b842-45d4-bb40-9ff452098db5","year":2025},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/2503.01233","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:aef5e3575e5ed0ae4bd490cda411773c1779b1b1ed70162cebb6521f3c63d9c1","observation_id":"cf08f3d4-cd6d-489e-b6bf-02136cbba05d","resolution":{"observed_at":"2026-05-18T14:16:27.893560Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved robustness and safety for autonomous vehicle control with adversarial reinforcement learning","venue":null,"work_id":"f2495c2c-bc53-491f-ac40-580260a199ec","year":2018},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:49e22d4deb689f008e433ba61a439e36ea67043ce07d7edb7785196bb58069b8","observation_id":"b0b1e676-5486-4428-a14e-29bdc19edebb","resolution":{"observed_at":"2026-05-18T14:16:28.298086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bayesian fault injection safety testing for highly automated vehicles with uncertainty","venue":null,"work_id":"59aebcd1-2855-4584-9880-b857f18e5303","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:de777150a270a100f7db9780be0fea4adac117101d90a954f20cc531e24444ca","observation_id":"05f1e37f-feed-47e8-a188-31fddd6c8657","resolution":{"observed_at":"2026-05-18T14:16:28.295709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llm-attacker: Enhancing closed-loop adversarial scenario generation for autonomous driving with large language models","venue":null,"work_id":"0a956b62-1eb3-4126-b1ac-dbb6dbfacd4b","year":2025},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:45bf8c757dfed612596ba07a799d88eacda49e39b24bf5f4b3736fc83a12b401","observation_id":"a889edac-d8cc-4f03-a555-2cd34d187f38","resolution":{"observed_at":"2026-05-18T14:16:28.293190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00972","last_updated":"2025-07-15T07:52:46Z","snapshot_observed_at":"2026-08-04T12:17:34.551277Z","submitted_at":"2025-05-02T03:22:00Z","title":"Seeking to Collide: Online Safety-Critical Scenario Generation for Autonomous Driving with Retrieval Augmented Large Language Models","version":2},"cited_work":{"arxiv_id":"2505.00972","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00972","snapshot_observed_at":"2026-07-09T05:46:01.467877Z","title":"Seeking to collide: Online safety-critical scenario generation for autonomous driving with retrieval augmented large language models","venue":"cs.AI","work_id":"c868772c-409e-486a-8f06-62e55aeeece0","year":2025},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/2505.00972","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:681bb3375b9f70b36b849109fbdcd4b10bcbea77d4b80a1b5beb7bedd4735724","observation_id":"ff35c4a7-a63a-4448-9b18-674bf99cfe5f","resolution":{"observed_at":"2026-05-18T14:16:27.881808Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring the roles of large language models in reshaping transportation systems: A survey, framework, and roadmap","venue":null,"work_id":"fd22d348-ce07-40c8-8a24-63ff6584aff5","year":2025},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:eeb6d7b6474eadc2560bd2939080364595f9c6c108d88e84e18cc84c22295b8d","observation_id":"35ceeed8-ad39-4dd7-adc4-4c4ec2bd5524","resolution":{"observed_at":"2026-05-18T14:16:28.290875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:33:36.354288Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"ee9aa0b5-5aed-4ffd-b640-d1eec1f8e893","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:ba3468c437a037be95a28ab3901eeb3be1d380ad9c612f9d36a57d91caca83a0","observation_id":"2241e421-f5a5-4c84-a76d-9c091955c753","resolution":{"observed_at":"2026-05-18T14:16:28.283429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.20804","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aed: Automatic discovery of effective and diverse vulnerabilities for autonomous driving policy with large language models","venue":null,"work_id":"dee5ea6b-48d3-4002-a585-8ec84e57549e","year":2025},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:12e062bc9dfb3265065b4b7f31ab3c2c72c702ac0637c50ea7d31416f011246b","observation_id":"76e709db-85fa-4415-8668-cb68421e97eb","resolution":{"observed_at":"2026-05-18T14:16:27.885795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"601c9869-f95c-4545-8f96-4c2702788349","year":2023},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:4bb119e811d509fa22e5a0e919d6ddeadc9152e0019dee334af8470d78d56904","observation_id":"03f6a91a-88f6-42bf-8037-61de7043c64b","resolution":{"observed_at":"2026-05-18T14:16:28.273644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rewarded soups: towards pareto-optimal alignment by interpolating weights fine-tuned on diverse rewards","venue":null,"work_id":"76373c99-8f40-4c0a-9e60-8460f31c55f0","year":2023},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:a1d5d4407d9d9b56042c98c324295ae83de215dc7460308aa35652b56143472a","observation_id":"f418556b-74b4-4c23-9146-abd7415a1a66","resolution":{"observed_at":"2026-05-18T14:16:28.270741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Goose: Goal-conditioned reinforcement learning for safety-critical scenario generation","venue":null,"work_id":"addeaee8-0b42-4e16-8099-0c99962cec47","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:a7bbfd1905f236752e583b10fd988b52331db7aa791065f77a0bbd8d08f89f82","observation_id":"b1c459b1-2c32-45d8-a01d-77a9adc57eb2","resolution":{"observed_at":"2026-05-18T14:16:28.264170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adversarial and reactive traffic agents for realistic driving simulation","venue":null,"work_id":"132abcf2-ba2c-4b0e-b37b-7c7fa6889046","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:f2b5b1d7b34509bf2068d92ad7117543b92c04084782bcff32d7ba7f3876eb32","observation_id":"7958ea57-5e67-45aa-8bb8-ecbdc3439eaa","resolution":{"observed_at":"2026-05-18T14:16:28.260614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generating useful accident-prone driving scenarios via a learned traffic prior","venue":null,"work_id":"deab0c59-e727-4423-b2ff-7e5f03e2d35a","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:581efa3e9b8315b07dd0260af0280a8479a9e71e25c977918d591efbe9c52790","observation_id":"02b2cbf0-1e42-4cbc-88db-222aff74edb6","resolution":{"observed_at":"2026-05-18T14:16:28.257709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:ec0c3573e1fb1fa8d98dedb9bf9e15c504812b097faf2a1c30cf6fbefedbeed0","observation_id":"f13a1cf6-f82d-49ef-a3b4-0b10872089b3","resolution":{"observed_at":"2026-05-18T14:16:27.873340Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoding-time language model alignment with multiple objectives","venue":null,"work_id":"81e0bc6d-555e-41f0-83b8-0dab942bfaaf","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:17a4eb2b0215083262251ffa86b64a9abacab0c350cdc1a2a7799cc2e2e5ac3b","observation_id":"3b53b18f-0bc8-470a-bbf9-8219bff3a079","resolution":{"observed_at":"2026-05-18T14:16:28.252041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seal: Towards safe autonomous driving via skill-enabled adversary learning for closed-loop scenario generation","venue":null,"work_id":"666e9c29-33e1-4c18-ac38-e0a91ea1c854","year":2025},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:baf86f270bfadd4bd32f21d1f483adca6cf50f752836e82bdbfae6b597108838","observation_id":"03d3adde-b8ad-4801-84f2-88aec287624b","resolution":{"observed_at":"2026-05-18T14:16:28.249458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.10654","last_updated":"2019-05-25T01:00:19Z","snapshot_observed_at":"2026-07-06T07:41:35.621386Z","submitted_at":"2019-03-26T02:15:59Z","title":"Failure-Scenario Maker for Rule-Based Agent using Multi-agent Adversarial Reinforcement Learning and its Application to Autonomous Driving","version":3},"cited_work":{"arxiv_id":"1903.10654","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.10654","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Failure-Scenario Maker for Rule-Based Agent using Multi-agent Adversarial Reinforcement Learning and its Application to Autonomous Driving","venue":"cs.LG","work_id":"08b61b6d-8a20-4348-93d4-ecb068962aae","year":2019},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/1903.10654","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:cf9229c74ca458fb881bf357004dfc3ce0b3e3d9ab9de6abdb0fd091a8bb9ffa","observation_id":"4a4d8d4c-d679-4a56-9af5-87acd104daa7","resolution":{"observed_at":"2026-05-18T14:16:27.868996Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advsim: Generating safety-critical scenarios for self-driving vehicles","venue":null,"work_id":"1746edc3-4011-40b8-ac0c-1c242f4308d7","year":2021},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:25a171f01077cd6af155fc1d4b6e47176cee9b08f9f17be4e00336e185419449","observation_id":"9dbebecd-1f25-4912-aea5-1798453a85dc","resolution":{"observed_at":"2026-05-18T14:16:28.244751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time","venue":null,"work_id":"f3438757-751a-4ba2-bc54-e039ed203798","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:42f122a5c21a692af538724c9a85289b8a0bb14e18b3b005edf3f8a0534cbb21","observation_id":"a562d042-76b7-413f-8d9b-0211b5c91d2b","resolution":{"observed_at":"2026-05-18T14:16:28.237436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10762","last_updated":"2025-06-02T12:51:19Z","snapshot_observed_at":"2026-07-06T20:37:05.273140Z","submitted_at":"2025-02-15T11:00:36Z","title":"Bone Soups: A Seek-and-Soup Model Merging Approach for Controllable Multi-Objective Generation","version":2},"cited_work":{"arxiv_id":"2502.10762","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.10762","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bone soups: A seek-and-soup model merging approach for controllable multi-objective generation","venue":null,"work_id":"69e048c5-f338-43fa-9654-14d65e085b76","year":2025},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/2502.10762","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:3365f3873d34d9c89242e4a3692d52ae6589deafa5d3448bfaaa55153627d766","observation_id":"c7129aca-84b8-46e7-91ff-369caff7cbdc","resolution":{"observed_at":"2026-05-18T14:16:27.860144Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advdiffuser: Generating adversarial safety-critical driving scenarios via guided diffusion","venue":null,"work_id":"641d8430-8646-4417-b395-03c3539cad7b","year":2024},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:41d3790ae18f55cacf96ce946eb9684033f431e37a6799354e0efe5048dd27fa","observation_id":"13ba1e73-1d82-4481-802a-c89fb16f6873","resolution":{"observed_at":"2026-05-18T14:16:28.234990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safebench: A benchmarking platform for safety evaluation of autonomous vehicles","venue":null,"work_id":"ff7ad986-893c-4a14-9824-6737fe0d0b69","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:261950a0af8d30f54bdd6b5e89e17ee37ca7577e426c5dacc5f5ee5cf60b960d","observation_id":"81d0dab7-167b-4dc5-8aa6-813ffcbfff90","resolution":{"observed_at":"2026-05-18T14:16:28.230003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffscene: Diffusion-based safety-critical scenario generation for autonomous vehicles","venue":null,"work_id":"2681875c-9a1f-4362-9d96-cbcebb4a0f2e","year":2025},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:9ed026e1717daa8cb44cad0186c4f16e51f7bf1457a0159aabe81a6495825874","observation_id":"e7c2186f-204c-4dff-8c34-86ae97ce7760","resolution":{"observed_at":"2026-05-18T14:16:28.225173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cat: Closed-loop adversarial training for safe end-to-end driving","venue":null,"work_id":"53dcf0f9-368d-4fd0-981f-fcbb91624d80","year":2023},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:5e1f794e8a31a4adce52a6ee1c09f9b05b16f7d860f9c77c319181cef3961583","observation_id":"7bb4cd7a-608a-4e77-9f7a-65a2043589fd","resolution":{"observed_at":"2026-05-18T14:16:28.222414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On adversarial robustness of trajectory prediction for autonomous vehicles","venue":null,"work_id":"78471dd6-52bf-4ae0-a925-3028df4b4550","year":2022},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:73e53a0b8540d1207a850ea1bd1e40f85ff82f213fb81d0ab3ec8b87e8986a36","observation_id":"c6bd32d4-1a37-4e29-bfa1-02ced2f85a9b","resolution":{"observed_at":"2026-05-18T14:16:28.219846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language-guided traffic simulation via scene-level diffusion","venue":null,"work_id":"e2679722-5856-4c69-a1c6-a93cc60dd39c","year":2023},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:9bfe50f31988f699c1c63a0468c0a581a345c1d763f50ba6c144398080cedc39","observation_id":"1df07e83-9706-43e6-aeef-1742d58fd650","resolution":{"observed_at":"2026-05-18T14:16:28.239779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T23:55:44.012295Z","title":"@esa (Ref","venue":null,"work_id":"b058608d-98d0-4821-a4ae-403d2b7cd411","year":null},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:773de6d54c807ae4cb9e81e8cefa78d3676c08b1cd91b1a4b61e3ad2b2a2c2cc","observation_id":"3a9a0b49-45e2-423d-9ff5-0bc9e31bfdf4","resolution":{"observed_at":"2026-05-18T14:16:28.305921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.337191Z","title":null,"venue":null,"work_id":"ea79bfb8-d434-45e9-8607-416d3839ec5c","year":null},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:760ae4811bcd168273543a40c1fc9d007397f90687664f2868159bb9ae6717d3","observation_id":"9f149dd8-9b2f-4656-94f8-c4ad5481fc60","resolution":{"observed_at":"2026-05-18T14:16:28.217463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12178","last_updated":"2025-02-14T05:29:43Z","snapshot_observed_at":"2026-08-03T00:42:34.461696Z","submitted_at":"2025-02-14T05:29:43Z","title":"Direct Preference Optimization-Enhanced Multi-Guided Diffusion Model for Traffic Scenario Generation","version":1},"cited_work":{"arxiv_id":"2502.12178","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.12178","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f0e895fb-7a82-4a21-8985-83d04b7ea46c","year":2023},"citing_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-18T14:13:18.951079Z"},"links":{"cited_paper":"/paper/2502.12178","citing_paper":"/paper/2509.20102"},"observation_digest":"sha256:e560a66997c700c69ef9249a5aa119b8be699df94048e95b18b336ddbbeaf985","observation_id":"08e15cd9-f752-430e-b373-41714edb1ff9","resolution":{"observed_at":"2026-05-18T14:16:27.897502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":11,"verified_fuzzy":40},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 4 inbound Pith citation observations for arXiv:2509.20102."}