{"as_of":"2026-08-06T15:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3c51744eb8978a37a77e9a02f47821265cc33215ae6626a892153788e1b83c42","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T10:22:08.922396Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.10630/citation-record","integrity":"/paper/2607.10630/integrity","json":"/paper/2607.10630/citation-record.json","paper":"/paper/2607.10630"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"A comprehensive survey of multia- gent reinforcement learning.IEEE Transactions on Systems, Man, and Cybernetics, Part C (Applications and Reviews), 38(2):156–172, 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:a30eb7dae7d14cf2a2e31aefb8c32ea4819b4a0d90e6f915eff2f5bc9bc11409","observation_id":"321f9089-083b-497f-95ef-4144033a459e","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11810","last_updated":"2022-02-04T02:50:02Z","snapshot_observed_at":"2026-08-02T23:58:09.453937Z","submitted_at":"2021-06-22T14:24:55Z","title":"NuPlan: A closed-loop ML-based planning benchmark for autonomous vehicles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11810","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"nuplan: A closed-loop ml-based planning benchmark for autonomous vehicles.arXiv preprint arXiv:2106.11810, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/2106.11810","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:b70aa24c962092245a986ee1256d58a7931ff04c3528940e33263688f87b8b95","observation_id":"bd757bb4-8717-4ad2-a9e6-6ac6fb4270aa","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Reinforcement learning with human feedback for realistic traffic simulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:76fe75cc45cf312378d8feb3fbeae8ca748a0abab046ba1c6474e6407ebe0685","observation_id":"9c224c84-3df3-481f-8b90-4ac404bdc213","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Safe-sim: Safety-critical closed-loop traffic simulation with diffusion-controllable adversaries","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:caebb683500cd9dd62141defe61c864cf94883901cf61122ca35558d1aedc93f","observation_id":"bd7db8e7-3f78-4448-9232-211278db1a06","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Rift: Group-relative rl fine-tuning for realistic and controllable traffic simulation.arXiv preprint arXiv:2505.03344, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:db96eb7563fa82e80866adc37abbd5aef252176929d83137cc61c2901e15cf32","observation_id":"d320f673-47b4-4b79-b7fc-c11bfc73f831","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14327","last_updated":"2024-04-22T16:38:41Z","snapshot_observed_at":"2026-08-01T23:46:13.963475Z","submitted_at":"2024-04-22T16:38:41Z","title":"PLUTO: Pushing the Limit of Imitation Learning-based Planning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14327","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Pluto: Pushing the limit of imitation learning- based planning for autonomous driving.arXiv preprint arXiv:2404.14327, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/2404.14327","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:6817968cd0d6783acbf9ef4fefb6610966dcf78c6cf8a07fb1e680815f20ecc4","observation_id":"2e4d68c9-7a8d-408d-afaa-0ca9674fbcf1","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Rethinking imitation-based planners for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:b06f7fec264eade3df6f19b9fea09122aa34cdb32f84d20fe98865e78556a7ca","observation_id":"e0613c43-f0fa-412c-af5a-3c897ab9ff72","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00141","last_updated":"2018-02-13T16:33:55Z","snapshot_observed_at":"2026-07-06T06:07:09.962753Z","submitted_at":"2017-10-31T23:09:08Z","title":"Training GANs with Optimism","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00141","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Training gans with optimism.arXiv preprint arXiv:1711.00141, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/1711.00141","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:103e161d3d61e3228169a19017ad14916c5d76ddfcd482e9e798475d0992a27d","observation_id":"066d82d0-58fc-480d-8b25-9d3b17c4d125","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Parting with mis- conceptions about learning-based vehicle motion planning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:532739aa2ec8afe2d686eee249dca2e7316ffcb8ecf059a72e3a8eb34be5750f","observation_id":"3ddaeb24-46a3-40fe-ba62-560f08f11f46","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Artemis: Autoregressive end-to-end trajectory planning with mixture of experts for autonomous driving.IEEE Robotics and Automation Letters, 11(1): 226–233, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:6ad70c50cd04b12d315edcdd5b82beff597a152a62378c326fd533ca19d720b5","observation_id":"37de8caf-59e8-476d-a86b-e0eb8d30dae0","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Intelligent driving intelligence test for autonomous vehicles with naturalistic and adversarial environment.Nature communications, 12(1):748, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:e38492f39d0b4a5b1da56c4d90227fac377e7c0dde24d79bb8b18c6cf1019192","observation_id":"99592923-0e7e-438c-b472-fe66e85f939b","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Dense reinforcement learning for safety validation of autonomous vehicles.Nature, 615 (7953):620–627, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:97c5e42207a81d1075574c43d6b81b8c58b29e75494dbbb01038c39fa949f7eb","observation_id":"7d0cc415-ddff-4f0a-8f7e-c70b0c61e829","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Breaking through safety performance stagnation in autonomous vehicles with dense learning.Nature Communications, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:1a7de3cb5efedf229e890013eeda44a52d2b65508e10aaed000cd0bd45b3b06a","observation_id":"123e2a70-0b74-4722-b69e-86e08609df01","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Counterfactual multi-agent policy gradients","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:feff7a46480dadbec3516537873af4ab782017584781900f173b5d1aba9cc9a7","observation_id":"4628c178-f537-4642-bc9c-3d39ff973857","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Foundation models in autonomous driving: A survey on scenario generation and scenario analysis.IEEE Open Journal of Intelligent Transportation Systems, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:7e616bdfe20421e092abafc206188589a6de7b061f86bde1705afe1707a65b99","observation_id":"8f4e4bbb-f234-49d3-9b08-8ffe450062f8","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Variance reduction techniques for gradient estimates in reinforcement learning.Journal of Machine Learning Research, 5(Nov): 1471–1530, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:e2cf3935118ff9ae10cc06aa3c6f2221d656d7d16c709787a3c97b569e32d4ea","observation_id":"6ba36404-4b44-4b75-bf62-44bcf5a9247c","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Can vehicle motion planning generalize to realistic long-tail scenarios? In2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), pages 5388–5395","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:35c11c512e441c00722d3ca35d24799797c45868aa47c05e10d1a8ea9faf40bb","observation_id":"98eee0cb-3015-4926-8af4-d5f708a127cc","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"King: Generating safety-critical driving scenarios for robust imitation via kinematics gradients","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:2f6bcf4430b8afa854d1daae32fe99fbb6e4d5ba03ba257bd9b22963b48d121c","observation_id":"4adf986f-a5c7-4610-b180-b812633c7125","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Solving motion planning tasks with a scalable generative model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:f723661d332627b59e6da007ee63c98c010f8d889c37c2389572ef833ccfa25c","observation_id":"4b15b28d-4e43-4635-a43f-b25648193ddb","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Gameformer: Game-theoretic modeling and learning of transformer-based interactive prediction and planning for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:a398ac29f6087f39b0cb2f793cfc61f8e7c656b2dbd3f3a3a2d0c0b5433c6c7b","observation_id":"00ed0c52-cdf5-4fa1-91bd-69524ca95813","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Gen-drive: Enhancing diffusion generative driving policies with reward modeling and reinforcement learning fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:e4f511d68d0475ebb158997acbb04903a277b64627404f94b7245d3d215421f3","observation_id":"0f61e445-d593-4277-8f05-a95a3566c905","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Approximately optimal approximate reinforcement learning","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:8f1176fdedfbc9177d01bf07347411c7d9e1ac4494829e59dc4d687ec1d17e47","observation_id":"2d9c9bd4-626c-43ae-a5aa-07f7cb1b4754","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Beyond behavior cloning in autonomous driving: a survey of closed-loop training techniques.Authorea Preprints, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:6322768c63a0934d70f2b719f4a4b18460b0800baf330713993e39954cd79575","observation_id":"a708a591-4dcd-4842-b85b-ebd4ee3d31d3","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Plannerrft: Reinforcing diffusion planners through closed-loop and sample-efficient fine-tuning.arXiv preprint arXiv:2601.12901, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:df360bde43ec3b896647fa046d41b292b81357cc7effd76f3bb7396477690cd2","observation_id":"b8a5b70e-387b-4fc4-8ca1-829cc517e1df","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Curse of rarity for autonomous vehicles.nature communications, 15(1):4808, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:f800327f21fe34947b3959230a07f941e54254306fdb8cb0a7c8dccbfd034550","observation_id":"003f9d1b-9f34-4a2d-8566-d4fe067d065f","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Adv-bmt: Bidirectional motion transformer for safety-critical traffic scenario generation.arXiv preprint arXiv:2506.09485, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:4033168a938fcb27dfcf5d7203bb995d76eefa8709b10ecd90254ec2be24353d","observation_id":"956d03d0-a960-423d-ba01-3c51b0155913","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Llm-attacker: Enhancing closed-loop adversarial scenario generation for autonomous driving with large language models.IEEE Transactions on Intelligent Transportation Systems, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:29a939b2d6413d197c6d104bc18081cb64ddd0e93cc0684698cb97023b403e9e","observation_id":"e5bd4a86-69fb-4704-8f5e-14bfd5b93437","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"The numerics of gans.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:f677a063ecda554507c9d9db2b317ee7f04c7af44051edc7525608ee9ea514bd","observation_id":"5349a390-d4e3-4fca-9512-1a4f8245fa82","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20102","last_updated":"2026-02-08T14:07:58Z","snapshot_observed_at":"2026-08-02T08:33:02.429820Z","submitted_at":"2025-09-24T13:27:35Z","title":"Steerable Adversarial Scenario Generation through Test-Time Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.20102","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Steerable adversarial scenario generation through test-time preference alignment.arXiv preprint arXiv:2509.20102, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/2509.20102","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:715d10829d23b9264808191f96d146df601a48dbd5ebd7c3e3764ec3d81607d5","observation_id":"7a92c527-ae9e-4254-a376-df972b415a06","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Adv-0: Closed-loop min-max adversarial training for long-tail robustness in autonomous driving","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:9500163181aacb27600fad4cd95f622fbac98dd055ebe7ff0f57c2ad4512672f","observation_id":"04d4b13b-4f96-48b7-acde-a2de901ebb6c","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Advancing multi-agent traffic simulation via r1-style reinforcement fine-tuning.arXiv preprint arXiv:2509.23993, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:36aadcdaab0b8ea20a32629cda4d8672c7f28fac231791a1445bde43333be179","observation_id":"90ac7391-8989-498e-9fa7-dac15a63c501","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Improving agent behaviors with rl fine-tuning for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:5d61da42a323b9ecf9d595d48ca344cba008dd5dfae7f4a73adef39118097889","observation_id":"60f21c84-cb1e-4530-8369-4443545d5ac7","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04535","last_updated":"2024-04-14T22:51:18Z","snapshot_observed_at":"2026-07-06T16:58:27.612525Z","submitted_at":"2023-12-07T18:53:27Z","title":"Trajeglish: Traffic Modeling as Next-Token Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04535","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Trajeglish: Traffic modeling as next-token prediction.arXiv preprint arXiv:2312.04535, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/2312.04535","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:f7d19bb0fcf53dd8ecc87e6e6cc1fc7deaecf3285c6d6e1fe724fbc8caa9b032","observation_id":"49e063c5-649e-4a6c-8952-3ce86a26b5eb","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Generating useful accident-prone driving scenarios via a learned traffic prior","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:8e5c2ec2fbba2a956be87b8cdb7c958c54c3dc5a126e5f896e1ebf54f43ebe24","observation_id":"74cb9b4a-eac8-4597-b9d1-343f09109855","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Optimization of conditional value-at-risk","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:82aa42238795cd2e7f96ada90ed4cc97c5bc6eead5b26a59d2c3c8f10cf969cb","observation_id":"4a1fd4dd-c60e-47ff-813e-1531ec603ba8","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Urban driver: Learning to drive from real-world demonstrations using policy gradients","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:e7967a8f667f3075ebd2024754ae25d3fb561c27f1659219b62e40f2ee52b346","observation_id":"ea798b9c-08c9-4e14-99a1-fa1776f9828a","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Trust region policy optimization","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:5eb78908edb8651b8dc99413555e311534e452028251e003df1c3f34dae9d396","observation_id":"572122c2-2471-4b16-a8c3-47ee08cb1a3c","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Motionlm: Multi-agent motion forecasting as language modeling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:365b6fa5fcc47d0a600817db334a83ae224565f00a9e422c35825aa75d35a1e8","observation_id":"33b5e601-1f74-4521-abff-20376574f704","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:7fc39a8e903b4713b243ee0f08a8de08498388a2b21c7f550e3d16e08eb58524","observation_id":"08bb54b0-62ff-4be9-b0ab-aac6fe6f954c","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Seal: Towards safe autonomous driving via skill-enabled adversary learning for closed-loop scenario generation.IEEE Robotics and Automation Letters, 10(9):9320–9327, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:f888487fdc2a29ff977c70076e7c8707bb1bfd28cc64f42425d9604978ea3533","observation_id":"903b832a-bf37-415b-9ed7-b75974613e76","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19620","last_updated":"2024-02-28T07:37:51Z","snapshot_observed_at":"2026-07-06T16:40:31.491333Z","submitted_at":"2023-10-30T15:12:41Z","title":"Large Trajectory Models are Scalable Motion Predictors and Planners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19620","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Large trajectory models are scalable motion predictors and planners.arXiv preprint arXiv:2310.19620, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/2310.19620","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:345984d5a551bef6f5f92bd3fed6436f9b6aa0a62895a90fc40b09b8ea2814a3","observation_id":"02d20eb9-5c0e-4e2e-80c4-12eb2bc818e2","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Flow matching-based autonomous driving planning with advanced interactive behavior modeling.arXiv preprint arXiv:2510.11083, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:e5984221b22c7ce412f3b8c8684048ccce30b701732f408e18d94621e0ce2502","observation_id":"da7d93c8-fb70-4352-83f7-dd2175a62713","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17659","last_updated":"2026-06-02T02:54:45Z","snapshot_observed_at":"2026-08-04T03:33:15.756302Z","submitted_at":"2025-05-23T09:22:19Z","title":"Plan-R1: Safe and Feasible Trajectory Planning as Language Modeling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17659","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Plan-r1: Safe and feasible trajectory planning as language modeling.arXiv preprint arXiv:2505.17659, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/2505.17659","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:242159a8eb41f8e0dce1ec6c17dce910577390c887b92675641cf1021f07753c","observation_id":"ce0c139a-c412-4198-91b8-a4ffaedc0b4d","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Motion planning for autonomous driving: The state of the art and future perspectives.IEEE Transactions on Intelligent Vehicles, 8(6):3692–3711, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:08cc0ddf4f76c74b046d20a258c303573f5ec1ac6e8875bdb25f7b1522bf9ba7","observation_id":"0b1cd810-a684-497b-bcd7-1b867e495bc2","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Advsim: Generating safety-critical scenarios for self- driving vehicles","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:2e549d32125b1006b378a667b02a3aaf83a7f8076f1aec9ed2b009e8f2c94524","observation_id":"4939d329-be0f-49cc-bb06-8b715a518ae8","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Smart: Scalable multi-agent real-time motion generation via next-token prediction.Advances in Neural Information Processing Systems, 37:114048–114071, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:3db78dca14da0c547826675d028bed0046bdeb9e5d425a65e344760e121e12ce","observation_id":"1cf38c5b-beb7-4d03-853b-12576071ade7","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Diffscene: Diffusion-based safety- critical scenario generation for autonomous vehicles","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:da82e7e62828a99824723e0a112f2c87ee90ded20b5ffcc5be628421e7686e2d","observation_id":"be889e97-a01b-4611-bae9-f7c82f5ef1b6","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Dap: A discrete-token autoregressive planner for autonomous driving.arXiv preprint arXiv:2511.13306, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:7dc6779a8ba11c5879eef004d6e9e2954b085762a2026cf844b754af6450e03a","observation_id":"2dfb0e97-afd3-43ae-8333-6be8b692f659","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Carplanner: Consistent auto-regressive trajectory planning for large-scale reinforcement learning in autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:09f8202a395e4526b839896d40c68a6ec62a1268d2810697e0f1b7947810c0f2","observation_id":"9e5c05a6-eea7-4e6d-a928-de1daf92bea8","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Epona: Autoregressive diffusion world model for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:00c9bf228d9213a8bb36fad62b00e1e3521787324490e64bf1de1bcba0c1cd2d","observation_id":"2ae657a7-ede1-44c9-a9cd-c80546993300","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Cat: Closed-loop adversarial training for safe end-to-end driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:aa9515cd166694d18e0b9fc9ee483389eeaa0a578d4f06e89ea69d503aaf02eb","observation_id":"6fd8628e-4bdd-4dfe-9145-5fd09abb076b","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Closed-loop supervised fine-tuning of tokenized traffic models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:fb7cbe6f5be65c435c9f7495b6f300a0de985b40628f1a51293a4825182cc624","observation_id":"9ef54a62-2815-496b-bf95-bd8a5652323f","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15564","last_updated":"2025-02-09T16:37:09Z","snapshot_observed_at":"2026-08-02T07:56:14.673217Z","submitted_at":"2025-01-26T15:49:50Z","title":"Diffusion-Based Planning for Autonomous Driving with Flexible Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15564","snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Diffusion-based planning for autonomous driving with flexible guidance.arXiv preprint arXiv:2501.15564, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"cited_paper":"/paper/2501.15564","citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:2ce65480e4d28a2c83a7680b63a3c5995acdbef280984bf388fc9bcdca06a69e","observation_id":"85acace4-8496-4423-9f81-41a2522d474c","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:22:08.922396Z","title":"Behaviorgpt: Smart agent simulation for autonomous driving with next-patch prediction.Advances in Neural Information Processing Systems, 37:79597–79617, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-14T10:22:08.922396Z"},"links":{"citing_paper":"/paper/2607.10630"},"observation_digest":"sha256:ade7cf32f3a0fe730c521157cc7d485fa366384568646ec4ba9929c59530345c","observation_id":"fba96190-e5d0-4dd7-be0f-f66252df5422","resolution":{"observed_at":"2026-07-14T10:22:08.922396Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.10630","last_updated":"2026-07-12T07:44:16Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-03T01:34:11.933959Z","submitted_at":"2026-07-12T07:44:16Z","title":"World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2607.10630."}