{"as_of":"2026-08-04T22:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a899d6e5b5cf2eb628f5a202b371df26c71e489d69ecaaed50e5dfd40e292bae","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T09:19:06.011699Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T01:24:07.087802Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T01:25:49.407199Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2605.19033","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.19033","snapshot_observed_at":"2026-07-09T01:25:49.407199Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","venue":"cs.RO","work_id":"d2bc3b14-d7cb-40ef-8864-10c38d3f00d4","year":2026},"citing_paper":{"arxiv_id":"2607.06957","last_updated":"2026-07-08T03:32:36Z","snapshot_observed_at":"2026-07-11T23:18:45.936980Z","submitted_at":"2026-07-08T03:32:36Z","title":"Flow-ERD: Agent-type Aware Flow Matching with Entropy-Regularized Distillation for Diverse Traffic Simulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-09T01:24:07.087802Z"},"links":{"cited_paper":"/paper/2605.19033","citing_paper":"/paper/2607.06957"},"observation_digest":"sha256:4f94e0c50082aca61ad8addbba5540e690d9af0c92f8aed858e4cff95628bfde","observation_id":"fcc93778-cc1d-479e-bde2-35052dfdd81b","resolution":{"observed_at":"2026-07-09T01:25:49.409195Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.19033/citation-record","integrity":"/paper/2605.19033/integrity","json":"/paper/2605.19033/citation-record.json","paper":"/paper/2605.19033"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Curb your attention: Causal attention gating for robust trajectory prediction in autonomous driving","venue":null,"work_id":"a8b1ffce-3c2a-48f0-9993-a112be43894c","year":null},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:5f3db40fbf90698063da65781fc953d48145ac574b4c1a1a2467559d8a926e41","observation_id":"67aeed02-67c4-4f23-a0d4-1cf7706d865f","resolution":{"observed_at":"2026-05-20T09:33:25.900807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Getting SMARTER for motion planning in autonomous driving systems","venue":null,"work_id":"fcebf92e-42fc-477d-ae96-04374bd91acd","year":2025},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:fbc319824a9107aa1d36d616ab105388aeb197bbcdd2bd8e2f425beaa61753e6","observation_id":"7175c40b-b9eb-46f6-8cb1-e300f6c4b6bd","resolution":{"observed_at":"2026-05-20T09:33:25.915695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Albrecht, Cillian Brewitt, John Wilhelm, Balint Gyevnar, Francisco Eiras, Mihai Dobre, and Subramanian Ramamoorthy","venue":null,"work_id":"25b6fa3f-e9eb-4513-8ea4-fab89e80555c","year":2021},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:34e91cde8912dedc3b595603312338663a444007cc1c5f4580e6e201a2a284c8","observation_id":"c3015937-4c55-45da-8b5f-70fc594bd2c5","resolution":{"observed_at":"2026-05-20T09:33:25.906784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hind- sight experience replay","venue":null,"work_id":"d48feb80-c63a-444b-88aa-46ed57e61e82","year":2017},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:5f76b7c52a16f3c5df4d320670fe85a646e13c464940c34f8940474857a138eb","observation_id":"42518bef-399a-4db4-a948-3c10db9fba84","resolution":{"observed_at":"2026-05-20T09:33:25.925046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11810","last_updated":"2022-02-04T02:50:02Z","snapshot_observed_at":"2026-08-02T23:58:09.453937Z","submitted_at":"2021-06-22T14:24:55Z","title":"NuPlan: A closed-loop ML-based planning benchmark for autonomous vehicles","version":4},"cited_work":{"arxiv_id":"2106.11810","doi":"10.48550/arxiv.2106.11810","metadata_source":"pith","pith_arxiv_id":"2106.11810","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"NuPlan: A closed-loop ML-based planning benchmark for autonomous vehicles","venue":"cs.CV","work_id":"b16aace6-deff-4546-b333-bcb7c9c07cdb","year":2021},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/2106.11810","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:9dee826a7b065b2f56a23e61f20d2ed928eff1ec98e3b9225fd2aae5c8b222e1","observation_id":"36a7ee20-d439-4a01-9888-2486694ee29a","resolution":{"observed_at":"2026-05-20T09:23:10.793010Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with human feedback for realistic traffic simulation","venue":null,"work_id":"87c42020-7a5c-4d60-9716-c2a8c531cb79","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:8676940eb16ce1522d0546b93f3c7515c0d1798e68fe18fb00314d8844cd31f4","observation_id":"d2c8c826-d0c1-41eb-87ce-4cdd7ebc0e65","resolution":{"observed_at":"2026-05-20T09:33:25.929573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human-compatible driving agents through data-regularized self-play reinforce- ment learning.Reinforcement Learning Journal, 1","venue":null,"work_id":"ad09247d-6318-46f3-8928-9fb393eff236","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:afeecb9dee6bfbd2812f82ffa27a9398e5c485e3779f11aab334969a8ec02db5","observation_id":"b3b2ef53-8a81-4a68-968b-bc9ffa66659f","resolution":{"observed_at":"2026-05-20T09:33:25.896650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Causal confusion in imitation learning","venue":null,"work_id":"62678b8d-d1eb-43dc-b708-4717a85efbed","year":2019},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:7b880e8067839d54c24b16f13bb37df92d3c37dd672bc0179a6f17848dce9037","observation_id":"aeb7f785-2cf2-422b-a0c8-5c3e96d45259","resolution":{"observed_at":"2026-05-20T09:33:25.902628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large scale in- teractive motion forecasting for autonomous driving : The Waymo open motion dataset","venue":null,"work_id":"5d54f8df-2e25-4af1-ac30-62545c8f3bb5","year":2021},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:042c7f927332f35384eb5bd124122abce8632abbe9a6bb2c1539ad29b99f95f0","observation_id":"7882bd23-d480-453c-b679-30746d88dd66","resolution":{"observed_at":"2026-05-20T09:33:25.914006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Waymax: An accelerated, data-driven simulator for large-scale autonomous driving research","venue":null,"work_id":"d762368f-7df4-4bf8-b88e-49fb355bbf85","year":2023},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:e9cbf918ebd849d473657b1c68b23300f787366a98267ed5a3a294d7d2f64f9a","observation_id":"3bca1b20-a4c7-48cb-b622-c35ba0812c8c","resolution":{"observed_at":"2026-05-20T09:33:25.885671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solv- ing motion planning tasks with a scalable generative model","venue":null,"work_id":"de1a0f63-173b-43d1-9018-54d73e20f7c5","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:30246e1e65cad844b7e497864e7b9fb394dbead7a31fe80637365f99beaae07a","observation_id":"a8743111-ce82-4b55-83a3-a28ff7722f23","resolution":{"observed_at":"2026-05-20T09:33:25.888986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solv- ing motion planning tasks with a scalable generative model","venue":null,"work_id":"a04ff44a-b174-4627-8423-f1e56707ef4a","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:e0b142b2da5909c2ed01b8fe69ffa5d359103305807d09e580c06e6f2d890a2f","observation_id":"a14513f8-a156-43bf-9611-da19546ea986","resolution":{"observed_at":"2026-05-20T09:33:25.887150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2404.02524","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:39:50.157172Z","title":"Versatile behavior diffusion for generalized traffic agent simulation","venue":null,"work_id":"0de8c09c-ee81-486c-b27a-6ac35bc8b2cc","year":2026},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:6cbced5ae055ff8ad22d2f0a204809faede4a238735cfc18564c38242b0f6741","observation_id":"94e31e66-8235-40f4-ae33-4433c7932c2d","resolution":{"observed_at":"2026-05-20T09:23:10.790303Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sym- phony: Learning realistic and diverse agents for autonomous driving simulation","venue":null,"work_id":"4d6638e0-4b60-4de6-a63c-e88ba67ff1d3","year":2022},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:3e024cffd16456c596bf4d8331b27a462d22633e694800f75073103ae0c4ee54","observation_id":"074d8604-fb84-46f9-b626-62bfdeb182d4","resolution":{"observed_at":"2026-05-20T09:33:25.893208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"15924883-d4c6-4893-b6c4-c8c56a9fa104","year":2016},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:81615557f7b3b2c070b71c78ba2993372ce8271508a3cad369e0647fb024c2d9","observation_id":"e6cc69d0-48a5-4180-b29a-63ba06350ccd","resolution":{"observed_at":"2026-05-20T09:33:25.941008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Buy 4 REINFORCE samples, get a baseline for free! InDeepRL- StructPred@ICLR","venue":null,"work_id":"539a1f81-8797-4ab2-b1a6-43be6bab0e25","year":2019},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:2c501a278a44857f8cddadad9c81c89971e338d17c53b0c04b59d47620ba15c1","observation_id":"083456a9-fc4c-4e6e-bd66-db4c5f7733a6","resolution":{"observed_at":"2026-05-20T09:33:25.938789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17015","last_updated":"2026-06-18T09:27:13Z","snapshot_observed_at":"2026-07-06T20:27:28.212857Z","submitted_at":"2025-01-28T15:26:25Z","title":"UniMM: A Unified Mixture Model Framework for Multi-Agent Simulation","version":2},"cited_work":{"arxiv_id":"2501.17015","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.17015","snapshot_observed_at":"2026-07-01T10:45:42.629451Z","title":"Revisit mixture mod- els for multi-agent simulation: Experimental study within a unified framework","venue":"cs.AI","work_id":"320ce9e7-85ad-4ebe-9c74-e80422b710ac","year":2025},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/2501.17015","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:8122315f111dec22ec5b43d11cba12ae68296e8ab294787cb5fc18267acce579","observation_id":"7d945716-938a-4fa5-8cfe-8a91e7659855","resolution":{"observed_at":"2026-06-19T17:11:51.260840Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Goal- conditioned reinforcement learning: Problems and solutions","venue":null,"work_id":"a4a5b980-1abc-4fc8-9ac6-c05be98f2db1","year":2022},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:dda316b4806c4f32ceca3bb8f897371d61950534988d523aafe2e3e62845aa06","observation_id":"c7811aeb-0663-4324-b7b1-daba00f32463","resolution":{"observed_at":"2026-05-20T09:33:25.945691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imitation is not enough: Robustifying imitation with reinforcement learning for challenging driv- ing scenarios","venue":null,"work_id":"f4408e27-0c99-4ce9-9503-4793751bc053","year":2023},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:f9bcedb2423c85505e97977497fbaf8880e28894599af96d630544e81737e006","observation_id":"a5f8dceb-2ba8-4e7d-b90c-0269cff15bb4","resolution":{"observed_at":"2026-05-20T09:33:25.943195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Waymo Open Sim Agents Chal- lenge","venue":null,"work_id":"0c0bdbc9-fc9b-4a43-863e-f09d2947c8ad","year":2023},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:c8ef0b97fb5b341c78710ad882a690016bbb9aedd158fdbdf69d7691593722c7","observation_id":"18352be0-c81a-4ef4-ae5d-9778943c8002","resolution":{"observed_at":"2026-05-20T09:33:25.950068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving agent behaviors with RL fine-tuning for autonomous driving","venue":null,"work_id":"5eeb84d7-2b5c-4de2-abe7-30b83c8f5f5f","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:2a04228249b92540223123e7654872f5b82bfbea22b580dab49bb33f47357136","observation_id":"51b9ada2-379c-4ed8-9664-4b71f34a4451","resolution":{"observed_at":"2026-05-20T09:33:25.920642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trajeglish: Traffic modeling as next-token prediction","venue":null,"work_id":"19acd392-f478-48d7-bf06-843cee0cef5a","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:387541c7d1394fbccc66e37cd696e7dae0362227fa9eea8235ab1d21ca53e8d0","observation_id":"39b11e0b-b5aa-4e63-9c54-6b1e12e7ebae","resolution":{"observed_at":"2026-05-20T09:33:25.923115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hindsight policy gradients","venue":null,"work_id":"78b1fb06-02b7-4193-8a72-5b5ac785bc39","year":null},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:72915a832ff959cf9ae3aa2e1ff0a47fafe59e2bcfd396cb9dd3dd1adebeeee2","observation_id":"9bd9a183-1657-49cc-8851-f5e9efc49a71","resolution":{"observed_at":"2026-05-20T09:33:25.927146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A re- duction of imitation learning and structured prediction to no- regret online learning","venue":null,"work_id":"b3e7836a-b34b-4bb8-8dbf-3073d2a158f0","year":2011},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:20516aee2c36f5e57f461d7e8cc133626d96e89e8f7829c0160fbe16b7d114c0","observation_id":"180ad613-0d94-4212-be41-5dbe05f9060c","resolution":{"observed_at":"2026-05-20T09:33:25.931865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:e42f6a3abf8f296f010de7e34b4e86e7462256ee7fee08c5f5729336b765f3a8","observation_id":"fc74133d-17ad-4511-a60c-1ad65620a813","resolution":{"observed_at":"2026-05-20T09:23:10.787009Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TrafficSim: Learning to simulate realistic multi- agent behaviors","venue":null,"work_id":"31a987e1-f37e-404f-b830-01cd4c70f7c4","year":2021},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:186e5b7faf4120f909b7f05e22eec34151ae604525c146ac8d58d07345cf77ea","observation_id":"4a21a0f1-4140-4292-bd12-2c0de9f871cf","resolution":{"observed_at":"2026-05-20T09:33:25.916454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Promptable closed-loop traffic simulation","venue":null,"work_id":"b8da3980-e613-48e1-a553-f70c424554af","year":null},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:99cd3d732272cedb402915e4d5f6057b00ccd9cab539d72ecc32141527995407","observation_id":"addd3954-1fd9-4c2b-a1c9-466e55c4c306","resolution":{"observed_at":"2026-05-20T09:33:25.912322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08448","last_updated":"2024-05-14T09:12:30Z","snapshot_observed_at":"2026-07-06T18:14:03.830337Z","submitted_at":"2024-05-14T09:12:30Z","title":"Understanding the performance gap between online and offline alignment algorithms","version":1},"cited_work":{"arxiv_id":"2405.08448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.08448","snapshot_observed_at":"2026-07-02T03:46:33.108981Z","title":"Understanding the performance gap between online and offline alignment algorithms","venue":null,"work_id":"92c35cdc-3e32-404d-a038-8a1f4228a044","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/2405.08448","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:b02cfaa9f0fcb0ab0111c65ddec112a2504a2294a10bb72628f2136a440ce113","observation_id":"df4730be-e401-4aa5-95a0-a557f1b2ee6e","resolution":{"observed_at":"2026-05-20T09:23:10.778887Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Direct post-training prefer- ence alignment for multi-agent motion generation model us- ing implicit feedback from pre-training demonstrations","venue":null,"work_id":"0bc258be-9d56-400f-9510-a04d5ceccd4c","year":2025},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:7d99abe992030aff14fcf3d64d0bd34a0fc0dab23b5dd33ece9cb6c2e1ca1f5d","observation_id":"e5b810d5-c306-4c44-854f-d2d68ce46cc6","resolution":{"observed_at":"2026-05-20T09:33:25.914255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Con- gested traffic states in empirical observations and micro- scopic simulations.Phys","venue":null,"work_id":"9fce318a-b3fe-43dd-a416-d791ec9224f0","year":2000},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:c7ec8e88c2ba0b4538e2ec093186f650d74b9132eb0c3ed057d2a258728bdb4d","observation_id":"7af707a1-57c7-4913-a57b-11a1e5e6f4ce","resolution":{"observed_at":"2026-05-20T09:33:25.934293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11868","last_updated":"2023-06-20T20:01:07Z","snapshot_observed_at":"2026-07-06T15:44:50.155585Z","submitted_at":"2023-06-20T20:01:07Z","title":"Multiverse Transformer: 1st Place Solution for Waymo Open Sim Agents Challenge 2023","version":1},"cited_work":{"arxiv_id":"2306.11868","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11868","snapshot_observed_at":"2026-07-01T10:45:42.647555Z","title":"Multiverse Trans- former: 1st place solution for Waymo open sim agents chal- lenge 2023","venue":null,"work_id":"62327ce9-29f2-4c77-a90d-bee72ab072a1","year":2023},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/2306.11868","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:3d742934775e159b463cd4d94f519662dcd5e098ba737d3c50f8b97f0e196cfe","observation_id":"505114d0-f972-491b-8d84-432c821486f9","resolution":{"observed_at":"2026-05-20T09:23:10.773544Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04447","last_updated":"2024-08-08T13:18:53Z","snapshot_observed_at":"2026-08-03T17:40:38.134675Z","submitted_at":"2024-08-08T13:18:53Z","title":"Reinforcement Learning from Human Feedback for Lane Changing of Autonomous Vehicles in Mixed Traffic","version":1},"cited_work":{"arxiv_id":"2408.04447","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.04447","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning from human feedback for lane changing of autonomous vehicles in mixed traffic","venue":null,"work_id":"ea719043-90bd-431e-873e-d615ff8ec770","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/2408.04447","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:13d4f83e2fa8f977180002460eee7ff61206d8676005b810e4691e58b570c8f5","observation_id":"c4cf43c1-dc91-4452-81b4-eb31f9d2a204","resolution":{"observed_at":"2026-05-20T09:23:10.776127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Argoverse 2: Next generation datasets for self-driving perception and fore- casting","venue":null,"work_id":"aa117466-f685-4ae3-9643-d3fd55a5b791","year":2021},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:515a18b1f81477943d8ee819063d372fc12d0a6b42fa12722b23624a218a5a0a","observation_id":"341e51a4-0d43-4e9e-83af-9dd7eb7edc0d","resolution":{"observed_at":"2026-05-20T09:33:25.908948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SMART: Scalable multi-agent real-time motion generation via next-token prediction","venue":null,"work_id":"3a9c5db7-928e-4750-a07b-6e560ab099e6","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:b3c817e63f9ce04f7cad7972f22dafff02d4433ec25022b689f6d3553a988f3b","observation_id":"9f5179f4-58ce-4bfa-bf1d-2a258e23be2a","resolution":{"observed_at":"2026-05-20T09:33:25.904642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BITS: Bi-level imitation for traffic simulation","venue":null,"work_id":"5c3dfb0f-9857-4e09-9e71-2e8fe2f606cb","year":null},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:1f87b186a7b1c2f72785ac4b0f0e229bc7028d36e12c4e2847413128e7bffcef","observation_id":"8a434942-1aef-4023-b1ab-e8d3e34329a8","resolution":{"observed_at":"2026-05-20T09:33:25.907040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TrafficBots: Towards world models for autonomous driving simulation and motion prediction","venue":null,"work_id":"dfb59369-56fe-4d30-9c98-386ddb0a4c37","year":2023},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:2d007f529bf29b67fcac1572baa8f24558bc8304065e573f8224473cc879b0d2","observation_id":"cbb85c13-6259-45dc-b7f4-0c356b2f8d04","resolution":{"observed_at":"2026-05-20T09:33:25.918498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10898","last_updated":"2024-06-16T11:20:49Z","snapshot_observed_at":"2026-07-06T18:31:45.125236Z","submitted_at":"2024-06-16T11:20:49Z","title":"TrafficBots V1.5: Traffic Simulation via Conditional VAEs and Transformers with Relative Pose Encoding","version":1},"cited_work":{"arxiv_id":"2406.10898","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.10898","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TrafficBots V1.5: Traffic simulation via conditional V AEs and transformers with relative pose encoding","venue":null,"work_id":"d9ae19d9-30ce-40d3-bb37-0f1bcf51d9ef","year":2024},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/2406.10898","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:91537b439a2bd4a76723d784c1008a9214c7885500e94d4c7832179f13ec321a","observation_id":"127552cc-79d9-4a3c-b55b-359ba95a7859","resolution":{"observed_at":"2026-05-20T09:23:10.781624Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21618","last_updated":"2025-06-23T08:32:05Z","snapshot_observed_at":"2026-07-06T21:48:17.192656Z","submitted_at":"2025-06-23T08:32:05Z","title":"TrajTok: Technical Report for 2025 Waymo Open Sim Agents Challenge","version":1},"cited_work":{"arxiv_id":"2506.21618","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.21618","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TrajTok: Technical report for 2025 Waymo open sim agents challenge","venue":null,"work_id":"9249cc9c-b0ce-4aa6-a55a-edd06bf4d6f6","year":2025},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/2506.21618","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:8563120c764e81be99cb66a931e2be180da7cf1c804e6da2f1ab76d95b1d6d70","observation_id":"c72bd7fe-a074-4c1b-bebb-8aefa3817d46","resolution":{"observed_at":"2026-05-20T09:23:10.771057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Closed- loop supervised fine-tuning of tokenized traffic models","venue":null,"work_id":"83a60c27-cd2b-45a1-9c93-1744c4b251a8","year":2025},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:9726f7ea85c6fa379ab91267aaea5418840c3b2da463051e91f73cee3ca3d4a1","observation_id":"fd026e84-4137-4beb-87ea-8cb587c6523e","resolution":{"observed_at":"2026-05-20T09:33:25.910606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TNT: Target-driven trajectory prediction","venue":null,"work_id":"7dd68a65-9446-40e5-bda3-0521e84d8152","year":2020},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:7f33e05b8022422507d7a546ecdb0db1327276e67a1c5a722bb8d0205231166e","observation_id":"1c148aca-609a-4518-8caf-f6394fcf48ba","resolution":{"observed_at":"2026-05-20T09:33:25.936347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15029","last_updated":"2025-03-19T09:23:09Z","snapshot_observed_at":"2026-07-06T20:55:13.966734Z","submitted_at":"2025-03-19T09:23:09Z","title":"DRoPE: Directional Rotary Position Embedding for Efficient Agent Interaction Modeling","version":1},"cited_work":{"arxiv_id":"2503.15029","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.15029","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DRoPE: Directional rotary position embedding for efficient agent interaction modeling","venue":null,"work_id":"c59efb3d-0ed3-4bba-833c-5da25b2d7ea8","year":2025},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/2503.15029","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:7567bce6846dce8957092e73f68e99a8979ba9af4a9945d2538f41df25f7e746","observation_id":"06a0a65b-4427-4d33-b500-7141e07f63e6","resolution":{"observed_at":"2026-05-20T09:23:10.768062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"KiGRAS: Kinematic-driven generative model for realistic agent simulation.IEEE Robotics and Automa- tion Letters","venue":null,"work_id":"79ef1d84-8abf-4e08-bbd1-39faedd29b57","year":2025},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:fbdf444a7d27d44e3b1163c8460b76752433287bf442a91b4ad68775dfc06c24","observation_id":"33721343-178f-4e26-b1bb-017c27f05296","resolution":{"observed_at":"2026-05-20T09:33:25.952629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guided conditional diffusion for controllable traffic simula- tion","venue":null,"work_id":"5adeeb38-27f7-40d8-a6b8-23ec0bc9fe58","year":2023},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:32849ee8ee2ff695cbb5d0fd5bdae54f1ab8bd5545b9ed3e8d8a7da99c98b5d3","observation_id":"a5c89baa-60b6-47b6-b590-3500004e6fd1","resolution":{"observed_at":"2026-05-20T09:33:25.889781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"BehaviorGPT: Smart agent simulation for autonomous driving with next-patch prediction","venue":null,"work_id":"817f2428-cb80-4a3b-9ef0-185895b67495","year":null},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:6c2287d470640988c4519868a182216de9af9ae9a882eb98294aaf8c7fff35b5","observation_id":"7c51b3f8-0c80-4edd-80dc-29a8e61597b3","resolution":{"observed_at":"2026-05-20T09:33:25.883763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":"1909.08593","doi":"10.48550/arxiv.1909.08593","metadata_source":"pith","pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-07-10T19:37:34.037876Z","title":"Fine-Tuning Language Models from Human Preferences","venue":"cs.CL","work_id":"4f54aad1-f3b6-404f-b9c7-e21ba0a33b99","year":2019},"citing_paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-20T09:19:06.011699Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2605.19033"},"observation_digest":"sha256:d95070b050b04797890efaeeaa11ce10038020ca04ac45cf4c8f2756c77fa6f6","observation_id":"e8a4e15b-4c16-4683-980d-5aaf6907ab99","resolution":{"observed_at":"2026-05-20T09:23:10.795678Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.631932+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.631932+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.19033","last_updated":"2026-05-18T18:57:13Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-02T11:15:30.224743Z","submitted_at":"2026-05-18T18:57:13Z","title":"RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":10,"verified_fuzzy":33},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2605.19033."}