{"as_of":"2026-08-04T12:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:257f972889c85ea524efb9cd6f78a9f47e0b4e70ae48129329045313366e0a86","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T17:20:55.364175Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.04470/citation-record","integrity":"/paper/2605.04470/integrity","json":"/paper/2605.04470/citation-record.json","paper":"/paper/2605.04470"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"976e6178-1ee4-4f1b-bfc3-df6077f2d02e","year":2023},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:5095fdd20b8f76249918bd4d99c86847af2cf7cf27d8d525e65ca9badadf2c39","observation_id":"eab05999-307c-4697-9a09-4749e55c382f","resolution":{"observed_at":"2026-05-26T08:01:56.546327Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jiang, S","venue":null,"work_id":"a9464e65-26b8-4b54-abf8-7fbf7ab2529d","year":2023},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:ae7f884b5a89db2d1b6e8076a0764002633368c9b2708cffbb54129638fc4caa","observation_id":"b59cdc02-a598-43ab-8be5-6826ab65c765","resolution":{"observed_at":"2026-05-26T08:01:56.612367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"132a4fd7-c187-44c6-be57-67415e9292c1","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:78f1cd7c63302f5e97a41cc335b80f860e645853dd5eef384a1153aae7500d1b","observation_id":"cb69716e-d824-4789-ad25-474e363bd58e","resolution":{"observed_at":"2026-05-26T08:01:56.609205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.24426","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:09:44.910902Z","title":"Counterfactual vla: Self-reflective vision-language-action model with adaptive reasoning","venue":null,"work_id":"be0acb58-7426-4a5f-ac44-70397b80715c","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:60447b0cb8f574c3c3a1215493393d58869197dead8d89274e07eecbc66a7b04","observation_id":"3e438397-4ebe-4fba-bd82-49bc70122f02","resolution":{"observed_at":"2026-05-11T17:41:06.537342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.14577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T08:26:48.309413Z","title":"DriveFine : Refining-augmented masked diffusion VLA for precise and robust driving","venue":null,"work_id":"4965dc90-9a14-4f54-88b5-56687e2d7f45","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:28596f7d9699818ef2de993184f3fbb6db58a48b1b97f6474bea2db29b3ac416","observation_id":"5e216dc5-bfda-4841-94ef-a023ab3951b6","resolution":{"observed_at":"2026-05-11T17:41:06.645773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.23421","last_updated":"2026-04-17T11:51:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-29T12:32:27Z","title":"DriveLaW:Unifying Planning and Video Generation in a Latent Driving World","version":3},"cited_work":{"arxiv_id":"2512.23421","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.23421","snapshot_observed_at":"2026-07-01T22:16:16.888093Z","title":"DriveLaW:Unifying Planning and Video Generation in a Latent Driving World","venue":"cs.CV","work_id":"896c37d3-f87a-437b-b4f2-c16e1876e156","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2512.23421","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:249da17e2916d70a395e402320dd984f1ded7f7f0897c48a185d6264103b5c0e","observation_id":"0e838f4d-8026-4f44-8eb1-76856aaf3cac","resolution":{"observed_at":"2026-05-11T17:41:06.563777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12796","last_updated":"2025-12-18T07:25:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-14T17:59:47Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2510.12796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.12796","snapshot_observed_at":"2026-07-10T08:36:59.776968Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","venue":"cs.CV","work_id":"c356b2a8-eaa6-476d-b6d8-8680bb5ddff8","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2510.12796","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:a2141b41e671ff215414d3b81841a53fdb023a70e78dc80d82e4aa8f8f955053","observation_id":"260e65f0-3b6a-447b-ac45-3b13c71c107c","resolution":{"observed_at":"2026-05-17T06:48:01.146010Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:8b1c76adf4391774fb836b3ee4c69dcdb532c938c04c57b188b0a8764e01c346","observation_id":"342c878c-ae81-4692-afe9-f7ea9ff8c245","resolution":{"observed_at":"2026-05-11T17:41:06.664844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f5109ebb-1048-46b9-bb12-391c59bbd002","year":2020},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:70ea14ef2f957df5d9314533c94b8558e2a8a41115543934adee3e64e216158b","observation_id":"b6f5e48b-0063-4956-a40b-0576941d1339","resolution":{"observed_at":"2026-05-26T08:01:56.587169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b968ad30-f6fb-489e-84d3-3e44ac31f27e","year":2021},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:a9e0931067cd70622507208b4227e3613dbefbaccd63cb4febf889e60cba0ca4","observation_id":"8dc98bf4-f6f4-485e-9be2-7b953eee30d0","resolution":{"observed_at":"2026-05-26T08:01:56.590362Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eecc1f22-dd30-44c4-8c28-e637c48a2c61","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:673e69c564c3a1bdc3ffc3301c14272deb39b9c2d21f2b25374b911b8fe6bc6c","observation_id":"4098be44-c741-4610-9846-ecb6c946c1ab","resolution":{"observed_at":"2026-05-26T08:01:56.568418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.18729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T01:29:22.355516Z","title":"Guideflow: Constraint-guided flow matching for planning in end-to-end autonomous driving","venue":null,"work_id":"77bb7610-de6b-4ea2-83cc-67941bfe353d","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:a2f85b04585c84ac4f50dc735c054dcaf7991bd62a53c1069aa13f7e87ba3fa2","observation_id":"42db1f74-25e1-4141-8b16-3f6e385dc822","resolution":{"observed_at":"2026-05-11T17:41:06.579094Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.08562","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:30:08.099262Z","title":"Resad: Normalized residual trajectory modeling for end-to-end autonomous driving.arXiv preprint arXiv:2510.08562","venue":null,"work_id":"9839db69-0650-48d4-8ce2-7f57d10c3dfb","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:6669d8548ba6867cbd5351655bb2ccd043ef59eed3b7f4866d90f1e485e62832","observation_id":"46c8581c-2519-4eac-a6ae-a9f757c79ddd","resolution":{"observed_at":"2026-05-11T17:41:06.651824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22801","last_updated":"2026-05-16T16:36:34Z","snapshot_observed_at":"2026-08-02T07:50:39.034281Z","submitted_at":"2026-02-26T09:37:38Z","title":"Unleashing the Potential of Diffusion Models for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2602.22801","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.22801","snapshot_observed_at":"2026-07-02T08:26:48.317515Z","title":"Unleashing the potential of diffusion models for end-to-end autonomous driving","venue":"cs.RO","work_id":"4db25156-f8d8-4dbb-ae6f-803d4e472a2b","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2602.22801","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:310e82f82e98b3c2d2c4a27104bd007e7fe82383891e973c639c44985aed8a6c","observation_id":"d8bb9175-09a2-4fdc-8e55-19c3e8491277","resolution":{"observed_at":"2026-05-20T00:03:06.805723Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cb64587e-9ca7-4283-9148-35fc008fb413","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:32bbc9dae9337ec9aa10f1b2a5777f5da3825eaf13fd923740e4335c01255c72","observation_id":"f4cecaed-6f6d-4147-8921-4c004e901ab1","resolution":{"observed_at":"2026-05-26T08:01:56.583894Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"80cc54fb-e931-4c38-bab7-a75bbc724a17","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:41a8c285925c8548adc04aa9404e8f8c4dfb8a68c1b04426702fb2138713ae9a","observation_id":"54d9dd46-8cb2-4876-aa82-34c0d8deb586","resolution":{"observed_at":"2026-05-26T08:01:56.571680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13757","last_updated":"2025-11-05T23:46:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-16T17:58:50Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","version":3},"cited_work":{"arxiv_id":"2506.13757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13757","snapshot_observed_at":"2026-07-10T08:36:59.854319Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","venue":"cs.CV","work_id":"945172fb-0f3b-43be-88b4-ae61042517e9","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2506.13757","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:a5e829386bc6ac3c60981e813f2d77ee8b3c6b4c22dd8d4c8b452d0e7c8d1440","observation_id":"37dc4c1c-ef25-4bd3-8a08-2866ff2d3d54","resolution":{"observed_at":"2026-05-14T21:46:44.401546Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.01441","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T13:04:40.247294Z","title":"Unifying language-action understanding and generation for autonomous driving","venue":null,"work_id":"c702a179-0944-450b-93eb-5ebf2595958c","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:8453e98b16cd150e995c22ca3c1d05bb89fe2eb0cb76d349bf67d41c37be6c95","observation_id":"5d8c7e53-9148-4052-a384-60d991ef16fe","resolution":{"observed_at":"2026-05-11T17:41:06.704504Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-07-06T18:28:42.314877Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":"2406.06978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-07-10T08:36:59.824360Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","venue":"cs.CV","work_id":"c1e2622d-92db-4a96-aa17-8ef832270ed1","year":2024},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:06f329f4b1bad239363d791b26865cf5e904b9c7fec61d9912ab2ac8a0696e9e","observation_id":"b8b0abe8-8ac4-4506-b82d-c4e8f22b60b8","resolution":{"observed_at":"2026-05-13T23:13:55.802367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a9e8b98-e063-475a-8ddd-e97401db523b","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:29e419872016af8d42869751ff07e80467022ce0230316fd7394ae28490c09d0","observation_id":"c4472306-3870-4455-8a73-ebba5473109b","resolution":{"observed_at":"2026-05-26T08:01:56.574460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06664","last_updated":"2025-06-07T05:06:05Z","snapshot_observed_at":"2026-07-06T21:38:20.585377Z","submitted_at":"2025-06-07T05:06:05Z","title":"Generalized Trajectory Scoring for End-to-end Multimodal Planning","version":1},"cited_work":{"arxiv_id":"2506.06664","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06664","snapshot_observed_at":"2026-07-04T16:39:58.091867Z","title":"Generalized trajectory scoring for end-to-end multimodal planning","venue":null,"work_id":"5c027ae8-9c2a-4484-a685-f902c6221905","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2506.06664","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:d9ebdb392507a36ec368c6b074b734390d82c925ba4319675cf52dfc1902c236","observation_id":"dae1d3be-8e8d-4b30-ab27-93f4d4ede494","resolution":{"observed_at":"2026-05-11T17:41:06.717031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.29163","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T17:47:17.908664Z","title":"Sparsedrivev2: Scoring is all you need for end-to-end autonomous driving","venue":null,"work_id":"aed1144b-daed-4e81-8552-b6dd205f2556","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:d71a5ae444bbdcafede029f8de4df5be43e1198b32f20758ecab527723569efc","observation_id":"d512dda4-9788-4eed-8cf3-cae931d82869","resolution":{"observed_at":"2026-05-11T17:41:06.583948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:cb25e9db65c29eeecf8113d32ec6d23bc18c6ca75309f1665fac9bbe70632f17","observation_id":"ae510ed2-d2c9-4063-9507-b37c347cd81a","resolution":{"observed_at":"2026-05-11T17:41:06.670098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-03T16:27:20.004675Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:f9d015f8bbe71a1bf37e5fbe5c655ba39014eaaf8f5fe81e666a055ae3e13194","observation_id":"2bb7ed72-044f-4308-86e6-79f06322e74b","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jaeger, D","venue":null,"work_id":"a9a17352-c6d2-4da7-aae2-acd342e562fe","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:15b02a955afbf6df9b6f7176dc4828a5850e71015b3fe465e307e3d15762ea78","observation_id":"efb198ae-e5c6-4b30-9068-40511f07b00a","resolution":{"observed_at":"2026-05-26T08:01:56.577653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cdb08383-214d-4e19-876e-2d7c8e0c2d27","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:5f9d64ff20a95bc48d1b75b6e5f26ac9fc01eb3f2c5ccc507d363643b88687f5","observation_id":"7302a973-0a56-4b6f-90a1-bd7b2d533f46","resolution":{"observed_at":"2026-05-26T08:01:56.580849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15308","last_updated":"2026-04-16T17:59:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-16T17:59:44Z","title":"RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework","version":1},"cited_work":{"arxiv_id":"2604.15308","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.15308","snapshot_observed_at":"2026-07-01T10:45:42.632381Z","title":"RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework","venue":"cs.CV","work_id":"cac892ab-c187-4afc-9d30-45b0eb1df43b","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2604.15308","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:201b31a43931c4dd83cfcf9635e0b2a1ecb3bf585758c328853834827f242f43","observation_id":"dff84d96-0b57-448f-a037-f7452849df0d","resolution":{"observed_at":"2026-05-11T17:41:06.621120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.08170","last_updated":"2025-08-21T11:45:55Z","snapshot_observed_at":"2026-08-04T03:10:02.227070Z","submitted_at":"2025-08-11T16:45:55Z","title":"ReconDreamer-RL: Enhancing Reinforcement Learning via Diffusion-based Scene Reconstruction","version":2},"cited_work":{"arxiv_id":"2508.08170","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.08170","snapshot_observed_at":"2026-07-04T03:59:33.829869Z","title":"Recondreamer-rl: Enhancing reinforcement learning via diffusion-based scene reconstruction","venue":null,"work_id":"9c88f5b1-4e7e-4de7-b2ea-c89aebb40ac4","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2508.08170","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:8ce668b7277458f1378da7aaed314a109e889589ada79bedcec2a35bb28a7089","observation_id":"c3b6f729-5c2f-4b65-a2ce-efd1bd22578b","resolution":{"observed_at":"2026-05-11T17:41:06.638765Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.18315","last_updated":"2026-07-01T22:38:52Z","snapshot_observed_at":"2026-08-03T22:21:48.231925Z","submitted_at":"2026-03-18T21:55:29Z","title":"DriveVLM-RL: Neuroscience-Inspired Reinforcement Learning with Vision-Language Models for Safe and Deployable Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2603.18315","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.18315","snapshot_observed_at":"2026-07-03T01:16:52.522105Z","title":"arXiv preprint arXiv:2603.18315","venue":null,"work_id":"8d53808a-09b4-4c28-9a7e-63f0a6064553","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2603.18315","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:dde6ed2ff2ffba80ce9c785ca734b11de7d0be2dd935781f916fe18d9e04d93c","observation_id":"aac362ad-8fa7-4aa0-8bb2-3b6627f12ac7","resolution":{"observed_at":"2026-07-03T01:16:52.522105Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ce265490-a638-4aa5-8090-ca8d21f861bb","year":2024},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:2ba08777f3caa9da512d3188b5891cf5e73c3441ded6180cf45a0c477fb6e88c","observation_id":"01e4e094-491a-4fc7-9f6a-7179e0f76d83","resolution":{"observed_at":"2026-05-26T08:01:56.634608Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ba6dae2a-b9fe-465c-b6b0-b1089b70738c","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:cfe7c7e46097077c1657e0f702028c0fd4c6fb6eeb93e26652ff032aa3dfcf28","observation_id":"d17ee294-5a7e-48a9-bf3a-bd849ab1eb95","resolution":{"observed_at":"2026-05-26T08:01:56.637523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"efbdc62b-f20e-4224-b57a-522c9d8613c2","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:3fc6ab6f1d186d50ff97356d666935e23009713f478d16f638599879205a5650","observation_id":"ef61e363-35f4-4c56-88c3-3b107615f1b9","resolution":{"observed_at":"2026-05-26T08:01:56.621634Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rafailov, A","venue":null,"work_id":"449f76fb-2d99-4957-a9a2-5b309b7eb713","year":2023},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:6f12283e6f358af889e07008e76b404a969cfa263742acb7394db37c0e49a603","observation_id":"d3cc3314-712f-4e48-855b-ea4053e89b73","resolution":{"observed_at":"2026-05-26T08:01:56.624921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08052","last_updated":"2025-09-29T17:21:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T03:14:04Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2506.08052","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.08052","snapshot_observed_at":"2026-07-10T08:36:59.842975Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","venue":"cs.CV","work_id":"02bd7e58-a437-4e26-912d-8f1a2e695fa7","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2506.08052","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:5ea3d4579cbe6383b33734bb56cb2f5067d1ad6c7478601a1bfc8a4e34e46d0f","observation_id":"b3749457-0881-44a1-a045-f8683a783627","resolution":{"observed_at":"2026-05-15T07:36:24.555133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.07745","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:30:08.059832Z","title":"re- gions important for driving","venue":null,"work_id":"e0b7a052-e6b6-4950-a9c2-1f052f74afec","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:84c465f150d65aa7da3772c7dbfbcab169dfd98784ff01298fc179024919c53e","observation_id":"343613c8-cf5e-4882-9f0c-530304efbfa1","resolution":{"observed_at":"2026-05-11T17:41:06.691999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.11475","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative scenario rollouts for end-to-end autonomous driving","venue":null,"work_id":"ce5851d1-7278-4c06-aa3d-4bdd75640b76","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:f03f63d4013f02eb98cf3246c97741a3089ed88f069f8820fbcd8db13f6c63f2","observation_id":"3e86f4e4-87c2-4f84-b30c-d6986bb1f77a","resolution":{"observed_at":"2026-05-11T17:41:06.631479Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.11041","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DynVLA: Learning world dynamics for action reasoning in autonomous driving","venue":null,"work_id":"783dac49-0c4d-4524-bf15-d0ffdae1828d","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:032a9de0ae2ef1508519b71ab07825702ef3ac7af35e1a7dabaa8ea689fb5235","observation_id":"eb0092cf-7fbd-4df9-85fd-2967f1067dd5","resolution":{"observed_at":"2026-05-11T17:41:06.598365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.00898","last_updated":"2026-07-17T14:56:12Z","snapshot_observed_at":"2026-08-03T13:18:24.988636Z","submitted_at":"2025-12-31T16:56:56Z","title":"Dichotomous Diffusion Policy Optimization","version":3},"cited_work":{"arxiv_id":"2601.00898","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.00898","snapshot_observed_at":"2026-07-20T03:19:14.643152Z","title":"Liang, Y","venue":null,"work_id":"2f183574-8209-48fa-8405-671a787fab88","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2601.00898","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:c614b71fd151040cb604aaeea11b1fe0845b31ece85c1a58abdd26d4abb7c296","observation_id":"2494b19a-086f-42ac-9622-946ba18891ee","resolution":{"observed_at":"2026-07-20T03:19:14.643152Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.06049","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Devil is in narrow policy: Unleashing exploration in driving vla models","venue":null,"work_id":"cc8fa96a-c352-4b34-9f47-e0308d4a3888","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:5fac68abb7841403561cb834de848b1bb2eeb6e541606728fa1813ee20753bd9","observation_id":"d9f88412-23a8-4066-a94a-76f31bd5f87e","resolution":{"observed_at":"2026-05-11T17:41:06.543662Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dauner, M","venue":null,"work_id":"f93d4878-9f4b-4148-893a-fca4b20d7ed2","year":2024},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:13d9d3de8a06ae2b3e4a6177c00fc68de991d607ad13d14b75a805e9a8331d03","observation_id":"430c7d80-53ec-4e63-9c9d-2b2484b2ebdb","resolution":{"observed_at":"2026-05-26T08:01:56.615557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a906ded-ec69-4d41-9f32-98f696a63dd7","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:9d85ccd36bf41b1dbb808965f8678ee8aaf31873a9ab1e3008b43149ddadd6f9","observation_id":"032d6e8d-c5c8-4f21-8ff8-fb84d790eb3b","resolution":{"observed_at":"2026-05-26T08:01:56.628410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6b1704cd-2d03-4077-a1f0-70bcb048b65a","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:7f8e289d06c1648d3620ee43c73e8e4aedb272911cee4ac0ab2bd55ce2d3c66b","observation_id":"eb115ea6-446e-489f-a91d-7d52bbd0d369","resolution":{"observed_at":"2026-05-26T08:01:56.631575Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.20325","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ad-r1: Closed-loop reinforcement learning for end-to-end autonomous driving with impartial world models","venue":null,"work_id":"54561e63-7919-4b7a-a342-e3a15381d1ad","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:c1e8912ca21bd5ea2a72573de8a012d972ee95ee0735291eddbfdc070179a849","observation_id":"525088fb-7e90-484b-a7ca-f4c0e617bec5","resolution":{"observed_at":"2026-05-11T17:41:06.569253Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03877","last_updated":"2024-11-27T09:31:04Z","snapshot_observed_at":"2026-07-06T18:26:19.664486Z","submitted_at":"2024-06-06T09:12:30Z","title":"Bench2Drive: Towards Multi-Ability Benchmarking of Closed-Loop End-To-End Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2406.03877","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03877","snapshot_observed_at":"2026-06-30T16:44:56.031336Z","title":"Bench2drive: Towards multi- ability benchmarking of closed-loop end-to-end autonomous driving","venue":null,"work_id":"198e09f9-7399-4636-b63c-a4b1e4009ce9","year":2024},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2406.03877","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:b44172e2ebbdbea740a3d41bebcc93f50a0a1485b56795c682041b776209d89b","observation_id":"f888977f-9ec6-466e-9ede-5480143658c9","resolution":{"observed_at":"2026-05-11T17:41:06.680073Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dosovitskiy, G","venue":null,"work_id":"45a95479-203b-4b92-9935-454b3523934c","year":2017},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:eb76c67340efc5d27915512ef421b1d560884b0985b02e675e32e42b07e873f3","observation_id":"8d1fc23d-5b87-4902-8421-c59f52ceb4b1","resolution":{"observed_at":"2026-05-26T08:01:56.596126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nguyen, M","venue":null,"work_id":"62454047-7c67-46da-914f-02c96ba30811","year":2026},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:d6ba83121a3796a798b5351e4d9fff08865f19dd6164c1568cedab02c9e6949a","observation_id":"b0308410-cacd-484e-939a-8a2942c1e440","resolution":{"observed_at":"2026-05-26T08:01:56.593268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3d983044-bea9-47d9-a261-58805d317fe8","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:de38fd0ea1fad3050f22ffc284daff06c1216739a0a283575bc55babac1d5985","observation_id":"eb968e6e-c04a-41c3-b6b3-5e17b16faf33","resolution":{"observed_at":"2026-05-26T08:01:56.602421Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-02T05:27:47.490711Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":"2501.03262","doi":"10.48550/arxiv.2501.03262","metadata_source":"pith","pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","venue":"cs.CL","work_id":"557f9e99-cb00-4dd2-92fd-67ddcddbb35d","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:82d4259071382e60967613140be37d86f0917b5f151107a09219ab58a18ed925","observation_id":"3dc38b47-c7df-4086-829d-2894520d2353","resolution":{"observed_at":"2026-05-12T09:21:45.673967Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:52:56.973979+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:52:56.973979+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.03344","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rift: Closed-loop rl fine-tuning for realistic and controllable traffic simulation","venue":null,"work_id":"d2e01296-48a9-4554-9bcd-60c391cc905d","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:b7c43fa406e5df34d9368a38f6ffb7f88bcd3baada0568a36e6d3a882c47db7b","observation_id":"11c39923-86a1-418e-ac59-9b409b3f65fa","resolution":{"observed_at":"2026-05-11T17:41:06.550525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9853b880-ff47-443d-9ebd-738c71f949cb","year":2024},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:ef1f5194b6ff9791ee3fe0c12fed166ddf483baf5031761240c17af7309c539b","observation_id":"bc62c079-a22a-4228-8257-d6c720da15ef","resolution":{"observed_at":"2026-05-26T08:01:56.599389Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.07292","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gerstenecker, A","venue":null,"work_id":"7dcd61a8-cf81-4281-9415-49d08cdbc570","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:d91820a163fd12d50ec880b7e8154a62eb26ded632cfc24fceafd3d35acce22d","observation_id":"56a65f86-51f1-47a3-9900-1053a35d41d4","resolution":{"observed_at":"2026-05-11T17:41:06.556357Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"edc89128-0bbc-4994-af8b-1014c93fb333","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:6d3c31cecb9639c06d782b5c4b6e7764b5cfeaf0882b1436e51e5e6a290c206f","observation_id":"b5aa05fa-d20a-4fa5-958c-10fbd7bf3e15","resolution":{"observed_at":"2026-05-26T08:01:56.605547Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6a65bc1b-bad8-4366-9bff-99aee317f796","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:3d100ff19d5dd877da12d8ed4ba3a16c9e2b828a5227d4ec79c7497b1067d173","observation_id":"65cb93a9-9e21-4963-b280-f19e730d888e","resolution":{"observed_at":"2026-05-26T08:01:56.618605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e784c977-d687-4412-aacb-ed9c850f166b","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:b0db1f30ce1de5577d5e49a183e3687f095728a7f3539ded200ef515945ac4c7","observation_id":"459d176a-83e7-43ba-8b50-215ec0f827ad","resolution":{"observed_at":"2026-05-26T08:01:56.640665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e67c5a5a-b883-4958-88ab-d369382fbef3","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:b907be56e8f9f8d4f9caf7da5ff31aab81555d812400888eb535a58edc97f167","observation_id":"8b432967-9d73-425c-b141-83dc0fd66cc9","resolution":{"observed_at":"2026-05-26T08:01:56.557119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ff90a2d2-3676-4fb7-b604-52dbae0b26b7","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:471ddd96bbe8663548469f479eef95c8bf54de23ea1c0c9f40d30848daa2bc34","observation_id":"4a4b6099-4694-4a43-a85c-ae7dc0cc46f7","resolution":{"observed_at":"2026-05-26T08:01:56.553551Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0ec57963-6712-4406-a19f-aab29d1a8573","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:1c4406647f8a9449880b82745db8adfdcd2b3c582580491d5a7c9fe0801385b2","observation_id":"f90746df-b0b5-4f43-aaae-9bf79153d3a9","resolution":{"observed_at":"2026-05-26T08:01:56.560604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c0236a85-4266-4dba-bf1d-bfb24393cf70","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:59c7c49e688aae4c0b540290c4c768547216ae8e7a2e7f00c2d6d7c305721d8c","observation_id":"b78517fb-8222-462e-89f8-bef430eddcc4","resolution":{"observed_at":"2026-05-26T08:01:56.564273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• HiP-AD [46].The ego decision is represented as joint path-speed candidates with 48 ego modes","venue":null,"work_id":"0a5a8b58-93fb-44d4-b72e-f88c2f856a7c","year":null},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:9aed9902eab972812d81c4d9636b1534707293db40434cad3caff7f0219f674d","observation_id":"c0f3373a-8f56-4f6c-8929-0f5418cc3bdc","resolution":{"observed_at":"2026-05-26T08:01:56.550097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:17:13.770090Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":22,"verified_exact":28,"verified_fuzzy":7},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2605.04470."}