{"as_of":"2026-08-06T02:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:72ba8cc1e66be3e975d5ecfdf6d6d9d00fe1b232bb9424eb52e5831ebbd3efd5","coverage":[{"denominator":86,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":86,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T02:34:29.624029Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:40:58.628617Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T17:47:17.865392Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2604.19710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19710","snapshot_observed_at":"2026-07-02T17:47:17.865392Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","venue":"cs.CV","work_id":"c54cca47-e232-4e5e-9146-78b9c733d622","year":2026},"citing_paper":{"arxiv_id":"2605.09701","last_updated":"2026-05-10T18:45:21Z","snapshot_observed_at":"2026-07-06T23:21:44.900680Z","submitted_at":"2026-05-10T18:45:21Z","title":"DriveFuture: Future-Aware Latent World Models for Autonomous Driving","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-12T02:59:27.018824Z"},"links":{"cited_paper":"/paper/2604.19710","citing_paper":"/paper/2605.09701"},"observation_digest":"sha256:6cca96bd9fcc98ad37b921848078f4beb3ae5484f5370be9443c4e9f02998ac4","observation_id":"0c579be4-6cff-491e-8117-1933288d9e8d","resolution":{"observed_at":"2026-05-12T03:01:17.924954Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2604.19710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19710","snapshot_observed_at":"2026-07-02T17:47:17.865392Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","venue":"cs.CV","work_id":"c54cca47-e232-4e5e-9146-78b9c733d622","year":2026},"citing_paper":{"arxiv_id":"2605.10904","last_updated":"2026-05-11T17:44:34Z","snapshot_observed_at":"2026-07-06T23:22:47.781940Z","submitted_at":"2026-05-11T17:44:34Z","title":"MDrive: Benchmarking Closed-Loop Cooperative Driving for End-to-End Multi-agent Systems","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T03:57:11.504679Z"},"links":{"cited_paper":"/paper/2604.19710","citing_paper":"/paper/2605.10904"},"observation_digest":"sha256:a400ae1ade9aa9766c9c1514c0757e27dc998bd9f72c8493721f6b7156823d54","observation_id":"bc8e20cc-cea2-438f-9e1c-7a88f9235c20","resolution":{"observed_at":"2026-05-12T06:51:27.467727Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2604.19710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19710","snapshot_observed_at":"2026-07-02T17:47:17.865392Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","venue":"cs.CV","work_id":"c54cca47-e232-4e5e-9146-78b9c733d622","year":2026},"citing_paper":{"arxiv_id":"2605.19524","last_updated":"2026-05-19T08:26:43Z","snapshot_observed_at":"2026-08-02T00:40:57.766933Z","submitted_at":"2026-05-19T08:26:43Z","title":"SafeAlign-VLA: A Negative-Enhanced Safe Alignment Framework for Risk-Aware Autonomous Driving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T05:23:18.759046Z"},"links":{"cited_paper":"/paper/2604.19710","citing_paper":"/paper/2605.19524"},"observation_digest":"sha256:8e0c0bff0d8f3312712ddf4c027029be132c1772d762eb95b88f8b3091252dd0","observation_id":"18c8c3cc-ad33-47e7-bb70-0d1551ae8292","resolution":{"observed_at":"2026-05-20T05:23:21.578496Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2604.19710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19710","snapshot_observed_at":"2026-07-02T17:47:17.865392Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","venue":"cs.CV","work_id":"c54cca47-e232-4e5e-9146-78b9c733d622","year":2026},"citing_paper":{"arxiv_id":"2605.23270","last_updated":"2026-05-22T06:17:35Z","snapshot_observed_at":"2026-07-06T23:33:29.550551Z","submitted_at":"2026-05-22T06:17:35Z","title":"ChainFlow-VLA: Causal Flow Planning with Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-25T04:37:56.487048Z"},"links":{"cited_paper":"/paper/2604.19710","citing_paper":"/paper/2605.23270"},"observation_digest":"sha256:ec1af74eb82a1631debad2bcb2d05ea9928a6eb66d2d1f43fe2a76db22b3ddea","observation_id":"0f6cf288-19ef-4041-83e2-750958b6d929","resolution":{"observed_at":"2026-05-25T04:40:23.805146Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2604.19710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19710","snapshot_observed_at":"2026-07-02T17:47:17.865392Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","venue":"cs.CV","work_id":"c54cca47-e232-4e5e-9146-78b9c733d622","year":2026},"citing_paper":{"arxiv_id":"2605.31572","last_updated":"2026-05-29T17:40:04Z","snapshot_observed_at":"2026-07-06T23:40:42.277618Z","submitted_at":"2026-05-29T17:40:04Z","title":"nuReasoning: A Reasoning-Centric Dataset and Benchmark for Long-Tail Autonomous Driving","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-28T22:35:04.552901Z"},"links":{"cited_paper":"/paper/2604.19710","citing_paper":"/paper/2605.31572"},"observation_digest":"sha256:6ded1150c9ae1aca81a19d800ab12a9acc5c72e8ade91c8bb807ccc87197412d","observation_id":"e86d1a60-ec57-4be8-b664-53c0368ac863","resolution":{"observed_at":"2026-07-01T19:26:00.329145Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2604.19710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19710","snapshot_observed_at":"2026-07-02T17:47:17.865392Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","venue":"cs.CV","work_id":"c54cca47-e232-4e5e-9146-78b9c733d622","year":2026},"citing_paper":{"arxiv_id":"2606.07170","last_updated":"2026-06-05T11:39:27Z","snapshot_observed_at":"2026-07-06T23:46:51.468468Z","submitted_at":"2026-06-05T11:39:27Z","title":"Test-Time Trajectory Optimization for Autonomous Driving","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-27T21:53:02.554405Z"},"links":{"cited_paper":"/paper/2604.19710","citing_paper":"/paper/2606.07170"},"observation_digest":"sha256:49767623e7394e03a0040f87aaec0810b6cfab88f65bf0125a74c424318809dd","observation_id":"de44b9ce-2320-4e50-8bc8-7c836f09cd74","resolution":{"observed_at":"2026-07-02T17:47:17.866802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2604.19710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19710","snapshot_observed_at":"2026-07-02T17:47:17.865392Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","venue":"cs.CV","work_id":"c54cca47-e232-4e5e-9146-78b9c733d622","year":2026},"citing_paper":{"arxiv_id":"2606.29879","last_updated":"2026-06-30T16:50:58Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T07:17:13Z","title":"LWDrive: Layer-Wise World-Model-Guided Vision-Language Model Planning for Autonomous Driving","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-30T06:34:37.717137Z"},"links":{"cited_paper":"/paper/2604.19710","citing_paper":"/paper/2606.29879"},"observation_digest":"sha256:9fb2a925d1ae786ace99178c24d94d2529589cb435828ef1465d63b1c54b8401","observation_id":"bd774d08-b97c-4ca7-be25-d7c0e2c6d6e2","resolution":{"observed_at":"2026-06-30T06:54:21.281852Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2604.19710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19710","snapshot_observed_at":"2026-07-02T17:47:17.865392Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","venue":"cs.CV","work_id":"c54cca47-e232-4e5e-9146-78b9c733d622","year":2026},"citing_paper":{"arxiv_id":"2606.29879","last_updated":"2026-06-30T16:50:58Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T07:17:13Z","title":"LWDrive: Layer-Wise World-Model-Guided Vision-Language Model Planning for Autonomous Driving","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-01T06:54:29.399091Z"},"links":{"cited_paper":"/paper/2604.19710","citing_paper":"/paper/2606.29879"},"observation_digest":"sha256:c1b18f14aec8003a966af38ff68971b9648cadd16fe94e5a415a6849f8a3cab1","observation_id":"b4d1f125-0986-4924-9361-f61d324d2a19","resolution":{"observed_at":"2026-07-01T06:55:28.890652Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19710","snapshot_observed_at":"2026-08-06T00:40:58.628617Z","title":"arXiv preprint arXiv:2604.19710 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01035","last_updated":"2026-08-02T06:45:16Z","snapshot_observed_at":"2026-08-06T02:17:42.989611Z","submitted_at":"2026-08-02T06:45:16Z","title":"WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T00:40:58.628617Z"},"links":{"cited_paper":"/paper/2604.19710","citing_paper":"/paper/2608.01035"},"observation_digest":"sha256:00b5bded0e471cad6902fbf0e784003633e461ab5ecc33483f895fc3be7942ee","observation_id":"9b7ad2ce-dcaf-4ea5-bb6c-98a975590e71","resolution":{"observed_at":"2026-08-06T00:40:58.628617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.19710/citation-record","integrity":"/paper/2604.19710/integrity","json":"/paper/2604.19710/citation-record.json","paper":"/paper/2604.19710"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: 2025 IEEE/CVF Winter Conference on Applications of Computer Vi- sion (WACV)","venue":null,"work_id":"e47aa778-8a2a-4812-b08c-74d1e26c4b05","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:cb87e5fed43b72dd52f940813006815ee091b5d43ff6ddb93a19da7d1dd9e21d","observation_id":"789398ea-4407-4e81-b4ef-b317ddef3e01","resolution":{"observed_at":"2026-05-22T20:47:07.179614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:845461e68df68d5c24136153093c75b0539f76bee79544dc2152ac5f1019f09f","observation_id":"cbc4f6c3-e733-471c-b152-eaf38b648d3a","resolution":{"observed_at":"2026-05-11T12:56:10.738850Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.04759","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T11:38:05.443358Z","title":"Driving with regulation: Interpretable decision-making for autonomous vehicles with retrieval-augmented reasoning via llm","venue":null,"work_id":"3ff8dce0-4ece-4367-97f1-9ea274d7c54d","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:57b6f62e424aa36c1307d27406d1e85625a56b2728b730020668b069d48bb93d","observation_id":"0e479331-ffba-4eae-b931-d325871d7b6c","resolution":{"observed_at":"2026-05-11T12:56:10.706956Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.04218","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:25.570449Z","title":"Pseudo-simulation for autonomous driving.arXiv preprint arXiv:2506.04218","venue":null,"work_id":"d8bb0a5f-f4f1-4d7d-a9b1-90eacc293742","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:6fc3918b546e49106bd57c4633814bd0f599ae8c4384ebcac866e945dbaf2b58","observation_id":"cc8a0520-4cbb-4e4f-b344-aa984dbeda0f","resolution":{"observed_at":"2026-05-11T12:56:10.729379Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Transactions on Pattern Analysis and Ma- chine Intelligence (2024)","venue":null,"work_id":"314983bc-62a3-4d40-b295-6cbb0aa2f8af","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:c51f5385b24de228b766ef35ee2c04a15b753fec32c44e79e6939b1a21733123","observation_id":"5a8e84ed-0384-4fd7-b32c-508873b52ff5","resolution":{"observed_at":"2026-05-22T20:47:07.175827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.739369Z","title":"IEEE trans- actions on pattern analysis and machine intelligence45(11), 12878–12895 (2022)","venue":null,"work_id":"4a287224-f80e-4ebd-aef1-da033b25fa7a","year":2022},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:24a28d71581a0122883d7063ff2d009cab540079697b7852b87b32630e848a42","observation_id":"f49c1443-1bfa-44ae-9213-0bee36b0c78f","resolution":{"observed_at":"2026-05-22T20:47:07.183332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:349aba63e5caba7254a9041abc5d6eb3a971893c7fa13be0e397ba9f005318a9","observation_id":"289b8899-96da-47e1-993d-7c00852d117b","resolution":{"observed_at":"2026-05-11T12:56:10.751419Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"53757fbf-483e-4f5d-9388-15efb702c387","year":2023},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:18e98d6fc9c52a2bb227cc7b9c01549b2b2100a626bbef70d570b33dc5b38cc3","observation_id":"89ee3a02-d762-4f89-937a-37a5998987dd","resolution":{"observed_at":"2026-05-22T20:47:07.171782Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.14577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T08:26:48.309413Z","title":"DriveFine : Refining-augmented masked diffusion VLA for precise and robust driving","venue":null,"work_id":"4965dc90-9a14-4f54-88b5-56687e2d7f45","year":2026},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:6fc89240ab32b7605b50087d1336ea3c99df5b226bf008f185590391cb9599ef","observation_id":"cbba3a54-e677-4402-a559-7451aed0083c","resolution":{"observed_at":"2026-05-11T12:56:10.721678Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.491788Z","title":"Advances in Neural Information Processing Systems37, 28706–28719 (2024)","venue":null,"work_id":"3c49e213-64bd-4dd4-a775-755b9ed29b19","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:7e25f05d14540822e73cb724fc5a3398f2f24aef37e8f4cb5ef5a792286f2207","observation_id":"2321aac8-52af-4aa9-98f0-2e7122084dc9","resolution":{"observed_at":"2026-05-22T20:47:07.160633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"c3465b9d-acd1-40b5-9544-23ca84c25b36","year":2021},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:51c4c656cf82ce594013f91ec9077c284b49c229874d4929d4387c8fb2ff56cd","observation_id":"4acb4a9f-d201-4976-acea-c20c85512471","resolution":{"observed_at":"2026-05-22T20:47:07.167972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.15968","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoReVLA: A dual-stage end-to-end autonomous driving framework for long-tail scenarios via collect-and-refine","venue":null,"work_id":"34d57d58-dac6-4682-abda-876d5a10e4af","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:407b3b5aac934004956922fb3da2d4c7505a603b3c23aa2955199dfbdd15eea1","observation_id":"856126b4-5cd5-4b6c-831a-772b071ec61d","resolution":{"observed_at":"2026-05-11T12:56:10.958930Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04333","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:19:57.002068Z","title":"Rap: 3d rasterization augmented end-to-end planning.arXiv preprint arXiv:2510.04333","venue":null,"work_id":"ec378d18-f9a4-4767-978d-df2ecc0c9e0d","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:307f018f798cb783722437ea0b46b016abeac0a88ee2c0d5cdf2fb741ffd558a","observation_id":"cec85f50-4106-4d0c-b030-38b9e84652fa","resolution":{"observed_at":"2026-05-11T12:56:10.764247Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Robotics and Automation Letters11(1), 226–233 (2025) 16 Z","venue":null,"work_id":"158a0f66-0f3f-4bfc-a914-6a330743ca2e","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:c22957768b548601b1766f97283859dc6b9920f221b8abf080cb298c8c0c0339","observation_id":"a475b150-a1c0-4450-9233-eedcab4fb1c7","resolution":{"observed_at":"2026-05-22T20:47:07.144822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19755","last_updated":"2025-03-25T15:18:43Z","snapshot_observed_at":"2026-08-05T21:57:39.132989Z","submitted_at":"2025-03-25T15:18:43Z","title":"ORION: A Holistic End-to-End Autonomous Driving Framework by Vision-Language Instructed Action Generation","version":1},"cited_work":{"arxiv_id":"2503.19755","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.19755","snapshot_observed_at":"2026-07-04T08:49:42.181123Z","title":"ORION: A Holistic End-to-End Autonomous Driving Framework by Vision-Language Instructed Action Generation","venue":"cs.CV","work_id":"c3fa58f6-0efb-4d29-a673-a2f26228ba6d","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2503.19755","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:c9389d57f26cb6fbca8fa9b637a7fe5743d84d12b2f0f92678cd78c02b279b0a","observation_id":"80e69c95-99c8-4587-aca5-8e8d33e6c619","resolution":{"observed_at":"2026-05-17T08:10:39.718006Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:0ab55e437a113fc347380e56164c03ced872de832f14b4a9a0f9a7326d0e92f9","observation_id":"0ec26a4d-135b-46f5-9b0d-9f0d725407cd","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: The Thirty-ninth Annual Conference on Neural Information Processing Systems (2025)","venue":null,"work_id":"b0f72037-1881-4021-a30e-273876addabb","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:3044e85cfb4719eb24e12197357485a6c37c918f50944ea9e17b2e445afd4380","observation_id":"116077ee-3c71-4342-a926-c29d0e82146b","resolution":{"observed_at":"2026-05-22T20:47:07.152501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a65592c0-3a13-4a9d-80fb-c71aaf5251f6","year":null},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:ae12d5a3a59c7a4cf5c1b56caac1a3c93fd4fa80fba014d6ff78abf21b66bb28","observation_id":"b4bfe1ae-3561-4969-a465-2a9a2764651d","resolution":{"observed_at":"2026-05-22T20:47:07.136569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4b632cd2-aa35-44cb-a53d-0005ae6be9ae","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:56979fb0ea6801dd8ea286ad3ab90c14fd198f310de0632820674320ddd9ff87","observation_id":"922be08b-97a7-4738-ae7a-3dbc7e45a22a","resolution":{"observed_at":"2026-05-22T20:47:07.129638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:72b91cff4610537e2b9fc08388ca3e026376ec4c48d21f907f8e3ba810b51a5b","observation_id":"fd476fc0-c472-463d-b185-cb2ef6da8760","resolution":{"observed_at":"2026-05-11T12:56:11.039336Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T06:16:52.146765Z","title":"ICLR1(2), 3 (2022)","venue":null,"work_id":"f84bfeb2-645f-4da8-b913-48ba34dfdc3e","year":2022},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:0bdb4eebd7ee562341adda7a3ddab71fa4dc3799d15fc86c2ea4278c8ef01d98","observation_id":"54179dc3-eb96-42bf-bd46-b452ecb0cd54","resolution":{"observed_at":"2026-05-22T20:47:07.133164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16760","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T00:46:40.293866Z","title":"Vision-language-action models for autonomous driving: Past, present, and future","venue":null,"work_id":"3ed0d403-c946-4357-b4f8-c33ead499359","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:4c1ff45c2bb3043f198a0a20777f068f35b1faca4d5655ce1842c90a5dff5474","observation_id":"7c063b8f-0f0c-47d6-ac6e-0605a35f6635","resolution":{"observed_at":"2026-05-11T12:56:11.091572Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.486307Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"ed8d3850-8f57-4015-a383-731c5ecc7b6b","year":2023},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:31f871d1ddbd24f944ce0eb4843d54fba146759b118257b6c87a597689189385","observation_id":"aff97c9c-ede8-4070-9933-7d1546fe5ef9","resolution":{"observed_at":"2026-05-22T20:47:07.156454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-05T06:31:46.069300Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2410.23262","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-07-10T08:36:59.765622Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","venue":"cs.CV","work_id":"61d9e129-bb61-41e0-9c9f-b30ba6f179b6","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:fd9f70afa25652fe4dec2c20f8443641540c25fb17ef197baed350ddefb8f3d8","observation_id":"bd8ff382-551f-42cd-bf22-a676d4f38691","resolution":{"observed_at":"2026-05-15T05:08:55.028561Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:0aa7708f583358d188716c15505f3075c9af824c6ebaa6e2ef23eb8e9e2415e2","observation_id":"d2ef1d48-631d-4ff8-8db6-427455325208","resolution":{"observed_at":"2026-05-11T12:56:10.899312Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:fc994a324635a96fb9a35fcb3729af760512b31c05beafc55c2563a131853d28","observation_id":"3dacb700-c033-451c-88f5-d16226ba78c6","resolution":{"observed_at":"2026-05-11T12:56:11.197451Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"0ca2af57-ff62-47a6-af90-cfdf0b7535cf","year":2023},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:cc8304a5af1086a01fb3acd4bfe361d8a12884444b921b6bf2cedc321b30ed18","observation_id":"ff2626a3-d474-4991-949a-bc70e9459721","resolution":{"observed_at":"2026-05-22T20:47:07.122395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03877","last_updated":"2024-11-27T09:31:04Z","snapshot_observed_at":"2026-07-06T18:26:19.664486Z","submitted_at":"2024-06-06T09:12:30Z","title":"Bench2Drive: Towards Multi-Ability Benchmarking of Closed-Loop End-To-End Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2406.03877","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.03877","snapshot_observed_at":"2026-06-30T16:44:56.031336Z","title":"Bench2drive: Towards multi- ability benchmarking of closed-loop end-to-end autonomous driving","venue":null,"work_id":"198e09f9-7399-4636-b63c-a4b1e4009ce9","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2406.03877","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:3d39d2dcc8edfb8bbeb07a0c6c5fe731b34523ee118664caf6ac9ad6712ce577","observation_id":"9083110d-fff3-4749-be24-c6e6aa644eb3","resolution":{"observed_at":"2026-05-11T12:56:10.713483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06571","last_updated":"2025-08-15T05:19:30Z","snapshot_observed_at":"2026-08-05T23:41:31.354015Z","submitted_at":"2025-08-07T06:30:05Z","title":"IRL-VLA: Training an Vision-Language-Action Policy via Reward World Model","version":3},"cited_work":{"arxiv_id":"2508.06571","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.06571","snapshot_observed_at":"2026-07-10T08:36:59.779636Z","title":"Irl-vla: Training an vision-language-action policy via reward world model","venue":"cs.AI","work_id":"949851a8-6409-4b4c-8066-025f27808795","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2508.06571","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:ad171ad3a73ed3fb22525e091df0df93c1103a83fb81ed23272a367e0801c403","observation_id":"906c2d25-f002-4967-b119-fad978051e4b","resolution":{"observed_at":"2026-05-11T12:56:10.808364Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22313","last_updated":"2024-10-29T17:53:56Z","snapshot_observed_at":"2026-07-31T01:16:26.372370Z","submitted_at":"2024-10-29T17:53:56Z","title":"Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2410.22313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.22313","snapshot_observed_at":"2026-07-10T08:36:59.782338Z","title":"Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving","venue":"cs.CV","work_id":"d832f16e-83a0-4311-bc95-39727ba8ccb6","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2410.22313","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:6c874c9472774ee69481087a807a3a5d7d482a584720bbfcb21ba0311d2d208e","observation_id":"73b032d2-7d4c-4969-a84b-a67c75d77e4a","resolution":{"observed_at":"2026-05-15T15:24:24.181007Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"ae1524de-8ff1-411d-aaa9-f6dc6b373f6f","year":2023},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:564ba91e2402be21606dbf33cd85dd0fdc17006049843e98ae4bb12268ca373c","observation_id":"25bcf15e-6a75-444d-bbc8-3543e8bc65e9","resolution":{"observed_at":"2026-05-22T20:47:07.164488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07608","last_updated":"2025-03-10T17:59:42Z","snapshot_observed_at":"2026-08-01T16:55:41.453922Z","submitted_at":"2025-03-10T17:59:42Z","title":"AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","version":1},"cited_work":{"arxiv_id":"2503.07608","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.07608","snapshot_observed_at":"2026-07-05T11:41:02.666322Z","title":"AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","venue":"cs.CV","work_id":"6cb91ed2-9a71-43b2-8cdc-656e5c3e918d","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2503.07608","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:0486c9699b8f061b930f71a1b7ed1b88a33033dc24c51162a7db64159d78246f","observation_id":"67439781-50b9-4660-9c6a-72229284d062","resolution":{"observed_at":"2026-05-16T20:06:27.342141Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: 2024 IEEE International Conference on Robotics and Automation (ICRA)","venue":null,"work_id":"4a4bcf5e-6dd6-47aa-8540-d8516ca4a4c3","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:4b777dd7218a6a105b2a049007bc21a69443ab57bec0b1ace3ee1a5645091824","observation_id":"243b9d87-8b36-4e60-b3b1-226a4ad1dd17","resolution":{"observed_at":"2026-05-22T20:47:07.105040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":"2502.19645","doi":"10.48550/arxiv.2502.19645","metadata_source":"pith","pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","venue":"cs.RO","work_id":"04f46bb3-4346-47e8-bf09-c75d91f96e87","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:d1da06c56129258f4d8dc35c201bfbe18d04cf9e9d76af847c448ec2078ba19f","observation_id":"b119b163-23b1-4cea-8451-0ffdeb22476c","resolution":{"observed_at":"2026-05-11T12:56:10.790534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":"2406.09246","doi":"10.18653/v1/2022.naacl-main.68","metadata_source":"pith","pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","venue":"cs.RO","work_id":"3e7e65c5-5aed-4fe9-8414-2092bcb31cc7","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:d38f150d09c825232714f6b486de605a0bdb40b6df9e5c414fb136cef667d330","observation_id":"aadd2585-2afb-465e-a3b2-74be790aba1d","resolution":{"observed_at":"2026-05-11T12:56:10.984545Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.05083","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T04:09:33.973625Z","title":"Driving on registers.arXiv preprint arXiv:2601.05083","venue":null,"work_id":"93ff0b60-3ad0-4412-8072-661fca2c6c6a","year":2026},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:cf277148476d7a45046952dff90af5c30646e3bfec3d7184cac1508c0d22b088","observation_id":"b0934dcd-c868-4358-8fe9-710d6489fcb8","resolution":{"observed_at":"2026-05-11T12:56:10.779476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Robotics and Automation Letters11(1), 818–825 (2025)","venue":null,"work_id":"0412baa4-3a83-4db8-b367-ba6097cad0c2","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:94236f1003e9d52197d57fd8cf27b321f0f94b67cf520482485526b48edce85b","observation_id":"402fcf9d-1d7a-406a-966a-aff245fb90c7","resolution":{"observed_at":"2026-05-22T20:47:07.109089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.10434","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:30:08.112705Z","title":"Finetuning generative trajectory model with reinforcement learning from human feedback","venue":null,"work_id":"71c3d95e-ed0c-4ad0-b539-7baa8e70ff92","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:b4a69e19535d850b9f942032f695a8b489eff0049d0bacd1eea08c3961e539b7","observation_id":"67ce3d4b-f8fc-4da2-8b08-97242304ce2a","resolution":{"observed_at":"2026-05-11T12:56:11.063948Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12796","last_updated":"2025-12-18T07:25:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-14T17:59:47Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2510.12796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.12796","snapshot_observed_at":"2026-07-10T08:36:59.776968Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","venue":"cs.CV","work_id":"c356b2a8-eaa6-476d-b6d8-8680bb5ddff8","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2510.12796","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:fe7a5ba4d3e2ab897b62b8499b75598a769bd56a3ff90ef5af3678fc4d7c5d7d","observation_id":"cef67672-b465-45d0-a2a1-0c2cd5aa5587","resolution":{"observed_at":"2026-05-17T06:48:01.146010Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.694558Z","title":null,"venue":null,"work_id":"e12d58c4-4f22-43b0-972d-473ba9920ea7","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:5375f6d412882ef910709482687c447583c42c8d0e9444b6f4b31c075c15fc25","observation_id":"994b2fa1-d4f3-4bea-b29c-15121cabefd4","resolution":{"observed_at":"2026-05-22T20:47:07.118301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08052","last_updated":"2025-09-29T17:21:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T03:14:04Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2506.08052","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.08052","snapshot_observed_at":"2026-07-10T08:36:59.842975Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","venue":"cs.CV","work_id":"02bd7e58-a437-4e26-912d-8f1a2e695fa7","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2506.08052","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:05c294e98c277b213db8d5fa50a555515463dd6ec2e8a484b26af70321c25563","observation_id":"1ac3b8d6-ae16-48d9-aca3-c305fb4cf60d","resolution":{"observed_at":"2026-05-15T07:36:24.555133Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-07-06T18:28:42.314877Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":"2406.06978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-07-10T08:36:59.824360Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","venue":"cs.CV","work_id":"c1e2622d-92db-4a96-aa17-8ef832270ed1","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:4982a4b75082838e388c25297cc96c0882a2dbd482f51c7f3b7daca1c61b21f5","observation_id":"e9a16a66-9161-443f-8d86-999c15aa24b6","resolution":{"observed_at":"2026-05-13T23:13:55.802367Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15139","last_updated":"2025-04-10T08:48:37Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T18:59:47Z","title":"DiffusionDrive: Truncated Diffusion Model for End-to-End Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2411.15139","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.15139","snapshot_observed_at":"2026-07-04T19:30:07.203930Z","title":"Diffusiondrive: Trun- 9 cated diffusion model for end-to-end autonomous driving","venue":null,"work_id":"66bfe3b2-f9cb-4d0c-8f12-1de1fdedfa9e","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2411.15139","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:0ad2a9b2ac6f718e39d5fcd838f8854dbe19927cfd254f70f502abac126328b3","observation_id":"3ac94b84-a80e-4539-baec-6773ea47e4ce","resolution":{"observed_at":"2026-05-11T12:56:11.005780Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07234","last_updated":"2025-03-10T12:17:38Z","snapshot_observed_at":"2026-07-06T20:49:51.505079Z","submitted_at":"2025-03-10T12:17:38Z","title":"CoT-Drive: Efficient Motion Forecasting for Autonomous Driving with LLMs and Chain-of-Thought Prompting","version":1},"cited_work":{"arxiv_id":"2503.07234","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.07234","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cot-drive: Efficient motion forecasting for autonomous driving with llms and chain-of-thought prompting","venue":null,"work_id":"fbea6c0c-e338-43b3-b378-5f0ccb14cd7c","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2503.07234","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:0cc918d870f115a211d15e6f8ac6c481b0ae46b5acb35c19cb14cfd791c3e7ad","observation_id":"f7cfea96-37af-4f31-b990-76a538b6951a","resolution":{"observed_at":"2026-05-11T12:56:10.864714Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:b2e8d3a98798dc4ae8417f60d7eb935caf20b53ac4f9172e0386be5e54dee7e7","observation_id":"2a7f40bc-d70f-4d48-a88e-0ad264187f7a","resolution":{"observed_at":"2026-05-11T12:56:11.115086Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Robotics and Automation Letters11(2), 1738–1745 (2025)","venue":null,"work_id":"e44cc0b5-f21c-4637-99e4-413adbea6e5b","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:204ec9e36f3b6e34e81e8d45f798f42aae43531b3a3dd980c78b939823d85a95","observation_id":"e7c9fae6-6369-47d5-848f-0b27ee2f4d2f","resolution":{"observed_at":"2026-05-22T20:47:07.113128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.06521","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.856983Z","title":"Driveworld-vla: Unified latent-space world modeling with vision-language-action for au- tonomous driving.ArXiv, abs/2602.06521","venue":null,"work_id":"470671b9-e73d-4a1f-ada7-4ea10be2e111","year":2026},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:004721780dc367326d3eca4d994e376aedd44ad306fc890e71519fd17a527fd1","observation_id":"12e3d1ff-5f74-4d25-b0e0-c1c8742dffb8","resolution":{"observed_at":"2026-05-11T12:56:11.161045Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00789","last_updated":"2026-04-19T12:44:09Z","snapshot_observed_at":"2026-07-06T22:21:14.144525Z","submitted_at":"2025-08-31T10:34:44Z","title":"CogDriver: Integrating Cognitive Inertia for Temporally Coherent Planning in Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2509.00789","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00789","snapshot_observed_at":"2026-07-10T08:36:59.826885Z","title":"CogDriver: Integrating Cognitive Inertia for Temporally Coherent Planning in Autonomous Driving","venue":"cs.CV","work_id":"a79c7723-4bcc-421d-add0-3eefd4890b8c","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2509.00789","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:902f2744d047bc49d2f0bc2f1522b8fc6e36b9cde69e80a92902ab815d1a04cf","observation_id":"a3d207bd-1ca4-4b4a-a881-ab9a7b62cc5a","resolution":{"observed_at":"2026-05-11T12:56:10.907671Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.00154","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2510.00154 (2025)","venue":null,"work_id":"76139e44-e3b6-421c-9459-f2a994e376f7","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:56b10c5d55121c50bfed232336300835a66340c1606774eac4eb1eada305050f","observation_id":"d44220b4-38c2-4da7-b318-8f7e100feedb","resolution":{"observed_at":"2026-05-11T12:56:10.848353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"de267c04-32b7-4f33-96e1-42d3e34a8e82","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:11203ef42dda9dbddc1dfa5597af6796a7152f86e0f978791a9275a42ec40ba0","observation_id":"f5e02696-7de5-472e-b78b-822b89ce4d87","resolution":{"observed_at":"2026-05-22T20:47:07.097758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01415","last_updated":"2023-12-05T05:26:29Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:57Z","title":"GPT-Driver: Learning to Drive with GPT","version":3},"cited_work":{"arxiv_id":"2310.01415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.01415","snapshot_observed_at":"2026-07-10T00:46:40.273418Z","title":"GPT-Driver: Learning to Drive with GPT","venue":"cs.CV","work_id":"494d528c-1309-40da-a76e-b19cd26efb14","year":2023},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2310.01415","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:73d972c82a0b2c6c9c4513581fc6be437bba0eca5eb148b4eb93e4602c3f2edc","observation_id":"b28be657-c50a-4c2c-b846-b9b1334f1884","resolution":{"observed_at":"2026-05-15T15:05:32.082062Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b58ee7d5-171c-442e-8b22-5489c75963ab","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:0dd666d39016374389d45a3df504ae6a407a06cf2773401670a20fbaeaf1597b","observation_id":"3c6c723d-5219-4c1d-b985-81b3fc001b13","resolution":{"observed_at":"2026-05-22T20:47:07.101818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"d660b0c8-f8a9-498f-8fea-6fb6bab74b26","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:c93712d4ed7071fc55fb8115dde82aa4c5f65620f970bdf5149f10c187002353","observation_id":"2e77d69b-2e51-484c-b826-7730e603d26e","resolution":{"observed_at":"2026-05-22T20:47:07.089684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12772","last_updated":"2025-08-05T19:28:06Z","snapshot_observed_at":"2026-07-06T20:53:41.124209Z","submitted_at":"2025-03-17T03:12:39Z","title":"NuPlanQA: A Large-Scale Dataset and Benchmark for Multi-View Driving Scene Understanding in Multi-Modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2503.12772","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12772","snapshot_observed_at":"2026-07-04T06:49:37.328933Z","title":"Nuplanqa: A large-scale dataset and benchmark for multi-view driving scene understanding in multi-modal large language models","venue":null,"work_id":"7316f2d8-a13d-4719-a8c6-25ce2d81eb3a","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2503.12772","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:59ca30c2a7e2f8afa11abfcfd0ec43eb937d2a09ff73543b536ba2fb9e092776","observation_id":"911d829a-d7de-4a33-a7f6-5cdc442c59c9","resolution":{"observed_at":"2026-05-11T12:56:10.915896Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.24426","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:09:44.910902Z","title":"Counterfactual vla: Self-reflective vision-language-action model with adaptive reasoning","venue":null,"work_id":"be0acb58-7426-4a5f-ac44-70397b80715c","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:b285fc48ceb6bc43c82ac934e7f8aa46472630aba18b13119eb9d53bf620d35e","observation_id":"734970c3-7ecc-4b3b-8b3e-5930f1714247","resolution":{"observed_at":"2026-05-11T12:56:11.190366Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.470128Z","title":"In: Pro- ceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"5a7fe8bc-ff3f-4d2f-9f23-85c2c01890b9","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:8588bf6cf76b2b23a981c478ca18d13ac7493a45ae3d6574c3f664d420ffc432","observation_id":"d295fb3d-1215-4a3f-a2c1-a23f59236b56","resolution":{"observed_at":"2026-05-22T20:47:07.126040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems36, 53728–53741 (2023)","venue":null,"work_id":"26d2c7c0-7464-4908-abb0-b1a25dcba68a","year":2023},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:81fbfa0559d59970b8b120753b7837d664adad3ab294ad26b1ba8983e912cf5a","observation_id":"18cf2ffe-5d59-45b9-bdad-8382cf1b637e","resolution":{"observed_at":"2026-05-22T20:47:07.094106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.21172","last_updated":"2026-06-05T21:24:23Z","snapshot_observed_at":"2026-08-03T02:26:02.645885Z","submitted_at":"2026-02-24T18:17:21Z","title":"NoRD: A Data-Efficient Vision-Language-Action Model that Drives without Reasoning","version":3},"cited_work":{"arxiv_id":"2602.21172","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.21172","snapshot_observed_at":"2026-07-02T08:26:48.275082Z","title":"Nord: A data-efficient vision-language-action model that drives without reasoning.arXiv preprint arXiv:2602.21172","venue":"cs.AI","work_id":"eda9f6e0-c390-4967-a190-cb6b4dbd2d82","year":2026},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2602.21172","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:5f6751c8b27281ea859d7a1e133228e4f830911f4a4a2eb398b0d1d043608cd3","observation_id":"5efc8c15-2d00-44ba-8f16-df24253f203d","resolution":{"observed_at":"2026-06-09T02:05:24.494922Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.11234","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T01:29:22.330488Z","title":"Poutine: Vision-language-trajectory pre-training and reinforcement learning post-training enable robust end-to-end autonomous driving","venue":null,"work_id":"b9c5c925-4544-4d63-aca5-0cabbb44906f","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:631245dff67071b205148ffbc1c0143d908cdda924d1b7b11db1ada8fd9922f8","observation_id":"e8ac09f2-fafa-4cf2-b364-655a0e44dafb","resolution":{"observed_at":"2026-05-11T12:56:11.021377Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.17940","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:30:08.132323Z","title":"Drivedpo: Policy learning via safety dpo for end-to-end autonomous driving","venue":null,"work_id":"87d25e56-fa80-4c5b-a584-6cc24dfcc4ba","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:5f760e188806f761e3b9efe9f8b25501eed6b37d6f1bd6a5757e7f4d8dc93df2","observation_id":"930a61e7-1b1a-47b2-9c55-253b3e8f96ff","resolution":{"observed_at":"2026-05-11T12:56:10.946744Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:1ba7fc7dd30ad1005b766ca96cd2c6a7a8f9109b916318958b26daa8081f62c8","observation_id":"4ea6011a-9580-4077-bd54-9b65ca4d06b8","resolution":{"observed_at":"2026-05-11T12:56:11.032544Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"d9e3c1bf-8407-412e-9124-ea954840d931","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:36f60694709b111d2ba05a96332226869b8d70cd2cb4acc48827bedda152da3f","observation_id":"b9ac469b-d464-420d-9c82-87cb1c65c138","resolution":{"observed_at":"2026-05-22T20:47:07.148635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF Conference on Com- puter Vision and Pattern Recognition","venue":null,"work_id":"52597c26-4f61-4edf-9e5f-a360b0c949ed","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:f212d1d4007c61249d4051c2fbad4639108f02ab7a6a3439bf81e9bdf3d37112","observation_id":"2ca4ee44-680b-4b1b-b209-8ba7bc973848","resolution":{"observed_at":"2026-05-22T20:47:07.140609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10226","last_updated":"2026-04-14T00:44:42Z","snapshot_observed_at":"2026-08-02T07:00:45.391301Z","submitted_at":"2025-12-11T02:22:07Z","title":"Latent Chain-of-Thought World Modeling for End-to-End Driving","version":2},"cited_work":{"arxiv_id":"2512.10226","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.10226","snapshot_observed_at":"2026-07-01T19:26:00.345897Z","title":"Latent Chain-of-Thought World Modeling for End-to-End Driving","venue":"cs.CV","work_id":"fa655521-b735-4544-b0b5-5892510a903e","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2512.10226","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:a8db27e6d3d792a3822a0f97e3b0b882eedd1e975da0f3381c1094cf277de6d9","observation_id":"397e8714-1c2c-403a-92e9-e0a47aca483a","resolution":{"observed_at":"2026-05-11T12:56:11.168497Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.11083","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T15:05:47.262117Z","title":"arXiv preprint arXiv:2510.11083 (2025)","venue":null,"work_id":"60a8d4f3-c56f-49cf-97f2-d41be877741a","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:c7800c19436a3dfdfa4558b1948d491c3d44e2b5af541010f9b322839551bd58","observation_id":"46bccbfa-dead-4420-ad64-d4e9140fd750","resolution":{"observed_at":"2026-05-11T12:56:11.288310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12289","last_updated":"2024-06-25T17:55:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-19T17:04:04Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":"2402.12289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12289","snapshot_observed_at":"2026-07-10T08:36:59.801031Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","venue":"cs.CV","work_id":"a0e2e7ab-9d0a-4fdb-9309-3c8cf7ed0226","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2402.12289","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:e80bd7ad9381d1487da84a04647204e253b890e41d366e252e30c5ac5a8755f4","observation_id":"f4225296-d5dd-4f1b-80c9-917db4c7c6a4","resolution":{"observed_at":"2026-05-12T19:22:35.820214Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11651","last_updated":"2024-04-16T11:41:13Z","snapshot_observed_at":"2026-07-06T17:31:50.029722Z","submitted_at":"2024-02-18T17:10:07Z","title":"Learning From Failure: Integrating Negative Examples when Fine-tuning Large Language Models as Agents","version":2},"cited_work":{"arxiv_id":"2402.11651","doi":"10.48550/arxiv.2402.11651","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning from failure: Integrating negative examples when fine-tuning large language models as agents","venue":"arXiv (Cornell University)","work_id":"52cd6fe7-55b7-481f-aeb6-984d7c073995","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2402.11651","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:5a619005a3d0c4971bacf97908f7c02150304d87f500406befadeb7673398585","observation_id":"a149a689-1aa9-4f62-9159-2f6e36b7fadf","resolution":{"observed_at":"2026-05-11T12:56:11.106795Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-20T22:23:34.654123+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T22:23:34.654123+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01533","last_updated":"2025-04-16T15:12:21Z","snapshot_observed_at":"2026-07-06T18:08:56.480769Z","submitted_at":"2024-05-02T17:59:24Z","title":"OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning","version":2},"cited_work":{"arxiv_id":"2405.01533","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.01533","snapshot_observed_at":"2026-07-05T11:41:02.615494Z","title":"Omnidrive: A holistic llm-agent framework for autonomous driving with 3d perception, reasoning and planning","venue":"cs.CV","work_id":"a9c52cec-4edd-4f36-b814-b3f42bc892b7","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2405.01533","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:2b4971c3d4351df797f6c81b01ec8559911d5aa922db134cdee2acf7ec54f970","observation_id":"bfa2d2b0-f6b4-44b8-b279-3558c244c9cb","resolution":{"observed_at":"2026-05-11T12:56:10.966885Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00088","last_updated":"2026-01-07T09:09:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-30T01:25:34Z","title":"Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail","version":2},"cited_work":{"arxiv_id":"2511.00088","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.00088","snapshot_observed_at":"2026-07-10T20:17:33.699563Z","title":"Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail","venue":"cs.RO","work_id":"eed9adfb-3fa1-4c0c-abb9-e31b79bba031","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2511.00088","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:131fb062280749f7b6f3140310482a9996bbcddba3a7a3daa8e045bb7338e408","observation_id":"ad12b233-e5e3-4877-9739-c8cc44b57026","resolution":{"observed_at":"2026-05-18T02:35:13.510586Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.09372","doi":"10.48550/arxiv.2509.09372","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vla-adapter: An effective paradigm 10 for tiny-scale vision-language-action model","venue":"arXiv (Cornell University)","work_id":"3a5ccb46-7c4b-4722-a692-4da07c94d2b1","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:95c7aaae6130f3ab7079705527ed85f94401d8428e84c860a5ea9e18d9a5afb1","observation_id":"b0a7956f-96fb-43da-9c6c-6c3efdaced85","resolution":{"observed_at":"2026-05-11T12:56:11.361358Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.05611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.771289Z","title":"Latentvla: Efficient vision-language models for autonomous driving via latent action prediction","venue":null,"work_id":"e974f766-0c20-48d7-bc7a-5035d22ae52f","year":2026},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:522df8a1bf62c6d32a55d90fb1ec7f7b2d91d81de47476ad44a3aeebe7e54b58","observation_id":"92a82417-efa6-4e06-8e02-9a7fdf6d3632","resolution":{"observed_at":"2026-05-11T12:56:11.097603Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.462304Z","title":"In: Proceed- ings of the Winter Conference on Applications of Computer Vision","venue":null,"work_id":"8a5c87f1-88ac-47f6-88a0-7ac1af4e72d3","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:c68003216351c5782c0953ed4a2ff21be6ef9da82cb622bb0889b568063d3f68","observation_id":"47ec9c99-1e16-44d9-b7ac-0a255e4be840","resolution":{"observed_at":"2026-05-22T20:47:07.085879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.26125","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:24.461790Z","title":"Wod-e2e: Waymo open dataset for end-to-end driving in challenging long-tail scenarios.arXiv preprint arXiv:2510.26125","venue":null,"work_id":"4a3f7018-e4da-4130-8356-de2679f76155","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:4be589c10c49ab8bf31fde812b90a8bdee7f5de692d9f899cbdd6e594bb22a0c","observation_id":"a3ce2027-81cf-4301-990d-2fea4c23e3e7","resolution":{"observed_at":"2026-05-11T12:56:10.858255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14446","last_updated":"2025-08-29T20:50:08Z","snapshot_observed_at":"2026-08-02T03:23:17.398540Z","submitted_at":"2024-12-19T01:53:36Z","title":"VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision","version":2},"cited_work":{"arxiv_id":"2412.14446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.14446","snapshot_observed_at":"2026-07-04T08:49:42.140527Z","title":"Vlm-ad: End-to-end autonomous driving through vision-language model supervision","venue":null,"work_id":"27a2e683-9815-4627-9722-a252c7441cd9","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2412.14446","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:f8c864ffef9a3153f81ba8d1ae926fa5ea6b9fc44414bc02d34d99563db0177b","observation_id":"f8d6b859-adbf-420a-867f-45858349138a","resolution":{"observed_at":"2026-05-11T12:56:11.153361Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.06659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:30:08.072014Z","title":"Drivesuprim: Towards precise trajectory selection for end-to-end planning","venue":null,"work_id":"d445dbeb-a6af-49a4-8615-d52d711ed40a","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:a6e4e7868b2b5d6466ea1562e1746e50f7674ee2cae3c202297f35d47b48d50b","observation_id":"ec1ea336-e583-40ee-8be8-7585446c0117","resolution":{"observed_at":"2026-05-11T12:56:10.999420Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.24795","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:19:47.599866Z","title":"arXiv preprint arXiv:2510.24795 (2025)","venue":null,"work_id":"91f872e2-5996-425c-a11e-e11db03ecb08","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:47c285ac7caffb84f849d9475b8db5ab398188a4bfdf0672d50862804d946756","observation_id":"a134ea83-0c2b-4736-953e-2f6542913f65","resolution":{"observed_at":"2026-05-11T12:56:11.057291Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03601","last_updated":"2024-08-14T04:31:32Z","snapshot_observed_at":"2026-08-03T08:33:00.534249Z","submitted_at":"2024-08-07T07:41:01Z","title":"DRAMA: An Efficient End-to-end Motion Planner for Autonomous Driving with Mamba","version":2},"cited_work":{"arxiv_id":"2408.03601","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.03601","snapshot_observed_at":"2026-07-10T08:36:59.837755Z","title":"Drama: An efficient end-to-end motion planner for autonomous driving with mamba","venue":"cs.RO","work_id":"1f979124-9895-424e-9a76-3b3111de8eda","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2408.03601","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:e985aa86d3cabbe9f8cc933b9e97a285c54fe0f69c20a8abc4233807a930b178","observation_id":"4a3acc55-cd9b-4139-9212-7ddade05540e","resolution":{"observed_at":"2026-05-11T12:56:10.977796Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17685","last_updated":"2025-11-11T01:31:25Z","snapshot_observed_at":"2026-08-02T20:06:32.255780Z","submitted_at":"2025-05-23T09:55:32Z","title":"FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2505.17685","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17685","snapshot_observed_at":"2026-07-08T05:34:32.413426Z","title":"FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving","venue":"cs.CV","work_id":"6ad88a41-f4d4-4df5-b676-2d30afb525ce","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2505.17685","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:de3b27473cbad05178eaf95a0b3ffb17733a9ce9bd11203f494b6f538ef5f3de","observation_id":"43f42b3c-74a1-45b1-8d97-5614c1188767","resolution":{"observed_at":"2026-05-15T19:19:43.280111Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.21952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T15:07:04.063556Z","title":"MindDriver: Introducing progressive multimodal reasoning for autonomous driving","venue":null,"work_id":"8dcca1cc-2eac-451e-ad61-001897d0a607","year":2026},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:c686d32c693cf94010879f4604180429328eb1cc39d6c67bff8dbed415674311","observation_id":"a85a730a-fd9f-4ac4-a119-6fec83122ead","resolution":{"observed_at":"2026-05-11T12:56:11.177945Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10856","last_updated":"2026-04-12T23:37:07Z","snapshot_observed_at":"2026-08-03T04:48:13.528107Z","submitted_at":"2026-04-12T23:37:07Z","title":"BridgeSim: Unveiling the OL-CL Gap in End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2604.10856","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.10856","snapshot_observed_at":"2026-07-04T01:29:22.340793Z","title":"BridgeSim: Unveiling the OL-CL Gap in End-to-End Autonomous Driving","venue":"cs.RO","work_id":"3147d625-acee-4658-9edd-85f63dd3e635","year":2026},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2604.10856","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:146c5caf9492c291312fa6b5344f92ff55689b0f6e1c20a41a9c244a312157d4","observation_id":"a1329af0-46e8-4135-8e8c-edd6fa9eda46","resolution":{"observed_at":"2026-05-11T12:56:11.074634Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.23463","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.848781Z","title":"Opendrivevla: Towards end-to-end au- tonomous driving with large vision language action model","venue":null,"work_id":"67021d38-441c-4135-9cf6-081c176c598c","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:55501c0d210bc5b0460c3f145cf662bcd9f4ec6a8ae6c5728e1e6b6ec0e851d6","observation_id":"7e0d2726-03ad-4906-8718-399a6d3b0dd8","resolution":{"observed_at":"2026-05-11T12:56:11.216355Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13757","last_updated":"2025-11-05T23:46:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-16T17:58:50Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","version":3},"cited_work":{"arxiv_id":"2506.13757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13757","snapshot_observed_at":"2026-07-10T08:36:59.854319Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","venue":"cs.CV","work_id":"945172fb-0f3b-43be-88b4-ae61042517e9","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2506.13757","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:6851c9f4e4f69417df46deaf3ccb4500006ce637d964a7d4779bf3b97631ca07","observation_id":"05f19485-0318-47ca-ab14-8f962ce62610","resolution":{"observed_at":"2026-05-14T21:46:44.401546Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01812","last_updated":"2025-08-05T19:48:49Z","snapshot_observed_at":"2026-08-04T08:00:36.608727Z","submitted_at":"2024-12-02T18:55:34Z","title":"V2XPnP: Vehicle-to-Everything Spatio-Temporal Fusion for Multi-Agent Perception and Prediction","version":3},"cited_work":{"arxiv_id":"2412.01812","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.01812","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V2XPnP: Vehicle-to-everything spatio- temporal fusion for multi-agent perception and prediction","venue":null,"work_id":"522dc60a-edbb-4313-b534-6239e5cbcfcf","year":2024},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2412.01812","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:3c65330b767ff45b1e277baf8d05fc2bba8157033a88b1e0ddc6094cd17b7f0a","observation_id":"e812c12a-e386-493e-ae40-b47bc47c2131","resolution":{"observed_at":"2026-05-11T12:56:11.390402Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"396ea378-16ad-4749-87f0-52a40f297a69","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:fec76205cefe6fcc2ebdcb9ef03f2c8b0909115630eee12763a765be3188c766","observation_id":"4374d39a-230d-4b72-8ea4-f71c7c001518","resolution":{"observed_at":"2026-05-22T20:47:07.078586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.07745","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:30:08.059832Z","title":"re- gions important for driving","venue":null,"work_id":"e0b7a052-e6b6-4950-a9c2-1f052f74afec","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:1094e129475ff71bcc2e9680ddf9db49bdcf9b9e148032eef17a780ac7d7336b","observation_id":"36c630fb-b576-4419-bad0-885883c974ec","resolution":{"observed_at":"2026-05-11T12:56:10.937138Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"straight","venue":null,"work_id":"235be313-9681-4941-81a2-6a624561e50a","year":2048},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:d6c52795f8e257a3d18adea04a2e6446e3b385d586f20f2592e4253b4903f55a","observation_id":"0cacf345-c3ff-4e02-86a9-03f4ce68cdc4","resolution":{"observed_at":"2026-05-22T20:47:07.081988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model"},"reference_resolution":{"displayed":86,"state_counts":{"malformed_identifier":0,"metadata_mismatch":48,"parse_uncertain":0,"unresolved":6,"verified_exact":10,"verified_fuzzy":22},"total_outbound_references":86},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 86 of 86 outbound references and 9 inbound Pith citation observations for arXiv:2604.19710."}