{"as_of":"2026-08-19T05:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb01d2b3b50c1922c9261c2c833be5ee227128c7949f8292ac945b7ae976d994","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T08:30:29.351159Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08375/citation-record","integrity":"/paper/2607.08375/integrity","json":"/paper/2607.08375/citation-record.json","paper":"/paper/2607.08375"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:cf6daf2ca7f79942350855c412c679396c9a0ada9e288a920e7ab28d5e743fd4","observation_id":"c9d6145b-bfe5-4ac8-ab50-51909f2dcf40","resolution":{"observed_at":"2026-07-10T08:36:59.792059Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:b3286f41de289282bf429e99bb502f5a9286efda5aa5f549597666d7d9181895","observation_id":"2f441632-3da3-4194-8eef-02ca64518182","resolution":{"observed_at":"2026-07-10T08:36:59.797199Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:47:02.494579Z","title":"In: 2025 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)","venue":null,"work_id":"54e617fb-97bf-4328-aba6-09351e3496a9","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:440341f72124b7a28106bcdafe2ed2e44d2c04cca381633781c020d2f3c2cea9","observation_id":"5077c05e-9af8-42f7-9e48-6cde919c2649","resolution":{"observed_at":"2026-07-10T08:47:02.495699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:47:02.492839Z","title":"IEEE Transactions on Pattern Analysis and Ma- chine Intelligence46(12), 10164–10183 (2024)","venue":null,"work_id":"a9c8190a-2276-4d8f-857d-5a829514265d","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:835cf2ca483568b53bc78063045c163dcc94c2d2ef32bc79d34855706df3e6ee","observation_id":"aa7efdb1-c004-4997-a13d-36ee34803646","resolution":{"observed_at":"2026-07-10T08:47:02.494023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13243","last_updated":"2026-04-17T23:12:55Z","snapshot_observed_at":"2026-08-14T22:14:39.326583Z","submitted_at":"2024-02-20T18:55:09Z","title":"VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning","version":2},"cited_work":{"arxiv_id":"2402.13243","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.13243","snapshot_observed_at":"2026-07-10T08:36:59.845914Z","title":"VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning","venue":"cs.CV","work_id":"e7670f83-e1e1-41e7-86eb-39477a3a10b2","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2402.13243","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:b2f0ccb12029d5371cc7d8ae52143eb4ca6777f3acf1d2ad1b686e4661190911","observation_id":"08fe4a81-7a5c-4b57-8834-30f3b5f0cb44","resolution":{"observed_at":"2026-07-10T08:36:59.847544Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.737279Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"23c51ada-4b46-4c77-8c9b-c9a232370b19","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:bbd3915ad81f6c4ffff4ac44c8bc6165a76a067f5c17a5bd32e683a906dbf8dc","observation_id":"046fd413-b7db-435a-b7b8-d6832a1daa7f","resolution":{"observed_at":"2026-07-10T08:36:59.738653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23757","last_updated":"2025-05-29T17:59:46Z","snapshot_observed_at":"2026-08-17T23:27:19.603501Z","submitted_at":"2025-05-29T17:59:46Z","title":"Impromptu VLA: Open Weights and Open Data for Driving Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":"2505.23757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23757","snapshot_observed_at":"2026-07-10T08:36:59.862431Z","title":"Chi, H.-a","venue":"cs.CV","work_id":"eb7dbfdb-1c0e-4e76-8cc5-ff8a12e35ad8","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2505.23757","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:f25e6d281e03b561f631d749d31f7673d32f611378e5aec78dfe98aa07115a01","observation_id":"866d70bb-612c-4630-b88e-85afed4dc9b8","resolution":{"observed_at":"2026-07-10T08:36:59.863731Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.739369Z","title":"IEEE trans- actions on pattern analysis and machine intelligence45(11), 12878–12895 (2022)","venue":null,"work_id":"4a287224-f80e-4ebd-aef1-da033b25fa7a","year":2022},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:89cd93b2d3182794c5a33654f90c826c79ac3207010455558c10ed0d3e3ba4df","observation_id":"4069f1cb-5f8a-4ac6-91f3-d8757210039f","resolution":{"observed_at":"2026-07-10T08:36:59.740781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.06474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.788055Z","title":"arXiv preprint arXiv:2601.06474 (2026)","venue":null,"work_id":"22c9eead-9cea-4bdb-8016-6dbbd7720649","year":2026},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:1fc94841fcd3c91aa2291cc3e266e487e6a46d1153a869991f39ac76d3e942d0","observation_id":"4b7f75d2-fdb0-4ecb-af8e-db3cd1bee492","resolution":{"observed_at":"2026-07-10T08:36:59.789648Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.491788Z","title":"Advances in Neural Information Processing Systems37, 28706–28719 (2024)","venue":null,"work_id":"3c49e213-64bd-4dd4-a775-755b9ed29b19","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:d4c06667f5888eb8cd563fa958f4bcf0c5a064141fc061df7494f21693021a2e","observation_id":"99015875-f986-4dbc-95a2-b0cdc5036d72","resolution":{"observed_at":"2026-07-10T08:37:00.492967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.493689Z","title":"In: Proceed- ings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"8d98db68-48b5-44e2-83bf-949c90ab95a9","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:6506d74a7c1e4f2f4da271367a2ed94b593deb49bf3b10406940a02f6b8816da","observation_id":"742fc2e2-b262-46c5-91c1-4cc3392eaf23","resolution":{"observed_at":"2026-07-10T08:37:00.494797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.696518Z","title":"IEEE Robotics and Automation Letters11(1), 226–233 (2025)","venue":null,"work_id":"6bef9bd2-950d-4f9e-97ef-44778f513396","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:2ce3824577b4a5e71c814ce2cf000416745048a3357db43ada29fcd3c2b8793e","observation_id":"f6707db4-34f7-40b2-8d76-d9fe7a75b538","resolution":{"observed_at":"2026-07-10T08:36:59.697918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.490156Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"19409c14-2445-4c62-94dc-e0bf2bad809d","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:aeadc456ecc5890eb6fc6df8ed8e3aaeda4d81d2e5ffb337a056adba0e11a72c","observation_id":"a5f6aca3-93c2-469d-9fc0-c398c706d560","resolution":{"observed_at":"2026-07-10T08:37:00.491271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:b44407a49ce5bd15a495f9d740f67270a8ae0aae85d7aa3314a4adba54c52529","observation_id":"7ba0cc93-6510-4627-978c-31e0d7faffe5","resolution":{"observed_at":"2026-07-10T08:36:59.810216Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15111","last_updated":"2025-05-21T05:05:38Z","snapshot_observed_at":"2026-08-17T18:11:37.287173Z","submitted_at":"2025-05-21T05:05:38Z","title":"iPad: Iterative Proposal-centric End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2505.15111","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15111","snapshot_observed_at":"2026-07-10T08:36:59.832088Z","title":"Marcel Hallgarten, Julian Zapata, Martin Stoll, Katrin Renz, and Andreas Zell","venue":"cs.CV","work_id":"8d622f56-73cd-4199-b12d-af1a96142c26","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2505.15111","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:041cb485780e32f5daa0958d728508926e34d8e77a3f2bc7bd59e3116c9c5187","observation_id":"75ac4ce3-c5cf-4739-928a-efbab44e6982","resolution":{"observed_at":"2026-07-10T08:36:59.833420Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.19221","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.819218Z","title":"Percept-W AM: Perception-enhanced world-awareness-action model for robust end-to-end autonomous driving","venue":null,"work_id":"1b0e95ac-bd5b-4ef8-8b7a-8153a709e612","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:ce4caee7a441bbb27ae2522494c954e900347505c0fe8c0fb435e4a2404deb2d","observation_id":"b288930c-9420-4b21-a65e-9da12e8dcf40","resolution":{"observed_at":"2026-07-10T08:36:59.820614Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.482958Z","title":"IEEE Transactions on Intelligent Transportation Systems22(4), 2076–2087 (2020)","venue":null,"work_id":"d76a5e4b-41c5-4aab-a984-8e9200ca1c2d","year":2076},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:cdf199b2e29e56811bc36e56d8ed92d37e27cf81ec0f5f87ea3cd38cb0787fb8","observation_id":"6c7cff0f-eec6-4b70-b6bc-eece36d39655","resolution":{"observed_at":"2026-07-10T08:37:00.484126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:27:03.318797Z","title":"Advances in neural information processing systems33, 6840–6851 (2020)","venue":null,"work_id":"effc8173-611c-4e0c-8d0b-066e3ae07f56","year":2020},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:76e4f89a177fa058de793d300abbbd149402c43cf1f8d959e6999d578f24e177","observation_id":"fafb9cdb-35a6-47fd-ab55-f5bea7688b3a","resolution":{"observed_at":"2026-07-10T08:37:00.485798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.481040Z","title":null,"venue":null,"work_id":"4acb55eb-9d98-4ca3-85a4-80681d9f632a","year":2022},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:5366463d80b635ecfb5534c5fe388bad6dc6e1c4cdd41921410067f264186222","observation_id":"0907c5f1-53a3-4378-b9b7-6a7113fd2ce0","resolution":{"observed_at":"2026-07-10T08:37:00.482186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.486307Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"ed8d3850-8f57-4015-a383-731c5ecc7b6b","year":2023},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:786db8e542306a0090aa53ba72a5a633edb92624bfbf2e4099ccaf2ee9087964","observation_id":"6f478842-ce74-48c1-8e90-0f93cbf0b246","resolution":{"observed_at":"2026-07-10T08:37:00.487403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.488086Z","title":"Trans- portation Research Part C: Emerging Technologies180, 105321 (2025)","venue":null,"work_id":"0f2c7089-2c35-4aa6-a1ae-2c37ea8401a1","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:898a2a60e99a9bbf2d85ac17f9c3b36c5b4a5aeb8d4f00e9563b8d52418e1b7f","observation_id":"9831c0bd-32cf-40d3-9e4e-17dafca8861c","resolution":{"observed_at":"2026-07-10T08:37:00.489480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-16T10:28:44.439043Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2410.23262","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-07-10T08:36:59.765622Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","venue":"cs.CV","work_id":"61d9e129-bb61-41e0-9c9f-b30ba6f179b6","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:7164f9b785c61e44134ee6fb38bea75f1031bd59f3cd2f6cb6d78bda5138ee67","observation_id":"944cccb9-1291-4e97-9169-e8fbc2dd9064","resolution":{"observed_at":"2026-07-10T08:36:59.767275Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19381","last_updated":"2025-06-03T02:28:31Z","snapshot_observed_at":"2026-08-15T22:25:11.974320Z","submitted_at":"2025-05-26T00:49:35Z","title":"DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving","version":4},"cited_work":{"arxiv_id":"2505.19381","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.19381","snapshot_observed_at":"2026-07-10T08:36:59.840386Z","title":"Diffvla: Vision-language guided diffusion planning for autonomous driving.arXiv preprint arXiv:2505.19381","venue":"cs.AI","work_id":"8603f4cb-e108-42c9-a17a-d8ec96d4dccb","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2505.19381","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:630561e81bcfa1a9fef72bc1f12c157c317e78ffa8067b62b3a97502a20aaae8","observation_id":"1cdd2119-b015-4b9b-8da5-a5634c3d0a01","resolution":{"observed_at":"2026-07-10T08:36:59.841765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06571","last_updated":"2025-08-15T05:19:30Z","snapshot_observed_at":"2026-08-14T18:50:37.854746Z","submitted_at":"2025-08-07T06:30:05Z","title":"IRL-VLA: Training an Vision-Language-Action Policy via Reward World Model","version":3},"cited_work":{"arxiv_id":"2508.06571","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.06571","snapshot_observed_at":"2026-07-10T08:36:59.779636Z","title":"Irl-vla: Training an vision-language-action policy via reward world model","venue":"cs.AI","work_id":"949851a8-6409-4b4c-8066-025f27808795","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2508.06571","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:5c9c949cd73d494d75f0551598018bca298609679b1ffa7bae4a56ceb19c1b3b","observation_id":"29aca45e-edf5-4daa-8fdf-06915c8773ba","resolution":{"observed_at":"2026-07-10T08:36:59.781035Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22313","last_updated":"2024-10-29T17:53:56Z","snapshot_observed_at":"2026-07-31T01:16:26.372370Z","submitted_at":"2024-10-29T17:53:56Z","title":"Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2410.22313","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.22313","snapshot_observed_at":"2026-07-10T08:36:59.782338Z","title":"Senna: Bridging Large Vision-Language Models and End-to-End Autonomous Driving","venue":"cs.CV","work_id":"d832f16e-83a0-4311-bc95-39727ba8ccb6","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2410.22313","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:1f64e8ec0dd134f139d3dd1b7674976db5e8e9892d7f53b5d01f9c996934799e","observation_id":"3dd29ca0-8928-49d4-888a-5c43a0a76bed","resolution":{"observed_at":"2026-07-10T08:36:59.784134Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.477996Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"f44e950f-8ca4-4c6b-988a-ccb4f32e0d79","year":2023},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:bf8cae44f2f2f9ac4708ed0347d8623199f596747c36d5f13ffa8a646b02b9f7","observation_id":"772d974c-2742-415d-a8dc-cf5ce8a651c6","resolution":{"observed_at":"2026-07-10T08:37:00.479026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.479509Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"4c356f16-d4fe-4eb1-aee1-99bd4d812857","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:ffa6d6572a371210d3d3ff63d0b6d333ae84812d6fc49679b19338aac1305dec","observation_id":"40cfa06a-ab11-4800-812b-993b53db5796","resolution":{"observed_at":"2026-07-10T08:37:00.480550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.05640","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.785396Z","title":"Sgdrive: Scene-to-goal hierarchical world cognition for autonomous driving","venue":null,"work_id":"3612857e-abbf-4542-ba92-19571f610ff8","year":2026},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:d0f9d1019475cdb8c3dd43bb348336fbe9ec4ff4c39a476ff598714fa91939dc","observation_id":"3e6a6aae-eae9-48e2-a42d-191ac68c7fe5","resolution":{"observed_at":"2026-07-10T08:36:59.786927Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.20109","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.829424Z","title":"Discrete diffusion for reflective vision-language-action models in autonomous driving","venue":null,"work_id":"2cf87071-6ee0-4979-901a-d931280eac40","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:497a1306d0ae6d698069678f951ca9b9091daafeb277027397de6866922896e7","observation_id":"4e1ab9eb-1308-4a73-8308-96cf28c30bd2","resolution":{"observed_at":"2026-07-10T08:36:59.830908Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12796","last_updated":"2025-12-18T07:25:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-14T17:59:47Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2510.12796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.12796","snapshot_observed_at":"2026-07-10T08:36:59.776968Z","title":"DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving","venue":"cs.CV","work_id":"c356b2a8-eaa6-476d-b6d8-8680bb5ddff8","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2510.12796","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:62e4d5b65cc93c85de492198b086c4097500f070c35bbd3d4caa99d4705efb99","observation_id":"ec012759-c158-4f6b-b11a-11992e68710c","resolution":{"observed_at":"2026-07-10T08:36:59.778364Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.694558Z","title":null,"venue":null,"work_id":"e12d58c4-4f22-43b0-972d-473ba9920ea7","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:a206e06adc554c7a07c72512e8149e12f09f7afe796cc24deea0502dd4a808d5","observation_id":"6ddc9071-f3f5-4561-9ff9-6cada1841a83","resolution":{"observed_at":"2026-07-10T08:36:59.695913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08052","last_updated":"2025-09-29T17:21:41Z","snapshot_observed_at":"2026-08-15T10:50:53.459374Z","submitted_at":"2025-06-09T03:14:04Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2506.08052","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.08052","snapshot_observed_at":"2026-07-10T08:36:59.842975Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","venue":"cs.CV","work_id":"02bd7e58-a437-4e26-912d-8f1a2e695fa7","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2506.08052","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:67b5667259f828588f1d8fa1f72b1fb77309b81dfd7c9b035bad943a04d63d6f","observation_id":"b69876e0-9ca2-486a-9a99-7fd3a885c77a","resolution":{"observed_at":"2026-07-10T08:36:59.844632Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-08-18T07:57:58.891611Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":"2406.06978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-07-10T08:36:59.824360Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","venue":"cs.CV","work_id":"c1e2622d-92db-4a96-aa17-8ef832270ed1","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:4c0d3379e1fab29e57b4600d84899388707bed7a05658712231e2ddb5da9e5d6","observation_id":"0482e74a-4163-47ac-a08e-ca67c85d0fab","resolution":{"observed_at":"2026-07-10T08:36:59.825706Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.471670Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence47(3), 2020–2036 (2024)","venue":null,"work_id":"df3fdf4f-4cd8-4c2e-b28e-e733c242dfdb","year":2020},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:ed6fff1d9467d35e20c557357e30595061068b4bdabc9db3befcb8c7e1b72e3b","observation_id":"c6b5d710-6bba-48cd-b7d1-f558362de36b","resolution":{"observed_at":"2026-07-10T08:37:00.472827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.473337Z","title":null,"venue":null,"work_id":"e0674707-e4e3-4032-aff9-a200be7ef5bf","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:79f800a8f27340660ba9dc48d3d613daa1e6963af569d49114877c111eec1478","observation_id":"c6bc4ab1-e8e8-4d9c-be9a-1b1f74741495","resolution":{"observed_at":"2026-07-10T08:37:00.474325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.06521","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.856983Z","title":"Driveworld-vla: Unified latent-space world modeling with vision-language-action for au- tonomous driving.ArXiv, abs/2602.06521","venue":null,"work_id":"470671b9-e73d-4a1f-ada7-4ea10be2e111","year":2026},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:6bde850c01904c80699b64257c88cc79a986a4da0ee457b3e816cdafc6952617","observation_id":"e46d0081-4529-4946-945f-d5f2f7570b4f","resolution":{"observed_at":"2026-07-10T08:36:59.858430Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00789","last_updated":"2026-04-19T12:44:09Z","snapshot_observed_at":"2026-08-14T21:37:38.681171Z","submitted_at":"2025-08-31T10:34:44Z","title":"CogDriver: Integrating Cognitive Inertia for Temporally Coherent Planning in Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2509.00789","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00789","snapshot_observed_at":"2026-07-10T08:36:59.826885Z","title":"CogDriver: Integrating Cognitive Inertia for Temporally Coherent Planning in Autonomous Driving","venue":"cs.CV","work_id":"a79c7723-4bcc-421d-add0-3eefd4890b8c","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2509.00789","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:237451771a2cd7b1e036b12ac7beb008813f6a2d8a71e41c47ad092d5135e73b","observation_id":"6aaab0dc-5f23-468a-9f9c-ed3350d03f10","resolution":{"observed_at":"2026-07-10T08:36:59.828258Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.12799","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.859649Z","title":"arXiv preprint arXiv:2512.12799 (2025)","venue":null,"work_id":"4e24842e-f8b5-45f3-a446-edaf8f073078","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:06ef0270f859d5f64dd49d385d72a1a3bf3b7afe66153c6603c0ae6a9d77718b","observation_id":"2f1eff42-3683-4450-8f7f-061aaf5b006f","resolution":{"observed_at":"2026-07-10T08:36:59.861170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.13769","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.811333Z","title":"Adathinkdrive: Adaptive thinking via reinforcement learning for autonomous driving","venue":null,"work_id":"338d5fbe-d397-489d-959b-c4319523f102","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:954390d3a8ee1783b5bb9eb7a7352f8375b844b76d53528dad36b36ec47dca43","observation_id":"8550b941-c72a-43f4-be33-267343402eb7","resolution":{"observed_at":"2026-07-10T08:36:59.812866Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.468632Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"faa6f5d2-aa4d-4cbc-aa5d-24b86a1f387e","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:043c84df8fee6c424c260c579bb6c423bee56efbd477d6118788868459052dc8","observation_id":"9c75bd26-5b03-4a8a-af7c-634e3207ecca","resolution":{"observed_at":"2026-07-10T08:37:00.469628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:27:03.332077Z","title":null,"venue":null,"work_id":"1b7735a2-669d-484f-a863-738e74836eb0","year":2023},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:cf57efcdbded45ebb5b98c24382b0848a630402b93037f4f2d6e2f6bb08bc7a8","observation_id":"cf2435bf-4874-472b-8c82-4f8157f53130","resolution":{"observed_at":"2026-07-10T08:37:00.468135Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.15298","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.798429Z","title":"Agentthink: A unified framework for tool-augmented chain-of-thought reasoning in vision-language models for autonomous driving","venue":null,"work_id":"cda6604b-34d8-4ab0-92aa-af608d3f6f6d","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:673e53e607c7a41e950e4c507b92219769f56c80620c2853c3f36e32a607b47a","observation_id":"b6fd0c34-d860-4967-91f3-1bd8ab53c5ff","resolution":{"observed_at":"2026-07-10T08:36:59.799878Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.470128Z","title":"In: Pro- ceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"5a7fe8bc-ff3f-4d2f-9f23-85c2c01890b9","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:d315da7d3a06719e09a77b1c4f136a2fe482f01725677798d75ac733b1a72358","observation_id":"5f7a2567-55e4-467c-94c0-73198d4e04f7","resolution":{"observed_at":"2026-07-10T08:37:00.471167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.476484Z","title":null,"venue":null,"work_id":"74cc12fe-e654-4e3f-8519-e44545d8193c","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:232f13dfde63435f16d80aed7c260363b6397b5463bd7014d7058518ce0011fd","observation_id":"0127f8d0-8073-4871-a905-9d537f600df0","resolution":{"observed_at":"2026-07-10T08:37:00.477484Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.465606Z","title":"In: 2025 IEEE International Conference on Robotics and Automation (ICRA)","venue":null,"work_id":"ae2c8048-9275-4e66-8bb4-0620d7d79284","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:9499c955728980ecde46bd1aa47d961c09870772f8347e30eb0b7e3b1e69b80f","observation_id":"1b176d80-ae1c-4224-b2c8-5422a546931a","resolution":{"observed_at":"2026-07-10T08:37:00.466660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20540","last_updated":"2026-01-28T12:37:01Z","snapshot_observed_at":"2026-08-13T17:45:09.123419Z","submitted_at":"2026-01-28T12:37:01Z","title":"Advancing Open-source World Models","version":1},"cited_work":{"arxiv_id":"2601.20540","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.20540","snapshot_observed_at":"2026-07-10T08:36:59.816756Z","title":"Advancing Open-source World Models","venue":"cs.CV","work_id":"3446760e-6460-429e-82f6-6a5133ce4c8a","year":2026},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2601.20540","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:fe2e110204580baf5c7d9f0ba6a0ac877a7313bad6c723a5b3eeae272698cc1d","observation_id":"8eef7757-069f-40e4-a182-7fa038b06622","resolution":{"observed_at":"2026-07-10T08:36:59.817972Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12289","last_updated":"2024-06-25T17:55:35Z","snapshot_observed_at":"2026-08-13T08:07:31.942031Z","submitted_at":"2024-02-19T17:04:04Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":"2402.12289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12289","snapshot_observed_at":"2026-07-10T08:36:59.801031Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","venue":"cs.CV","work_id":"a0e2e7ab-9d0a-4fdb-9309-3c8cf7ed0226","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2402.12289","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:10fff684c21575ee3995f5d77b01f956ceeb8aa57a38912fd164c89d09d3c235","observation_id":"52dd6aea-6dbc-440f-aef0-ea8cfcf33719","resolution":{"observed_at":"2026-07-10T08:36:59.802423Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05741","last_updated":"2025-04-09T04:23:38Z","snapshot_observed_at":"2026-08-16T12:43:07.817483Z","submitted_at":"2025-04-08T07:17:45Z","title":"DDT: Decoupled Diffusion Transformer","version":2},"cited_work":{"arxiv_id":"2504.05741","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.05741","snapshot_observed_at":"2026-07-10T18:47:31.564501Z","title":"Ddt: Decoupled diffusion transformer","venue":"cs.CV","work_id":"8625279b-e85e-4c87-ba22-16d4d9e1f709","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2504.05741","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:fbaa2410f9484b58094e7dbd4a478add6fd2576bd52bf132bb2f6514af6f95d8","observation_id":"c547a0e9-d1d9-410d-84a8-8ab35862a8e2","resolution":{"observed_at":"2026-07-10T08:36:59.807676Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00088","last_updated":"2026-01-07T09:09:57Z","snapshot_observed_at":"2026-08-16T04:26:38.567252Z","submitted_at":"2025-10-30T01:25:34Z","title":"Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail","version":2},"cited_work":{"arxiv_id":"2511.00088","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.00088","snapshot_observed_at":"2026-07-10T20:17:33.699563Z","title":"Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail","venue":"cs.RO","work_id":"eed9adfb-3fa1-4c0c-abb9-e31b79bba031","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2511.00088","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:f8c7cb7166c7566b08642890d4055262331d6abfc9bfd031189fea46cef6c5d1","observation_id":"4653bab0-c80c-4175-b46b-4ed2ae8c729f","resolution":{"observed_at":"2026-07-10T08:36:59.794711Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.463971Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"d38e1601-c8b4-4c5d-abdc-b20f1e01e302","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:5acb7a550cd8439be6d55f3729781c679f1210a54149971fe93b9f3f56b927c5","observation_id":"4a41d77a-4a01-455b-97aa-eb70c81e45ff","resolution":{"observed_at":"2026-07-10T08:37:00.465071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24948","last_updated":"2026-04-27T05:41:00Z","snapshot_observed_at":"2026-08-16T12:43:58.343317Z","submitted_at":"2025-09-29T15:45:19Z","title":"World-Env: Leveraging World Model as a Virtual Environment for VLA Post-Training","version":6},"cited_work":{"arxiv_id":"2509.24948","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.24948","snapshot_observed_at":"2026-07-10T08:36:59.803669Z","title":"World-Env: Leveraging World Model as a Virtual Environment for VLA Post-Training","venue":"cs.RO","work_id":"e43fb37f-61a0-4911-b5e5-880083d7aa30","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2509.24948","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:7cd4ee1a184ab1e13243bb19ed367632c8014fa1cdae2ada36cebc4c5da0f699","observation_id":"034631dc-3fd5-46d0-9294-3f70a4f7aa0d","resolution":{"observed_at":"2026-07-10T08:36:59.805192Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.05611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.771289Z","title":"Latentvla: Efficient vision-language models for autonomous driving via latent action prediction","venue":null,"work_id":"e974f766-0c20-48d7-bc7a-5035d22ae52f","year":2026},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:770a6bdc711a6870cbabc1e8bd7282614e66f648cf1077aec69bc9917a1185fb","observation_id":"8b02771b-d1c2-4216-8026-85ee3a52ee73","resolution":{"observed_at":"2026-07-10T08:36:59.772838Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.462304Z","title":"In: Proceed- ings of the Winter Conference on Applications of Computer Vision","venue":null,"work_id":"8a5c87f1-88ac-47f6-88a0-7ac1af4e72d3","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:c8eef3e556a37826653ba392ef06930f0a0f88312fb7bede66ab8cac6bf6d015","observation_id":"9828820d-f9a9-465a-a07e-d41d298cee24","resolution":{"observed_at":"2026-07-10T08:37:00.463454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04453","last_updated":"2026-07-01T06:26:33Z","snapshot_observed_at":"2026-08-17T17:52:19.115172Z","submitted_at":"2026-01-07T23:49:52Z","title":"UniDrive-WM: Unified Understanding, Planning and Generation World Model for Autonomous Driving","version":4},"cited_work":{"arxiv_id":"2601.04453","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.04453","snapshot_observed_at":"2026-07-10T20:17:33.704789Z","title":"Yaman, Shen Cheng, Yiren Lu, Jingru Luo, Nathan Jacobs, and Liu Ren","venue":"cs.CV","work_id":"3ac6a372-f517-4cc3-b5b0-521ae353835c","year":2026},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2601.04453","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:a65d9a1324de2330babdd30df2ab54d2730a3b6df2dba1e944bd9119c841984d","observation_id":"e156b304-78bd-4141-a8db-c6ee9550a134","resolution":{"observed_at":"2026-07-10T08:36:59.770048Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.460210Z","title":"IEEE Robotics and Automation Letters9(10), 8186–8193 (2024)","venue":null,"work_id":"15ea3876-9e38-4a83-8eb8-21ad32f1d0cc","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:cb0e3283379442fba4ea40b75003b8e87b5825b310c26aee36b0e0d30d20f15c","observation_id":"2f7d6bb0-9e36-4576-8878-232388ee8d65","resolution":{"observed_at":"2026-07-10T08:37:00.461430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16278","last_updated":"2026-05-18T09:58:49Z","snapshot_observed_at":"2026-08-14T23:40:20.516170Z","submitted_at":"2025-05-22T06:23:04Z","title":"DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2505.16278","doi":"10.48550/arxiv.2505.16278","metadata_source":"pith","pith_arxiv_id":"2505.16278","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving","venue":"cs.CV","work_id":"4ac9d612-065c-475b-80c6-e307b1ae4128","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2505.16278","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:0d8970e52844f204a4a798330f921036c8aa358eb5391678ea491ea44b194af0","observation_id":"80a04f9d-e1a7-43c8-a857-aa4ce40e777a","resolution":{"observed_at":"2026-07-10T08:36:59.815484Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:52:59.664485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:52:59.664485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":"2410.06940","doi":"10.48550/arxiv.2410.06940","metadata_source":"pith","pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","venue":"cs.CV","work_id":"1aff8ef8-079b-4afe-9e6a-148e6fd08e6a","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:38956083bc87ebd27d646b6e66da2da06b8c1cf33d5caaf6469ec4d3052db050","observation_id":"8add2359-a98b-40e7-934b-ec2b0881380d","resolution":{"observed_at":"2026-07-10T08:36:59.775628Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:37:00.474806Z","title":"Drones9(4), 281 (2025)","venue":null,"work_id":"ffcab475-41dd-4438-a6a9-1450b69eefbd","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:2478489171faf6c1aa5c813239aff366d6eba8b4677cab82e79881a4b9c67b30","observation_id":"29a990f6-db16-4328-8f1a-a559b0d263bf","resolution":{"observed_at":"2026-07-10T08:37:00.475961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03601","last_updated":"2024-08-14T04:31:32Z","snapshot_observed_at":"2026-08-18T07:41:59.126214Z","submitted_at":"2024-08-07T07:41:01Z","title":"DRAMA: An Efficient End-to-end Motion Planner for Autonomous Driving with Mamba","version":2},"cited_work":{"arxiv_id":"2408.03601","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.03601","snapshot_observed_at":"2026-07-10T08:36:59.837755Z","title":"Drama: An efficient end-to-end motion planner for autonomous driving with mamba","venue":"cs.RO","work_id":"1f979124-9895-424e-9a76-3b3111de8eda","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2408.03601","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:862c12fae9c425f752aec9d2c48c7051b6933bfbfa8d8e55ffd05583bfa79eeb","observation_id":"74afe11b-9f8d-4d05-a929-aa088dde747c","resolution":{"observed_at":"2026-07-10T08:36:59.839150Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.19012","doi":"10.48550/arxiv.2509.19012","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pure vision language action (vla) models: A comprehensive survey.arXiv preprint arXiv:2509.19012","venue":"ArXiv.org","work_id":"8b1ae741-24d6-418e-8e4d-3c7c5fd88b92","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:64d4c86f68c415b3860b4aacb0d583773f683d8611f2e04c823c2a57f7934f8d","observation_id":"99ae5c7e-f8f3-4fe0-a1b0-50e3f5800d55","resolution":{"observed_at":"2026-07-10T08:36:59.836513Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.744991Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"1a201e6a-3a02-408d-8c60-28a746c34e76","year":2024},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:0724047d6f490a043d46d6e35f2ab93ad04b2e7fcfd9f1b0bce12339db432fcf","observation_id":"dff452f4-d829-4c4c-98a5-4c04cdf7d629","resolution":{"observed_at":"2026-07-10T08:36:59.746200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15564","last_updated":"2025-02-09T16:37:09Z","snapshot_observed_at":"2026-08-14T19:32:39.548748Z","submitted_at":"2025-01-26T15:49:50Z","title":"Diffusion-Based Planning for Autonomous Driving with Flexible Guidance","version":2},"cited_work":{"arxiv_id":"2501.15564","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15564","snapshot_observed_at":"2026-07-10T08:36:59.821774Z","title":"Diffusion-based planning for autonomous driving with flexible guidance","venue":"cs.RO","work_id":"25af4a06-f2ba-40e3-a38d-b643f82db3a0","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2501.15564","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:48d5b1ecf3d71cde1bc1c4af785552ec05509ad604bde2fea1471aa8a6999b60","observation_id":"9ada88d8-aa13-4e3c-a305-e4010e887d07","resolution":{"observed_at":"2026-07-10T08:36:59.823247Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.23463","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.848781Z","title":"Opendrivevla: Towards end-to-end au- tonomous driving with large vision language action model","venue":null,"work_id":"67021d38-441c-4135-9cf6-081c176c598c","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:57c7526fa3e107ca5e6099159f20453bc748cefba441e2b381c43dceb138548e","observation_id":"f5c5f92a-b4b9-4608-a6c9-728a9ea8beba","resolution":{"observed_at":"2026-07-10T08:36:59.850255Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13757","last_updated":"2025-11-05T23:46:20Z","snapshot_observed_at":"2026-08-14T00:40:02.694887Z","submitted_at":"2025-06-16T17:58:50Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","version":3},"cited_work":{"arxiv_id":"2506.13757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13757","snapshot_observed_at":"2026-07-10T08:36:59.854319Z","title":"AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning","venue":"cs.CV","work_id":"945172fb-0f3b-43be-88b4-ae61042517e9","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2506.13757","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:0944b7cb1467b64207254b1477397f1b13dc6e382c0e48ae82a8e4ddb6eb5261","observation_id":"58efcce0-79d1-4744-b45a-b0a4b972dba6","resolution":{"observed_at":"2026-07-10T08:36:59.855660Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":"2504.10479","doi":"10.48550/arxiv.2504.10479","metadata_source":"pith","pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","venue":"cs.CV","work_id":"fe8637aa-12bc-4434-8d36-9f57b5eebcbe","year":2025},"citing_paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-10T08:30:29.351159Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2607.08375"},"observation_digest":"sha256:1fad2e420f7f595b2d58cd8d3eb94272434b13d140485865c5f29fdf54fb84a3","observation_id":"0a9232e7-8332-46cb-854d-ce7fe5474d2e","resolution":{"observed_at":"2026-07-10T08:36:59.852958Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.08375","last_updated":"2026-07-09T11:49:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T13:52:25.802411Z","submitted_at":"2026-07-09T11:49:57Z","title":"WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":33,"parse_uncertain":0,"unresolved":5,"verified_exact":4,"verified_fuzzy":23},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2607.08375."}