{"as_of":"2026-08-05T16:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a3c67d7ecbd026f0feea869afa43b426d58244f61cdaa4bc1ba7b162ed49d56e","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T20:32:31.567162Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23511/citation-record","integrity":"/paper/2607.23511/integrity","json":"/paper/2607.23511/citation-record.json","paper":"/paper/2607.23511"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:26.691393Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:26.691393Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:00689b409b3863fc1bc93bc782d99843b261577708607d1f54a9e14e98459c73","observation_id":"77b89f99-4755-415b-957e-62faab1bb989","resolution":{"observed_at":"2026-07-30T20:32:26.691393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-07-30T20:32:26.761467Z","title":"arXiv preprint arXiv:1604.07316 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:26.761467Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:a6078300e19d2591c2c1b1b8b0957a9a8642c2caf7566bd2517bf3c71462d9f5","observation_id":"4248919f-3de0-4bc6-8249-1d1a3b87fa22","resolution":{"observed_at":"2026-07-30T20:32:26.761467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11810","last_updated":"2022-02-04T02:50:02Z","snapshot_observed_at":"2026-08-02T23:58:09.453937Z","submitted_at":"2021-06-22T14:24:55Z","title":"NuPlan: A closed-loop ML-based planning benchmark for autonomous vehicles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11810","snapshot_observed_at":"2026-07-30T20:32:26.902210Z","title":"arXiv preprint arXiv:2106.11810 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:26.902210Z"},"links":{"cited_paper":"/paper/2106.11810","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:3abd8a409dc213f844d7e0f93231dc89d43a376dd830f23462e7676b31bf257c","observation_id":"1d38a84c-b33e-45ab-84ac-5e44be7108be","resolution":{"observed_at":"2026-07-30T20:32:26.902210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13243","last_updated":"2026-04-17T23:12:55Z","snapshot_observed_at":"2026-08-04T01:21:26.466156Z","submitted_at":"2024-02-20T18:55:09Z","title":"VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13243","snapshot_observed_at":"2026-07-30T20:32:27.001497Z","title":"arXiv preprint arXiv:2402.13243 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.001497Z"},"links":{"cited_paper":"/paper/2402.13243","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:b7b30d29760603c1f353fd9cf81e16d8249e8015c74fd741a03f79ddec914324","observation_id":"82519ebe-7844-4df3-96f3-de947793235c","resolution":{"observed_at":"2026-07-30T20:32:27.001497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.095146Z","title":"In: The Fourteenth International Conference on Learning Representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.095146Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:38ad1b84c3e7246feb4e36c488f315eee9cab83eb2fbceef6c0ac20aad68cff6","observation_id":"f3af78c0-b873-49e5-a8bb-78fa6c40f7ae","resolution":{"observed_at":"2026-07-30T20:32:27.095146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05092","last_updated":"2026-06-26T08:53:36Z","snapshot_observed_at":"2026-07-06T23:17:48.161262Z","submitted_at":"2026-05-06T16:30:48Z","title":"Driver-WM: A Driver-Centric Traffic-Conditioned Latent World Model for In-Cabin Dynamics Rollout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.05092","snapshot_observed_at":"2026-07-30T20:32:27.198258Z","title":"arXiv preprint arXiv:2605.05092 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.198258Z"},"links":{"cited_paper":"/paper/2605.05092","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:966dc6ceaf5a891649b0d9b2da591766f9107c4e5b294daf183bdbadc1f2db61","observation_id":"c2a7149f-98c2-4ca0-b498-407091c3ede9","resolution":{"observed_at":"2026-07-30T20:32:27.198258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.316909Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence45(11), 12878–12895 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.316909Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:c686b08cc9c49dde1e1bb391f21d30a026c557c19e9a12d19b4c7d730d273f6c","observation_id":"813bd482-30e0-41f5-ba28-a24e03257a5d","resolution":{"observed_at":"2026-07-30T20:32:27.316909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.435765Z","title":"In: Proceedings of the Conference on Com- puter Vision and Pattern Recognition, Vancouver, Canada","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.435765Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:33d14627fa8c2cfd9c56476acfe05cf3d13b758195ef76e9e60ab04a883414ed","observation_id":"110e0f2f-8cf7-4445-9a8d-73aca3d4d47d","resolution":{"observed_at":"2026-07-30T20:32:27.435765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.528245Z","title":"In: Ad- vances in Neural Information Processing Systems (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.528245Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:d420a139fe92099316e4572ef57e4a3310099bd48e588c5556cac28ce2e1dfc5","observation_id":"db68c301-ec06-4a43-8aa3-47de690ce5da","resolution":{"observed_at":"2026-07-30T20:32:27.528245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-07-30T20:32:27.592066Z","title":"arXiv preprint arXiv:2505.14683 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.592066Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:83efbde3e8431cc691d00f4cfaf6f25d409049d8e69bf06228a6029621e46cd8","observation_id":"c58c1ef3-b9a4-4fcd-91dd-48e9b4d0de3e","resolution":{"observed_at":"2026-07-30T20:32:27.592066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.656776Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.656776Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:655841e12caf5addd714acf4a8585efb982b11951b480a6ecfb5c33ca4f31027","observation_id":"7cea9e62-9f0f-4778-857a-ca30ab0c29ea","resolution":{"observed_at":"2026-07-30T20:32:27.656776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.721395Z","title":"arXiv preprint arXiv:2512.03422 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.721395Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:debe554165d97ec0803e2cd35ff9cfee0d5f1cf086a0201ae412e606b0b699d6","observation_id":"873bd727-b8a3-44b4-99b3-a62a30279b50","resolution":{"observed_at":"2026-07-30T20:32:27.721395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.789565Z","title":"In- ternational Journal of Computer Vision134(4), 152 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.789565Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:e70a71b0e4b1216a147284d3159ed1fea9f85401f5543e0ae0c4e0b0d4c0919c","observation_id":"bb27471d-4dbc-486a-8025-215c0687c36e","resolution":{"observed_at":"2026-07-30T20:32:27.789565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.921992Z","title":"IEEE Transactions on Image Processing6(9), 1305–1315 (1997) MOJITO 17","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.921992Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:89c2d3bbfde4327f65d0cd8248165d3e4d57aab25409deb6c1af1908f860eb02","observation_id":"135621dd-7799-4897-83f3-387d4d5e4f5c","resolution":{"observed_at":"2026-07-30T20:32:27.921992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.039948Z","title":"IEEE Robotics and Automation Letters11(1), 226–233 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.039948Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:aa8c380367e23b998d3e7036a5704d6c71723f6f3c063d40cb3d86f8be6f111a","observation_id":"6bf228bc-14e4-4259-a528-4e746cf13796","resolution":{"observed_at":"2026-07-30T20:32:28.039948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.177159Z","title":"On the Move to Meaningful Internet Systems","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.177159Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:a32c81e156dc80244beaabb71ab03c5cadbad0df7bbc636e67be94bc3daf74fb","observation_id":"e01284c4-f917-464c-ab8c-93f0da2fd330","resolution":{"observed_at":"2026-07-30T20:32:28.177159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.313633Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.313633Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:10533d3178bb1655365b7b7b0da9a4ca913ef8b021ae3b809b9ba1680203eb7b","observation_id":"9a981c3f-0bd7-40a3-a427-2ddf0b38c5d0","resolution":{"observed_at":"2026-07-30T20:32:28.313633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.432222Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.432222Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:9cd8f4ed9749cb142f9c1684a8953bab68f457dd175d1b4783b139a9b76615a4","observation_id":"4d841639-b5f2-4342-8ed1-ba89fd132f64","resolution":{"observed_at":"2026-07-30T20:32:28.432222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-30T20:32:28.512306Z","title":"arXiv preprint arXiv:2203.17054 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.512306Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:7829b64b25b0be2c8a20f511dd070be47af7c4fbd3e31223b698db0fe9b6c261","observation_id":"10dafbcf-c168-43d9-b0f2-54a9eba7b58e","resolution":{"observed_at":"2026-07-30T20:32:28.512306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07656","last_updated":"2025-07-11T08:15:30Z","snapshot_observed_at":"2026-08-04T23:03:25.422868Z","submitted_at":"2025-03-07T11:41:18Z","title":"DriveTransformer: Unified Transformer for Scalable End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07656","snapshot_observed_at":"2026-07-30T20:32:28.580271Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.580271Z"},"links":{"cited_paper":"/paper/2503.07656","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:c3184fd4065e6576c8519711ab24e8cadc6f179e73324566d92d52ef9fbb60d2","observation_id":"b6758fdc-6026-4a55-be27-ff8ca64e8484","resolution":{"observed_at":"2026-07-30T20:32:28.580271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19381","last_updated":"2025-06-03T02:28:31Z","snapshot_observed_at":"2026-07-06T21:30:14.357703Z","submitted_at":"2025-05-26T00:49:35Z","title":"DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19381","snapshot_observed_at":"2026-07-30T20:32:28.653831Z","title":"arXiv preprint arXiv:2505.19381 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.653831Z"},"links":{"cited_paper":"/paper/2505.19381","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:576095c87086a25cab9cd18a795f65628095c94d67b8e1a9e66326ad38dfc83f","observation_id":"049bf77d-00fd-414d-978a-5ebe72ada5a0","resolution":{"observed_at":"2026-07-30T20:32:28.653831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.750013Z","title":"In: Proceed- ings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.750013Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:7677f8c0bab6c722e016cb2a721220a0d333bc1ca0c03cf34657a6ff9f72571b","observation_id":"23f09026-68de-4c07-8407-0f8241d60418","resolution":{"observed_at":"2026-07-30T20:32:28.750013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.841892Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.841892Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:f87cfc82fc8459b5aec1acf56265ed37ee87df86a52c4ef79f637b6bc07a3c1e","observation_id":"9ad21512-e556-40c8-bc53-1805f3cd33ea","resolution":{"observed_at":"2026-07-30T20:32:28.841892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10719","last_updated":"2026-07-12T18:02:23Z","snapshot_observed_at":"2026-08-03T17:07:38.286115Z","submitted_at":"2025-12-11T14:59:07Z","title":"SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.10719","snapshot_observed_at":"2026-07-30T20:32:28.937993Z","title":"arXiv preprint arXiv:2512.107192(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.937993Z"},"links":{"cited_paper":"/paper/2512.10719","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:ff0c676e0151e090c982bf69b2a59586f926564b62dad3b108a496c201fd2bb3","observation_id":"873477c8-0a99-4621-91cd-2e3f47345803","resolution":{"observed_at":"2026-07-30T20:32:28.937993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.015395Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.015395Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:0a9cda17b24c8493ef0d552aaf1c37c3df76473c5cd2e8345f5c30c8d3d70fc5","observation_id":"e0d730a8-13c5-4dfd-826f-15755a1ef781","resolution":{"observed_at":"2026-07-30T20:32:29.015395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08052","last_updated":"2025-09-29T17:21:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T03:14:04Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08052","snapshot_observed_at":"2026-07-30T20:32:29.090631Z","title":"arXiv preprint arXiv:2506.08052 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.090631Z"},"links":{"cited_paper":"/paper/2506.08052","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:4cbd8b47844403757d18e7f8b67a111b6a3b838d0bafce2f974a6d41108f63e9","observation_id":"9f947b19-1e77-4522-94f9-482e539447b9","resolution":{"observed_at":"2026-07-30T20:32:29.090631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-07-06T18:28:42.314877Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-07-30T20:32:29.179218Z","title":"arXiv preprint arXiv:2406.06978 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.179218Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:cc064c949bbfa63ee544fe810c8a304eba8a493ebfe9461dd2dbb39f2e01cfe6","observation_id":"e973c24c-9240-476c-b557-2fecdac9b0d2","resolution":{"observed_at":"2026-07-30T20:32:29.179218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06664","last_updated":"2025-06-07T05:06:05Z","snapshot_observed_at":"2026-08-05T08:34:09.387431Z","submitted_at":"2025-06-07T05:06:05Z","title":"Generalized Trajectory Scoring for End-to-end Multimodal Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06664","snapshot_observed_at":"2026-07-30T20:32:29.296690Z","title":"arXiv preprint arXiv:2506.06664 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.296690Z"},"links":{"cited_paper":"/paper/2506.06664","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:efae83afc41223c71e905526ed8f681f7a51d502effc9c837ac958d8f86e5450","observation_id":"4dabccde-2494-4bab-9f03-ce8bd79827b1","resolution":{"observed_at":"2026-07-30T20:32:29.296690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.394694Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.394694Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:ac31b9dfbf2e95adc6f3208071e3fdf78583862241e17fd9b255e9558b912343","observation_id":"910d8078-1742-4f2e-acab-34682e005d29","resolution":{"observed_at":"2026-07-30T20:32:29.394694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.456986Z","title":"In: Proceedings of the Computer Vision and Pattern Recog- nition Conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.456986Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:61a0b73e8f77488f530be48b03b93d6e3bc3a0e5ae062b7227389c9556001b18","observation_id":"6b9ce650-a433-4733-b85a-870d6fa6f1af","resolution":{"observed_at":"2026-07-30T20:32:29.456986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.524360Z","title":"Advances in Neural Information Processing Systems38, 14123–14151 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.524360Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:fa2bde7fc86e244eeacdee2f4c06df0c1a3ff4658bdc163f02ebd17559d823bb","observation_id":"33b6ce54-195b-4161-981b-0208aa7d2e7b","resolution":{"observed_at":"2026-07-30T20:32:29.524360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.623547Z","title":"arXiv preprint arXiv:2511.18729 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.623547Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:e944a45f810f65e7d972063759aeda81607a3c0f5f29bfd6373b2a94dfc9a816","observation_id":"920ffcbc-748b-41e7-8528-f93cfdbcb672","resolution":{"observed_at":"2026-07-30T20:32:29.623547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.720896Z","title":"arXiv preprint arXiv:2512.09864 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.720896Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:81805cec8b1b1d1d102a112d2312835304445a0bdcf985bb61bbe1965caac355","observation_id":"1220f78f-192c-4435-a379-e70eb06e3024","resolution":{"observed_at":"2026-07-30T20:32:29.720896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.775309Z","title":"arXiv preprint arXiv:2509.13769 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.775309Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:52d717a29fff8dd0b151ee8005f7c0692d295c836c622a45c9119fa1b03eaf47","observation_id":"3751734d-4e78-43fa-8377-b42a704830b5","resolution":{"observed_at":"2026-07-30T20:32:29.775309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.835691Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.835691Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:339f35aa8cad263e6fe50b26cfdb3a659cce38a042c91cd4f7433cdef46d7b61","observation_id":"aa71d1e8-8dea-4750-81c2-ea1f973b4d9d","resolution":{"observed_at":"2026-07-30T20:32:29.835691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.895772Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.895772Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:82be77bb7cec8528a774f7b54bd6275da90711ef2c9fd755aa77a8e7e31cf713","observation_id":"9951b8da-c15e-46ac-8fa7-3eccd1e6fdde","resolution":{"observed_at":"2026-07-30T20:32:29.895772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.948822Z","title":"arXiv preprint arXiv:2602.13301 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.948822Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:f35d0a1a78a2efacb828fd782a9111ea60c12a9864085889bd2779dc5579039c","observation_id":"83e622fa-a3a4-4634-b544-1e6926fbdddf","resolution":{"observed_at":"2026-07-30T20:32:29.948822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19620","last_updated":"2024-05-31T07:40:55Z","snapshot_observed_at":"2026-07-06T18:22:22.643181Z","submitted_at":"2024-05-30T02:13:56Z","title":"SparseDrive: End-to-End Autonomous Driving via Sparse Scene Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19620","snapshot_observed_at":"2026-07-30T20:32:30.026655Z","title":"arXiv preprint arXiv:2405.19620 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.026655Z"},"links":{"cited_paper":"/paper/2405.19620","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:637a7de163e211faa50211623fb4f430886d189dfb66a7084a031a95163e5028","observation_id":"dbb4d79a-8c83-404f-a82f-011be0e57ddb","resolution":{"observed_at":"2026-07-30T20:32:30.026655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.106967Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.106967Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:dbcd7563f0a14443041497e9fbc5552ccaa8981b10c3307ce0cb90952021a550","observation_id":"bb4fcd49-363e-4bcc-8d9e-ae282df67cf0","resolution":{"observed_at":"2026-07-30T20:32:30.106967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.198010Z","title":"ACM Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.198010Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:1c5dad641ef61bcc68fbfaf288499e029c0cc6a964d9a4c1062748852774f29a","observation_id":"d5f3b6d3-62f8-4fc5-8673-0108730a71ec","resolution":{"observed_at":"2026-07-30T20:32:30.198010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-30T20:32:30.295917Z","title":"arXiv preprint arXiv:2503.20314 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.295917Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:92fffffb153963282880fcdd6c052749b8573b8ca3d710190b653e6b3e2b94d2","observation_id":"0cc6ac1e-d45e-4ed2-8b4c-ab90d0b5afd5","resolution":{"observed_at":"2026-07-30T20:32:30.295917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.399969Z","title":"In: Proceedings of the computer vision and pattern recognition conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.399969Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:06040a524d7958b58bf7da29c0ea8f72ef2a8cbd6c086849c2d177464a817986","observation_id":"8e40d7fb-efc3-4dc1-a4a3-20c1ee370be5","resolution":{"observed_at":"2026-07-30T20:32:30.399969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12170","last_updated":"2025-07-18T12:26:43Z","snapshot_observed_at":"2026-07-06T20:53:13.629451Z","submitted_at":"2025-03-15T15:23:35Z","title":"DiffAD: A Unified Diffusion Modeling Approach for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12170","snapshot_observed_at":"2026-07-30T20:32:30.470495Z","title":"arXiv preprint arXiv:2503.12170 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.470495Z"},"links":{"cited_paper":"/paper/2503.12170","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:7c721b67018c002d7d21f17984e33cc0bdec43f2845923c893529f8c5bdd9262","observation_id":"aad98c4d-102f-481e-ab1f-e62ed70b3ae9","resolution":{"observed_at":"2026-07-30T20:32:30.470495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.537018Z","title":"Advances in Neural Information Processing Systems38, 140367–140387 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.537018Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:154ffb4f658159d595710e8c2061f903342e43bb00fa332975d110c11b556ce0","observation_id":"4e914759-5adf-4dde-b32d-06afd33eb20c","resolution":{"observed_at":"2026-07-30T20:32:30.537018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-30T20:32:30.599240Z","title":"arXiv preprint arXiv:2505.09388 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.599240Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:5662f16908a0ff16bcfb1fc16fbdbd08bf02d6de9fe6064c79a4e8118eb29b8e","observation_id":"386adcf9-6bbe-4388-9a28-e99511cafebf","resolution":{"observed_at":"2026-07-30T20:32:30.599240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.687603Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.687603Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:2cbf65a1a536037d78faa161c667c019101839f1631d45b11457f748cdc23d69","observation_id":"34eca01f-ef2b-4686-be36-cb85cc2b6fff","resolution":{"observed_at":"2026-07-30T20:32:30.687603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.782293Z","title":"International Journal of Computer Vision132(11), 4823–4849 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.782293Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:56c140a0a71bea3862518497fc990045fe0faee8a970ec3ffdc07d90f58876bb","observation_id":"8ddba64a-4e8f-40cc-a3c4-e441e22e763b","resolution":{"observed_at":"2026-07-30T20:32:30.782293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.843498Z","title":"In: Proceedings of the 44th international ACM SIGIR conference on research and development in information retrieval","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.843498Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:a3035b458c74b14545899adc85fad93a30eb9ed51695111953e58c0ec4ada2b5","observation_id":"f32a9953-0d3c-4776-81dc-7a12bf9981d8","resolution":{"observed_at":"2026-07-30T20:32:30.843498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.924177Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.924177Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:74044b0c57d2d955b11d00605ff8378dd7c553b5017b78ab15719154c7a0c9ca","observation_id":"aa9bad6b-4953-4dfd-8dfb-11b6e6064339","resolution":{"observed_at":"2026-07-30T20:32:30.924177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.029630Z","title":"arXiv preprint arXiv:2506.06659 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.029630Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:2e14ab63bffc8b8a17a6481f96c6d0d732308606a544e758232001aff82298d2","observation_id":"fa387103-1832-4de4-9454-9e18dff1401b","resolution":{"observed_at":"2026-07-30T20:32:31.029630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03601","last_updated":"2024-08-14T04:31:32Z","snapshot_observed_at":"2026-08-03T08:33:00.534249Z","submitted_at":"2024-08-07T07:41:01Z","title":"DRAMA: An Efficient End-to-end Motion Planner for Autonomous Driving with Mamba","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03601","snapshot_observed_at":"2026-07-30T20:32:31.166241Z","title":"arXiv preprint arXiv:2408.03601 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.166241Z"},"links":{"cited_paper":"/paper/2408.03601","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:d9fdcf64f8f4fa01527b1e861a24ba08dbfd6da9eb23853bb647fa2502fe7f51","observation_id":"deabebd7-cafe-4082-8697-ea7233ae3cab","resolution":{"observed_at":"2026-07-30T20:32:31.166241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.225537Z","title":"ACM Transactions on Intelligent Systems and Technology8(3), 1–19 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.225537Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:9514ab24cce020d623f0372e118059cb6f4d9596308f65835a252d715c8b53ee","observation_id":"119d2e00-b2cf-48b4-af66-787db4c7895a","resolution":{"observed_at":"2026-07-30T20:32:31.225537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.341916Z","title":"In: The Thirteenth International Conference on Learning Rep- resentations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.341916Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:6d5352dbfdf029635ebaeae778728c19f4c7aefee4992e070dc8688a69e731b9","observation_id":"0f7a8899-3ab2-4635-9b89-4e1ce64eb43e","resolution":{"observed_at":"2026-07-30T20:32:31.341916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.428513Z","title":"In: International Conference on Learning Rep- resentations (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.428513Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:8dfcfa220a85e92be838cf80abe7f9df0c915201370e13ce1318f72c5a18aef1","observation_id":"2642771e-1898-4798-bebc-5f20a8da7c4c","resolution":{"observed_at":"2026-07-30T20:32:31.428513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.483781Z","title":"Advances in Neural Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.483781Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:e17412393f5db87a40c805af9af113506d593679b667156b0c05b445a67a683a","observation_id":"ea5e806d-27e5-4f17-9203-cce392c218fe","resolution":{"observed_at":"2026-07-30T20:32:31.483781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.567162Z","title":"arXiv preprint arXiv:2512.07745 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.567162Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:d8c4381442823f061c61133a2da5f1c26c284df2588ba1c0c195431ed66c0123","observation_id":"b2fea04b-cda3-44db-9ea7-453bb714b9dc","resolution":{"observed_at":"2026-07-30T20:32:31.567162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T15:17:21.420836Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2607.23511."}