{"as_of":"2026-08-06T12:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8565e8ea68dde5b1ccb3926da38b99f2436df424cb14e49cc9afc71b8a665c80","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T17:05:52.493660Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.04055/citation-record","integrity":"/paper/2604.04055/integrity","json":"/paper/2604.04055/citation-record.json","paper":"/paper/2604.04055"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Codeslam—learning a compact, optimisable representation for dense visual slam","venue":null,"work_id":"45635917-92f7-42f7-bdaf-115234e0d5fb","year":2018},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:bf524d8eeab1e294f8e153a86ce7f34018a7866dce62c8a0fbefdf0f061c4d02","observation_id":"5bb542b3-360f-4bbd-a4db-fa5d74d5c236","resolution":{"observed_at":"2026-05-14T05:28:08.865891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lift-slam: A deep-learning feature-based monocular visual slam method.Neurocomputing, 455:97–110","venue":null,"work_id":"0eb4127d-7228-4d97-97a5-3f82848ba875","year":2021},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:f2a2cfaf8f7890b6fd6e1671832d82c33c71b89583a112cefea6dbddc0bfdde9","observation_id":"049d3179-df1f-46e1-bb46-696737312b3a","resolution":{"observed_at":"2026-05-14T05:28:08.876088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The euroc micro aerial vehicle datasets.The International Journal of Robotics Research, 35 (10):1157–1163","venue":null,"work_id":"28f58f67-72f8-45ea-9997-2f6b2ef59f56","year":2016},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:c6bae830adf0425b87f9c2abb704d0fec992da6d60e3e2d5588e8bdb543749db","observation_id":"71015ed3-f52b-4524-a58d-2a91050aa823","resolution":{"observed_at":"2026-05-14T05:28:08.869882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orb-slam3: An accu- rate open-source library for visual, visual–inertial, and mul- timap slam.IEEE Transactions on Robotics, 37(6):1874– 1890","venue":null,"work_id":"c85a0e6a-783a-4b35-9b1d-e314a609267c","year":2021},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:5ac9bc75d4edd592ea11e3e28d66f144bff12037fc43f45cc8e32fd4a5c5f899","observation_id":"ce385c7c-bf11-4d04-8119-1e5d44f97270","resolution":{"observed_at":"2026-05-14T05:28:08.872822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vpl- slam: A vertical line supported point line monocular slam system.IEEE Transactions on Intelligent Transportation Systems","venue":null,"work_id":"07ae70f8-eb14-461f-b10e-8a4eac2885fc","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:6625e03ddab01ebb533408614581fd848cfff7122697c90585b8aaff69907bb9","observation_id":"aa85e7c3-67a5-4a7c-ba30-d3f605ac6891","resolution":{"observed_at":"2026-05-14T05:28:08.938699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi- lio: A lightweight multiple lidar-inertial odometry system","venue":null,"work_id":"e192af02-828b-491b-855e-3f3a5578f51c","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:747466b65cd857d76e2fcb51473a3bfc166463f9e9aeba9d7d1854c076ba2f97","observation_id":"2db2eb34-df06-40e7-9720-6d040d8275d2","resolution":{"observed_at":"2026-05-14T05:28:08.908724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepfactors: Real-time probabilistic dense monocular slam.IEEE Robotics and Automation Letters, 5 (2):721–728","venue":null,"work_id":"40015200-9aa3-4e98-b5de-508bbd4c8f02","year":2020},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:03ec1aa31a997ccd7a99679b3d92d2c09dbf832376655f91a699672c36ac6123","observation_id":"dc1528a1-a7a4-4826-81e6-c8b508eae14c","resolution":{"observed_at":"2026-05-14T05:28:08.892534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Monoslam: Real-time single camera slam","venue":null,"work_id":"4c5619ee-08ec-4a52-9d23-cc8b9c4d834d","year":2007},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:77e0fb802a67c21c17d575a5b2bca1a562b9114a0412e692539d3847a663dc3b","observation_id":"cc80c285-a08e-430e-97da-ca7b07b518b7","resolution":{"observed_at":"2026-05-14T05:28:08.992813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11247","last_updated":"2026-05-13T03:31:24Z","snapshot_observed_at":"2026-08-06T04:07:06.773895Z","submitted_at":"2024-03-17T15:41:35Z","title":"Compact 3D Gaussian Splatting For Dense Visual SLAM","version":3},"cited_work":{"arxiv_id":"2403.11247","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11247","snapshot_observed_at":"2026-07-04T13:09:51.149892Z","title":"Compact 3D Gaussian Splatting For Dense Visual SLAM","venue":"cs.CV","work_id":"d8274008-86ea-42d5-93fa-b5f806a9224a","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2403.11247","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:942f2e58f2478aa8967847d9df16d7338f6af5cded2fe68bd7c9a4832799420b","observation_id":"59451c40-f510-4c26-9f3a-e7ea8b284a6d","resolution":{"observed_at":"2026-05-14T01:54:32.068473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Plgslam: Progressive neural scene represenation with local to global bundle adjustment","venue":null,"work_id":"e90c14be-e0aa-44f4-a231-39f022dfed4c","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:322350c213afea8035201410423a7bc35cd8139cf4c3437b00b4a55c2d2a5d75","observation_id":"fea9c1a7-2c1b-4475-b948-b9e1be7ff167","resolution":{"observed_at":"2026-05-14T05:28:08.885690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.23180","last_updated":"2026-05-16T07:53:20Z","snapshot_observed_at":"2026-08-03T04:34:56.955960Z","submitted_at":"2025-12-29T03:40:05Z","title":"GaussianDWM: 3D Gaussian Driving World Model for Unified Scene Understanding and Multi-Modal Generation","version":3},"cited_work":{"arxiv_id":"2512.23180","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.23180","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaussiandwm: 3d gaussian driving world model for unified scene understanding and multi-modal generation.arXiv preprint arXiv:2512.23180","venue":null,"work_id":"b62d9196-ae8a-4859-987a-617456f68914","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2512.23180","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:968e1c31d7fa2e8e96ae3c25bb05b9bafdd66c19f31559cac8801236f1ea0158","observation_id":"5472f68e-b5be-45cc-862f-2f8792081ba3","resolution":{"observed_at":"2026-05-20T00:03:01.148630Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.03422","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:46:11.607069Z","title":"What is the best 3d scene representation for robotics? from geometric to foundation models","venue":null,"work_id":"e2f37cab-d139-438b-9969-f14a0c9fc8f9","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:1397430f7e95e91a017ed40dd053fa69c0165b24ebf62353b02d61bd268fe518","observation_id":"f51d7c7f-5f9b-4961-94f5-dfc8325af484","resolution":{"observed_at":"2026-05-13T17:08:00.938623Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Superpoint: Self-supervised interest point detection and description","venue":null,"work_id":"f7868cd5-95bf-43b9-98c5-63747e6f38e1","year":2018},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:8cee5f8aa9cef481c6f4e27ab561b6581939f6f90ff9d8e0d52ee5d03685b0b1","observation_id":"de7fd923-30bb-48dd-8858-6e9866f19585","resolution":{"observed_at":"2026-05-14T05:28:08.905600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lsd- slam: Large-scale direct monocular slam","venue":null,"work_id":"dd87d38c-58e7-460a-a17f-163885b9ff9b","year":2014},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:d0c92a84adc1f70bc36504a61893a99177589290cf1bcf55e17d7e1d9d22b143","observation_id":"4ee40f19-488f-406d-83d5-ce58a032d171","resolution":{"observed_at":"2026-05-14T05:28:08.956548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Direct sparse odometry.IEEE transactions on pattern analysis and machine intelligence, 40(3):611–625","venue":null,"work_id":"82181134-7dba-434b-ad47-b69ff0164d70","year":2017},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:ba8d6ec3a5a0e77eb7a6ef553187f080b7b3cad15f24b480352f94d4f53fffc9","observation_id":"6279fc7d-5435-44b4-9524-6a5ce84e3eb3","resolution":{"observed_at":"2026-05-14T05:28:08.984325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Svo: Fast semi-direct monocular visual odometry","venue":null,"work_id":"13cba9ff-f735-4d1f-be74-b95a28935ceb","year":2014},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:66c3c1948db912cdaf8b3ff226254130857b8c814bcf572e7722df99985e7198","observation_id":"6affdfbd-6762-490c-bffd-65193ee93092","resolution":{"observed_at":"2026-05-14T05:28:08.902299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bags of binary words for fast place recognition in image sequences.IEEE Transactions on robotics, 28(5):1188–1197","venue":null,"work_id":"320a6544-20b1-4a81-85d4-81fe875d8c39","year":2012},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:ea167ade1793f3f719d3b81f640f8ca0a47cdff187d1f82e2ad4f66c85339227","observation_id":"0182821a-495d-4dd8-bc9f-094230e78591","resolution":{"observed_at":"2026-05-14T05:28:08.895441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep incomplete multi-view learning via cyclic permutation of vaes","venue":null,"work_id":"7a2aed3c-e8f6-4c4f-b20a-15905c95fa71","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:376f74c30d725b4ba85bd024048fffe8265edb720dc6579a3d56c3f67e6c657d","observation_id":"8afdde99-0ca9-46c2-9f32-734201e5548c","resolution":{"observed_at":"2026-05-14T05:28:08.961856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ldso: Direct sparse odometry with loop closure","venue":null,"work_id":"ef77f1e6-bafa-4127-91cb-eec635a1d0a4","year":2018},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:e96e45df46f2ae9fc3c76dc25f1c723cc0fbb773f8b80315719805e73455d52d","observation_id":"5dcd509c-e82c-43ad-bef3-13653d1d6792","resolution":{"observed_at":"2026-05-14T05:28:08.928838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Good: Training-free guided diffusion sampling for out-of-distribution detection","venue":null,"work_id":"4072ac3e-0250-4b29-91f8-a36aeea43855","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:a0ba1f704fded6d3e2cf969c6aeef7dd41b0e7426361ec564ff56de1b7e85972","observation_id":"5234b1a8-ed61-4089-970f-0870ce17e973","resolution":{"observed_at":"2026-05-14T05:28:08.978909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:26:28.964851Z","title":"Vision meets robotics: The kitti dataset.The Inter- national Journal of Robotics Research, 32(11):1231–1237","venue":null,"work_id":"6984c823-a284-4856-ae63-3d50ce40b6f5","year":null},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:b762d739e81744f373930afcadb26b9562f558d68bd00ca49cfd97265bf475bf","observation_id":"5242c2b1-91d2-4c0c-8ce3-6b94c18a4d5a","resolution":{"observed_at":"2026-05-14T05:28:08.987242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"evo: Python package for the evalua- tion of odometry and slam.https://github.com/ MichaelGrupp/evo","venue":null,"work_id":"7f1d5b39-d4e2-499a-b7f9-ecc43ecf4a91","year":2017},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:52e3724f737cc494b8052aa83568d8b3a0fdb924549041c0522ac2a3c7f0032d","observation_id":"38464ba1-0b7f-4de5-80b1-83621ed82438","resolution":{"observed_at":"2026-05-14T05:28:08.898752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dark-isp: Enhancing raw image processing for low-light object detection","venue":null,"work_id":"db383952-4f68-4aa4-ad55-82f33c89fb7d","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:b45edd6b79b1814dc12ccd0006fcf9ca2819bc30791fa7937710d5a64c65ab1c","observation_id":"668a40b0-e652-4b0b-b8e7-ccc9008159a0","resolution":{"observed_at":"2026-05-14T05:28:08.995424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toward camera open-set 3d object detection for autonomous driving scenar- ios.IEEE Transactions on Intelligent Transportation Sys- tems, 26(12):23190–23201","venue":null,"work_id":"68c2f196-df64-4681-b38c-6a87866439bd","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:84cd217f0f5b2aa34f443bc8b6a6c3d1e0bd9ce2bd07faa74ede3af13fd604f3","observation_id":"0d8ae6a8-e11b-4c83-a387-a24c61c7f479","resolution":{"observed_at":"2026-05-14T05:28:08.882532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.08254","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T04:37:36.978376Z","title":"DynamicVGGT: Learning dynamic point maps for 4D scene reconstruction in autonomous driving","venue":null,"work_id":"fc42d7cc-f5a2-4771-931a-34ae52d78f45","year":2026},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:ffbbed45569abfc55b1d40759a95143dd077222e27a4711d01f26e81305268ad","observation_id":"25b71fec-ac37-4cc2-a42d-87209090b4c7","resolution":{"observed_at":"2026-05-13T17:08:00.941371Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.03795","last_updated":"2026-04-06T07:53:28Z","snapshot_observed_at":"2026-08-05T20:29:20.174279Z","submitted_at":"2025-12-03T13:43:33Z","title":"MPCFormer: A physics-informed data-driven approach for explainable socially-aware autonomous driving","version":2},"cited_work":{"arxiv_id":"2512.03795","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.03795","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MPCFormer: A physics-informed data-driven approach for explainable socially-aware autonomous driving","venue":"cs.RO","work_id":"c14d6716-f633-4550-b68d-2f95e70f76a1","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2512.03795","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:a17e5d94979e80be41e316c1406a61db4d3fff1a37183d4af810cf7ad8f7453a","observation_id":"ddaec180-d10e-4b09-9b48-5d641b49e5be","resolution":{"observed_at":"2026-05-13T17:08:00.944304Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Photo-slam: Real-time simultaneous localization and photo- realistic mapping for monocular stereo and rgb-d cameras","venue":null,"work_id":"1e7b2ca6-9862-497a-830d-265923844a2f","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:e14f2b9df1765c18513838045ec6209d3da51afcc1f315f404a55e9c0e116abc","observation_id":"d892961f-d3d7-4236-8e88-82eb3bb250a0","resolution":{"observed_at":"2026-05-14T05:28:08.916223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eslam: Efficient dense slam system based on hy- brid representation of signed distance fields","venue":null,"work_id":"bb6b0711-370e-4189-914f-9cc1fc10a225","year":2023},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:870cacfcc77282ee3aaf11f380da2188c6b2af4c53a1d2ad38ce6d1b973e6298","observation_id":"09222a9c-5326-4fdb-aafa-aff61722dd02","resolution":{"observed_at":"2026-05-14T05:28:08.964933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Splatam: Splat track & map 3d gaus- sians for dense rgb-d slam","venue":null,"work_id":"b621159a-e8fc-47f6-9220-90c05e5602ef","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:4d732403fd0225cf4b9977c2892b132d47a3c2516dfd14dcfb1d5726e80f9bf5","observation_id":"8d700724-11d7-4b19-92a7-19ca4cf41894","resolution":{"observed_at":"2026-05-14T05:28:08.919097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T07:46:04.037239Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Trans","venue":null,"work_id":"f02b3a8e-cb41-4f1f-ae1c-75b487ba20f9","year":null},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:07a0d12fb5ab4b41df6e54bf8b276d686c4f4572529a85ef5ee0833298861f9f","observation_id":"176804ef-a8ca-406b-90af-cf7b37729f95","resolution":{"observed_at":"2026-05-14T05:28:08.935670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parallel tracking and map- ping for small ar workspaces","venue":null,"work_id":"46148512-1016-4d17-a96b-b4fcc0b3a00c","year":2007},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:03731af85fcc3e6ca449500ddc9933a5b6ce812c25627d3ff28e95ad16ad6d3e","observation_id":"2a3b0198-f01e-4a9d-b744-6144dd43d6cb","resolution":{"observed_at":"2026-05-14T05:28:08.971022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Artdeco: Toward high-fidelity on-the-fly reconstruction with hierarchical gaussian structure and feed- forward guidance","venue":null,"work_id":"93e32fbd-9649-44b4-8856-95a0139e2048","year":null},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:bf1bf2fed34458b5f121fd534e3631f33251abee68a1cebe765167da3f2ff318","observation_id":"5e514e0a-06f8-4df1-9cea-2b324b783817","resolution":{"observed_at":"2026-05-14T05:28:08.998078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Papl-slam: Principal axis-anchored monocu- lar point-line slam.IEEE Robotics and Automation Letters","venue":null,"work_id":"13cc35c8-11a8-4da6-b25e-8fef39497247","year":null},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:40525a45f02e089d8648ea1a5839f0e23069786bf2e044395e37891dc629d190","observation_id":"093dcfdc-d566-4957-adc6-bc51a4dcb87c","resolution":{"observed_at":"2026-05-14T05:28:08.968219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Constrained gaussian splatting via implicit tsdf hash grid for dense rgb-d slam.IEEE Transactions on Artificial Intelli- gence","venue":null,"work_id":"7b55a5da-ddd0-405a-9d90-31ac2b103401","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:4d1ed592eb64190a4babc9f217fe236e47dd4f95d04ae4560d0017b4c57190fd","observation_id":"51805d5a-254e-4954-804c-dd96c8627fe2","resolution":{"observed_at":"2026-05-14T05:28:08.879287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ec-slam: Effectively constrained neural rgb-d slam with tsdf hash en- coding and joint optimization.Pattern Recognition, 170: 112034","venue":null,"work_id":"4007c5fb-cb4e-4d50-aab4-7d46ee3285d9","year":2026},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:d63556dfa8912035725ea94539d0654de7f78a317622172e094908f88af151c5","observation_id":"915c987e-152d-44f3-857d-86d3bf684710","resolution":{"observed_at":"2026-05-14T05:28:08.925714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Undeepvo: Monocular visual odometry through unsuper- vised deep learning","venue":null,"work_id":"8cd8cc2a-b679-4d86-ab35-9da0f865da7a","year":null},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:40c8c8f96380517747cbb1cd69076694a87456112839e2ce3939af160acb3a9d","observation_id":"90dd4c6f-537b-4773-811d-b8d53fd3a158","resolution":{"observed_at":"2026-05-14T05:28:08.932400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepslam: A ro- bust monocular slam system with unsupervised deep learn- ing.IEEE Transactions on Industrial Electronics, 68(4): 3577–3587","venue":null,"work_id":"62b2f7bd-a11a-4e0f-b389-68c709afb46d","year":2020},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:ad4fda7fac8f8dafa188b5fa482d7131077f6aac9ffbc949325a1728ecbc48ab","observation_id":"8f28b2f6-9e1c-4030-b6d1-4173b5163290","resolution":{"observed_at":"2026-05-14T05:28:08.889054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.13842","last_updated":"2026-04-10T02:57:29Z","snapshot_observed_at":"2026-08-02T22:21:29.644302Z","submitted_at":"2026-03-14T08:53:47Z","title":"Fine-tuning is Not Enough: A Parallel Framework for Collaborative Imitation and Reinforcement Learning in End-to-end Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2603.13842","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.13842","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fine-tuning is Not Enough: A Parallel Framework for Collaborative Imitation and Reinforcement Learning in End-to-end Autonomous Driving","venue":"cs.RO","work_id":"0a3b0963-1b63-4332-94ce-404f50b318f3","year":2026},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2603.13842","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:0a8afdce4c582cb8226d5429b08be5013dfd074c411ca5296a8bfe0cc3048fe8","observation_id":"2e0d7bd3-204a-450f-bb54-c886341b9fa5","resolution":{"observed_at":"2026-05-13T17:08:00.947378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lightglue: Local feature matching at light speed","venue":null,"work_id":"b5bbdfaa-6521-4996-a705-a373da9b5229","year":2023},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:6549d1d78dcdb1f3f0514fcc44066ef8ad4e47b35ce6eac409b915e471106165","observation_id":"b50e6696-4039-4e56-aa4c-905534f27bec","resolution":{"observed_at":"2026-05-14T05:28:08.953711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep patch visual slam","venue":null,"work_id":"70fcf780-443e-4351-87f3-ba5727539c41","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:99b0f7482c28b910e53d3c68a86798835f2401565dd3fa35332514ed00158fc7","observation_id":"bd0d0c24-a8ac-44c7-acc0-064deec8a68b","resolution":{"observed_at":"2026-05-14T05:28:08.981485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Loopy-slam: Dense neural slam with loop closures","venue":null,"work_id":"e9c62d20-fa6d-4fc7-9322-a246b4f63c0b","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:d2e867a0516d1557e08fd4cd0502d8fe2564dd5bb802f36a3c9666f91c7955cf","observation_id":"c68d5d6f-00b8-4597-862a-4aae8c185692","resolution":{"observed_at":"2026-05-14T05:28:08.976125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.21044","last_updated":"2025-08-28T17:50:03Z","snapshot_observed_at":"2026-08-05T14:41:14.654194Z","submitted_at":"2025-08-28T17:50:03Z","title":"MMG-Vid: Maximizing Marginal Gains at Segment-level and Token-level for Efficient Video LLMs","version":1},"cited_work":{"arxiv_id":"2508.21044","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21044","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mmg-vid: Maxi- mizing marginal gains at segment-level and token-level for efficient video llms","venue":null,"work_id":"b7fd4ad9-ea98-4087-810b-822ebaf383ad","year":2025},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2508.21044","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:fe8795170847043471f0dd6f10bc390966057e999fe6d36a37b91e30b9b18ead","observation_id":"29f1ba24-1c86-4ce9-8209-8e21e967bea8","resolution":{"observed_at":"2026-05-13T17:08:00.956426Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.25072","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gift: Global irreplaceability frame tar- geting for efficient video understanding","venue":null,"work_id":"a15076be-9cb0-46ad-a8e4-ebdf67c6cfee","year":2026},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:adf6ed107a004abc55a46b26a0bef7c4958611de75f8dca1032b472f6e744e33","observation_id":"d689379c-06d1-4894-b74b-995de8fcf44f","resolution":{"observed_at":"2026-05-13T17:08:00.932689Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaussian splatting slam","venue":null,"work_id":"31fd18df-e75c-472d-b339-df7fb81ef24e","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:61c90ea99b85088512fc90dfde9ab1ec232d5eb05793d405b47353c83b5b4912","observation_id":"16031932-0580-4112-b375-db3765992731","resolution":{"observed_at":"2026-05-14T05:28:09.003158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:54:49.663524Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis.Communications of the ACM, 65(1):99–106","venue":null,"work_id":"a78ca6b2-365a-4526-90f5-0d8b3dbaf9c4","year":2021},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:5d7e263e08a8ebc52d1ec6652d383d76bbf88118dcbe9ab4fb992e0f061cb80c","observation_id":"545d594c-0ff3-44e1-908e-595e1059a534","resolution":{"observed_at":"2026-05-14T05:28:08.912811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orb-slam2: An open- source slam system for monocular, stereo, and rgb-d cam- eras.IEEE transactions on robotics, 33(5):1255–1262","venue":null,"work_id":"4a6a6435-42a4-468b-9d67-e515d7e5c1d6","year":2017},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:7148c520d87bdc41e512b68fcbccf30160c16eed322bee3703cb9041b100e616","observation_id":"3c0e5584-48eb-4974-97b5-6cc6059a9a0c","resolution":{"observed_at":"2026-05-14T05:28:08.950861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orb-slam: a versatile and accurate monocular slam system.IEEE Transactions on Robotics, 31(5):1147–1163","venue":null,"work_id":"e8b457d4-2e93-4a10-8cf2-1b746427877b","year":null},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:82c7d2a195897c25a8972f79ea2d8ad56bd21cd8e0aa026b401136a1488943e8","observation_id":"0f705efc-9f63-4365-9ee8-d180543b2135","resolution":{"observed_at":"2026-05-14T05:28:08.922274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":"6b2ee027-1143-43da-82d8-109f3b5af6b4","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:bc972a83c676c991b3371becf95e2ac232cfc7cd2f4d9bfa08e90beb919eecbf","observation_id":"9874e5d5-c2df-47a2-8f6a-78d12100156a","resolution":{"observed_at":"2026-05-14T05:28:08.944099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rtg-slam: Real-time 3d re- construction at scale using gaussian splatting","venue":null,"work_id":"460a40df-7a06-4cde-8d41-27ce237a7ac7","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:fac226f2b70014d1fe08ed03e6cf987ccab71901b2b8d685205b0167febf7823","observation_id":"493fd4c5-7690-4857-84a8-8ca398fe7bf3","resolution":{"observed_at":"2026-05-14T05:28:08.947451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":"582b3ca2-f58e-4990-a189-09308b50ff9b","year":2021},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:550033a9b73f5fa57f415872bfe2bf520226a0b203401519d77ff8b6acb53682","observation_id":"d4a4a1f7-c821-4943-843d-0f6806e4df7f","resolution":{"observed_at":"2026-05-14T05:28:08.941486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Machine learning for high-speed corner detection","venue":null,"work_id":"2f2cdcc9-8369-4336-8922-720e0d0d2f58","year":2006},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:241c5dcb5b9fac694b19f6853893955acd2513e3ee8c79fabfaa04df99cd2ae5","observation_id":"2102df67-99b3-4154-bc96-8f3db2d1daa5","resolution":{"observed_at":"2026-05-14T05:28:08.973545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orb: An efficient alternative to sift or surf","venue":null,"work_id":"5bf7ff2e-5ca3-4d50-bfd5-137fcb81bf5b","year":null},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:59a1b1fe02b9f455894c63c426ea4a3bf557123904ed3aecccebe25ded995df5","observation_id":"65359457-d2eb-4103-9a0b-23e974b546d0","resolution":{"observed_at":"2026-05-14T05:28:08.990287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Good features to track","venue":null,"work_id":"9bd569ad-1adb-4a10-9ace-87252e350012","year":1994},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:f0cd5c1147f7bba5d520e0be9d97fcbced2c928da11fac922e7b866e477314b7","observation_id":"2f05d425-f82b-462d-9f7b-310420d27025","resolution":{"observed_at":"2026-05-14T05:28:08.959124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"imap: Implicit mapping and positioning in real-time","venue":null,"work_id":"55254f79-5114-4dd1-8b87-45ff26b25e46","year":2021},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:d9dad6d6a38b71b055378e1f0f8250a6bea602abc4411258a11390c0a6599dd2","observation_id":"676706f0-d027-434c-8e80-b8b182fb7154","resolution":{"observed_at":"2026-05-14T05:28:09.000630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoupling scene perception and ego status: A multi-context fusion approach for enhanced generaliza- tion in end-to-end autonomous driving","venue":null,"work_id":"f8d48fe1-24bb-49cf-b8f0-c5e408fd1bba","year":2026},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:240d1c43a16fdd99c3944534e35e8146f0e8448002c43c9bf4a34f8340b27ff4","observation_id":"9e5a29fa-08cf-40b1-b282-1f8e647b1c5a","resolution":{"observed_at":"2026-05-14T05:28:09.023480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.18561","last_updated":"2026-04-10T06:34:23Z","snapshot_observed_at":"2026-08-03T00:47:39.661659Z","submitted_at":"2026-03-19T07:21:01Z","title":"CausalVAD: De-confounding End-to-End Autonomous Driving via Causal Intervention","version":2},"cited_work":{"arxiv_id":"2603.18561","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.18561","snapshot_observed_at":"2026-07-04T11:29:50.227290Z","title":"CausalVAD: De-confounding End-to-End Autonomous Driving via Causal Intervention","venue":"cs.CV","work_id":"d3ef6cf0-37dd-45a8-a163-d883391deeea","year":2026},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2603.18561","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:8eb94b6585c33c657dd00235cbe68a57d7821a78587b866df5a8a2fd87cd5c4a","observation_id":"e0158c81-752e-44c5-8d04-055b2f726966","resolution":{"observed_at":"2026-05-13T17:08:00.935656Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cnn-slam: Real-time dense monocular slam with learned depth prediction","venue":null,"work_id":"62c560cc-69ab-4c2d-a7ec-0f7a66c7b775","year":2017},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:f044ddcc6b66acf79ba79edb4f00d004d406b11495e70e586592dc6d6db539fd","observation_id":"630b30bb-2c06-455e-b40a-e35035b40249","resolution":{"observed_at":"2026-05-14T05:28:09.010819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":"0535d4db-9569-43b9-b14d-f9676d53752e","year":2020},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:b0b1e56bc1429f7ea1e789a10b5771a2681ae8b96bc60715591db3baf9474a64","observation_id":"9fb6fbef-15da-43b8-a21e-a9659d7712d7","resolution":{"observed_at":"2026-05-14T05:28:09.030405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Droid-slam: Deep visual slam for monocular, stereo, and rgb-d cameras.Advances in Neu- ral Information Processing Systems, 34:16558–16569","venue":null,"work_id":"e91f7a89-4c57-44f2-94ab-35d5241f563f","year":2021},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:3366415143c89e67919c6a3549aa99e219927071f9bf7010c29ccd9120913494","observation_id":"41822919-ec29-45ca-90cc-e38612e2639c","resolution":{"observed_at":"2026-05-14T05:28:09.025907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep patch vi- sual odometry.Advances in Neural Information Processing Systems, 36","venue":null,"work_id":"43e9ea34-dcc6-475c-9a33-3c141ae635f0","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:52fc5081723ebfc0641c3fce6b217799848e2e754ba46af1e1865f77ce55b4f4","observation_id":"21195aad-5a7b-4e40-9c0f-277b8bacda90","resolution":{"observed_at":"2026-05-14T05:28:09.013470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Co- slam: Joint coordinate and sparse parametric encodings for neural real-time slam","venue":null,"work_id":"020a9b38-44d9-49a8-b369-c5cacd0674b9","year":2023},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:e64360857096ddc5261a2b1f0737e2aa90ff55d680c4e7ac694d25178e18c04a","observation_id":"604c81cf-ea4e-4555-8e8d-0d64585deaf4","resolution":{"observed_at":"2026-05-14T05:28:09.008328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepvo: Towards end-to-end visual odometry with deep recurrent convolutional neural networks","venue":null,"work_id":"f3331a3f-a1ea-4c3c-88c9-628ef65f8773","year":2043},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:185c73b22a507bd1a381a4f783f904ea213d8965c9c44f18b9391d088d61a74c","observation_id":"3f7cfa11-4a5e-4c94-9189-1be7f59614f0","resolution":{"observed_at":"2026-05-14T05:28:09.016341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tartanair: A dataset to push the limits of visual slam","venue":null,"work_id":"6c15d00c-15d0-4473-9428-6d6c7299dfa0","year":2020},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:2b06e45524082d8dc32a1dae36f711dffe0ec774433b928ae79e0ed530b31870","observation_id":"99f7a5b7-e272-4a58-8111-1db9ed98c586","resolution":{"observed_at":"2026-05-14T05:28:09.021124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tartanvo: A generalizable learning-based vo","venue":null,"work_id":"dd6e6987-20e2-4615-ae55-9f6f16c62a31","year":2021},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:a4311abfc0a3f9a93d78ae9f1fe3d430dfb3f57d00f7ab0bb0bc079fdd012b9e","observation_id":"df6e4265-8f53-446c-a019-a74dc1711f8b","resolution":{"observed_at":"2026-05-14T05:28:09.028106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03520","last_updated":"2025-02-27T12:19:53Z","snapshot_observed_at":"2026-08-05T21:55:32.486142Z","submitted_at":"2024-08-07T03:08:57Z","title":"AirSLAM: An Efficient and Illumination-Robust Point-Line Visual SLAM System","version":4},"cited_work":{"arxiv_id":"2408.03520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.03520","snapshot_observed_at":"2026-06-30T07:44:21.502949Z","title":"AirSLAM: An efficient and illumination-robust point-line visual slam system","venue":null,"work_id":"8f8a61f9-6ace-427c-8486-bee99c5b3e63","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2408.03520","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:72fdb6a1d3c81e40c58ac13228e97c27322819341739cdeb0934271e21036a6f","observation_id":"f80be053-e072-4e1b-b790-8d7b9e48d617","resolution":{"observed_at":"2026-05-13T17:08:00.918619Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09414","last_updated":"2024-10-20T11:24:09Z","snapshot_observed_at":"2026-07-06T18:30:32.982860Z","submitted_at":"2024-06-13T17:59:56Z","title":"Depth Anything V2","version":2},"cited_work":{"arxiv_id":"2406.09414","doi":"10.48550/arxiv.2406.09414","metadata_source":"pith","pith_arxiv_id":"2406.09414","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Depth Anything V2","venue":"cs.CV","work_id":"5f5274d6-f7a5-4598-a3f6-d11f44520a2e","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2406.09414","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:80e9ba7edae7170c328ed125a5b63c532c36c2360d69311ec602f337d42b0d4b","observation_id":"4a590cf0-b5e4-4af7-9a43-5be87eca8825","resolution":{"observed_at":"2026-05-13T17:08:00.926951Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Go-slam: Global optimization for consistent 3d in- stant reconstruction","venue":null,"work_id":"ef0ea8fd-a4a8-4a95-ac74-9433c59a38b6","year":2023},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:11520c77cdf2f11e965a531e54edf2fc8016921338b1aadf6c6b0df7406a3539","observation_id":"ed401678-2066-429f-9672-4296f399a841","resolution":{"observed_at":"2026-05-14T05:28:09.018751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04417","last_updated":"2025-06-03T04:12:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-06T09:18:04Z","title":"SparseVLM: Visual Token Sparsification for Efficient Vision-Language Model Inference","version":4},"cited_work":{"arxiv_id":"2410.04417","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04417","snapshot_observed_at":"2026-07-09T21:36:34.338168Z","title":"SparseVLM: Visual Token Sparsification for Efficient Vision-Language Model Inference","venue":"cs.CV","work_id":"691499bc-3ae3-49f0-aba6-ab6c7972a7a7","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2410.04417","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:9ca6a3dc39737e28fa31a8af7eabe300032ca8dc5d5627e77b5b226e6a0169df","observation_id":"735cf995-5c67-4147-b990-2d8d30107ffb","resolution":{"observed_at":"2026-05-15T14:58:32.742607Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02382","last_updated":"2024-05-10T10:54:03Z","snapshot_observed_at":"2026-07-06T18:40:22.951929Z","submitted_at":"2024-05-10T10:54:03Z","title":"Light-SLAM: A Robust Deep-Learning Visual SLAM System Based on LightGlue under Challenging Lighting Conditions","version":1},"cited_work":{"arxiv_id":"2407.02382","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.02382","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Light-slam: A robust deep-learning visual slam system based on lightglue under challenging lighting conditions","venue":null,"work_id":"7a6f8df8-3776-4254-a143-5305557334aa","year":2024},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"cited_paper":"/paper/2407.02382","citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:ed66945bdc71df8b35b1728957e42df4c34a91e02fa6c367aaa7e6cad1409b13","observation_id":"aa8e5f64-67bc-4dcf-9364-f7cea4017188","resolution":{"observed_at":"2026-05-13T17:08:00.924476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deeptam: Deep tracking and mapping","venue":null,"work_id":"ed0d3560-7d60-4215-904c-3062abf320f4","year":2018},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:eda2347ad4648d3f1d33cbe67576686941026855583269696bdaf2f176b0c58b","observation_id":"de5da952-7124-4333-bb07-db27a758406c","resolution":{"observed_at":"2026-05-14T05:28:09.005470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.22228","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialreward: Verifiable spatial re- ward modeling for fine-grained spatial consistency in text-to- image generation","venue":null,"work_id":"2bc76e96-a9d0-4e83-a2d3-9bd60d7d634a","year":2026},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:b3420d10a7db74268cde8420cc251a9a702c78ede7f829eebdf9af9e1abbf1b6","observation_id":"b7245d58-5a2a-446b-82ae-aba36e6c4a19","resolution":{"observed_at":"2026-05-13T17:08:00.929943Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nice-slam: Neural implicit scalable encoding for slam","venue":null,"work_id":"c9760a6b-949a-4b4b-b6e6-2a570513f88f","year":2022},"citing_paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:52.493660Z"},"links":{"citing_paper":"/paper/2604.04055"},"observation_digest":"sha256:74f98c4630b0f999c0377931c723ee4ff85d99462b310452268419929206392b","observation_id":"e6e3dc28-e3b4-4afe-b5dd-49f3e8c121d4","resolution":{"observed_at":"2026-05-14T05:28:09.032601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.04055","last_updated":"2026-04-05T10:59:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:53:06.517678Z","submitted_at":"2026-04-05T10:59:48Z","title":"DINO-VO: Learning Where to Focus for Enhanced State Estimation"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":14,"verified_fuzzy":58},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2604.04055."}