{"as_of":"2026-08-04T20:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:85086b494161a0de1c583d314bab7591137b73ab74409c510cb210b4f3f902b6","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T10:59:25.973958Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.11563/citation-record","integrity":"/paper/2606.11563/integrity","json":"/paper/2606.11563/citation-record.json","paper":"/paper/2606.11563"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Advances in Agri- culture Robotics: A State-of-the-Art Review and Challenges Ahead ,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:8d12908b77d99101aff3177eecd74abc07b542018a388f2bc8b5db9dfaf2a494","observation_id":"bb3412ac-6dd7-4ff4-8101-45491e914687","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Vision meets Robotics: The KITTI Dataset,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:fba373b125212c9b1f2d23e735364d57a195160a384aac9601fce9d4379c1625","observation_id":"ed0fa4e6-75de-4c86-b86c-05f354a7766a","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"1 Year, 1000km: The Oxford RobotCar Dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:a50a631d746731bbe4a73835de37b7bcf8d5726af71c00113f68c7d2f7664694","observation_id":"b060fb25-0b26-47b3-a24b-1e9c94c2aff7","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Indoor Segmen- tation and Support Inference from RGBD Images,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:7a4f85df3381fb246f5ad60524ffdf9aa48f60c5ec9a37dabaaea1a450517970","observation_id":"218ff575-3c27-4431-89d9-d7232cf52cd7","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"VGGT: Visual Geometry Grounded Transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:bb64f4da759e403cb3693dcdcb39e6c280c1edd5d1b755e21d36e80849e7ffb4","observation_id":"83522be6-e102-41a1-ad8b-8de890c73435","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Lip- loc: Lidar image pretraining for cross-modal localization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:da16175dc9335ecd74f8ae07e82bb4e22182774202952397c99ef4f4946d6d0a","observation_id":"20737e14-3b4f-45ee-81df-045b4b63b5ca","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Wild- Cross: A Cross-Modal Large Scale Benchmark for Place Recognition and Metric Depth Estimation in Natural Environments,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:ca64b2919367868e87d6801e3b81421d900ba4913b026e401b101097092387a0","observation_id":"2e213919-2ab0-4f2c-b0ff-21fd20930210","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Wild-Places: A Large-Scale Dataset for Lidar Place Recognition in Unstructured Natural Environments,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:814bb39521d236c2b53f2c08dba9cf32b0127d8fd95b17e71ff2bccc638a5310","observation_id":"ca75a27d-e771-48ce-aef3-caee826a9b11","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Depth Anything V2,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:f09dd310f308251d90f5dddc118dfa48dfba1dd55433df577352f127de66694c","observation_id":"5647fbc9-8815-45aa-af3f-28221a2fc891","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"WildScenes: A benchmark for 2D and 3D semantic segmentation in large-scale natural environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:88ad0ccb823a79dd77a2e44601cbce75126a61d82fcb6a010228e874fc44447b","observation_id":"5896fd22-f888-4a21-bbd6-949b15129878","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12595","last_updated":"2022-05-25T09:15:27Z","snapshot_observed_at":"2026-08-03T06:09:40.793593Z","submitted_at":"2022-05-25T09:15:27Z","title":"Wildcat: Online Continuous-Time 3D Lidar-Inertial SLAM","version":1},"cited_work":{"arxiv_id":"2205.12595","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.12595","snapshot_observed_at":"2026-07-09T23:56:38.449462Z","title":"Wildcat: Online Continuous-Time 3D Lidar-Inertial SLAM","venue":"cs.RO","work_id":"2a010829-935c-4635-8d73-c15fd81b2b0f","year":2022},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"cited_paper":"/paper/2205.12595","citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:6ab200ade635c5e24c9f77cc9115641e0bc49e223097e67f1d70280ff6f56d87","observation_id":"da68553c-9a9c-433d-9f35-3ed2d75f5706","resolution":{"observed_at":"2026-07-03T08:07:45.548412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"NetVLAD: CNN architecture for weakly supervised place recogni- tion,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:d5bea70fe37ed6434f271a1a1bc0cbe2323ca3d016a42b7d3201babdb9843bac","observation_id":"d9c13c3c-1ad3-4b7b-9343-2da845f785f8","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"MixVPR: Feature Mixing for Visual Place Recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:6db35aba3a57ac7d1d37e955077c99c6ef87f3ed1eaa29164b9d77870f8ca20f","observation_id":"6b7149dd-72bb-4de0-a547-dbdec6b10bc4","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Optimal transport aggregation for visual place recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:211a5e1cae9fa29053b58e2a3b57c8f36d475dc98d234e2a12da262045324f37","observation_id":"847627d6-7194-49ec-bc5e-ff31faeb3c56","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"BoQ: A Place is Worth a Bag of Learnable Queries,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:e40ee620ffd6ee29a54f8147b5c1d06a9b72455eaeecc17f4cadac8b65f50428","observation_id":"bcf8df54-c4a3-4ba5-bfbc-a2ff1c98ec65","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Rethinking Visual Geo- localization for Large-Scale Applications,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:ac4a37a0cd7066e5ae6a822fa862d7d7326e4ac86826a79d5f34815f934a1825","observation_id":"0159ee4e-1ac5-4b61-90a5-d59eedae8871","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:2aa93d0383e8d5294474c768c1d7543b8e51089cb8957a3f058616a5c4b1d5f1","observation_id":"649187c2-1dfe-4357-8ef6-4973b979ba4b","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-07-11T00:07:42.299741Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:27206872a388c2064e9ce5be0d2bdb2d8bd93b6d6ca32de15c2a0b81260850e2","observation_id":"3727f7fd-80d7-4fe2-b0c0-ca1749b3e54f","resolution":{"observed_at":"2026-07-03T08:07:45.550652Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":"2508.10104","doi":"10.1055/a-2487-1252","metadata_source":"pith","pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DINOv3","venue":"cs.CV","work_id":"c8b07deb-8fe7-4e18-9620-f3569d3529ce","year":2025},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:fac425de49de6d3c05098ff424a96fbf49872bacbf81f1ccd8d6224d6b8df491","observation_id":"a2cacbe9-befc-4620-adae-a6ff8f93f11d","resolution":{"observed_at":"2026-07-03T08:07:45.542180Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Virtual Worlds as Proxy for Multi-Object Tracking Analysis,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:37a7e7fdc351df31f0b97c26d987f97256aafddb4807e3d9c735172798d721eb","observation_id":"d26a15da-4d51-4834-bb21-fa96cf48bc0c","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":"2511.10647","doi":"10.48550/arxiv.2511.10647","metadata_source":"pith","pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-07-11T02:27:48.889599Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","venue":"cs.CV","work_id":"0a54b500-1e9d-46c2-85eb-8e16cbac8461","year":2025},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:9d3bcd9116542d396a15645eac715b224866beb873b69030da87e6008b82c62a","observation_id":"3daff839-c0f7-4da4-bfd4-4b166a50ddf5","resolution":{"observed_at":"2026-07-03T08:17:44.922742Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10565","last_updated":"2025-05-15T17:59:50Z","snapshot_observed_at":"2026-07-06T21:24:34.845524Z","submitted_at":"2025-05-15T17:59:50Z","title":"Depth Anything with Any Prior","version":1},"cited_work":{"arxiv_id":"2505.10565","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.10565","snapshot_observed_at":"2026-07-07T22:24:11.134049Z","title":"Depth anything with any prior","venue":"cs.CV","work_id":"eef7e0d5-2243-4708-9a72-4c2ef9789516","year":2025},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"cited_paper":"/paper/2505.10565","citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:37d45df30ddd745c6809c764c26e7ad46a1c4df414ca09955d8be2d12054ec97","observation_id":"cb1ebaae-bf77-488b-b842-1f35be37b524","resolution":{"observed_at":"2026-07-03T08:07:45.544952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Visual Place Recogni- tion with Repetitive Structures,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:a9dc1f90a378460c141f05b5bf5ac784897f1a03427dcf73f0695276f129b562","observation_id":"bbd7410c-88ab-4612-a11b-dedd4aac1c5a","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T10:59:25.973958Z","title":"Mapillary Street-Level Sequences: A Dataset for Lifelong Place Recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T10:59:25.973958Z"},"links":{"citing_paper":"/paper/2606.11563"},"observation_digest":"sha256:1acf16313a07845b8a70fc59fc01af46d3138d544148ad2b77addd5b245601bf","observation_id":"d37b25df-00a8-465b-8d33-831874de0074","resolution":{"observed_at":"2026-06-27T10:59:25.973958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.11563","last_updated":"2026-06-10T01:43:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-30T15:57:16.918366Z","submitted_at":"2026-06-10T01:43:24Z","title":"Cross-Modal Benchmarking for Robotic Perception in Natural Environments"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2606.11563."}