{"as_of":"2026-08-09T05:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:580147123a64c26fb156a9f93aae8d0457ad61170a467b2806694248e4cffd99","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T21:56:37.014060Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.18803/citation-record","integrity":"/paper/2602.18803/integrity","json":"/paper/2602.18803/citation-record.json","paper":"/paper/2602.18803"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:32.463133Z","title":"Rethinking visual geo-localization for large-scale appli- cations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:32.463133Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:c733473c3e4eccaa0ef22a8fb89199a1727cc1b5d289a19f82da079bef715836","observation_id":"6989361e-73b3-46a6-a75e-fb834e5f92da","resolution":{"observed_at":"2026-08-02T21:56:32.463133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:32.663966Z","title":"Eigenplaces: Training viewpoint robust models for visual place recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:32.663966Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:4c8439113c846c1b855f1cad3aa887c9b504c27cd631d43cf6b0975569c0f3bc","observation_id":"80d1ced9-bf5c-4099-9609-042f9ee5a886","resolution":{"observed_at":"2026-08-02T21:56:32.663966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:32.895842Z","title":"Potential problems of stability and convergence in image-based and position-based visual servoing","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:32.895842Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:5ba87521e1272f4f2f140c40e674d8c18495a1b084297b42e272407ebe4141fe","observation_id":"eecea369-b949-4ddf-a21a-41f4cc3d8455","resolution":{"observed_at":"2026-08-02T21:56:32.895842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:33.062358Z","title":"Visual servo control","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:33.062358Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:1fd6445570fd1b1c329c529d79f72f6cade04a6cf801778f5e9b57567b791c15","observation_id":"9a67ecaf-8243-4385-a500-6b4d35279afb","resolution":{"observed_at":"2026-08-02T21:56:33.062358Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:33.309036Z","title":"Visual servo control","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:33.309036Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:99f4e1f1af9f7c0b72c4dd0754ac994139f6abbced5518f388c8064a24b6647a","observation_id":"b3aeb9b0-1e85-4487-ab4a-eb4bf70ba912","resolution":{"observed_at":"2026-08-02T21:56:33.309036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:33.479513Z","title":"Cautious weight decay.arXiv preprint arXiv:2510.12402, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:33.479513Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:0c24b82ae4044abf1876e588af439031584a25ebe2198b76a3e1cf344876a97a","observation_id":"61fdf98f-cc51-455c-a1e9-d04e0084c3ad","resolution":{"observed_at":"2026-08-02T21:56:33.479513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:33.632030Z","title":"A new approach to visual servoing in robotics","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:33.632030Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:9e5fd680d19761ab09750e9700e4d37be6e22bb3864267a345f54cd9bca06d7c","observation_id":"4ab712a7-d5ce-44ab-bbcc-3f07dfe54e53","resolution":{"observed_at":"2026-08-02T21:56:33.632030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:33.801786Z","title":"Pampc: Perception-aware model predictive control for quadrotors","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:33.801786Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:cce38a05249a404fc23b4b9bea2a337e18a5ae6096bcbe9d2edc24adcfbd7d95","observation_id":"ea234e4c-c195-49b5-8c5f-4d39ae18d6aa","resolution":{"observed_at":"2026-08-02T21:56:33.801786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:33.995479Z","title":"Muon: An optimizer for hidden layers in neural networks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:33.995479Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:92f73e160a2f76e4b15bf45857ba161577d4a601629c6101582b1519de88fb73","observation_id":"311ac9a7-e32d-42b1-9d37-2dc5b6d45313","resolution":{"observed_at":"2026-08-02T21:56:33.995479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:34.205640Z","title":"Habitat synthetic scenes dataset (hssd-200): An analysis of 3d scene scale and realism tradeoffs for objectgoal navigation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:34.205640Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:27388af182b8df3d473c7f62b9dc6a99b6ea50fab24fadf095e79fa5551ec273","observation_id":"e8b36415-6b9b-419b-80dc-6c26fc3ddb52","resolution":{"observed_at":"2026-08-02T21:56:34.205640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-07-06T06:14:28.435222Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-02T21:56:34.364512Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:34.364512Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:672f035807f4e5aae7f4742626c75e9918bdecebb3302fae047fdecede4a0aa6","observation_id":"10b9f87b-0fe8-4fc5-9a5e-e403a8c77461","resolution":{"observed_at":"2026-08-02T21:56:34.364512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15876","last_updated":"2022-11-29T02:29:35Z","snapshot_observed_at":"2026-07-06T14:24:18.648084Z","submitted_at":"2022-11-29T02:29:35Z","title":"Instance-Specific Image Goal Navigation: Training Embodied Agents to Find Object Instances","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15876","snapshot_observed_at":"2026-08-02T21:56:34.510003Z","title":"Instance-specific image goal navigation: Training embodied agents to find object instances.arXiv preprint arXiv:2211.15876, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:34.510003Z"},"links":{"cited_paper":"/paper/2211.15876","citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:87ccc68dcd17cd9e0bdcecb7c256e02f74fcb9b9ac4d9f2e808a542dd1871476","observation_id":"abaf3041-b4fa-48f1-bc6b-78e5d36622d1","resolution":{"observed_at":"2026-08-02T21:56:34.510003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:34.652570Z","title":"Navigating to objects specified by images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:34.652570Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:795558db5fd82ec16c82d3ec5ca9d5b9eb52b82a11f280d540a58a247cf4a450","observation_id":"0945cc52-8ed7-401c-ab78-eeefe83fd8c0","resolution":{"observed_at":"2026-08-02T21:56:34.652570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:34.790763Z","title":"Grounding image matching in 3d with mast3r","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:34.790763Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:a12f94fe85cf8328bc27a98132eb44fe87730dbd65117f2b4bf2013e479f4f58","observation_id":"37cd4d70-db24-4e3a-ba73-5536c8a3a6c3","resolution":{"observed_at":"2026-08-02T21:56:34.790763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-02T21:56:34.871539Z","title":"Depth anything 3: Recovering the visual space from any views.arXiv preprint arXiv:2511.10647, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:34.871539Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:26215bab7d4778865ea759756a9d709dd43cf064f9bcec0040c0e51adc239b00","observation_id":"435d1a01-5ec9-4999-b4dc-c2196248980e","resolution":{"observed_at":"2026-08-02T21:56:34.871539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:35.120919Z","title":"Botanicgarden: A high- quality dataset for robot navigation in unstructured natu- ral environments.IEEE Robotics and Automation Letters, 9(3):2798–2805, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.120919Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:6b79932ad7d8b4f397e9ab25b2ffbc880f3f1d88e56d1f308efb550bbba19793","observation_id":"01edac82-b1b1-4c48-8ff6-4b58010cf0d5","resolution":{"observed_at":"2026-08-02T21:56:35.120919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:35.186694Z","title":"Sampling-based mpc for constrained vision based control","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.186694Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:cd20d4358d5b88ee8b38d8b3a8effb50ecf097d0f430fa1b4f7b5209e1893b79","observation_id":"3f5d1462-dea0-4573-99a7-2a9ea6fa7e8b","resolution":{"observed_at":"2026-08-02T21:56:35.186694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:35.266641Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.266641Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:3b66f2f022d8089d92a516b5787d3ed72a5740b46b53513c0099b3dc3c828719","observation_id":"b4cdbdf3-cf1c-491c-bc5a-c464354dd963","resolution":{"observed_at":"2026-08-02T21:56:35.266641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10696","last_updated":"2025-07-30T11:43:00Z","snapshot_observed_at":"2026-08-07T15:44:57.179193Z","submitted_at":"2025-05-15T20:35:06Z","title":"TartanGround: A Large-Scale Dataset for Ground Robot Perception and Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10696","snapshot_observed_at":"2026-08-02T21:56:35.349637Z","title":"Tartanground: A large-scale dataset for ground robot perception and navigation.arXiv preprint arXiv:2505.10696, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.349637Z"},"links":{"cited_paper":"/paper/2505.10696","citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:1a4679f79f8a0e4438b9bff61a64c5ff46e71984b52c66f69cbdd5646455950a","observation_id":"1f71d69e-d73b-47d0-b23a-9694cc33f8d5","resolution":{"observed_at":"2026-08-02T21:56:35.349637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:35.428892Z","title":"Scalable diffu- sion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.428892Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:a48a779847f36de5cabf2beb2ef7e4af7b74d6f9624596dd88d47f58a8a63363","observation_id":"09c50f94-86f4-49cd-a6d6-1b0964cd1977","resolution":{"observed_at":"2026-08-02T21:56:35.428892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20110","last_updated":"2025-12-18T09:32:11Z","snapshot_observed_at":"2026-08-08T08:28:09.948334Z","submitted_at":"2025-02-27T14:03:15Z","title":"UniDepthV2: Universal Monocular Metric Depth Estimation Made Simpler","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20110","snapshot_observed_at":"2026-08-02T21:56:35.486896Z","title":"Unidepthv2: Universal monocular met- ric depth estimation made simpler.arXiv preprint arXiv:2502.20110, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.486896Z"},"links":{"cited_paper":"/paper/2502.20110","citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:348e3c7c46ee38834780eae0fd81b72b9d6bcc321ff843e08738c9f06fd1373a","observation_id":"27755f92-c822-4124-a35d-3c50d22fca04","resolution":{"observed_at":"2026-08-02T21:56:35.486896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08238","last_updated":"2021-09-16T22:01:24Z","snapshot_observed_at":"2026-07-06T11:48:35.206160Z","submitted_at":"2021-09-16T22:01:24Z","title":"Habitat-Matterport 3D Dataset (HM3D): 1000 Large-scale 3D Environments for Embodied AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08238","snapshot_observed_at":"2026-08-02T21:56:35.565042Z","title":"Habitat-matterport 3d dataset (hm3d): 1000 large-scale 3d environments for embodied ai.arXiv preprint arXiv:2109.08238, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.565042Z"},"links":{"cited_paper":"/paper/2109.08238","citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:22704ded1325e05f7b68a5efa7872a787acfe349808f06a273f406f37f15f763","observation_id":"5c4af01b-6cf9-4cba-b715-4f82ed811755","resolution":{"observed_at":"2026-08-02T21:56:35.565042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:35.650209Z","title":"Habitat: A Platform for Embodied AI Research","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.650209Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:c99a71c6cf7caf8f4f2763644483d65be9c01f823c8c1b54d114b024e29a1c54","observation_id":"33ffa885-f420-4e97-b87d-7204c0332291","resolution":{"observed_at":"2026-08-02T21:56:35.650209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:35.734335Z","title":"Gnm: A general navigation model to drive any robot","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.734335Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:9e1a7bec1e1f09aa1a3b1fbc74356ca77e3ae016041b21887f04b27b87166053","observation_id":"b5ecdcc7-8694-472d-9a06-d92165dea4f1","resolution":{"observed_at":"2026-08-02T21:56:35.734335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14846","last_updated":"2023-10-24T06:16:43Z","snapshot_observed_at":"2026-08-07T21:06:01.525655Z","submitted_at":"2023-06-26T16:57:03Z","title":"ViNT: A Foundation Model for Visual Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14846","snapshot_observed_at":"2026-08-02T21:56:35.817252Z","title":"Vint: A foundation model for visual navigation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.817252Z"},"links":{"cited_paper":"/paper/2306.14846","citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:30735f3eff8d6b2967c59e82446a9fc522711770cd927ebbdfb2e7314320f3f4","observation_id":"6f3df3c4-ee9c-4659-895a-90074b0e39e1","resolution":{"observed_at":"2026-08-02T21:56:35.817252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:35.896169Z","title":"Theia: Distilling diverse vision foundation models for robot learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.896169Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:20915bb5f7ef54221864560828ba86acd8b8882aa8e49d799d4d290cc73e1a57","observation_id":"8dab01af-9b23-47e3-8d5c-6ab79452158a","resolution":{"observed_at":"2026-08-02T21:56:35.896169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-02T21:56:35.956566Z","title":"Dinov3.arXiv preprint arXiv:2508.10104, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:35.956566Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:b6f099bc5df7cb1db27d8ae8e1993f31ba334ca533bd51e6f34442e2833608a8","observation_id":"f006d4b0-1ead-4599-8cc4-0ed51e3e01b5","resolution":{"observed_at":"2026-08-02T21:56:35.956566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.009068Z","title":"Nomad: Goal masked diffusion policies for navigation and exploration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.009068Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:1c720960f5bd88b7ce4dd768d9996a9d104f0582e2803e004ebd990c68735a77","observation_id":"75f8cfe5-0c6e-46e8-8ec0-d9bc63f467f2","resolution":{"observed_at":"2026-08-02T21:56:36.009068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.059654Z","title":"Roformer: Enhanced trans- former with rotary position embedding.Neurocomputing, 568:127063, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.059654Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:4c3a080a7807574f8c1e30f6bf0aabd8ab6ca59b433fbacba3292d43c2c1af4a","observation_id":"486aad3f-22c5-4cf9-a430-22638638d10f","resolution":{"observed_at":"2026-08-02T21:56:36.059654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.111388Z","title":"Placenav: Topological navigation through place recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.111388Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:f0df8d205cd15953ebd0d57f8dfa1b646b11698153fbdfb65ccaa0e559a2f3e1","observation_id":"2300c075-755c-4324-a3fd-1c9b70df1ac7","resolution":{"observed_at":"2026-08-02T21:56:36.111388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.189851Z","title":"Torres, Harry Edelman, and Joni-Kristian K ¨am¨ar¨ainen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.189851Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:e9e8b6ea12f3e641dc4f46e01eb1a50ba22db4401f5d583ce3be6e49d72dd83a","observation_id":"9a133bb4-85b0-4e7c-86f1-54c8fcfdf409","resolution":{"observed_at":"2026-08-02T21:56:36.189851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.245152Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.245152Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:20cece8b555ec9d4562a86f6bea61ae3be0e230006abccb7ba2e7d7f97a4039e","observation_id":"79f3475a-355c-4f0e-be0d-d392ebb1eade","resolution":{"observed_at":"2026-08-02T21:56:36.245152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.300238Z","title":"Benchmark for evaluating long-term localization in indoor environments under substantial static and dynamic scene changes","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.300238Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:70053f7cc412fd90f597b212d7bb0aa64408a6466bd1ee84ad905547b55d67ae","observation_id":"65807f66-8490-45e9-ab92-10cffdaa60e4","resolution":{"observed_at":"2026-08-02T21:56:36.300238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.375781Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.375781Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:e2d8c572b1458e2fefe36923183d02114b5eaf7361e5b393e6e32c6407e95c6e","observation_id":"8f0edf7c-3e32-48fd-80bf-e0066afd5b6d","resolution":{"observed_at":"2026-08-02T21:56:36.375781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.428932Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.428932Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:003c3f43d608da125ec0cff6daf723bea004c791d2b98c9b6b3b74f8f9a48b31","observation_id":"6eb1673f-f9f4-4b35-ab50-a54bd8a67723","resolution":{"observed_at":"2026-08-02T21:56:36.428932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10565","last_updated":"2025-05-15T17:59:50Z","snapshot_observed_at":"2026-08-07T15:44:58.634802Z","submitted_at":"2025-05-15T17:59:50Z","title":"Depth Anything with Any Prior","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10565","snapshot_observed_at":"2026-08-02T21:56:36.481537Z","title":"Depth any- thing with any prior.arXiv preprint arXiv:2505.10565, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.481537Z"},"links":{"cited_paper":"/paper/2505.10565","citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:84a1c389bae45201de466d50ea5b4ff1a4b3d0f10b2a11cc155f6956f246258f","observation_id":"49d9aa10-2429-4f83-9841-377cf3887a38","resolution":{"observed_at":"2026-08-02T21:56:36.481537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.557777Z","title":"Aggressive driving with model predictive path integral control","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.557777Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:a4e41db02732ca816f99e41c69c5ba5329654a2e4d9f9d704e3dab6168183368","observation_id":"4ab4deb2-9e29-419a-96d6-112b70dbad9c","resolution":{"observed_at":"2026-08-02T21:56:36.557777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.621186Z","title":"Model predictive path integral control: From theory to parallel computation.Journal of Guidance, Control, and Dynamics, 40(2):344–357, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.621186Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:e456592f9c4acc76fbc1cf44534d031b91cb8401e8555fa5993d5eda4154dd7e","observation_id":"bec6ee44-ff33-4df8-9461-fb4a05c790f4","resolution":{"observed_at":"2026-08-02T21:56:36.621186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.658299Z","title":"Zamir, Zhiyang He, Alexander Sax, Jitendra Malik, and Silvio Savarese","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.658299Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:6ee5bf8c15ef98005de0a3a39ac8e980e9aa8a821ec1955d306d087967767c0b","observation_id":"07888f30-f809-4ecc-84ab-4ed3aef926f7","resolution":{"observed_at":"2026-08-02T21:56:36.658299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.743095Z","title":"Toward robust robot 3-d perception in urban environments: The ut campus object dataset.IEEE Transactions on Robotics, 40:3322–3340, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.743095Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:54f4c4d92db066507bfbb170c333fb89068bb0ee5a0d0b6d6b74db1c9db7a6b4","observation_id":"4fe1f3d7-4957-4e5f-839c-523319e94745","resolution":{"observed_at":"2026-08-02T21:56:36.743095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.825727Z","title":"At k= 0a learned empty-pose token is used instead","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.825727Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:cf0b9e7e49448f0ba6213923ad15a14d9274a18f5ab9e3f50924a44c70d0f418","observation_id":"98de6078-9e8e-4584-8180-e0f782601773","resolution":{"observed_at":"2026-08-02T21:56:36.825727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.905226Z","title":"These condition the input tokens via Adaptive Layer Normalization: x′ =x+gate⊙ h (1 +scale)⊙RMSNorm(x) +shift i","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.905226Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:be9ae9ab8a02d087edf0c0aaac7f9d3b22a8f8f3326c1aee707f478e1e22c437","observation_id":"f339c979-a6a3-47cf-8252-6dfcf65f1e59","resolution":{"observed_at":"2026-08-02T21:56:36.905226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:36.963494Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:36.963494Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:0092815d9f31fb826e0e337472caaf9c3001ebbdb5aa87a0c1b6b3695e518cd6","observation_id":"7de936a3-4179-43a1-8185-7a06f0849c07","resolution":{"observed_at":"2026-08-02T21:56:36.963494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:37.014060Z","title":"The final predictions are mapped to bounded ranges: image coordinatesp i = tanh(·)∈[−1,1]; a visibility logitv i; and a normalized distanced i = 1 2 tanh(·) + 1 ∈[0,1]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:37.014060Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:5990cd8984196b88c9f63faa73e1bd8b77d135a65e979ffa12a4032edaf4b59a","observation_id":"8b3c2d72-707f-4b5f-baab-094af56c387e","resolution":{"observed_at":"2026-08-02T21:56:37.014060Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:56:34.086611Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T21:56:34.086611Z"},"links":{"citing_paper":"/paper/2602.18803"},"observation_digest":"sha256:aa73b9712dc61d3315f30604f444b927584f2ec0bc6dfad3b6ed25070cf1aeb2","observation_id":"fb387fd3-dbde-4227-a8b9-50a1e385e4b6","resolution":{"observed_at":"2026-08-02T21:56:34.086611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.18803","last_updated":"2026-07-02T13:59:22Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T10:57:09.906822Z","submitted_at":"2026-02-21T11:33:00Z","title":"Learning to Localize Reference Trajectories in Image-Space for Visual Navigation"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2602.18803."}