{"as_of":"2026-08-18T22:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d86e4a86e74af282f9b375d9836173b220a96f466122032458fe7d4dab7c3f9c","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T11:48:14.888295Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:21:26.572115Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.28237","snapshot_observed_at":"2026-07-14T12:26:27.446079Z","title":"Poinav: Benchmarking and enhancing final-meters arrival in real-world vision-language navigation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10350","last_updated":"2026-07-17T17:27:03Z","snapshot_observed_at":"2026-08-17T00:48:18.886735Z","submitted_at":"2026-07-11T15:24:43Z","title":"ABot-AgentOS: A General Robotic Agent OS with Lifelong Multi-modal Memory","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T12:26:27.446079Z"},"links":{"cited_paper":"/paper/2605.28237","citing_paper":"/paper/2607.10350"},"observation_digest":"sha256:06775dcbd355fc127d4c9ef78ce106e19ab334184640c4eed05f098311dad2f9","observation_id":"f8fe316d-c505-47f0-97c7-175935f34ab6","resolution":{"observed_at":"2026-07-14T12:26:27.446079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.28237","snapshot_observed_at":"2026-08-02T07:21:26.572115Z","title":"Poinav: Benchmarking and enhancing final-meters arrival in real-world vision-language navigation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10350","last_updated":"2026-07-17T17:27:03Z","snapshot_observed_at":"2026-08-17T00:48:18.886735Z","submitted_at":"2026-07-11T15:24:43Z","title":"ABot-AgentOS: A General Robotic Agent OS with Lifelong Multi-modal Memory","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T07:21:26.572115Z"},"links":{"cited_paper":"/paper/2605.28237","citing_paper":"/paper/2607.10350"},"observation_digest":"sha256:c5a5f4d25b4686f5271c02e9695e8caa7e3d7e81d6eae015c7bccadb093fed6e","observation_id":"3f6a8f50-8fe5-4a10-9867-c8db609cf765","resolution":{"observed_at":"2026-08-02T07:21:26.572115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.28237","snapshot_observed_at":"2026-07-14T12:10:21.115628Z","title":"Poinav: Benchmarking and enhancing final-meters arrival in real-world vision-language navigation.arXiv preprint arXiv:2605.28237, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10383","last_updated":"2026-07-17T07:17:10Z","snapshot_observed_at":"2026-08-16T10:16:46.784385Z","submitted_at":"2026-07-11T16:21:03Z","title":"ABot-N1: Toward a General Visual Language Navigation Foundation Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T12:10:21.115628Z"},"links":{"cited_paper":"/paper/2605.28237","citing_paper":"/paper/2607.10383"},"observation_digest":"sha256:f0900d412ea7d962d4a2441158417ead32ad6d83f96243c8868170c894a3ee2e","observation_id":"4553ac70-d3e4-4073-b8c5-03d95d8fd3a8","resolution":{"observed_at":"2026-07-14T12:10:21.115628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.28237","snapshot_observed_at":"2026-08-02T07:19:38.321058Z","title":"Poinav: Benchmarking and enhancing final-meters arrival in real-world vision-language navigation.arXiv preprint arXiv:2605.28237, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10383","last_updated":"2026-07-17T07:17:10Z","snapshot_observed_at":"2026-08-16T10:16:46.784385Z","submitted_at":"2026-07-11T16:21:03Z","title":"ABot-N1: Toward a General Visual Language Navigation Foundation Model","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T07:19:38.321058Z"},"links":{"cited_paper":"/paper/2605.28237","citing_paper":"/paper/2607.10383"},"observation_digest":"sha256:33256540a588d38e0b2bc437d81ee6a94ca6fcd6e9082ed2858d793eab23f447","observation_id":"3bbe455c-b2ac-4aee-81e2-8f0e24068f23","resolution":{"observed_at":"2026-08-02T07:19:38.321058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.28237/citation-record","integrity":"/paper/2605.28237/integrity","json":"/paper/2605.28237/citation-record.json","paper":"/paper/2605.28237"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:c8885cf4636504a5ff0cb657a05849b35aa0cb1da8173415b6876d0d71d52800","observation_id":"0d42ca5d-b4e9-4229-8cd6-0b8cb4626648","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:b091e9d24ce5c9f9c16a3f2097210ae9c2807131656dce35f9e144ca3d39b7db","observation_id":"3ac0e6eb-170a-415e-8d2c-ccb9332cb933","resolution":{"observed_at":"2026-06-29T11:53:23.909181Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:7e4b205089b347889ffa0db9cc00cf64bd19c809a02ef4e0ac8fb9927e1d4d08","observation_id":"dd75b899-dd17-40c5-9982-485a13f8fd6e","resolution":{"observed_at":"2026-06-29T11:53:23.914734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13171","last_updated":"2020-08-30T04:28:13Z","snapshot_observed_at":"2026-08-18T16:20:55.129945Z","submitted_at":"2020-06-23T17:18:54Z","title":"ObjectNav Revisited: On Evaluation of Embodied Agents Navigating to Objects","version":2},"cited_work":{"arxiv_id":"2006.13171","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13171","snapshot_observed_at":"2026-07-04T19:20:06.888892Z","title":"Objectnav revisited: On evaluation of embodied agents navigating to objects","venue":null,"work_id":"2559f113-5e2a-419e-8aba-d15f8f50737c","year":2006},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2006.13171","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:6787e39e968f6fde87928112c861e62600a5cf2343f3b6238c8f828487d981cc","observation_id":"d31070da-bac2-46fb-b5ae-7dbfef2c69f7","resolution":{"observed_at":"2026-06-29T11:53:23.914234Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16634","last_updated":"2023-09-28T17:41:17Z","snapshot_observed_at":"2026-08-17T00:21:27.576788Z","submitted_at":"2023-09-28T17:41:17Z","title":"End-to-End (Instance)-Image Goal Navigation through Correspondence as an Emergent Phenomenon","version":1},"cited_work":{"arxiv_id":"2309.16634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.16634","snapshot_observed_at":"2026-06-30T05:54:18.833742Z","title":"End-to-end (instance)-image goal navigation through correspondence as an emergent phenomenon.arXiv preprint arXiv:2309.16634","venue":null,"work_id":"80a8aae3-8704-4d37-b0ae-3df25c30d95a","year":2023},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2309.16634","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:6305b8097ba056c264fe3925681d8eb9831c06c66789ffe91f9c328a26539de7","observation_id":"d73e5434-9500-4321-8705-d101c2dd5c0b","resolution":{"observed_at":"2026-06-29T11:53:23.919441Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"Advances in Neural Information Processing Systems33, 4247–4258 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:0b928fcca3f384b2a7b51415656116a0fe11664724e39895f736f53c3ea48444","observation_id":"42962cc2-da4f-4d5b-8231-7149d4eb168a","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.21135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:38:59.473787Z","title":"Socialnav: Training human-inspired foundation model for socially-aware embodied navigation","venue":null,"work_id":"5428a7a4-b28b-4e9f-b7c4-af475e6d48d8","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:5ea663b77e232dce730ef40ab006d66d7315fc687186a0d4cfd4b6c38a3ec6ef","observation_id":"b6ccc453-987f-4be3-af8d-7d42d7b8280b","resolution":{"observed_at":"2026-06-29T11:53:23.906966Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04453","last_updated":"2025-02-17T18:27:27Z","snapshot_observed_at":"2026-08-17T17:58:31.496050Z","submitted_at":"2024-12-05T18:58:17Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Navigation","version":2},"cited_work":{"arxiv_id":"2412.04453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04453","snapshot_observed_at":"2026-07-04T09:09:43.511252Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Naviga- tion","venue":null,"work_id":"f57eed5a-690c-4e1f-8832-41c0fa16ce05","year":2024},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2412.04453","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:2f70c541f6ae0ac53623892d0000122b199a327418575980747b774c1f74f870","observation_id":"7d8c41c4-e31e-4da3-bf8b-14aaa25f3361","resolution":{"observed_at":"2026-06-29T11:53:23.916822Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.11598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T11:08:02.870809Z","title":"Abot-n0: Technical report on the vla foundation model for versatile embodied navigation","venue":null,"work_id":"8510ab27-cfb8-418f-9a64-23043b5d602d","year":2026},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:b62825473d70803476c7605c3a231afcaa78311661a98d004a875a12c3d638b7","observation_id":"a129f07e-b47d-4502-a017-13a93acd566e","resolution":{"observed_at":"2026-06-29T11:53:23.902282Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-16T16:12:15.083932Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2211.16649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-07-04T17:09:59.557766Z","title":"Clip-nav: Using clip for zero-shot vision-and-language navigation","venue":null,"work_id":"0744df03-abcd-4bcf-bd2e-e48679e7bd1e","year":2022},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:033af97aa4a79eae863333e365c68e7904ebfd9cf9778610f612c781c4066162","observation_id":"bf3fa07c-7c51-4b30-a3e2-ec3b920608f4","resolution":{"observed_at":"2026-06-29T11:53:23.904587Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2505.07062","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-07-08T16:15:06.198778Z","title":"Seed1.5-VL Technical Report","venue":"cs.CV","work_id":"0e8e025f-ca1e-49cc-aee2-33f3a0201f3c","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:0b63e62fabbb280ef94dd946014c5c4ce3bf77fa3b7fc115d8dcbdab464dea1d","observation_id":"7c9e4383-148c-4a6d-aea1-be5b84072df7","resolution":{"observed_at":"2026-06-29T11:53:23.923833Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02459","last_updated":"2026-05-29T17:47:50Z","snapshot_observed_at":"2026-08-18T07:29:57.033295Z","submitted_at":"2026-02-02T18:47:49Z","title":"TIC-VLA: A Think-in-Control Vision-Language-Action Model for Robot Navigation in Dynamic Environments","version":2},"cited_work":{"arxiv_id":"2602.02459","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.02459","snapshot_observed_at":"2026-07-03T06:07:41.680560Z","title":"Tic-vla: A think-in-control vision-language-action model for robot navigation in dynamic environments","venue":"cs.RO","work_id":"a1a5ef9f-843d-4452-8cb1-60bfd31ef197","year":2026},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2602.02459","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:7ae1c04acb4e6d13e8fee4c834a2b1be9ed7b0420abe60c3bc47b6e28955b01a","observation_id":"61db0f1d-0381-45d4-aec1-8d78bf689780","resolution":{"observed_at":"2026-06-29T11:53:23.887082Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15643","last_updated":"2025-04-22T07:01:00Z","snapshot_observed_at":"2026-08-18T08:41:19.125018Z","submitted_at":"2025-04-22T07:01:00Z","title":"Multimodal Perception for Goal-oriented Navigation: A Survey","version":1},"cited_work":{"arxiv_id":"2504.15643","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15643","snapshot_observed_at":"2026-06-29T11:53:23.901201Z","title":"arXiv preprint arXiv:2504.15643 (2025)","venue":null,"work_id":"87f098b3-cc54-42a8-aeec-697fb3996a73","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2504.15643","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:14701e2e6e3ed7e987dd7c20c2b18707d025e183076c3902cdc4df460685a76f","observation_id":"8335ecdc-9976-4a4f-b229-a6f5c42fb703","resolution":{"observed_at":"2026-06-29T11:53:23.902469Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"ACM Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:5c76d2d848645fc4675e335a265e7a22b781d530096c5c1a52b79e1f3176a58c","observation_id":"e9748a13-5e81-4811-b43e-fad0a872c987","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15876","last_updated":"2022-11-29T02:29:35Z","snapshot_observed_at":"2026-08-16T16:12:35.480055Z","submitted_at":"2022-11-29T02:29:35Z","title":"Instance-Specific Image Goal Navigation: Training Embodied Agents to Find Object Instances","version":1},"cited_work":{"arxiv_id":"2211.15876","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.15876","snapshot_observed_at":"2026-06-30T05:54:18.824558Z","title":"arXiv preprint arXiv:2211.15876 (2022)","venue":null,"work_id":"6fc37ac0-f258-471e-a427-5b76dbd7a29d","year":2022},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2211.15876","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:536fff9c216bf36a159f786326ce8fb9a97261fdc019b98bba9f42ec9761c3b2","observation_id":"baa6b37a-d6e7-496e-bc53-404784ea0511","resolution":{"observed_at":"2026-06-29T11:53:23.895635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: European Confer- ence on Computer Vision","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:646b4d4eab8fd9fdb3baad8326da7b7c11353c6f53d1f62e9ab37798d3d3671e","observation_id":"5112448e-5f38-4f31-97fb-3b93bb89338a","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing (EMNLP)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:38ab9f05bd6d8b029f3c226fdaa06fc525af1b5fd2f17ff93dabf5f38bcc76cf","observation_id":"19a9e073-7ed8-4053-873c-a1da4f48a93d","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.19021","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:49.356120Z","title":"Vlnverse: A benchmark for vision-language navigation with versatile, embodied, realistic simulation and evaluation","venue":null,"work_id":"ee18b792-428c-4ab3-9774-c99e1aeb798e","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:968bf101e717d27d1c2d6a873030e835485219357e0a40f360d2080139995ca2","observation_id":"a88b3dfc-4961-470a-a07f-4282b6b0fe9f","resolution":{"observed_at":"2026-06-29T11:53:23.895192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:b0243a1afb8e3b3b27b84eb0bd50f2f8f19675afa5f10e1be6b1479d808d8f79","observation_id":"7a2f3976-a39f-4d91-a2f7-32b0d606d86c","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04882","last_updated":"2024-06-07T12:26:34Z","snapshot_observed_at":"2026-08-16T13:45:10.310910Z","submitted_at":"2024-06-07T12:26:34Z","title":"InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment","version":1},"cited_work":{"arxiv_id":"2406.04882","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04882","snapshot_observed_at":"2026-07-04T16:59:58.820576Z","title":"Instructnav: Zero-shot system for generic instruction navigation in unexplored environment","venue":null,"work_id":"163a5740-30e3-4ba4-a130-8dd5e26c10e7","year":2024},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2406.04882","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:5905961c87229dabbbedc80fa84165416fe35004560cb140109fcfef4ef47df1","observation_id":"5a9badb4-99cf-40cd-aea5-36813081ea58","resolution":{"observed_at":"2026-06-29T11:53:23.897545Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.21307","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:49.313248Z","title":"Towards physically executable 3d gaussian for embodied navigation","venue":null,"work_id":"8907c1bc-b2ce-4663-9106-6704204ecb90","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:e744815b7d62663d9b05e0e9a35551a0035ef5aa3d148774ad96cdb7de34f0d5","observation_id":"44b8caac-6e47-4989-905c-83269dab5f3d","resolution":{"observed_at":"2026-06-29T11:53:23.884747Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:54ea1c369853d5b5aedcab85b03220e3abcbae32964e2c6102c4f863b3de9c6f","observation_id":"5aca7b11-756a-409a-9841-9fa149c0bb31","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14846","last_updated":"2023-10-24T06:16:43Z","snapshot_observed_at":"2026-08-16T15:21:01.661105Z","submitted_at":"2023-06-26T16:57:03Z","title":"ViNT: A Foundation Model for Visual Navigation","version":2},"cited_work":{"arxiv_id":"2306.14846","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.14846","snapshot_observed_at":"2026-07-04T21:10:08.552638Z","title":"ViNT: A foundation model for visual navigation","venue":null,"work_id":"41c011a1-665d-4cf7-a0d9-59604241df87","year":2023},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2306.14846","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:d55fa8629ba26730cd2f55581f96cf430c5faf2a3201d14463a6a6b425390e93","observation_id":"657cc18f-a988-48ed-b808-8972ceb6515b","resolution":{"observed_at":"2026-06-29T11:53:23.879641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":"2507.01006","doi":"10.48550/arxiv.2507.01006","metadata_source":"pith","pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","venue":"cs.CV","work_id":"366607ba-e4ea-4726-98c3-63356e32351c","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:de3be40a5c132e78b4d7c2be476d1e6f667f02fc2f6776af9b42e4a467c5d830","observation_id":"8e426974-96e3-4b4d-bda3-51ad3db8a631","resolution":{"observed_at":"2026-06-29T11:53:23.877292Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:38:13.144769+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:38:13.144769+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:6be93af4e890ec3107239dda1e2763b44b586436402107091592fdd9d3e7335e","observation_id":"ad39a2d3-0c0b-49de-b261-d757da777972","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16755","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:53:23.872575Z","title":null,"venue":null,"work_id":"541ff977-6f03-451b-8cda-c4d00bcdb6a1","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:415b189afa11fab4f9f95693b344e98ccf1eea511b1a07fe945f9aadf7252b22","observation_id":"1bc92d6d-f7bc-4b7d-83c8-aedf155014c5","resolution":{"observed_at":"2026-06-29T11:53:23.873798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":"2508.18265","doi":"10.48550/arxiv.2508.18265","metadata_source":"pith","pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","venue":"cs.CV","work_id":"b8f5e260-fff5-444e-bcf5-2c42cfefd83d","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:30aa795f36faea368c1f09bc37c93b4fe06d9c3913be6bec815ad252942eca6b","observation_id":"0f1f6cfb-c00f-4d34-9e26-3807f79df4d1","resolution":{"observed_at":"2026-06-29T11:53:23.879717Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:38:12.771444+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:38:12.771444+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:85792312c60b3b60288e5b72f35467a50b1613abf822550b9e27847742bb35fe","observation_id":"14753d0b-094a-4ce5-bf62-c4aaf0e1f528","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.08186","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:49.061789Z","title":"Available: https://arxiv.org/abs/2512.08186","venue":null,"work_id":"bb9f5bf8-8d63-4d67-9cc2-7f0fe65b4ade","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:318ace6fe0418bd626d1bb5d42f61857cc5b08fce0880db856ba002c0a0b4269","observation_id":"c3e48b24-a96e-4c45-87e4-d7c07629620a","resolution":{"observed_at":"2026-06-29T11:53:23.904733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-18T02:14:46.902275Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"cited_work":{"arxiv_id":"2507.05240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.05240","snapshot_observed_at":"2026-07-11T02:27:48.997495Z","title":"Streamvln: Streaming vision-and- language navigation via slowfast context modeling","venue":"cs.RO","work_id":"ec969c94-54ed-47a7-8dd3-a07cd132485e","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2507.05240","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:f2695e8ec07065f7133796d85ae39b970aa6a9d21d755d9e87cab94b2a4d9120","observation_id":"09c6ba14-c83e-48a0-9560-839fbac711df","resolution":{"observed_at":"2026-07-10T01:18:45.609520Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00357","last_updated":"2020-01-20T04:18:58Z","snapshot_observed_at":"2026-08-14T00:24:58.794756Z","submitted_at":"2019-11-01T13:07:37Z","title":"DD-PPO: Learning Near-Perfect PointGoal Navigators from 2.5 Billion Frames","version":2},"cited_work":{"arxiv_id":"1911.00357","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1911.00357","snapshot_observed_at":"2026-07-04T16:59:58.769476Z","title":"Decentralized distributed PPO: solving pointgoal navigation","venue":null,"work_id":"7170e982-3143-4286-a431-71793e679d9a","year":1911},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/1911.00357","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:59c834212d1dcd70b32f68ce40d771155984997815d170c47cb1ce3ce33a2cdc","observation_id":"90cef4f3-fec8-4ace-aa3b-01c95a7f32f2","resolution":{"observed_at":"2026-06-29T11:53:23.921783Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T21:07:24.202581Z","title":"Omninav: A unified framework for prospective exploration and visual-language navigation","venue":null,"work_id":"3dab4811-a369-4aed-9612-71d164d55fb2","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:a1b53b19a6f44fc0b72dc2b8476390aaab3d2ae8cd80cdf89d796b988932035c","observation_id":"16062af1-2752-4d3f-9bf0-4fe101ebcd20","resolution":{"observed_at":"2026-06-29T11:53:23.893040Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: 2024 IEEE International Con- ference on Robotics and Automation (ICRA)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:39a0c4c8b3a090a8c50d97c48e1d8139f76e84cc61915270119acd54a756b438","observation_id":"5cc5ff67-2f42-4831-8ca7-abbbd894da28","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:8cefd626dfdccb230a3ac96add8d6b47909e118380c7a4784e824cc93a486fe3","observation_id":"a26eb656-702c-4d41-81cc-3a0602ec9878","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.12129","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:49.210222Z","title":"Embodied navigation foundation model","venue":null,"work_id":"12f41b76-9aed-4727-a532-07029f19a43c","year":2025},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:b9a6b29528459ae336a0000226310ccff1f202ce32652c5cbc7b8809d45629d9","observation_id":"0c11995f-7e9f-47c3-bf1a-027e0e5379e4","resolution":{"observed_at":"2026-06-29T11:53:23.900165Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06224","last_updated":"2025-02-06T10:14:36Z","snapshot_observed_at":"2026-08-16T16:28:01.153501Z","submitted_at":"2024-12-09T05:55:55Z","title":"Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks","version":2},"cited_work":{"arxiv_id":"2412.06224","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06224","snapshot_observed_at":"2026-07-11T02:27:49.380331Z","title":"Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks","venue":"cs.RO","work_id":"13512be0-3aa0-406d-8602-a0edc0286028","year":2024},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"cited_paper":"/paper/2412.06224","citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:13e350521d134c0ba7f9d178ee709eba3c9e46227d953cb193ef6789e8dcbef8","observation_id":"c1a02638-f573-4a37-af8a-b164e7079bf8","resolution":{"observed_at":"2026-06-29T11:53:23.897932Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:c7ef8e20cfd1ad979dda99aaffb666280e79a34bd9b91520f49f62ed6288920d","observation_id":"c0c1d96d-0300-4553-a3be-1400d7eda5c7","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.06427","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:53:23.908266Z","title":null,"venue":null,"work_id":"185c94f2-7144-4e1e-986e-2c8802c8fd03","year":2026},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:6560dd49463e1d91cc27041a0c61fc551995a612cc81b110455e9e0d496b0742","observation_id":"503429d4-ca0e-4bff-bd9d-cb2273c0075e","resolution":{"observed_at":"2026-06-29T11:53:23.909852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T11:48:14.888295Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:14.888295Z"},"links":{"citing_paper":"/paper/2605.28237"},"observation_digest":"sha256:4c31b22e62e6962a39199fc3f5a14abd17c014670dd2b0fc1ffd6cb89a6ea53b","observation_id":"7e579b3e-c910-40d1-b1ec-505151b72c3a","resolution":{"observed_at":"2026-06-29T11:48:14.888295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.28237","last_updated":"2026-05-27T09:50:16Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T23:55:29.770936Z","submitted_at":"2026-05-27T09:50:16Z","title":"POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":11,"parse_uncertain":0,"unresolved":13,"verified_exact":15,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 4 inbound Pith citation observations for arXiv:2605.28237."}