{"as_of":"2026-08-12T10:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6816762aa6110aacbf439420608bbb5d8e827c44b8f9697ab55a22eba4ca16e6","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T04:46:03.020800Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T00:30:53.972225Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.22816","snapshot_observed_at":"2026-08-02T00:30:53.972225Z","title":"AwareVLN: Reasoning with self-awareness for vision-language navigation.arXiv preprint arXiv:2605.22816, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15004","last_updated":"2026-07-16T13:52:08Z","snapshot_observed_at":"2026-08-02T00:30:51.207475Z","submitted_at":"2026-07-16T13:52:08Z","title":"CosFly-VLA: A Spatially Aware Vision-Language-Action Model for UAV Tracking","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T00:30:53.972225Z"},"links":{"cited_paper":"/paper/2605.22816","citing_paper":"/paper/2607.15004"},"observation_digest":"sha256:fd90ec8eab38ed600590963c0ec407d31e1c5abc626b1c8120e89e362b21cb5c","observation_id":"dfc96182-3778-4438-80e0-6e96e4aaae77","resolution":{"observed_at":"2026-08-02T00:30:53.972225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.22816/citation-record","integrity":"/paper/2605.22816/integrity","json":"/paper/2605.22816/citation-record.json","paper":"/paper/2605.22816"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bevbert: Multimodal map pre-training for language-guided navigation","venue":null,"work_id":"efaddf19-00dd-4fb2-af49-85febed557d3","year":2022},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:0550b2e2f07bf54899ef1f318c57f78b0b741923066e41cff95668f60851ce53","observation_id":"e6d2f198-dbe7-4194-adac-4ecadfcac18f","resolution":{"observed_at":"2026-05-22T04:46:05.059909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1st place so- lutions for rxr-habitat vision-and-language navigation com- petition (cvpr 2022)","venue":null,"work_id":"77c50c2d-a669-419e-9daa-cc044826a992","year":2022},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:0ccae6bce9722592a202b2133a327531db445c35d132e691a1ea9e9e5fe49530","observation_id":"8186c9bc-05a4-4f68-9503-6031a5808e65","resolution":{"observed_at":"2026-05-22T04:46:05.113284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Etpnav: Evolving topo- logical planning for vision-language navigation in continu- ous environments.IEEE Transactions on Pattern Analysis and Machine Intelligence","venue":null,"work_id":"15ac4741-3bb4-46cc-84dd-e54600304af9","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:7a927f6152ec3754930416f8ad09119263bf5093e09b5663f90fe3ebdbd531d1","observation_id":"699a5abb-f389-4291-b5f8-8be72a749eac","resolution":{"observed_at":"2026-05-22T04:46:05.063270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.06757","last_updated":"2018-07-18T03:28:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-07-18T03:28:02Z","title":"On Evaluation of Embodied Navigation Agents","version":1},"cited_work":{"arxiv_id":"1807.06757","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.06757","snapshot_observed_at":"2026-07-04T09:09:43.494441Z","title":"On Evaluation of Embodied Navigation Agents","venue":"cs.AI","work_id":"3b074aa9-2ff9-4ad6-8796-6a25689ecfd3","year":2018},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/1807.06757","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:cdb019f0b0f27174bbfae1b3187a1412fd66805ac08fab6080c12e7020388417","observation_id":"ebb697a6-b348-40dc-9333-05440049e02b","resolution":{"observed_at":"2026-05-22T04:46:04.584538Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision-and-language navigation: In- terpreting visually-grounded navigation instructions in real environments","venue":null,"work_id":"769b623e-02bf-4f86-9a35-75ddd190a566","year":null},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:170e5554a72a008655f7d9182ae065405bb7a9613c240fab8f55c40ab248fb72","observation_id":"dda6a7e9-9343-4262-aca6-5b94af8b6a42","resolution":{"observed_at":"2026-05-22T04:46:05.067491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01823","last_updated":"2024-06-01T01:54:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-04T08:16:11Z","title":"RT-H: Action Hierarchies Using Language","version":2},"cited_work":{"arxiv_id":"2403.01823","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.01823","snapshot_observed_at":"2026-07-10T14:37:16.092859Z","title":"RT-H: Action Hierarchies Using Language","venue":"cs.RO","work_id":"ecf7cf18-c1a8-4a6b-bc2a-fb165643aa0d","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2403.01823","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:b2b85f293677f6c25ffcba2dc0eb6c9b5bec2f2513b2c231626de00883bb3177","observation_id":"edb0deb1-e9ee-4cb6-9e2e-27060b75b830","resolution":{"observed_at":"2026-05-22T04:46:04.537564Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Matterport3d: Learning from rgb-d data in indoor environments.3DV","venue":null,"work_id":"3e753884-399a-4644-855d-a25fa5c16601","year":2017},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:2e851caff7912af2b09e5cc7a1cee7bcd9fb918a97219d0722515ec972494391","observation_id":"4505b0f1-72c5-4f90-91a8-ecdbc036c0e2","resolution":{"observed_at":"2026-05-22T04:46:05.128395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object goal naviga- tion using goal-oriented semantic exploration","venue":null,"work_id":"37392ebe-6799-4bd1-93b0-bf6587ff7546","year":2020},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:3c2cf0a281d7a611bb437710428c7103d4b3387db77915dce6fa988ad8acfd6c","observation_id":"892cc9c5-a117-4872-9a48-a939f5fecce5","resolution":{"observed_at":"2026-05-22T04:46:05.109647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Affordances-oriented planning using foundation models for continuous vision- language navigation","venue":null,"work_id":"dd7e1c76-6393-440a-85c6-bf465fe6a1da","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:3a8069c203cbad281b711ec6e1ed0a22649f967e0689b937d623e39378c81f7f","observation_id":"d7205c7c-6876-465a-ae9a-310386ef4c43","resolution":{"observed_at":"2026-05-22T04:46:05.157283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Topological planning with transform- ers for vision-and-language navigation","venue":null,"work_id":"5b065cb8-3cb6-42f0-93bf-1fffa1bde9d8","year":2021},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:40667a6c1e5cba0f9d0c3218b41eeba2e5d71fdde891f20f78b7b059a0580528","observation_id":"eea711d6-b72c-406c-95fb-d30c8e7ece70","resolution":{"observed_at":"2026-05-22T04:46:05.160530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07506","last_updated":"2022-10-14T04:23:27Z","snapshot_observed_at":"2026-08-10T20:47:43.195852Z","submitted_at":"2022-10-14T04:23:27Z","title":"Weakly-Supervised Multi-Granularity Map Learning for Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":"2210.07506","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.07506","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Weakly- supervised multi-granularity map learning for vision-and- language navigation.arXiv preprint arXiv:2210.07506","venue":null,"work_id":"ea70dfd8-1f06-41be-a7b3-d92bce492abc","year":2022},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2210.07506","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:f87ccba6505485f11460613e45503e96cb73fd28ac128ce7486ac1066aaa0a1a","observation_id":"6f560508-131f-42c6-a24d-170b3f9b5cae","resolution":{"observed_at":"2026-05-22T04:46:04.495232Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07997","last_updated":"2023-08-15T19:01:19Z","snapshot_observed_at":"2026-08-06T03:03:10.665669Z","submitted_at":"2023-08-15T19:01:19Z","title":"$A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models","version":1},"cited_work":{"arxiv_id":"2308.07997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.07997","snapshot_observed_at":"2026-07-03T04:47:38.680188Z","title":"a2nav: Action-aware zero-shot robot navigation by exploit- ing vision-and-language ability of foundation models","venue":null,"work_id":"168af3cb-b624-4d53-9927-6428593b52bc","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2308.07997","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:a1b4a8371f7a35e2aeb85cd218533af6f0f04c0ab60c92f4c4cfb229d046c90c","observation_id":"a7d11f88-d4fd-4bce-93c9-5fddcb0893e1","resolution":{"observed_at":"2026-05-22T04:46:04.595494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04453","last_updated":"2025-02-17T18:27:27Z","snapshot_observed_at":"2026-08-11T21:21:36.601778Z","submitted_at":"2024-12-05T18:58:17Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Navigation","version":2},"cited_work":{"arxiv_id":"2412.04453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04453","snapshot_observed_at":"2026-07-04T09:09:43.511252Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Naviga- tion","venue":null,"work_id":"f57eed5a-690c-4e1f-8832-41c0fa16ce05","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2412.04453","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:24102ddef155bd9b1b62ddd09c5c7e85c1a5b0975644a48e8ea88168933c35c6","observation_id":"2120b067-32a6-4a06-8585-b872eaeb6435","resolution":{"observed_at":"2026-05-22T04:46:04.562531Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning universal policies via text-guided video genera- tion.Advances in neural information processing systems, 36:9156–9172","venue":null,"work_id":"a6c35cec-bf35-45a7-81ab-c00456608800","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:b9741f9d9acc115de242cf6f2316fafbe3f3b0f1a0f4e88a83650dac47b59a91","observation_id":"41058075-bcbf-4a78-9c25-1dada1c18bc0","resolution":{"observed_at":"2026-05-22T04:46:05.144290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08261","last_updated":"2025-02-16T03:13:51Z","snapshot_observed_at":"2026-08-11T17:58:47.515554Z","submitted_at":"2024-12-11T10:17:00Z","title":"FLIP: Flow-Centric Generative Planning as General-Purpose Manipulation World Model","version":2},"cited_work":{"arxiv_id":"2412.08261","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08261","snapshot_observed_at":"2026-07-04T13:39:51.163883Z","title":"Flip: Flow-centric generative planning as general-purpose manipulation world model","venue":null,"work_id":"339ba8ff-0845-4be8-8f61-865696fae960","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2412.08261","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:1a500b6f16b378831bfd68d35dcb1529dc2928e14aa7b7b9bfc65d5bd56a227d","observation_id":"c76a6c9c-d031-4371-b704-dc4162fdc671","resolution":{"observed_at":"2026-05-22T04:46:04.489225Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09839","last_updated":"2025-06-11T15:15:17Z","snapshot_observed_at":"2026-08-07T23:59:45.702444Z","submitted_at":"2025-06-11T15:15:17Z","title":"OctoNav: Towards Generalist Embodied Navigation","version":1},"cited_work":{"arxiv_id":"2506.09839","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09839","snapshot_observed_at":"2026-07-02T03:36:30.079609Z","title":"arXiv preprint arXiv:2506.09839 , year=","venue":null,"work_id":"4eccfbd9-d98f-4e9d-9003-4d7f30160283","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2506.09839","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:e964f76023cb426dda7fb0034ead2e9fad5e0b5e8402de26cac488a9df48855b","observation_id":"7c76c7cd-a72b-4c66-a072-775f977ba613","resolution":{"observed_at":"2026-05-22T04:46:04.580136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17561","last_updated":"2025-06-21T03:07:48Z","snapshot_observed_at":"2026-08-10T20:46:45.924039Z","submitted_at":"2025-06-21T03:07:48Z","title":"VLA-OS: Structuring and Dissecting Planning Representations and Paradigms in Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":"2506.17561","doi":"10.48550/arxiv.2506.17561","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vla-os: Structuring and dissecting planning representations and paradigms in vision-language- action models","venue":"arXiv (Cornell University)","work_id":"2f6a2ca4-9b17-4e04-9fd2-2bda1ec1519b","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2506.17561","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:046312825f767b2c8db8b8114dfdc4124065218a1c5647daaa9bf6fa00579f87","observation_id":"d7a4b6d9-4f86-46a6-bb5b-8b5e954b8d57","resolution":{"observed_at":"2026-05-22T04:46:04.519797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-modal map learning for vision and language navigation","venue":null,"work_id":"ca6054ee-597e-4c79-afac-2284ce40bba7","year":2022},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:2ef454929e32c7a44fdb16cd470c6b7f3c91f14ded6a0453855da25761c54097","observation_id":"0809e1ba-4f10-4929-8a6d-e002a2a6990d","resolution":{"observed_at":"2026-05-22T04:46:05.125774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridg- ing the gap between learning in discrete and continuous en- vironments for vision-and-language navigation","venue":null,"work_id":"f8506ff6-d9a3-44e1-b8a0-1da0ce828095","year":2022},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:0c6c50938295887490308b8750d8bad2002a87327bdfe882b2312f1ec2ea0439","observation_id":"581958ed-c548-48f7-8cee-3216a5ea68a0","resolution":{"observed_at":"2026-05-22T04:46:05.071811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning navigational visual representations with semantic map su- pervision","venue":null,"work_id":"2654e00f-6d70-44e4-9c70-4e30c4b16a08","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:4030012674405fa4afde3747d89317bc92548e7606b2fb751945c3318a92dd7a","observation_id":"947f2da4-d25b-42bb-8418-0b42aefce8d4","resolution":{"observed_at":"2026-05-22T04:46:05.082265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05446","last_updated":"2019-11-28T16:59:52Z","snapshot_observed_at":"2026-08-12T02:26:15.793843Z","submitted_at":"2019-07-11T18:42:03Z","title":"General Evaluation for Instruction Conditioned Navigation using Dynamic Time Warping","version":2},"cited_work":{"arxiv_id":"1907.05446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.05446","snapshot_observed_at":"2026-06-30T14:04:45.358650Z","title":"General evaluation for instruction con- ditioned navigation using dynamic time warping","venue":null,"work_id":"71d39e47-7694-4bd6-85cc-3d0b11439736","year":2019},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/1907.05446","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:d6ef8b97bc4a1a0eb36f201990ab7ab338e63da77d818b57e609b167ca70ce65","observation_id":"af2250b1-ef25-45e8-ad65-c7c28121e99e","resolution":{"observed_at":"2026-05-22T04:46:04.501339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robobrain: A unified brain model for robotic manipulation from abstract to concrete","venue":null,"work_id":"2165038b-4dc6-4612-acf8-a44e6bf407fc","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:c4ab98509d1015fb650cf22959ee6aead5b4d18874b0c3b28b862744f86c8672","observation_id":"a3465eff-ed0c-43bf-952c-9130d8632ef7","resolution":{"observed_at":"2026-05-22T04:46:05.106551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sim-2-sim transfer for vision- and-language navigation in continuous environments","venue":null,"work_id":"4b3dd137-45c5-4c3f-95a2-802d4d84421a","year":2022},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:2a47a4e125375f87899374b62f23b4da631b1da31d6328e4cd1fa286306443fd","observation_id":"9d408783-900b-4827-a7d7-be404d7e0699","resolution":{"observed_at":"2026-05-22T04:46:05.052944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beyond the nav-graph: Vision and language navigation in continuous environments","venue":null,"work_id":"0522390c-05ff-454c-aac3-4f69e237ac0e","year":2020},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:31ca069f1286192bf033cfa1f0cb10cced34c00065dd07a346197625ff614bdf","observation_id":"09fcebb2-f0bd-4ed5-a18a-defc949d6098","resolution":{"observed_at":"2026-05-22T04:46:05.056625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Waypoint models for instruction- guided navigation in continuous environments","venue":null,"work_id":"1c05b24d-6b26-4296-9c9f-cc31e1106999","year":2021},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:d6c11cf1c43ff79a45a8a9daea0aca95852a30eb4d472847fd6fc770ae2a1e25","observation_id":"56229615-dd55-41dd-aba0-a73598ed21c2","resolution":{"observed_at":"2026-05-22T04:46:05.075633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Room-across-room: Multilingual vision- and-language navigation with dense spatiotemporal ground- ing","venue":null,"work_id":"3e1ff34e-20d9-4615-849a-4f8be995caad","year":2020},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:d7e95eccfdd28b7def4d0e915d3934b26eb1b212fa27516a4899ea6e48722a9b","observation_id":"11c05d4f-626b-4af1-ba7f-57be99b87fc2","resolution":{"observed_at":"2026-05-22T04:46:05.140847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.11917","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T03:06:43.707322Z","title":"Onetwovla: A unified vision-language-action model with adaptive reasoning","venue":null,"work_id":"97bcd591-f890-454c-94ea-62b1d81cf31e","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:cd7df50f542e7f0222827fd8a29fe1fda35fdbb5755cf78860a1006e29454271","observation_id":"302351a1-f47c-48d5-8938-523d458b0480","resolution":{"observed_at":"2026-05-22T04:46:04.513621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10884","last_updated":"2025-09-13T16:31:03Z","snapshot_observed_at":"2026-08-10T03:00:31.416194Z","submitted_at":"2025-09-13T16:31:03Z","title":"Nav-R1: Reasoning and Navigation in Embodied Scenes","version":1},"cited_work":{"arxiv_id":"2509.10884","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10884","snapshot_observed_at":"2026-07-04T10:39:45.302935Z","title":"Nav-r1: Reasoning and navigation in embodied scenes","venue":null,"work_id":"bad70f4d-e39b-4222-93b8-ddeb973b2e9b","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2509.10884","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:23a9743dcab0c3459021f1b617580593dce3adc3a6afaf912fa68e71d2d9cba4","observation_id":"fda16bb8-09bf-4837-98ef-0e06788b4967","resolution":{"observed_at":"2026-05-22T04:46:04.556035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bird’s-eye-view scene graph for vision-language navigation","venue":null,"work_id":"cd4ca239-cf6c-47d4-a679-d8320d126854","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:0c3211c6c20f20b6ffa40e86b598d4cd92b8dac9edf41e4a823a66acab3151ce","observation_id":"c77b0a6a-cb6c-4ab2-a815-44d30acfd687","resolution":{"observed_at":"2026-05-22T04:46:05.116506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dis- cuss before moving: Visual language navigation via multi- expert discussions","venue":null,"work_id":"1ad8c401-49fe-4763-9fa0-65ed12250530","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:11da09a2ca3cb2663f82d4e39b65fa8c7bcbd114ff5cb846a1a0eef7fc28b88a","observation_id":"fb21af81-e66d-4377-b40d-b325c2858881","resolution":{"observed_at":"2026-05-22T04:46:05.119646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rt-affordance: Affordances are versatile intermediate rep- resentations for robot manipulation","venue":null,"work_id":"b28eeadd-6786-42f7-9920-a8ddc52e5ead","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:23393b401ff906b8309edba8d22f44e811beaf26fb48c55a98715357ac3d7baf","observation_id":"8ea6b500-6628-44aa-9cde-19551c7b3b51","resolution":{"observed_at":"2026-05-22T04:46:05.122790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-06T23:28:19.444744Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:d09b91c34fd78dc613e95012101af1c821043335f48c49e1bc8e2579bb233fef","observation_id":"0ce6c4d5-b991-4c1b-a393-9f1103944045","resolution":{"observed_at":"2026-05-22T04:46:04.568388Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language-aligned waypoint (law) super- vision for vision-and-language navigation in continuous en- vironments","venue":null,"work_id":"6c0758d7-9a2c-407c-aacb-319d98331f93","year":2021},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:fee00eee9ef653efb78451b3fbbfe4df1d345426a33688a8a21ee5f3c2c97e18","observation_id":"665f839b-6641-4fc4-b172-17863bd52b04","resolution":{"observed_at":"2026-05-22T04:46:05.099902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05996","last_updated":"2024-07-08T14:46:44Z","snapshot_observed_at":"2026-08-10T20:47:29.627562Z","submitted_at":"2024-07-08T14:46:44Z","title":"Multimodal Diffusion Transformer: Learning Versatile Behavior from Multimodal Goals","version":1},"cited_work":{"arxiv_id":"2407.05996","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.05996","snapshot_observed_at":"2026-07-04T13:09:50.161878Z","title":"Multimodal diffusion transformer: Learning versatile behavior from multimodal goals","venue":null,"work_id":"988b5d0d-a604-46c5-8d86-72a48f501f25","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2407.05996","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:09c1d992c122b5be815c5dce61755c04997420deaf44bef7985833ee648efd3e","observation_id":"685b7205-5126-4cb6-b2cb-1f1abe86f475","resolution":{"observed_at":"2026-05-22T04:46:04.600695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Habitat: A platform for embodied ai research","venue":null,"work_id":"7a9ba688-da29-41da-b791-afa38208a9b8","year":2019},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:2ec05f36375533d34e2aa6b38c26ad70a17453c6f28684a429b66ff0db39cb29","observation_id":"928f8690-1ae3-4010-ae78-dd6d9ac3b8cb","resolution":{"observed_at":"2026-05-22T04:46:05.137637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19417","last_updated":"2025-07-15T17:44:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T18:58:41Z","title":"Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":"2502.19417","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.19417","snapshot_observed_at":"2026-07-10T04:16:48.655148Z","title":"Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models","venue":"cs.RO","work_id":"5fa4c212-9ac8-4c92-95ee-879621fbcb2e","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2502.19417","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:b2843ff4e86be25bd5bd66a88152a9d4866b2299a00e42ba39cd0f27ff26d6fe","observation_id":"68737d5f-53ef-4b44-a07f-3738098b9817","resolution":{"observed_at":"2026-05-22T04:46:04.531661Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15109","last_updated":"2024-12-19T17:52:50Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:52:50Z","title":"Predictive Inverse Dynamics Models are Scalable Learners for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2412.15109","doi":"10.48550/arxiv.2412.15109","metadata_source":"pith","pith_arxiv_id":"2412.15109","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Predictive Inverse Dynamics Models are Scalable Learners for Robotic Manipulation","venue":"cs.RO","work_id":"50911eef-b866-4e23-b501-1b4c4bfd1a78","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2412.15109","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:5f42b545e2439da45f4e610580c12b39b7e6786f8c0ad7a21aecf0c3c3ab2cf5","observation_id":"eece47ac-4fff-45f8-8a78-72074edc6ee4","resolution":{"observed_at":"2026-05-22T14:38:25.165602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamwalker: Mental planning for contin- uous vision-language navigation","venue":null,"work_id":"1c9cc1fb-a581-41ac-b528-bbd51c41c2aa","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:decf3730720d35b02d1e0ebf7c82600a22005b8a72f2ccbcd47d02d292959c7b","observation_id":"40a22603-89fd-4471-9d87-286a1c22c38b","resolution":{"observed_at":"2026-05-22T04:46:05.092805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:a6bbbf94890467fdc64130730a9e325840eff4d1e40ef224b9521eb264c84882","observation_id":"20316ea6-0082-4924-8bef-599d06814739","resolution":{"observed_at":"2026-05-22T04:46:04.573900Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling data generation in vision-and-language navigation","venue":null,"work_id":"e6ab08c9-14d7-45cc-910a-80b6165e7679","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:81cef912b80b18194cec9f86a74bd57d97178fec339a2e52b331c29cdce9cfdc","observation_id":"d57f819d-65b9-4245-9f60-547f5136b448","resolution":{"observed_at":"2026-05-22T04:46:05.150586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gridmm: Grid memory map for vision- and-language navigation","venue":null,"work_id":"93d51265-5ed7-49cd-90a1-97898fa6fcfe","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:34cba7df0934cd406399b3abd98fc7ec4daad2eabf10eaca922dfad1682f9761","observation_id":"5c8b67ff-6f7c-4040-9a5b-48b0cf421cfa","resolution":{"observed_at":"2026-05-22T04:46:05.153491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lookahead exploration with neural radiance representation for continuous vision- language navigation","venue":null,"work_id":"1c5c3b85-7218-4050-abab-78262b879695","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:af0a54adb3ca4f6f23bc3ec3bb97c175ff70954740dcb29630620f526e2e2ada","observation_id":"5ed049f4-8bde-4fec-903d-b4d81db0e2e1","resolution":{"observed_at":"2026-05-22T04:46:05.147514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lookahead exploration with neural radiance representation for continuous vision- language navigation","venue":null,"work_id":"dbc1c5ad-0d11-48e8-a05f-a35261f7790f","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:8b8e315575103b7cdd6016483526e7031c30f9366226d068c67e1517e7e4200d","observation_id":"55e1eabe-9bb0-488f-9ab8-ca85230911f0","resolution":{"observed_at":"2026-05-22T04:46:05.089672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chain-of-thought prompting elicits reasoning in large lan- guage models.Advances in neural information processing systems, 35:24824–24837","venue":null,"work_id":"cd0f84da-6c10-4807-9c71-e2ed5b666da5","year":2022},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:f7861415ef7dd8236d31bed1647174a8a75e50a60175d196d888fea2aa487daf","observation_id":"1bbc662c-9436-4678-b822-7f7926c4fcc6","resolution":{"observed_at":"2026-05-22T04:46:05.096534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-06T19:26:50.907830Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"cited_work":{"arxiv_id":"2507.05240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.05240","snapshot_observed_at":"2026-07-11T02:27:48.997495Z","title":"Streamvln: Streaming vision-and- language navigation via slowfast context modeling","venue":"cs.RO","work_id":"ec969c94-54ed-47a7-8dd3-a07cd132485e","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2507.05240","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:d6ed31d720273d3f538fd6570f288ddcb4fa3b7cc3799403abae33c63c98af69","observation_id":"134d7494-b0f0-4396-bf3e-498cb0861b5b","resolution":{"observed_at":"2026-07-10T01:18:45.609520Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":"2401.00025","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-07-10T18:47:31.639635Z","title":"Any-point Trajectory Modeling for Policy Learning","venue":"cs.RO","work_id":"0c843c6a-ce05-4ca4-992b-e25516f490db","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:5b0b53950586593c7b0f503f9dc6708c725bb58149c73c3958a001cf62196063","observation_id":"fcc3dab5-a1c7-4a4e-b1f7-4001c3a5b830","resolution":{"observed_at":"2026-05-22T04:46:04.525691Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05855","last_updated":"2025-08-09T10:58:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-09T11:25:56Z","title":"DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control","version":3},"cited_work":{"arxiv_id":"2502.05855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05855","snapshot_observed_at":"2026-07-10T04:16:48.719609Z","title":"DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control","venue":"cs.RO","work_id":"3564a757-5726-4b2a-a28e-114a4a467dfb","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2502.05855","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:60e54e98a995198cc308a93640bad86b5d852d292d930ff4e3af877afce90679","observation_id":"d8639eb4-61cb-46ae-8b52-22f21f54ccb1","resolution":{"observed_at":"2026-05-22T04:46:04.549209Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06114","last_updated":"2024-09-26T17:14:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-09T19:42:22Z","title":"Learning Interactive Real-World Simulators","version":3},"cited_work":{"arxiv_id":"2310.06114","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.06114","snapshot_observed_at":"2026-07-04T17:09:59.117795Z","title":"Learning Interactive Real-World Simulators","venue":"cs.AI","work_id":"16f38691-7ab6-4e23-bba5-6b656579e579","year":2023},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2310.06114","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:676b56b77882e5e02c117eae48e7634aa0104e94532f8d2922a47e607542d182","observation_id":"02b0d59f-7a48-462a-970e-22c96b6d04dd","resolution":{"observed_at":"2026-05-22T04:46:04.481001Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10416","last_updated":"2025-08-14T07:39:26Z","snapshot_observed_at":"2026-08-08T02:28:41.150453Z","submitted_at":"2025-08-14T07:39:26Z","title":"CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model","version":1},"cited_work":{"arxiv_id":"2508.10416","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.10416","snapshot_observed_at":"2026-06-29T19:33:54.614414Z","title":"Correctnav: Self-correction flywheel empowers vision-language-action navigation model","venue":null,"work_id":"87b54dda-42f9-40b9-b86e-8c0d96e8a0d2","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2508.10416","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:e793ef07d4a7074463fe7a92f533d8ab1967a245c749292a74c0fa9b044eb7cc","observation_id":"75e775aa-3980-439d-b79e-0aa6eec4ed1a","resolution":{"observed_at":"2026-05-22T04:46:04.466276Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08693","last_updated":"2025-03-06T19:29:03Z","snapshot_observed_at":"2026-08-07T02:44:43.738657Z","submitted_at":"2024-07-11T17:31:01Z","title":"Robotic Control via Embodied Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":"2407.08693","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.08693","snapshot_observed_at":"2026-07-10T13:37:06.920040Z","title":"Robotic Control via Embodied Chain-of-Thought Reasoning","venue":"cs.RO","work_id":"bbe96698-686e-4b4a-9f7f-ed5054e61cca","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2407.08693","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:db65e12cf648a07d8785b3eaa31dd4bc0ae1e2d988ecf814242d20021d79e3bb","observation_id":"c55ed96a-d93e-47a0-a7b9-e8b90a1349ca","resolution":{"observed_at":"2026-05-22T04:46:04.590180Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Uni-navid: A video-based vision- language-action model for unifying embodied navigation tasks","venue":null,"work_id":"1726b47e-e0a8-4dad-9d09-9b0fe9747fcd","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:3709b9a4d1e8e0df28d91ac226159a28edb8494ad26547fee57b239bda839be6","observation_id":"9676a36a-cd06-4854-bbfd-9a2bd7defbc7","resolution":{"observed_at":"2026-05-22T04:46:05.103248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Navid: Video-based vlm plans the next step for vision-and-language navigation.Robotics: Science and Sys- tems","venue":null,"work_id":"f3ace873-b76b-490f-9dc1-c450b8c79273","year":2024},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:cbb08f6898738d3800293234d5ca18b3f089f052c89ecd27a10dbad59de1de80","observation_id":"87cf9181-3a33-4f2a-aa9c-1032c9697bfb","resolution":{"observed_at":"2026-05-22T04:46:05.131199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cot-vla: Visual chain-of-thought rea- soning for vision-language-action models","venue":null,"work_id":"27779cb7-d82b-4e89-8222-45be03377c24","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:74498edb72b50ee4e7604ff4ac1bd21475a071afc8dece1b797db40bcb50d95d","observation_id":"fd420a47-33ad-4d6e-bbf0-c257ace5e15a","resolution":{"observed_at":"2026-05-22T04:46:05.134631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I see xxx. And I'm in xxx","venue":null,"work_id":"3f80b1d4-8058-46e2-8199-350d782e3db7","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:2c0c361b3fc7bbc75e08720880c9ec005833e0b536f0d9d3c5d6a6efc5dce17f","observation_id":"dc2f9475-1544-41f5-850f-de4fccb0499f","resolution":{"observed_at":"2026-05-22T04:46:05.079023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Our AwareVLN also achieves leading performance under this transfer setting, demonstrating strong robustness","venue":null,"work_id":"e39c3c6b-5d56-408b-98f6-112f4fb8bd2f","year":null},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:52e8f3d5fb84fb163f1ecc4cca012240c1fa7fab7891071472ea1679107a91a1","observation_id":"dcacd5a0-0491-4dc8-9ecd-9f7f26fd6e52","resolution":{"observed_at":"2026-05-22T04:46:05.085799Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":22,"verified_fuzzy":32},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2605.22816."}