{"as_of":"2026-08-08T07:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ec95494d03400eb3e46a49e65057283d8f051f81fbedd8bb998b87b3e67b428","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:51:50.963143Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T07:09:37.364862Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.16986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-07-04T07:09:37.364862Z","title":"NavGPT: Explicit reasoning in vision-and-language navigation with large language models","venue":null,"work_id":"b1fd196b-e0a3-41ee-a446-fd6cb609dcf8","year":2024},"citing_paper":{"arxiv_id":"2401.03568","last_updated":"2024-01-25T21:20:27Z","snapshot_observed_at":"2026-07-30T06:39:40.880794Z","submitted_at":"2024-01-07T19:11:18Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","version":2},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-05-18T14:25:58.876978Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2401.03568"},"observation_digest":"sha256:76e4d268d21b297d6f2cc4a4067dbd9c7a32c3bcf28cdfc84870fcf17c184635","observation_id":"7082600f-ae2b-4568-b8da-8fcb1d8c980f","resolution":{"observed_at":"2026-05-18T14:25:59.318626Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.16986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-07-04T07:09:37.364862Z","title":"NavGPT: Explicit reasoning in vision-and-language navigation with large language models","venue":null,"work_id":"b1fd196b-e0a3-41ee-a446-fd6cb609dcf8","year":2024},"citing_paper":{"arxiv_id":"2402.15852","last_updated":"2024-06-30T11:14:13Z","snapshot_observed_at":"2026-07-06T17:34:57.509162Z","submitted_at":"2024-02-24T16:39:16Z","title":"NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation","version":7},"reference_index":121,"source":"pdf_text","source_observed_at":"2026-05-18T04:55:20.362512Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2402.15852"},"observation_digest":"sha256:4f0ef20342d3680d1145d6482b066726300a4a42f99970e31dc05a4338b80388","observation_id":"ded1a298-dcda-49b3-9238-3e19cb415de0","resolution":{"observed_at":"2026-05-18T04:55:20.565357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.16986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-07-04T07:09:37.364862Z","title":"NavGPT: Explicit reasoning in vision-and-language navigation with large language models","venue":null,"work_id":"b1fd196b-e0a3-41ee-a446-fd6cb609dcf8","year":2024},"citing_paper":{"arxiv_id":"2412.06224","last_updated":"2025-02-06T10:14:36Z","snapshot_observed_at":"2026-08-06T17:32:08.916929Z","submitted_at":"2024-12-09T05:55:55Z","title":"Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks","version":2},"reference_index":121,"source":"pdf_text","source_observed_at":"2026-05-16T19:51:36.137985Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2412.06224"},"observation_digest":"sha256:00e1e32caa97858036335af6ff73c7c76ab48131e45c0b5acf860230589211ec","observation_id":"f2caa80c-0171-4fd1-a0f7-bb98bd334d8c","resolution":{"observed_at":"2026-05-16T19:51:36.388976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-08-06T19:51:50.963143Z","title":"Navgpt: Explicit reasoning in vision-and-language navigation with large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04509","last_updated":"2025-07-06T18:52:16Z","snapshot_observed_at":"2026-08-07T23:08:38.610344Z","submitted_at":"2025-07-06T18:52:16Z","title":"MVL-Loc: Leveraging Vision-Language Model for Generalizable Multi-Scene Camera Relocalization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:51:50.963143Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2507.04509"},"observation_digest":"sha256:f5def470a30176f17a60ac83fb6888d53212e74edd0192afd5dc5e68c1014bf2","observation_id":"11c3bad6-0b8d-4f07-b6de-e5207a512cf4","resolution":{"observed_at":"2026-08-06T19:51:50.963143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-08-06T19:37:05.744748Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-06T19:26:50.907830Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:37:05.744748Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2507.05240"},"observation_digest":"sha256:a96390cdbd65e87c8ca0ea48097b4c3b7e1eb6f0cc27bd951bc2282726431dc1","observation_id":"c91a7d8e-19bf-4711-9c03-293b3c2b4026","resolution":{"observed_at":"2026-08-06T19:37:05.744748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-08-05T18:39:12.470115Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16654","last_updated":"2025-09-10T11:47:41Z","snapshot_observed_at":"2026-08-07T07:41:00.512029Z","submitted_at":"2025-08-20T05:41:22Z","title":"MSNav: Zero-Shot Vision-and-Language Navigation with Dynamic Memory and LLM Spatial Reasoning","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T18:39:12.470115Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2508.16654"},"observation_digest":"sha256:37abadfc105e84eeeed2207f13e55a14995c0dc7468491bbac0c5642965679de","observation_id":"8c135422-e0dd-4747-b58c-1a57e16c7284","resolution":{"observed_at":"2026-08-05T18:39:12.470115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-08-04T17:00:45.037296Z","title":"Navgpt: Explicit reasoning in vision- and-language navigation with large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.11197","last_updated":"2025-09-14T09:54:20Z","snapshot_observed_at":"2026-08-04T17:00:42.809060Z","submitted_at":"2025-09-14T09:54:20Z","title":"DreamNav: A Trajectory-Based Imaginative Framework for Zero-Shot Vision-and-Language Navigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T17:00:45.037296Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2509.11197"},"observation_digest":"sha256:6f26f425d65ebca81881344604175576e29d0a0a41a341fd80a11bc4cfbcc076","observation_id":"f3422f1a-3965-49c3-afdf-8a41250b5b9e","resolution":{"observed_at":"2026-08-04T17:00:45.037296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-08-04T12:37:56.580627Z","title":"Navgpt: Explicit reasoning in vision- and-language navigation with large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.03142","last_updated":"2026-06-29T05:31:52Z","snapshot_observed_at":"2026-08-06T16:54:48.653237Z","submitted_at":"2025-10-03T16:15:09Z","title":"MM-Nav: Multi-View VLA Model for Robust Visual Navigation via Multi-Expert Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T12:37:56.580627Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2510.03142"},"observation_digest":"sha256:95729549330d7936c39f8b76369c9541eac84eb4407b052fa2455ee8a23b319b","observation_id":"0017e3d3-9ebd-477e-9b16-c90f2ae7cbed","resolution":{"observed_at":"2026-08-04T12:37:56.580627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.16986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-07-04T07:09:37.364862Z","title":"NavGPT: Explicit reasoning in vision-and-language navigation with large language models","venue":null,"work_id":"b1fd196b-e0a3-41ee-a446-fd6cb609dcf8","year":2024},"citing_paper":{"arxiv_id":"2512.12177","last_updated":"2025-12-13T04:49:26Z","snapshot_observed_at":"2026-07-06T22:38:54.914862Z","submitted_at":"2025-12-13T04:49:26Z","title":"Floorplan2Guide: LLM-Guided Floorplan Parsing for BLV Indoor Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T23:10:37.814878Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2512.12177"},"observation_digest":"sha256:f0716d5f1d0e8758a6476a0dd63e8843acc0c14fdf7af8c865ca4c3de95dec6b","observation_id":"6799a38b-e08b-432e-bf85-ed461025272c","resolution":{"observed_at":"2026-05-16T23:11:21.132290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-08-02T17:57:56.499039Z","title":"Navgpt: Explicit reasoning in vision- and-language navigation with large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.18271","last_updated":"2026-07-29T12:13:10Z","snapshot_observed_at":"2026-08-08T01:55:19.225646Z","submitted_at":"2026-03-18T20:44:34Z","title":"SG-CoT: An Ambiguity-Aware Robotic Planning Framework using Scene Graph Representations","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T17:57:56.499039Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2603.18271"},"observation_digest":"sha256:a32fdee41dbb2a1726e4409311bd44d7993e481e592c234cdb759d383ee8ea95","observation_id":"1a61d812-a500-4d10-ade0-c502d2c6efc1","resolution":{"observed_at":"2026-08-02T17:57:56.499039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.16986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-07-04T07:09:37.364862Z","title":"NavGPT: Explicit reasoning in vision-and-language navigation with large language models","venue":null,"work_id":"b1fd196b-e0a3-41ee-a446-fd6cb609dcf8","year":2024},"citing_paper":{"arxiv_id":"2604.07973","last_updated":"2026-04-09T08:37:20Z","snapshot_observed_at":"2026-07-06T22:57:09.435331Z","submitted_at":"2026-04-09T08:37:20Z","title":"How Far Are Large Multimodal Models from Human-Level Spatial Action? A Benchmark for Goal-Oriented Embodied Navigation in Urban Airspace","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T18:09:39.510770Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2604.07973"},"observation_digest":"sha256:6e06d01f0d7050839602b38b064c25d4edc1467d8f20e0e429b615c560528524","observation_id":"97343341-7e49-46fa-8f53-2dc94ba54834","resolution":{"observed_at":"2026-05-11T05:25:56.913695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.16986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-07-04T07:09:37.364862Z","title":"NavGPT: Explicit reasoning in vision-and-language navigation with large language models","venue":null,"work_id":"b1fd196b-e0a3-41ee-a446-fd6cb609dcf8","year":2024},"citing_paper":{"arxiv_id":"2605.23771","last_updated":"2026-05-22T15:40:52Z","snapshot_observed_at":"2026-07-06T23:33:53.870540Z","submitted_at":"2026-05-22T15:40:52Z","title":"PhotoFlow: Agentic 3D Virtual Photography Missions","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-25T04:33:24.355622Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2605.23771"},"observation_digest":"sha256:5a55d1a63abd3b6f22ac46371f43fe9de009ff9ad9f1ba9769c3ed8801448ea5","observation_id":"a60f1f0c-baf3-4cf9-b30f-e26ee35b056c","resolution":{"observed_at":"2026-05-25T04:35:21.046941Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.16986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-07-04T07:09:37.364862Z","title":"NavGPT: Explicit reasoning in vision-and-language navigation with large language models","venue":null,"work_id":"b1fd196b-e0a3-41ee-a446-fd6cb609dcf8","year":2024},"citing_paper":{"arxiv_id":"2605.31404","last_updated":"2026-05-29T15:09:25Z","snapshot_observed_at":"2026-08-02T20:20:50.094771Z","submitted_at":"2026-05-29T15:09:25Z","title":"The Sword, Shield, and Achilles' Heel: Characterizing the Linguistic Inductive Bias of Large Language Models for Spatial Reasoning in Navigation Planning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T22:23:24.536258Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2605.31404"},"observation_digest":"sha256:91e5a718c4a20a5beac8de0800a84451398d55d40890654a7ea58ca61125bde5","observation_id":"0ec91a74-4cc8-4623-834b-22bcaeccbb31","resolution":{"observed_at":"2026-07-01T19:36:08.323474Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.16986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-07-04T07:09:37.364862Z","title":"NavGPT: Explicit reasoning in vision-and-language navigation with large language models","venue":null,"work_id":"b1fd196b-e0a3-41ee-a446-fd6cb609dcf8","year":2024},"citing_paper":{"arxiv_id":"2606.21398","last_updated":"2026-06-19T13:06:02Z","snapshot_observed_at":"2026-08-04T00:30:09.459045Z","submitted_at":"2026-06-19T13:06:02Z","title":"BIT-Nav: Brain-Inspired Trajectory Memory for Embodied Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T13:52:31.453516Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2606.21398"},"observation_digest":"sha256:bf7288450a1d87f110faa7626f0d30bba29f35de13b29c80d47aee66fc8d806e","observation_id":"4b936c32-405f-478c-af5c-add0ac2e8750","resolution":{"observed_at":"2026-07-04T07:09:37.366333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16986","snapshot_observed_at":"2026-08-01T11:00:24.420418Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20061","last_updated":"2026-07-22T12:05:13Z","snapshot_observed_at":"2026-08-06T16:01:15.346277Z","submitted_at":"2026-07-22T12:05:13Z","title":"ReferTrack: Referring Then Tracking for Embodied Visual Tracking","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T11:00:24.420418Z"},"links":{"cited_paper":"/paper/2305.16986","citing_paper":"/paper/2607.20061"},"observation_digest":"sha256:3e1612614e83e129c90ba3a53dbb5be1e8f094ed509458f3dd6d9fd3cfd06354","observation_id":"87951153-cd2e-4ee6-a848-7ac3792bcd51","resolution":{"observed_at":"2026-08-01T11:00:24.420418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.16986/citation-record","integrity":"/paper/2305.16986/integrity","json":"/paper/2305.16986/citation-record.json","paper":"/paper/2305.16986"},"outbound":[],"paper":{"arxiv_id":"2305.16986","last_updated":"2023-10-19T17:59:43Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:41:06Z","title":"NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2305.16986."}