{"as_of":"2026-08-22T15:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:58ef46bf49252651f5e2064b2450d94e922688946e4ae5a1576f80ef865d3fd8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:37:06.486394Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T22:16:15.770472Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":"2406.09798","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-07-01T22:16:15.770472Z","title":"Sim-to-real transfer via 3d feature fields for vision-and-language navigation","venue":null,"work_id":"d1a53bf2-6bce-425d-84c0-51f068f3870f","year":2024},"citing_paper":{"arxiv_id":"2412.06224","last_updated":"2025-02-06T10:14:36Z","snapshot_observed_at":"2026-08-16T16:28:01.153501Z","submitted_at":"2024-12-09T05:55:55Z","title":"Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-16T19:51:36.137985Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2412.06224"},"observation_digest":"sha256:f06d4962cc5832d1475415d6e0775044f61f74bc8323cf5860df19b78abc8e65","observation_id":"746dc660-068b-40d2-942b-e5edd55bb516","resolution":{"observed_at":"2026-05-16T19:51:36.408807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-08-06T19:37:06.486394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-18T02:14:46.902275Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:37:06.486394Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2507.05240"},"observation_digest":"sha256:bb6a0fc5a644d568df957981c5acf60a4fbc9810eb8b419c97199c243446869b","observation_id":"bde7ccd3-c346-4362-900d-b5355b079ea7","resolution":{"observed_at":"2026-08-06T19:37:06.486394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":"2406.09798","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-07-01T22:16:15.770472Z","title":"Sim-to-real transfer via 3d feature fields for vision-and-language navigation","venue":null,"work_id":"d1a53bf2-6bce-425d-84c0-51f068f3870f","year":2024},"citing_paper":{"arxiv_id":"2511.17097","last_updated":"2026-04-14T15:21:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-21T09:52:07Z","title":"Progress-Think: Semantic Progress Reasoning for Vision-Language Navigation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-17T21:02:38.013115Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2511.17097"},"observation_digest":"sha256:fc2c3f257be8b71b3d5c066a136b1c15f9560a89a9a945437a4ccfa118456420","observation_id":"d81170af-6f26-43d6-bcfa-88008f5a2f3e","resolution":{"observed_at":"2026-05-17T21:05:15.948267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-08-03T17:18:19.324767Z","title":"Sim-to-real transfer via 3d feature fields for vision-and-language navigation.arXiv preprint arXiv:2406.09798, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10310","last_updated":"2026-06-29T06:58:00Z","snapshot_observed_at":"2026-08-17T08:31:18.887148Z","submitted_at":"2025-12-11T05:57:48Z","title":"Efficient-VLN: A Simple yet Strong Baseline for Efficient Vision-Language Navigation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T17:18:19.324767Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2512.10310"},"observation_digest":"sha256:c64a207780e73af521828e9175cfcf51e70c337f25e1eeb4633da558b2e178cb","observation_id":"07c39507-5f92-43e3-a44c-9814a8086f15","resolution":{"observed_at":"2026-08-03T17:18:19.324767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-08-02T17:15:42.456871Z","title":"arXiv preprint arXiv:2406.09798 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27577","last_updated":"2026-08-01T10:28:12Z","snapshot_observed_at":"2026-08-17T20:04:46.470368Z","submitted_at":"2026-03-29T08:34:05Z","title":"Structured Observation Language for Efficient and Generalizable Vision-Language Navigation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T17:15:42.456871Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2603.27577"},"observation_digest":"sha256:ea1a0d9df673bb5a383b3005d1fec65d940159a3181c2ac3e9c9fc368329d278","observation_id":"4a37d7d0-c494-43c1-a3a7-1bb2c5ed5f3e","resolution":{"observed_at":"2026-08-02T17:15:42.456871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-08-04T05:43:12.218507Z","title":"arXiv preprint arXiv:2406.09798 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27577","last_updated":"2026-08-01T10:28:12Z","snapshot_observed_at":"2026-08-17T20:04:46.470368Z","submitted_at":"2026-03-29T08:34:05Z","title":"Structured Observation Language for Efficient and Generalizable Vision-Language Navigation","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T05:43:12.218507Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2603.27577"},"observation_digest":"sha256:a607c454bb654a691141f5fd24b2fdaad591bda688b03ce605215b1103c72012","observation_id":"787a395e-32a0-46bd-85a7-ee4ac09b8bcb","resolution":{"observed_at":"2026-08-04T05:43:12.218507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":"2406.09798","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-07-01T22:16:15.770472Z","title":"Sim-to-real transfer via 3d feature fields for vision-and-language navigation","venue":null,"work_id":"d1a53bf2-6bce-425d-84c0-51f068f3870f","year":2024},"citing_paper":{"arxiv_id":"2604.27620","last_updated":"2026-04-30T09:09:40Z","snapshot_observed_at":"2026-08-11T04:56:25.116086Z","submitted_at":"2026-04-30T09:09:40Z","title":"SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-07T05:05:33.606975Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2604.27620"},"observation_digest":"sha256:6176635fe1b3c3e53fe09e7ea5c3fb00a7efdfde668a3b26d427749e235e5974","observation_id":"9b1a7178-1732-4ba9-9ff0-db259365690f","resolution":{"observed_at":"2026-05-12T10:36:31.362890Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":"2406.09798","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-07-01T22:16:15.770472Z","title":"Sim-to-real transfer via 3d feature fields for vision-and-language navigation","venue":null,"work_id":"d1a53bf2-6bce-425d-84c0-51f068f3870f","year":2024},"citing_paper":{"arxiv_id":"2605.22036","last_updated":"2026-05-21T06:20:17Z","snapshot_observed_at":"2026-08-15T17:22:17.879626Z","submitted_at":"2026-05-21T06:20:17Z","title":"GA-VLN: Geometry-Aware BEV Representation for Efficient Vision-Language Navigation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T06:45:35.920991Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2605.22036"},"observation_digest":"sha256:4d708d9fb23147effd16806fd25a2189b7b6f3bfe800c24467217f9204c8af33","observation_id":"c453db80-8def-4148-b327-3daa650a6a92","resolution":{"observed_at":"2026-05-22T06:46:10.625336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":"2406.09798","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-07-01T22:16:15.770472Z","title":"Sim-to-real transfer via 3d feature fields for vision-and-language navigation","venue":null,"work_id":"d1a53bf2-6bce-425d-84c0-51f068f3870f","year":2024},"citing_paper":{"arxiv_id":"2606.01621","last_updated":"2026-06-11T13:52:08Z","snapshot_observed_at":"2026-08-09T21:32:00.358889Z","submitted_at":"2026-06-01T03:12:58Z","title":"Goal2Pixel: Grounding Goals to Pixels for Vision-Language Navigation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T15:39:13.803571Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2606.01621"},"observation_digest":"sha256:2c92a06eacc7614be0140457a16d7d838cec5f0b4f31e394e6ddf47eed9e5c0b","observation_id":"09ea12b4-f5f7-4198-a492-f49e253a9cd7","resolution":{"observed_at":"2026-07-01T22:16:15.772018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":"2406.09798","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-07-01T22:16:15.770472Z","title":"Sim-to-real transfer via 3d feature fields for vision-and-language navigation","venue":null,"work_id":"d1a53bf2-6bce-425d-84c0-51f068f3870f","year":2024},"citing_paper":{"arxiv_id":"2606.30367","last_updated":"2026-06-29T14:33:03Z","snapshot_observed_at":"2026-08-06T15:33:36.109677Z","submitted_at":"2026-06-29T14:33:03Z","title":"FutureNav: Unified World-Action Modeling for Vision-and-Language Navigation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-30T05:05:56.065261Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2606.30367"},"observation_digest":"sha256:6701219e72de444056361764efb04b778aa583d18aa2300f6bbefd99c315e5a5","observation_id":"34a44080-1371-49c6-9b5d-30e3db1364d0","resolution":{"observed_at":"2026-06-30T15:44:49.385502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-08-02T05:13:59.448829Z","title":"Sim-to-real transfer via 3d feature fields for vision-and-language navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13461","last_updated":"2026-07-15T05:46:34Z","snapshot_observed_at":"2026-08-17T08:03:05.810974Z","submitted_at":"2026-07-15T05:46:34Z","title":"Joint On-and-Off Policy Learning for Vision-and-Language Navigation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:59.448829Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2607.13461"},"observation_digest":"sha256:34a90d246c0f13ca8da711676ef26f62cc10becf057f18c584fe7cff6980231c","observation_id":"4ca47ea4-dee1-4731-b0bf-b94fb7c9d64a","resolution":{"observed_at":"2026-08-02T05:13:59.448829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09798","snapshot_observed_at":"2026-07-30T20:42:04.289618Z","title":"Sim-to-real transfer via 3d feature fields for vision-and-language navigation.arXiv preprint arXiv:2406.09798, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23504","last_updated":"2026-07-26T07:08:30Z","snapshot_observed_at":"2026-08-16T18:17:45.281076Z","submitted_at":"2026-07-26T07:08:30Z","title":"MemVLN: Episodic and Procedural Memory for Vision-and-Language Navigation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-30T20:42:04.289618Z"},"links":{"cited_paper":"/paper/2406.09798","citing_paper":"/paper/2607.23504"},"observation_digest":"sha256:e796c5d47573cedcb539e29d7e308d05f435daa21b92e660e1764c9d9a518227","observation_id":"0ff8670e-d957-4cdc-b122-94b3404acb98","resolution":{"observed_at":"2026-07-30T20:42:04.289618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.09798/citation-record","integrity":"/paper/2406.09798/integrity","json":"/paper/2406.09798/citation-record.json","paper":"/paper/2406.09798"},"outbound":[],"paper":{"arxiv_id":"2406.09798","last_updated":"2024-10-14T04:48:18Z","latest_version":3,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T13:43:03.918674Z","submitted_at":"2024-06-14T07:50:09Z","title":"Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2406.09798."}