{"as_of":"2026-08-16T01:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe20483410ccaf287867818d6eb5eedaf2802e9442e2fec6e030b882cda4ca33","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:34:35.346330Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08596/citation-record","integrity":"/paper/2608.08596/integrity","json":"/paper/2608.08596/citation-record.json","paper":"/paper/2608.08596"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.04385","last_updated":"2023-08-03T09:39:00Z","snapshot_observed_at":"2026-08-13T13:25:14.355252Z","submitted_at":"2022-12-08T16:27:54Z","title":"BEVBert: Multimodal Map Pre-training for Language-guided Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04385","snapshot_observed_at":"2026-08-14T04:34:34.982299Z","title":"arXiv preprint arXiv:2212.04385 Goal-oriented Navigation Instruction Generation with Tour Video Priors 15 (2022) 4","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:34.982299Z"},"links":{"cited_paper":"/paper/2212.04385","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:0407dd8388a7f23af6e019699a88b8e9e0bc176aa2b0c35f537a910bf10b3d7b","observation_id":"1b1b750b-06c1-43b7-8017-1a3d444161e0","resolution":{"observed_at":"2026-08-14T04:34:34.982299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.814167Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2024) 3, 4","venue":null,"work_id":"c04a5809-b2ac-472d-a67c-c6cfca88dd07","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:34.987921Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:37386a4b04136e8db272cf0ba2e464a2b10e03f9a9c69d7dfb05383252f16e0b","observation_id":"4145de4f-f2a2-456a-aa2e-9d7891835e44","resolution":{"observed_at":"2026-08-14T04:34:36.819200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:34.992562Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:34.992562Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:56ae29921ed843d887490331ca29a15b66f0ba219bfcd15013fb36384727e94d","observation_id":"343d3836-d28d-480e-9acb-580b79f79325","resolution":{"observed_at":"2026-08-14T04:34:34.992562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.789176Z","title":"In: Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":"4270f54f-0ddb-4c64-9e47-1225a70e63ae","year":2018},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:34.997155Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:90573d2aa9d1be29252204d0791b4d441e8ce7101d306f0ac1a782cbf996d4aa","observation_id":"78268c00-a435-46d8-997b-fbcaf0198e8a","resolution":{"observed_at":"2026-08-14T04:34:36.794186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:35.002037Z","title":"In: 2025 IEEE International Conference on Robotics and Automation (ICRA)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.002037Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:7826e69ebc4f336f0b068fd9d12afa05e953c74bd2d19891094f14142e5173af","observation_id":"13bc2c65-0afc-47bf-a12e-d4760247563a","resolution":{"observed_at":"2026-08-14T04:34:35.002037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-14T04:34:35.007050Z","title":"5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.007050Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:f71612a77b5051c6cf2ce39214ca7beb3e086f18bf9d981a4663b55c3671737b","observation_id":"098e7442-39f5-402f-8120-38b34efbc6ae","resolution":{"observed_at":"2026-08-14T04:34:35.007050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.765244Z","title":"(2025) 5, 10, 11, 6, 7","venue":null,"work_id":"7082da40-955d-4567-a121-1f1157ea66a6","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.012021Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:2c9c1161dd0c86ab1b9803e2490f9b451efe19f3950684e82d84100380fc2002","observation_id":"e3e8ee37-16da-4104-86aa-4c0d56cab0b6","resolution":{"observed_at":"2026-08-14T04:34:36.770018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.750659Z","title":"In: Pro- ceedings of the 26th annual international conference on machine learning","venue":null,"work_id":"7efdccc9-8d91-4d4b-97eb-84981f8ecbeb","year":2009},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.016888Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:741c9fa4d1df20aa650f99e976858d05501eb22fe9ce1911057283978f3a0e08","observation_id":"ffce5103-1612-4216-8ee0-57ec55d2a49a","resolution":{"observed_at":"2026-08-14T04:34:36.755262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.735605Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"f2b65c07-3ca8-4c85-b8c3-2cdd5d3edc2f","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.021485Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e2f14bcce0d8c72e67390f88f3bd654c11dfe549913e9080be4e8d97ceaa1b32","observation_id":"c0054c01-0dce-4209-916d-f6dc7da54b8a","resolution":{"observed_at":"2026-08-14T04:34:36.740365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11684","last_updated":"2024-06-17T07:55:59Z","snapshot_observed_at":"2026-07-06T17:31:53.996417Z","submitted_at":"2024-02-18T19:26:49Z","title":"ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11684","snapshot_observed_at":"2026-08-14T04:34:35.026213Z","title":"arXiv preprint arXiv:2402.11684 (2024) 10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.026213Z"},"links":{"cited_paper":"/paper/2402.11684","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:ed9e9766dd20abd463ef0a06eea423e1334a17c0b3a4365c28547ee221dd1b76","observation_id":"a21391c9-4b25-48ca-a07e-fd9afd0f1f17","resolution":{"observed_at":"2026-08-14T04:34:35.026213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.720380Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"007865c7-e839-44af-9809-d01dcdbf61ee","year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.031104Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:981e63346c9380c1dde1690e52a933593f4e65c025cf6f7c71e6c59e57c76810","observation_id":"000c1d06-5843-41ce-bd00-d5f3a4db4004","resolution":{"observed_at":"2026-08-14T04:34:36.725457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.705021Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"9650b100-a179-4d96-8625-d8f8d441e7e7","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.035480Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:25dbdc22387f8db92a0b3113b3c9c62c8dd687ca0a518729825ddae53f83dc03","observation_id":"376622d5-2708-4c36-8f63-77fc8bdb67f6","resolution":{"observed_at":"2026-08-14T04:34:36.709747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04453","last_updated":"2025-02-17T18:27:27Z","snapshot_observed_at":"2026-08-11T21:21:36.601778Z","submitted_at":"2024-12-05T18:58:17Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04453","snapshot_observed_at":"2026-08-14T04:34:35.040088Z","title":"arXiv preprint arXiv:2412.04453 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.040088Z"},"links":{"cited_paper":"/paper/2412.04453","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:5ca5f1cfc90c5b881d38b3917883efc89cfdfb3247878391c32a99e470d00780","observation_id":"11c936a4-78c7-458d-821f-0029b6b698df","resolution":{"observed_at":"2026-08-14T04:34:35.040088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07775","last_updated":"2024-07-12T14:37:08Z","snapshot_observed_at":"2026-08-12T23:24:55.990893Z","submitted_at":"2024-07-10T15:49:07Z","title":"Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07775","snapshot_observed_at":"2026-08-14T04:34:35.044831Z","title":"arXiv preprint arXiv:2407.07775 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.044831Z"},"links":{"cited_paper":"/paper/2407.07775","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:c19e4759d3aec304db7ddc3afdda0b380c7a39faacd6f33f9ac5f042564ae142","observation_id":"f35ef524-a1b3-4784-83b3-6507948d0003","resolution":{"observed_at":"2026-08-14T04:34:35.044831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.689998Z","title":"Li et al","venue":null,"work_id":"d2d153c1-3547-421d-9e5a-0922353478b6","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.049468Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:19405805d4218bac52ec303cf3a93eb0c37b918ebdfda1d58dfe06d7b01989ee","observation_id":"efd37d8d-28d3-4251-9028-fc67088cf198","resolution":{"observed_at":"2026-08-14T04:34:36.694736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08566","last_updated":"2025-06-10T08:36:51Z","snapshot_observed_at":"2026-08-14T15:09:54.897942Z","submitted_at":"2025-06-10T08:36:51Z","title":"Generating Vision-Language Navigation Instructions Incorporated Fine-Grained Alignment Annotations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08566","snapshot_observed_at":"2026-08-14T04:34:35.053699Z","title":"arXiv preprint arXiv:2506.08566 (2025) 2, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.053699Z"},"links":{"cited_paper":"/paper/2506.08566","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:b54179209addc9a557b111c3eeeaff0e0c3254ae2f60a2bffc90e37413c1e330","observation_id":"bbd2b0e3-7b33-4aa2-bc60-009a975a2a50","resolution":{"observed_at":"2026-08-14T04:34:35.053699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11487","last_updated":"2024-04-02T04:27:55Z","snapshot_observed_at":"2026-08-15T05:25:53.356841Z","submitted_at":"2024-03-18T05:38:07Z","title":"Can LLMs Generate Human-Like Wayfinding Instructions? Towards Platform-Agnostic Embodied Instruction Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11487","snapshot_observed_at":"2026-08-14T04:34:35.058564Z","title":"arXiv preprint arXiv:2403.11487 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.058564Z"},"links":{"cited_paper":"/paper/2403.11487","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:d1f8be122f30b8477b5fb5a3f0d577493758a2bf57b179ae81522c5cf82797b2","observation_id":"40aa80d8-e2d0-4a6b-8264-ef2b4ef4f743","resolution":{"observed_at":"2026-08-14T04:34:35.058564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.676228Z","title":"In: European Conference on Computer Vi- sion","venue":null,"work_id":"54dbd031-10bb-4230-9873-072c8621704c","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.063348Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:832e61a238e45308d10b27dee77bb26f4f417cb90f2d8793c09330f9f5af6603","observation_id":"58f9e7c0-abf1-40cf-bfad-1bca45befccc","resolution":{"observed_at":"2026-08-14T04:34:36.680704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.662022Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"46ca8cd5-4a6e-408e-b012-01e09cdc2cdb","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.067618Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:8638ea65f68b207c3d5b4f78a16d1c7097ccae224921cf3c45700e81c6bac9e4","observation_id":"9de90e1a-2e34-4c67-8298-aa4c4f77d1da","resolution":{"observed_at":"2026-08-14T04:34:36.666896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.647673Z","title":"Communi- cations of the ACM24(6), 381–395 (1981) 7","venue":null,"work_id":"d51a832a-cf38-4c39-83c7-a406155eac79","year":1981},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.071752Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:050773ee561c7bd46dc4bbcc8da095b2714b90bca50703f327aa416be8ad715b","observation_id":"869207c1-4f19-4e5d-8b07-138abc644e0e","resolution":{"observed_at":"2026-08-14T04:34:36.652467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.632922Z","title":"Advances in neural information processing sys- tems31(2018) 2, 4","venue":null,"work_id":"07202e7f-10bd-41e2-a237-5a28f2814f04","year":2018},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.075921Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:3955c6d9bfc860c48bfcc20f55155a597a9d0ef7c5da9332ffd2034d31814ca3","observation_id":"45b49681-a4bb-4f63-a638-000152dc29a0","resolution":{"observed_at":"2026-08-14T04:34:36.637759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.617956Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"c49e4b5f-3f45-449a-b602-964bef6bb9c8","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.080055Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:c565b0d10db0b8e2e79c4419734bbf2f630aa89870a514c3ef568946b0b7c780","observation_id":"ac860cc6-4ea8-4928-a31d-62c14b767f22","resolution":{"observed_at":"2026-08-14T04:34:36.622896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.602473Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"4dca4ed7-ddba-4f06-ad23-b09e4065c951","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.084334Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:fb4c47621c37b56e7f8781c4c443eb1921db576407e304eba184f71a75bfcab8","observation_id":"201f4bfa-bc28-4833-bd49-67c9e949a794","resolution":{"observed_at":"2026-08-14T04:34:36.607576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03603","last_updated":"2024-10-04T17:03:14Z","snapshot_observed_at":"2026-08-14T01:01:26.534012Z","submitted_at":"2024-10-04T17:03:14Z","title":"LeLaN: Learning A Language-Conditioned Navigation Policy from In-the-Wild Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03603","snapshot_observed_at":"2026-08-14T04:34:35.088481Z","title":"arXiv preprint arXiv:2410.03603 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.088481Z"},"links":{"cited_paper":"/paper/2410.03603","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:2cdb77b53369be9e3b9535d0c23aa79452ab989ca665a911a3afae0cca0ae913","observation_id":"3e0e5581-a064-44d2-b06c-f706abe9e6d8","resolution":{"observed_at":"2026-08-14T04:34:35.088481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17403","last_updated":"2025-01-29T03:57:56Z","snapshot_observed_at":"2026-08-13T07:59:19.968914Z","submitted_at":"2025-01-29T03:57:56Z","title":"General Scene Adaptation for Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17403","snapshot_observed_at":"2026-08-14T04:34:35.092927Z","title":"arXiv preprint arXiv:2501.17403 (2025) 1, 2, 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.092927Z"},"links":{"cited_paper":"/paper/2501.17403","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:704cacbdcc8dd7d95b9f4868f1679059b0f9d1ab0ac74acb7449572ff3a96951","observation_id":"ed1f94d9-d410-4390-b6f3-3e4750141163","resolution":{"observed_at":"2026-08-14T04:34:35.092927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:35.097876Z","title":"arXiv preprint arXiv:2506.01946 (2025) 2, 5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.097876Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:b4122f084156efc9484d81056efdcda27ae2dc89e08a3707992be153a4add409","observation_id":"baf2d2cf-c1f8-431f-b703-c29a3e2a2bf0","resolution":{"observed_at":"2026-08-14T04:34:35.097876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.587915Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"bd49eb21-2ad2-4e53-ba23-b2ea42687f2d","year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.101980Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:2455c55d17eafaee8a05235cf89df68ce968af2a96e8bfe8c7f2259f56bfedfb","observation_id":"47219645-6818-472b-89b6-4b39b51a1afe","resolution":{"observed_at":"2026-08-14T04:34:36.592418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05446","last_updated":"2019-11-28T16:59:52Z","snapshot_observed_at":"2026-08-14T16:06:36.393156Z","submitted_at":"2019-07-11T18:42:03Z","title":"General Evaluation for Instruction Conditioned Navigation using Dynamic Time Warping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.05446","snapshot_observed_at":"2026-08-14T04:34:35.106278Z","title":"arXiv preprint arXiv:1907.05446 (2019) 6","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.106278Z"},"links":{"cited_paper":"/paper/1907.05446","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:db687624a2beb917b2229d515621ef475a2a48f7be46e4cedfb948532ac0b276","observation_id":"3b9a1193-8073-40b4-937b-0bf9864444a9","resolution":{"observed_at":"2026-08-14T04:34:35.106278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.573570Z","title":"In: European Confer- ence on Computer Vision","venue":null,"work_id":"854bcf09-1c60-48f7-b8b6-4fe951faff21","year":2020},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.111206Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e1fb7149f0698299fdd1632b942b5fe293e507c7e0c998f7a3bf595db55cf690","observation_id":"6199eb5e-3557-48b5-abcd-3a55e07c504e","resolution":{"observed_at":"2026-08-14T04:34:36.578354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.07954","last_updated":"2020-10-15T18:01:15Z","snapshot_observed_at":"2026-08-13T21:19:20.544340Z","submitted_at":"2020-10-15T18:01:15Z","title":"Room-Across-Room: Multilingual Vision-and-Language Navigation with Dense Spatiotemporal Grounding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.07954","snapshot_observed_at":"2026-08-14T04:34:35.115493Z","title":"arXiv preprint arXiv:2010.07954 (2020) 1, 2, 4, 6, 7","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.115493Z"},"links":{"cited_paper":"/paper/2010.07954","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:0fff7ae7c0f2f2aef3beb549a79353962f3e9ae227c9e67ab2dfc31b7d5d3666","observation_id":"50370e0f-fdbc-4726-9b82-d38f282ff8c4","resolution":{"observed_at":"2026-08-14T04:34:35.115493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.559284Z","title":"In: Proceedings of the ACM SIGOPS 29th Symposium on Operating Systems Principles (2023) 10 Goal-oriented Navigation Instruction Generation with Tour Video Priors 17","venue":null,"work_id":"db700b10-4689-4052-9d22-654d5b384947","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.120189Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:b378a2d6e840f040dda3cabc4eee879b43e7e70e5939284ef6d710a5708a3dd5","observation_id":"39b0ac29-bbd1-47eb-a0aa-16f48aca1d06","resolution":{"observed_at":"2026-08-14T04:34:36.563953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19024","last_updated":"2025-02-26T10:30:40Z","snapshot_observed_at":"2026-08-07T17:47:11.098787Z","submitted_at":"2025-02-26T10:30:40Z","title":"Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments","version":1},"cited_work":{"arxiv_id":"2502.19024","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.19024","snapshot_observed_at":"2026-08-14T04:34:35.846643Z","title":"Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments","venue":"cs.RO","work_id":"886b2034-34a2-47aa-9c09-2cf6b372dc62","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.124639Z"},"links":{"cited_paper":"/paper/2502.19024","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:bb0972479d05173896fdf7b1768961185bd80b43d890131703370f105fd0dce2","observation_id":"6af576d7-c101-4855-ad38-5218a0ac5a18","resolution":{"observed_at":"2026-08-14T04:34:35.853735Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.544594Z","title":"In: Text sum- marization branches out","venue":null,"work_id":"62d76559-2d88-4744-9193-07afabcb0f93","year":2004},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.129338Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:4266f2a0268fddcdd01503a6e67c717699d409b0bfa9067723f64891068e2f67","observation_id":"13334bd9-ff18-456f-8c77-6e86e717aa0d","resolution":{"observed_at":"2026-08-14T04:34:36.549506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.529315Z","title":"In: Proceedings of the IEEE/CVF In- ternational Conference on Computer Vision","venue":null,"work_id":"309f4542-e440-4339-97c2-9ed50752cb08","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.134115Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:7d3e5a07cd53e924b0985d0149707e141846625b9e6dac680af2479f49fe52e9","observation_id":"5035417e-a662-4b64-8a85-a5b8d9243558","resolution":{"observed_at":"2026-08-14T04:34:36.534345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.513932Z","title":null,"venue":null,"work_id":"d5e29820-bb9c-4aa0-9ad7-53da6e6b09a2","year":2008},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.138566Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:9360a997a393c4483025371d2ed5618019cdd7be4c63cf033cc5cbbdd5af4fdc","observation_id":"7be0a82a-2e00-4e58-ae10-9ae15bde24d5","resolution":{"observed_at":"2026-08-14T04:34:36.518836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.498656Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"68f2a8e0-ca43-452e-b061-fbcf01e6e139","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.142977Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:95cf890e2f44527a93ad18af11ccf7868f485a950d214b9ae936f4eac4327e37","observation_id":"5383acfb-6e5b-4ab2-8e4a-03c8c8c50eb8","resolution":{"observed_at":"2026-08-14T04:34:36.503353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04882","last_updated":"2024-06-07T12:26:34Z","snapshot_observed_at":"2026-08-14T23:30:42.777149Z","submitted_at":"2024-06-07T12:26:34Z","title":"InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04882","snapshot_observed_at":"2026-08-14T04:34:35.147506Z","title":"arXiv preprint arXiv:2406.04882 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.147506Z"},"links":{"cited_paper":"/paper/2406.04882","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:b7fe30dcbb27534a14f79a394f513c7fd9d517be388ee63a451617841d253ef2","observation_id":"2f4b9f71-157b-4c93-9465-8e3ebd044a3f","resolution":{"observed_at":"2026-08-14T04:34:35.147506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14830","last_updated":"2024-02-16T23:44:38Z","snapshot_observed_at":"2026-08-13T23:44:54.604004Z","submitted_at":"2024-02-16T23:44:38Z","title":"Orca-Math: Unlocking the potential of SLMs in Grade School Math","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14830","snapshot_observed_at":"2026-08-14T04:34:35.152287Z","title":"arXiv preprint arXiv:2402.14830 (2024) 10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.152287Z"},"links":{"cited_paper":"/paper/2402.14830","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:0ed26b91501c760cf7ec0a55c7ac1b80df2a395eeaa1f156ca9b2d1ce88afb84","observation_id":"61dae913-21d8-4ef3-898d-32aa91fc1e9e","resolution":{"observed_at":"2026-08-14T04:34:35.152287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01805","last_updated":"2025-05-21T09:38:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-02T15:12:17Z","title":"SpaceR: Reinforcing MLLMs in Video Spatial Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01805","snapshot_observed_at":"2026-08-14T04:34:35.157051Z","title":"arXiv preprint arXiv:2504.01805 (2025) 10","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.157051Z"},"links":{"cited_paper":"/paper/2504.01805","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:aca78bd6f43ea434619483d1d66e202fd56541f0be2a07a844b80c0d55d3e22a","observation_id":"f0dd3dbb-4720-4487-9afb-870f8e928d93","resolution":{"observed_at":"2026-08-14T04:34:35.157051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.484034Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"27584ca7-03bc-4fb9-8d18-e78ccbf6d65f","year":2020},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.161752Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e664883bb1115967ccbc9cf6dfb105ef1c9599b8d715c18c6afd9a97abb159f1","observation_id":"5c98a439-1e7d-4dce-8e9f-bfd4926b35af","resolution":{"observed_at":"2026-08-14T04:34:36.488839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01031","last_updated":"2025-06-01T14:21:02Z","snapshot_observed_at":"2026-08-13T21:47:20.221397Z","submitted_at":"2025-06-01T14:21:02Z","title":"NavBench: Probing Multimodal Large Language Models for Embodied Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01031","snapshot_observed_at":"2026-08-14T04:34:35.166153Z","title":"arXiv preprint arXiv:2506.01031 (2025) 8","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.166153Z"},"links":{"cited_paper":"/paper/2506.01031","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:d1ff7153262c8c8552204ca498d153babfff162610f5cf56a6f39a6fb250f68f","observation_id":"81cd374f-3024-449e-aadb-4a19f7f1b7ae","resolution":{"observed_at":"2026-08-14T04:34:35.166153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:35.171068Z","title":"arXiv preprint arXiv:2504.00907 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.171068Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:13a4874054a4466cb87639d4e0317ff03d5e925ebe20effaca7b165dffd8e8f6","observation_id":"86620621-84ee-4fb0-aa71-d10860b8aa81","resolution":{"observed_at":"2026-08-14T04:34:35.171068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.470591Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"f8b225a1-781a-41e0-9c35-01007c97279e","year":2019},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.175601Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:8102a25547d6e46030ed378228880920ed898cc54c7f9989bed6c3034d3ea029","observation_id":"9f612b35-8093-4fe1-8984-33a1678d2cd9","resolution":{"observed_at":"2026-08-14T04:34:36.475091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.456297Z","title":"In: Conference on robot learning","venue":null,"work_id":"19deca8e-8e36-45d2-90f2-8a39cc1c0601","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.179854Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:f7235256912709b7836c6afa27cbca0386307edcd5278b9840511a041b446ebc","observation_id":"f352e6a8-dbd4-494c-b522-d39978e18cf3","resolution":{"observed_at":"2026-08-14T04:34:36.460991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-14T04:34:35.184480Z","title":"arXiv preprint arXiv:2402.03300 (2024) 9, 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.184480Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:ea2af695404e3ac2dfe5437cb28ec5dac560ec4b90fd4c02e670b41a74f2e1d0","observation_id":"25f856a5-ee88-4b32-9fd2-0f8137e1a00b","resolution":{"observed_at":"2026-08-14T04:34:35.184480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.442593Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"520ee061-2657-4323-a556-570e8499777e","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.189061Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:44cc0495aeccdbd3925260c67e3cc266620ac546191192f07a09f12a7e94d384","observation_id":"608b2a8e-62f5-4983-a686-0dfb33a708f9","resolution":{"observed_at":"2026-08-14T04:34:36.447335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.04195","last_updated":"2019-04-08T17:14:52Z","snapshot_observed_at":"2026-08-14T16:49:50.459520Z","submitted_at":"2019-04-08T17:14:52Z","title":"Learning to Navigate Unseen Environments: Back Translation with Environmental Dropout","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.04195","snapshot_observed_at":"2026-08-14T04:34:35.193857Z","title":"arXiv preprint arXiv:1904.04195 (2019) 2, 4","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.193857Z"},"links":{"cited_paper":"/paper/1904.04195","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:2aa6fa301c9e8036290bdf2fb86620a91994844a11ca35b871006fc2e13b8353","observation_id":"f744108d-89ec-4dc7-802d-34cc8dbf3043","resolution":{"observed_at":"2026-08-14T04:34:35.193857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.428104Z","title":"Li et al","venue":null,"work_id":"a1173d20-7ba2-4ecb-98ae-2843aeee91b9","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.198623Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:f6dd1f3e41748c6f8c3856a24ed4c9260d700e4cd12dcc1a5487ea04e49737a2","observation_id":"8a88bfb0-39c2-4235-83f2-6ea352d38a8c","resolution":{"observed_at":"2026-08-14T04:34:36.432957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.413437Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pat- tern recognition","venue":null,"work_id":"f6e25f8f-3eb4-4bba-90ac-696a28b826e2","year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.203035Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:287ae4a32ee1b87b5df6173a8a124ea2f352df23a7b0cbf76b42f5602f2afd02","observation_id":"a2106c67-19e7-4cf8-97a3-c1917f455ea4","resolution":{"observed_at":"2026-08-14T04:34:36.418115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.397891Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"401a17d9-6353-4ccd-b290-ed63f1aab3de","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.208088Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:bd5d70b54cd8ff4005b6c614e84931bbe0f21baddca45b547ee0ca577f429fde","observation_id":"d3da8b0f-e371-48ec-a88f-9fd2030daf9d","resolution":{"observed_at":"2026-08-14T04:34:36.403330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.267695Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"93bf5904-e7df-40f8-8b5b-370610aff44c","year":2022},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.212527Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e90c3d9c33780a13e99215c810d49f1e235effcf3df7b15dc5943c202fee6492","observation_id":"f1659e2b-913c-4889-be9f-90b9af9e51bc","resolution":{"observed_at":"2026-08-14T04:34:36.272243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.253292Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"c5b67402-7530-4732-bb4b-06f2e2513acf","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.216891Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:061c0059fc159e5d73e06087d69cbf0433788d68b469898f842bffc563216c70","observation_id":"149f1919-7790-4702-98ed-25939dfc7aec","resolution":{"observed_at":"2026-08-14T04:34:36.257821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.237109Z","title":"Advances in Neural Information Processing Systems37, 121475–121499 (2024) 10","venue":null,"work_id":"d383b778-8a0c-43de-bf31-f438e706e45e","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.221223Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:4a91d8b77c57e6ca74d62d26d9a62413de6bf8ae9b0440d87c5abf30b5c37818","observation_id":"abdb614d-f28b-43ff-8da1-e0a38d43229b","resolution":{"observed_at":"2026-08-14T04:34:36.243288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-08-13T18:24:04.904767Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10442","snapshot_observed_at":"2026-08-14T04:34:35.225816Z","title":"arXiv preprint arXiv:2411.10442 (2024) 10, 5","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.225816Z"},"links":{"cited_paper":"/paper/2411.10442","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:6bed216af22a5a0b46679396a70258d78bc1b2e4b4bea2eb7947c391375e11bb","observation_id":"603a7637-d6a6-441b-bec4-eeab0d8714b2","resolution":{"observed_at":"2026-08-14T04:34:35.225816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-13T04:48:56.237545Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-14T04:34:35.230585Z","title":"5: Advancing open-source multimodal models in versatility, reasoning, and efficiency","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.230585Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e6b1ebc7efddd7b64a68c4efad89f0cc4d5c3619ed705d9e617e791b3c366a0d","observation_id":"4f8c77f6-2eaf-43d5-badc-3671d5865ef3","resolution":{"observed_at":"2026-08-14T04:34:35.230585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.222209Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"b41b07b9-d53c-4302-8505-f7e1bd513081","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.235172Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:2a06fad9f0fd561c610a863045a4654405933ef5feb39b9de10cb010b4cb4520","observation_id":"b093d542-fc31-4580-8351-244c0ff51eb0","resolution":{"observed_at":"2026-08-14T04:34:36.226824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11142","last_updated":"2025-03-07T06:06:29Z","snapshot_observed_at":"2026-08-12T10:07:25.847288Z","submitted_at":"2025-02-16T14:17:36Z","title":"NavRAG: Generating User Demand Instructions for Embodied Navigation through Retrieval-Augmented LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11142","snapshot_observed_at":"2026-08-14T04:34:35.239654Z","title":"arXiv preprint arXiv:2502.11142 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.239654Z"},"links":{"cited_paper":"/paper/2502.11142","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:9244f2156539bd5f413da31c9639589df5e930199f97d7fb7e8e4c942c55ee15","observation_id":"bf8f2bfc-cdf9-4e74-85b9-26d8a94918e5","resolution":{"observed_at":"2026-08-14T04:34:35.239654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08467","last_updated":"2025-02-28T08:06:39Z","snapshot_observed_at":"2026-08-14T22:24:02.598995Z","submitted_at":"2024-12-11T15:32:24Z","title":"Bootstrapping Language-Guided Navigation Learning with Self-Refining Data Flywheel","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08467","snapshot_observed_at":"2026-08-14T04:34:35.244441Z","title":"arXiv preprint arXiv:2412.08467 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.244441Z"},"links":{"cited_paper":"/paper/2412.08467","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:75e65a7a57ba322ce2bc74e0dc309df512b6f6108b63374f62ae3cb956f08986","observation_id":"71b87891-78e3-4e1e-bd4d-19f698ca34ac","resolution":{"observed_at":"2026-08-14T04:34:35.244441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.207205Z","title":"In: Proceed- ings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"cca1b03f-19fb-41dc-b883-e1aae8bd4f2c","year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.249070Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:6e481f5db314d59d73cc9f5cc44a7d4bbef7115129054719350c3b259bb10151","observation_id":"27cde5e7-8c3c-4309-a8ed-11a7f7693f02","resolution":{"observed_at":"2026-08-14T04:34:36.211900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:35.253523Z","title":"arXiv preprint arXiv:2512.08186 (2025) 9, 13","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.253523Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:e786140d468c8f765542cda387a31304906257756c3c2a2cd3ff734424eaa5a1","observation_id":"b3d94491-d362-41fa-9680-2718fabf024d","resolution":{"observed_at":"2026-08-14T04:34:35.253523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-06T19:26:50.907830Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05240","snapshot_observed_at":"2026-08-14T04:34:35.257974Z","title":"arXiv preprint arXiv:2507.05240 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.257974Z"},"links":{"cited_paper":"/paper/2507.05240","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:4d4dc0a0ce4b70085339082390a34191fdf055678cc6d6e45595d6da84bb3bf4","observation_id":"831a9937-39e5-4609-9668-f3f9f85f7332","resolution":{"observed_at":"2026-08-14T04:34:35.257974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.191723Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"0bcd2a8f-771b-4271-b96e-ee133971ea6c","year":2019},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.262808Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:a03736a7b9d6f9ec1638a9cfd5473a9ba421fe0ab486978a13bb15f2bd1d94bd","observation_id":"36a0d711-48c7-49e5-a7ae-6cdb7ea2a566","resolution":{"observed_at":"2026-08-14T04:34:36.196567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09547","last_updated":"2026-04-29T01:36:59Z","snapshot_observed_at":"2026-08-11T15:57:30.241116Z","submitted_at":"2025-08-13T07:05:17Z","title":"GoViG: Goal-Conditioned Visual Navigation Instruction Generation via Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09547","snapshot_observed_at":"2026-08-14T04:34:35.267252Z","title":"arXiv preprint arXiv:2508.09547 (2025) 2, 3, 5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.267252Z"},"links":{"cited_paper":"/paper/2508.09547","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:3a6235e723053d35dfb791b0bd2dca1b43f0daf19fb683e9d31b47b5f9d3ee62","observation_id":"fa12c939-bcda-4fa3-a653-d3149ed5cf70","resolution":{"observed_at":"2026-08-14T04:34:35.267252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.176705Z","title":"In: Pro- ceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"42b9257e-167d-4f50-aac8-0870dd006fb9","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.271796Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:9b644b5f151d0a70867ec9dc47923ef8d37bbbbe52ba0242786e59e2a22d9ffe","observation_id":"07453ca9-bf2b-4332-8f69-0a0415bc4794","resolution":{"observed_at":"2026-08-14T04:34:36.182130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.161933Z","title":"In: 2024 IEEE International Con- ference on Robotics and Automation (ICRA)","venue":null,"work_id":"632d8a39-2ef6-4ad2-bb8a-268102b705ae","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.276064Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:2a7ebae5e672ab42e4e6d72bf77aa0f8c84f979bdd5267b8c802163eebdb52a1","observation_id":"accc630d-9750-46a3-a68f-7d1eeb0bd6f8","resolution":{"observed_at":"2026-08-14T04:34:36.166985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.145564Z","title":"In: 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)","venue":null,"work_id":"abb29dd2-28a1-4f28-8aec-23a6f60e21e2","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.280607Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:550f1778828019e27d6db0cd7eb3cca30927af77d9c63cffa94b247ef68ef141","observation_id":"289156a2-d1f2-417d-9f3a-f25b8e5dfe7a","resolution":{"observed_at":"2026-08-14T04:34:36.150183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-14T04:34:35.285162Z","title":"arXiv preprint arXiv:2309.12284 (2023) 10","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.285162Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:1019969ac98eb5f66c681b4168f3129dfdd36893f65083bcf23964afe98856b8","observation_id":"aae6a15f-04ed-42f6-b78c-c1089de197c9","resolution":{"observed_at":"2026-08-14T04:34:35.285162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-07T14:43:09.380195Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-14T04:34:35.289705Z","title":"arXiv preprint arXiv:2309.05653 (2023) 10","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.289705Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:fcfd1f6ae122bf6173852c78786f6f6f7ef9d01d36c802532af7009e5350576b","observation_id":"67e71dfd-cca6-4c0d-be03-48c67cbc23f2","resolution":{"observed_at":"2026-08-14T04:34:35.289705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06224","last_updated":"2025-02-06T10:14:36Z","snapshot_observed_at":"2026-08-06T17:32:08.916929Z","submitted_at":"2024-12-09T05:55:55Z","title":"Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06224","snapshot_observed_at":"2026-08-14T04:34:35.294644Z","title":"arXiv preprint arXiv:2412.06224 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.294644Z"},"links":{"cited_paper":"/paper/2412.06224","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:a94c4d42e0d52bff4083e5d0f744dc26a7737fedeeb3eeafb52b88b9ce51e16d","observation_id":"6a882902-92c9-400f-963a-90e592a8bcaf","resolution":{"observed_at":"2026-08-14T04:34:35.294644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15852","last_updated":"2024-06-30T11:14:13Z","snapshot_observed_at":"2026-08-12T04:00:31.932219Z","submitted_at":"2024-02-24T16:39:16Z","title":"NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15852","snapshot_observed_at":"2026-08-14T04:34:35.299539Z","title":"arXiv preprint arXiv:2402.15852 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.299539Z"},"links":{"cited_paper":"/paper/2402.15852","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:2ee31087ecdc2502d27f91e16ff3ac65898856560340ddd83d33f5037d9cd102","observation_id":"2f63341b-19f8-493b-ba49-39f1741476db","resolution":{"observed_at":"2026-08-14T04:34:35.299539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13451","last_updated":"2026-05-09T11:40:06Z","snapshot_observed_at":"2026-08-02T06:35:33.765328Z","submitted_at":"2025-02-19T05:52:34Z","title":"MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13451","snapshot_observed_at":"2026-08-14T04:34:35.304762Z","title":"arXiv preprint arXiv:2502.13451 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.304762Z"},"links":{"cited_paper":"/paper/2502.13451","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:7c5afeab3856eab59e676ca1c00ce9f46578ee4b9a00bc1146e3ee78421a1e5d","observation_id":"c9497d46-7d08-4d32-a1bf-0dd7905432f0","resolution":{"observed_at":"2026-08-14T04:34:35.304762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14254","last_updated":"2025-06-10T21:36:52Z","snapshot_observed_at":"2026-08-07T18:03:02.988777Z","submitted_at":"2025-02-20T04:41:40Z","title":"Mem2Ego: Empowering Vision-Language Models with Global-to-Ego Memory for Long-Horizon Embodied Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14254","snapshot_observed_at":"2026-08-14T04:34:35.309557Z","title":"arXiv preprint arXiv:2502.14254 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.309557Z"},"links":{"cited_paper":"/paper/2502.14254","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:1f32c6eacfafc8dfde4e5012e65375b90d7a23754042afbe425d1b379f0e6f93","observation_id":"bd50a817-4396-4a93-8e9d-eaeeb67c883d","resolution":{"observed_at":"2026-08-14T04:34:35.309557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07035","last_updated":"2024-12-29T23:16:37Z","snapshot_observed_at":"2026-08-12T23:25:39.126520Z","submitted_at":"2024-07-09T16:53:36Z","title":"Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07035","snapshot_observed_at":"2026-08-14T04:34:35.314057Z","title":"arXiv preprint arXiv:2407.07035 (2024) 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.314057Z"},"links":{"cited_paper":"/paper/2407.07035","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:d49d788a245a184eb6dc2b35842934896648d5fb102f7e9cd6a84d4d1cf76c8b","observation_id":"0a6533d1-cd21-4d58-a848-990739e88371","resolution":{"observed_at":"2026-08-14T04:34:35.314057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.10504","last_updated":"2021-01-26T01:03:49Z","snapshot_observed_at":"2026-08-03T21:04:17.663648Z","submitted_at":"2021-01-26T01:03:49Z","title":"On the Evaluation of Vision-and-Language Navigation Instructions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.10504","snapshot_observed_at":"2026-08-14T04:34:35.318996Z","title":"arXiv preprint arXiv:2101.10504 (2021) 8","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.318996Z"},"links":{"cited_paper":"/paper/2101.10504","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:87ff6d36e4e8135870775d6865f178b781ff04e5e73718294d05d38ad01e856e","observation_id":"19d4d347-8cb3-42c8-a3d5-1b33a7f8a959","resolution":{"observed_at":"2026-08-14T04:34:35.318996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.130882Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"087b0388-89d1-47b1-afa5-ac89a19c8935","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.323716Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:5cd2595efe62dff76def67bb2b2866e00a2564f91d57165f12634f082baabfd8","observation_id":"4d7aca7c-31a6-4262-a3a1-4463a88b4f8f","resolution":{"observed_at":"2026-08-14T04:34:36.135480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14658","last_updated":"2025-01-07T05:37:04Z","snapshot_observed_at":"2026-08-14T20:57:51.689202Z","submitted_at":"2024-02-22T16:06:23Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14658","snapshot_observed_at":"2026-08-14T04:34:35.328264Z","title":"arXiv preprint arXiv:2402.14658 (2024) 10","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.328264Z"},"links":{"cited_paper":"/paper/2402.14658","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:b110ec82e9ab0ac2aac4f60c267e72b401ffc9f14a00943afa25c577cfe5279e","observation_id":"c2c6c45d-3825-4974-85e0-8382c27e4d5f","resolution":{"observed_at":"2026-08-14T04:34:35.328264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.115622Z","title":"In: European Confer- ence on Computer Vision","venue":null,"work_id":"39cac431-87bb-469c-8fda-b089e1810c9e","year":2024},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.332989Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:a8832d68229a69eed19a39b8289695ae638444f462c0a8facbd6b93cd433e98b","observation_id":"871fc483-fc46-40cf-8938-d9efe4bdbfe0","resolution":{"observed_at":"2026-08-14T04:34:36.120528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.099782Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"c1390ab6-92e6-4cd1-bc68-df4848dda95f","year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.337472Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:335640b1388086b435df11e93ea9c9fc4faf0bd97bc757e288e8c2c41d7e261c","observation_id":"5ecec553-9d79-4bf5-a8ba-e9b4ff26f1d6","resolution":{"observed_at":"2026-08-14T04:34:36.104469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:34:36.085160Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"c993dfe5-e489-4ad9-926f-b40d178476d6","year":2021},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.341982Z"},"links":{"citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:52acdc1e3a1674fd8bb1362be47e65676843b473f64cf9c9e63e4034d52a39b3","observation_id":"df603f53-2adf-4e88-a6ba-4f5f0a28c4ff","resolution":{"observed_at":"2026-08-14T04:34:36.089812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T18:37:57.419939Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-14T04:34:35.346330Z","title":"Move forward 100 cm","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.346330Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2608.08596"},"observation_digest":"sha256:74673d13ba8eeef3bcbb5543dd7cef61cd3d9b2878af13924a206501511d29be","observation_id":"ef5ee8ff-0585-499b-8afa-4d0fa6f5d9f8","resolution":{"observed_at":"2026-08-14T04:34:35.346330Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.08596","last_updated":"2026-08-09T09:21:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T00:57:58.719096Z","submitted_at":"2026-08-09T09:21:47Z","title":"Goal-oriented Navigation Instruction Generation with Tour Video Priors"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":40},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 0 inbound Pith citation observations for arXiv:2608.08596."}