{"as_of":"2026-08-18T04:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ce1c374ceb9bc155fc20732781195b569a42145a8172e5d004c2e1ec27d085f1","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:25:19.387288Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:22:17.982994Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T11:08:02.851997Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.16623","snapshot_observed_at":"2026-08-15T17:22:17.982994Z","title":"History-augmented vision-language models for frontier-based zero-shot object navigation.arXiv preprint arXiv:2506.16623, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12637","last_updated":"2025-08-18T05:47:48Z","snapshot_observed_at":"2026-08-16T00:21:58.031488Z","submitted_at":"2025-08-18T05:47:48Z","title":"HOMI: Ultra-Fast EdgeAI platform for Event Cameras","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:22:17.982994Z"},"links":{"cited_paper":"/paper/2506.16623","citing_paper":"/paper/2508.12637"},"observation_digest":"sha256:51b76a1ed88b706a0efb80dc09db4d2f851f9885a5dd4100909edf158cac3d47","observation_id":"28ed85db-802d-41e5-8563-183a2290d9eb","resolution":{"observed_at":"2026-08-15T17:22:17.982994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.16623","snapshot_observed_at":"2026-08-03T19:40:13.426231Z","title":"History-augmented vision-language models for frontier-based zero-shot object navigation.arXiv preprint arXiv:2506.16623, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.05131","last_updated":"2026-07-30T19:16:02Z","snapshot_observed_at":"2026-08-17T00:49:12.809750Z","submitted_at":"2025-11-28T06:17:02Z","title":"AREA3D: Active Reconstruction Agent with Unified Feed-Forward 3D Perception and Vision-Language Guidance","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T19:40:13.426231Z"},"links":{"cited_paper":"/paper/2506.16623","citing_paper":"/paper/2512.05131"},"observation_digest":"sha256:ea7eb3513f666934bdfcb392f978a61d4995a18f29ab64640cce9d0f02f2a17b","observation_id":"c02f03f6-015c-494e-8c71-b17d72bf7d27","resolution":{"observed_at":"2026-08-03T19:40:13.426231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"cited_work":{"arxiv_id":"2506.16623","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16623","snapshot_observed_at":"2026-07-03T11:08:02.851997Z","title":"Habibpour and F","venue":null,"work_id":"fd936774-96d6-4313-b9b2-a352232a4836","year":2025},"citing_paper":{"arxiv_id":"2607.02417","last_updated":"2026-07-02T16:48:43Z","snapshot_observed_at":"2026-08-02T16:44:23.076809Z","submitted_at":"2026-07-02T16:48:43Z","title":"LIME: Learning Intent-aware Camera Motion from Egocentric Video","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-03T11:01:22.425665Z"},"links":{"cited_paper":"/paper/2506.16623","citing_paper":"/paper/2607.02417"},"observation_digest":"sha256:8ffe52182f72edbe3379bf986090e60534bd1c162afa634eada293b443e56f31","observation_id":"82e45f01-d120-40fa-8c99-283edad080b2","resolution":{"observed_at":"2026-07-03T11:08:02.853535Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.16623/citation-record","integrity":"/paper/2506.16623/integrity","json":"/paper/2506.16623/citation-record.json","paper":"/paper/2506.16623"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.04597","last_updated":"2025-05-07T23:28:22Z","snapshot_observed_at":"2026-08-17T01:51:24.716392Z","submitted_at":"2025-01-08T16:25:32Z","title":"FrontierNet: Learning Visual Cues to Explore","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04597","snapshot_observed_at":"2026-08-15T19:25:19.266603Z","title":"Frontiernet: Learning visual cues to explore,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.266603Z"},"links":{"cited_paper":"/paper/2501.04597","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:d869384a127f7a021c32e7462c3a059b7084b8433161504d6bace760ff8bb301","observation_id":"b997a48a-a839-4a54-8743-d6eb80b8f835","resolution":{"observed_at":"2026-08-15T19:25:19.266603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07035","last_updated":"2024-12-29T23:16:37Z","snapshot_observed_at":"2026-08-16T13:35:42.252082Z","submitted_at":"2024-07-09T16:53:36Z","title":"Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07035","snapshot_observed_at":"2026-08-15T19:25:19.271735Z","title":"Vision-and-language navigation today and to- morrow: A survey in the era of foundation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.271735Z"},"links":{"cited_paper":"/paper/2407.07035","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:111590e65fff2b0b3bc8b0404accc386436e398bc8a20019990b28ae8519a80a","observation_id":"531eb9b5-6092-41a4-8075-4e2bc68af1b1","resolution":{"observed_at":"2026-08-15T19:25:19.271735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.761612Z","title":"Object goal navigation using data regularized q-learning,","venue":null,"work_id":"6a5d245f-49a4-4464-a264-1529f2ad5cbe","year":2022},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.275730Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:78f5008bae3fa68a26a9362dedf70823ed40a2483c1dd0c49e2a1ed73337bcde","observation_id":"b68da96a-0c70-436d-9504-034003fcfc35","resolution":{"observed_at":"2026-08-15T19:25:19.766101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.16649","last_updated":"2022-11-30T00:38:54Z","snapshot_observed_at":"2026-08-16T16:12:15.083932Z","submitted_at":"2022-11-30T00:38:54Z","title":"CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.16649","snapshot_observed_at":"2026-08-15T19:25:19.279724Z","title":"Clip-nav: Using clip for zero-shot vision-and-language nav- igation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.279724Z"},"links":{"cited_paper":"/paper/2211.16649","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:21be74c2bde6a2624c1f9c9007c705f57c4a97f965ced2ba953346f1946ede89","observation_id":"2cce3c0d-7e79-42ba-9868-b6ede055898e","resolution":{"observed_at":"2026-08-15T19:25:19.279724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.748517Z","title":"A survey of object goal navigation,","venue":null,"work_id":"e5780bfc-0a39-43d9-8e1b-16977907c583","year":2024},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.284466Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:5c236dc12861892fc0cdf741bfa27dfd814cc1226e0e23e9f03d9e9fb2614f34","observation_id":"aff8b131-a2dc-41ee-858c-17f9d6e2cebe","resolution":{"observed_at":"2026-08-15T19:25:19.752823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.288417Z","title":"Vlfm: Vision- language frontier maps for zero-shot semantic navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.288417Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:cd6f99a7fa1b7f1ac92ca8917b3f5a2ac933dad05f9dada36e2dd6896be9d9ff","observation_id":"24f71764-3c4e-4ada-8df0-5606a767304b","resolution":{"observed_at":"2026-08-15T19:25:19.288417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23978","last_updated":"2024-10-31T14:31:53Z","snapshot_observed_at":"2026-08-17T01:53:48.750649Z","submitted_at":"2024-10-31T14:31:53Z","title":"GAMap: Zero-Shot Object Goal Navigation with Multi-Scale Geometric-Affordance Guidance","version":1},"cited_work":{"arxiv_id":"2410.23978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.23978","snapshot_observed_at":"2026-08-15T19:25:19.582430Z","title":"GAMap: Zero-Shot Object Goal Navigation with Multi-Scale Geometric-Affordance Guidance","venue":"cs.RO","work_id":"596affbb-52a5-4452-9dd3-d4feb8d0aa1a","year":2024},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.292487Z"},"links":{"cited_paper":"/paper/2410.23978","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:78e7e9a202fc57452bba72425fc659803fd302bb353df69d52a650cde5e0a8da","observation_id":"12ebd94b-b90d-4dcf-93c8-d8f966ce5373","resolution":{"observed_at":"2026-08-15T19:25:19.588541Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.296239Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.296239Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:8f39574548415350866243273f97debf66781416e4f7086f99811f626d6961cb","observation_id":"3c5fc472-ac59-416c-8ad5-f5b51baf84c6","resolution":{"observed_at":"2026-08-15T19:25:19.296239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10421","last_updated":"2022-12-14T14:28:33Z","snapshot_observed_at":"2026-08-16T19:48:07.434556Z","submitted_at":"2022-03-20T00:52:45Z","title":"CoWs on Pasture: Baselines and Benchmarks for Language-Driven Zero-Shot Object Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10421","snapshot_observed_at":"2026-08-15T19:25:19.305443Z","title":"Clip on wheels: Zero-shot object navigation as object localization and exploration,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.305443Z"},"links":{"cited_paper":"/paper/2203.10421","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:3e9cd1e631b560cf38bafbad7fa92eb68514fc81b1909c28c5ea978228796816","observation_id":"325808cb-2fd8-4715-b849-d046bf7a62f0","resolution":{"observed_at":"2026-08-15T19:25:19.305443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.718276Z","title":"Zson: Zero-shot object-goal navigation using multimodal goal embeddings,","venue":null,"work_id":"fc838347-b4a9-4045-a6d3-f6aae7573dfe","year":null},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.310082Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:323dd5f6614e50933a884de5d8f56d1c981b875c6dfc21c9b3a2af606a809fc4","observation_id":"aba48fbe-5c5c-4b78-9bc6-c6393a52052a","resolution":{"observed_at":"2026-08-15T19:25:19.722520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.318171Z","title":"Habitat challenge 2023,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.318171Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:fb42b651b2c85d8c889c71287fdf7965441c1f000046948fd436b60b60171652","observation_id":"882e3354-cea1-4c75-8c08-2a6087dddbbf","resolution":{"observed_at":"2026-08-15T19:25:19.318171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-08-15T02:35:59.111911Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-15T19:25:19.321830Z","title":"Improved baselines with visual instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.321830Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:ce86c9c54d79e9e814161be65929821b2b314b86bdfb83af7001f4be0295e47c","observation_id":"a09bda92-332a-4b0e-854c-95937fe9c14f","resolution":{"observed_at":"2026-08-15T19:25:19.321830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.696639Z","title":"Pali: A jointly-scaled multilingual language-image model,","venue":null,"work_id":"d4d71d8f-aa60-43f1-b7e5-d79744e23666","year":null},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.326579Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:bbe588d631b31d05eb89c77032e9148a847615a065e331b563b8cf03d384df36","observation_id":"81249f90-cce7-4ccc-bd88-7f997ef1ea67","resolution":{"observed_at":"2026-08-15T19:25:19.700734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04468","last_updated":"2026-04-25T07:16:42Z","snapshot_observed_at":"2026-08-03T08:48:57.969106Z","submitted_at":"2024-12-05T18:59:55Z","title":"NVILA: Efficient Frontier Visual Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04468","snapshot_observed_at":"2026-08-15T19:25:19.335254Z","title":"Nvila: Efficient frontier visual language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.335254Z"},"links":{"cited_paper":"/paper/2412.04468","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:658c04c7569411396a801b90ab35d06482138c84b3b3edf919ea3f6c72465aec","observation_id":"69889f48-d61c-42ca-b982-c7acbe558e68","resolution":{"observed_at":"2026-08-15T19:25:19.335254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.683416Z","title":"Frontier based exploration for autonomous robot,","venue":null,"work_id":"0e81c83c-b06e-4739-b116-09c428628606","year":2018},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.340239Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:e4755cd84ad888ba64ffd4763a6aff802e2e1078041b071306d27870f3f245b8","observation_id":"9d0824e5-be4c-48cb-88be-48e6afc8d122","resolution":{"observed_at":"2026-08-15T19:25:19.687419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06794","last_updated":"2023-06-05T17:55:12Z","snapshot_observed_at":"2026-08-16T15:49:09.216982Z","submitted_at":"2022-09-14T17:24:07Z","title":"PaLI: A Jointly-Scaled Multilingual Language-Image Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.06794","snapshot_observed_at":"2026-08-15T19:25:19.331049Z","title":"Available: https://arxiv.org/abs/2209.06794","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.331049Z"},"links":{"cited_paper":"/paper/2209.06794","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:78c9f70db62d9c6a9605dec156007ba55e4d2b5d4c13a73dd4d8cfc20404b353","observation_id":"abafff3f-b900-48d2-a66c-9ab8fd40bae1","resolution":{"observed_at":"2026-08-15T19:25:19.331049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.06757","last_updated":"2018-07-18T03:28:02Z","snapshot_observed_at":"2026-08-14T11:12:04.949259Z","submitted_at":"2018-07-18T03:28:02Z","title":"On Evaluation of Embodied Navigation Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.06757","snapshot_observed_at":"2026-08-15T19:25:19.347842Z","title":"On evalu- ation of embodied navigation agents,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.347842Z"},"links":{"cited_paper":"/paper/1807.06757","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:99f2e784b9eac612bf66bf8a9cb4fab184154f250a8644b496e59c33486cc548","observation_id":"62aa880c-d2f6-406f-bdd8-a7174025b588","resolution":{"observed_at":"2026-08-15T19:25:19.347842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.656350Z","title":"Yolov7: Trainable bag-of-freebies sets new state-of-the-art for real-time object detectors,","venue":null,"work_id":"27f06c61-6647-4941-98f2-46a0c12e2a3f","year":null},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.352077Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:84ee7ba2cae30a36be3d0d687f6f7185611374da1fc4a45a6478fffe45b2424b","observation_id":"bdf48b86-5c16-4717-9c72-edc2e8c453ec","resolution":{"observed_at":"2026-08-15T19:25:19.660563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.669950Z","title":"Ver: Scaling on-policy rl leads to the emergence of navigation in embodied rearrangement,","venue":null,"work_id":"1c53b241-4c18-4e36-8fda-f0efd1c2ff94","year":2022},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.344411Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:176a154c02020197db27b679335535d0629ea3b2b7d86741f8b349e708c22fd5","observation_id":"35c616ed-b541-41e4-af0b-0a3f5f25ecc6","resolution":{"observed_at":"2026-08-15T19:25:19.674521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-15T19:25:19.367137Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.367137Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:725f5400d67abf4ef9d5eac1e006c5c473ac4acf1874a3763d23cd3818db5b2b","observation_id":"e25df732-7ba8-48c2-a1b0-c2283f830bc8","resolution":{"observed_at":"2026-08-15T19:25:19.367137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14289","last_updated":"2023-07-01T07:26:22Z","snapshot_observed_at":"2026-08-12T07:11:05.316372Z","submitted_at":"2023-06-25T16:37:25Z","title":"Faster Segment Anything: Towards Lightweight SAM for Mobile Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14289","snapshot_observed_at":"2026-08-15T19:25:19.372145Z","title":"Faster segment anything: Towards lightweight sam for mobile applications,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.372145Z"},"links":{"cited_paper":"/paper/2306.14289","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:553be849e59cbd07811e234f272a7906b6f98cd255f59ba14f1ad77e0f64839b","observation_id":"08d1bc69-694a-4b10-b176-bd71d2ecabb6","resolution":{"observed_at":"2026-08-15T19:25:19.372145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.377263Z","title":"L3mvn: Leveraging large language models for visual target navigation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.377263Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:052c0e4c10f7649153393dce50b09674f872715aa0f9db6c29eb800faf8c987d","observation_id":"c6359c9e-5c66-4754-814b-77a9e7833d43","resolution":{"observed_at":"2026-08-15T19:25:19.377263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-07-06T03:42:37.507458Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-15T19:25:19.361565Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.361565Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:9463140417bde739eefdb57e4c45de7a7cfb3d163aaddee376b529df459c8ced","observation_id":"958275c8-8627-47b4-8b59-14b3c1fc2bc2","resolution":{"observed_at":"2026-08-15T19:25:19.361565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:19.387288Z","title":"Bridging zero-shot object navigation and foundation models through pixel-guided navigation skill,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.387288Z"},"links":{"citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:f03d05f3ef557e89c0228dd5e5d23c7f6804a98dbdefe2667278f822c364fa3c","observation_id":"4eb95dfd-7370-4bd8-b117-ed3fc8dacad1","resolution":{"observed_at":"2026-08-15T19:25:19.387288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09874","last_updated":"2024-10-13T15:31:31Z","snapshot_observed_at":"2026-08-16T13:09:54.147507Z","submitted_at":"2024-10-13T15:31:31Z","title":"ImagineNav: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09874","snapshot_observed_at":"2026-08-15T19:25:19.382409Z","title":"Imaginenav: Prompting vision- language models as embodied navigator through scene imagination,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.382409Z"},"links":{"cited_paper":"/paper/2410.09874","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:d339ae75e1a5a5a2d5991bfc8f3f96c9f70f589e929a401cda0483c1e5ea9a77","observation_id":"eefe3ada-35d9-496f-ac6d-53d309628757","resolution":{"observed_at":"2026-08-15T19:25:19.382409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-15T19:25:19.300479Z","title":"Available: https://arxiv.org/abs/2103.00020","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.300479Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:46928bf366972e9fb40b89928fc8b9209bd4863aae911cb6e8dce34e6cced134","observation_id":"ff2727f6-0e9f-4d78-9313-78087522ba10","resolution":{"observed_at":"2026-08-15T19:25:19.300479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02696","last_updated":"2022-07-06T14:01:58Z","snapshot_observed_at":"2026-08-17T13:14:56.017352Z","submitted_at":"2022-07-06T14:01:58Z","title":"YOLOv7: Trainable bag-of-freebies sets new state-of-the-art for real-time object detectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02696","snapshot_observed_at":"2026-08-15T19:25:19.356806Z","title":"Available: https://arxiv.org/abs/2207.02696","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.356806Z"},"links":{"cited_paper":"/paper/2207.02696","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:b84bc7abdb4eb8ea9eb137e28d401a06b01351ddb6d21e23c6183fd855260118","observation_id":"85c8bf57-266c-404e-b5b8-4a197c513bfe","resolution":{"observed_at":"2026-08-15T19:25:19.356806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.12403","last_updated":"2023-10-13T03:48:11Z","snapshot_observed_at":"2026-08-16T16:50:33.723741Z","submitted_at":"2022-06-24T17:59:02Z","title":"ZSON: Zero-Shot Object-Goal Navigation using Multimodal Goal Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.12403","snapshot_observed_at":"2026-08-15T19:25:19.313862Z","title":"Available: https://arxiv.org/abs/2206.12403","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:19.313862Z"},"links":{"cited_paper":"/paper/2206.12403","citing_paper":"/paper/2506.16623"},"observation_digest":"sha256:84b7e27452572ecf36fd5bfa19e9cfae2c367daee70999d79002c7344225d024","observation_id":"2607f2d5-0820-4109-aa2e-629fcd08a526","resolution":{"observed_at":"2026-08-15T19:25:19.313862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.16623","last_updated":"2025-06-19T21:50:16Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-17T01:55:12.329703Z","submitted_at":"2025-06-19T21:50:16Z","title":"History-Augmented Vision-Language Models for Frontier-Based Zero-Shot Object Navigation"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 3 inbound Pith citation observations for arXiv:2506.16623."}