{"as_of":"2026-08-23T17:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc4754f682822f6cd7166f6ef691f448448a0e512c3fdfc98ccd2d03cb93ca6c","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:39:00.235201Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T19:48:53.213389Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-14T19:49:25.790193Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"cited_work":{"arxiv_id":"2506.15377","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.15377","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient and generalizable environmental understanding for visual navigation","venue":null,"work_id":"5e1489ce-41f6-42f8-b2f0-eb11c8953383","year":2025},"citing_paper":{"arxiv_id":"2605.13037","last_updated":"2026-05-13T05:46:29Z","snapshot_observed_at":"2026-08-21T20:01:04.140616Z","submitted_at":"2026-05-13T05:46:29Z","title":"MAP: A Map-then-Act Paradigm for Long-Horizon Interactive Agent Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-14T19:48:53.213389Z"},"links":{"cited_paper":"/paper/2506.15377","citing_paper":"/paper/2605.13037"},"observation_digest":"sha256:a0e0235bf486ca83e1cfb5f091897e7df398de59212ae6b9027231d2be1842a7","observation_id":"5e4071c7-eeae-4e8d-abf4-41bdd5f5c1e4","resolution":{"observed_at":"2026-05-14T19:49:25.793467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.15377/citation-record","integrity":"/paper/2506.15377/integrity","json":"/paper/2506.15377/citation-record.json","paper":"/paper/2506.15377"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.167266Z","title":"Core challenges in embodied vision-language planning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.167266Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:16b1baaceec061b2e38ac1ac76370782ab4122a1ee2bd0343c651fc8e7667dd6","observation_id":"bfd2dd29-b826-4b71-8778-5792eb981b76","resolution":{"observed_at":"2026-08-15T19:38:58.167266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.201265Z","title":"Long short-term memory,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.201265Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:13cfc794c578fb0855ef6fa73db8fabc8863d653a3346723908c8a02b9ffec7f","observation_id":"f20faf1a-a0a2-4840-ac5c-59448cb45176","resolution":{"observed_at":"2026-08-15T19:38:58.201265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.206907Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.206907Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:4008847c669e7205357456e0438226e52215962a39dcfb0cdc79ae15418dee9c","observation_id":"98ea281e-1b5c-4856-8dc5-d274f0153694","resolution":{"observed_at":"2026-08-15T19:38:58.206907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.213561Z","title":"Simple but effective: Clip embeddings for embodied ai,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.213561Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:62ac2828bccf929407171edd4c188e797a12bdd6bbbcbce4eab6ee875368781a","observation_id":"2c175fb9-d863-4122-90b4-e981139281f7","resolution":{"observed_at":"2026-08-15T19:38:58.213561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:02.434110Z","title":"Optimal control of markov processes with incomplete state information i,","venue":null,"work_id":"43e309ee-8d49-40f4-92d1-79f1bb7d3ab0","year":1965},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.219321Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:c46f417b0ea03c81993a7e9cea928bde056b57253c734361f889129d4d4aa488","observation_id":"126ccc64-e4c4-4143-82cd-5d7dc4751d17","resolution":{"observed_at":"2026-08-15T19:39:02.506090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:02.368106Z","title":"Markov decision processes,","venue":null,"work_id":"dbc20346-7a46-4a61-b232-2cfe5c5b5a6c","year":1990},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.224818Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:6e6b15f13560c672094b2e5e442ede6ff23ecee586aaf03af95d1898c09723cb","observation_id":"a3de4885-f2df-4184-8601-d4d4cb0abf58","resolution":{"observed_at":"2026-08-15T19:39:02.374087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.231912Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.231912Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:35b65a4b05a3d48df2268189e37fbb260575b3b7ec97ed7c795a05da20e4b493","observation_id":"2bd909c4-6259-4c04-9a59-85ca9a4ed2aa","resolution":{"observed_at":"2026-08-15T19:38:58.231912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:02.341350Z","title":"Causal influence detection for improving efficiency in reinforcement learning,","venue":null,"work_id":"8a8c851a-955b-4051-a40a-5d7203fade3b","year":2021},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.290238Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:690d1d380fedaa078b049e8d981756aee67a783a83690ca20e5ac83c9b84e546","observation_id":"905fa4d7-f758-4067-bff1-b4ed9aac58ac","resolution":{"observed_at":"2026-08-15T19:39:02.346294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.374739Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.374739Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:70f8cd6f1e1813cb605539508a8d412da5741cdc40cc12efe6c4ee582e181d5e","observation_id":"cbbd0a9e-3f9e-4a3a-8e58-bd61f9d22bdb","resolution":{"observed_at":"2026-08-15T19:38:58.374739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:02.228885Z","title":"Lower and upper bounds for approximation of the kullback-leibler divergence between gaussian mixture models,","venue":null,"work_id":"647cf838-9d0b-44bb-af23-5f544a4b11c5","year":2012},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.380869Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:7fe98b3e9970dce95faa6ebdd16112c81a876c18bebe8b9443fab8e0caf0849e","observation_id":"9c78b6c6-4720-4970-8394-8610c4506f9c","resolution":{"observed_at":"2026-08-15T19:39:02.293331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:02.210354Z","title":"Causal curiosity: Rl agents discovering self-supervised experiments for causal representation learning,","venue":null,"work_id":"a94a5679-c5e4-417e-b4d5-fb0b664333e9","year":2021},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.457235Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:267bc179b3ee1893a76a5c03521fc1c842e27c03c4a7243b002cb9ed974e222c","observation_id":"ba30d486-8a57-4dad-b07f-813f56685749","resolution":{"observed_at":"2026-08-15T19:39:02.215593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.534493Z","title":"Curiosity-driven exploration by self-supervised prediction,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.534493Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:2a3e699f3efe25db72290075baeda47895763651e70f585098fad340d6bcab51","observation_id":"7c704ede-d37c-4307-bb03-b5a5c0641a81","resolution":{"observed_at":"2026-08-15T19:38:58.534493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:02.181274Z","title":"Look before you leap: Bridging model-free and model-based reinforcement learning for planned-ahead vision-and-language navigation,","venue":null,"work_id":"918ec137-c695-483d-b359-a09c6d1eea02","year":2018},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.542054Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:29efbb891c9162ae3ecbf59274b0cb377d3bc5b03ed8304a8e0f87b5264f8cf8","observation_id":"4b10c167-05aa-487c-bb4f-462e02153329","resolution":{"observed_at":"2026-08-15T19:39:02.187712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T19:38:58.549683Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.549683Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:bc07377367b3384a8d96d174404f6abb97488aeb64d38d4ba322935f4ad98b06","observation_id":"8a59d404-b44d-42d7-9b54-b3ae2d9fcd1e","resolution":{"observed_at":"2026-08-15T19:38:58.549683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:02.063062Z","title":"Robothor: An open simulation-to-real embodied ai platform,","venue":null,"work_id":"e8698399-372c-4868-b234-85fe6ddd9370","year":2020},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.561214Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:3c5ca319613fde239bab91dd72d9588d19cbedb23400ec7cf1391b0a9ec1f2c6","observation_id":"86428db6-cebe-481e-9686-5e01c292e976","resolution":{"observed_at":"2026-08-15T19:39:02.128882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.06158","last_updated":"2017-09-18T20:34:48Z","snapshot_observed_at":"2026-08-18T04:48:01.891163Z","submitted_at":"2017-09-18T20:34:48Z","title":"Matterport3D: Learning from RGB-D Data in Indoor Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.06158","snapshot_observed_at":"2026-08-15T19:38:58.570308Z","title":"Matterport3d: Learning from rgb-d data in indoor environments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.570308Z"},"links":{"cited_paper":"/paper/1709.06158","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:8389aefcfcfac06cde507665a862e8bc96bd097b95e5f1dfd61b5b5a35506704","observation_id":"2a7843a8-81e8-44a0-899f-b6aca1facedd","resolution":{"observed_at":"2026-08-15T19:38:58.570308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.640388Z","title":"Gibson env: Real-world perception for embodied agents,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.640388Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:6d662edd019789a3e791fa32c379e500f7d40ca9b1dfae1da062679726538bab","observation_id":"6aeec390-f68b-4bfc-8f85-907cf8e1beae","resolution":{"observed_at":"2026-08-15T19:38:58.640388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.674192Z","title":"Procthor: Large- scale embodied ai using procedural generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.674192Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:d393ce2a4b1d1424c715d9048078c5375c4b55fbd0656c55b64dcdda2e136e07","observation_id":"ab16c598-9c0a-4fc1-8d86-e16b51493e39","resolution":{"observed_at":"2026-08-15T19:38:58.674192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.934070Z","title":"Stubborn: A strong baseline for indoor object navigation,","venue":null,"work_id":"02a36512-2143-40ad-8594-07917ec82163","year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.685412Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:7975b093f2e865beae99431c0b28cf66f7be557e697ac72a4943c9523d53551e","observation_id":"c4b98323-39f2-41cf-98d7-6fb95ec5518f","resolution":{"observed_at":"2026-08-15T19:39:02.028838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.693896Z","title":"Thda: Treasure hunt data augmentation for semantic navigation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.693896Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:ae6e61bd8aaa46a1e1494c7d1f3f97ee63c1b82b6e4d261501b801f0aa887ad7","observation_id":"645024f7-8322-448b-a5a1-b07b8df797e6","resolution":{"observed_at":"2026-08-15T19:38:58.693896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.906806Z","title":"Habitat-web: Learning embodied object-search strategies from human demonstrations at scale,","venue":null,"work_id":"593ba106-657d-4772-902b-0c7dfdd93e5a","year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.785731Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:d7a20145718519435301dd0c3069cad22acb2e3cc470833699e91d8e3d3d4ea9","observation_id":"fc8d4f71-6355-41b1-ad8c-2f30f7a5de05","resolution":{"observed_at":"2026-08-15T19:39:01.912543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.812077Z","title":"Auxiliary tasks and exploration enable objectgoal navigation,","venue":null,"work_id":"ce0902a3-7875-49d4-90ff-20becef90528","year":2021},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.803217Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:6b4a09c0788cb2af030345056fc9c0580ca7fb6dd95a166032bc747c722bcdec","observation_id":"b428f94d-575f-4290-a522-04a6430ab9da","resolution":{"observed_at":"2026-08-15T19:39:01.849202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.813564Z","title":"Pirlnav: Pretraining with imitation and rl finetuning for objectnav,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.813564Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:afd7943d34cc15ef81c2845af35530dcd96b988c2b2ca39148556704c9d1fbd8","observation_id":"a5cbe1b0-d577-49db-aa96-f4ddcb363fb4","resolution":{"observed_at":"2026-08-15T19:38:58.813564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00357","last_updated":"2020-01-20T04:18:58Z","snapshot_observed_at":"2026-08-19T15:30:38.248912Z","submitted_at":"2019-11-01T13:07:37Z","title":"DD-PPO: Learning Near-Perfect PointGoal Navigators from 2.5 Billion Frames","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00357","snapshot_observed_at":"2026-08-15T19:38:58.824660Z","title":"Dd-ppo: Learning near-perfect pointgoal navigators from 2.5 billion frames,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.824660Z"},"links":{"cited_paper":"/paper/1911.00357","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:f0c6e545e99081a8727116e92423f04e03a068282e048ce43f8122705f3c4e97","observation_id":"4051859b-2480-4edf-9b8f-27366046d407","resolution":{"observed_at":"2026-08-15T19:38:58.824660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T19:38:58.968757Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.968757Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:0ed19df06ce96dbd167146c327c23d33a24cf8b5aa5ea232dfb7128d828a515c","observation_id":"44ad46c3-4f59-4c9d-85c0-d3cdc7abe755","resolution":{"observed_at":"2026-08-15T19:38:58.968757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.12760","last_updated":"2020-08-28T17:35:22Z","snapshot_observed_at":"2026-08-19T11:58:25.394160Z","submitted_at":"2020-08-28T17:35:22Z","title":"AllenAct: A Framework for Embodied AI Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.12760","snapshot_observed_at":"2026-08-15T19:38:58.991979Z","title":"Allenact: A framework for embodied ai research,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.991979Z"},"links":{"cited_paper":"/paper/2008.12760","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:d84597645cf75288f6a95eeddf4e9c801db518370ec1bb74f059f74585b122d4","observation_id":"4a37c1df-6b3b-414e-b703-dd4ce5de61a4","resolution":{"observed_at":"2026-08-15T19:38:58.991979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:58.998781Z","title":"Vision-and-language navigation: Interpreting visually-grounded navigation instructions in real environments,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:58.998781Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:d31083aa8b9e42b0c27b1a866644300b3bc86a75efe72fc774fbba5f30287855","observation_id":"5450958a-05eb-4a30-836d-ed4751676fcd","resolution":{"observed_at":"2026-08-15T19:38:58.998781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:59.007994Z","title":"Speaker- follower models for vision-and-language navigation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.007994Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:389278d19353fb1d366f309a79ced38e13f33ee08f89b5b63c4fc24cf62e18a2","observation_id":"0c865d1b-444d-4f76-99fd-61ff850a101f","resolution":{"observed_at":"2026-08-15T19:38:59.007994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.04195","last_updated":"2019-04-08T17:14:52Z","snapshot_observed_at":"2026-08-17T14:44:30.657958Z","submitted_at":"2019-04-08T17:14:52Z","title":"Learning to Navigate Unseen Environments: Back Translation with Environmental Dropout","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.04195","snapshot_observed_at":"2026-08-15T19:38:59.014350Z","title":"Learning to navigate unseen environ- ments: Back translation with environmental dropout,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.014350Z"},"links":{"cited_paper":"/paper/1904.04195","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:88fb8d8302d7325af01b0062d61b48d1ab5e04c76ee7fb67244adb34110cd5e9","observation_id":"94b72900-7811-45c4-bce2-24e2f29b567e","resolution":{"observed_at":"2026-08-15T19:38:59.014350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.07954","last_updated":"2020-10-15T18:01:15Z","snapshot_observed_at":"2026-08-20T08:38:25.415514Z","submitted_at":"2020-10-15T18:01:15Z","title":"Room-Across-Room: Multilingual Vision-and-Language Navigation with Dense Spatiotemporal Grounding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.07954","snapshot_observed_at":"2026-08-15T19:38:59.097188Z","title":"Room- across-room: Multilingual vision-and-language navigation with dense spatiotemporal grounding,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.097188Z"},"links":{"cited_paper":"/paper/2010.07954","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:836d6c27082b0fec66fdb43673e22e9794178df6101c1228e6ea6be5ff26af7a","observation_id":"70223ba6-7919-4ba5-9bd5-238504b91dc6","resolution":{"observed_at":"2026-08-15T19:38:59.097188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.627523Z","title":"Reverie: Remote embodied visual referring expression in real indoor environments,","venue":null,"work_id":"1e448ede-6057-4d37-9a3b-710dd4db09d1","year":2020},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.158952Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:b241cb19a0f40116e05842e06854e3af1fa84803120127c7d6241558da37e07c","observation_id":"9e341ffa-1ae8-4dc2-8786-c9e8364f8184","resolution":{"observed_at":"2026-08-15T19:39:01.705456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:59.166891Z","title":"History aware multimodal transformer for vision-and-language navigation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.166891Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:8df5f63248b480ea08d525a044dfc2f83b18d0b470533a05605902aa274aae44","observation_id":"dd4883ab-5bde-43d4-b9fa-8487d222925d","resolution":{"observed_at":"2026-08-15T19:38:59.166891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.599624Z","title":"Gpf-bg: A hierarchical vision-based planning framework for safe quadrupedal navigation,","venue":null,"work_id":"952ae4ac-cf9e-456b-bf4d-430440410d3e","year":2023},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.174853Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:d6945ca83201a1dfea52f34157e592775e7cba049c929981ed62fa1f45a7ecb6","observation_id":"70d049e2-d4f0-44bf-b543-4f1d6e40788e","resolution":{"observed_at":"2026-08-15T19:39:01.606565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.506273Z","title":"Topo- logical planning with transformers for vision-and-language navigation,","venue":null,"work_id":"c73d1f6a-2200-4ed8-a64f-b0d49a65a4db","year":2021},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.268442Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:cd1e9f5dcf5d5b1c53daf9b5e9803656bb024c9c6a9cff17d3a8e363afca3c4b","observation_id":"25d34b13-5dec-4d20-8572-735db0c22043","resolution":{"observed_at":"2026-08-15T19:39:01.565557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:59.322005Z","title":"Think global, act local: Dual-scale graph transformer for vision-and-language navigation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.322005Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:c31578ebf4e1cdbf05396190fac3a94887c5e570268f59dbd7816986f391201f","observation_id":"2fd7d028-312b-4f8d-ba8b-110252188bc7","resolution":{"observed_at":"2026-08-15T19:38:59.322005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.371202Z","title":"Gridmm: Grid memory map for vision-and-language navigation,","venue":null,"work_id":"6af961ed-7ae8-416e-ad30-bf18be7274be","year":2023},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.327754Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:9c234e2ef9e688e0f3480d139edbd00f07298a507f42141d235e2e65abacb8a6","observation_id":"95b1702e-2f55-4ba1-b06c-4a1669a30ab4","resolution":{"observed_at":"2026-08-15T19:39:01.413386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.353649Z","title":"Target-driven structured transformer planner for vision- language navigation,","venue":null,"work_id":"8008b181-5367-48f5-b505-eb6704d0c18a","year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.334430Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:523bba539ccb4b080c2bec41d41c7cb3a0eade00db107ff3f9db563b8958f29f","observation_id":"b454258b-92b3-409f-b826-e2cb8db7c830","resolution":{"observed_at":"2026-08-15T19:39:01.359308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.273331Z","title":"Kerm: Knowledge enhanced reasoning for vision-and-language navigation,","venue":null,"work_id":"70193ad2-c3cb-4004-a714-443412403588","year":2023},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.340223Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:68da3f7fbd21df70cf2bbcc714741d44e5469e4e30aeb4f259792fc3f8db1c28","observation_id":"61fc5f59-b338-4d2a-9ea9-52c1e150a61b","resolution":{"observed_at":"2026-08-15T19:39:01.324797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.225546Z","title":"Zero-shot object goal visual navigation,","venue":null,"work_id":"81a62885-0633-40e1-ac86-4d66b2f0297a","year":2023},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.346654Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:70d4b0eb0222990beea1f70da0252e03786f14c2a6193f87731665694d7032c6","observation_id":"c09cc297-87c9-4123-8668-3a8f0b409325","resolution":{"observed_at":"2026-08-15T19:39:01.231983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05363","last_updated":"2024-05-08T18:45:37Z","snapshot_observed_at":"2026-08-21T04:29:20.122963Z","submitted_at":"2024-05-08T18:45:37Z","title":"LOC-ZSON: Language-driven Object-Centric Zero-Shot Object Retrieval and Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05363","snapshot_observed_at":"2026-08-15T19:38:59.412224Z","title":"Loc-zson: Language-driven object-centric zero-shot object retrieval and navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.412224Z"},"links":{"cited_paper":"/paper/2405.05363","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:3d57ab4523d4c6adf37f51434bef8947a7485a115e9bd80049a8ac3167fec311","observation_id":"bb249b6c-f7f8-4a06-8505-7bf7789e36c4","resolution":{"observed_at":"2026-08-15T19:38:59.412224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18892","last_updated":"2024-04-26T02:16:11Z","snapshot_observed_at":"2026-08-20T20:00:05.485528Z","submitted_at":"2024-02-29T06:31:18Z","title":"Aligning Knowledge Graph with Visual Perception for Object-goal Navigation","version":2},"cited_work":{"arxiv_id":"2402.18892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.18892","snapshot_observed_at":"2026-08-15T19:39:00.791337Z","title":"Aligning Knowledge Graph with Visual Perception for Object-goal Navigation","venue":"cs.CV","work_id":"d631b4f0-3a21-4f19-a1a4-75d2b9d4093d","year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.486206Z"},"links":{"cited_paper":"/paper/2402.18892","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:2d3bb47691e9ab7c5f0e14f9afd7cb6c8b2d5540e271eb5d9b90a4ed4438ea6f","observation_id":"22ec1165-d138-4571-9a52-3af53c45aad3","resolution":{"observed_at":"2026-08-15T19:39:00.816872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.03267","last_updated":"2024-03-12T09:01:54Z","snapshot_observed_at":"2026-08-20T00:35:14.102328Z","submitted_at":"2022-11-07T02:24:39Z","title":"Prompter: Utilizing Large Language Model Prompting for a Data Efficient Embodied Instruction Following","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.03267","snapshot_observed_at":"2026-08-15T19:38:59.493625Z","title":"Prompter: Utilizing large language model prompting for a data efficient embodied instruction following,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.493625Z"},"links":{"cited_paper":"/paper/2211.03267","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:1df6a04e030d32215b0add7c25f378233ba06efd35111f5bc41253ba443fd75b","observation_id":"c232ffcf-4ea1-4dbb-b24b-a696f8fe50d5","resolution":{"observed_at":"2026-08-15T19:38:59.493625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.139958Z","title":"A persistent spatial semantic representation for high-level natural language instruction execution,","venue":null,"work_id":"d1838462-3bcc-48f3-9e8a-d914a2841bd8","year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.501206Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:1fc7b72159a57d4bbdb7a4ef762731501202059c80720b5640f84510be91af04","observation_id":"a6088fb6-26b9-4cef-9289-fbeed1bdc18a","resolution":{"observed_at":"2026-08-15T19:39:01.207565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:59.508709Z","title":"A survey of embodied ai: From simulators to research tasks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.508709Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:dd193630ddf9fb4f7ec1190af3f0e6a3f99f59985bdeafd6e91425554964bb16","observation_id":"a104c141-d9d8-41d6-83ae-3b9015f82ce3","resolution":{"observed_at":"2026-08-15T19:38:59.508709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:59.514489Z","title":"Navgpt: Explicit reasoning in vision- and-language navigation with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.514489Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:39d7a0bda2595b85e639bcfa01c518769c9fe6c8893e82f63a3c630708339c2d","observation_id":"4585f9d8-f21c-4882-b490-eebfc7cdabca","resolution":{"observed_at":"2026-08-15T19:38:59.514489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:01.031856Z","title":"Discuss before moving: Visual language navigation via multi-expert discussions,","venue":null,"work_id":"5beb9ff0-480c-4e74-a216-f739579b4bc1","year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.565457Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:eb1cd3c26213686879dae57ab7c36257d0e5eca7f2eff57ed06bed7798ec5b1c","observation_id":"cd2c8ce3-a690-4e86-bb24-c8b149bf80b5","resolution":{"observed_at":"2026-08-15T19:39:01.105878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07314","last_updated":"2024-06-20T07:23:45Z","snapshot_observed_at":"2026-08-18T08:40:37.716014Z","submitted_at":"2024-01-14T15:34:48Z","title":"MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07314","snapshot_observed_at":"2026-08-15T19:38:59.611783Z","title":"Mapgpt: Map-guided prompting for unified vision-and-language navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.611783Z"},"links":{"cited_paper":"/paper/2401.07314","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:04b06cffe9ede3d60840f690870312c0ad31e947a62d01f4779e1d11eb1b6d55","observation_id":"0fe28681-a1a5-46f2-b2b0-44c21e4fdf7d","resolution":{"observed_at":"2026-08-15T19:38:59.611783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:59.617880Z","title":"Bridging zero-shot object navigation and foundation models through pixel-guided navigation skill,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.617880Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:bcb0a3ce227b8005baa0fc804accd08d6c7113a6ce23b8c61ac5b7919e65520e","observation_id":"32a084b8-6187-44c6-b4b4-d4ba22e19182","resolution":{"observed_at":"2026-08-15T19:38:59.617880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T19:38:59.666718Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.666718Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:e5cb7f555868a2a51e3d4a2966b5bef5717ed4572d4ed2402c54b1494cf7f5c1","observation_id":"ea202836-c2ae-4d81-b4b6-3032bd26687f","resolution":{"observed_at":"2026-08-15T19:38:59.666718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07889","last_updated":"2024-03-30T22:00:22Z","snapshot_observed_at":"2026-08-18T09:16:54.730430Z","submitted_at":"2023-10-11T20:52:30Z","title":"LangNav: Language as a Perceptual Representation for Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07889","snapshot_observed_at":"2026-08-15T19:38:59.755816Z","title":"Langnav: Language as a perceptual representation for navigation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.755816Z"},"links":{"cited_paper":"/paper/2310.07889","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:5c96b9b4ad1f7fbb08b49e60960ab6f24d6ddad847b0df28c51cdee269890dc9","observation_id":"ea06a66a-aa08-4210-9d78-85b5ea0d33c6","resolution":{"observed_at":"2026-08-15T19:38:59.755816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07376","last_updated":"2025-03-22T11:04:36Z","snapshot_observed_at":"2026-08-20T08:35:32.354944Z","submitted_at":"2024-03-12T07:27:02Z","title":"NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07376","snapshot_observed_at":"2026-08-15T19:38:59.805652Z","title":"Navcot: Boosting llm-based vision-and-language navigation via learning disentangled reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.805652Z"},"links":{"cited_paper":"/paper/2403.07376","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:3487d3c51cb2c35fdc6dd7a1482725630045eaf1ed9e73ea0eddc88b69a0a765","observation_id":"4c46774f-d34e-45a6-adb3-a6d02e5feaed","resolution":{"observed_at":"2026-08-15T19:38:59.805652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:59.812205Z","title":"Towards learning a generalist model for embodied navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.812205Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:80dd3034a02d6355ed4f725a0b9411eaa655bb05af2bdfa8f7c70ba539fd35c1","observation_id":"c461bcec-7d7b-412c-826c-b458c103e7b7","resolution":{"observed_at":"2026-08-15T19:38:59.812205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T19:38:59.818371Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.818371Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:46662247646068a9baf3b9aa82b6153730bdb4bf62e277f5eaf356beddcc1192","observation_id":"5080dfd5-f717-484b-a233-55259ac2a385","resolution":{"observed_at":"2026-08-15T19:38:59.818371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:00.966986Z","title":"Interventional few-shot learning,","venue":null,"work_id":"719864be-ddca-4398-a140-194f7094a1ba","year":2020},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.823673Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:550b2122d203cfb9e3fa3658f72dec29312876358519d474e7927b93b12a2d48","observation_id":"113b6cf1-4b18-4446-a366-2371662ddaa2","resolution":{"observed_at":"2026-08-15T19:39:00.998787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.02023","last_updated":"2017-09-14T22:52:47Z","snapshot_observed_at":"2026-08-15T05:59:06.977382Z","submitted_at":"2017-09-06T22:53:12Z","title":"CausalGAN: Learning Causal Implicit Generative Models with Adversarial Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.02023","snapshot_observed_at":"2026-08-15T19:38:59.829516Z","title":"Causalgan: Learning causal im- plicit generative models with adversarial training,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.829516Z"},"links":{"cited_paper":"/paper/1709.02023","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:b05351ec48398bcfb3df9257238127ffd2a8499b38b3c80ef29be07f7a17549f","observation_id":"a03afd20-fa16-4466-b1ad-bc2bb6734025","resolution":{"observed_at":"2026-08-15T19:38:59.829516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01452","last_updated":"2023-11-21T03:43:15Z","snapshot_observed_at":"2026-08-16T15:18:58.111401Z","submitted_at":"2023-07-04T03:00:43Z","title":"Causal Reinforcement Learning: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01452","snapshot_observed_at":"2026-08-15T19:38:59.954608Z","title":"Causal reinforcement learning: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.954608Z"},"links":{"cited_paper":"/paper/2307.01452","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:7792ee3c3615e31e63d913da797aa658468277c0ac06832c5f4146e5dd892173","observation_id":"6b6b76e1-f169-4f88-93bd-e27426ee9d86","resolution":{"observed_at":"2026-08-15T19:38:59.954608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:38:59.995405Z","title":"Causal confusion in imitation learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T19:38:59.995405Z"},"links":{"citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:4269828c130a9e5bbe2bce3806a657245a6b0eddf684deda69e5986eefd6fa6b","observation_id":"24671f56-3da3-46df-a40c-3b275760e7cb","resolution":{"observed_at":"2026-08-15T19:38:59.995405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06665","last_updated":"2024-04-29T23:21:33Z","snapshot_observed_at":"2026-08-19T05:17:20.406773Z","submitted_at":"2024-02-06T17:15:33Z","title":"The Essential Role of Causality in Foundation World Models for Embodied AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06665","snapshot_observed_at":"2026-08-15T19:39:00.001039Z","title":"The essential role of causality in foundation world models for embodied ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T19:39:00.001039Z"},"links":{"cited_paper":"/paper/2402.06665","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:d754133c7129909d4ac6a3d95633283ebb256e36560a8ca952e75e3bc78d39b7","observation_id":"3eedfd56-8dad-44be-b4ce-4208a7e50bbf","resolution":{"observed_at":"2026-08-15T19:39:00.001039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10742","last_updated":"2021-04-07T01:57:14Z","snapshot_observed_at":"2026-08-21T10:04:31.859072Z","submitted_at":"2020-06-18T17:59:35Z","title":"Learning Invariant Representations for Reinforcement Learning without Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10742","snapshot_observed_at":"2026-08-15T19:39:00.009760Z","title":"Learning invariant representations for reinforcement learning without reconstruction,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T19:39:00.009760Z"},"links":{"cited_paper":"/paper/2006.10742","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:adcf42c2b13fe71b7c045b57333c0e0920696ac9819348014161f0dd16ce9b21","observation_id":"262d9d42-3a04-4d69-956b-7a8c212f3858","resolution":{"observed_at":"2026-08-15T19:39:00.009760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14228","last_updated":"2020-12-28T13:44:36Z","snapshot_observed_at":"2026-08-19T23:08:24.553574Z","submitted_at":"2020-12-28T13:44:36Z","title":"Causal World Models by Unsupervised Deconfounding of Physical Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14228","snapshot_observed_at":"2026-08-15T19:39:00.036333Z","title":"Causal world models by unsupervised deconfounding of physical dynamics,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T19:39:00.036333Z"},"links":{"cited_paper":"/paper/2012.14228","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:d4204481036c9fd2fb3f7303fc89d4fe5fd2c3ebfdd2b2c41e1c345623231a59","observation_id":"6dab8363-cf39-4221-9c82-b64bb210cc34","resolution":{"observed_at":"2026-08-15T19:39:00.036333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.04892","last_updated":"2022-08-09T16:48:28Z","snapshot_observed_at":"2026-08-22T22:39:53.828426Z","submitted_at":"2022-08-09T16:48:28Z","title":"Intrinsically Motivated Learning of Causal World Models","version":1},"cited_work":{"arxiv_id":"2208.04892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.04892","snapshot_observed_at":"2026-08-15T19:39:00.511806Z","title":"Intrinsically Motivated Learning of Causal World Models","venue":"cs.AI","work_id":"16bd45ea-57d2-48b8-b465-0905833b9a12","year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T19:39:00.113480Z"},"links":{"cited_paper":"/paper/2208.04892","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:372ac75ebda727cab4f736e8657734f26d8258982bd5894b07527953db7ee062","observation_id":"fc873ce4-abe0-4a35-9992-b02463ef8743","resolution":{"observed_at":"2026-08-15T19:39:00.517260Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05217","last_updated":"2020-12-07T19:40:05Z","snapshot_observed_at":"2026-08-20T09:35:08.065459Z","submitted_at":"2020-02-12T20:20:47Z","title":"Resolving Spurious Correlations in Causal Models of Environments via Interventions","version":2},"cited_work":{"arxiv_id":"2002.05217","doi":null,"metadata_source":"pith","pith_arxiv_id":"2002.05217","snapshot_observed_at":"2026-08-15T19:39:00.420526Z","title":"Resolving Spurious Correlations in Causal Models of Environments via Interventions","venue":"cs.LG","work_id":"9fda8fdb-ab02-472e-83e0-d4b34e5931be","year":2020},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T19:39:00.119880Z"},"links":{"cited_paper":"/paper/2002.05217","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:d08d24d1c72e5e820c15d9739080c424c3fc5b43b5febbc0f18e0d41cff8d79e","observation_id":"28dff616-3e6b-4d0e-b2ba-00e7f4b93858","resolution":{"observed_at":"2026-08-15T19:39:00.490272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01474","last_updated":"2022-06-03T09:53:57Z","snapshot_observed_at":"2026-08-19T21:31:28.619492Z","submitted_at":"2022-06-03T09:53:57Z","title":"Offline Reinforcement Learning with Causal Structured World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01474","snapshot_observed_at":"2026-08-15T19:39:00.128075Z","title":"Offline reinforcement learning with causal structured world models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T19:39:00.128075Z"},"links":{"cited_paper":"/paper/2206.01474","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:facc3c8716cb434db0a390509785fcd30998d373be5205bfa5a09af025005f54","observation_id":"500d7fa8-1aa6-4655-b311-937732dc6220","resolution":{"observed_at":"2026-08-15T19:39:00.128075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.13452","last_updated":"2022-06-27T17:02:53Z","snapshot_observed_at":"2026-08-22T05:28:39.939013Z","submitted_at":"2022-06-27T17:02:53Z","title":"Causal Dynamics Learning for Task-Independent State Abstraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.13452","snapshot_observed_at":"2026-08-15T19:39:00.135621Z","title":"Causal dynam- ics learning for task-independent state abstraction,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T19:39:00.135621Z"},"links":{"cited_paper":"/paper/2206.13452","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:890f67c127b54cef49d9138388e0492e7ddfd8d7f1d348a927ae4b0a3a8b311e","observation_id":"97d3f661-2a19-4156-8f90-d501895639de","resolution":{"observed_at":"2026-08-15T19:39:00.135621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09850","last_updated":"2021-06-07T14:29:09Z","snapshot_observed_at":"2026-08-22T22:39:43.285672Z","submitted_at":"2021-02-19T10:37:54Z","title":"Model-Invariant State Abstractions for Model-Based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2102.09850","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.09850","snapshot_observed_at":"2026-08-15T19:39:00.296271Z","title":"Model-Invariant State Abstractions for Model-Based Reinforcement Learning","venue":"cs.LG","work_id":"cebce44b-f2c3-4cb2-ba29-2185d0209fc9","year":2021},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T19:39:00.190586Z"},"links":{"cited_paper":"/paper/2102.09850","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:24247c43f54534b0e7c55a46008b5d592f12cfc079ff33870a8b60acaa406d7e","observation_id":"dbd88af9-d7f1-4856-9e1c-06b394208f46","resolution":{"observed_at":"2026-08-15T19:39:00.365194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10877","last_updated":"2024-07-19T11:12:08Z","snapshot_observed_at":"2026-08-16T14:17:53.657912Z","submitted_at":"2024-02-16T18:29:19Z","title":"Robust agents learn causal world models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10877","snapshot_observed_at":"2026-08-15T19:39:00.235201Z","title":"Robust agents learn causal world models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T19:39:00.235201Z"},"links":{"cited_paper":"/paper/2402.10877","citing_paper":"/paper/2506.15377"},"observation_digest":"sha256:beac5fbeffddc03815835ee2b6368c051a6705778d7445841c295714be8101a4","observation_id":"cbfde439-13e7-4088-a6c9-1403db300849","resolution":{"observed_at":"2026-08-15T19:39:00.235201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.15377","last_updated":"2025-06-18T11:47:02Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T09:09:17.028029Z","submitted_at":"2025-06-18T11:47:02Z","title":"Efficient and Generalizable Environmental Understanding for Visual Navigation"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":4,"verified_fuzzy":20},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 1 inbound Pith citation observation for arXiv:2506.15377."}