{"as_of":"2026-08-20T08:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:782da4901fe8f1fefd5826892aead1f52cf77e4ec37f8323963b94057f0a80f9","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:53:42.217995Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12860/citation-record","integrity":"/paper/2608.12860/integrity","json":"/paper/2608.12860/citation-record.json","paper":"/paper/2608.12860"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:46.195854Z","title":"Optimization based full body control for the atlas robot,","venue":null,"work_id":"6485e00a-1763-4460-ba13-cba0ee31c16e","year":2014},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:38.741342Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:6ab04e5c2539c24d51c9a955d3435eae579ea227be40765739f0a0b568cccf3e","observation_id":"8850e181-aad4-4053-9f61-02f71174eb1c","resolution":{"observed_at":"2026-08-15T21:53:46.207260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02116","last_updated":"2025-04-19T18:59:07Z","snapshot_observed_at":"2026-08-16T12:59:45.278940Z","submitted_at":"2025-01-03T22:00:53Z","title":"Humanoid Locomotion and Manipulation: Current Progress and Challenges in Control, Planning, and Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02116","snapshot_observed_at":"2026-08-15T21:53:38.795320Z","title":"Humanoid locomotion and manipulation: Current progress and challenges in control, planning, and learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:38.795320Z"},"links":{"cited_paper":"/paper/2501.02116","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:29f41c26dd296dac58d463ba02a30888b67fbff8c6ab68e85f42dbb454c63671","observation_id":"2d6431bb-e558-4c02-9709-0d0f72844df9","resolution":{"observed_at":"2026-08-15T21:53:38.795320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:46.163925Z","title":"Vision-and-language nav- igation: Interpreting visually-grounded navigation instructions in real environments,","venue":null,"work_id":"2a8b67d0-bd4e-4c78-8756-79da86eff392","year":2018},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:38.915937Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:0aa9d4b2e885e6c5ca6ae880a5a071981e76c8296a749003823db96c41fc24a8","observation_id":"c72effe9-40d0-47d6-892b-8d021f9c246d","resolution":{"observed_at":"2026-08-15T21:53:46.170518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:46.122000Z","title":"Collaborative dialogue in minecraft,","venue":null,"work_id":"4460444b-58b5-43d1-8b3e-43506fb5ce81","year":2019},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:39.042928Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:578ea6f34d6ff0ffaa9e6a9d7e130164974145249aeb9254eb26f71c4f33fead","observation_id":"7d35e317-e2c9-4066-96ad-42c5d38922c1","resolution":{"observed_at":"2026-08-15T21:53:46.144448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.06158","last_updated":"2017-09-18T20:34:48Z","snapshot_observed_at":"2026-08-18T04:48:01.891163Z","submitted_at":"2017-09-18T20:34:48Z","title":"Matterport3D: Learning from RGB-D Data in Indoor Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.06158","snapshot_observed_at":"2026-08-15T21:53:39.260005Z","title":"Matterport3d: Learning from rgb-d data in indoor environments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:39.260005Z"},"links":{"cited_paper":"/paper/1709.06158","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:e0554d388aa7abd0d66cf4cc7e9a34c910bb30df742d34f53fe6e150ea356fdc","observation_id":"284ff9fe-ab1a-4322-9d99-262398b8b2e6","resolution":{"observed_at":"2026-08-15T21:53:39.260005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:46.002905Z","title":"Grutopia: Dream general robots in a city at scale,","venue":null,"work_id":"53ce4444-52e8-4dc8-ae17-1e3369b034cf","year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:39.677646Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:242555eb53b7cff2c3ac4978aef46356864b606d54ffcb38edfb08608605f7e6","observation_id":"cf0ae7f2-c4b7-46ab-861c-8e39cd55f7b1","resolution":{"observed_at":"2026-08-15T21:53:46.059005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.251850Z","title":"Towards physically executable 3d gaussian for embodied navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.251850Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:5c6cf51409d1e33d3a3e6e35b2041546c9c010218348e2a99ab881aa66bab27e","observation_id":"ee48fd50-ad43-4c4f-a530-4a2f3caa6c63","resolution":{"observed_at":"2026-08-15T21:53:40.251850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.942649Z","title":"3d gaussian splatting for real-time radiance field rendering.,","venue":null,"work_id":"e6e79df6-8b9b-4b32-b29a-e7ac75c50a50","year":2023},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.262586Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:07ae1f48b0558b22be8269650600b33a24a7866190eecd3b700e2f5b2fe8bb94","observation_id":"401b6f31-2e04-4ee6-b32f-20121411f00f","resolution":{"observed_at":"2026-08-15T21:53:45.956921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.307907Z","title":"Vlnverse: A benchmark for vision- language navigation with versatile, embodied, realistic simulation and evaluation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.307907Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:2f99aee4e71c42d53bef571e2bdd02e0a23758e50caaf75aa1fb385b38ee7446","observation_id":"5f507701-020b-47e7-9c2f-ddabcac489bf","resolution":{"observed_at":"2026-08-15T21:53:40.307907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.886711Z","title":"Habitat: A platform for embodied ai research,","venue":null,"work_id":"241db653-46b4-4542-8783-aca4f3087d8d","year":2019},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.380281Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:6e80b2fa668e2dc58b1fae73f652d551978868d5d02cc1f7b4196b11c20420bb","observation_id":"82971a8e-b263-4150-aa02-0ba94042015d","resolution":{"observed_at":"2026-08-15T21:53:45.905574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-15T21:53:40.422070Z","title":"Ai2-thor: An inter- active 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.422070Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:47d13c002f5ba97d48fd0825cc72aa2647d728266a873dcbbf3ab5f3baa281eb","observation_id":"9e39a8b9-e8f2-40ce-9f38-fd9a7cf82318","resolution":{"observed_at":"2026-08-15T21:53:40.422070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.436241Z","title":"Airsim: High-fidelity visual and physical simulation for autonomous vehicles,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.436241Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:ef7c4d2a83994f52f18dad9ab3b35103396be37923ed9b97def420b29c34c4f1","observation_id":"99171fbb-ea7b-4ddf-90c6-a1eb574df9aa","resolution":{"observed_at":"2026-08-15T21:53:40.436241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.611780Z","title":"Rethinking the embodied gap in vision- and-language navigation: A holistic study of physical and visual disparities,","venue":null,"work_id":"b3b26a40-cb01-41e8-b5eb-b4814ad5b0b2","year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.449711Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:5756a683fe72b4750c8d791454668040f1a6e302f1f5a65c435c8e327c421c60","observation_id":"455b3844-d0da-43f4-a43a-8970991fe07c","resolution":{"observed_at":"2026-08-15T21:53:45.707651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.508184Z","title":"3d gaussian ray tracing: Fast tracing of particle scenes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.508184Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:ec9678c1325bdab2a879506e114eae50b63c665ea09eb748d72fe3d63572e19c","observation_id":"3d5023b3-f65d-4cbf-ab5c-e76f34f59398","resolution":{"observed_at":"2026-08-15T21:53:40.508184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:40.600968Z","title":"3dgut: Enabling distorted cameras and secondary rays in gaussian splatting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.600968Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:4a4d891113fb5f60ee3576869b74414b2e3885bd2f8a5b3dba2b0ab743046c05","observation_id":"a44b9be2-50de-4cca-9cbf-7640990ecf7d","resolution":{"observed_at":"2026-08-15T21:53:40.600968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.383997Z","title":"Stay on the path: Instruction fidelity in vision-and-language naviga- tion,","venue":null,"work_id":"628b077d-446c-4a73-abbf-c82e95a2e27e","year":2019},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.668543Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:b71e9a671b5822cfc59ca2ef03d1601c09e6d00ea4aaf780ebcc68b0af24b123","observation_id":"3005c6ab-9e84-4492-b42e-13803102626f","resolution":{"observed_at":"2026-08-15T21:53:45.456070Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.236274Z","title":"Room- across-room: Multilingual vision-and-language navigation with dense spatiotemporal grounding,","venue":null,"work_id":"c221b2f5-cb58-4d13-b8ea-e93ee07cf11b","year":2020},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.757992Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:ae85ed850c1cbdbfa8fc83e80cbddf09e6c6748822b23bd21270af77ac24c0c4","observation_id":"445bcd59-c57b-480b-99e2-a906cee2e13e","resolution":{"observed_at":"2026-08-15T21:53:45.316660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.170184Z","title":"Reverie: Remote embodied visual referring expression in real indoor environments,","venue":null,"work_id":"93fb5e6f-e8b8-48ab-aebc-38d56987173e","year":2020},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.795980Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:238fdd7e3939352cbb9ab653b1cd96873c33b7513110e0aad9d6ef05f19bbe37","observation_id":"7845e6b2-444e-4849-a5b0-be2de87bfc11","resolution":{"observed_at":"2026-08-15T21:53:45.195203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:45.111724Z","title":"Soon: Scenario oriented object navigation with graph-based exploration,","venue":null,"work_id":"c1cea4a7-5c2f-4b5e-8030-ac132c2319e4","year":2021},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.807155Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:263cdd56ed8089e7f25f58f51cf3b4c295a615ad75357546d26bdbfbf090c4f3","observation_id":"ea9e9ecb-1c18-47f7-8ab5-991b19810827","resolution":{"observed_at":"2026-08-15T21:53:45.126219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.969187Z","title":"Vision- and-dialog navigation,","venue":null,"work_id":"79c27488-7b70-400a-8508-856e3bfbef17","year":2020},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.814475Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:16963e559db7fb90175a41e7708e17b31a7c26ea193b5841da05a4a925b3f418","observation_id":"24a58abe-0f6d-4bae-9e95-f4717c89fa8d","resolution":{"observed_at":"2026-08-15T21:53:45.021923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.885554Z","title":"Vision-based nav- igation with language-based assistance via imitation learning with indirect intervention,","venue":null,"work_id":"c6405cc9-6bef-4a08-961d-0c006c1a9fe1","year":2019},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.919868Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:8f4a4684734a50d5a91021916de0a7aea7471610ddf88ac0aee2c8829ab2b384","observation_id":"41cdb3ca-c7c2-4579-b1b5-3983b9f1f9ed","resolution":{"observed_at":"2026-08-15T21:53:44.919953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.746081Z","title":"Beyond the nav-graph: Vision-and-language navigation in continuous environ- ments,","venue":null,"work_id":"1d0af0d6-7475-44ef-9c9b-1dcc53e024ee","year":2020},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:40.982003Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:edd3f9e12d4bf79a04087564bb06c675f48f32ce5c47e598619d6a86eb689514","observation_id":"0c8167d4-abdb-4e61-8204-fb2080361841","resolution":{"observed_at":"2026-08-15T21:53:44.809907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.635789Z","title":"Towards long-horizon vision-language navigation: Platform, benchmark and method,","venue":null,"work_id":"8ce52958-92ae-485f-a81b-05e46bc91a66","year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.005738Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:a0a628c88d8b34c726836bf38ddf9b945fbb844b5e24e4f1de3f8ed96a6dfdcc","observation_id":"f2724438-cef8-4751-93fc-46fa9fbcb815","resolution":{"observed_at":"2026-08-15T21:53:44.652701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.512822Z","title":"Human-aware vision-and-language navigation: Bridging simulation to reality with dynamic human inter- actions,","venue":null,"work_id":"5fd89216-2072-4298-893c-930681807607","year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.101358Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:15d88f03132df6dfd2b7b874705fca116bfe987c478db49f47532f09f83c9b9d","observation_id":"da9166cf-390c-46ec-9276-53e50e6944cd","resolution":{"observed_at":"2026-08-15T21:53:44.574348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17403","last_updated":"2025-01-29T03:57:56Z","snapshot_observed_at":"2026-08-19T15:06:15.286138Z","submitted_at":"2025-01-29T03:57:56Z","title":"General Scene Adaptation for Vision-and-Language Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17403","snapshot_observed_at":"2026-08-15T21:53:41.192201Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.192201Z"},"links":{"cited_paper":"/paper/2501.17403","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:e5c9840e21f12d839f001a95008fb405ae1cb12647145f61a7a5014b37f72d17","observation_id":"3039ad18-0c5a-42f4-8c0a-9379d0803090","resolution":{"observed_at":"2026-08-15T21:53:41.192201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:41.245454Z","title":"gsplat: An open-source library for gaussian splatting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.245454Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:50747907e3803f8af459e7430ee86c0cd907818a823215800669040f856bb529","observation_id":"cd93fdd8-7cea-455c-8990-9390df0771e1","resolution":{"observed_at":"2026-08-15T21:53:41.245454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.415813Z","title":"2d gaussian splatting for geometrically accurate radiance fields,","venue":null,"work_id":"efd6d801-468c-40a1-8228-66b3782ceec5","year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.257585Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:5ecf78a5645210c43fded8654a7e0710ed9a0cc8c31b9ab3e6707be73a86aecd","observation_id":"e4c8d764-5863-403e-bdac-f9fb1fc55874","resolution":{"observed_at":"2026-08-15T21:53:44.431882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.309704Z","title":"Sparse voxels ras- terization: Real-time high-fidelity radiance field rendering,","venue":null,"work_id":"7b539aaf-5bce-4eba-a935-e0dc7ebfdf50","year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.558475Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:a1812d6141f79eea3dcba6e21fc63821fce16874cbdf6cefae82e6f1f5845915","observation_id":"7755b901-2c53-4546-8fb7-399bdc0a7eb8","resolution":{"observed_at":"2026-08-15T21:53:44.375549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.242732Z","title":"Habitat-gs: A high-fidelity navigation simulator with dynamic gaussian splatting,","venue":null,"work_id":"29da5d96-5041-4922-9d43-3a1d7868c617","year":2026},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.666703Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:6f02c64fcf8d9329b5a3d9ab5e37244877c182c40a8744dea5935467b636c713","observation_id":"9df11dcf-1329-49a9-88a1-1c4e02ca8fd3","resolution":{"observed_at":"2026-08-15T21:53:44.255424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.186202Z","title":"Pgsr: Planar-based gaussian splatting for efficient and high-fidelity surface reconstruction,","venue":null,"work_id":"b5eb4ba7-8721-4e9c-85b8-a295017448e1","year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.716801Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:17b931a57aa9d0b0f538b0db61ea5633ad85db6459a2111d425e2c6c7d639f7f","observation_id":"f03a4f04-39d1-4a26-a4f1-1d9a40fdd819","resolution":{"observed_at":"2026-08-15T21:53:44.197702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:44.029212Z","title":"Kinectfusion: Real-time dense surface mapping and tracking,","venue":null,"work_id":"3353c4b1-e551-4708-be28-5e66f649c73f","year":2011},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.775904Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:46a56345c2f75fbe29c5ca87fd7081a1e497700559022098f6d61d0a77e2d28b","observation_id":"cf251642-b136-40fe-b9dc-7c0b1b48a33d","resolution":{"observed_at":"2026-08-15T21:53:44.106979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:41.827041Z","title":"Structure-from-motion revisited,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.827041Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:8d97a07e5ab3bfdd751a3fd4d9e52667d7f82e57b55d8eefa8ed4284c9f735c4","observation_id":"ee2e69a0-8667-41d2-abbc-631579574f3a","resolution":{"observed_at":"2026-08-15T21:53:41.827041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:41.853446Z","title":"Pixel- wise view selection for unstructured multi-view stereo,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.853446Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:246ad779d98e1b8c6d004cbb40dfab48ce929b70cb1556b88a9a4648bd1afa86","observation_id":"0e807059-22c0-4ab2-abed-1617b862943c","resolution":{"observed_at":"2026-08-15T21:53:41.853446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-15T21:53:41.879726Z","title":"Qwen3-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.879726Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:8d5f4bc16757027ebe01991a39047afd67b187626b16ef7985b704caa2306607","observation_id":"2252faf0-c937-488f-ae50-342aceb6ed2c","resolution":{"observed_at":"2026-08-15T21:53:41.879726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:43.663384Z","title":"Gemma 4 technical report,","venue":null,"work_id":"f499f6a3-5feb-4e55-ab7f-b82265c9a15e","year":2026},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.888286Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:ae5902bac17032ac57d4493f013b756e191373cf9ddd6a71b30faccc56f369bf","observation_id":"a9f0e1fd-9c48-4eb8-a481-0f7972137409","resolution":{"observed_at":"2026-08-15T21:53:43.767393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-15T21:53:41.894860Z","title":"Internvl3. 5: Advancing open-source multi- modal models in versatility, reasoning, and efficiency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.894860Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:7c9494706039bc312c3cabf2c8e9b9bea2c50d732732899ed5c291c295069d22","observation_id":"d37620a3-9ece-416d-97c6-2f40844c1318","resolution":{"observed_at":"2026-08-15T21:53:41.894860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04453","last_updated":"2025-02-17T18:27:27Z","snapshot_observed_at":"2026-08-17T17:58:31.496050Z","submitted_at":"2024-12-05T18:58:17Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04453","snapshot_observed_at":"2026-08-15T21:53:41.907818Z","title":"Navila: Legged robot vision-language- action model for navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.907818Z"},"links":{"cited_paper":"/paper/2412.04453","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:530110b27df54c26ec634f4a43ce884ff77a8bc56b5e9f65155ee30f344a0bc1","observation_id":"a860a33c-fd01-4431-890e-a63af14b9b69","resolution":{"observed_at":"2026-08-15T21:53:41.907818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05240","last_updated":"2026-07-09T06:53:43Z","snapshot_observed_at":"2026-08-18T02:14:46.902275Z","submitted_at":"2025-07-07T17:49:41Z","title":"StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05240","snapshot_observed_at":"2026-08-15T21:53:41.980807Z","title":"Streamvln: Streaming vision-and- language navigation via slowfast context modeling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:41.980807Z"},"links":{"cited_paper":"/paper/2507.05240","citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:48a07170efc696808f1f4c97824f47dd2d0a7cb2c107be164d3414f0ec1ad668","observation_id":"bd6b9e4f-7f68-4b38-a83b-b6bfe5d8cc8a","resolution":{"observed_at":"2026-08-15T21:53:41.980807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:42.073287Z","title":"Ground slow, move fast: A dual-system foundation model for generalizable vision-and-language navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:42.073287Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:6f6bf0b1bafcece2fc6ae92960d09bd465b83ad9d76b595cd979d4746f817e1c","observation_id":"3d88c808-1b09-4f91-9ce3-ebc4aa291b6b","resolution":{"observed_at":"2026-08-15T21:53:42.073287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:53:42.217995Z","title":"Janusvln: Decoupling semantics and spatiality with dual implicit memory for vision-language navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:53:42.217995Z"},"links":{"citing_paper":"/paper/2608.12860"},"observation_digest":"sha256:55284cb6898f3859a2281a9c7443e8bfd3400a9e0a8e790caea6a0ab2d9df473","observation_id":"2af89980-7f63-49cc-839b-5b7231469be7","resolution":{"observed_at":"2026-08-15T21:53:42.217995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.12860","last_updated":"2026-08-13T06:16:05Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-20T07:04:22.131983Z","submitted_at":"2026-08-13T06:16:05Z","title":"HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2608.12860."}