{"as_of":"2026-08-09T18:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:138142c308e8746c37f1ba3a84d25a8a67384df08c240b7ff266a2ce6e23f5b9","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:29:36.955442Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.18881/citation-record","integrity":"/paper/2505.18881/integrity","json":"/paper/2505.18881/citation-record.json","paper":"/paper/2505.18881"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1807.06757","last_updated":"2018-07-18T03:28:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-07-18T03:28:02Z","title":"On Evaluation of Embodied Navigation Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.06757","snapshot_observed_at":"2026-08-07T14:29:34.425323Z","title":"On evaluation of embodied navigation agents","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.425323Z"},"links":{"cited_paper":"/paper/1807.06757","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:a92f526fea18977b79be7d50a8f2148da2a93f6f2a1bf76ba5924cefed39fecf","observation_id":"7f974932-4b71-42fe-b426-4924b94610b3","resolution":{"observed_at":"2026-08-07T14:29:34.425323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:41.899083Z","title":"Hm3d-ovon: A dataset and benchmark for open-vocabulary object goal navigation","venue":null,"work_id":"52e78e9e-1855-45b7-90e4-eeeb1dde7a77","year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.478669Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:43dc4ab72df886a31ba9e8da82ddd212da81ad16f838d8e738ac505bb3db075d","observation_id":"414e07fa-0548-4420-96de-ae09e2bc5d48","resolution":{"observed_at":"2026-08-07T14:29:41.948421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08238","last_updated":"2021-09-16T22:01:24Z","snapshot_observed_at":"2026-07-06T11:48:35.206160Z","submitted_at":"2021-09-16T22:01:24Z","title":"Habitat-Matterport 3D Dataset (HM3D): 1000 Large-scale 3D Environments for Embodied AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08238","snapshot_observed_at":"2026-08-07T14:29:34.560519Z","title":"Habitat-matterport 3d dataset (HM3d): 1000 large-scale 3d environments for embodied AI","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.560519Z"},"links":{"cited_paper":"/paper/2109.08238","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:16cf74a88ccb9ae79dac4b3a345a7235ca3d6c98e04a8bd3df34ea9f9a1a41f5","observation_id":"b7430479-5976-42db-ac44-726c707c7167","resolution":{"observed_at":"2026-08-07T14:29:34.560519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:34.631864Z","title":"Chang, Manolis Savva, Maciej Halber, Thomas Funkhouser, and Matthias Nießner","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.631864Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:f0bc17c90adf3bcd5062c3402ec7a981739e7f0d97576676d1dc3a9170840465","observation_id":"0b8ff767-dd0d-4a2a-9eec-5b875d5f7bb0","resolution":{"observed_at":"2026-08-07T14:29:34.631864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:41.733913Z","title":"Procthor: Large-scale embodied ai using procedural generation","venue":null,"work_id":"a8430a57-e074-401d-ae58-0d71c121ecf2","year":2022},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.715983Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:8bd21e42fb6d30bcc66c2bd869a4dfaf2ba0ff82e7e615a7c7c6346f748afb7e","observation_id":"318a2a0b-4e58-4665-ad5b-bf91258fae66","resolution":{"observed_at":"2026-08-07T14:29:41.798517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:34.780344Z","title":"Habitat 2.0: Training home assistants to rearrange their habitat","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.780344Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:2d16feb0b4586410a59c1c377e1eef9aca521a160570f5f6b3520a1ade3906fd","observation_id":"5b782f16-6f4a-46a5-863c-bb1eeb3112b7","resolution":{"observed_at":"2026-08-07T14:29:34.780344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:41.577030Z","title":"Towards open vocabulary learning: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence, 46(7):5092–5113, 2024","venue":null,"work_id":"5b3389f0-161e-473d-a479-974be83e0c2b","year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.859203Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:f2f7be34be725037eb0e220e6307b268c4f1ea41d713e3b51ed733a04d0420d9","observation_id":"ce589f66-cebd-4361-917a-368c0faf8491","resolution":{"observed_at":"2026-08-07T14:29:41.639675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:34.893522Z","title":"Vision-and-language navigation: Interpreting visually-grounded navigation instructions in real environments","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.893522Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:6ef701c6490c4e6c04ab7b0be09679f79a7fb2ff7f3516645699766b4a4e8250","observation_id":"62e9f821-69c4-4e91-9aff-b909b3d3b5bd","resolution":{"observed_at":"2026-08-07T14:29:34.893522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:34.937329Z","title":"Llama: Open and efficient foundation language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.937329Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:5bb2d3b6f34809c9746d30b44ec91b0e1bf4108d6d5220c08b18b426e787828f","observation_id":"7d582b92-9068-4861-b24b-0b416da76af3","resolution":{"observed_at":"2026-08-07T14:29:34.937329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:29:34.986229Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:34.986229Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:627e6d6bad6630d79fdef94defc4b04e94f83b082c1469d74a4c7c80fdb6b9fc","observation_id":"ca7a4332-47b3-46f0-be7c-a76c43fcb072","resolution":{"observed_at":"2026-08-07T14:29:34.986229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:35.049650Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.049650Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:591687b1ce8953d959fda255b8581b6cd76c6bd756eecf38206b541bb3969a1b","observation_id":"1c8a4af7-8018-4efd-b628-d41448960f2a","resolution":{"observed_at":"2026-08-07T14:29:35.049650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:35.148434Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.148434Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:ce3253fac69b6ac0bb00a587555f431ca22d8a1513e5336e7b612f9436faeb13","observation_id":"cb388f3e-4058-47dd-8814-85450b0320d3","resolution":{"observed_at":"2026-08-07T14:29:35.148434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:29:35.270245Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.270245Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:f38aca56b46991fcf3a48a85d0678b6e211b9421d4b712be56b928cd922dc6fc","observation_id":"f111f866-ded7-4a6d-bcbb-6ff39481aac1","resolution":{"observed_at":"2026-08-07T14:29:35.270245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:41.339486Z","title":"Vlfm: Vision- language frontier maps for zero-shot semantic navigation","venue":null,"work_id":"85407a6e-c4fb-4a15-87c8-b30f0ae9b1b9","year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.342837Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:e8b867d2e8b11618c63465bdc4cf59c54d6b420dff161b0b9a27699de02e3fa0","observation_id":"c517a64d-7abc-40f2-9d9f-c36ede7a7c7f","resolution":{"observed_at":"2026-08-07T14:29:41.414696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:41.174223Z","title":"L3mvn: Leveraging large language models for visual target navigation","venue":null,"work_id":"d23d54cb-8b43-43dd-bbf7-04937a0c7124","year":2023},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.453216Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:f5709dd3a36630db5d638e2c58958241a6c157bc852dd3f6a72c1f6029a7de56","observation_id":"86170c9a-d45d-4797-aef8-2deb260f878c","resolution":{"observed_at":"2026-08-07T14:29:41.247588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18115","last_updated":"2024-06-26T07:06:42Z","snapshot_observed_at":"2026-08-06T03:52:39.680195Z","submitted_at":"2024-06-26T07:06:42Z","title":"Open-vocabulary Mobile Manipulation in Unseen Dynamic Environments with 3D Semantic Maps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18115","snapshot_observed_at":"2026-08-07T14:29:35.516486Z","title":"Open-vocabulary mobile ma- nipulation in unseen dynamic environments with 3d semantic maps","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.516486Z"},"links":{"cited_paper":"/paper/2406.18115","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:0c040da30e0a34cbff0053f06e66cd4a750e2b270904de5463973bd77435bb50","observation_id":"90e62150-d464-493c-8bb8-2dbbff7f2cd9","resolution":{"observed_at":"2026-08-07T14:29:35.516486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:40.924496Z","title":"Auxiliary tasks and exploration enable objectgoal navigation","venue":null,"work_id":"6f2a040a-d46e-4f51-ac2b-1a4e4d0b1e66","year":2021},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.562115Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:760909c778f4799be4d28c5732571a26d6ddb64141b109cdce48023b3bc683e5","observation_id":"25588e2a-5b4a-4797-8347-8a60fe1bc309","resolution":{"observed_at":"2026-08-07T14:29:41.048499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:40.724627Z","title":"3d-aware object goal navigation via simultaneous exploration and identification","venue":null,"work_id":"9870713d-77fa-4128-9f3f-f8b9e4300dde","year":2023},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.604258Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:2378fb09de984ea93c1413ebd0b80ab2c2b7e1842175ed50ba9494ad5f0e100c","observation_id":"c7568162-57e0-4cd7-b481-aa22550fcf3a","resolution":{"observed_at":"2026-08-07T14:29:40.845866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:40.427410Z","title":"Poni: Potential functions for objectgoal navigation with interaction-free learning","venue":null,"work_id":"ddb03840-708d-4939-8726-de4de4c058a1","year":2022},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.700131Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:e60f4dbe23cf40d4fa011deacbe31544a5e03949c62e409bf225d6c552a8d4f1","observation_id":"32ac66d9-7464-4f32-9bc1-b3a1ec4f1664","resolution":{"observed_at":"2026-08-07T14:29:40.562469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:35.765477Z","title":"Object goal navigation using goal-oriented semantic exploration","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.765477Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:7007fe73f9c29cb130f9b7a88f68a91fc60d3d7982c674953e61952231456941","observation_id":"ac6f9587-5a1c-4d8c-85ee-32aa3c740de9","resolution":{"observed_at":"2026-08-07T14:29:35.765477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:35.819499Z","title":"Zson: Zero-shot object-goal navigation using multimodal goal embeddings","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.819499Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:f7f5a9da204be2f4b8c5a5be4addac7b0fd35e443105360642d861d1ab459b67","observation_id":"0b3e6c64-737a-4376-a1b5-49b8eeb759f1","resolution":{"observed_at":"2026-08-07T14:29:35.819499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:40.059867Z","title":"Habitat-web: Learning embodied object-search strategies from human demonstrations at scale","venue":null,"work_id":"eda59f9e-492f-44aa-a9b0-be776d4d54d3","year":2022},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.907202Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:7d783074b1045ff9523f28fea38f3aca9d085d1d6e98617e745d78680f6ab8a0","observation_id":"93cf5e59-bd64-4a2b-b6ab-1ac4160de4c1","resolution":{"observed_at":"2026-08-07T14:29:40.249924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:39.774978Z","title":"Thda: Treasure hunt data augmentation for semantic navigation","venue":null,"work_id":"afc7cc6d-bdfd-4bf4-b445-9661cd8f1e1d","year":2021},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:35.947503Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:e178277f4b67ac816d4786a7dae67ef35a3aa76c873c2934dd74f86593bd8cd2","observation_id":"b91908d7-0b75-4839-a2bf-e3c0332c8356","resolution":{"observed_at":"2026-08-07T14:29:39.910937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:39.542104Z","title":"Simple but effective: Clip embeddings for embodied ai","venue":null,"work_id":"02c9bd41-fac1-4563-a20c-8c6a1ba81aef","year":2022},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.004969Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:02d7f876c927596fe812477fa19db0843e98cc3dd922f00eb97fba530b637cd6","observation_id":"7f0c44fe-b599-4c15-9bb5-7d8ec90f14fc","resolution":{"observed_at":"2026-08-07T14:29:39.619170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:36.052666Z","title":"Pirlnav: Pretraining with imitation and rl finetuning for objectnav","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.052666Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:e942067783d2fc71f11a5ac36e38e0b50d30880c0ab6dc8de66847cd4a9690f3","observation_id":"b92a47b3-8eb1-4759-9984-d68c4ba5bb58","resolution":{"observed_at":"2026-08-07T14:29:36.052666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:39.342383Z","title":"Prioritized semantic learning for zero-shot instance navigation","venue":null,"work_id":"043cde5a-ca49-4544-bdde-6b902646e9c8","year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.109016Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:8d6b89f82be0831e5a99b6120be4684df144d28c3e36416ac5b3fea9c2ad8f14","observation_id":"fb80a6e3-2a2a-4d2e-94cc-04f58eada8c7","resolution":{"observed_at":"2026-08-07T14:29:39.431301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:39.169249Z","title":"Matterport3D: Learning from RGB-D data in indoor environments","venue":null,"work_id":"6ca30ffd-7cda-4394-8e58-340e3dbca38c","year":2017},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.173005Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:8b95b731176d201796850440074118dd3d1f81d6e652860d7c287d5c5c69a7d9","observation_id":"54ba0987-b28b-4f94-ab5a-634f2c7ad94d","resolution":{"observed_at":"2026-08-07T14:29:39.216637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05797","last_updated":"2019-06-13T16:29:58Z","snapshot_observed_at":"2026-08-01T13:51:16.469557Z","submitted_at":"2019-06-13T16:29:58Z","title":"The Replica Dataset: A Digital Replica of Indoor Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05797","snapshot_observed_at":"2026-08-07T14:29:36.222850Z","title":null,"venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.222850Z"},"links":{"cited_paper":"/paper/1906.05797","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:15a656bbf25c46f21948d4a8d8fc3a77cfef2326e0cee1f318d33ebfa3603335","observation_id":"186658e5-1ff3-426a-8dd4-5735b26e607b","resolution":{"observed_at":"2026-08-07T14:29:36.222850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:36.264255Z","title":"Open-set image tagging with multi-grained text supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.264255Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:2ea729d8dcc0da062f560e436958fc27e2255c8b7f73ac345c51be27010094d7","observation_id":"d263c6f7-27a9-4ca4-b132-39a85c478be2","resolution":{"observed_at":"2026-08-07T14:29:36.264255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:36.337153Z","title":"Conceptgraphs: Open-vocabulary 3d scene graphs for perception and planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.337153Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:f298a8e803f4ca29899fea91b06640dd2f8971fd429874baf963a9cddec361e5","observation_id":"6b6964cd-d204-4ba0-a74f-678109e4ebf5","resolution":{"observed_at":"2026-08-07T14:29:36.337153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:29:36.389040Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.389040Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:8a22e59aa5ac7239c77a8b2aeca073597cfc6c896d30f276e9e37ebce88083c3","observation_id":"e53018e1-63ea-4182-b8b0-a8e740136fcf","resolution":{"observed_at":"2026-08-07T14:29:36.389040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:36.438926Z","title":"The ycb object and model set: Towards common benchmarks for manipulation research","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.438926Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:8eb916ffa2f8bec9d4719f02beb6056cfff76edbce891ded964b7ac573387ebd","observation_id":"fd7bc3c0-e824-4b4d-9360-e1db1aec14f9","resolution":{"observed_at":"2026-08-07T14:29:36.438926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-07-06T06:14:28.435222Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T14:29:36.492540Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.492540Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:41d8a26edbccec280c951a9b1e9e8349e67122ffb87aa752dc0326d0bc6ec357","observation_id":"beacf3ad-ed9c-478f-8e48-347edec1419e","resolution":{"observed_at":"2026-08-07T14:29:36.492540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:38.907958Z","title":"Abo: Dataset and benchmarks for real-world 3d object understanding","venue":null,"work_id":"1de7a7ec-6e80-4af7-9300-a3e1855b94ee","year":2022},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.541174Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:39f53649503087376041da85f8f3587a8dd62920feaa7054c56a49869b4ac4a2","observation_id":"4f8b89bf-3b19-4211-8a6f-bbc49bad673a","resolution":{"observed_at":"2026-08-07T14:29:38.959539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:36.603280Z","title":"Chang, and Manolis Savva","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.603280Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:14cfa27503e58970ef9cc4c262e9e3c258b7328ca873d6b95dba40f26e55bc5a","observation_id":"9a2434ea-bf42-44eb-ae59-80579c29aace","resolution":{"observed_at":"2026-08-07T14:29:36.603280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:38.597826Z","title":"Homerobot: Open-vocabulary mobile manipulation, 2024","venue":null,"work_id":"0929c6f9-a131-42ea-afcd-e2488100ea05","year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.662966Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:901c7cafb82f1d51ceaaf1f3bd60260fe038cdc37432b679c995b4e5cc624bd5","observation_id":"68153f51-1bea-45b9-b306-6e40532932d6","resolution":{"observed_at":"2026-08-07T14:29:38.745723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:38.248344Z","title":"Frontier detection and reachability analysis for efficient 2d graph-slam based active exploration","venue":null,"work_id":"f3c8e84d-b3eb-4de9-9e66-2c05e3e2ce3e","year":2020},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.720602Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:3fcef9de4bf82b758b713ccd38aa1f49125bbaaf1588db11bb0eb2867b1e4fa7","observation_id":"d2b560e1-43da-4cb4-9dc2-88ca5b3b7d2a","resolution":{"observed_at":"2026-08-07T14:29:38.393005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:37.881272Z","title":"Autonomous exploration development environment and the planning algorithms","venue":null,"work_id":"9db93d74-1667-4623-8e3d-461357192ce0","year":2022},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.762727Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:1b6aa308048e7aa37cb43fa64506161a50129e7f339e300eb3978b532d096b9d","observation_id":"d4e45921-63ae-4754-8824-f327bdeb6010","resolution":{"observed_at":"2026-08-07T14:29:38.017196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-07T14:29:36.802178Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.802178Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:6a29018c1c02d48f748a113f74f0cae80f9011cf1b73923080dc778d85ebf4ac","observation_id":"369e8471-98bf-4972-b495-a9f44d82ef88","resolution":{"observed_at":"2026-08-07T14:29:36.802178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:37.553842Z","title":"Grounding dino 1.5: Advance the \"edge\" of open-set object detection, 2024","venue":null,"work_id":"078c4856-8dd7-453f-bc37-4424aa0064e1","year":2024},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.858208Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:8c90b14589a5fa738bb366a36cfba047bbb5992af742d1e251a0b4ca7ae493ae","observation_id":"1dcd1a56-6297-4e8c-883e-f5ee3e04ddcb","resolution":{"observed_at":"2026-08-07T14:29:37.659645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:37.415366Z","title":"Google scanned objects: A high-quality dataset of 3d scanned household items","venue":null,"work_id":"dd53ca1f-723b-44c9-a378-7892c1745249","year":2022},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.905453Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:9b7db57c98dccf5c2602beaf8712c258673b9c63be76016acbc29ed1e2276035","observation_id":"b974e5fc-8205-454e-90b9-d6a174f0f2ff","resolution":{"observed_at":"2026-08-07T14:29:37.483555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:37.203866Z","title":"objects\": [object_1, object_2, ...]}, please find and return pieces of furnitures with surface to put daily objects on top of, such as","venue":null,"work_id":"35d70244-f56f-467c-9167-8f36d718cc82","year":null},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.955442Z"},"links":{"citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:2efb225ea4097b42562b332ebc75fd02265ca481bdeab9e0f3799d8bdf2ef767","observation_id":"b0c3b3d5-a167-4d0a-a63d-897cb4230ac8","resolution":{"observed_at":"2026-08-07T14:29:37.344190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:21:44.565183Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2505.18881."}