{"as_of":"2026-08-22T10:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ddbd5ca27069130393dffc9db2ab104c36a0d96ba21ee26e00a4948dfee4713","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T01:22:28.834204Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25106/citation-record","integrity":"/paper/2607.25106/integrity","json":"/paper/2607.25106/citation-record.json","paper":"/paper/2607.25106"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:26.977084Z","title":"Learning transferable visual models from natural language su- pervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:26.977084Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:376de021197227a0c4334d7f53a70c0346d34235918d91d8732127fae5e163cb","observation_id":"b5696181-1a07-4da3-b2b9-83a263b47bf9","resolution":{"observed_at":"2026-07-31T01:22:26.977084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.059042Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.059042Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:0608cd5e276e362d00706f3e3f7d0da642dccf20e10e2610bb9b83db42191248","observation_id":"672232e2-3319-4f88-b17b-7639c0ba09d1","resolution":{"observed_at":"2026-07-31T01:22:27.059042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.132701Z","title":"Sed: A simple encoder-decoder for open-vocabulary semantic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.132701Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:10cd1577a0a4c98ec8f4b82df179f2c824b565fa6badbef0ca215a4b1c1fe1d3","observation_id":"b488b456-8628-46c3-a6fd-31189e8658a3","resolution":{"observed_at":"2026-07-31T01:22:27.132701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.226781Z","title":"Vlfm: Vision- language frontier maps for zero-shot semantic navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.226781Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:549aa40c51ffffcf3793a7393a72c631f1d4748bd8dac34b816e1ef4132fc694","observation_id":"1d5f39fa-ef67-471b-8a15-3a94e31c9068","resolution":{"observed_at":"2026-07-31T01:22:27.226781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.323449Z","title":"Onemap to find them all: A spatial semantic map for multi-query object search,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.323449Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:74a1bf0378d93c9f97395622a29e0b2be2affd73f33a412a36ae7435bea4b3ca","observation_id":"e715036e-a79a-4c62-941e-724c6e8feacd","resolution":{"observed_at":"2026-07-31T01:22:27.323449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.394012Z","title":"Search and detect: Training-free long tail object detection via web- image retrieval,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.394012Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:2b4eed80854dd8ccce762241ffca48a74d22a89edb9d844c1b50fe95ebf3a79d","observation_id":"aacd11c7-93f5-4197-8602-8e67b126a114","resolution":{"observed_at":"2026-07-31T01:22:27.394012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10582","last_updated":"2025-03-15T01:09:17Z","snapshot_observed_at":"2026-08-16T12:50:17.494849Z","submitted_at":"2025-03-13T17:32:48Z","title":"VisualWebInstruct: Scaling up Multimodal Instruction Data through Web Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10582","snapshot_observed_at":"2026-07-31T01:22:27.471673Z","title":"Visualwe- binstruct: Scaling up multimodal instruction data through web search,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.471673Z"},"links":{"cited_paper":"/paper/2503.10582","citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:b700ca3b4953941c25203b906c5646eb9a326015b782fa3b7f99e2b544a44190","observation_id":"0fac7589-b6ec-43a8-893b-b7b12c239209","resolution":{"observed_at":"2026-07-31T01:22:27.471673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.560293Z","title":"Hm3d- ovon: A dataset and benchmark for open-vocabulary object goal navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.560293Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:365916793849a56e842f4a0cd8f866dbae42aaca582e208d10f7feb6688f353c","observation_id":"90295b46-9461-4a6c-93bc-927502b16d0d","resolution":{"observed_at":"2026-07-31T01:22:27.560293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.648071Z","title":"Habitat synthetic scenes dataset (hssd-200): An analysis of 3d scene scale and realism tradeoffs for objectgoal navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.648071Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:79ad0340e76eb910aae0f35e2981628ffbbb6118cd5334b1679867ad0fa2b542","observation_id":"6a7de46e-a258-44f2-ba91-1bdd1a663f5b","resolution":{"observed_at":"2026-07-31T01:22:27.648071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.743675Z","title":"Matterport3d: Learning from rgb- d data in indoor environments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.743675Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:4d8b7f19f1c0fd9c9c9af284b591d047749889718a1127a1ea0073e7b87bea43","observation_id":"7728cbf4-ae68-4622-b951-764c898fe0c6","resolution":{"observed_at":"2026-07-31T01:22:27.743675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.825174Z","title":"Gibson env: Real-world perception for embodied agents,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.825174Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:ac7bc5d506949dfd8aa9499b6323616d295ff9f41f84ededc7e12ab3fe586bd4","observation_id":"5547500f-bfb0-48f2-bbc9-27083b423a05","resolution":{"observed_at":"2026-07-31T01:22:27.825174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.909867Z","title":"Vlmaps: Vision- language maps for robot navigation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.909867Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:fd14b193748979f879597b45ed6bc42d9c35bcc4a7cf60a36c553c7be33ba0b6","observation_id":"6b6d219a-2dbd-415e-bc05-361036bdce06","resolution":{"observed_at":"2026-07-31T01:22:27.909867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:27.990458Z","title":"Openfusion: Real-time open-vocabulary 3d mapping and queryable scene representation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:27.990458Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:20a7a4b04e93848ddfbe40d0da19bb4509ce9fe3fb6313c0450e8835d4591745","observation_id":"5b0f8e9a-dcf4-428f-92c9-3c6bf2f28343","resolution":{"observed_at":"2026-07-31T01:22:27.990458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:28.073835Z","title":"Sigmoid loss for language image pre-training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:28.073835Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:77b85836130dc5905ec476efe568eef44b552152920ae2e6bb68f88911ae43dc","observation_id":"42b7101f-8544-4714-b9c1-b50f94c558b1","resolution":{"observed_at":"2026-07-31T01:22:28.073835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:28.127251Z","title":"Lseg: Language-driven semantic segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:28.127251Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:3c6fcb8b1a87f60ef3c67313745e7501b13d2fb5c9028950dda6275ec07562cd","observation_id":"5a955a01-5382-4560-b98a-d28cfd205558","resolution":{"observed_at":"2026-07-31T01:22:28.127251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:28.223942Z","title":"Openscene: 3d scene understanding with open vo- cabularies,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:28.223942Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:ce93dfb1938df895e379eec2baed9d5ba2429445e258d632ae83e3c2747fdd07","observation_id":"6a40bad8-e1a5-48f6-bac8-d767f5c7d02c","resolution":{"observed_at":"2026-07-31T01:22:28.223942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:28.284627Z","title":"Scaling open-vocabulary object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:28.284627Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:d33f386c1c2a2c849624deb3620467429d639ebc6cdf41575c479c412e0d8cda","observation_id":"b41b9817-993f-4787-b18e-34e09cd360ce","resolution":{"observed_at":"2026-07-31T01:22:28.284627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:28.384138Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:28.384138Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:91a025f018c581b70ff1cee2c99a3db4e8a0a69ab18bb352f25acdcd010d6fb5","observation_id":"f9a3964a-a7f5-4e48-ba50-c30a60a33627","resolution":{"observed_at":"2026-07-31T01:22:28.384138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:28.489663Z","title":"Yolo- world: Real-time open-vocabulary object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:28.489663Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:bdc21bbaf325652f4030ad71af7f532258addda7d36784c5f2b8ed58ff7ef43a","observation_id":"952672ad-c996-46ee-b52f-e22c9b48f678","resolution":{"observed_at":"2026-07-31T01:22:28.489663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:28.558965Z","title":"Deep long- tailed learning: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:28.558965Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:8c788a2d8816a3a4e019aeca0cd2f45bfa09e6f8157e193601a0139c4f68b607","observation_id":"693be27e-1019-40db-b30e-4f4a147fcfd6","resolution":{"observed_at":"2026-07-31T01:22:28.558965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08238","last_updated":"2021-09-16T22:01:24Z","snapshot_observed_at":"2026-08-15T09:50:41.483833Z","submitted_at":"2021-09-16T22:01:24Z","title":"Habitat-Matterport 3D Dataset (HM3D): 1000 Large-scale 3D Environments for Embodied AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08238","snapshot_observed_at":"2026-07-31T01:22:28.701677Z","title":"Habitat-matterport 3d dataset (hm3d): 1000 large-scale 3d environments for embodied ai,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:28.701677Z"},"links":{"cited_paper":"/paper/2109.08238","citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:9126895fe58fbd7ea720e1820234d7614d9f78f10a86c1dd27da7f4fcbd1550a","observation_id":"7eabeac9-7e4c-408d-92a9-4d8eb7e6d13d","resolution":{"observed_at":"2026-07-31T01:22:28.701677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T01:22:28.834204Z","title":"Zson: Zero-shot object-goal navigation using multimodal goal embed- dings,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T01:22:28.834204Z"},"links":{"citing_paper":"/paper/2607.25106"},"observation_digest":"sha256:f913c8978d98cecd5533edeeead74e45aebfdd8f47c33a404bbd990ab7e1ed90","observation_id":"bdf6ba2f-a306-409a-b198-35364d737d9c","resolution":{"observed_at":"2026-07-31T01:22:28.834204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25106","last_updated":"2026-07-27T22:09:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T08:21:56.872723Z","submitted_at":"2026-07-27T22:09:32Z","title":"IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2607.25106."}