{"as_of":"2026-08-08T05:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b881e3d189ff59e6dfa132c67bd41404950cc861f30cdfce3137f5b018553f5","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:12:13.992499Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.08526/citation-record","integrity":"/paper/2506.08526/integrity","json":"/paper/2506.08526/citation-record.json","paper":"/paper/2506.08526"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.379253Z","title":"Nerfels: renderable neural codes for improved camera pose estima- tion","venue":null,"work_id":"57922263-344b-4595-b1ba-c9f7d661e9df","year":null},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.865052Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:cda90f5381e2c72287fc6efd15fd0513a754f27390c5b54d3657ab29b43cc759","observation_id":"0b54d118-cea1-4081-9e89-670aa597f998","resolution":{"observed_at":"2026-08-07T05:12:14.383419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:13.869782Z","title":"Reloc- net: Continuous metric learning relocalisation using neural nets","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.869782Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:aada8a05c261354f1bd842b26900d3d06030ed2d5cae853ac6143932eee47350","observation_id":"3cf169b3-cb0a-41c0-82e4-84a5ae8a3121","resolution":{"observed_at":"2026-08-07T05:12:13.869782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.361690Z","title":"Depth camera based indoor mobile robot localization and navigation","venue":null,"work_id":"e2e8088d-f1df-422b-a13f-9db7d2a9181c","year":2012},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.873684Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:5379e6aa2c517e70baed1f8229340e1f7dc3f150b01855ca832a596a2a11dd66","observation_id":"059d582f-9f57-4920-bb8f-8b050a152b7a","resolution":{"observed_at":"2026-08-07T05:12:14.365344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.351621Z","title":"Geometry-aware learning of maps for camera localization","venue":null,"work_id":"4b960d0f-3ca6-4d52-9a1d-3216f433fcb6","year":2018},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.877600Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:677592b2e402dc72d344d5b306db4caed8c55049ae0475619d3d3dc6d5048f28","observation_id":"914c5fd0-ed85-4421-859b-6e58be4fc37d","resolution":{"observed_at":"2026-08-07T05:12:14.355279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:13.881516Z","title":"Geometry-aware learning of maps for cam- era localization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.881516Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:a994c7aa799ddf45cc8c84ab267a74a301285090e5a1574603b607cd02e0f225","observation_id":"d0fdc4ea-79b3-4a57-99a5-317cda593bd6","resolution":{"observed_at":"2026-08-07T05:12:13.881516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.334410Z","title":"Let’s take this online: Adapting scene coordinate regression network predictions for online rgb-d camera relocalisation","venue":null,"work_id":"0706a183-90a8-4c9c-801b-6f53c5a4da23","year":2019},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.885277Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:e80a7708dbfe7c0a84b613fb36060b30c3d1a2c73d759c92a57c125c00f2bcd3","observation_id":"e40c99db-0ce6-4227-96e1-dd7c7134d58b","resolution":{"observed_at":"2026-08-07T05:12:14.338465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:13.889035Z","title":"Crossvit: Cross-attention multi-scale vision transformer for image classification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.889035Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:87bb9f4fa3991dad59acbd39567b6bd19393170dd88c55d6bd1248100604310e","observation_id":"90f5b612-f220-42d2-a18a-b66b831da55c","resolution":{"observed_at":"2026-08-07T05:12:13.889035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.317540Z","title":"Direct- posenet: Absolute pose regression with photometric consis- tency","venue":null,"work_id":"e4358ef8-3253-41b9-bcc4-7f7264788d4b","year":2021},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.892543Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:82a12f3eb4f939a91f5e7b176c02232b60dbaf890f4d519b687a52346facbcbb","observation_id":"12fe87d8-c2cc-4147-b732-ed04757c6e6e","resolution":{"observed_at":"2026-08-07T05:12:14.321632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.307554Z","title":"Dfnet: Enhance absolute pose regression with direct feature matching","venue":null,"work_id":"647bc40d-ab6b-4a08-98ff-424b2e8f1a20","year":2022},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.896158Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:f62790222f14eb06ef8b907e54b6bd69df036cd7fbcec7a744ce79b241f8da3b","observation_id":"936d3104-ec04-4d80-ad53-e7986f18ab7c","resolution":{"observed_at":"2026-08-07T05:12:14.311051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:13.899775Z","title":"Camnet: Coarse-to-fine retrieval for camera re- localization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.899775Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:30d4384629ad0f65d1fd2f4c72b10893f297680db90344b44d280e7cb4165e1f","observation_id":"c0c4b15a-4552-4e0a-a3e1-53f29f40a31a","resolution":{"observed_at":"2026-08-07T05:12:13.899775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.289433Z","title":"Modelling uncertainty in deep learning for camera relocalization","venue":null,"work_id":"e811889c-eef6-4a71-b30b-76ae2dff286e","year":2016},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.903123Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:c8822237ce876d3382c7da2312671745616903e09f0323c0a09537dab80f9451","observation_id":"60957a36-d0f1-4a19-abd9-5e0b79d4644c","resolution":{"observed_at":"2026-08-07T05:12:14.293306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.278532Z","title":"Geometric loss func- tions for camera pose regression with deep learning","venue":null,"work_id":"9d09bd50-7800-4dbd-964a-8d221a418695","year":2017},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.906359Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:1c8daf3a84d6fe6fb898554cc0e126cd37ee793c746891ab4ccf6ca7b2b8ca60","observation_id":"6210c91e-5e3e-4fa1-81cf-c5611f021952","resolution":{"observed_at":"2026-08-07T05:12:14.282539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.266882Z","title":"Posenet: A convolutional network for real-time 6-dof cam- era relocalization","venue":null,"work_id":"d4cafb67-9c5e-427c-a218-25f22846f837","year":2015},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.910465Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:597d55edf182ce996dd84c676b8b7330597fcff19bde958f5e3fae399ef58328","observation_id":"557acb50-52f8-49b7-8ffc-550c6c0cbb6a","resolution":{"observed_at":"2026-08-07T05:12:14.271480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.255559Z","title":"Vela, and Stan Birchfield","venue":null,"work_id":"746c9867-4dba-4ff7-bec0-ac295bbe26a2","year":null},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.914072Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:af0756908f7c01e093ac369b4814a0aa8b5cbc36fbe5486d5323c463f9187b55","observation_id":"b8729f31-60c2-4816-8409-3888a761b719","resolution":{"observed_at":"2026-08-07T05:12:14.259793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.244058Z","title":"Image-based localization using hourglass networks","venue":null,"work_id":"ba4bed2d-0ecb-4284-88ba-bcdb45e75e29","year":2017},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.917685Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:8a7b951c013b6b63162df7451bffc526d06690fd7447e8fa2ebd52233625903f","observation_id":"d96b3d9e-fa13-4fbb-8561-8c87919865fb","resolution":{"observed_at":"2026-08-07T05:12:14.248550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:13.921351Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.921351Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:6892dafa75f46bbb9903b69ef121eeedab4321159f084f9494224f0f6717c5cd","observation_id":"f5e3d379-57fb-49ae-a0f4-09a2eeb2b538","resolution":{"observed_at":"2026-08-07T05:12:13.921351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.226634Z","title":"Lens: Localization enhanced by nerf synthesis","venue":null,"work_id":"61edd4a9-a24c-41a9-a3cb-0244f9fee3c1","year":2022},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.924799Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:f365c550625b021aba59de74db09f5f27bc06e1892346178ae94b95b67e59ea4","observation_id":"39be456b-4f1a-4316-b149-c7dece9313f2","resolution":{"observed_at":"2026-08-07T05:12:14.230488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.215179Z","title":"Crossfire: Camera relocalization on self-supervised features from an implicit representation","venue":null,"work_id":"c261f20a-6298-447f-b7a0-7f063973c34d","year":2023},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.928096Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:500f88e4d69eb98acfb9e887f71af49cf53cedba3a97e0321da63c7a5ae30387","observation_id":"6116f76f-c21b-4f01-924c-606d4e4bbbcf","resolution":{"observed_at":"2026-08-07T05:12:14.218793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.204651Z","title":"Leveraging equivariant features for absolute pose regression","venue":null,"work_id":"f25453eb-5408-4415-8d63-a078329e9806","year":2022},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.931411Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:0be4014c9884a174041775c83677664f073a1b51fc40512359136d31df60383b","observation_id":"b64908e8-3bd1-4372-9702-f7d6f4dd5a8e","resolution":{"observed_at":"2026-08-07T05:12:14.208177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.194249Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks","venue":null,"work_id":"cadb36fb-e36e-4b45-aa5b-a64e10cb5aca","year":2018},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.934694Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:792ca067ccd3936bdd37e0e7d34bfe3239f1483561b8ec8573c49710087795f6","observation_id":"93125454-f8af-416b-b0c4-20a945b7c59c","resolution":{"observed_at":"2026-08-07T05:12:14.197952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.183722Z","title":"Back to the feature: Learning robust camera localization from pixels to pose","venue":null,"work_id":"f959617b-70f4-4333-9937-7badd2989eda","year":2021},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.938321Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:45700b5fdac034ebde2b1fd94520f60e4e18f6b978c1ff972b807c479547af28","observation_id":"290cfdda-e16c-491b-b57b-d5bcdad61f39","resolution":{"observed_at":"2026-08-07T05:12:14.187626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.173334Z","title":"Benchmarking 6dof outdoor visual localiza- tion in changing conditions","venue":null,"work_id":"59f646db-77b7-440b-bdc5-a440de33a173","year":2018},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.941934Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:ac2f5bf5a3e19472eb1339be371ebb0b155eadde8030f577b58922df099e0116","observation_id":"9d5b72ea-0765-4ce4-9294-b9a1abc865f3","resolution":{"observed_at":"2026-08-07T05:12:14.177016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:13.945173Z","title":"Sch ¨onberger and Jan-Michael Frahm","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.945173Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:16b89d3edea2a8cee6df9a05cb5b840c818150faa893b2784694f7c68fa64e95","observation_id":"f47f5e23-b7d1-4afd-86dc-533cb12ee985","resolution":{"observed_at":"2026-08-07T05:12:13.945173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.155800Z","title":"Do we really need scene- specific pose encoders? In2020 25th International Con- ference on Pattern Recognition (ICPR), pages 3186–3192","venue":null,"work_id":"22d242b0-5749-405e-87ef-38329390b281","year":2021},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.948453Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:3657f95ba01f071531a2aa744407865a445c627c77175d9f7d1335c68445f35a","observation_id":"6faf4aaa-6003-4c28-ba46-4d55ae6ddb1d","resolution":{"observed_at":"2026-08-07T05:12:14.160417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.145795Z","title":"Camera pose auto-encoders for improving pose regression","venue":null,"work_id":"235e93d9-a83b-4caa-8f3a-2d341fbfd8aa","year":2022},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.951826Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:5ff08e8f88927eeaf3e6b09312b266153682df50bf1b3fbab1a590fa2992b0f6","observation_id":"a5ad33c9-6501-4c90-852f-31e97de8db0b","resolution":{"observed_at":"2026-08-07T05:12:14.149346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.135750Z","title":"Sparsepose: Sparse- view camera pose regression and refinement","venue":null,"work_id":"f5d7ec86-c455-490c-9d13-e1e344251f90","year":2023},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.955046Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:b68e9a2b1902f8e24c508b2497f2f42b12cce4cabb57690f278ed2a0f85e7587","observation_id":"582831de-fc81-4b67-8dbd-12a2150a84cf","resolution":{"observed_at":"2026-08-07T05:12:14.139355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.125104Z","title":"Inloc: Indoor visual localization with dense matching and view synthesis","venue":null,"work_id":"47c3bfda-561a-43b4-b30a-e32e4c86745f","year":2018},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.958946Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:f9a0b7324b7000a1c6423e93150ccf04730f4eb1048ace1067a19e2de32d4961","observation_id":"6d2142a2-c178-4608-b704-35c7af42d4fd","resolution":{"observed_at":"2026-08-07T05:12:14.128886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.112656Z","title":"Global localization from monocular slam on a mobile phone.IEEE Transactions on Visualization and Computer Graphics, 20(4):531–539, 2014","venue":null,"work_id":"7635fef2-0e7f-4bcf-ae92-70c3ae1b2819","year":2014},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.962449Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:22ee20eceba0492884327f69694bef0c7532e9879923774118891781eca560db","observation_id":"c746675e-e720-4e24-842d-c720251f0eb8","resolution":{"observed_at":"2026-08-07T05:12:14.116979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.101602Z","title":"Walch, C","venue":null,"work_id":"6029c1e5-55e5-4503-b598-b8a6c69d72da","year":2017},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.965956Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:6c0133e6366433024669dbeb8fac3df836253f4ee80519e63a542318b832afd4","observation_id":"564a194e-7148-4364-887a-5a97b13be894","resolution":{"observed_at":"2026-08-07T05:12:14.105571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.090068Z","title":"Atloc: Atten- tion guided camera localization","venue":null,"work_id":"3d6e3d27-4c49-419c-b91c-557895ce05ce","year":null},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.970417Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:bb3411105374b919bef72930b57767706f8e583aeb20984b8e4c2423b3fbbd76","observation_id":"19495a25-f235-4671-885a-4cf01a350a38","resolution":{"observed_at":"2026-08-07T05:12:14.093709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.078193Z","title":"Tartanair: A dataset to push the limits of visual slam","venue":null,"work_id":"1e74d660-3bc3-4166-8fbb-6397dad6c604","year":2020},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.975151Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:12b7044d6b5c6a7da66d7351837cbc9cef3f23e9d55d8c51bce9692445b5f697","observation_id":"1c73f74e-49d8-4812-a644-595925387770","resolution":{"observed_at":"2026-08-07T05:12:14.082670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.065469Z","title":"Crossformer++: A versatile vision transformer hinging on cross-scale attention","venue":null,"work_id":"cd1c5d6e-0002-4138-a5b0-d04522cfd437","year":2023},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.978574Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:e1e43a8b805844da4f93f29cb9e1c1a4cc15d426520d166c95b95fc4b9b37f54","observation_id":"1183520e-8e48-4c2f-b715-47ece032f18f","resolution":{"observed_at":"2026-08-07T05:12:14.069345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.053134Z","title":"Inverted pyramid multi-task trans- former for dense scene understanding","venue":null,"work_id":"55fabf34-a3a2-4f20-9323-041544b62c56","year":2022},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.981920Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:65b6a80f4766fd9b0a5b2960509dfe9db7d3874ca1da2af616bf00051aab2fca","observation_id":"446480f0-b8c8-4ccb-8e10-93e9a7d5ae00","resolution":{"observed_at":"2026-08-07T05:12:14.057523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.040968Z","title":"Barron, Alberto Rodriguez, Phillip Isola, and Tsung-Yi Lin","venue":null,"work_id":"1c62652e-a084-4c96-8ea9-dd5f25bba05f","year":2021},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.985377Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:87a9dce7732faebb532c6e8c4fab1fb4086096e6312d237a41ca30969da830a4","observation_id":"926ff4b5-4e0e-479e-a274-a05c7b031e37","resolution":{"observed_at":"2026-08-07T05:12:14.045662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:13.988700Z","title":"Pnerfloc: Visual localization with point- based neural radiance fields","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.988700Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:9d0ae424b9f7b06f444659b4ee4874fa764a14858588ea546e2b0addad15e8a9","observation_id":"e35264e5-e9be-436b-9070-30b1d7b89e0e","resolution":{"observed_at":"2026-08-07T05:12:13.988700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:12:14.020553Z","title":null,"venue":null,"work_id":"137cd16f-ba5e-45a4-be87-ac176c300424","year":2021},"citing_paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:12:13.992499Z"},"links":{"citing_paper":"/paper/2506.08526"},"observation_digest":"sha256:0474ac8fa67d4f13650ef57c88ceff1ace46efdf628498fec0ce0653f264e1c6","observation_id":"3a069a9f-ab48-496b-9457-34b1a7e4717a","resolution":{"observed_at":"2026-08-07T05:12:14.025633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.08526","last_updated":"2025-06-10T07:44:53Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:05:45.947220Z","submitted_at":"2025-06-10T07:44:53Z","title":"Robust Visual Localization via Semantic-Guided Multi-Scale Transformer"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2506.08526."}