{"as_of":"2026-08-08T12:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:69e05f2c80927678067c894e55addda67048cd7f733cd89a2eb3265a5ad45655","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:35:49.944005Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:13:51.829966Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T08:15:32.522311Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02112","snapshot_observed_at":"2026-08-03T16:13:51.829966Z","title":"Sab3r: Semantic-augmented backbone in 3d reconstruction.arXiv preprint arXiv:2506.02112, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14364","last_updated":"2026-06-01T12:40:47Z","snapshot_observed_at":"2026-08-08T11:23:54.955713Z","submitted_at":"2025-12-16T12:49:35Z","title":"Unified Semantic Transformer for 3D Scene Understanding","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T16:13:51.829966Z"},"links":{"cited_paper":"/paper/2506.02112","citing_paper":"/paper/2512.14364"},"observation_digest":"sha256:f38b75778eea7070aaff9f454f526b051fc25868f3ad287fdcf346f770603068","observation_id":"ef85ed60-9e7b-4dc6-8349-a9adae6951d7","resolution":{"observed_at":"2026-08-03T16:13:51.829966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02112","snapshot_observed_at":"2026-08-03T06:33:36.869530Z","title":"arXiv preprint arXiv:2506.02112 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.22615","last_updated":"2026-06-24T05:37:55Z","snapshot_observed_at":"2026-08-06T02:53:10.366194Z","submitted_at":"2026-01-30T06:14:42Z","title":"TTSA3R: Training-Free Temporal-Spatial Adaptive Persistent State for Streaming 3D Reconstruction","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T06:33:36.869530Z"},"links":{"cited_paper":"/paper/2506.02112","citing_paper":"/paper/2601.22615"},"observation_digest":"sha256:c254257c0074f58e34716a4243ce37d953d467ca000af41f710056339c39c8ab","observation_id":"1278ddf7-bae3-4d93-ba3d-87f7e99ade77","resolution":{"observed_at":"2026-08-03T06:33:36.869530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"cited_work":{"arxiv_id":"2506.02112","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02112","snapshot_observed_at":"2026-07-01T08:15:32.522311Z","title":"arXiv preprint arXiv:2506.02112 (2025)","venue":null,"work_id":"bfc4c294-c3b1-4346-b572-7d6eda9971c3","year":2025},"citing_paper":{"arxiv_id":"2606.14307","last_updated":"2026-06-30T10:03:58Z","snapshot_observed_at":"2026-07-31T03:54:17.412804Z","submitted_at":"2026-06-12T09:43:13Z","title":"Pano3D: Unified 3D Reconstruction and Panoptic Segmentation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-01T07:23:24.807344Z"},"links":{"cited_paper":"/paper/2506.02112","citing_paper":"/paper/2606.14307"},"observation_digest":"sha256:1c9162dfa947df27d7e9a7ae7aa561cafa133dfb3673f5aa526056148e99824a","observation_id":"37e1b8f6-e3ad-4f94-a91d-ddac6652ad0e","resolution":{"observed_at":"2026-07-01T08:15:32.524449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02112/citation-record","integrity":"/paper/2506.02112/integrity","json":"/paper/2506.02112/citation-record.json","paper":"/paper/2506.02112"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:43.114483Z","title":"Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.114483Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:83411fe57890364125d1581abb66c78d2b24b7e0fbae90fec502a6c6972ade7b","observation_id":"91311425-7fa2-4c96-818b-f00ce3f8788e","resolution":{"observed_at":"2026-08-07T11:35:43.114483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.116335Z","title":"Building rome in a day","venue":null,"work_id":"3421f108-249b-4244-a599-24b23e9623f3","year":2011},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.221639Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:a4f77de7f322651c7eee94c483e98522526d6039e67c9e2560700fd87ca0faff","observation_id":"9b521cc4-0b51-4e70-8c47-ec7bec96f947","resolution":{"observed_at":"2026-08-07T11:35:52.121352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.103046Z","title":"ARK- itscenes - a diverse real-world dataset for 3d indoor scene understanding using mobile RGB-d data","venue":null,"work_id":"d45ed9f2-eab7-4acf-a214-679f3980e8b8","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.331448Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d72ee04c9977580201fe2001e4b6967b77bdfcf91863b315ec09b97f69367b26","observation_id":"eeed7202-b3ef-4371-a5ec-043c682bd6ef","resolution":{"observed_at":"2026-08-07T11:35:52.107623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.087682Z","title":"Auto-rectify network for unsupervised indoor depth estimation, 2021","venue":null,"work_id":"0d06c66e-b464-4c80-8ce8-220f50eff82b","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.434902Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:079d9a2fece527862fd8a987910791dc79ee0c878c31e65d664edd52424fc1c3","observation_id":"12ff697c-f277-43a0-858f-bde6fde3fbba","resolution":{"observed_at":"2026-08-07T11:35:52.092754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.073625Z","title":"Unsupervised scale-consistent depth learning from video.In- ternational Journal of Computer Vision (IJCV), 2021","venue":null,"work_id":"5547447d-7a4e-4e44-92fa-9e633699dbc0","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.518248Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:731e88db46d1c06a734e251e391088f4e6571c495dac4920935df598b767e763","observation_id":"76e9ef6a-95cc-4ebf-b402-87e05fab2f51","resolution":{"observed_at":"2026-08-07T11:35:52.077925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.059307Z","title":null,"venue":null,"work_id":"dc1784fd-fe56-402d-b34c-199606763d50","year":2016},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.626746Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:3e1042780c693979d3e4dafa32bb5f20b1de07f26cab7822e1684edcba988c6f","observation_id":"648f101a-fd2f-44fb-9553-8ba0d5ad7ef2","resolution":{"observed_at":"2026-08-07T11:35:52.064605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:43.700295Z","title":"Emerg- ing properties in self-supervised vision transformers, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.700295Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:b37d8a0c885fb0c4d5be6a0bf8972db15a6c8ab5da2c049c10abaeed209b3091","observation_id":"7d09f927-9b3c-4f9f-ad20-d2f2ffe31fec","resolution":{"observed_at":"2026-08-07T11:35:43.700295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.037982Z","title":"Learn- ing to generate text-grounded mask for open-world semantic segmentation from only image-text pairs","venue":null,"work_id":"fc904701-e8cb-42c2-9c71-d4f28ba7e7b3","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.799199Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:be4cd948998ca19f65425d020ecd0e741b5f996ec5a92c185147416fcbb3ca15","observation_id":"c6f31c4f-3b70-4a23-a397-8c11c08ddd01","resolution":{"observed_at":"2026-08-07T11:35:52.042548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.025053Z","title":"Scanrefer: 3d object localization in rgb-d scans using natural language","venue":null,"work_id":"d91b09e2-66f1-4d90-b78d-fe4caa93b223","year":2020},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.887582Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:6b47b08b612ecdafbead937957237eafded2ba67abbc2a6f3e1d7e98c51da708","observation_id":"b72797c4-c933-437e-9f89-6d23cb2dd066","resolution":{"observed_at":"2026-08-07T11:35:52.029188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.013082Z","title":"Chang, Manolis Savva, Maciej Hal- ber, Thomas Funkhouser, and Matthias Nießner","venue":null,"work_id":"50a2c53a-a466-4b58-bd0c-d6635ec8da58","year":2017},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:43.964579Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:6f6afb88e7dcffb24c7685c206c5ecb61ae729e0cfbd08a1faf288514e5c98fe","observation_id":"66f56ef5-635a-4cfb-ba5a-cdd142a33075","resolution":{"observed_at":"2026-08-07T11:35:52.017097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:52.000232Z","title":"Superpoint: Self-supervised Interest Point Detection and Description","venue":null,"work_id":"370acc3f-cb38-4172-9907-7d899e499c7c","year":2018},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.065817Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:4345743c45aea2879f357ce4d494f1378f7a1ec220b75666cb194132c07bf868","observation_id":"81f91954-5485-441d-91c3-566f8310cf6d","resolution":{"observed_at":"2026-08-07T11:35:52.004163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.989210Z","title":"Maskclip: Masked self-distillation advances contrastive language-image pretraining, 2023","venue":null,"work_id":"7388cbc5-87f7-4645-8d36-f16374385891","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.143065Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:c90d734a4d5ad8c710ab2215b2e43244865862b3d4d3ac60d753da2a447a560f","observation_id":"bbfbaa83-eca2-40b4-b503-c41f59022517","resolution":{"observed_at":"2026-08-07T11:35:51.993301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:44.242334Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.242334Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:99a909fd1ca04cfeb2c9857255eae29a1f318fb31f4e7b12d8ca8f08524d22c8","observation_id":"71f46731-491b-45f1-854b-e4dfc38f2636","resolution":{"observed_at":"2026-08-07T11:35:44.242334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.967605Z","title":"Everingham, S","venue":null,"work_id":"c73b6fc1-2ba2-4183-ae8f-0c0351a91b59","year":2015},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.334729Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:0c2347bcf869014e84199305c89dd7d85340b99dab0ac4c333e5812d6078b1bc","observation_id":"ec8317ee-bf60-4e7d-9007-84154e3e42cb","resolution":{"observed_at":"2026-08-07T11:35:51.971639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.953999Z","title":"Nerf-sos: Any-view self- supervised object segmentation on complex scenes, 2022","venue":null,"work_id":"0dd6af55-70b7-419e-89f4-d83ba49a0e9c","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.485180Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:a20032a520e4a21747007bc03521c9e833f10570bc4cf3614a5c57fbdb3e9416","observation_id":"e4354394-2539-4e8a-9351-b78158a9defc","resolution":{"observed_at":"2026-08-07T11:35:51.959509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.929576Z","title":"Large spatial model: End-to-end unposed images to semantic 3d, 2024","venue":null,"work_id":"54d33daa-2c04-4e1e-a86b-bc1417436188","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.582649Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:f0b28083e2f75476e0950cc0da6bd98c4c87320644d4ddf2ebea6def1764fc5f","observation_id":"f5d3233f-751e-49a0-a702-bdfb55f384d0","resolution":{"observed_at":"2026-08-07T11:35:51.934276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.916798Z","title":null,"venue":null,"work_id":"8ca354ce-c66a-4bee-9921-d17f883c578a","year":null},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.676908Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:1df287e2ccce084edc7427f4ad1f49ee1d0d3ffa13de587aa9dbb5996f2d591d","observation_id":"1445ac99-5cbd-480e-8f14-a00413f52447","resolution":{"observed_at":"2026-08-07T11:35:51.921150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.905794Z","title":"Brandt, Axel Feld- mann, Zhoutong Zhang, and William T","venue":null,"work_id":"b0b55226-25ad-402f-8964-95bd5d7a4507","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.784954Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:606fd6e6afc090860cb6d4beab54fb804b7d290a417ad0f7a3a498516d78e1f6","observation_id":"4982176a-1beb-4372-87ad-70740d14f0bf","resolution":{"observed_at":"2026-08-07T11:35:51.908954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.894919Z","title":"Vision meets robotics: The kitti dataset","venue":null,"work_id":"2f5ebd73-c4d7-4cb4-b211-2cf6f2970dfb","year":2013},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.888834Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:aa9597fa5682b8a2a0030608fecbfcd4cb2e8366e63d3b74ac9246c266928d1e","observation_id":"1b376e47-611e-488d-ad8a-93ea0534c891","resolution":{"observed_at":"2026-08-07T11:35:51.898351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.884689Z","title":null,"venue":null,"work_id":"541edbfe-2b9b-4acd-9f51-1efe4be4ff30","year":2019},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:44.981550Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:090c142eb2a7f877891b306132ec4ced198c73c05e461c2cecda5b652109e4fa","observation_id":"6998c1d7-0f65-4027-a0a0-62f1a2471fe9","resolution":{"observed_at":"2026-08-07T11:35:51.888143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.873264Z","title":"3d-llm: Inject- ing the 3d world into large language models, 2023","venue":null,"work_id":"cfb9ba1e-ac64-4399-aac0-986193ef0579","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.070769Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d3b7901e95f617d3e6e93eba4831e2924a54240fcee5e6ba900c0af43b6540fb","observation_id":"ddf4164e-7e08-406f-be5a-662e8a66b557","resolution":{"observed_at":"2026-08-07T11:35:51.877035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.863064Z","title":"Open- CLIP, 2021","venue":null,"work_id":"e17d6d47-87fa-429b-9b1c-141a5e8bff48","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.165900Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:811c970391cfd2c1261049fd037554bb430bda79607a6a74b48aa0c20103203e","observation_id":"cc789746-3e24-48bc-ae90-4a4f50e0dcce","resolution":{"observed_at":"2026-08-07T11:35:51.866307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.851992Z","title":"Harley, Gabriel Sarch, Kriti Aggarwal, Vishrav Chaudhary, and Katerina Fragkiadaki","venue":null,"work_id":"0c8b5e76-582d-442e-bbda-ca437dcf0278","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.240879Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:efcb5425415f1202254f7b9f901bc4648d56ef5a38d0c63a34c95aa5e9925595","observation_id":"c98a0c46-02c7-45b9-bd95-7a2af6da0b7a","resolution":{"observed_at":"2026-08-07T11:35:51.856170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.841591Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"b8a643dc-5698-4ff5-b0ac-c436e3c75add","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.327215Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:6507521369c871310faae8d2ae2317da1b19eef8b831a9fa11b874e098af14ec","observation_id":"46dec75a-b4c1-4e1c-8b59-eed4098e7dd9","resolution":{"observed_at":"2026-08-07T11:35:51.845026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.830050Z","title":"Lerf: Language embedded radiance fields, 2023","venue":null,"work_id":"e435be81-e141-4179-8d93-594ec7ec5244","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.411674Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:4d5d0572263c9492b3b67c2ff1c3d4d829198038eca5744491cabc611bd8a4a3","observation_id":"bff80c38-3d24-4ce7-8d6d-5bea5bdeb378","resolution":{"observed_at":"2026-08-07T11:35:51.834398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.819339Z","title":"Anthony Movshon","venue":null,"work_id":"95d78585-f18d-4402-adc7-a1a27b11bf65","year":null},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.521549Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:79dc2151bb91b8bab43ddc682f6b192a1c653745eab9b6fe3067aacf35765cb1","observation_id":"75926e39-fe1c-4c71-ac69-89e09bcdc01c","resolution":{"observed_at":"2026-08-07T11:35:51.822636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.808858Z","title":"Large-scale localization datasets in crowded indoor spaces, 2021","venue":null,"work_id":"a20638a3-d812-4259-84c5-3286c9e8daa9","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.608495Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:536f826e4fbf7cf90e7cee76d4fd59d92a5169ca304220d1e742e4a849d3d11d","observation_id":"212030af-bd50-46f5-9de4-3ad79b432e4d","resolution":{"observed_at":"2026-08-07T11:35:51.811945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.798036Z","title":"Ground- ing image matching in 3d with mast3r, 2024","venue":null,"work_id":"394e1dde-6669-4d13-bad9-fabff7bda42a","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.685445Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:3dda2c0b34032a37d8afc8bf3fe1ca58f3a0f96de4866184cdadf2ec5f774755","observation_id":"58d3f9e7-e71a-4275-a80b-bb801834372b","resolution":{"observed_at":"2026-08-07T11:35:51.801736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.786737Z","title":"Ground- ing image matching in 3d with mast3r, 2024","venue":null,"work_id":"b61c2d89-5cea-4664-ad7e-ef48a6226ee4","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.760538Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:7bef0daff1a9c5a3572a476a8db596c32509d29373a1f8bd999ef602da0a2e43","observation_id":"e2c5bc62-3fc1-44d9-801b-fdaeab25e133","resolution":{"observed_at":"2026-08-07T11:35:51.790495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.776343Z","title":"Weinberger, Serge Belongie, Vladlen Koltun, and Ren ´e Ranftl","venue":null,"work_id":"f282d1e2-eccf-47de-b08b-72d5139dafcb","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.833477Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:aeda7aa8ce2f4fb1ebefb14b1e9d98361d6ebf9317d06e7bfa6a93ab14dd263f","observation_id":"cbe6ccfa-1493-48eb-98af-650d0b09caaa","resolution":{"observed_at":"2026-08-07T11:35:51.779500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.764916Z","title":"Megadepth: Learning single- view depth prediction from internet photos","venue":null,"work_id":"ff80cdea-b682-47f1-b340-b0a77383b6b5","year":2018},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.903609Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:5a50cf66f3c86197d3aeb423bb521521c46c12fc94dd48554dfee987587a2961","observation_id":"d7dd1132-a60f-4e54-9997-2de0e29fbd69","resolution":{"observed_at":"2026-08-07T11:35:51.768986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04926","last_updated":"2023-12-18T15:49:22Z","snapshot_observed_at":"2026-07-06T15:24:42.200476Z","submitted_at":"2023-05-08T17:59:58Z","title":"RelPose++: Recovering 6D Poses from Sparse-view Observations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04926","snapshot_observed_at":"2026-08-07T11:35:45.979580Z","title":"Zhang, and Shubham Tulsiani","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:45.979580Z"},"links":{"cited_paper":"/paper/2305.04926","citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e400ae7e24ed149cb240fe56db8d071cb8ce2dc31a8e7d9123fff9a8893ce31d","observation_id":"71b139c9-a07e-4ee0-89a3-4593acd345a4","resolution":{"observed_at":"2026-08-07T11:35:45.979580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.753393Z","title":"Pixel-perfect structure-from-motion with featuremetric refinement","venue":null,"work_id":"e2cbd182-cfa1-43ca-a9c3-187c8df40223","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.053268Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d773c9db074f9ee721801122db75e5cdcd429f3de88d401b5766529c294222ce","observation_id":"ab17ba16-b4d7-48d5-9a06-3a6170fe24fb","resolution":{"observed_at":"2026-08-07T11:35:51.756987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.742895Z","title":"Open-world semantic seg- mentation via contrasting and clustering vision-language embedding","venue":null,"work_id":"66544d91-9439-46df-aaee-b0eb9da2009c","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.132322Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:643dafbda87220d28aa0ec626b00bd080d993d142575782ad6dc3d06f2c9c957","observation_id":"3ee27f1f-bd83-4b24-80cb-933c245fe13e","resolution":{"observed_at":"2026-08-07T11:35:51.746661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.732504Z","title":"Segclip: Patch aggregation with learnable centers for open-vocabulary semantic segmentation","venue":null,"work_id":"f3eb28e3-e25d-4880-81ed-52a4643f3679","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.226037Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:e3407918294b687388caacf921e4fd0ed880e36350e0441e43495a4dab4892a5","observation_id":"cd8054c0-2939-479a-a8e1-42d6e6ef5b55","resolution":{"observed_at":"2026-08-07T11:35:51.736390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.721713Z","title":"The three r’s of computer vision: Recognition, recon- struction and reorganization","venue":null,"work_id":"eaa15ebc-4f84-4049-975c-dd2afaf8941a","year":2016},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.295263Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:941b5695258eee69a65a04310f691f574d8f50c86d50926f4d21be08d109890b","observation_id":"c978e32f-fd38-486f-8538-76ed963cb51c","resolution":{"observed_at":"2026-08-07T11:35:51.725246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.709027Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":"0676c07f-a20e-48a9-b327-af68a4590e09","year":2020},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.365232Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:05435e3a2d536f995bd9c0a84aa34bd11f07483bfb291427390573f251e150db","observation_id":"d5e0645c-6434-4826-8ea2-7271f6656253","resolution":{"observed_at":"2026-08-07T11:35:51.712736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.698350Z","title":null,"venue":null,"work_id":"891c6ac5-10f1-4dea-afe0-4c1439a8d19d","year":2015},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.456062Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:7c3b172f0c0902df0b1a56bc675cf3848a0d87b9f2bb67b5578cd9a0355940ad","observation_id":"cacb7a0e-e132-4398-99b4-650e20148149","resolution":{"observed_at":"2026-08-07T11:35:51.701391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.687269Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"1e3e7476-f5f6-466e-8cd9-916bca6405c9","year":2012},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.547443Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d518dacbcd4e3078babda1f8de9df8b27cd2950c27e1055bebee1c3e6568e2ac","observation_id":"c321aa01-776b-4f72-a2e3-aeaaaf74ced5","resolution":{"observed_at":"2026-08-07T11:35:51.691158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.677010Z","title":"Robustmix: Improving robust- ness by regularizing the frequency bias of deep nets, 2024","venue":null,"work_id":"f880af40-c43b-473d-80f2-8f1d3a49e8ca","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.632356Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:66cb20b880ace26dbfb28df019e1eedb314b55b0f5c69470e810383260e12ce1","observation_id":"dd3041f9-ba11-41ec-b63c-868c2e6818b1","resolution":{"observed_at":"2026-08-07T11:35:51.680581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.666452Z","title":"Dinov2: Learning robust visual features with- out supervision, 2024","venue":null,"work_id":"944c5c75-51d8-41b7-8909-5be353bd0a2b","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.730974Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:dee6be85feaccdfc4c728b93b95a3ab5ab2c42e5e04a63c0c1d04b0238f4a745","observation_id":"ed04bc09-a3fb-4921-a16e-9745ee5975fa","resolution":{"observed_at":"2026-08-07T11:35:51.669859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.656489Z","title":"Openscene: 3d scene understanding with open vocabularies","venue":null,"work_id":"4b5bf6e9-c607-42f7-983c-0fc0aa8f7479","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.817471Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:820a01698b437b9ea84800f53fb4c77231f7e9b9956703e0c48a3ee742acb66c","observation_id":"c0c917d0-5824-4ee3-b730-1e04675e772a","resolution":{"observed_at":"2026-08-07T11:35:51.659929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.645538Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":"f2028203-426e-407c-a20f-e6c1d25611dd","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.908966Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:3043437ac5687824fb679329b471d6c382518f16e93039be3f400636f5836e2b","observation_id":"31498249-1d4b-4d96-84dd-e646b0d1a080","resolution":{"observed_at":"2026-08-07T11:35:51.649173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.635464Z","title":"Per- ceptual grouping in contrastive vision-language models","venue":null,"work_id":"8b440a0d-65f9-47a9-ba25-88bd8315dd43","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:46.988812Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:266526caa3d7bedf860c47c2bd414ecd957692c1e73f479e615b88c11e490996","observation_id":"e07deae9-8a06-4e7e-bb97-44d4ff4cc3e1","resolution":{"observed_at":"2026-08-07T11:35:51.638696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.625309Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":"30454103-fd44-469e-bef5-d41f713148b1","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.087326Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:2867225a7c12d2a3d698f8d1ad1a2e206cd750ee222fdfe078030ba208ff668b","observation_id":"b5dabd5c-a84a-47e0-81bd-d28f07156c8f","resolution":{"observed_at":"2026-08-07T11:35:51.628723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.612894Z","title":"Com- mon objects in 3d: Large-scale learning and evaluation of real-life 3d category reconstruction","venue":null,"work_id":"aba24c16-ba55-4a34-80c4-4ef6cefead3e","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.179526Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:cf33e641fa557ef3bd129aeb66812b0d27e0ca8a0714e50568dca1a9a7d58715","observation_id":"1c17a856-ef85-47f0-af46-69351b368b22","resolution":{"observed_at":"2026-08-07T11:35:51.617057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10307","last_updated":"2023-01-31T01:57:52Z","snapshot_observed_at":"2026-07-06T14:53:53.017634Z","submitted_at":"2023-01-31T01:57:52Z","title":"ViewCo: Discovering Text-Supervised Segmentation Masks via Multi-View Semantic Consistency","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10307","snapshot_observed_at":"2026-08-07T11:35:47.274591Z","title":"Viewco: Discovering text-supervised segmentation masks via multi-view semantic consistency","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.274591Z"},"links":{"cited_paper":"/paper/2302.10307","citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:58eddcaa9afdda3556f4da418b3e3d336e10a847a550f8159dc139da9e5adfe3","observation_id":"3354fdec-2137-40b4-9653-b04915109701","resolution":{"observed_at":"2026-08-07T11:35:47.274591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.602606Z","title":null,"venue":null,"work_id":"a0dcd02e-b663-47d0-b64a-1d31afd728ad","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.349849Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:cf28c9688e58cb1667c73dadab446e6f7fcbe454521d005cd780e2f93fc00d93","observation_id":"83e3212d-177e-4c20-a25e-730457ea16b3","resolution":{"observed_at":"2026-08-07T11:35:51.605826Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.591879Z","title":"SuperGlue: Learning feature matching with graph neural networks","venue":null,"work_id":"cdb242ec-285d-4fdc-9e0c-fc611fbd775b","year":2020},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.442494Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:2d06a90ced3a28dd9ae7440bbe83346fc97331fb7a4ae4d11582c814f399c176","observation_id":"602488e9-cc86-4626-8d08-03be4624deec","resolution":{"observed_at":"2026-08-07T11:35:51.595625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.580776Z","title":"Habitat: A platform for embodied ai research, 2019","venue":null,"work_id":"f54b28fa-a99a-4a29-95aa-5538db3366b3","year":2019},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.538373Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:90c5cc6c811d7857e99e35e207a81b0acfde0a3ce90ee17502cc35f226aa51b1","observation_id":"bafcf3c0-138b-4617-b9ea-0aed6df42576","resolution":{"observed_at":"2026-08-07T11:35:51.584564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.569589Z","title":"Mask3D: Mask Trans- former for 3D Semantic Instance Segmentation","venue":null,"work_id":"c6f22927-4b41-4bbd-b9e3-5734919e2ff9","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.633748Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:1fa4b56f19f2bc4c7e2f16b00d2043f1ce2c8cf1cb1eec9618c30a0a17ef8559","observation_id":"993df610-cc53-48bf-8026-c902bc876f0e","resolution":{"observed_at":"2026-08-07T11:35:51.573942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.557914Z","title":"Sch ¨onberger and Jan-Michael Frahm","venue":null,"work_id":"f1e6dba9-97c4-4cfc-8ca6-dfb78aae18c0","year":2016},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.704786Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:6d10b3b5bc31c8821b94443c2ce26442691e8d532bdeb3a97ec680cdb0a295ab","observation_id":"ee8d8273-67e1-405b-8607-002af681d759","resolution":{"observed_at":"2026-08-07T11:35:51.561843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.546392Z","title":"Distilled feature fields enable few-shot language-guided manipulation, 2023","venue":null,"work_id":"2febd0c7-e47d-48ae-b35c-5c4c15f434e4","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.790089Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:f6d2529c0667516272dfe6a3e5abd655dc31b727f40f0cce846064ee71fe8d27","observation_id":"36ac2833-a36e-4cb9-9295-3442efdfe612","resolution":{"observed_at":"2026-08-07T11:35:51.549888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.534559Z","title":"Panoptic lifting for 3d scene understanding with neural fields","venue":null,"work_id":"2ec9bc35-3e8a-4567-b1ac-418ec62f8d89","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.858399Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:4215504f4d5e893ab8f1a29742718668dccf16a8be88a3e3e64dc1c60c8ad285","observation_id":"402149f4-5e7a-42c7-9dbb-1d0990659894","resolution":{"observed_at":"2026-08-07T11:35:51.538401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.523527Z","title":"Kick back & relax: Learning to reconstruct the world by watching slowtv, 2023","venue":null,"work_id":"1a7ffeaa-337a-4238-8c70-da85b58a37cc","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:47.952230Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:a820faef4c3a5f1c756465b069ba47b71e11ad0ae1eb3dc0d2456efda12d7ba3","observation_id":"63bf56d6-f2b7-4b7b-8cb4-97968ac3d51c","resolution":{"observed_at":"2026-08-07T11:35:51.527064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.512209Z","title":"Efm3d: A bench- mark for measuring progress towards 3d egocentric founda- tion models, 2024","venue":null,"work_id":"ee19d4bb-5aae-45f9-9ea0-b513742965ee","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.064366Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d4c3c188a73ceee0563cef6162b7dbf559749c0d35b87507678a5fd88efa263b","observation_id":"52204596-e21f-4107-94d0-58bdade8744d","resolution":{"observed_at":"2026-08-07T11:35:51.515908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.497835Z","title":"Sc-depthv3: Robust self- supervised monocular depth estimation for dynamic scenes","venue":null,"work_id":"490a096b-e374-4e7d-ae36-d3e17e685e88","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.151209Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:13550d2e38da179e134241dbb2ffde559b7cbcb007b61b38c4937e25f27fbe78","observation_id":"bba1807c-2e3b-4dc7-858d-2029f398f9e5","resolution":{"observed_at":"2026-08-07T11:35:51.502696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:48.232906Z","title":"Habitat 2.0: Training home assistants to rearrange their habitat","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.232906Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:fb4c04c5565d2f301196afda6ff6d2c2e66d0e22eef5d9c01da5905251dc83c8","observation_id":"5c6a23e0-9d7c-458b-9a3c-d4c7168458ba","resolution":{"observed_at":"2026-08-07T11:35:48.232906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.479289Z","title":"Droid-slam: Deep visual slam for monocular, stereo, and rgb-d cameras, 2021","venue":null,"work_id":"b6b8787c-fd0b-4616-9f20-4a91ac219e8e","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.306033Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:881d1f612a2df77a79fef483449598aea94783129320d1f662b0e008313a31e8","observation_id":"a90fefae-cc5a-49e2-8f3a-cfd4f8e0b2cb","resolution":{"observed_at":"2026-08-07T11:35:51.482810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.467002Z","title":"Neural feature fusion fields: 3d distillation of self- supervised 2d image representations, 2022","venue":null,"work_id":"4570c751-ed68-4091-9238-55070b0ebe09","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.404391Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:f6f4636f62dfe6ac686af90314604f2f801319e6585cfe5f9aad087897da2689","observation_id":"71f09928-7998-4e88-bd2e-9b574bd85da7","resolution":{"observed_at":"2026-08-07T11:35:51.471887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.449270Z","title":"Sam-clip: Merging vision foundation models towards semantic and spatial understanding, 2024","venue":null,"work_id":"3c87d970-0071-491e-a9f2-6ad5c7bf10ee","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.494754Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:4bebb929816f61439d5f9f102a1ccd03d3f6f8e7e0d52f815f20ff0cf8c23c6f","observation_id":"fbd8f1eb-ce5b-47a4-85ac-5c1b9bc995c5","resolution":{"observed_at":"2026-08-07T11:35:51.456446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.433421Z","title":"PoseDiffusion: Solving pose estimation via diffusion-aided bundle adjustment","venue":null,"work_id":"754e201b-1b85-47ad-9174-2385cbc9940a","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.604741Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:a53f4e95df777aa46ae3fdaff51d3f30188cc4af17ec799ca1d58dd79957953a","observation_id":"51eee655-0e7a-43c7-9ec9-6cba9806fc3e","resolution":{"observed_at":"2026-08-07T11:35:51.437354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.422440Z","title":"Vggsfm: Visual geometry grounded deep structure from motion","venue":null,"work_id":"fc860c22-5277-4539-a525-38003df4e93f","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.664786Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:acadc429a45f779b161e72fd7383283a9fda8bd418237ddbb0c4e02b961906b6","observation_id":"342b5654-9e6f-4b1b-97c9-7411addd9de3","resolution":{"observed_at":"2026-08-07T11:35:51.426003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.410052Z","title":"Dust3r: Geometric 3d vi- sion made easy, 2023","venue":null,"work_id":"968db443-8435-4553-913f-c4142bd582b3","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.739432Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:9db9257860f9470ee1ad871b0330309097c94e30b1ac1f5356430c9f11bf447a","observation_id":"731c0cf9-5d80-493c-9aed-4c20630e7ceb","resolution":{"observed_at":"2026-08-07T11:35:51.414362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.396970Z","title":"Point transformer v3: Simpler, faster, stronger","venue":null,"work_id":"d3a668f5-f1a7-406e-b9d2-cd9328bbf81a","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.793780Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:90476897887632dd48fb9c90fbb85e9edaafe4b2ead8472f0d8a0c4fcc43ef3d","observation_id":"1581f975-0c54-4994-9fcd-301dc7f3f454","resolution":{"observed_at":"2026-08-07T11:35:51.402094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.381111Z","title":"Groupvit: Semantic segmentation emerges from text supervision","venue":null,"work_id":"2a5709e5-5b90-41c6-a37b-4c1d053f1ef6","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.871079Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:1b5ef49b006dd858f74021a8fdc2f25f05058e3342c16232326d63aaa527fdd7","observation_id":"68466f5e-102b-4f46-8db6-599f1391d35f","resolution":{"observed_at":"2026-08-07T11:35:51.384928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.369457Z","title":"Learning open-vocabulary semantic segmentation models from natural language supervision","venue":null,"work_id":"a2f7d16a-d73f-46e9-95f4-36f91311c982","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:48.947884Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:14410aa77058465bc6aaeff43516f7d71067efb67da14716d7a2ca90fb624e1a","observation_id":"2c8031f5-711d-4aac-bdec-228c17792feb","resolution":{"observed_at":"2026-08-07T11:35:51.373074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.356651Z","title":"Llm- grounder: Open-vocabulary 3d visual grounding with large language model as an agent","venue":null,"work_id":"1d30b21d-1202-426f-82e9-c957658d32f4","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.008506Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:7f6409f6daa5013e95b65e7dc01fa0513650a0d6a14acd2175daf90395f7a3cd","observation_id":"fec7c169-a3ad-4daa-aad6-4eadf6b50dbd","resolution":{"observed_at":"2026-08-07T11:35:51.360804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.345218Z","title":"Sat: 2d semantics assisted training for 3d visual grounding, 2021","venue":null,"work_id":"ee6891d3-0d6e-4a97-bdc7-7f1ed9d471c5","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.061222Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:177f2ba8205a7eac0caab9f44c8ef07a2a1f8c04e73ef819242d63d560764880","observation_id":"cf9feebb-3ee1-4493-9a27-2c0f6f7ad6ee","resolution":{"observed_at":"2026-08-07T11:35:51.349073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.331447Z","title":"Blendedmvs: A large-scale dataset for generalized multi-view stereo net- works","venue":null,"work_id":"caf60dee-68ac-4500-bba1-0acab3891e7a","year":null},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.147726Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:2ed10d3d32e631c68ab1c919f3c298b0f882985829804da6aad5ed1b32b4bcbe","observation_id":"f0c6f2a5-87a2-4e79-b06a-7cea8f1c596e","resolution":{"observed_at":"2026-08-07T11:35:51.336116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.315906Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes, 2023","venue":null,"work_id":"1fc1d9f8-0bcf-4ede-9102-994079c96c66","year":2023},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.219678Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:3d7b6be2951ff3a9db439fc43035bd5db26234013b44647823092783a2796c53","observation_id":"4ef1f692-4f6d-43c3-8bed-f55d0b5599df","resolution":{"observed_at":"2026-08-07T11:35:51.320866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:49.316205Z","title":"New crfs: Neural window fully-connected crfs for monocular depth estimation, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.316205Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:b612e4d8c4106496af03631801e8ac0f83e2a017064f9d2848093485a95160b3","observation_id":"f130ae27-5b59-42c1-ba7a-9ca63ac4efd0","resolution":{"observed_at":"2026-08-07T11:35:49.316205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.289614Z","title":"Improving 2d feature representations by 3d-aware fine-tuning, 2024","venue":null,"work_id":"bd196471-00b9-4d8f-9b4c-ed15a017eb95","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.388161Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:9e43b6adadb1d1baba56782815dd8b24daf0884219297a5a468a66768524d300","observation_id":"ff6e42f5-5f0c-4c82-a3fb-b7d84035d502","resolution":{"observed_at":"2026-08-07T11:35:51.294574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.272328Z","title":"Zamir, Tilman Wekel, Pulkit Agrawal, Colin Wei, Jitendra Malik, and Silvio Savarese","venue":null,"work_id":"a422b20b-d3d0-46fd-b3fe-32c590518eb9","year":2016},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.461661Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:d81a6189fe40787ecc777d042afdde78a260fd4837026218b71b8909b88d408f","observation_id":"c3477780-b666-48fd-92a9-a4e6c7550ec0","resolution":{"observed_at":"2026-08-07T11:35:51.278843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.229246Z","title":"Zhang, Deva Ramanan, and Shubham Tulsiani","venue":null,"work_id":"cf4d0527-954c-47ff-b176-d58b77d1401a","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.530204Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:f054d1b83bf6ba3db9f083f5d693081a4951aed4d3a2857f0671a9be74b7050c","observation_id":"7c8f82a9-6386-4afb-badc-a3cc518651a4","resolution":{"observed_at":"2026-08-07T11:35:51.241625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.182128Z","title":"Cameras as rays: Pose estimation via ray diffusion","venue":null,"work_id":"e8375e96-47f6-4003-bcc1-ffec4c297aa1","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.618703Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:618f3955d34e8ac71b628ac9bfd9436720d583efaa8135c70cee2038a2999705","observation_id":"4a679178-7764-4e0d-9c3f-1c9544f914b9","resolution":{"observed_at":"2026-08-07T11:35:51.204739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:51.116129Z","title":"Monovit: Self-supervised monocular depth estimation with a vision transformer","venue":null,"work_id":"5b29a135-e55b-4d6e-b5b1-6673a5c66c24","year":2022},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.678188Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:78b46d3ee3b2dfdd1bba91b42430def6a2a572c8b7bde887a63554a2cc32b736","observation_id":"c34ee000-bb65-4a4f-99a4-4e10a142b695","resolution":{"observed_at":"2026-08-07T11:35:51.155613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.858340Z","title":null,"venue":null,"work_id":"f2968a9d-f37b-476f-b992-2d235152f995","year":2021},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.750319Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:0aa7fb474ff664703b9df8b7fbc404c202fa20d7d39f87000e146b37a163bbc1","observation_id":"f46042ae-3e9e-4065-b4ce-91a53ff9c3bf","resolution":{"observed_at":"2026-08-07T11:35:50.995357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.620079Z","title":"Semantic under- standing of scenes through the ade20k dataset","venue":null,"work_id":"8471c671-51d5-452c-8bf3-24c4648fc358","year":2019},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.807390Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:abe028e103bd962fae2f8b7d13eed8eaf1d12bd0e515f4f3b1813d58ff196409","observation_id":"d58f5ee6-3b8a-4d44-ad59-6f0897c399e0","resolution":{"observed_at":"2026-08-07T11:35:50.734147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:49.818911Z","title":"Feature 3dgs: Supercharging 3d gaussian splatting to enable distilled feature fields","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.818911Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:eecac7b8456a2ba8663cb89c13261460c7af02aedc63b81da54a3f501c2d8605","observation_id":"57d42441-85e5-4d14-8087-adb632a3a73a","resolution":{"observed_at":"2026-08-07T11:35:49.818911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:35:50.311291Z","title":"Unifying 3d vision-language understanding via prompt- able queries","venue":null,"work_id":"7b49d846-1c3a-4b87-9e2a-10663a1423a4","year":2024},"citing_paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T11:35:49.944005Z"},"links":{"citing_paper":"/paper/2506.02112"},"observation_digest":"sha256:1704966670b0b2c8f6d88b91cdb31a08b1f4a0a023ec764317aba9e8b4fbe22c","observation_id":"8394186b-dede-41e1-9929-ef57c11e795d","resolution":{"observed_at":"2026-08-07T11:35:50.438211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02112","last_updated":"2025-06-04T02:28:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:27:59.197185Z","submitted_at":"2025-06-02T18:00:04Z","title":"SAB3R: Semantic-Augmented Backbone in 3D Reconstruction"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":67},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 3 inbound Pith citation observations for arXiv:2506.02112."}