{"as_of":"2026-08-08T12:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0adbe62887f78edbc8852f5abf0efe10fb988d452bc02e9d04e071ef8fdc3e8f","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:22:40.727671Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:37:23.620325Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15373","snapshot_observed_at":"2026-08-04T09:37:23.620325Z","title":"RAZER: Robust Accel- erated Zero-Shot 3D Open-V ocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14546","last_updated":"2026-08-03T08:20:35Z","snapshot_observed_at":"2026-08-08T06:39:49.614098Z","submitted_at":"2025-10-16T10:41:31Z","title":"QuASH: Using Natural-Language Heuristics to Query Visual-Language Robotic Maps","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T09:37:23.620325Z"},"links":{"cited_paper":"/paper/2505.15373","citing_paper":"/paper/2510.14546"},"observation_digest":"sha256:5ef6418f266d8b6dbc7b6cb88fda00ad65a882a3bac4ed60546b717cec65122c","observation_id":"07970442-5f5d-4679-9db3-a5267545ce27","resolution":{"observed_at":"2026-08-04T09:37:23.620325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.15373/citation-record","integrity":"/paper/2505.15373/integrity","json":"/paper/2505.15373/citation-record.json","paper":"/paper/2505.15373"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:50.599959Z","title":"Associatively segmenting instances and semantics in point clouds,","venue":null,"work_id":"5cf7369e-8f16-4594-a873-6016b8083800","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.471423Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:5b00c1f485a03bf87aadd7c07ea473ba5c6c0ee1fbc189cefcc0a1fe6521ab50","observation_id":"4b0788c1-a971-4feb-b35d-9c2ee91a7e76","resolution":{"observed_at":"2026-08-07T15:22:50.714251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:50.466088Z","title":"3d bird’s-eye- view instance segmentation,","venue":null,"work_id":"74afb31a-ad0f-4fca-99b6-f5c4a5b1ed0d","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.532385Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:b67f5159ace0ae19e765633397043437263e39f976de7f00de50f197f79324c8","observation_id":"ec814e19-d84b-4f3f-81a2-17df41d296e9","resolution":{"observed_at":"2026-08-07T15:22:50.517654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:50.280445Z","title":"3d instance segmentation via multi-task metric learning,","venue":null,"work_id":"038a687a-1989-43cd-a5fc-bc26458fabdb","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.632848Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:ffafcd7b9ea50804076e00ed68941a408f8f05109508c88fe04f3bf992bfde27","observation_id":"1327f7c7-4d62-40a7-8952-be35231d81ec","resolution":{"observed_at":"2026-08-07T15:22:50.352130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:50.035695Z","title":"3d-sis: 3d semantic instance segmen- tation of RGB-D scans,","venue":null,"work_id":"0407c95f-d95c-4b92-b9b3-cb196a360392","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.707090Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:b2ad5fbc4babb6e431fed96a2efdb301d73d9b466019af3b518637ef2e6b08e0","observation_id":"ca31287c-0b03-4b01-b3c9-e8de8dfb0abd","resolution":{"observed_at":"2026-08-07T15:22:50.147933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.893407Z","title":"Learning object bounding boxes for 3d instance segmenta- tion on point clouds,","venue":null,"work_id":"c12a2880-15ad-40b9-bbda-04985ce5feef","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.785996Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:5e043f2fe94faa8299b67f37b2aa7fa0adadc2b359628f82a387cd6c2dec6237","observation_id":"3fbaa1aa-b9f5-43bc-9024-44db559db760","resolution":{"observed_at":"2026-08-07T15:22:49.955507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.660430Z","title":"Towards open vocabulary learning: A survey,","venue":null,"work_id":"1a8e2fb2-d936-4e7f-bbd9-d2f1cd110138","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:35.892207Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:c8a5257439e8106563055272f6a7e70bff594c3ed1c5cdae06f4c96da46050fe","observation_id":"4402cdb0-31b9-47fa-a817-1ba5fdeeb1f0","resolution":{"observed_at":"2026-08-07T15:22:49.788515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.436680Z","title":"A survey on open-vocabulary detection and segmentation: Past, present, and future,","venue":null,"work_id":"737622d3-7b8b-499e-b86b-a8787d19f674","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.012584Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:c28ddad1617f3f50c9db009e127fd5759e844366d60c46420cd0b15ae212b572","observation_id":"2eb2db16-493b-4a7a-9cdb-5360c760324a","resolution":{"observed_at":"2026-08-07T15:22:49.527652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.238528Z","title":"A simple baseline for open-vocabulary semantic segmentation with pre-trained vision-language model,","venue":null,"work_id":"b02d38c5-a4d4-49d5-a995-46c7318f42ca","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.103621Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:debdd62663f8e6f10fed5da362f27803c3a44f55a69316a6dc13b3fe00bca7c8","observation_id":"4e7456dc-8c26-40c2-9751-fe80498dc5a6","resolution":{"observed_at":"2026-08-07T15:22:49.297891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:36.158720Z","title":"Clio: Real-time task-driven open-set 3d scene graphs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.158720Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:02c7d2ed205c1e96398dd03a34f048df845b55d843a93d4fbb0e626b799065df","observation_id":"dc4c9fc9-ac96-48b2-9eac-85887ed6543a","resolution":{"observed_at":"2026-08-07T15:22:36.158720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:49.095434Z","title":"V olumetric Instance-Aware Semantic Mapping and 3D Object Discovery,","venue":null,"work_id":"6d788d7d-f3fb-41e3-9232-8c76b70904b5","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.237805Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:7d1e0276623d67424d615deaca0962d9954dbda5b51c441ad11c8a0ee025a43d","observation_id":"d27f2663-8d84-40ce-a83b-c476c8d758ec","resolution":{"observed_at":"2026-08-07T15:22:49.171116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.936392Z","title":"Panopticfusion: Online volumetric semantic mapping at the level of stuff and things,","venue":null,"work_id":"55266b3a-ea67-4fb2-85f4-8b253f53f112","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.320785Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:7439fa6642158585abc61065bfa5ab15c72aa330ad778a586c041612c47c71a1","observation_id":"d4756706-6dee-4d2b-a5f7-99f0ad6de78b","resolution":{"observed_at":"2026-08-07T15:22:49.038867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:36.382205Z","title":"Maskfusion: Real-time recog- nition, tracking and reconstruction of multiple moving objects,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.382205Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:fefe13459cb6ea748836418aec51aa87a431a0601ac8a3d7a17804c25e2e7388","observation_id":"b324e760-a772-41e9-a98a-f5ad9d4af53b","resolution":{"observed_at":"2026-08-07T15:22:36.382205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.815956Z","title":"Occuseg: Occupancy-aware 3d instance segmentation,","venue":null,"work_id":"df2e859f-75c5-4cf0-bc4d-9bcba1a2bfeb","year":2020},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.454734Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:54e0c36cb2d0ca4c31a09fbb114d57b4c72ac39517515df0fd126a6ad3a84723","observation_id":"462eef91-2b34-445e-a6bc-1c923e4e6d5a","resolution":{"observed_at":"2026-08-07T15:22:48.852768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.666097Z","title":"Hierarchical aggre- gation for 3d instance segmentation,","venue":null,"work_id":"acec0ea6-c21e-4d98-8c11-44278d9a54c6","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.531340Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:2af3b211e3277920512b28ec2c9aa5555e2be40a9b344210737e0a7bd8def195","observation_id":"833c5088-f5ee-4bfe-9a7c-d989f9511227","resolution":{"observed_at":"2026-08-07T15:22:48.734605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.467160Z","title":"Learning transferable visual models from natural language supervi- sion,","venue":null,"work_id":"e21090f6-c882-464d-8b59-9305d6dd94dd","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.602573Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:7800010bcb1be8db5422fdef0d0169cfa3218c30408ae1884316ebfd50330c5f","observation_id":"c5bf2e45-c4b7-4fdd-9ae0-b0040cfa7dbf","resolution":{"observed_at":"2026-08-07T15:22:48.548443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.276754Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models,","venue":null,"work_id":"2cbe63b8-3066-4445-b4a4-5132b9657c9b","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.653890Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:2d05391185d1ae033951ec4557eeb66b3550e12e9681108b5e92eb102ee5fb87","observation_id":"bb58a6d7-1ed3-4ed7-8961-2c6171f81756","resolution":{"observed_at":"2026-08-07T15:22:48.350475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:48.070354Z","title":"Pointclip: Point cloud understanding by CLIP,","venue":null,"work_id":"20b0af89-52b0-4661-a619-d553bed679fc","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.694252Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:219ac32b4fb67bbc4d9e34985d833309d217515288d7957e23d4ab19b081b0a8","observation_id":"db120c11-e55f-475b-9973-a965960dfd4c","resolution":{"observed_at":"2026-08-07T15:22:48.196885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.769394Z","title":"ULIP: learning a unified representation of language, images, and point clouds for 3d understanding,","venue":null,"work_id":"a3bcead9-9d9d-468d-abf4-dfa10f30b8e3","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.734433Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:69d8a396e3f0e5d542a54366e225a4e24a7f09afa8a18f76c26ee6208e891aa3","observation_id":"c1ab0514-4cfe-4522-a5f2-657626a19113","resolution":{"observed_at":"2026-08-07T15:22:47.918903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.699885Z","title":"Con- ceptgraphs: Open-vocabulary 3d scene graphs for perception and plan- ning,","venue":null,"work_id":"5bf31ba2-26a5-4bef-b2f2-274f12b98d14","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.773536Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:a038b3624b48ebd5b9f08192b2248643d7f319de499acd9e9bc01a7c41515679","observation_id":"39a64823-4908-45b9-a961-84b4add1920b","resolution":{"observed_at":"2026-08-07T15:22:47.704740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.586046Z","title":"Ins-conv: Incremental sparse convolution for online 3d segmentation,","venue":null,"work_id":"3deed6f0-19de-4b81-8678-d4392486a0cd","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.802466Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:dcf8eaac7671d2fe98fb7b18e01cd78423b1d20ff344bcc11ad61aa11d216b1e","observation_id":"d01f0e2d-061b-43c4-82ee-b0e414d7e613","resolution":{"observed_at":"2026-08-07T15:22:47.690904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.447615Z","title":"PLA: language- driven open-vocabulary 3d scene understanding,","venue":null,"work_id":"fde0bd7c-20f2-4e51-8f64-48ce65775983","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.886820Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:d32405df894de61f56632d802adf6f7946658248da22ae5c7b0da763861bc5c0","observation_id":"0680cacd-3f64-4cf4-bc22-b2543216deb6","resolution":{"observed_at":"2026-08-07T15:22:47.532315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.331036Z","title":"Context-aware alignment and mutual masking for 3d-language pre-training,","venue":null,"work_id":"abc2a6ea-6b0d-47ea-9e76-90dc1c05f368","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:36.965831Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:359f00caa835c33dd2687d5c7fd4b5b5f6994b5c991c5c49fe900a5395abf8c9","observation_id":"5340ce07-8502-4f37-92b2-182b949e1c1a","resolution":{"observed_at":"2026-08-07T15:22:47.385633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.218195Z","title":"3d-vista: Pre- trained transformer for 3d vision and text alignment,","venue":null,"work_id":"2df82959-7508-4acd-ab63-7d5af280790c","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.049703Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:0d3b41930bb23bc3c03ce79ef662ee51588f063d1c3d83b97dd4687bcdfe5551","observation_id":"1c42f3b5-5cc3-4191-bedb-e6f934954ed6","resolution":{"observed_at":"2026-08-07T15:22:47.278458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:47.092842Z","title":"V ote2cap-detr++: Decoupling localization and describing for end-to-end 3d dense captioning,","venue":null,"work_id":"02b51ec1-b361-48e7-ad30-69e92b6dc51c","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.127649Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:e27fcc5a6282f742c59594070f93e35d94b840aa559d15eed69742955dc5d9d3","observation_id":"03bcb883-5144-48c4-8d25-35f60503e6bc","resolution":{"observed_at":"2026-08-07T15:22:47.145039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.943603Z","title":"Scan2cap: Context-aware dense captioning in RGB-D scans,","venue":null,"work_id":"fc03748a-55dd-4eb6-84cf-33bb8c001a84","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.191655Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:217c73204264d55625a041a9f5624af55eebe1a14420e7edb558d50a005fa067","observation_id":"174ef342-3f43-42c1-99a8-f33a840d8f8b","resolution":{"observed_at":"2026-08-07T15:22:47.025195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.788197Z","title":"Scanrefer: 3d object localization in RGB-D scans using natural language,","venue":null,"work_id":"e5dbb523-2d93-491a-b329-5689697514af","year":2020},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.257609Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:9c1af8cc9f1d81a7d8a4da31f4f1881d9711559fceae6ad2665e1cce1cafd967","observation_id":"6f1d9cff-261b-4a5c-9cdc-040ca6c17289","resolution":{"observed_at":"2026-08-07T15:22:46.861919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.645804Z","title":"Mask3d: Mask transformer for 3d semantic instance segmentation,","venue":null,"work_id":"22dcb285-cc73-404f-8bd5-de42cf873a88","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.416332Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:a005fc7d8f089573ec18d75948482cfc66d6f04144124bf6da1270c2d58ec92d","observation_id":"dde8a880-9efc-4790-86d8-b68f26d5ac69","resolution":{"observed_at":"2026-08-07T15:22:46.729120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.541109Z","title":"AGILE3D: attention guided interactive multi-object 3d segmentation,","venue":null,"work_id":"c53c41b2-b351-4475-9b28-07fba6a06cb2","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.477212Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:133d721de65ece9da6a10e46a64494bd66842eeb5ddce1691db3f7e984953816","observation_id":"d3e0b8d0-3a69-43f6-a14e-8705a198a9f4","resolution":{"observed_at":"2026-08-07T15:22:46.590863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.358515Z","title":"Uni3d: Exploring unified 3d representation at scale,","venue":null,"work_id":"1ef3f326-5a5f-4f8b-88da-b49d8eb0a4fa","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.504814Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:6cb484f0547b71830f88a621a1e49f666a3d5694deb927455f6bd98fbb807c87","observation_id":"5af2ed09-0ab5-4938-b052-a6432b548dce","resolution":{"observed_at":"2026-08-07T15:22:46.460899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.227939Z","title":"LERF: language embedded radiance fields,","venue":null,"work_id":"28757b33-f49c-4a9d-ab14-e0a59906bd6b","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.526429Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:b885f6adfc2bd57cc16ca63bd70d0be8c7322430a96047b481819c5d0bb8e5f1","observation_id":"a6367960-f0d5-4867-be02-f21755b94fe2","resolution":{"observed_at":"2026-08-07T15:22:46.286703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.078302Z","title":"Open-nerf: Towards open vocabulary nerf decomposition,","venue":null,"work_id":"856b0fc0-13a4-4735-b78a-97c8eb2c2ab6","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.556498Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:33a44dec8e9b571c29dac2924ea18ce2fdf7db2b25b5190d8299518aa4743ef9","observation_id":"1ebf5ee5-7739-43c2-be04-5a5f3f741c45","resolution":{"observed_at":"2026-08-07T15:22:46.145930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:46.001529Z","title":"Gov-nesf: Generalizable open- vocabulary neural semantic fields,","venue":null,"work_id":"5a401bd5-0ea5-4329-be2d-c606d6662a25","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.589635Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:55efe400393f8426a7172d1178a71d12e8171616a37f2afde5f607b269036c02","observation_id":"4ce5aff7-cbbd-4212-9dfa-eb0720b61700","resolution":{"observed_at":"2026-08-07T15:22:46.044116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11141","last_updated":"2024-02-17T00:15:09Z","snapshot_observed_at":"2026-08-05T23:08:32.859583Z","submitted_at":"2024-02-17T00:15:09Z","title":"Semantically-aware Neural Radiance Fields for Visual Scene Understanding: A Comprehensive Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11141","snapshot_observed_at":"2026-08-07T15:22:37.611786Z","title":"Semantically-aware neural radiance fields for visual scene understand- ing: A comprehensive review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.611786Z"},"links":{"cited_paper":"/paper/2402.11141","citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:254093ed1f7adb79fbe17d3ae46533f6e07bf8c9525cc1385ce4c1ad48f03855","observation_id":"a742f79b-67e0-43aa-824f-b9f7c096f313","resolution":{"observed_at":"2026-08-07T15:22:37.611786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.880771Z","title":"Kimera: From SLAM to spatial perception with 3d dynamic scene graphs,","venue":null,"work_id":"82f9dc79-fe76-49ea-b83c-df706a5039fc","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.640523Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:7c4b39b92848741c4a29fc6fa6fa4fa30fbbbaeb4bc867000dfb68dd1b09ef9c","observation_id":"dc95b1c2-1b80-4700-8fa1-23d2afa44bed","resolution":{"observed_at":"2026-08-07T15:22:45.917354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.752576Z","title":"Mid-fusion: Octree-based object-level multi-instance dynamic SLAM,","venue":null,"work_id":"b2124e0b-dabc-4866-a842-1dc4974ba88e","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.679335Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:27067a8e7cc8ed53c10cdf20a8d555dcdfcb39c09ef5c065a5d657eff297214d","observation_id":"2179a4f0-55a8-4f2c-bed6-58d2cd5c7a74","resolution":{"observed_at":"2026-08-07T15:22:45.834189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.600724Z","title":"Quadricslam: Dual quadrics from object detections as landmarks in object-oriented SLAM,","venue":null,"work_id":"64256283-e39d-478c-8621-80b61a874158","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.719308Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:710db68858e1e7717ff5067f052e097401fd531ff34896068afef7baa90063cc","observation_id":"ca011e25-00f4-4b29-8f48-2a45c2574ef3","resolution":{"observed_at":"2026-08-07T15:22:45.655941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.431464Z","title":"Semantic segmentation guided slam using vision and lidar,","venue":null,"work_id":"6c1dc033-125c-4115-a026-6c418cdd782a","year":2018},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.760364Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:b35bfcfee6de8248cf65f6d886e5330b8fa42a510459e912653fcdb342b7982f","observation_id":"2b346505-10d3-48fc-a25f-057bfbd80b55","resolution":{"observed_at":"2026-08-07T15:22:45.549884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.315366Z","title":"SLAM++: simultaneous localisation and mapping at the level of objects,","venue":null,"work_id":"e5b6b666-0556-43d4-b16e-1b64e2469ef8","year":2013},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.800164Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:47c41f41cb0a3ecb64ebb63470fd0c4cccbc7394436847b1a62d9a38e2f17ec2","observation_id":"1119398b-5e04-4849-a3b2-6bdfe7cb5f9a","resolution":{"observed_at":"2026-08-07T15:22:45.379886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.173077Z","title":"vmap: Vectorised object mapping for neural field SLAM,","venue":null,"work_id":"934b2b71-fe06-40ff-966f-2ad37fbb35a8","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.829092Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:e3dbf70071f6b1a1c4a5f214af05f6521bf25f2212372b0776ba64cb25efc6fd","observation_id":"be73c05f-9191-4662-a799-8d51121f17d1","resolution":{"observed_at":"2026-08-07T15:22:45.266814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:45.059964Z","title":"Tightly coupled semantic RGB-D inertial odometry for accurate long-term localization and mapping,","venue":null,"work_id":"f4bfd8ce-abf9-4e1a-9d5c-4892e11b38e4","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.848026Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:5d95e4ef27d19672be99a211127db0279d35337b743ac7ffdfc9d76d72296226","observation_id":"77e96657-9eb6-439f-b088-ec30998b66ab","resolution":{"observed_at":"2026-08-07T15:22:45.100754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.870845Z","title":"RO-MAP: real-time multi-object mapping with neural radiance fields,","venue":null,"work_id":"58b0efa8-f165-45b2-852f-79308f8355f2","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.886184Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:7ad35ef2700ab69d4a01427271231676bf182d22f245f78cddac8696da2c8019","observation_id":"1baec478-43a8-44b5-af09-db67a4a13906","resolution":{"observed_at":"2026-08-07T15:22:44.961101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.731125Z","title":"Fusion++: V olumetric object-level SLAM,","venue":null,"work_id":"f46031a3-b170-4d25-b443-3ca40585f90e","year":2018},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:37.953885Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:72cf3b3bccc7e43280c3537cdcf28280d648a9a589d174e367b39129f219d7fc","observation_id":"09adcbe4-128b-4370-b379-1ecbca49b60b","resolution":{"observed_at":"2026-08-07T15:22:44.789161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.574503Z","title":"Scenegraph- fusion: Incremental 3d scene graph prediction from rgb-d sequences,","venue":null,"work_id":"acf6e582-44a8-412c-a840-3eb8a3abc163","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.037892Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:f994f7d72e05ab0b4e1114f9d8133627b3376ff018542352cad5d6b76f794743","observation_id":"79feeaa0-5e41-4dec-a909-3cde8b29c583","resolution":{"observed_at":"2026-08-07T15:22:44.681051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.512881Z","title":"Hi- erarchical Open-V ocabulary 3D Scene Graphs for Language-Grounded Robot Navigation,","venue":null,"work_id":"e09a952d-be2c-4d65-b2f5-af49f6f4d42b","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.085663Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:e3ae8e862a2706abbc22068c17241cb7ef9aa96caee5057f6738c08119204e5a","observation_id":"b05a4e2e-2635-48e7-9197-30829766d262","resolution":{"observed_at":"2026-08-07T15:22:44.536995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.351598Z","title":"Llm-seg: Bridging image segmentation and large language model reasoning,","venue":null,"work_id":"2811f96a-5957-46f9-8722-d7b16a001a6c","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.133526Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:a909c1b13c22ecb6fea16cb7526963c8edd0d25a2da5704420a8c0be9b24449d","observation_id":"bc261b03-a5aa-47c0-9adb-72f3fb2225f7","resolution":{"observed_at":"2026-08-07T15:22:44.455263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.223537Z","title":"Llmformer: Large language model for open-vocabulary semantic segmentation,","venue":null,"work_id":"107ef948-3a93-4208-bb43-13b3d31251f7","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.196140Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:c99d576581fd1a132443efe7447411e75c23d92298d880b25ca7a352739667d3","observation_id":"b0e22997-5ddb-47fb-a938-4d22e4c30123","resolution":{"observed_at":"2026-08-07T15:22:44.296504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:44.064437Z","title":"SQA3D: situated question answering in 3d scenes,","venue":null,"work_id":"03247ad4-e8ed-4b32-92c9-c2eb8a137e7b","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.300867Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:4cc2ba7d0d996db8add68d8642e3eee900b6310d8462e040c8c4b2b98f33fe32","observation_id":"26f0bf3d-7abc-4212-80f7-5a90330c061d","resolution":{"observed_at":"2026-08-07T15:22:44.146281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.892439Z","title":"Scanqa: 3d question answering for spatial scene understanding,","venue":null,"work_id":"95aaf3ce-1468-487c-b813-5edd225c6dc6","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.427208Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:8695b9ddff24430c4fbe116ac8d79e226724dfe1ad6e0d482ae2f51bf5b1e1e4","observation_id":"39f39f71-9875-4150-b47a-948eb1e65ef0","resolution":{"observed_at":"2026-08-07T15:22:43.973881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.670200Z","title":"Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes,","venue":null,"work_id":"45d8273a-43a2-4534-8a97-b6baa4195ada","year":2020},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.554792Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:caf00e77ad1e0c53a03e495cad4f0545a2e4444ac3fd4500c38e697a2b53a2b5","observation_id":"4ab3e50a-cbb9-495f-8022-d4116f691f6d","resolution":{"observed_at":"2026-08-07T15:22:43.789543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10370","last_updated":"2024-11-18T08:29:08Z","snapshot_observed_at":"2026-08-05T04:37:45.202508Z","submitted_at":"2024-05-16T18:03:41Z","title":"Grounded 3D-LLM with Referent Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10370","snapshot_observed_at":"2026-08-07T15:22:38.641610Z","title":"Grounded 3d-llm with referent tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.641610Z"},"links":{"cited_paper":"/paper/2405.10370","citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:b4eed6e10506d915576b4a211f92b1ec4f8c346fbc36fa78f2c411564e156965","observation_id":"1e132501-0529-491e-abee-8a279aa49919","resolution":{"observed_at":"2026-08-07T15:22:38.641610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.480637Z","title":"3d-llm: Injecting the 3d world into large language models,","venue":null,"work_id":"8cf08118-3ecf-4e47-9e86-4051db812b79","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.725747Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:5142a98611541e98c7cd06e6c4e3a4fd3a9b60f21b2275dfc745484232d118c2","observation_id":"722e0fd3-7eba-4ddb-809b-100e21b8c641","resolution":{"observed_at":"2026-08-07T15:22:43.570868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.333551Z","title":"Ll3da: Visual interactive instruction tuning for omni-3d understanding reasoning and planning,","venue":null,"work_id":"98586311-480f-4005-b318-3408b748816b","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.848978Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:f5eb9dcda5659d301ee0841fa1bfd71848bf17bdd34779895b9b30f83f185712","observation_id":"1797064e-d44f-419f-b836-d4a18ed7d697","resolution":{"observed_at":"2026-08-07T15:22:43.385449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:43.140687Z","title":"LLM-Grounder: Open-vocabulary 3d visual grounding with large language model as an agent,","venue":null,"work_id":"465a1aca-b5da-481c-82a2-f9dc4fd8e1b3","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:38.964761Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:2d4a0961b46ad82560087e82c8e95505359bd245a436c1730405fe3ca3232611","observation_id":"e24f7baf-3af7-4aab-bc09-7090d5938393","resolution":{"observed_at":"2026-08-07T15:22:43.232237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:39.060210Z","title":"Multi-object hallucination in vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.060210Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:c7b46d831895e9e163d4c97e99dc63fccac442eab286d3adc4f72de7ba07dba0","observation_id":"a35e7804-8e7c-4725-8d49-efe99e070996","resolution":{"observed_at":"2026-08-07T15:22:39.060210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:22:39.197156Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.197156Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:7a3279280505240889bf7737d190397165144e95f4e700f561d896d19bbcab44","observation_id":"f5d6dc99-a140-4730-8f27-d883b362e6cc","resolution":{"observed_at":"2026-08-07T15:22:39.197156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.923756Z","title":"Open3DSG: Open-vocabulary 3d scene graphs from point clouds with queryable objects and open-set relationships,","venue":null,"work_id":"e69af4a4-f1a4-41dd-a642-c14adaaf903d","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.329139Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:23179b1faec329aaede5d0ad597ea358490b16faa50b4acc564540243b24d3b7","observation_id":"8cdfc10f-e501-431c-b60e-c999646e1a7e","resolution":{"observed_at":"2026-08-07T15:22:43.030317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:39.430313Z","title":"The hungarian method for the assignment problem,","venue":null,"work_id":null,"year":1955},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.430313Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:7a038029bb1aa937b0ff5a29f62c1eb36c2fe43e30837a1de6ca923fa9ab3e06","observation_id":"4531bd7a-3a80-412a-9665-1b7e9a225cac","resolution":{"observed_at":"2026-08-07T15:22:39.430313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.729144Z","title":"Scenenn: A scene meshes dataset with annotations,","venue":null,"work_id":"4613a20e-518f-4d43-82c0-8e93dc02f8c0","year":2016},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.520091Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:c374d95b2c5a2a7c4e5f5664549d53c25f16ef679b464d2249c122575f9470dd","observation_id":"3f52e759-6c93-4bc7-a1a1-dce4c01d0a62","resolution":{"observed_at":"2026-08-07T15:22:42.838258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.533321Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes,","venue":null,"work_id":"e18de131-0390-47c3-8b17-8aae5a4e8ccc","year":2017},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.670356Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:d69d2f65c9e7cfd34331714f84d96d9ab67fe2eec7cd5cb017f5b33da6c298f1","observation_id":"d0f8a6fc-5b47-4c92-a2ec-64d96f214198","resolution":{"observed_at":"2026-08-07T15:22:42.611250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.291065Z","title":"Scannet++: A high- fidelity dataset of 3d indoor scenes,","venue":null,"work_id":"d1e17fa6-820b-4203-96a0-620a416e585a","year":2023},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.804187Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:bf1e2edb25f6443dfb72af0a5cda0aa69e40f88bb537f768912ed985195d5b96","observation_id":"bb754713-ab9e-419a-ae19-04b065f337ed","resolution":{"observed_at":"2026-08-07T15:22:42.403542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:42.131821Z","title":"Language-grounded indoor 3d semantic segmentation in the wild,","venue":null,"work_id":"095bf481-7ad7-48d4-abbc-192a52ba1e03","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.896850Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:bf1e9a16c800b33458edf5493a3a63448d633aeb6d7f2b39b94e3ea0d75b185a","observation_id":"73f3b243-a8b4-4fcb-8667-c56720acb85d","resolution":{"observed_at":"2026-08-07T15:22:42.215221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05797","last_updated":"2019-06-13T16:29:58Z","snapshot_observed_at":"2026-08-01T13:51:16.469557Z","submitted_at":"2019-06-13T16:29:58Z","title":"The Replica Dataset: A Digital Replica of Indoor Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05797","snapshot_observed_at":"2026-08-07T15:22:39.972152Z","title":"The Replica dataset: A digital replica of indoor spaces,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:39.972152Z"},"links":{"cited_paper":"/paper/1906.05797","citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:ada4f88dbbd8cc2fbcc2a4e6e622f94cdb8b0748c9c64f5b2bb43048650731f1","observation_id":"15810e38-0f8a-4aa5-a8a4-100c81035074","resolution":{"observed_at":"2026-08-07T15:22:39.972152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.907854Z","title":"V olumetric instance-level seman- tic mapping via multi-view 2d-to-3d label diffusion,","venue":null,"work_id":"eab6fae2-c074-4328-9132-e82564aaae07","year":2022},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.086075Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:06279acfbb13030837fa248dece0c4e1310e1dcbd4881ee1d6e3709ad45ae2be","observation_id":"84791a6d-fb38-44f4-9744-f8c049a006bf","resolution":{"observed_at":"2026-08-07T15:22:42.017279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.672891Z","title":"Reconstructing interactive 3d scenes by panoptic mapping and CAD model alignments,","venue":null,"work_id":"1a00d9f1-ebe4-4e55-ab49-6cd627edd57f","year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.226975Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:4edaef76d78fd5934608945ec2f0ccc433b17d43f905b928199d7a813f5666e6","observation_id":"9131ee45-4c85-458f-b76c-844822d0826f","resolution":{"observed_at":"2026-08-07T15:22:41.816365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.460525Z","title":"Multi-view fusion-based 3d object detection for robot indoor scene perception,","venue":null,"work_id":"4be09754-9783-425c-823d-981a7e709030","year":2019},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.329151Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:3c2c36c6c37c5c2d41cf18ee629dc3546c64bec5eb3539a2e670655cb91fdef6","observation_id":"704a7737-9c43-405d-bc9a-20d9e6d8a25f","resolution":{"observed_at":"2026-08-07T15:22:41.547600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.259948Z","title":"Incremental instance-oriented 3d semantic mapping via rgb-d cameras for unknown indoor scene,","venue":null,"work_id":"b86d8bc3-c00b-4c4b-9fd9-8efe6a0f047b","year":2020},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.436907Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:ac3f3a183e275a1786b6e7181114392b1bf1c744f53ed88f61e13033fba4a372","observation_id":"2edf28c1-51f9-4378-8089-8073e8569949","resolution":{"observed_at":"2026-08-07T15:22:41.354254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:41.099808Z","title":"V olumetric semanti- cally consistent 3d panoptic mapping,","venue":null,"work_id":"2cce5e76-2797-4c15-a447-db987d57a674","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.546225Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:03c4f965a72199697c3995f8a3b88939dd840edb6017dd299e4d51cd0c5c0fe5","observation_id":"ad5464f7-a2ce-43f4-937d-a380e4b6e129","resolution":{"observed_at":"2026-08-07T15:22:41.173056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:40.635796Z","title":"Orb-slam3: An accurate open-source library for visual, visual– inertial, and multimap slam,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.635796Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:01f79e436df4252589652df2ab09b2ca790eb1e868fed823c0b4adf777bdbd08","observation_id":"7cd7d39f-beae-44a9-bde2-73d7f02c59ae","resolution":{"observed_at":"2026-08-07T15:22:40.635796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:22:40.917581Z","title":"Openins3d: Snap and lookup for 3d open-vocabulary instance segmen- tation,","venue":null,"work_id":"6a5e5bb6-44a9-4112-831d-57adf6587b64","year":2024},"citing_paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:22:40.727671Z"},"links":{"citing_paper":"/paper/2505.15373"},"observation_digest":"sha256:8800f99548946b2ba040a05e69462a2d0ea17688b3946524d979cbc0dd898ed0","observation_id":"070d3c4c-7378-4b07-9b30-fbd7e517e808","resolution":{"observed_at":"2026-08-07T15:22:40.994241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.15373","last_updated":"2025-05-21T11:07:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:16:40.613025Z","submitted_at":"2025-05-21T11:07:25Z","title":"RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":60},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 1 inbound Pith citation observation for arXiv:2505.15373."}