Pith. sign in

Paper Citation Record · LEDGER

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding

As of 9 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 0 inbound Pith citation observations for arXiv:2512.23020.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2512.23020 v3

Coverage vector

measured 76 of 76 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-03T13:46:30.742617Z

measured 76 of 76 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

76 of 76 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved76
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 4b346241-e0e1-43ec-88bb-c7892aeca65f · outbound

This paper cites Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.639077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.639077Z digest=sha256:50c050eeceba0b36535190eeef842fd13277f283d21ff889b2b04b2492d3288e

Observation 7cb64a59-1787-46a4-b295-ad60e12ceb72 · outbound

This paper cites Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.676297Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.676297Z digest=sha256:4fe89e6dd9e11dc7e28d4aa6000c68b295e761f255ccf959b1a925b48be4015e

Observation 55fef07d-a12e-4b20-8630-3ea9ee537b29 · outbound

This paper cites Qwen2.5-VL Technical Report.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Qwen2.5-VL Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.725953Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.725953Z digest=sha256:8949e4aba3379b6eb57c7e4adcf90cc0fc62c8a3f301bfe6efb68cf5fc51bfa5

Observation 313e7e72-8f17-4ead-8cf0-73b5e44adc38 · outbound

This paper cites ARKitScenes: A Diverse Real-World Dataset For 3D Indoor Scene Understanding Using Mobile RGB-D Data.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding ARKitScenes: A Diverse Real-World Dataset For 3D Indoor Scene Understanding Using Mobile RGB-D Data

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.796692Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.796692Z digest=sha256:7ad91713011069b2929930eba7db5f9ccb1c0d8d5c4697ab0e25589c2735f4d2

Observation 1ea61447-7beb-4efd-b01a-dfde39e94a8e · outbound

This paper cites V olcengine, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding V olcengine, 2025

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.853650Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.853650Z digest=sha256:46a66d4dd2dc41c1a8b1005c3f33e20b4af99515079a0500766829a073d60bbc

Observation 1e65dbb5-7e34-4f5f-8fff-e0fc2d88a324 · outbound

This paper cites Scanrefer: 3d object localization in rgb-d scans using natural language.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Scanrefer: 3d object localization in rgb-d scans using natural language

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.916811Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.916811Z digest=sha256:09523ffbf436bdfaf28eed3a17cd8da5ec697195278302b9955b05152226d361

Observation 365da19f-3f5b-44f5-a20d-e35d17c5ccec · outbound

This paper cites Clip2scene: Towards label-efficient 3d scene understanding by clip.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Clip2scene: Towards label-efficient 3d scene understanding by clip

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:24.997144Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:24.997144Z digest=sha256:d9aa6713b09039f0a0bb16786ef3acbb3bd9c77d2dce982b7162dd5dccabedfe

Observation 5105a9ff-fdc1-4b41-9095-839b7250849b · outbound

This paper cites Internvl: Scaling up vision founda- tion models and aligning for generic visual-linguistic tasks.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Internvl: Scaling up vision founda- tion models and aligning for generic visual-linguistic tasks

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.071306Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.071306Z digest=sha256:e7776dad98540ecf7bb843c9371af0dd0da4c5ca2cc08dfacc6aa9a927f21995

Observation 0ff6566a-fc14-4ad6-b5c3-323be97cdb00 · outbound

This paper cites Scannet: Richly-annotated 3d reconstructions of indoor scenes.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Scannet: Richly-annotated 3d reconstructions of indoor scenes

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.129168Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.129168Z digest=sha256:ef60e907dd0dfb4ac3f501ca401edf36fe738f35d9853b6cbb189a856705aba9

Observation 46ad6a8a-70b9-49da-b652-3cc48b0672d0 · outbound

This paper cites Text-guided sparse voxel prun- ing for efficient 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Text-guided sparse voxel prun- ing for efficient 3d visual grounding

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.187733Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.187733Z digest=sha256:5b2226e32a97c69d26f9a61d60961f9a9b874bc8ebff0c34d68d6b7fe54faff8

Observation 79ffd427-3678-4b2a-8168-4a7734fab0cf · outbound

This paper cites Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.254469Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.254469Z digest=sha256:680c3724706be2f8b62fd498e79518195b044cc622f81ad4346aeba52f536731

Observation aba550f1-ed45-4a81-abaa-ad820e307ae1 · outbound

This paper cites Visual Language Maps for Robot Navigation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Visual Language Maps for Robot Navigation

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.397049Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.397049Z digest=sha256:756b2c650e574100a7c56b4262cce5f7996a17a9c7319e50ee325c3aeebc9cae

Observation d8f4c378-cc0b-43cc-9bca-b2f04d685a82 · outbound

This paper cites Viewsrd: 3d vi- sual grounding via structured multi-view decomposition.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Viewsrd: 3d vi- sual grounding via structured multi-view decomposition

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.547384Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.547384Z digest=sha256:beabc813e490760ff94d931248781397ff8731a8d159d410cfece29b60595e6c

Observation ae655177-e249-4e1d-a798-b8d92ac04e86 · outbound

This paper cites Real-time object detection meets dinov3.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Real-time object detection meets dinov3

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.615188Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.615188Z digest=sha256:02e1c2ac947c0badb06a58e9355643fd2c2ae0246a1e5ed68f9226d2037f3bb7

Observation 0cdf0053-1cc4-41c5-a688-a9bc2a70ff88 · outbound

This paper cites 3D-R1: Enhancing Reasoning in 3D VLMs for Unified Scene Understanding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding 3D-R1: Enhancing Reasoning in 3D VLMs for Unified Scene Understanding

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.731371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.731371Z digest=sha256:278ba31e6b90ad0a43cd8582bcac0d4457809886da127831c2de6c19b9538e7e

Observation 3d8791ce-1010-443c-b94b-10369b914744 · outbound

This paper cites Assister: As- sistive navigation via conditional instruction generation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Assister: As- sistive navigation via conditional instruction generation

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.801754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.801754Z digest=sha256:e8b4baee4498b7a7e7c3ffcbc7f2c226f72f1878f1f2d06478a8c280ffe00a50

Observation 4376230b-4c53-4e26-a8f6-b0ff8ffbf535 · outbound

This paper cites Bottom up top down detection transform- ers for language grounding in images and point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Bottom up top down detection transform- ers for language grounding in images and point clouds

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.845804Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.845804Z digest=sha256:1bddb9d41ffbe53fc2823bc725d79feb568a384558cb6fb625a93ae273b2df97

Observation 0ea278d1-3707-465b-9906-d3296915f07b · outbound

This paper cites Pointgroup: Dual-set point grouping for 3d instance segmentation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Pointgroup: Dual-set point grouping for 3d instance segmentation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.912211Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.912211Z digest=sha256:e85541d55cd8d099f1ecce65de17177e636a49b9c4a09fb44c34784ac9a1c27b

Observation 8d28f72c-da0d-45f4-bbc5-e6f807603ee0 · outbound

This paper cites Spazer: Spatial- semantic progressive reasoning agent for zero-shot 3d visual grounding, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Spazer: Spatial- semantic progressive reasoning agent for zero-shot 3d visual grounding, 2025

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:25.960605Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:25.960605Z digest=sha256:1d700bd7f47d6782600f008da2aa644dc47679a7406a946e833cb17537c8c6ee

Observation 94f518d9-4b48-49ab-802d-b24c4340eb6e · outbound

This paper cites Segment Anything.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Segment Anything

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.060718Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.060718Z digest=sha256:127e5dfe1e5813c70281080277bd1c03f0d63aa6bf87198333e174c0ef400bd3

Observation 2060021a-bdac-4969-9613-d3b9a9a896d4 · outbound

This paper cites Robo3d: Towards robust and reliable 3d perception against corruptions.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Robo3d: Towards robust and reliable 3d perception against corruptions

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.160300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.160300Z digest=sha256:8f9d6c1ef068cdc53b515bcfc76daa2e85e976afc2c966d48e99a620820b093b

Observation 9869603a-e889-42c3-9a27-33295ed45466 · outbound

This paper cites Binary coors capable or ‘correcting dele- tions, insertions, and reversals.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Binary coors capable or ‘correcting dele- tions, insertions, and reversals

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.184051Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.184051Z digest=sha256:9b020a8b47a1e462ff514c1b0ba4f0ff58e5315cbc025e76fcbdf633dd07f579

Observation 9daaeccf-04d9-44ef-8393-d9f33e95ee1a · outbound

This paper cites Cityanchor: City-scale 3d visual grounding with multi-modality llms.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Cityanchor: City-scale 3d visual grounding with multi-modality llms

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.351052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.351052Z digest=sha256:10c4839b05520800f7d7935a6b6009d2bc8dd8c2441455837bc423d5b761a318

Observation 0aa3d14f-4e59-4823-883b-658530d8641d · outbound

This paper cites Seeground: See and ground for zero-shot open-vocabulary 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Seeground: See and ground for zero-shot open-vocabulary 3d visual grounding

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.509898Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.509898Z digest=sha256:74e82d4c72d9816909ac2c95c6c2081be35ea6e0128ca1babef1fe1cac3bd8b0

Observation aebef689-f72b-4ddc-8853-94e5b34d856d · outbound

This paper cites Seqvlm: Proposal- guided multi-view sequences reasoning via vlm for zero- shot 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Seqvlm: Proposal- guided multi-view sequences reasoning via vlm for zero- shot 3d visual grounding

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.629243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.629243Z digest=sha256:087f8ee117bff4ca7012d9fe11817a761971511752c3219c3409120279756d4d

Observation 9e22817d-c8bc-4075-b897-a3ae1548164a · outbound

This paper cites Groundflow: A plug-in module for temporal reasoning on 3d point cloud sequential grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Groundflow: A plug-in module for temporal reasoning on 3d point cloud sequential grounding

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.799701Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.799701Z digest=sha256:b5845234aac82ecbe3326dac8c045f71ec43af7b98d56c9971efc8ca767b9488

Observation dc85aebc-4eba-4633-b6fc-e820d97724f9 · outbound

This paper cites Improved baselines with visual instruction tuning, 2023.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Improved baselines with visual instruction tuning, 2023

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:26.973422Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:26.973422Z digest=sha256:0a2fe8eb0fb3431a5881689b61d4b0fb402b180c73bc5c75dfef6cf9f9a678a0

Observation 4f273e61-c111-4dfc-83c1-c1dc8b131b5c · outbound

This paper cites Visual instruction tuning, 2023.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Visual instruction tuning, 2023

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.091001Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.091001Z digest=sha256:27a716661c5bb465d1296de92208c0ce9d08f9cdb20a9558dffea8e5cbd04521

Observation 625178ca-ae18-4280-b076-d97ccc34447b · outbound

This paper cites Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.233532Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.233532Z digest=sha256:60e8de45d8e174723bc2b6bd53bb96e04664f0b3e121cdb4ae2e77f81a4b53da

Observation dcca793a-e749-461c-8723-89250657945e · outbound

This paper cites Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.376732Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.376732Z digest=sha256:3708ef009148068cbdaeadbb3209b5c254384bbfa77c8b2d1fe4c90556e74363

Observation 0436e47e-bb4e-443f-af38-a90c8ec9db68 · outbound

This paper cites Aligning cyber space with physical world: A comprehensive survey on embodied ai.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Aligning cyber space with physical world: A comprehensive survey on embodied ai

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.593660Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.593660Z digest=sha256:c8ce84f3f7437a4994b1ca1979c3c1db736a515357c39ea90195aa746f458c8a

Observation 609dd445-8d22-4c7d-a296-3472a44a633b · outbound

This paper cites Group-free 3d object detection via transformers.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Group-free 3d object detection via transformers

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.638770Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.638770Z digest=sha256:fbd0544c7a0117939de8d3d4a0c913807613adeb3dbad3e52bd571480846eb2c

Observation 7ad903ff-af64-4bf5-ae6f-cd74ad7cce1f · outbound

This paper cites Rea- songrounder: Lvlm-guided hierarchical feature splatting for open-vocabulary 3d visual grounding and reasoning.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Rea- songrounder: Lvlm-guided hierarchical feature splatting for open-vocabulary 3d visual grounding and reasoning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.714644Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.714644Z digest=sha256:216431924eb878b9d5a0ec033d7c800548091e6bfe35a2a5dbb32246342887f4

Observation 61b1d477-c84d-4d3e-9fb2-c3ae3b292bad · outbound

This paper cites An Examination of the Compositionality of Large Generative Vision-Language Models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding An Examination of the Compositionality of Large Generative Vision-Language Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.883179Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.883179Z digest=sha256:13a2fe232bd37b2999fab776870fd257a281cfc159810e6b76cf77dac08be296

Observation dd930adc-d263-4ca4-9785-2d0317dbd7a4 · outbound

This paper cites A guided tour to approximate string matching.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding A guided tour to approximate string matching

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:27.983279Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:27.983279Z digest=sha256:36408e2a69102346b15af572772193c695eae7d7552d4a96fce026e98ea3c1b6

Observation f0860b1e-8f69-4d8c-aacb-33e8803e4aab · outbound

This paper cites Open3dis: Open-vocabulary 3d instance segmentation with 2d mask guidance.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Open3dis: Open-vocabulary 3d instance segmentation with 2d mask guidance

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.053097Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.053097Z digest=sha256:a40713877a070cb474095352b4314b7f30651a8519cf28d4f285e8450c3d1ad0

Observation 32c978b5-73d8-4424-82b2-d4e30651184c · outbound

This paper cites Gpt-4 technical report, 2024.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Gpt-4 technical report, 2024

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.121495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.121495Z digest=sha256:4229215df2b2df8ecc41b3141b257671c8a9e09d8576fc890291fa62a942dc3a

Observation e6481afa-a945-489a-9415-830dd543b5bd · outbound

This paper cites GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.179433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.179433Z digest=sha256:4679c685a8f200dfaf0e8ea0f23c13e6dc0a2a4aaed0f25d983c2c5168eda7a2

Observation 9eb4c277-9824-4e43-97cb-0256e0b9ea0f · outbound

This paper cites Multi-branch collabora- tive learning network for 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Multi-branch collabora- tive learning network for 3d visual grounding

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.243595Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.243595Z digest=sha256:c68518f71bd30f1ed6878a41e8f9a65b97c3618f07637e22da47ca5b95b5addd

Observation 70dc88a2-54c0-40d3-ac7d-dd9c867f6c76 · outbound

This paper cites Learning transferable visual models from natural language supervision, 2021.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Learning transferable visual models from natural language supervision, 2021

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.297223Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.297223Z digest=sha256:b60b1054219a370f11f989290705575c07264dec61eb42b03164505f2bb2d663

Observation d5b20ee0-b1e6-49f0-8540-80afdd41453b · outbound

This paper cites SAM 2: Segment Anything in Images and Videos.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding SAM 2: Segment Anything in Images and Videos

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.346656Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.346656Z digest=sha256:9e233118a3ca240852f89159389776ae408206b31c8f03e36ad2df0474d8512e

Observation 57964a5f-e6fc-4aef-91ef-31deb606b288 · outbound

This paper cites Grounding dino 1.5: Ad- vance the ”edge” of open-set object detection, 2024.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Grounding dino 1.5: Ad- vance the ”edge” of open-set object detection, 2024

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.393825Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.393825Z digest=sha256:f33a785acf4077837bd7f60a998dfde61f9c741297ac3121cf31c3f433dc2996

Observation 32008338-e2d5-4e3f-a618-5dc97d6e26ca · outbound

This paper cites Grounded sam: Assembling open-world models for diverse visual tasks,.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Grounded sam: Assembling open-world models for diverse visual tasks,

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.424535Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.424535Z digest=sha256:18e2ccee9c02f7ae4a3a148e61aca843c7ddff1f25afd1ae61096d16be7d652d

Observation daf0f72f-dfe0-4e2b-a1ff-767a1fdd28f1 · outbound

This paper cites Mask3D: Mask Transformer for 3D Semantic Instance Segmentation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Mask3D: Mask Transformer for 3D Semantic Instance Segmentation

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.502891Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.502891Z digest=sha256:716164a0a1b3ed1992fff82801e3a1208a3f7b93ea04dde707572164f1943f02

Observation e3503738-9962-483a-a2b3-9a578d223cfc · outbound

This paper cites an unresolved cited work.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Unresolved cited work

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.607897Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.607897Z digest=sha256:c2aaf39d3d4aee8a17d27e68b10e58901868ffd8eb0205731362668fec5d5859

Observation a9395ac1-3912-48b4-82d0-acf97ae44f8f · outbound

This paper cites Chain of semantics programming in 3d gaussian splatting representation for 3d vision grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Chain of semantics programming in 3d gaussian splatting representation for 3d vision grounding

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.748376Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.748376Z digest=sha256:be371f675c48726a8901bc8f042cb843cb83c21de060bbd219bb9efdc8af768d

Observation 3472fcdf-5afe-46c1-be4d-3509521c0783 · outbound

This paper cites Scanverse: An extended reality authoring platform for in- dustrial digital twins.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Scanverse: An extended reality authoring platform for in- dustrial digital twins

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.854787Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.854787Z digest=sha256:58196e46e8272a86f41650c9a5907d0842dc6dc6d4fb255fbe8ee1b0dc1455de

Observation a6820240-1a67-4ba2-b240-7f044a4c3e72 · outbound

This paper cites Toronto-3D: A large-scale mobile lidar dataset for semantic segmenta- tion of urban roadways.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Toronto-3D: A large-scale mobile lidar dataset for semantic segmenta- tion of urban roadways

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.908564Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.908564Z digest=sha256:b3c5b9f303b3d759e2f2955b6687dd94d55d18a4db9ec20d8f4166eb611df6b7

Observation 3be4b7ec-5f81-4755-833d-1eea1eb25418 · outbound

This paper cites Qwen3 technical report, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Qwen3 technical report, 2025

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:28.957516Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:28.957516Z digest=sha256:fcc4213608e4688ab3d9db1152decab16e736da5cc523f44501955953ce18f47

Observation 07a0aecb-96b9-4ac7-862a-76df66962e74 · outbound

This paper cites Step-3 is large yet affordable: Model-system co-design for cost-effective decoding, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Step-3 is large yet affordable: Model-system co-design for cost-effective decoding, 2025

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.034955Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.034955Z digest=sha256:9894863ca4b034868c77908ab9bde8e573596026ad3969d434f1fde210804d7c

Observation cc8f7e8d-a0aa-46cc-9b4f-f250c82245aa · outbound

This paper cites Glm-4.5v and glm-4.1v-thinking: Towards versatile multi- modal reasoning with scalable reinforcement learning, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Glm-4.5v and glm-4.1v-thinking: Towards versatile multi- modal reasoning with scalable reinforcement learning, 2025

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.130473Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.130473Z digest=sha256:aa5cb15d1fd00790221e377a12e59782dd10554f71b270f0f2071b6666c21ed2

Observation 814571d9-400c-4c26-8d44-9d44c9a40a71 · outbound

This paper cites Four ways to improve verbo-visual fusion for dense 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Four ways to improve verbo-visual fusion for dense 3d visual grounding

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.154289Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.154289Z digest=sha256:704ecd24bb251dc1dc20956952a0003c0bf8dcbdb00582af226efca9528d826f

Observation 7c244af7-a5db-4e14-b8ce-6532c0111468 · outbound

This paper cites Four ways to improve verbo-visual fusion for dense 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Four ways to improve verbo-visual fusion for dense 3d visual grounding

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.223924Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.223924Z digest=sha256:ddae07bccd3f338eb9937316ae0beb168de92e32b0f53dc3f5806a8a31965688

Observation f5708c28-47ae-43e2-9ff4-f8244763b1e0 · outbound

This paper cites Softgroup for 3d instance segmentation on point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Softgroup for 3d instance segmentation on point clouds

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.325058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.325058Z digest=sha256:803112ae2d3df72ab1b1a829df944c3642527fd47d073f16f9552349e16aba68

Observation 72d1996a-a531-4851-a608-fcfaf610fc9f · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.369610Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.369610Z digest=sha256:3fbecdd07c15028a461d35047d3d5029fa7574e469f563bec311c7eb5bdacf78

Observation 045eac86-d014-4d93-aa85-b015f2ab480d · outbound

This paper cites InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.439667Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.439667Z digest=sha256:3dd3392c19f1c7c813369c4ae8c9bf9aefe074fc0cbbb324ae7d80249c801ab1

Observation 6beead42-ee3b-461e-ac78-166077ee50b2 · outbound

This paper cites Gˆ 3-lq: Marry- ing hyperbolic alignment with explicit semantic-geometric modeling for 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Gˆ 3-lq: Marry- ing hyperbolic alignment with explicit semantic-geometric modeling for 3d visual grounding

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.489388Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.489388Z digest=sha256:0e351789b687a5fa51410ceaa347ccd38b575660ee6fb2b5169cecedc81a31be

Observation f9c39b50-f675-4731-a626-01bfe58e9bc4 · outbound

This paper cites Deepseek-vl2: Mixture-of-experts vision-language models for advanced multimodal understanding, 2024.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Deepseek-vl2: Mixture-of-experts vision-language models for advanced multimodal understanding, 2024

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.550904Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.550904Z digest=sha256:c589ba26438583cd51a9eaf2bfe89fbc6682883b9c7cc636f7dc82d9d2952b1e

Observation 382c87ca-ec19-4a3e-afa8-9f25ababd34a · outbound

This paper cites Vlm-grounder: A vlm agent for zero-shot 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Vlm-grounder: A vlm agent for zero-shot 3d visual grounding

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.609114Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.609114Z digest=sha256:383ee55a2e33dfdbce21d159ba9c86b0687a79621d2d3d3aa6404f3b0724f430

Observation fe98ea70-968a-4796-96d3-57bdbcdeb287 · outbound

This paper cites Pointllm: Empowering large language models to understand point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Pointllm: Empowering large language models to understand point clouds

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.707101Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.707101Z digest=sha256:b83a754d29f6793b4d8748d22e9b4369cb75583c25b827ec2efaf9ac295ec8a8

Observation 6cc2d2db-73c8-4542-ac51-40b761f4fc84 · outbound

This paper cites Llm- grounder: Open-vocabulary 3d visual grounding with large language model as an agent.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Llm- grounder: Open-vocabulary 3d visual grounding with large language model as an agent

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.770251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.770251Z digest=sha256:949b207a1073b0bb5f7a46a211bb7066a77e0985058d54c56bb38d7bee2816c3

Observation fdb310ac-5857-4264-ad30-debb3c91e2b7 · outbound

This paper cites Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.832565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.832565Z digest=sha256:14205467c2cede9fcaf4162c87cd62f33d300df0b3ce2118141062e2e2416f22

Observation 82175457-2fca-4ac1-bbc9-7a6120e388a5 · outbound

This paper cites Scannet++: A high-fidelity dataset of 3d in- door scenes.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Scannet++: A high-fidelity dataset of 3d in- door scenes

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.888749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.888749Z digest=sha256:25edfd484433c8b673e995832e9d22b8addef474e675d5c9b799b0f8b9782fa4

Observation 71713700-8dca-4192-9004-f57fff4b2e6d · outbound

This paper cites Visual programming for zero-shot open-vocabulary 3d visual grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Visual programming for zero-shot open-vocabulary 3d visual grounding

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.914190Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.914190Z digest=sha256:5a80cf4b2eca497fbc140cd222ca7b7205149dad8ea33d8c3299fe76dd716495

Observation 265e5e3c-adee-4ff5-b8a5-50ee03ade4ff · outbound

This paper cites SORT3D: Spatial Object-centric Reasoning Toolbox for Zero-Shot 3D Grounding Using Large Language Models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding SORT3D: Spatial Object-centric Reasoning Toolbox for Zero-Shot 3D Grounding Using Large Language Models

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:29.976578Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:29.976578Z digest=sha256:13002c35667a2dfc8bf76a31dec87fb8ce06d82be387d1f6b582eec31d6d9917

Observation 8c9db673-f821-44de-9a2f-029057679638 · outbound

This paper cites Freeq-graph: Free-form querying with semantic con- sistent scene graph for 3d scene understanding, 2025.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Freeq-graph: Free-form querying with semantic con- sistent scene graph for 3d scene understanding, 2025

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.037104Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.037104Z digest=sha256:65dcb765ea64e1d0367ebf464405e862a22bcca74cc35e827fae8df023d61b88

Observation 9d4a9856-247b-4feb-a670-6463b978ce0d · outbound

This paper cites Multi3drefer: Grounding text description to multiple 3d objects.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Multi3drefer: Grounding text description to multiple 3d objects

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.093670Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.093670Z digest=sha256:236d955e52b466b58f450a9cca5278920ae8f3d393f8eed51e92ca105a6712f2

Observation b9a73137-451c-4659-b58b-157ebbdc473f · outbound

This paper cites Prototype correlation matching and class- relation reasoning for few-shot medical image seg- mentation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Prototype correlation matching and class- relation reasoning for few-shot medical image seg- mentation

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.163068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.163068Z digest=sha256:01401c733d78cecf38366015504f862baa40f87aadc88ebc4ce8a5dafa8a4296

Observation 918a850a-c282-4b16-bc5f-4a8add1d2a3f · outbound

This paper cites Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Vision-and-Language Navigation Today and Tomorrow: A Survey in the Era of Foundation Models

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.233495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.233495Z digest=sha256:c3f46cce1fc41688d7ce4a3e83281de3ebbbd9ea8084c7ecd740cc2b742b6a31

Observation e42712d6-cb06-45aa-8643-30e1a0e2ef7c · outbound

This paper cites 3dvg- transformer: Relation modeling for visual grounding on point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding 3dvg- transformer: Relation modeling for visual grounding on point clouds

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.307236Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.307236Z digest=sha256:c7791d4d173631dfbf8614d05860e56f9913e764acf731dd7a7426287bd4f5d5

Observation 81f17d1f-e9b9-44ab-bf37-731031f23fee · outbound

This paper cites DenseGrounding: Improving Dense Language-Vision Semantics for Ego-Centric 3D Visual Grounding.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding DenseGrounding: Improving Dense Language-Vision Semantics for Ego-Centric 3D Visual Grounding

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.353680Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.353680Z digest=sha256:3f851ecaa01d506fa1eb59839b8c9ff581376823750aa86b0a8e75977cdeb020

Observation 7420f87d-4a26-45cd-b82a-55daeed10fef · outbound

This paper cites Point-SAM: Promptable 3d segmentation model for point clouds.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Point-SAM: Promptable 3d segmentation model for point clouds

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.422883Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.422883Z digest=sha256:9b6e567994f55e5dfad5c9c038d2d26362d2abc0e7aa629ed9c2694e3d2960f2

Observation 725628d7-5b50-4f3c-9e4c-88091d41cc87 · outbound

This paper cites LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.457026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.457026Z digest=sha256:6225cb2c9729161b2fc72e49b728febede19b9db5e0ece3358f6799d500a8d01

Observation ceaeb973-e054-41e8-9cbb-b6551fc49d41 · outbound

This paper cites Struct2d: A perception-guided framework for spatial reasoning in large multimodal models.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Struct2d: A perception-guided framework for spatial reasoning in large multimodal models

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.520895Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.520895Z digest=sha256:1601fdb0f1b869483270b4b46b841e4527cdc0ac10427f8c18f67a21bbfa3e26

Observation 098fbfdd-eb2e-48db-9b07-8b01ae14249d · outbound

This paper cites 3d-vista: Pre-trained transformer for 3d vision and text alignment.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding 3d-vista: Pre-trained transformer for 3d vision and text alignment

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.657126Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.657126Z digest=sha256:18b89e1f84059dcd34981bf5e9f1454d6e1dd2beb6cf3d55733ca5ae4128c5a0

Observation f93a6b4e-bca8-4850-a1ac-808aa1fd3e24 · outbound

This paper cites Move to understand a 3d scene: Bridg- ing visual grounding and exploration for efficient and versa- tile embodied navigation.

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding Move to understand a 3d scene: Bridg- ing visual grounding and exploration for efficient and versa- tile embodied navigation

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-03T13:46:30.742617Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:46:30.742617Z digest=sha256:6e6957b76efcc3524efaebc4d5d3ad6d9d2a74d0c24145ddde9b84c9a83622d5

Pith citing papers

No inbound Pith citation observations are available.