{"as_of":"2026-08-22T12:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ffd3662167730418f879877d37e357f5b1bec26b0f668568454914370f8759ad","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T23:23:21.424035Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.03869/citation-record","integrity":"/paper/2607.03869/integrity","json":"/paper/2607.03869/citation-record.json","paper":"/paper/2607.03869"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Rotated multi-scale interaction network for referring remote sensing image seg- mentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:a8c37f12e82a71ab6ad87153aee9c84c0127ca3b93f5bac2e588f377455f9f46","observation_id":"66e9850f-65d2-40cd-9607-d3cff592243b","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08613","last_updated":"2025-05-26T09:17:07Z","snapshot_observed_at":"2026-08-16T13:10:25.653960Z","submitted_at":"2024-10-11T08:28:04Z","title":"Cross-Modal Bidirectional Interaction Model for Referring Remote Sensing Image Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08613","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Cross-modal bidirectional interaction model for referring remote sensing image segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2410.08613","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:4c6cb9f4dc91c34cab943177dfed8ce79c7365c5aa11d2ba74da9e8e60bc9935","observation_id":"a1e13361-4b89-46d8-a20c-c2c3c093453d","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Exploring fine-grained image-text alignment for referring remote sensing image segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:80027f6463b48232cfef37a1f400fc7d6369e9fdb09fef8c24d520ecf8b65f20","observation_id":"e1b4fe2f-4312-4348-ac1d-7aa91746d45e","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Visual programming: Compositional visual reasoning without training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:5fcc32adcb4723c4a89301b072fcf719dd4ffdb24910b1e9f81d25eb6c0ea56a","observation_id":"4e04466e-b846-46d9-b2d4-af87d29e50cb","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"ViperGPT: Visual inference via python execution for reasoning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:441b47aa8f2aecff608e73f647a8b703d0c8e22454c930d26fbb4c5f12c88bd0","observation_id":"5803bbf7-0655-43cd-9b5d-e8f1eca2cd09","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Locate anything on earth: Advancing open-vocabulary object detection for remote sensing community,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:0837129994bffc6303b4ec3897ab1f822d0e7defe0e4b13248f7d7968ef71774","observation_id":"47f1ba69-7d8d-4c39-9a52-db7f8ff6aba1","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"CRIS: CLIP-driven referring image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:ee8219f2486fe52e04adb29b15180d0defc4966797d2b30690866d27d91f8bfa","observation_id":"112c7aec-f37b-404f-a8e9-7c1b0d0685b7","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"LA VT: Language-aware vision transformer for referring image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:4f4347431b84c393f4333233b0eacdb145e249276ed7244da865bf4fac037eb0","observation_id":"569ad6a7-e90c-4554-88c3-bb7c4ce08b9e","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Referring image segmentation via recurrent refinement networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:849bbd7fc51215501b6a7ecf1277616ea83cd9fbdad65be6dc82db886fc80618","observation_id":"200932a1-3c13-43f7-9d0a-bf749a8e991b","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Bi-directional relationship inferring network for referring image segmentation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:23171d827d27b1e19d17d281ddb28c64f262648f9cd90597d75fe6a3e83f96cc","observation_id":"5c550ea7-eacd-4e07-9d19-30014bfc951d","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Cross-modal pro- gressive comprehension for referring segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:149217b740ff09ae3e3449f0ad56d3786bc5707d24cf83b1cbec7bcc60affbbd","observation_id":"d8f5fe5f-0509-483d-8210-9f64c1d89501","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"RRSIS: Referring remote sensing image segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:b7074b4962d4cd78dafe38781906c96deb8f7b44a5e55c964b1458808f5b9d20","observation_id":"456b6d03-3f99-4fa0-b185-2efa9d891e74","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08486","last_updated":"2025-02-12T15:21:18Z","snapshot_observed_at":"2026-08-21T07:51:37.275508Z","submitted_at":"2025-02-12T15:21:18Z","title":"Referring Remote Sensing Image Segmentation via Bidirectional Alignment Guided Joint Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08486","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Referring remote sensing image segmentation via bidirectional alignment guided joint prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2502.08486","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:53233df5246b78c044a2536c530ef705958cb840dc4eb6576663a47731a8dd9f","observation_id":"46241598-3b88-4bfb-91a8-8df0ee3aa9b7","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"RSRefSeg 2: Decoupling referring remote sensing image segmentation with founda- tion models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:c9a4b3be27bc344480efd03671f672d916f29251493ffc35669a49ea523f143c","observation_id":"4ee71596-a81d-4a70-b9a2-919058af988b","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Zero-shot referring remote sensing image segmentation with expert knowledge priors and hierarchical relational matching,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:ea5265629582090bc47f743d1a6fa9ee4f72b69dbd41ea8d96c80c51925a1649","observation_id":"34e9f8d8-06db-4df6-a684-a9d0fd91fe0a","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"RSVG-ZeroOV: Exploring a training-free framework for zero-shot open-vocabulary visual grounding in remote sensing images,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:d3aa0b0eef2c425b4851fb4ab731d2cc61db5785d04deafbbbecdaa09f30113e","observation_id":"5386f454-e589-4722-bd13-c52ebfaa4157","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"DGL-RSIS: Decou- pling global spatial context and local class semantics for training-free remote sensing image segmentation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:79c97dcc0cc739112566e1f8166579d6122579cd92a47a1f32e028ee5bc464de","observation_id":"783d56ff-fe4f-4e8e-a4cd-9ba7c0e3c6fa","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16719","last_updated":"2026-03-28T16:54:56Z","snapshot_observed_at":"2026-08-07T05:59:39.049027Z","submitted_at":"2025-11-20T18:59:56Z","title":"SAM 3: Segment Anything with Concepts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16719","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"SAM 3: Segment anything with concepts,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2511.16719","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:e9827a9087cdf7e30450807e91a41428d9202cd2eaaeadbb0c935e1948ad09b6","observation_id":"d882258c-c5c1-416b-8630-ef0dd9c5e9d1","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"SegEarth-OV: Towards training-free open-vocabulary segmentation for remote sensing images,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:d47ad466c8a1646cd8e172250c84c7ce555a1d5b6c8723c94b1f688b5d56645a","observation_id":"c9858861-d33d-428d-a6af-b71d4da10b93","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"SegEarth-OV3: Exploring SAM 3 for open-vocabulary semantic seg- mentation in remote sensing images,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:01415f012f6f5e11aeff60f52a472b82691a7854522e38eb1b123ebb8a8371fb","observation_id":"fcd9b6be-570b-4d75-b9c2-fbf09530504f","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"InstructSAM: A training-free framework for instruction-oriented remote sensing object recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:b3cc0bfb78b8f0c82c294573288a63ef014bcae3da2b95a63a3af9b38bfc9e11","observation_id":"adbf840c-3227-4c3b-b55e-ba296417f2dd","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09644","last_updated":"2025-04-13T16:36:47Z","snapshot_observed_at":"2026-08-21T10:45:09.439576Z","submitted_at":"2025-04-13T16:36:47Z","title":"SegEarth-R1: Geospatial Pixel Reasoning via Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09644","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"SegEarth-R1: Geospatial pixel reasoning via large language model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2504.09644","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:e8dc52c030f67a50165ef970d1344c93cce93e81378083f2a7af30d4029c1a5a","observation_id":"ad8b33cf-c6cb-4884-8f80-8de4c5b4b3e7","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11904","last_updated":"2025-05-10T15:43:29Z","snapshot_observed_at":"2026-08-18T10:59:15.089999Z","submitted_at":"2024-11-16T05:12:11Z","title":"GeoGround: A Unified Large Vision-Language Model for Remote Sensing Visual Grounding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11904","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"GeoGround: A unified large vision-language model for remote sensing visual grounding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2411.11904","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:beb9f585bd197a71a8218db2a14e9a4ec8a8be59bbc1ca64ae128a02429eaaea","observation_id":"53a278df-2956-40a3-abd5-a24d8a118c03","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Text4Seg++: Advancing image segmentation via generative lan- guage modeling,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:22283e2e5c7653d99f424253478198c4feafe9d55b642f5418e67105ebe6ba7a","observation_id":"313523de-42e9-49b5-944d-e298fa4085cd","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Enabling training-free text-based remote sensing segmentation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:d05087e3beeca2523ed2cb095fa1421d1011b266945fcc28762e4254fa3aca78","observation_id":"a73058b5-63db-47e4-989b-15a3a1bd2250","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Neural module networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:a9d0e38da29303ab811ea77e07a59e620af459a226be0f1dc2b6f088c3dbf344","observation_id":"7a9302ee-4474-42e9-a186-2d8cea68aca2","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Neural-symbolic VQA: Disentangling reasoning from vision and lan- guage understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:1a619ee80ada207358199e5bb8b12920c85769b7a9866efceecd4377ea59f323","observation_id":"8efe472f-2d7b-4b67-aa13-9e4159feb1d0","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"The neuro- symbolic concept learner: Interpreting scenes, words, and sentences from natural supervision,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:816f02317890cc1566fed2d61237ee16beebf72a2b3b5c4fdf766325998867a8","observation_id":"837d3780-9d85-4ed1-862d-6c0040c120de","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"ReCLIP: A strong zero-shot baseline for referring ex- pression comprehension,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:5aa28304e9276f89eb69286e03120b350b55c8c052854f35332d46da99ca30b9","observation_id":"54e048cc-7d42-4f0b-939b-840842c44d57","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"A new way to represent the relative position between areal objects,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:f22db99a42dfbb55d9d3280948e399b9cb45f07a991fd2ee192dd32b821b7303","observation_id":"527cd1be-e8da-484a-9e09-b2181f86da54","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Fuzzy spatial relationships for image processing and inter- pretation: a review,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:c07799447fc78055f2726e143e65b0e4504bb5885059e5024664431a4d759de9","observation_id":"e3dc5ef3-9819-4333-bc5e-3ff608c6ce5a","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Grounding spatial language in perception: An empirical and computational investigation,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:455d88d11bab3902700cde8a2268fc1b39d501467cfff3f3ad6883557bf4d643","observation_id":"f2512c7d-41d8-43e9-9655-de2702b2e506","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"STAR: A first- ever dataset and a large-scale benchmark for scene graph generation in large-size satellite imagery,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:fb7d12d0753caa4441eba4242524f336da1317fa4bdf96c9b4c00aa1334d7cb1","observation_id":"4f5468a3-b34e-4507-bf4e-1b278ff6d13a","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"ReCon1M: A large-scale benchmark dataset for relation comprehension in remote sensing imagery,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:b7a7897c874c4f8a4ab42e37a5df54159f9a9a0261510cc41819835e62f1fc1d","observation_id":"85bf0af1-8813-44fd-b21a-fe34c6bfc4b5","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07788","last_updated":"2024-04-11T14:29:30Z","snapshot_observed_at":"2026-08-16T14:01:43.693333Z","submitted_at":"2024-04-11T14:29:30Z","title":"AUG: A New Dataset and An Efficient Model for Aerial Image Urban Scene Graph Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07788","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"AUG: A new dataset and an efficient model for aerial image urban scene graph generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2404.07788","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:71b7558f3697875c96ec317440c92abb13d75e35d91ff40bf91c850002355871","observation_id":"0ad1b1ac-5f22-40b3-9972-1bf0055555d3","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"RSGround-R1: Rethinking remote sensing visual grounding through spatial reasoning,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:47c5aae517c1d38d994c2832a5d648d603ab6a46575d8c9fd57ab2d19ecb124a","observation_id":"e7acb938-e474-4efd-ae3e-322cc3705dc7","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"ProVG: Progressive visual grounding via language decoupling for remote sensing imagery,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:36fc606c1afdc9fb00c2c05f7d5ce4f07aea6cf85b67840882f1e570f65c9a3f","observation_id":"b8d0fa98-7ded-42d3-b027-1db51fdf14dd","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Grounded language-image pre- training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:17f75f8a174b3825d0c3734372c9b1f9bc1a5f68084bc1e29aaf7f8d3eeb6a41","observation_id":"0d5f8765-4740-4384-9050-388528f5ddfd","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Grounding DINO: Marrying DINO with grounded pre-training for open-set object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:11a90b74db0dba367d567129de8e4f9cf56d463fe173c8d9f4053850764be9f4","observation_id":"25ea5a75-5c03-473c-950c-8f0a5cdaf240","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"RS5M and GeoRSCLIP: A large-scale vision-language dataset and a large vision-language model for remote sensing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:ec36f6c69c5f860e3230f960897a6599b00053308904ebd39e0894414aa5b09d","observation_id":"c14f8b06-1ec6-4dd7-9e4b-ab83d9256433","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"RemoteCLIP: A vision language foundation model for remote sensing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:a3ee996996785ee57c28d7586be21f0b89e596a855a9e64b28f9ee1de35c22f9","observation_id":"e64276ee-1bcb-42c5-ad4f-d69e04da772d","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"SkyScript: A large and semantically diverse vision-language dataset for remote sens- ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:f92bb0eb6aad3e0ef8850e1f7c75246d016c6d592080e4e76fc7865b3b341127","observation_id":"aed72f14-ba23-408b-95dc-1ed5c3c7b7f3","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:0f8347824fb13974bfb609c4896c46f1632d0577fcfe94fccab3f7e2512b85c3","observation_id":"a219296b-5a1b-4c51-8386-f5d0906ecc1c","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"SAM 2: Segment anything in images and videos,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:8918be7e75eacf9adc35f6df766e9851bfbd7631d45e62ec67128f2a0f981964","observation_id":"66977964-9578-429d-9c0d-9aca96e95814","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"RemoteSAM: Towards segment anything for earth observation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:e648e6b4bfcded96506e45927bf11a72b25688ccfe99e21a032f5236a9d4cb7a","observation_id":"b983ecab-65bb-4a31-826d-eb9b01d09738","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:18878f6cf06d21dfe9bfde32c2e5e0626e820b6fcdae1879ff3084ecba1dd4f5","observation_id":"42b7739d-14b9-4e6e-818b-e49a0e2e40d1","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Slicing aided hyper inference and fine-tuning for small object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:6f6c6c5b20ba8cfba7c685432701a9071513b4e8a8e6e264a7d11b8ae2308f1e","observation_id":"27bbc58f-2371-4369-b323-fbf42c4024f1","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-08-15T22:57:45.773661Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Phi-4-mini technical report: Compact yet powerful multimodal language models via mixture- of-LoRAs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:42894402f695410e0e3f952ab2a6f7d8f7a4c5dffa7039df3a1c8362f6f4e0d8","observation_id":"a322e578-7976-48ac-b5a0-0944f900980e","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05355","last_updated":"2024-10-07T15:40:45Z","snapshot_observed_at":"2026-08-20T14:51:10.875950Z","submitted_at":"2024-10-07T15:40:45Z","title":"Falcon Mamba: The First Competitive Attention-free 7B Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05355","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Falcon mamba: The first competitive attention-free 7B language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2410.05355","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:f3524cc4bd3b5b67b8da2bd4ea901438a3aa580fb9558e74c9eefc8bceb3ded1","observation_id":"7f7d0ce1-10a0-49ab-9a8c-4081b5c640a1","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"The Llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:84e90ddb8f61d439e28a70cb2f3589f20323a18db3029ec66221d45d6358057c","observation_id":"f77d11f8-15c9-45d8-a7f8-957d1c818b12","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"CARIS: Context-aware referring image segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:ba912a3d2f058850197de23649c143753c5f5a66db4413d77a01a6b9f78b42ad","observation_id":"adb5a19c-2a18-4f19-a3f1-169b74930662","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T23:23:21.424035Z","title":"Generalized re- ferring expression segmentation on aerial photos,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-11T23:23:21.424035Z"},"links":{"citing_paper":"/paper/2607.03869"},"observation_digest":"sha256:e984527350268da5be83fd9334f6c87b6552ac2eb991a0fcd7c7ca773db50929","observation_id":"457128f5-d7b9-4569-8843-924b9f92f9e7","resolution":{"observed_at":"2026-07-11T23:23:21.424035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03869","last_updated":"2026-07-04T13:21:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T21:04:43.208151Z","submitted_at":"2026-07-04T13:21:31Z","title":"GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2607.03869."}