{"as_of":"2026-08-09T09:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b90bcbe16384f3f23ebcaa3009480a2025d25938691586dbe5dce1ef7cc81cc4","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T12:50:04.670827Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2601.01456/citation-record","integrity":"/paper/2601.01456/integrity","json":"/paper/2601.01456/citation-record.json","paper":"/paper/2601.01456"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:00.370045Z","title":"Rethinking few-shot 3d point cloud semantic segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:00.370045Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:488ca0ad4b9484d43f997d212e6f7717ebcdf3d980f7774855080716c5d697cc","observation_id":"17b5ca0c-1d14-40ab-9238-753a727fad84","resolution":{"observed_at":"2026-08-03T12:50:00.370045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-08-08T23:14:57.166208Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-08-03T12:50:01.034749Z","title":"Point-bind & point- llm: Aligning point cloud with multi-modality for 3d under- standing, generation, and instruction following.arXiv preprint arXiv:2309.00615,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.034749Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:b952b9978dd23633f519d3a5cc1101385c9e095c18ba832b0528f6ebdaa856aa","observation_id":"e61121aa-809c-44e4-a755-e5b43e9b7d83","resolution":{"observed_at":"2026-08-03T12:50:01.034749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:01.143753Z","title":"Unim-ov3d: Uni-modality open-vocabulary 3d scene understanding with fine-grained feature representation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.143753Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:6b614c4a82b10ff35486d191a2fe5fe14b724a27b0bca571f236d8aba3e4bbd0","observation_id":"1f8fd3e6-a4d6-41e4-8a86-3adc4ff4e084","resolution":{"observed_at":"2026-08-03T12:50:01.143753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:01.464313Z","title":"Jacobs, Michael I","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.464313Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:71fa57ac432b6f5123b10e2b417d021aced861ad6db546b09d06fee669ce27d4","observation_id":"fc183a27-a955-4bcb-9c80-09e175c31cca","resolution":{"observed_at":"2026-08-03T12:50:01.464313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:01.741869Z","title":"Stratified transformer for 3d point cloud segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.741869Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:a7e066575cf26a135c86830d4e31f71d2c086a5f1c7ec2ecc7bdb07b3d893fe9","observation_id":"ab88fd24-4dbc-4e55-a38b-2b647c376267","resolution":{"observed_at":"2026-08-03T12:50:01.741869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:01.885165Z","title":"Logits de- confusion with clip for few-shot learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.885165Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:0bfd72dc51fdc7edfbdf0b6cd02ab5d3cf52aaf20f426bb3b7042a3ca6b8cfa7","observation_id":"1b7ed068-c216-4bfa-b3d0-e381a8e87491","resolution":{"observed_at":"2026-08-03T12:50:01.885165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:01.972356Z","title":"Point- mamba: A simple state space model for point cloud analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.972356Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:179d0f449fbd97f19f263b3ff055af6d6f6b27493eb8db60f88c07ae2a0f7fd5","observation_id":"460adc6e-c094-4301-86c2-c477226273e7","resolution":{"observed_at":"2026-08-03T12:50:01.972356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:02.048218Z","title":"Open3dis: Open-vocabulary 3d instance segmentation with 2d mask guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:02.048218Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:851481125c4d9800c6ca82d4c4024120c4f82cf5eb3e1ee62e539df4876aac83","observation_id":"63d44acb-6998-4950-936c-58e64d5c2606","resolution":{"observed_at":"2026-08-03T12:50:02.048218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:02.162966Z","title":"Boosting few-shot 3d point cloud segmentation via query-guided enhance- ment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:02.162966Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:c192302085f54f1bdbd14ea7e24069cf951277d0703c7bbe8a2e00ad195dbdf0","observation_id":"e3915499-5e1f-4443-968a-c58237decb9e","resolution":{"observed_at":"2026-08-03T12:50:02.162966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:02.287889Z","title":"Openscene: 3d scene understanding with open vo- cabularies","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:02.287889Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:aa1011b5f5513766ca9526233b2988ad5a4fa19ac6ae6bfea890750e81351de8","observation_id":"b4ad34fc-e72b-418d-8c79-dd6780c35b83","resolution":{"observed_at":"2026-08-03T12:50:02.287889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:02.416576Z","title":"Shape-biased cnns are not always superior in out-of-distribution robustness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:02.416576Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:449e21e914d96ed2329e4e9b0a7272452a9335b86b5161816c2eb20d5fa03e78","observation_id":"fb0dc0f9-13c4-4da8-b40d-d9d8edf69209","resolution":{"observed_at":"2026-08-03T12:50:02.416576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:02.511721Z","title":"Prototypical networks for few-shot learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:02.511721Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:94e5f8fb01017c1e0b1426fa1c633afd07abea2ca521023c3393cd6f18a25c14","observation_id":"7732842c-73dc-4a18-9899-c3670dea8510","resolution":{"observed_at":"2026-08-03T12:50:02.511721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:02.629303Z","title":"Point-peft: Parameter-efficient fine-tuning for 3d pre-trained models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:02.629303Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:c53deaa4a94c8163368b4d5afaf1df1ae7e243453393e98ed00540102b7b3c9a","observation_id":"a86b13fc-2c55-44fa-8d39-06bc8ebece20","resolution":{"observed_at":"2026-08-03T12:50:02.629303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:02.823570Z","title":"Kpconv: Flexible and deformable convo- lution for point clouds","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:02.823570Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:1f4dce781e64c1b3c6fa43c606056e8422e1dbeecf333167f25be82abdea6344","observation_id":"cbd9cc15-2f04-4505-a2a9-99909cd215bf","resolution":{"observed_at":"2026-08-03T12:50:02.823570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:03.061864Z","title":"Dynamic graph cnn for learning on point clouds.ACM Transactions on Graphics (tog), 38(5):1–12,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:03.061864Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:9a2e82f63124da06d5ade5a2bebd812a3c48c338bfe199eedf108e4a848c79bc","observation_id":"02fb97d3-5b05-4f2e-a79f-f6274322e96d","resolution":{"observed_at":"2026-08-03T12:50:03.061864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:03.156016Z","title":"A survey of label-efficient deep learning for 3d point clouds.IEEE Transactions on Pattern Analysis and Machine In- telligence, 46(12):9139–9160,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:03.156016Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:9f589b8cc492f4c3e47b8ebe728edc5ee173324795c92deede24261461dc7f14","observation_id":"5d1a3e95-8d25-4c59-b277-d4a9148ffb79","resolution":{"observed_at":"2026-08-03T12:50:03.156016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:03.280766Z","title":"Aggregation and purification: dual enhance- ment network for point cloud few-shot segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:03.280766Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:86d146381869f1bdf96f9381bceeda555ca0a737cd182c2160c6ae94cd97fa1e","observation_id":"372ecdde-b4a4-4845-a8ce-7a2448ef5afb","resolution":{"observed_at":"2026-08-03T12:50:03.280766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:03.367027Z","title":"Pointllm: Empowering large language models to understand point clouds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:03.367027Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:3bdec3f3f1ee70c08b20f5142c7f3a120f5a2a2711d5098d60469cbbc509a44b","observation_id":"beba5c7d-510a-4278-86cd-eec025b77620","resolution":{"observed_at":"2026-08-03T12:50:03.367027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:03.528621Z","title":"Ulip: Learning a unified represen- tation of language, images, and point clouds for 3d understand- ing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:03.528621Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:343aa98803ec02925039cd09ff601f425f5242d56a04d6522b27ff5e067c25b9","observation_id":"8bf02317-1a4e-4833-aea1-6233409f85ee","resolution":{"observed_at":"2026-08-03T12:50:03.528621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:03.658229Z","title":"Ulip-2: Towards scalable multimodal pre-training for 3d understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:03.658229Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:6313ed5d5be31e37ce87202bb6e1e07f2e8aa98e3d3b01c33889501e30101e10","observation_id":"ff9314bc-960b-418f-bcd7-984320ef8eaf","resolution":{"observed_at":"2026-08-03T12:50:03.658229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:03.814644Z","title":"Regionplc: Regional point-language contrastive learning for open-world 3d scene understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:03.814644Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:ac41a71ab590a15992503d84206a14447a26277c79c85aae95940c7b06165478","observation_id":"8d320cd5-118d-445b-a6f7-ec1fa4f736ab","resolution":{"observed_at":"2026-08-03T12:50:03.814644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:03.959495Z","title":"Point-bert: Pre-training 3d point cloud transformers with masked point modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:03.959495Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:25d12b3311830bf4f97e980e393cf21a42e95ae971719c5422c975cff0c7169e","observation_id":"20f47759-6e97-426b-9802-adc6ee8561db","resolution":{"observed_at":"2026-08-03T12:50:03.959495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:04.072502Z","title":"Tip-adapter: Training-free adaption of clip for few-shot clas- sification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:04.072502Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:510f639373ef3610779b0b56a03e31df848e6dafebdf979e6db950c38fe82f9e","observation_id":"7544e131-a3de-4a4d-b1e7-73575e1ef2c2","resolution":{"observed_at":"2026-08-03T12:50:04.072502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:04.131913Z","title":"Few-shot 3d point cloud semantic seg- mentation via stratified class-specific attention based transformer network","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:04.131913Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:f5ca6d66ccdb15a69d54982ff4b90b8b2a8a36d8773d31d4cc05011cb536ca4e","observation_id":"81cb4eef-7c22-473e-8e6f-3a98b77f79cf","resolution":{"observed_at":"2026-08-03T12:50:04.131913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:04.312505Z","title":"Few-shot 3d point cloud semantic segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:04.312505Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:c178af5a1cfd74674f14bbe2dd1e7ba1ad7e4402b86f0527cb8a4af567617a61","observation_id":"9c4f5977-57aa-44c7-9d81-cc0ce4300719","resolution":{"observed_at":"2026-08-03T12:50:04.312505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:04.522613Z","title":"Uni3d: Ex- ploring unified 3d representation at scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:04.522613Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:92c4bff5f6eed021a46dbe0f068cad8e1fd8699f1b8888bbec873062f9d312e3","observation_id":"de156d58-d56c-496c-b7ad-71e60e0c56cd","resolution":{"observed_at":"2026-08-03T12:50:04.522613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:04.670827Z","title":"Not all fea- tures matter: Enhancing few-shot clip with adaptive prior refine- ment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:04.670827Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:cff0e1ab67f6b4e3f3f45a2f82cf130e8a43a1173cb84a0d6af22426f1563bc2","observation_id":"9bcd50fd-4ee0-4741-81aa-24f31c33b710","resolution":{"observed_at":"2026-08-03T12:50:04.670827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:01.584334Z","title":"Open-vocabulary 3d semantic segmentation with foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.584334Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:212e77dfcb9a670a5ef7d397b407b2f4cce7db27eba7dec0b63c06ebf3789e75","observation_id":"01c7f409-423b-4951-b2ed-fef5f31eb56f","resolution":{"observed_at":"2026-08-03T12:50:01.584334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:00.657436Z","title":"Clip2scene: Towards label-efficient 3d scene understanding by clip","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:00.657436Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:607667d439e1306717b853e570d31527d15566ef85acdbdf0778c8011cfd523f","observation_id":"b7f6316e-6187-4123-a425-cc40d24ecd25","resolution":{"observed_at":"2026-08-03T12:50:00.657436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:00.852038Z","title":"Pla: Language-driven open-vocabulary 3d scene understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:00.852038Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:14e5eec8a5c0b2b4af62e6187edc3ff091734e1bff59c107987211fd363b4ecb","observation_id":"99465079-72b0-4ce4-825b-a68efa02a943","resolution":{"observed_at":"2026-08-03T12:50:00.852038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:02.926181Z","title":"A closer look at the robustness of contrastive language-image pre- training (clip)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:02.926181Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:64500b2fbfc9184f9b51929a149e5ba9aba63c69f1e9fe2018d9132bfab3e6cb","observation_id":"14edcae7-4542-4fa6-b06a-b6fdc937131a","resolution":{"observed_at":"2026-08-03T12:50:02.926181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:04.427457Z","title":"Decoupled knowledge distillation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:04.427457Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:b3ad810f236b639583d2424c06fb4bc3de3bdfce38c5abe94c53d1be6d96b9b9","observation_id":"b25b786a-1724-4247-b049-847528fecad9","resolution":{"observed_at":"2026-08-03T12:50:04.427457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:01.367437Z","title":"3d-llm: Injecting the 3d world into large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.367437Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:8e4dfdb87ffb27f14f710a676a024f896242a0426d1498af790e1fb961607051","observation_id":"b262e671-c440-4348-ade1-0edad4e68506","resolution":{"observed_at":"2026-08-03T12:50:01.367437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:00.723912Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:00.723912Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:e3b24eaf494718bc8c9a249c8d300542aa576773411665e80705507b4ee02f3d","observation_id":"a2a0aaaf-59d6-439d-97cd-a3055a0922a6","resolution":{"observed_at":"2026-08-03T12:50:00.723912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:01.229830Z","title":"Cost aggregation with 4d convolutional swin transformer for few-shot segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.229830Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:71a1425bd20cec0e1195d4444978acfa82fe1852b6b852c46b6f62f24630523e","observation_id":"6085099d-af73-41a7-87ea-0f569fd88a53","resolution":{"observed_at":"2026-08-03T12:50:01.229830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:50:00.560721Z","title":"3d semantic parsing of large-scale indoor spaces","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:00.560721Z"},"links":{"citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:fa3cabf007cbbbf9d9ef4a1e1f42fd2e9e67e12a2c87a5ffd91781195283bedd","observation_id":"1ce15c7b-22ab-44b3-b03f-671b396d583c","resolution":{"observed_at":"2026-08-03T12:50:00.560721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T23:42:56.648925Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2601.01456."}