{"as_of":"2026-08-07T12:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:805fbad1ef36f783fe206dd8509abd1ed94015a4ad6800d6efafb413685a2a4a","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:10:16.872826Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09102/citation-record","integrity":"/paper/2507.09102/integrity","json":"/paper/2507.09102/citation-record.json","paper":"/paper/2507.09102"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.611792Z","title":"Crosspoint: Self-supervised cross-modal contrastive learning for 3d point cloud understanding","venue":null,"work_id":"ce1afb6e-3f52-4ad8-8db4-28cc5e4b869a","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:12.847511Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:582034d75035041ae245c202668977dc9c3f3978474d5f9e5a0b43f774317272","observation_id":"2505c0ab-56a1-44a9-9cf8-66e14b75107a","resolution":{"observed_at":"2026-08-06T18:11:17.653408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:12.878546Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:12.878546Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:952864ed30369d4cbe6af0ea176865182752766b0d2a5c0bd957bfd0fded5d35","observation_id":"2a8300f4-d514-4507-9180-a7dc13b52252","resolution":{"observed_at":"2026-08-06T18:10:12.878546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T18:10:12.939433Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:12.939433Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:8682a2964d62e3e38be6dd12aa120391bdbbceb069e8098f76b94cf526ee0eb0","observation_id":"6b22e63e-bc59-4d61-9995-1cd2f7698a3c","resolution":{"observed_at":"2026-08-06T18:10:12.939433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:13.023196Z","title":"Lan- guage models are few-shot learners.Advances in neural in- formation processing systems, 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.023196Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:898b21b80190ff209e95bb5d8f8fa5aa8faa52b2ccbd6f3b40cac675d1d3d714","observation_id":"ed326cb4-a057-44af-9c5a-e48140650b0f","resolution":{"observed_at":"2026-08-06T18:10:13.023196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.513128Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":"d54274d8-fae1-47f3-9431-4bdf96f50cdd","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.073706Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:1e736a1f41491c6e6353de436daa6397391f3583193cc46e69e79538025021c7","observation_id":"b40ca3d3-94e6-4744-a5f1-e977ba6c9c24","resolution":{"observed_at":"2026-08-06T18:11:17.540779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-07T11:28:03.211074Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-06T18:10:13.105370Z","title":"Shapenet: An information-rich 3d model repository.arXiv preprint arXiv:1512.03012, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.105370Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:e8358511224745bcc8409a5463c081d29345d8e724b13ece52f64d3cb7dcd2f8","observation_id":"4c73ecaa-2eac-4521-b79b-e84cc140257e","resolution":{"observed_at":"2026-08-06T18:10:13.105370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.383461Z","title":"Pimae: Point cloud and image interactive masked autoencoders for 3d object detection","venue":null,"work_id":"3dd664ac-5fd6-4163-8a39-c88383f0ccf4","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.140901Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:eafe124fb68455acd0a8f8d42ed38d762444064c04bef8d77358e1d6ed41759e","observation_id":"3835781d-8bb6-4978-8134-15712d92b154","resolution":{"observed_at":"2026-08-06T18:11:17.427683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:13.200061Z","title":"Videocrafter1: Open diffusion models for high-quality video generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.200061Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:6662a1e31e654886cef3554f0fc683a52440f237b68d2a9df58afade29c67844","observation_id":"aff5a1ba-d889-4958-b229-96c4d307af1e","resolution":{"observed_at":"2026-08-06T18:10:13.200061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.223724Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":"b9e08264-7bef-40a6-9b69-ab55e8b28f71","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.260591Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:756b81a888daa5023c43dd91213c6b0b202216e3861aa266051d62d4e94d492e","observation_id":"e9e74191-8316-4955-982b-59e0572697f8","resolution":{"observed_at":"2026-08-06T18:11:17.275699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.152878Z","title":"Pointmixup: Augmentation for point clouds","venue":null,"work_id":"268866d1-d5fe-4483-96e7-214fdb24ea81","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.296831Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:cbb39ec4d74c4982926523b15f2a86da140dface30127a791d4efb0c37a9fe2b","observation_id":"1f24c81b-2196-4607-9c39-e7ef2179976e","resolution":{"observed_at":"2026-08-06T18:11:17.163200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.074018Z","title":"Text-to-image diffusion mod- els are zero shot classifiers.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"03a9ed97-bd85-4d6b-9295-029c35177681","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.328625Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:a87dc271608b2a789f90e1053660b70a0419febcf700cf75b04838a12529ce1d","observation_id":"9df3e67b-e750-44ee-91dd-60ba6ca0c5a2","resolution":{"observed_at":"2026-08-06T18:11:17.130508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:13.357989Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.357989Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:62704136ad60e4857d6abff6c3ed58351d036a927dbb5470a1098fc2eff1e7d1","observation_id":"4352d4c7-4cf5-48ca-9866-97c57396780d","resolution":{"observed_at":"2026-08-06T18:10:13.357989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T18:10:13.447665Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding.arXiv preprint arXiv:1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.447665Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:19a0f8928e0df18a645fa7e6a4e90d648d91143fd124618587ab0ca098799740","observation_id":"aefa933c-376a-42c6-8969-a55e399c4e06","resolution":{"observed_at":"2026-08-06T18:10:13.447665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.963897Z","title":null,"venue":null,"work_id":"289fbb0f-826c-43d7-b6b7-35a91a51b42a","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.575189Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:70b80b208573c4c3b838f6ff3bf0dfac448a2eada94258f34d93d6810584f18c","observation_id":"76f2bf74-d093-4c97-90f0-660057f0f98b","resolution":{"observed_at":"2026-08-06T18:11:16.999867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.854398Z","title":"Revisiting point cloud shape classification with a simple and effective baseline","venue":null,"work_id":"61bac70e-bf70-42c7-880f-8444971fbb8e","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.653087Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:8c845f176b5effa07a17ff8fddb10ea9794e770feb0cf3622019410b306813ea","observation_id":"42aa2748-5f36-4325-820d-d5dea85c746e","resolution":{"observed_at":"2026-08-06T18:11:16.907749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.746183Z","title":"3d semantic segmentation with submani- fold sparse convolutional networks","venue":null,"work_id":"65715b86-ee61-4a7c-be9d-808021e2eda2","year":2018},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.711407Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:7864a05351a3328eb0428575c61706099999e43d35449be8d714b7c37d638381","observation_id":"6d07a70c-38c8-44bb-86a6-60fd9b51760e","resolution":{"observed_at":"2026-08-06T18:11:16.801989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.567560Z","title":"Bootstrap your own latent-a new approach to self-supervised learning.Advances in neural information processing systems, 33:21271–21284, 2020","venue":null,"work_id":"eaf2868c-ed0e-4c95-8217-385199b57f59","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.775895Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:8cab4e6ee1f2f6b727fa938d24060249c61bb600a4144414047327c711e69181","observation_id":"a7405aea-e35e-4194-8b82-71e9f41b4522","resolution":{"observed_at":"2026-08-06T18:11:16.659626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T18:10:13.937680Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning.arXiv preprint arXiv:2307.04725, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.937680Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:7b1e2b1162e4a268ef481ed9df390dd3971d78e66d717355556fda7bb85ee661","observation_id":"47b51c72-e53a-4ee8-8b29-eb0af7ace969","resolution":{"observed_at":"2026-08-06T18:10:13.937680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14007","last_updated":"2023-09-25T17:22:39Z","snapshot_observed_at":"2026-08-06T08:11:16.060565Z","submitted_at":"2023-02-27T17:56:18Z","title":"Joint-MAE: 2D-3D Joint Masked Autoencoders for 3D Point Cloud Pre-training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14007","snapshot_observed_at":"2026-08-06T18:10:13.986793Z","title":"Joint-mae: 2d-3d joint masked au- toencoders for 3d point cloud pre-training.arXiv preprint arXiv:2302.14007, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.986793Z"},"links":{"cited_paper":"/paper/2302.14007","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:db7330ea327bc225b554610483e43260e0df665d17fbcbb6cf737f6bab3e5941","observation_id":"3b893064-dba0-4fe3-9606-5cc310dcbf84","resolution":{"observed_at":"2026-08-06T18:10:13.986793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.426823Z","title":"Mvtn: Multi-view transformation network for 3d shape recognition","venue":null,"work_id":"8b5a191d-d53b-4b71-bb61-c2d12a3f8ad9","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.105673Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:9839ee6d65745c91d962052045696e7cfd768d7c652f53cf466bbb7145459739","observation_id":"12cb7dfd-7395-4c00-b674-cfd2161e5da0","resolution":{"observed_at":"2026-08-06T18:11:16.472891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.269981Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"0bc154d4-eaed-470b-843e-3362e45cc729","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.222816Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:e8071b628ed17f4d5950934a03d2a1bb3e32bb2b22a14700204b21a455b15c07","observation_id":"f27cb8ec-7a16-4363-9974-a8a2d859a43d","resolution":{"observed_at":"2026-08-06T18:11:16.353457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:14.257395Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.257395Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:72905640d51bb0a2deb8071863045fd68933c2cf0ec9e91baa207a746e169ab8","observation_id":"70167a6a-f384-47dc-bb13-e3439fa70495","resolution":{"observed_at":"2026-08-06T18:10:14.257395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.105125Z","title":"Regu- larization strategy for point cloud via rigidly mixed sample","venue":null,"work_id":"1d3beb73-9d4e-4527-a54a-29412ad9ff9b","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.298704Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:6857b40869d34ef629de34f4df6a2973a92407b3d1d6ac9cbb2fd6aabb198626","observation_id":"4ec609ef-8241-4a18-8792-e716dab9f03c","resolution":{"observed_at":"2026-08-06T18:11:16.215343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:14.340844Z","title":"Your diffusion model is secretly a zero-shot classifier","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.340844Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:7b310725173b07464be2476667dc5c38e00dce669e9e33c65ff065cbd2380561","observation_id":"45094009-f6c7-4fca-be21-9c3db0e4dd68","resolution":{"observed_at":"2026-08-06T18:10:14.340844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.945228Z","title":"Pointcnn: Convolution on x-transformed points","venue":null,"work_id":"f2b0556c-9fee-4523-8871-63afbc9deb4a","year":2018},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.364934Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:f63431ec7c780f555a552f14eadeee957456b0a1ea03da2a5bfd49c7650f3ea3","observation_id":"2ae84e8a-8dba-4962-a28b-5eca27a83494","resolution":{"observed_at":"2026-08-06T18:11:16.011365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.847286Z","title":"Masked discrim- ination for self-supervised learning on point clouds.Pro- ceedings of the European Conference on Computer Vision (ECCV), 2022","venue":null,"work_id":"70a27f9e-cf72-4f98-bfab-c6266ccce9ce","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.417199Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:bd14f1e843c58951e166a9efab682aedbd39f877422a93bc25999e464747e675","observation_id":"cb035155-e7b6-4715-b182-30b30b957f83","resolution":{"observed_at":"2026-08-06T18:11:15.876039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.723750Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"542aa0ff-4409-473c-b15c-a5d69e5b0e7f","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.460131Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:df0f7497ed4fc3a10bfac2aabf3e76c348d766a36239aba9940239173004ebdd","observation_id":"9b25c965-8b19-437e-8fff-24aeda182ac6","resolution":{"observed_at":"2026-08-06T18:11:15.800974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15008","last_updated":"2023-11-08T16:50:08Z","snapshot_observed_at":"2026-07-06T16:37:16.106127Z","submitted_at":"2023-10-23T15:02:23Z","title":"Wonder3D: Single Image to 3D using Cross-Domain Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15008","snapshot_observed_at":"2026-08-06T18:10:14.508003Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion.arXiv preprint arXiv:2310.15008, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.508003Z"},"links":{"cited_paper":"/paper/2310.15008","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:8b1e49e1471f3d9d15845ce1a7018801b135ee4fa4007e7f9cbbeab4803c88cf","observation_id":"cb137d2c-0f2c-4c85-b328-68cab4500cca","resolution":{"observed_at":"2026-08-06T18:10:14.508003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-06T18:10:14.569340Z","title":"Sgdr: Stochas- tic gradient descent with warm restarts.arXiv preprint arXiv:1608.03983, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.569340Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:da42c578a5aa45071c46255fa123c9293bccbdaac6e4229ae8747f988ffeafb4","observation_id":"ffb7f258-4d04-4017-8e5c-e82e988bde59","resolution":{"observed_at":"2026-08-06T18:10:14.569340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T18:10:14.635657Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.635657Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:88627628d2cdc605bd02f230a46eb0bb66cd370136f5e8f30aa1b07e4d1538e3","observation_id":"cedad0d9-c625-4dd9-a621-d215f04a726d","resolution":{"observed_at":"2026-08-06T18:10:14.635657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07123","last_updated":"2022-11-29T07:07:37Z","snapshot_observed_at":"2026-08-02T22:08:27.106810Z","submitted_at":"2022-02-15T01:39:07Z","title":"Rethinking Network Design and Local Geometry in Point Cloud: A Simple Residual MLP Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07123","snapshot_observed_at":"2026-08-06T18:10:14.681106Z","title":"Rethinking network design and local geometry in point cloud: A simple residual mlp framework.arXiv preprint arXiv:2202.07123, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.681106Z"},"links":{"cited_paper":"/paper/2202.07123","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:923fc951fa082197d41f31287e5d46aea866dff0d4a021d19757b754b2b7b8f5","observation_id":"d6f22c8d-9106-410c-9b5d-126bd5dc3d51","resolution":{"observed_at":"2026-08-06T18:10:14.681106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.600717Z","title":"An end-to- end transformer model for 3d object detection","venue":null,"work_id":"3d51a2fc-a988-4f4a-921b-28505cceb8a3","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.711021Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:6672eac5d37a67cd307e970292ede57f3425af18388ea71fe845ef68fa6e2721","observation_id":"168316dc-ad3c-4763-9011-0457bd9b8d21","resolution":{"observed_at":"2026-08-06T18:11:15.661110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.539773Z","title":"Masked autoencoders for point cloud self-supervised learning","venue":null,"work_id":"00680f87-121c-4222-b957-c32ab796c4c2","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.757025Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:c92b7e1664f0664e552264956a993122ea2034810a88fe498c658b1c6ad702e8","observation_id":"70f384b5-cc7b-4664-9e94-64b567f8d61d","resolution":{"observed_at":"2026-08-06T18:11:15.554188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.459625Z","title":"Diffusion autoen- coders: Toward a meaningful and decodable representation","venue":null,"work_id":"30b63b90-ed72-4226-9314-684624d50faa","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.807459Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:ae24e605752e02efddd298614558155564627ca63d9b853454a9bcc79f30c1ee","observation_id":"a9116193-ecc0-40b2-af28-701ebc7dd9ea","resolution":{"observed_at":"2026-08-06T18:11:15.490308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:14.854852Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.854852Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:5b31b7981d3dfebbcb7abb1a055941e29d365d8e4c65d7a695b8eeb4714a590d","observation_id":"1503f485-51e1-4f6f-959a-e6c2af3c9db3","resolution":{"observed_at":"2026-08-06T18:10:14.854852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.344551Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"123c4a7c-7883-4749-82b8-5ec105d058f8","year":2017},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.879216Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:765171fd3315028e4f9f8dcfa66014977ddc49c382ee03eefc6c45912ee9efe4","observation_id":"d40ed85e-8b65-481b-89fc-d62c883cebb3","resolution":{"observed_at":"2026-08-06T18:11:15.380699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.270808Z","title":"Contrast with reconstruct: Contrastive 3d representation learning guided by generative pretraining","venue":null,"work_id":"aa4adc5b-2127-474b-8eec-975895c7d6a3","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.902598Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:6d1dc7f181a1eaf9a1b1c979552b2c9a809d32d705fb5fd67ca77cb064ea604c","observation_id":"2289abe0-1bac-4de8-bf60-e2b5d8a9f704","resolution":{"observed_at":"2026-08-06T18:11:15.296402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.129574Z","title":"Pointnext: Revisiting pointnet++ with improved training and scaling strategies","venue":null,"work_id":"9bbcab4f-136d-4892-bf98-56dbd03d323e","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.933504Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:26cc6d1bae9c01e136f6ed91304388a0850f406007ee7722c1916a86fe06882c","observation_id":"7757d46e-9ba8-474d-83ef-9ad85fd16efa","resolution":{"observed_at":"2026-08-06T18:11:15.178206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.036478Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"2a017634-0015-4600-b62f-77283ae36f47","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.971120Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:aa6a93d67c1e87dc528fe4dc392e60755aacd8a521b68c4bebb82e9184e384fd","observation_id":"248b25d1-1542-4232-93e5-212ddbaa79f8","resolution":{"observed_at":"2026-08-06T18:11:15.080289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.938784Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21(140):1–67, 2020","venue":null,"work_id":"20437233-978f-41b0-a308-b17100e2a8ec","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.018244Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:0dd3c5b3c5becf8e4e53e3827bd8fcabeb5d9ffaf68637ef78648f4ac9d90cf3","observation_id":"6bcf9ebd-e919-4607-a6c8-27547fa3360c","resolution":{"observed_at":"2026-08-06T18:11:14.979594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.918552Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"17300827-3a2a-4d4c-a110-5c5386585f9a","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.047622Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:27ee043660483bff1781c095238726b17e1d972bc0dfe8845ae8cb9823dad66b","observation_id":"ceb31386-37b1-4328-954a-0afdb27f2c3e","resolution":{"observed_at":"2026-08-06T18:11:14.925335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.864207Z","title":"Self-supervised few-shot learning on point clouds.Advances in Neural Information Processing Systems, 33:7212–7221, 2020","venue":null,"work_id":"324a4cef-2933-4a4d-b3df-0a290ce4f880","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.100262Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:dad407cb200fbbad1df01bac0e3f29e9c858bfb73d57763cb1d7d48ec69a01d7","observation_id":"b9547a7f-5bbf-416a-8296-624be2fb104c","resolution":{"observed_at":"2026-08-06T18:11:14.894542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-06T18:10:15.153625Z","title":"Mvdream: Multi-view diffusion for 3d gen- eration.arXiv preprint arXiv:2308.16512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.153625Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:ee86e577241b4b33688793edbad8a5ebc682abe3ca1aa2fab9e03dd28c7f4b6a","observation_id":"5985ab1e-ef0e-4368-8550-dd410708fd3c","resolution":{"observed_at":"2026-08-06T18:10:15.153625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.808524Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"4d9c7d0a-3bd5-4eaf-9eca-2c7b7910216f","year":2015},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.188239Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:996dda75634984101ff3f60f44553971d5439fb56d3cdc8c653f7638cc6f2224","observation_id":"95a23cb5-3daf-4b19-b22c-bb9bd1f0d04a","resolution":{"observed_at":"2026-08-06T18:11:14.825920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.653623Z","title":"Epmf: Efficient perception-aware multi-sensor fusion for 3d semantic seg- mentation.IEEE Transactions on Pattern Analysis and Ma- chine Intelligence, 46(12):8258–8273, 2024","venue":null,"work_id":"0cd51e8d-ba5a-4d6f-8d4e-e5197c35c5ce","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.222544Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:3f6b086f25c0760995843fcad741dea1efac3eb4495f70019b663a036f41009d","observation_id":"c94390ee-c1c8-4171-9882-ea89a3f597cf","resolution":{"observed_at":"2026-08-06T18:11:14.716318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12469","last_updated":"2024-04-02T17:40:03Z","snapshot_observed_at":"2026-07-06T16:09:44.283461Z","submitted_at":"2023-08-23T23:44:44Z","title":"Diffuse, Attend, and Segment: Unsupervised Zero-Shot Segmentation using Stable Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12469","snapshot_observed_at":"2026-08-06T18:10:15.259656Z","title":"Diffuse, attend, and segment: Unsupervised zero-shot segmentation using stable diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.259656Z"},"links":{"cited_paper":"/paper/2308.12469","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:22c06ad438d3571fe9798f1cd1e5590c3ab731ec47bce0d97111d5f9a1d98983","observation_id":"44523044-c91c-4f82-b234-3f09335abca7","resolution":{"observed_at":"2026-08-06T18:10:15.259656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.539411Z","title":"Revisiting point cloud classification: A new benchmark dataset and classification model on real-world data","venue":null,"work_id":"e373b027-3024-4859-9286-314eee3c9186","year":2019},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.308344Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:76fd8a4dbb9ef770c499605e1458dd45587c1ad4a93d5f8b5be66cb5803ebc35","observation_id":"e61adc65-3d64-47b0-b4d0-e2b983756779","resolution":{"observed_at":"2026-08-06T18:11:14.583484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.431947Z","title":"Visualizing data using t-sne.Journal of machine learning research, 9 (11), 2008","venue":null,"work_id":"16294daa-2c8e-4c1f-8333-f463ab03c27c","year":2008},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.339098Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:6f4ef2183a77da58a5bc07ddd7e20db2b3e78b1f78d8a692da56c8b95be37448","observation_id":"29e0b7c9-69b9-4b75-8100-3ff01728982f","resolution":{"observed_at":"2026-08-06T18:11:14.498983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.291813Z","title":"Dynamic graph cnn for learning on point clouds.ACM Transactions on Graphics (tog), 38(5):1–12, 2019","venue":null,"work_id":"f5b4a4e3-4e3d-455e-9d11-25e59c296733","year":2019},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.381365Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:ef36c920b4500a9e76677e0b13c7a8b2d699160bdc66e2a60e88a91b58bb170e","observation_id":"2fe7fb8e-f7d4-471f-9878-d62dcb6b41eb","resolution":{"observed_at":"2026-08-06T18:11:14.353991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.903144Z","title":"Pointpatchmix: Point cloud mixing with patch scoring","venue":null,"work_id":"8198e5ce-989f-4ff6-84c1-a75a63b89b4b","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.417288Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:43538f0a86199a929cf5575b0a6a5e8aab97c4ad0fe9fb07aad3807ee44ec3e4","observation_id":"c2119a06-14b0-4db5-b438-2d21d658377e","resolution":{"observed_at":"2026-08-06T18:10:19.943217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.729339Z","title":"P2p: Tuning pre-trained image models for point cloud analysis with point-to-pixel prompting","venue":null,"work_id":"a64eed4f-65be-443a-af0c-d5df6b6a1c2c","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.460912Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:0823704dc2447bfff39adfb5ac217bb6f81f497af2e4b5d6a6196b52ab931128","observation_id":"098ad68a-2033-460c-be2d-b0d916872135","resolution":{"observed_at":"2026-08-06T18:10:19.842472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.586864Z","title":"Take-a-photo: 3d-to-2d generative pre-training of point cloud models","venue":null,"work_id":"ae5a9728-eaa0-4af0-86d8-1a2fc1113bb4","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.493693Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:2ee5141f05823982ceba160a5a89b52cc396cae3aff2db2e6fc7bfd68587f374","observation_id":"a7c23fa9-d9e2-45ef-80b6-7054463e85ca","resolution":{"observed_at":"2026-08-06T18:10:19.637186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.468786Z","title":"3d shapenets: A deep representation for volumetric shapes","venue":null,"work_id":"b1db23ea-3eb8-4fa6-ab01-542924240de8","year":1912},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.537024Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:1c594403598e3d94c52b055dd4e2e520ee5d876ffc2b8d49b0705b2cc1d8cb55","observation_id":"6907f1aa-268c-4299-8090-52a2dfe58efa","resolution":{"observed_at":"2026-08-06T18:10:19.531932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.385174Z","title":"Pointcontrast: Unsupervised pre- training for 3d point cloud understanding","venue":null,"work_id":"240e309b-825f-453e-946c-d548811d252d","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.600318Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:da89afabdbda27bca46312f94e42eae9f421ee970b39ffde0075b6fe8636a378","observation_id":"c4715f67-a684-46ab-a8f1-10e0d9d177c0","resolution":{"observed_at":"2026-08-06T18:10:19.424424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.223013Z","title":"Ulip: Learning a unified representation of language, images, and point clouds for 3d understanding","venue":null,"work_id":"0aa1961b-b9fc-40c2-bf2a-397b51b034eb","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.609593Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:113f184cbcb0553ed132caa57cc434dbb77dd54f473d42eca4840e53d1056c24","observation_id":"04783218-b9a9-4fed-bebf-262dcea90f5f","resolution":{"observed_at":"2026-08-06T18:10:19.254793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:15.697363Z","title":"Ulip-2: Towards scalable multimodal pre-training for 3d understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.697363Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:ee898f6d4aebca8ae310e3393ae319d9f4e1482eed9a14d6d777fce1d0a5f478","observation_id":"857aab2a-324f-4313-a06e-5e1a175b5a85","resolution":{"observed_at":"2026-08-06T18:10:15.697363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.115622Z","title":"Gd-mae: gen- erative decoder for mae pre-training on lidar point clouds","venue":null,"work_id":"065a79ef-3fc1-496d-882a-6b29c5d41aaa","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.807452Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:01abcf6db58d7cfe2add01fe6518b8a3d979dc78031db0fe99a31094264e113c","observation_id":"d086ba09-88db-4d52-8c5d-453f971157e5","resolution":{"observed_at":"2026-08-06T18:10:19.146285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13721","last_updated":"2023-10-28T11:21:47Z","snapshot_observed_at":"2026-08-04T23:42:21.771516Z","submitted_at":"2023-01-31T15:58:32Z","title":"DisDiff: Unsupervised Disentanglement of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13721","snapshot_observed_at":"2026-08-06T18:10:15.836359Z","title":"Dis- diff: Unsupervised disentanglement of diffusion probabilis- tic models.arXiv preprint arXiv:2301.13721, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.836359Z"},"links":{"cited_paper":"/paper/2301.13721","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:cf0d9b5d85889aa51bc17705326a11c434d901c284d80f964555f70bcf5cb507","observation_id":"2702fef2-ca23-452c-b9b1-28eb39d806c0","resolution":{"observed_at":"2026-08-06T18:10:15.836359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09712","last_updated":"2024-06-12T15:20:36Z","snapshot_observed_at":"2026-08-07T02:18:16.237014Z","submitted_at":"2024-02-15T05:07:54Z","title":"Diffusion Model with Cross Attention as an Inductive Bias for Disentanglement","version":2},"cited_work":{"arxiv_id":"2402.09712","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.09712","snapshot_observed_at":"2026-08-06T18:10:16.995587Z","title":"Diffusion Model with Cross Attention as an Inductive Bias for Disentanglement","venue":"cs.CV","work_id":"6adfdd6c-c964-4141-974f-64759a4b6523","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.899434Z"},"links":{"cited_paper":"/paper/2402.09712","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:65cd9823db1da4611721196ace07b6b08256caaa014fe6a42dd79ffac1134079","observation_id":"b29f7a7f-80da-4892-9dfd-2e47121c104d","resolution":{"observed_at":"2026-08-06T18:10:17.153766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.982398Z","title":"A scalable active framework for region annotation in 3d shape collections.ACM Transactions on Graphics (ToG), 35(6):1–12, 2016","venue":null,"work_id":"e10ae059-953a-4b5a-9173-2884ccc28c79","year":2016},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.982409Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:57313f5b9b837f2355f3d40d111cc696ffcf035876ab0f6c15da036877feb4d2","observation_id":"444bc779-e0af-47e1-99bf-c33aaa53aa0b","resolution":{"observed_at":"2026-08-06T18:10:19.057909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.812173Z","title":"Point-bert: Pre-training 3d point cloud transformers with masked point modeling","venue":null,"work_id":"ca7ffa77-a47e-4611-814f-612b275a9631","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.040475Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:0023f1579be4f3a6f5371c255a88e7e03a8cb18aa0e43edf2c4981b42e5bfddb","observation_id":"9d3611d4-4fdb-4d04-805d-1331c51f596f","resolution":{"observed_at":"2026-08-06T18:10:18.916090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11430","last_updated":"2024-01-21T08:35:25Z","snapshot_observed_at":"2026-07-06T17:18:24.209069Z","submitted_at":"2024-01-21T08:35:25Z","title":"Exploring Diffusion Time-steps for Unsupervised Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11430","snapshot_observed_at":"2026-08-06T18:10:16.121566Z","title":"Exploring diffusion time- steps for unsupervised representation learning.arXiv preprint arXiv:2401.11430, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.121566Z"},"links":{"cited_paper":"/paper/2401.11430","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:dfcd8bc38cf5a7e99a362e205ce5d3eb6f18fc6ce3194bb68e6eda03697088e9","observation_id":"90f08ac1-a6d5-43ea-b5e6-3cd0cd96dd24","resolution":{"observed_at":"2026-08-06T18:10:16.121566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10726","last_updated":"2023-12-17T14:17:05Z","snapshot_observed_at":"2026-07-06T17:04:13.625458Z","submitted_at":"2023-12-17T14:17:05Z","title":"Towards Compact 3D Representations via Point Feature Enhancement Masked Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10726","snapshot_observed_at":"2026-08-06T18:10:16.218975Z","title":"Towards compact 3d representations via point feature enhancement masked au- toencoders.arXiv preprint arXiv:2312.10726, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.218975Z"},"links":{"cited_paper":"/paper/2312.10726","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:a43124adce73b98b68dd8463bf081b6467da2bd835cf3155ac6b7e22b499dce2","observation_id":"5bbc99fa-d16f-4670-8c07-739437aa0a88","resolution":{"observed_at":"2026-08-06T18:10:16.218975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.644469Z","title":"Point-m2ae: multi-scale masked autoencoders for hierarchical point cloud pre-training.Advances in neural information processing sys- tems, 35:27061–27074, 2022","venue":null,"work_id":"1c954a2a-c7c5-44b4-80ce-f6b51dc2f5c1","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.262742Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:d0af240773bf0fadcbeb157fd326389f7d59cb589d4b69cc0027aaa1aa0b91fe","observation_id":"062c784a-ff7c-46e4-bdbd-769934e37865","resolution":{"observed_at":"2026-08-06T18:10:18.751622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.461364Z","title":"Learning 3d representations from 2d pre-trained models via image-to-point masked autoencoders","venue":null,"work_id":"7af1487c-4f57-4d56-934f-c92c611c967c","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.346704Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:f7cd35d89e2ffca51ac7b9c8ba53e0ec5d6a302c93da9bd757cc2c9676e4b6c4","observation_id":"57507315-8fa4-4214-b946-55bc81e2cae1","resolution":{"observed_at":"2026-08-06T18:10:18.529515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.323908Z","title":"Self-supervised pretraining of 3d features on any point-cloud","venue":null,"work_id":"91f892da-e1ed-489f-a364-c23b3e0d037f","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.421860Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:cea1da29cefdefa11cd693507bf45b6ffd1072a7830bbd7c828e10c3c1c44d56","observation_id":"c01214c0-4e5d-4f72-bd94-fd91a4c26d09","resolution":{"observed_at":"2026-08-06T18:10:18.380825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.227131Z","title":"Unsupervised rep- resentation learning from pre-trained diffusion probabilistic models.Advances in Neural Information Processing Sys- tems, 35:22117–22130, 2022","venue":null,"work_id":"a14907d0-b682-44e9-bf37-4285021322db","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.494743Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:4dbb29772696e41e9fefe07637058e05e5f44e523a41d7100ec9d966c30b19a3","observation_id":"86070a7c-ba84-47f5-a481-b37b26ecd42b","resolution":{"observed_at":"2026-08-06T18:10:18.272034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.068204Z","title":"Unleashing text-to-image diffu- sion models for visual perception","venue":null,"work_id":"48aef8e9-2266-4e9e-af09-002f5e8672d8","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.572560Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:bd49066fc07925c70cadcfe9a44a37ddcc87ec101eb3ea9f0744af8af644e6b9","observation_id":"369bdf0b-1b69-494d-9cf5-4987af7f5321","resolution":{"observed_at":"2026-08-06T18:10:18.129125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:17.922965Z","title":"Point cloud pre-training with diffusion models","venue":null,"work_id":"2246b758-8ec8-4852-9fd2-a75083595ca8","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.686652Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:3aca54e93ff76b125acf10c31bf0dfbb5c4b5e83b7530a63f649d380fb0c5739","observation_id":"99e686ea-f0c3-4f9f-9d28-0e114106b8b5","resolution":{"observed_at":"2026-08-06T18:10:17.986753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:17.760789Z","title":"As shown in Tab","venue":null,"work_id":"933f332e-d049-4990-ad59-8047866db2c7","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.758303Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:4246f25cc4931f0ae2fe05e973ad54e6a8a8523faeca9e29f264d24f5e36b074","observation_id":"f5081452-b484-456b-832c-bf82e84b12d6","resolution":{"observed_at":"2026-08-06T18:10:17.807721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:17.630471Z","title":null,"venue":null,"work_id":"17f84d1f-763d-43d7-9691-cc1b8a25787f","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.796235Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:f53544ba1465016da215f5bf9a6f8e86769fd26565b384e2e8a9e3a173ab1d32","observation_id":"bf580d36-5f05-48f4-a8a7-5103f5272463","resolution":{"observed_at":"2026-08-06T18:10:17.698514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:17.448045Z","title":"Illustration of the Augmentation Strategy.We show our augmentation strategy in Fig","venue":null,"work_id":"cf95a975-65f8-4664-bc32-36a3cd81339c","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.872826Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:e9f78eb9675a79554125a908a25ebeea4102732fffae79d8848c41b65e5d3864","observation_id":"e6796ec5-8155-40c1-9e4a-6e29b44cb2c0","resolution":{"observed_at":"2026-08-06T18:10:17.529897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":47},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2507.09102."}