{"as_of":"2026-08-08T21:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ec10cd587947d1b971202a524e00ee1c2b1a28fc43cf4edbad48f2e0b094e6e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:52:45.058273Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T03:29:29.479882Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-08-06T21:52:45.058273Z","title":"Learning from 2D: Con- trastive pixel-to-point knowledge transfer for 3D pretraining,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23227","last_updated":"2025-06-29T13:17:12Z","snapshot_observed_at":"2026-08-06T21:45:18.549063Z","submitted_at":"2025-06-29T13:17:12Z","title":"High-quality Pseudo-labeling for Point Cloud Segmentation with Scene-level Annotation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:45.058273Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2506.23227"},"observation_digest":"sha256:96d0789531749ea55177bf86decec8c71014de01c2ac4de14cd980bd2f538891","observation_id":"e44a0215-7d7c-44d4-8666-27562dc9f5cb","resolution":{"observed_at":"2026-08-06T21:52:45.058273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-08-06T19:32:34.713298Z","title":"Learning from 2d: Contrastive pixel-to-point knowledge transfer for 3d pretraining","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05260","last_updated":"2025-07-07T17:59:58Z","snapshot_observed_at":"2026-08-08T11:05:11.106349Z","submitted_at":"2025-07-07T17:59:58Z","title":"Beyond One Shot, Beyond One Perspective: Cross-View and Long-Horizon Distillation for Better LiDAR Representations","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:32:34.713298Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2507.05260"},"observation_digest":"sha256:ca25582d34946dfe9ad4140e3e00dab0357fcdc4dadd41d4390d37e0c05d7810","observation_id":"e9a4a2e1-f3b3-4a9c-b717-89febea07e53","resolution":{"observed_at":"2026-08-06T19:32:34.713298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-08-06T14:51:52.741538Z","title":"Learning from 2d: Contrastive pixel-to-point knowledge transfer for 3d pretraining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17533","last_updated":"2025-07-23T14:13:14Z","snapshot_observed_at":"2026-08-06T18:13:30.036290Z","submitted_at":"2025-07-23T14:13:14Z","title":"Multi-modal Multi-task Pre-training for Improved Point Cloud Understanding","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:52.741538Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2507.17533"},"observation_digest":"sha256:cb904c4ee8fa92237a32b6d2d18335d8ae665c53a745efa016464d1b846ea08a","observation_id":"d0d9424f-6cf3-4b85-8d1b-bf5e39bf080f","resolution":{"observed_at":"2026-08-06T14:51:52.741538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-08-05T13:43:55.822844Z","title":"Learning from 2d: Contrastive pixel-to-point knowledge transfer for 3d pretraining,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00379","last_updated":"2025-08-30T06:34:39Z","snapshot_observed_at":"2026-08-05T13:43:40.703591Z","submitted_at":"2025-08-30T06:34:39Z","title":"Domain Adaptation-Based Crossmodal Knowledge Distillation for 3D Semantic Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:43:55.822844Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2509.00379"},"observation_digest":"sha256:414077971801c2e4a3ecc3ef03627fdfe6858fce6983c497c6887118cfc68268","observation_id":"9197fa95-24d5-4be9-b2d0-61a2082c7e31","resolution":{"observed_at":"2026-08-05T13:43:55.822844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":"2104.04687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-07-04T03:29:29.479882Z","title":"W., Meng, T., Caine, B., Ngiam, J., Peng, D., and Tan, M","venue":null,"work_id":"e000ccfc-e461-47da-8381-c466d1379dfc","year":2021},"citing_paper":{"arxiv_id":"2604.03334","last_updated":"2026-04-03T06:02:29Z","snapshot_observed_at":"2026-07-06T22:52:29.705312Z","submitted_at":"2026-04-03T06:02:29Z","title":"Bridging the Dimensionality Gap: A Taxonomy and Survey of 2D Vision Model Adaptation for 3D Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T20:26:27.298974Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2604.03334"},"observation_digest":"sha256:7257bde3d11a8d844c687b65bace99a4e3388ad967e1699a57bb1f7b68c7c13d","observation_id":"509cef8b-b9f1-4191-a4e5-05b43eeb3bf1","resolution":{"observed_at":"2026-05-13T20:28:13.972698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":"2104.04687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-07-04T03:29:29.479882Z","title":"W., Meng, T., Caine, B., Ngiam, J., Peng, D., and Tan, M","venue":null,"work_id":"e000ccfc-e461-47da-8381-c466d1379dfc","year":2021},"citing_paper":{"arxiv_id":"2604.18831","last_updated":"2026-04-20T20:55:21Z","snapshot_observed_at":"2026-08-02T06:50:33.846525Z","submitted_at":"2026-04-20T20:55:21Z","title":"Feasibility of Indoor Frame-Wise Lidar Semantic Segmentation via Distillation from Visual Foundation Model","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-10T04:49:35.318158Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2604.18831"},"observation_digest":"sha256:a5d327ce156705baacf6a76a124ace3086057e1560cf9b7a0a3b90d8f7ffa01b","observation_id":"b286709b-4a6c-431c-a246-6fb5d5089503","resolution":{"observed_at":"2026-05-10T11:35:19.215295Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":"2104.04687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-07-04T03:29:29.479882Z","title":"W., Meng, T., Caine, B., Ngiam, J., Peng, D., and Tan, M","venue":null,"work_id":"e000ccfc-e461-47da-8381-c466d1379dfc","year":2021},"citing_paper":{"arxiv_id":"2605.09899","last_updated":"2026-05-11T02:44:08Z","snapshot_observed_at":"2026-07-06T23:21:54.140120Z","submitted_at":"2026-05-11T02:44:08Z","title":"Hyperbolic Distillation: Geometry-Guided Cross-Modal Transfer for Robust 3D Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T04:25:15.991414Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2605.09899"},"observation_digest":"sha256:2a3ae103701b46e9f06b06513748f42c1eb481bce197c537fd0d0beacac7928f","observation_id":"5b6f5e5d-827d-4a33-9e2a-e4c39cb80b75","resolution":{"observed_at":"2026-05-12T06:16:28.786473Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":"2104.04687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-07-04T03:29:29.479882Z","title":"W., Meng, T., Caine, B., Ngiam, J., Peng, D., and Tan, M","venue":null,"work_id":"e000ccfc-e461-47da-8381-c466d1379dfc","year":2021},"citing_paper":{"arxiv_id":"2606.20189","last_updated":"2026-06-23T13:08:08Z","snapshot_observed_at":"2026-08-05T20:17:36.710597Z","submitted_at":"2026-06-18T13:01:40Z","title":"HilDA: Hierarchical Distillation with Diffusion for Advancing Self-Supervised LiDAR Pre-training","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-26T18:06:04.101217Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2606.20189"},"observation_digest":"sha256:1307fd67e83cdf7417908771a9a5a656c0818806ae3700eaa37f53630ce519d5","observation_id":"8d79a1f6-4402-4bd1-91d5-1d3947880498","resolution":{"observed_at":"2026-07-04T03:29:29.483040Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":"2104.04687","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-07-04T03:29:29.479882Z","title":"W., Meng, T., Caine, B., Ngiam, J., Peng, D., and Tan, M","venue":null,"work_id":"e000ccfc-e461-47da-8381-c466d1379dfc","year":2021},"citing_paper":{"arxiv_id":"2607.00514","last_updated":"2026-07-01T06:49:17Z","snapshot_observed_at":"2026-08-07T09:44:09.040603Z","submitted_at":"2026-07-01T06:49:17Z","title":"Cross4D-JEPA: Dense Cross-modal Correspondence Distillation for 4D Point Cloud Representation Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-02T14:45:28.839686Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2607.00514"},"observation_digest":"sha256:b8df79045a7397bac7d571f69f11cf3ad473ad8afd772a8e77713e9d41bb8bcf","observation_id":"273b026d-264f-48eb-8f70-65743e3559bb","resolution":{"observed_at":"2026-07-02T14:47:03.108630Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.04687","snapshot_observed_at":"2026-07-14T09:28:01.256510Z","title":"Learning from 2d: Contrastive pixel-to-point knowledge transfer for 3d pretraining,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10762","last_updated":"2026-07-12T13:37:47Z","snapshot_observed_at":"2026-08-01T23:40:53.167718Z","submitted_at":"2026-07-12T13:37:47Z","title":"TOLiD: Bridging the Architecture Gap in Vision Foundation Model to LiDAR Pretraining via Token Lifting for Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T09:28:01.256510Z"},"links":{"cited_paper":"/paper/2104.04687","citing_paper":"/paper/2607.10762"},"observation_digest":"sha256:15dfa8b751c06927940fe186c443c9905a1c42ce6512b7b18d9e065f1ab4d17f","observation_id":"933573ac-84db-456b-beb3-d17fb5880473","resolution":{"observed_at":"2026-07-14T09:28:01.256510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2104.04687/citation-record","integrity":"/paper/2104.04687/integrity","json":"/paper/2104.04687/citation-record.json","paper":"/paper/2104.04687"},"outbound":[],"paper":{"arxiv_id":"2104.04687","last_updated":"2021-12-27T15:19:51Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T10:58:14.547632Z","submitted_at":"2021-04-10T05:40:42Z","title":"Learning from 2D: Contrastive Pixel-to-Point Knowledge Transfer for 3D Pretraining"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2104.04687."}