{"as_of":"2026-08-08T02:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4e14b1e5829998b761bfa3ea1d8286887148e25ce734ea0003204e5c09dce82","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:40:17.417495Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":17,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-07-06T11:19:34.705520Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T11:50:11.476015Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2106.08254"},"observation_digest":"sha256:86071a0f2e9d955110725f038636dc8f5c87b7f42c01428ee2a3a0a00d0e571e","observation_id":"f2686462-a443-4b7e-a018-4b22fafdeaaf","resolution":{"observed_at":"2026-05-13T11:50:11.503940Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-16T08:12:30.984870Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2309.16797"},"observation_digest":"sha256:7008f3ccab561c7652993939bf5c502df1808ce09dff72c82cb4c4f9731745c1","observation_id":"0db076aa-81db-4f10-995a-66bf1e7b52c6","resolution":{"observed_at":"2026-05-16T08:12:31.385104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2312.17090","last_updated":"2023-12-28T16:10:25Z","snapshot_observed_at":"2026-08-02T07:14:02.308302Z","submitted_at":"2023-12-28T16:10:25Z","title":"Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels","version":1},"reference_index":129,"source":"arxiv_source","source_observed_at":"2026-05-15T16:35:47.826165Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2312.17090"},"observation_digest":"sha256:319ae4eadf348c4dd3866f2b4996685e4e093e464f1968e8907827e594fd47c9","observation_id":"503156a9-01f2-46d4-b08e-8768895902d1","resolution":{"observed_at":"2026-05-15T16:35:48.149598Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2404.08471","last_updated":"2024-02-15T18:59:11Z","snapshot_observed_at":"2026-08-07T02:30:11.447693Z","submitted_at":"2024-02-15T18:59:11Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","version":1},"reference_index":230,"source":"arxiv_source","source_observed_at":"2026-05-12T12:40:23.709098Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2404.08471"},"observation_digest":"sha256:5ce8214fd0ac0bf44bb5376148b43df3399a2114268caa95fa5445fa6417547a","observation_id":"24e23a72-8f7c-487c-accf-cf26de8bbac9","resolution":{"observed_at":"2026-05-12T12:40:23.862062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2503.16683","last_updated":"2026-04-20T21:20:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-20T19:59:39Z","title":"GAIR: Location-Aware Self-Supervised Contrastive Pre-Training with Geo-Aligned Implicit Representations","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T22:41:00.027266Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2503.16683"},"observation_digest":"sha256:17c286694c1965fd986248261c6767522f7823aab95feb0181c03cf56f4566c2","observation_id":"7ed57719-9bd5-40fd-9bdd-75fbd04748f4","resolution":{"observed_at":"2026-05-22T22:42:13.409272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-07T15:40:17.417495Z","title":"An empirical study of training self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14751","last_updated":"2025-05-20T13:15:27Z","snapshot_observed_at":"2026-08-07T15:34:12.208046Z","submitted_at":"2025-05-20T13:15:27Z","title":"Self Distillation via Iterative Constructive Perturbations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:40:17.417495Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2505.14751"},"observation_digest":"sha256:20e9e9c5b3e9ce909a55b49d1fa377ef15e75a383aa6e7d33dad50dc9416a6ac","observation_id":"5c89becb-6785-416b-a98b-ef71a599ad6c","resolution":{"observed_at":"2026-08-07T15:40:17.417495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-07T14:14:41.095167Z","title":"An empirical study of training self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19680","last_updated":"2025-05-26T08:40:31Z","snapshot_observed_at":"2026-08-07T14:44:05.824531Z","submitted_at":"2025-05-26T08:40:31Z","title":"Cut out and Replay: A Simple yet Versatile Strategy for Multi-Label Online Continual Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:41.095167Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2505.19680"},"observation_digest":"sha256:aabfc3736281df9510340c1201c91139bb59c9c6e1d2c33fecebb7528c03e5cb","observation_id":"694a59dd-5a4d-40fa-8b3a-53c6246972b8","resolution":{"observed_at":"2026-08-07T14:14:41.095167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-07T13:22:29.010114Z","title":"An empirical study of training self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22196","last_updated":"2025-05-28T10:18:20Z","snapshot_observed_at":"2026-08-07T14:44:32.519753Z","submitted_at":"2025-05-28T10:18:20Z","title":"An Augmentation-Aware Theory for Self-Supervised Contrastive Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:29.010114Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2505.22196"},"observation_digest":"sha256:46255b5c308cbac42d6185a02072b5035a0e17a995ec475bbe9944a897293b18","observation_id":"97ce9b05-cb7c-4620-98da-8e97e7d10f55","resolution":{"observed_at":"2026-08-07T13:22:29.010114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-07T05:25:31.866030Z","title":"An empirical study of training self-supervised vision transformers, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08008","last_updated":"2025-06-09T17:59:54Z","snapshot_observed_at":"2026-08-07T05:17:55.846802Z","submitted_at":"2025-06-09T17:59:54Z","title":"Hidden in plain sight: VLMs overlook their visual representations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:25:31.866030Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2506.08008"},"observation_digest":"sha256:95cbbbc09c468f7b84a60ea2362a60d599a75c00c1f51c4ee4fd4859dfc5af6d","observation_id":"6bf1eaae-e437-4f15-9902-44650ed9bd71","resolution":{"observed_at":"2026-08-07T05:25:31.866030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-07T04:12:48.510234Z","title":"An empirical study of training self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11439","last_updated":"2025-06-13T03:37:57Z","snapshot_observed_at":"2026-08-07T04:06:40.545358Z","submitted_at":"2025-06-13T03:37:57Z","title":"Uncertainty Awareness Enables Efficient Labeling for Cancer Subtyping in Digital Pathology","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:12:48.510234Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2506.11439"},"observation_digest":"sha256:15b0b389aa6c10b734bbbb7a7c66c33f634683b69580d7b669e0253c065d32c4","observation_id":"1afc5160-e24b-4743-897b-610538d94610","resolution":{"observed_at":"2026-08-07T04:12:48.510234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2508.09691","last_updated":"2026-04-07T08:20:47Z","snapshot_observed_at":"2026-08-03T05:11:37.073397Z","submitted_at":"2025-08-13T10:37:41Z","title":"PaCo-FR: Patch-Pixel Aligned End-to-End Codebook Learning for Facial Representation Pre-training","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T22:53:23.271423Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2508.09691"},"observation_digest":"sha256:b87390319c904c64ea51aa7a19695c1454167d6e8b252fdaa55fd2ff4a5a34f6","observation_id":"5c07c8f3-2d4b-41c1-a4d8-0b79ea2e1fb4","resolution":{"observed_at":"2026-05-18T22:56:53.139981Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-03T05:18:30.707009Z","title":"Chen, M., Jiang, M., Zhang, X., Dou, Q., Wang, Z., and Li, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02890","last_updated":"2026-06-01T19:39:57Z","snapshot_observed_at":"2026-08-07T10:19:53.337320Z","submitted_at":"2026-02-02T22:48:49Z","title":"Self-Soupervision: Cooking Model Soups without Labels","version":2},"reference_index":274,"source":"pdf_text","source_observed_at":"2026-08-03T05:18:30.707009Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2602.02890"},"observation_digest":"sha256:0e13058fca56e418526e72b0d98e054062696cad207d7786a52ea1873c9b1c86","observation_id":"f6ffccf8-3b6b-48f0-854b-9be69f469b85","resolution":{"observed_at":"2026-08-03T05:18:30.707009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2604.13947","last_updated":"2026-04-15T15:01:29Z","snapshot_observed_at":"2026-08-02T18:42:12.380694Z","submitted_at":"2026-04-15T15:01:29Z","title":"Heuristic Style Transfer for Real-Time, Efficient Weather Attribute Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T13:37:59.894503Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2604.13947"},"observation_digest":"sha256:d612043d5719a00346f9cd33e0028a2c68c1e7b330b98fa21a1f63e423c683bc","observation_id":"6402da3f-8c90-4237-bb2f-22319c61b382","resolution":{"observed_at":"2026-05-10T13:40:27.076956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2604.18251","last_updated":"2026-04-20T13:28:24Z","snapshot_observed_at":"2026-07-06T23:05:08.728446Z","submitted_at":"2026-04-20T13:28:24Z","title":"Style-Based Neural Architectures for Real-Time Weather Classification","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T04:32:29.400543Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2604.18251"},"observation_digest":"sha256:c37a4df88014b55389823468f91d089272631c73742ff356e95d3fe7e6e1a6c5","observation_id":"342f2900-19dd-4e3b-add3-e470fb2883da","resolution":{"observed_at":"2026-05-11T11:51:03.488100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2605.03245","last_updated":"2026-05-05T00:26:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T00:26:57Z","title":"Text-Conditional JEPA for Learning Semantically Rich Visual Representations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T17:58:43.650308Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2605.03245"},"observation_digest":"sha256:99bd36ba2978d5ec15bdd816840c4ee3b87d43e50076246eabc3689567c71a1a","observation_id":"3c301b2c-af92-463a-bedd-24fb94f32b1c","resolution":{"observed_at":"2026-05-12T10:51:30.647800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":"2104.02057","doi":"10.48550/arxiv.2104.02057","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An empirical study of training self-supervised vision transformers","venue":"arXiv (Cornell University)","work_id":"3fad1b3f-2ddd-4ef1-95f6-a797e0c02979","year":2021},"citing_paper":{"arxiv_id":"2605.18878","last_updated":"2026-05-16T02:49:12Z","snapshot_observed_at":"2026-08-02T22:07:15.605820Z","submitted_at":"2026-05-16T02:49:12Z","title":"Prognostic Value of Lung Ultrasound Biomarkers for Readmission Risk in Congestive Heart Failure: A Pilot Data-Driven Analysis","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-20T15:41:31.181025Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2605.18878"},"observation_digest":"sha256:4ec78d90b43424e9baa330e497f9759277b167a1b3d07910fbf8ece9f4179901","observation_id":"a2921392-a880-4238-bf1c-6459a960a07f","resolution":{"observed_at":"2026-05-20T15:43:26.413714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:53:30.196656+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02057","snapshot_observed_at":"2026-07-12T08:12:18.373103Z","title":"An empirical study of training self-supervised vision transformers.arXiv preprint arXiv:2104.02057, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.02637","last_updated":"2026-07-02T15:34:46Z","snapshot_observed_at":"2026-08-02T18:06:42.028681Z","submitted_at":"2026-07-02T15:34:46Z","title":"Post-Generation Curation of Synthetic Images via Homogeneous-Heterogeneous Splitting","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-12T08:12:18.373103Z"},"links":{"cited_paper":"/paper/2104.02057","citing_paper":"/paper/2607.02637"},"observation_digest":"sha256:92e4eeb392b2542d4ac19db095811e58ca4e42a4f9df9f59b3ad6346bd581d65","observation_id":"ba36f626-90bb-4bbf-a811-5e001edf2eaa","resolution":{"observed_at":"2026-07-12T08:12:18.373103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2104.02057/citation-record","integrity":"/paper/2104.02057/integrity","json":"/paper/2104.02057/citation-record.json","paper":"/paper/2104.02057"},"outbound":[],"paper":{"arxiv_id":"2104.02057","last_updated":"2021-08-16T17:40:21Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T10:56:39.571860Z","submitted_at":"2021-04-05T17:59:40Z","title":"An Empirical Study of Training Self-Supervised Vision Transformers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2104.02057."}