{"as_of":"2026-08-07T12:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:06411c6eaffd8ee5dfa71dbb1f25edbcc3c0a242abe2908de3af7f08f6c3afb6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":35,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:29:54.641798Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":4,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2310.01852","last_updated":"2024-01-22T03:11:15Z","snapshot_observed_at":"2026-08-07T05:10:33.059352Z","submitted_at":"2023-10-03T07:33:27Z","title":"LanguageBind: Extending Video-Language Pretraining to N-modality by Language-based Semantic Alignment","version":7},"reference_index":208,"source":"arxiv_source","source_observed_at":"2026-05-17T03:27:58.952076Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2310.01852"},"observation_digest":"sha256:3b10cfbc478ccd4671abc2ffe9c5a52b03fe0c73f0b9962ee50736bb91deb5db","observation_id":"32d51985-98c8-4073-87a5-01aa653416f0","resolution":{"observed_at":"2026-05-17T03:27:59.136192Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-16T16:35:37.937462Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2312.16886"},"observation_digest":"sha256:2bad86edec2a26b57ce39e9d5d986844068e6f38b10bd04b87c4bedc26999fad","observation_id":"bdb84ae6-aeaf-49be-8af4-16da472a8658","resolution":{"observed_at":"2026-05-16T16:35:38.079877Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-07T11:29:54.641798Z","title":"Imagenet-21k pretraining for the masses","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02453","last_updated":"2025-07-03T06:22:46Z","snapshot_observed_at":"2026-08-07T11:21:05.068607Z","submitted_at":"2025-06-03T05:18:15Z","title":"PAID: Pairwise Angular-Invariant Decomposition for Continual Test-Time Adaptation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:54.641798Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2506.02453"},"observation_digest":"sha256:cce5db5905986ff22024c9844480680a8a2ed0af72897e53a98c0132294402b2","observation_id":"d52fab38-56c5-4f04-a170-0fbbcce3e5b5","resolution":{"observed_at":"2026-08-07T11:29:54.641798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-07T10:24:24.951506Z","title":"Imagenet-21k pretraining for the masses","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05826","last_updated":"2025-06-06T07:53:40Z","snapshot_observed_at":"2026-08-07T10:11:02.685326Z","submitted_at":"2025-06-06T07:53:40Z","title":"Learning Along the Arrow of Time: Hyperbolic Geometry for Backward-Compatible Representation Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T10:24:24.951506Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2506.05826"},"observation_digest":"sha256:121bf312711de8927cc3a64981da0492746cbf460732bdd3b1a6bb28066cddf9","observation_id":"1ddf0a31-3519-4ed5-98cf-dd63efdcd4f4","resolution":{"observed_at":"2026-08-07T10:24:24.951506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-07T05:57:57.751315Z","title":"Imagenet-21k pretraining for the masses,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06569","last_updated":"2025-06-06T22:49:53Z","snapshot_observed_at":"2026-08-07T05:51:43.563677Z","submitted_at":"2025-06-06T22:49:53Z","title":"Textile Analysis for Recycling Automation using Transfer Learning and Zero-Shot Foundation Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:57:57.751315Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2506.06569"},"observation_digest":"sha256:b23642998ee639f6ead52503d4f047cbe8b3617a3c0e89894291ade44eca24a0","observation_id":"e9405bb7-a69d-49ef-9676-0926a939234a","resolution":{"observed_at":"2026-08-07T05:57:57.751315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-07T04:09:41.086921Z","title":"Imagenet-21k pretraining for the masses","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11465","last_updated":"2025-06-13T04:39:58Z","snapshot_observed_at":"2026-08-07T08:51:19.233284Z","submitted_at":"2025-06-13T04:39:58Z","title":"RollingQ: Reviving the Cooperation Dynamics in Multimodal Transformer","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:09:41.086921Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2506.11465"},"observation_digest":"sha256:3b0d5d0dd2269ef78885b679e58d08b8a599a0d68c544f42da94f38347a2399d","observation_id":"d46087ef-f70c-4d11-83e1-910194c6e1e2","resolution":{"observed_at":"2026-08-07T04:09:41.086921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-06T21:41:34.691781Z","title":"Imagenet-21k pretraining for the masses","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23623","last_updated":"2025-06-30T08:40:36Z","snapshot_observed_at":"2026-08-07T12:15:49.915840Z","submitted_at":"2025-06-30T08:40:36Z","title":"Revisiting Audio-Visual Segmentation with Vision-Centric Transformer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:41:34.691781Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2506.23623"},"observation_digest":"sha256:97a6867c6e2f5cb67af0bac67ab69b2b6679a5c8505eedbf7da5d6aa36a44b4a","observation_id":"61e08455-777a-485e-922f-b50865cd6976","resolution":{"observed_at":"2026-08-06T21:41:34.691781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-06T18:54:55.009314Z","title":"Imagenet-21k pretraining for the masses,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07044","last_updated":"2025-07-16T03:52:16Z","snapshot_observed_at":"2026-08-06T18:46:09.326153Z","submitted_at":"2025-07-09T17:07:26Z","title":"Opto-ViT: Architecting a Near-Sensor Region of Interest-Aware Vision Transformer Accelerator with Silicon Photonics","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:54:55.009314Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2507.07044"},"observation_digest":"sha256:19a3add9648183420a720d943394e70080a7d79043b63d0e43e95b76e067890c","observation_id":"d1176881-a22d-4c8d-b9b1-462021c21c57","resolution":{"observed_at":"2026-08-06T18:54:55.009314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-06T18:33:37.546443Z","title":"Imagenet-21k pretraining for the masses","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07929","last_updated":"2025-07-10T17:09:14Z","snapshot_observed_at":"2026-08-06T18:26:42.779349Z","submitted_at":"2025-07-10T17:09:14Z","title":"Towards Continuous Home Cage Monitoring: An Evaluation of Tracking and Identification Strategies for Laboratory Mice","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:37.546443Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2507.07929"},"observation_digest":"sha256:e0c3ffdfa1a986643f049dd2d71e6a5ed4497a91e497abb3bc7280aec9795e5a","observation_id":"5cc46fc6-e0af-4ed7-87e3-17525577ec55","resolution":{"observed_at":"2026-08-06T18:33:37.546443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-06T18:25:20.674966Z","title":"Ridnik, E","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08384","last_updated":"2025-07-11T07:58:21Z","snapshot_observed_at":"2026-08-06T18:17:31.725720Z","submitted_at":"2025-07-11T07:58:21Z","title":"Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T18:25:20.674966Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2507.08384"},"observation_digest":"sha256:c8cf1f1ca79957a6b9021c46d060dbfbd5069895b3b72507cecd7c64f04186e0","observation_id":"01a8da17-0e19-4411-8b6e-b90d6a2969c2","resolution":{"observed_at":"2026-08-06T18:25:20.674966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-06T18:06:33.053004Z","title":"& Zelnik-Manor, L","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09299","last_updated":"2025-07-12T14:19:04Z","snapshot_observed_at":"2026-08-07T11:06:28.629023Z","submitted_at":"2025-07-12T14:19:04Z","title":"ViT-ProtoNet for Few-Shot Image Classification: A Multi-Benchmark Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:06:33.053004Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2507.09299"},"observation_digest":"sha256:9e7395d67bcb96ca079d0f4c50eef7e00c7c9f3098c22a5ebe79e1f1e7c11f82","observation_id":"02754b74-4417-4d6c-9eb8-31a0afb277cf","resolution":{"observed_at":"2026-08-06T18:06:33.053004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-06T14:37:32.195913Z","title":", author Baruch, E.B","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18330","last_updated":"2025-07-25T17:32:47Z","snapshot_observed_at":"2026-08-07T11:33:41.628642Z","submitted_at":"2025-07-24T11:57:59Z","title":"GVCCS: A Dataset for Contrail Identification and Tracking on Visible Whole Sky Camera Sequences","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T14:37:32.195913Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2507.18330"},"observation_digest":"sha256:8b5757dfd047310eb378d2687f0baecd5ad6185389970e1629c3af26f0fe8daf","observation_id":"23983688-5fea-4bee-8774-9be931c53e71","resolution":{"observed_at":"2026-08-06T14:37:32.195913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2507.21114","last_updated":"2026-06-23T13:04:27Z","snapshot_observed_at":"2026-08-06T18:17:05.365272Z","submitted_at":"2025-07-11T08:30:12Z","title":"Page image classification for content-specific data processing","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-19T06:00:46.843420Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2507.21114"},"observation_digest":"sha256:b401e8ad461d120efc44ae56c9eafe55e82a468cdcc0896215ca6f2d6f03789c","observation_id":"94e879dd-ac65-4130-b61b-a2a5b9be83cb","resolution":{"observed_at":"2026-05-19T06:02:07.647676Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T13:24:13.653762Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00692","last_updated":"2025-08-31T04:18:12Z","snapshot_observed_at":"2026-08-05T13:24:12.828357Z","submitted_at":"2025-08-31T04:18:12Z","title":"CascadeFormer: A Family of Two-stage Cascading Transformers for Skeleton-based Human Action Recognition","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T13:24:13.653762Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2509.00692"},"observation_digest":"sha256:4c99586228f289c75a2ee0e58dafc025ca6ab0700423f58a8158edaf9f65a612","observation_id":"c73d2521-2941-46a6-b06b-16332c09f1b4","resolution":{"observed_at":"2026-08-05T13:24:13.653762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T14:12:29.948773Z","title":"Imagenet-21k pretraining for the masses","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07993","last_updated":"2025-08-29T13:34:21Z","snapshot_observed_at":"2026-08-05T14:12:25.134682Z","submitted_at":"2025-08-29T13:34:21Z","title":"Revisiting Deepfake Detection: Chronological Continual Learning and the Limits of Generalization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T14:12:29.948773Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2509.07993"},"observation_digest":"sha256:7559ec875957b80754b81b7556d81f4ada8dd1f907528ed308f1bdd8821e7831","observation_id":"40f2d71d-1d61-46c5-8a1f-6909817928e5","resolution":{"observed_at":"2026-08-05T14:12:29.948773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-03T22:31:35.719971Z","title":"ImageNet-21k Pretraining for The Masses,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.10260","last_updated":"2026-07-10T07:05:29Z","snapshot_observed_at":"2026-08-07T11:06:19.787195Z","submitted_at":"2025-11-13T12:49:10Z","title":"H3Former: Hypergraph-based Semantic-Aware Aggregation via Hyperbolic Hierarchical Contrastive Loss for Fine-Grained Visual Classification","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T22:31:35.719971Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2511.10260"},"observation_digest":"sha256:a62077b8ab10ffa2f99c7f333b527c0c41878f7d84deca0557e2329845b76c23","observation_id":"ce1f79a4-4625-4815-a8c5-c41238e0c480","resolution":{"observed_at":"2026-08-03T22:31:35.719971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2511.22337","last_updated":"2026-04-17T07:35:52Z","snapshot_observed_at":"2026-07-06T22:37:08.086095Z","submitted_at":"2025-11-27T11:18:42Z","title":"HandyLabel: Towards Post-Processing to Real-Time Annotation Using Skeleton Based Hand Gesture Recognition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-17T05:05:24.411291Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2511.22337"},"observation_digest":"sha256:950c7ce804a9a92d8b46595c52b2eef8f318c7b8896557002e7acc37f25a61a7","observation_id":"6834d710-eeef-4c62-8529-f6fe3a45c3a8","resolution":{"observed_at":"2026-05-17T05:09:04.066271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2602.07940","last_updated":"2026-05-11T10:23:54Z","snapshot_observed_at":"2026-08-06T02:36:14.785124Z","submitted_at":"2026-02-08T12:15:35Z","title":"MePo: Meta Post-Refinement for Rehearsal-Free General Continual Learning","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T06:20:18.021294Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2602.07940"},"observation_digest":"sha256:d7c234cf11a37b666819cb95fecb107264ddd06586b3e2bc90fe9bfac815a8e9","observation_id":"6afc2b4a-3fac-435a-a54a-eb8103f685fa","resolution":{"observed_at":"2026-05-16T06:20:40.881579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2603.22570","last_updated":"2026-05-16T19:21:49Z","snapshot_observed_at":"2026-08-02T22:04:13.851745Z","submitted_at":"2026-03-23T21:05:21Z","title":"CanViT: Toward Active-Vision Foundation Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-21T10:33:29.023955Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2603.22570"},"observation_digest":"sha256:f6fae0b90a0d112daefc7c1882edddfaa20bb44ebb0afa61c48c7b7f07ab1e2e","observation_id":"4d064ed4-4093-4dff-957d-89d99d0cf494","resolution":{"observed_at":"2026-05-21T10:34:06.899210Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2604.04552","last_updated":"2026-05-07T08:44:16Z","snapshot_observed_at":"2026-07-06T22:53:29.118925Z","submitted_at":"2026-04-06T09:21:48Z","title":"StableTTA: Improving Vision Model Performance by Training-free Test-Time Adaptation Methods","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T19:40:24.850441Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2604.04552"},"observation_digest":"sha256:796bb615266e2c1da0c13f1eadfda9b09a878d90320d1d098e551c7ce86f6b7c","observation_id":"b4ae7957-f184-4287-a003-5734e38f2935","resolution":{"observed_at":"2026-05-10T22:40:48.411580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2604.13244","last_updated":"2026-04-14T19:21:41Z","snapshot_observed_at":"2026-07-06T23:01:19.191464Z","submitted_at":"2026-04-14T19:21:41Z","title":"4th Workshop on Maritime Computer Vision (MaCVi): Challenge Overview","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T16:18:34.717325Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2604.13244"},"observation_digest":"sha256:6d76cea49577123780c07d8047e05efcd2cc0a40aa3386f20cceed8665993101","observation_id":"a3e5ab55-180b-4b23-a54b-ca17041d427c","resolution":{"observed_at":"2026-05-11T09:01:00.658333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2604.22477","last_updated":"2026-04-29T14:23:54Z","snapshot_observed_at":"2026-08-04T10:22:05.244783Z","submitted_at":"2026-04-24T11:55:50Z","title":"Contrastive Semantic Projection: Faithful Neuron Labeling with Contrastive Examples","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T12:40:39.953351Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2604.22477"},"observation_digest":"sha256:e8e193268aa912452cc060e255d3e3ba14ab5372ec65d0c1e04fd0446c0fc8db","observation_id":"d535ac1e-eed2-402a-b86e-40f7675c8ba6","resolution":{"observed_at":"2026-05-11T19:06:10.151812Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2605.10953","last_updated":"2026-04-30T15:28:51Z","snapshot_observed_at":"2026-08-07T12:26:09.273968Z","submitted_at":"2026-04-30T15:28:51Z","title":"Parameter-Efficient Adaptation of Pre-Trained Vision Foundation Models for Active and Passive Seismic Data Denoising","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-13T07:58:21.350747Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2605.10953"},"observation_digest":"sha256:fc4a938bfc4e1bf470b0649d292f53aa7a68ff95fb3db68460c8b3d11d84bc77","observation_id":"fa154e1d-885d-4e6f-8a4d-b8226d9504a2","resolution":{"observed_at":"2026-05-13T08:02:31.950023Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2605.11107","last_updated":"2026-05-11T18:13:05Z","snapshot_observed_at":"2026-07-06T23:22:57.012338Z","submitted_at":"2026-05-11T18:13:05Z","title":"Birds of a Feather Flock Together: Background-Invariant Representations via Linear Structure in VLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T07:26:02.947081Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2605.11107"},"observation_digest":"sha256:46595e00fbad1ed2a09e78708805e49b498766cb55883db6d1c3109a523a9eee","observation_id":"4f1722eb-e688-4bdb-af02-11db97b3427d","resolution":{"observed_at":"2026-05-13T07:27:29.789189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2605.23719","last_updated":"2026-05-20T13:35:17Z","snapshot_observed_at":"2026-08-02T10:22:47.382889Z","submitted_at":"2026-05-20T13:35:17Z","title":"Weierstrass Positional Encoding for Vision Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-25T05:48:36.533090Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2605.23719"},"observation_digest":"sha256:c0209024d056227852bd7d30fe338ec760507881499bc550b53ce4217771af9c","observation_id":"e944fe83-b74b-4ac2-b6b9-99012df630cd","resolution":{"observed_at":"2026-05-25T05:50:23.761775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2605.26636","last_updated":"2026-05-26T07:17:27Z","snapshot_observed_at":"2026-08-05T14:13:53.444731Z","submitted_at":"2026-05-26T07:17:27Z","title":"JetViT: Efficient High-Resolution Vision Transformer with Post-Training Attention Search","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T18:12:21.124678Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2605.26636"},"observation_digest":"sha256:72b8a1a72c6fae35a44f108e8b61792c50ee045970e1cb24454c6ae5d65feead","observation_id":"ea4a2e2c-6963-4ab4-a97d-1a41fd8fbdb0","resolution":{"observed_at":"2026-06-29T18:13:48.405563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2605.27482","last_updated":"2026-06-26T13:12:06Z","snapshot_observed_at":"2026-08-04T20:02:34.218602Z","submitted_at":"2026-05-26T12:55:02Z","title":"Energy-Structured Low-Rank Adaptation for Continual Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T19:38:04.181839Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2605.27482"},"observation_digest":"sha256:f8202537cccd3cd5437e61625e044d98c33850c28587a58e96759a04d0f11adf","observation_id":"732d3010-6621-4ce0-8c2b-a428c0fc4245","resolution":{"observed_at":"2026-06-29T19:43:54.816900Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2605.28271","last_updated":"2026-05-27T10:17:56Z","snapshot_observed_at":"2026-08-02T18:19:54.777523Z","submitted_at":"2026-05-27T10:17:56Z","title":"LV-OSD: Language-Vision-Complementary Open-Set Object Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T13:44:59.042817Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2605.28271"},"observation_digest":"sha256:b8a72b8a83341819363d325cc4ccfc5de4541a2381138ea47039a19fe8d1fdc9","observation_id":"5bc5ad43-1aa2-4bc4-a926-492004439a8b","resolution":{"observed_at":"2026-06-29T13:53:28.939534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2606.02572","last_updated":"2026-06-01T17:58:01Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:58:01Z","title":"VISReg: Variance-Invariance-Sketching Regularization for JEPA training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T15:17:59.919440Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2606.02572"},"observation_digest":"sha256:d85afcea9336f516faf51de18531f4eb4b8827c1872f48e1dd17f2031e691789","observation_id":"aa4c9160-869c-476a-aa14-8fce30c641aa","resolution":{"observed_at":"2026-07-01T22:36:17.080856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2606.07558","last_updated":"2026-05-25T08:36:36Z","snapshot_observed_at":"2026-08-03T04:25:51.531766Z","submitted_at":"2026-05-25T08:36:36Z","title":"Page image classifier fine-tuned on century-spanning archives of scanned documents for further content-specific processing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T22:50:29.393207Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2606.07558"},"observation_digest":"sha256:ee07d42a5ef42f6ae7b647d08671dc7a3ebc7326e96a04ca1ec301f5882540b2","observation_id":"40ad3c0e-de80-4da6-998e-ed62e8ff5426","resolution":{"observed_at":"2026-06-29T22:54:01.074649Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2606.09360","last_updated":"2026-06-08T11:34:32Z","snapshot_observed_at":"2026-07-31T08:23:57.018074Z","submitted_at":"2026-06-08T11:34:32Z","title":"ExDet: Open-Domain Open-Vocabulary Detection with Cross-modal Extrapolation and Rectification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T16:53:37.521755Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2606.09360"},"observation_digest":"sha256:a285823b0ca4c476634aa9f12f545c91e8e5b2437401e610e71c35f06777f187","observation_id":"74204860-2cd5-423d-8409-a90c5ba0ff06","resolution":{"observed_at":"2026-07-03T00:57:30.396703Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2606.16734","last_updated":"2026-07-17T10:41:18Z","snapshot_observed_at":"2026-08-02T16:20:06.031805Z","submitted_at":"2026-06-15T13:55:37Z","title":"The Edge-on Galaxies in the DESI survey (EGIDE): sample building and photometry","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-06-27T03:24:51.042931Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2606.16734"},"observation_digest":"sha256:5eca7329a010e37a6fc079404ba040841f972bb69246307352fd3bf2688e2b7f","observation_id":"a3dac1e9-fd39-4d00-8d19-fc9988a1b0f6","resolution":{"observed_at":"2026-06-27T03:30:26.695732Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-02T11:12:41.905093Z","title":"ImageNet-21K Pretraining for the Masses.arXiv e-prints2021, p","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.16734","last_updated":"2026-07-17T10:41:18Z","snapshot_observed_at":"2026-08-02T16:20:06.031805Z","submitted_at":"2026-06-15T13:55:37Z","title":"The Edge-on Galaxies in the DESI survey (EGIDE): sample building and photometry","version":3},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-02T11:12:41.905093Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2606.16734"},"observation_digest":"sha256:57b8d5e34fe40ef1a95a276063a44405853fc2dac001cbc0e2f49a17d67ddd83","observation_id":"03836d3b-efdb-40cd-a471-8243035c081f","resolution":{"observed_at":"2026-08-02T11:12:41.905093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2607.00620","last_updated":"2026-07-01T08:40:46Z","snapshot_observed_at":"2026-07-07T00:06:14.968413Z","submitted_at":"2026-07-01T08:40:46Z","title":"Identifying Latent Concepts and Structures for Generalized Category Discovery","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-07-02T14:42:01.334822Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2607.00620"},"observation_digest":"sha256:b53372933df21f47181f3620195d304b878f0941ec329c6af0d75775f1ce7f8f","observation_id":"18c8b1b4-0bc3-4036-9009-fc1b5502a2e4","resolution":{"observed_at":"2026-07-02T14:47:03.336260Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses","version":4},"cited_work":{"arxiv_id":"2104.10972","doi":"10.48550/arxiv.2104.10972","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.10972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagenet-21k pretraining for the masses","venue":"arXiv (Cornell University)","work_id":"31e88324-e013-43f0-8c70-24aba0fa92fb","year":2021},"citing_paper":{"arxiv_id":"2607.00916","last_updated":"2026-07-01T13:21:44Z","snapshot_observed_at":"2026-08-03T02:46:32.964561Z","submitted_at":"2026-07-01T13:21:44Z","title":"Condensing Large-Scale Datasets Directly with Minimal Information Loss","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-02T13:59:59.488216Z"},"links":{"cited_paper":"/paper/2104.10972","citing_paper":"/paper/2607.00916"},"observation_digest":"sha256:ecd87bd1c6476975212cd53166c3ce97b5e20fc81d363c5a13dfbf0e8d76efea","observation_id":"3998c07f-7f0a-4624-8570-6e4eb3fcf47f","resolution":{"observed_at":"2026-07-02T14:07:02.387711Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2104.10972/citation-record","integrity":"/paper/2104.10972/integrity","json":"/paper/2104.10972/citation-record.json","paper":"/paper/2104.10972"},"outbound":[],"paper":{"arxiv_id":"2104.10972","last_updated":"2021-08-05T15:04:28Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T21:17:51.553405Z","submitted_at":"2021-04-22T10:10:14Z","title":"ImageNet-21K Pretraining for the Masses"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 35 inbound Pith citation observations for arXiv:2104.10972."}