{"as_of":"2026-08-07T09:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c201f7bce3e0478e9e8ccb0f05d87723dd485d95e2d2f205f5efaf1025a2e5c1","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T02:10:27.569787Z","state":"measured"},{"denominator":111,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":111,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":88,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":88,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:25:41.207347Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":210,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2404.08471","last_updated":"2024-02-15T18:59:11Z","snapshot_observed_at":"2026-08-07T02:30:11.447693Z","submitted_at":"2024-02-15T18:59:11Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","version":1},"reference_index":297,"source":"arxiv_source","source_observed_at":"2026-05-12T12:40:23.709098Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2404.08471"},"observation_digest":"sha256:f06f7b1c7d99aca46a70e0af403a816dc767f34216be5009dd5f0b031df13023","observation_id":"f14a4747-65d4-4b24-8c1f-449cff0fdf0e","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-07T04:25:41.207347Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10582","last_updated":"2025-09-10T07:20:50Z","snapshot_observed_at":"2026-08-07T04:20:14.907451Z","submitted_at":"2025-06-12T11:19:07Z","title":"Rethinking Random Masking in Self-Distillation on ViT","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:25:41.207347Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2506.10582"},"observation_digest":"sha256:d34a8611bac7684ea397138d22d9901788ac602c4d36ce61f3c6965780a39d0b","observation_id":"dd7d20d9-70ae-41a1-95ac-cc3708041cf1","resolution":{"observed_at":"2026-08-07T04:25:41.207347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T23:27:33.201202Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18164","last_updated":"2026-08-03T17:42:54Z","snapshot_observed_at":"2026-08-06T23:37:31.119903Z","submitted_at":"2025-06-22T20:40:11Z","title":"CDG-MAE: Cross-view Masked Modeling using Diffusion Generated Views","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:33.201202Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2506.18164"},"observation_digest":"sha256:a3ef46f95aee4273233a444c8542dc0ea6fed900262298d40e6c92ccfd071f15","observation_id":"23a934a4-0b0c-4730-b05e-bf678524b17d","resolution":{"observed_at":"2026-08-06T23:27:33.201202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T23:11:30.175878Z","title":"arXiv preprint arXiv:2111.07832 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19552","last_updated":"2025-06-24T12:00:13Z","snapshot_observed_at":"2026-08-06T23:04:23.147486Z","submitted_at":"2025-06-24T12:00:13Z","title":"General Methods Make Great Domain-specific Foundation Models: A Case-study on Fetal Ultrasound","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:11:30.175878Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2506.19552"},"observation_digest":"sha256:94b46f062ad471401c3f5956f0526962fbb86eef3a8a6929d38a20d07c88a9a7","observation_id":"782cb8f4-4720-48ec-bd08-a99227d9159e","resolution":{"observed_at":"2026-08-06T23:11:30.175878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T22:26:23.312376Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.21724","last_updated":"2025-06-26T19:17:10Z","snapshot_observed_at":"2026-08-06T22:18:02.271659Z","submitted_at":"2025-06-26T19:17:10Z","title":"Asymmetric Dual Self-Distillation for 3D Self-Supervised Representation Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:26:23.312376Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2506.21724"},"observation_digest":"sha256:bb3cd4fa5f6e8630f357cd26d4ab61c41c8937695bcbfb81a1c9431c9700e463","observation_id":"fccc7cdd-76a3-446f-b5af-293cdf735578","resolution":{"observed_at":"2026-08-06T22:26:23.312376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T21:17:07.479266Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00754","last_updated":"2025-07-08T19:44:08Z","snapshot_observed_at":"2026-08-07T06:17:54.949084Z","submitted_at":"2025-07-01T13:58:21Z","title":"Language-Unlocked ViT (LUViT): Empowering Self-Supervised Vision Transformers with LLMs","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T21:17:07.479266Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.00754"},"observation_digest":"sha256:2205c2cf379ac89774aa4e17ef80ceed2a1fa6caec9fbc6c8651d53c133c289f","observation_id":"ebad85fb-f08e-4e2c-83cd-bf4aabd2f59e","resolution":{"observed_at":"2026-08-06T21:17:07.479266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T19:52:37.878565Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04408","last_updated":"2025-07-06T14:48:10Z","snapshot_observed_at":"2026-08-06T19:45:45.331038Z","submitted_at":"2025-07-06T14:48:10Z","title":"A View-consistent Sampling Method for Regularized Training of Neural Radiance Fields","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:52:37.878565Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.04408"},"observation_digest":"sha256:eecaeb302f5e6ad02825f298433b3b0987d3c1935bf8b3bca9329949fd14b376","observation_id":"7a17615d-b98b-487e-93ae-3c546e6cfd7b","resolution":{"observed_at":"2026-08-06T19:52:37.878565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T19:44:36.889264Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.04801","last_updated":"2025-07-08T08:17:37Z","snapshot_observed_at":"2026-08-06T19:36:54.438128Z","submitted_at":"2025-07-07T09:21:28Z","title":"PointGAC: Geometric-Aware Codebook for Masked Point Cloud Modeling","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:44:36.889264Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.04801"},"observation_digest":"sha256:b6b4631b069ce30cdf64dfe6c30ec90fd58f1d474f1c086db576bfcb743503d2","observation_id":"d73092d8-6dd7-40b0-aab1-4869363bbdd7","resolution":{"observed_at":"2026-08-06T19:44:36.889264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T18:00:20.682062Z","title":"ibot: Image bert pre-training with online tokenizer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09471","last_updated":"2025-07-13T03:11:35Z","snapshot_observed_at":"2026-08-06T20:30:59.363843Z","submitted_at":"2025-07-13T03:11:35Z","title":"CKAA: Cross-subspace Knowledge Alignment and Aggregation for Robust Continual Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T18:00:20.682062Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.09471"},"observation_digest":"sha256:6844c5a419a5001e38a5230601419da632b2e5492498bceee0cb6b084af29337","observation_id":"eae453d2-279e-47de-94c0-d4c5b1426467","resolution":{"observed_at":"2026-08-06T18:00:20.682062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T17:03:55.285023Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12008","last_updated":"2025-07-16T08:05:22Z","snapshot_observed_at":"2026-08-06T16:53:43.695181Z","submitted_at":"2025-07-16T08:05:22Z","title":"Dual form Complementary Masking for Domain-Adaptive Image Segmentation","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:55.285023Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.12008"},"observation_digest":"sha256:6fea71be087772199f5351f76934a295b12654831aa6c09c19c06e3a0de342dd","observation_id":"b5f172c2-11a4-469e-8897-8f749aaa31be","resolution":{"observed_at":"2026-08-06T17:03:55.285023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T17:04:39.217991Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12022","last_updated":"2025-07-16T08:30:30Z","snapshot_observed_at":"2026-08-07T08:55:41.093557Z","submitted_at":"2025-07-16T08:30:30Z","title":"Dataset Ownership Verification for Pre-trained Masked Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:04:39.217991Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.12022"},"observation_digest":"sha256:04168154359fcca0d40eb0a11b8ee2e15eaaf39963245c53aebb95cec054a86c","observation_id":"3d868fd9-cbeb-472e-910b-024626d660ab","resolution":{"observed_at":"2026-08-06T17:04:39.217991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T16:24:48.897644Z","title":"ibot: Image bert pre-training with online tokenizer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.13637","last_updated":"2026-06-24T08:13:26Z","snapshot_observed_at":"2026-08-06T16:17:15.115021Z","submitted_at":"2025-07-18T03:50:29Z","title":"Towards channel foundation models (CFMs): Motivations, methodologies and opportunities","version":4},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T16:24:48.897644Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.13637"},"observation_digest":"sha256:dc8bbe2b92d46979b7c927e2d898fc86962d37dd8e312e3b8bb6176fe6f1dde4","observation_id":"de6a2160-fa80-4b31-aff7-b8b1aacfaaca","resolution":{"observed_at":"2026-08-06T16:24:48.897644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T15:44:53.606732Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15216","last_updated":"2025-07-21T03:36:58Z","snapshot_observed_at":"2026-08-06T15:35:49.818397Z","submitted_at":"2025-07-21T03:36:58Z","title":"Improving Joint Embedding Predictive Architecture with Diffusion Noise","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:44:53.606732Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.15216"},"observation_digest":"sha256:843a2834fe52a238ba4733452731011198e956fa99a9c669dc670293ef00afcd","observation_id":"1c410d63-ba17-413d-99ee-64c11bd99a5f","resolution":{"observed_at":"2026-08-06T15:44:53.606732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T15:16:23.855868Z","title":", author Wei, C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16360","last_updated":"2025-07-22T08:48:45Z","snapshot_observed_at":"2026-08-06T15:09:09.572076Z","submitted_at":"2025-07-22T08:48:45Z","title":"A High Magnifications Histopathology Image Dataset for Oral Squamous Cell Carcinoma Diagnosis and Prognosis","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T15:16:23.855868Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.16360"},"observation_digest":"sha256:d61eed3cd2f1ffce52b269b859262d8907d4d307b466be90eb632ce847dc3932","observation_id":"1f2e605d-458d-4e8e-8d84-98c4a9049700","resolution":{"observed_at":"2026-08-06T15:16:23.855868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T14:55:57.376907Z","title":"arXiv preprint arXiv:2111.07832 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17239","last_updated":"2025-07-23T06:15:54Z","snapshot_observed_at":"2026-08-06T14:51:12.421120Z","submitted_at":"2025-07-23T06:15:54Z","title":"MaskedCLIP: Bridging the Masked and CLIP Space for Semi-Supervised Medical Vision-Language Pre-training","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:55:57.376907Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.17239"},"observation_digest":"sha256:e4f870755b943311e9e909eb12d8979f8c0382341a7dbabdda3e01814b5e50ad","observation_id":"09ec3bc2-5624-4b3a-b682-c4672ae19fcd","resolution":{"observed_at":"2026-08-06T14:55:57.376907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T14:13:58.379754Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.19773","last_updated":"2025-07-26T03:48:12Z","snapshot_observed_at":"2026-08-06T14:13:50.014323Z","submitted_at":"2025-07-26T03:48:12Z","title":"Self-Guided Masked Autoencoder","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T14:13:58.379754Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.19773"},"observation_digest":"sha256:0802116faa63530af3871e489e1f4c582ae1a3e504d33122a908576e6eabd1fc","observation_id":"cad74e73-8733-43da-80ef-41a7249a38f1","resolution":{"observed_at":"2026-08-06T14:13:58.379754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T12:02:57.486367Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.22194","last_updated":"2025-07-29T19:41:37Z","snapshot_observed_at":"2026-08-06T12:02:56.365040Z","submitted_at":"2025-07-29T19:41:37Z","title":"Temporally Consistent Unsupervised Segmentation for Mobile Robot Perception","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T12:02:57.486367Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2507.22194"},"observation_digest":"sha256:f9d9275b52accdf263b189d77efe391fab956f26c83d235973d05d6692f44ce7","observation_id":"3da0ee0a-b4e7-40db-9819-e43bf7eec16e","resolution":{"observed_at":"2026-08-06T12:02:57.486367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T23:57:25.203262Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05505","last_updated":"2025-08-07T15:37:26Z","snapshot_observed_at":"2026-08-05T23:38:23.113758Z","submitted_at":"2025-08-07T15:37:26Z","title":"Symmetry Understanding of 3D Shapes via Chirality Disentanglement","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T23:57:25.203262Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2508.05505"},"observation_digest":"sha256:36ac1691dfd8b9e4be031c05645cabcae32cce1498fef98500950506654359de","observation_id":"fa43b392-30dd-4919-9c32-0a414fb1d00c","resolution":{"observed_at":"2026-08-05T23:57:25.203262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T20:48:43.615674Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09909","last_updated":"2025-08-13T16:05:50Z","snapshot_observed_at":"2026-08-05T20:48:35.913813Z","submitted_at":"2025-08-13T16:05:50Z","title":"SHREC'25 Track on Multiple Relief Patterns: Report and Analysis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T20:48:43.615674Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2508.09909"},"observation_digest":"sha256:a7a219ec425d3b6bf0db12e1eb68614581322d240c0fc5ef7cd3721208f7f973","observation_id":"32f6f5f7-b074-4b3f-ae41-ee35c4e3bad1","resolution":{"observed_at":"2026-08-05T20:48:43.615674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T17:45:06.636212Z","title":"ibot: Image bert pre-training with online tokenizer.arXiv preprint arXiv:2111.07832, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.15904","last_updated":"2025-08-21T18:04:41Z","snapshot_observed_at":"2026-08-05T17:44:58.679543Z","submitted_at":"2025-08-21T18:04:41Z","title":"Boosting Pathology Foundation Models via Few-shot Prompt-tuning for Rare Cancer Subtyping","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T17:45:06.636212Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2508.15904"},"observation_digest":"sha256:fded2b781454b483d4e08b63db4211bf9eccc51cac1d17469b35e6ad339d494b","observation_id":"e9a2fd5a-f921-4e50-abd7-acda6cd3b85b","resolution":{"observed_at":"2026-08-05T17:45:06.636212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T16:57:03.304771Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17524","last_updated":"2025-08-24T21:11:28Z","snapshot_observed_at":"2026-08-05T16:56:58.995114Z","submitted_at":"2025-08-24T21:11:28Z","title":"OmniMRI: A Unified Vision--Language Foundation Model for Generalist MRI Interpretation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T16:57:03.304771Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2508.17524"},"observation_digest":"sha256:4eb0b07f5187e33841b40794302b69c0ff4092dfd59a6bca7a97d9826c65538e","observation_id":"d85145f5-9b96-49d4-9448-fbeee2490e23","resolution":{"observed_at":"2026-08-05T16:57:03.304771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T12:47:49.379487Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01250","last_updated":"2025-09-01T08:42:17Z","snapshot_observed_at":"2026-08-05T12:47:48.308760Z","submitted_at":"2025-09-01T08:42:17Z","title":"Towards More Diverse and Challenging Pre-training for Point Cloud Learning: Self-Supervised Cross Reconstruction with Decoupled Views","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T12:47:49.379487Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2509.01250"},"observation_digest":"sha256:43a52d6e0ff62056b1a1341af4f9663772625e753eb4be25a20ae88e0648aaa7","observation_id":"e8b11c97-ea03-4233-86cd-b52c8e97b06f","resolution":{"observed_at":"2026-08-05T12:47:49.379487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-04T23:33:57.655073Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.06516","last_updated":"2025-09-14T12:44:02Z","snapshot_observed_at":"2026-08-05T18:51:31.273454Z","submitted_at":"2025-09-08T10:20:56Z","title":"QualityFM: a Multimodal Physiological Signal Foundation Model with Self-Distillation for Signal Quality Challenges in Critically Ill Patients","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T23:33:57.655073Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2509.06516"},"observation_digest":"sha256:c683d55f20ab3da3cb6484cdcf321bbbaf9028e069abf775660f567ea02f6837","observation_id":"666e756c-3208-4eb1-bb2a-4488fc2006fc","resolution":{"observed_at":"2026-08-04T23:33:57.655073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-04T22:55:16.994267Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.06907","last_updated":"2025-09-08T17:23:28Z","snapshot_observed_at":"2026-08-04T22:55:13.201377Z","submitted_at":"2025-09-08T17:23:28Z","title":"FoMo4Wheat: Toward reliable crop vision foundation models with globally curated data","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T22:55:16.994267Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2509.06907"},"observation_digest":"sha256:b25c7294707a05fa517a2600f42a5b94450bfcf0956fc527065556b5ff15f4b7","observation_id":"bea32e29-bf01-4422-b066-dbf264571ea9","resolution":{"observed_at":"2026-08-04T22:55:16.994267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2509.09530","last_updated":"2026-04-17T13:31:48Z","snapshot_observed_at":"2026-07-06T22:28:48.082201Z","submitted_at":"2025-09-11T15:13:02Z","title":"DualTrack: Sensorless 3D Ultrasound needs Local and Global Context","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T17:49:03.734959Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2509.09530"},"observation_digest":"sha256:ae6dc387733c084362a8ac5ad56815669ff0f5fe08afa02fe56205041c24171c","observation_id":"3d91b3ca-3525-4f60-bb54-d1b6e2a3417a","resolution":{"observed_at":"2026-05-18T17:51:42.035821Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-04T18:55:35.682352Z","title":"ibot: Image bert pre-training with online tokenizer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09572","last_updated":"2025-09-11T16:08:43Z","snapshot_observed_at":"2026-08-04T18:55:35.035693Z","submitted_at":"2025-09-11T16:08:43Z","title":"PeftCD: Leveraging Vision Foundation Models with Parameter-Efficient Fine-Tuning for Remote Sensing Change Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T18:55:35.682352Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2509.09572"},"observation_digest":"sha256:f1794248af7e61fe0fb6d05f680b60c76e3c2a44b4abc928c38b43d7aad49515","observation_id":"dbbfab78-18fc-4ece-998f-dd4b5f8a4b2b","resolution":{"observed_at":"2026-08-04T18:55:35.682352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2509.15642","last_updated":"2026-05-13T09:44:42Z","snapshot_observed_at":"2026-08-03T10:00:41.657277Z","submitted_at":"2025-09-19T06:07:53Z","title":"UNIV: Unified Foundation Model for Infrared and Visible Modalities","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-18T16:28:48.494939Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2509.15642"},"observation_digest":"sha256:1791b20d0c4f222225a4202438a4addf73f7a98ae947e844f383c7e81dfb0b46","observation_id":"fb6eea95-5fe6-4981-b522-70b61f53c47b","resolution":{"observed_at":"2026-05-18T16:31:37.175410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-03T22:16:16.821190Z","title":"ibot: Image bert pre-training with online tokenizer.arXiv preprint arXiv:2111.07832,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.11270","last_updated":"2026-06-30T13:53:11Z","snapshot_observed_at":"2026-08-07T08:30:47.200374Z","submitted_at":"2025-11-14T13:05:10Z","title":"{\\Phi}eat: Physically Grounded Material Feature Representation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T22:16:16.821190Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2511.11270"},"observation_digest":"sha256:b5508d009ebd03e108fc0894a0f96ebef16915a783d86d46ff74065fcaa8e6f1","observation_id":"e90c9954-0f70-4f11-96ec-c237a06dd746","resolution":{"observed_at":"2026-08-03T22:16:16.821190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2511.22958","last_updated":"2026-04-28T19:14:29Z","snapshot_observed_at":"2026-07-06T22:37:12.421372Z","submitted_at":"2025-11-28T08:03:46Z","title":"Contrastive Heliophysical Image Pretraining for Solar Dynamics Observatory Records","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-17T04:17:57.951707Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2511.22958"},"observation_digest":"sha256:a72a0c403c94cfea79f424f81ca746869e1be94c51adf0e5a72bb17d089ccec9","observation_id":"4a488521-3817-4be9-b556-11ec25fcbff7","resolution":{"observed_at":"2026-05-17T04:19:00.355875Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-03T04:59:13.942090Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-06T01:28:51.088554Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:13.942090Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:ceef90be69fe6589c1181cfa1b9e77de93b0b1175854b276c10105d733089610","observation_id":"11d18450-eeb7-44e5-ba5c-0fd587b4f2d6","resolution":{"observed_at":"2026-08-03T04:59:13.942090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2602.07940","last_updated":"2026-05-11T10:23:54Z","snapshot_observed_at":"2026-08-06T02:36:14.785124Z","submitted_at":"2026-02-08T12:15:35Z","title":"MePo: Meta Post-Refinement for Rehearsal-Free General Continual Learning","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T06:20:18.021294Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2602.07940"},"observation_digest":"sha256:50a26b7342e7e0492409c26bf5807753b5e080dbf2c6c25e0fb13b9b49a25bf6","observation_id":"407e85f1-3bfc-449e-b71b-eec65e28a9d5","resolution":{"observed_at":"2026-05-16T06:20:40.914953Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-04T05:54:41.580242Z","title":"arXiv preprint arXiv:2111.07832 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.10648","last_updated":"2026-08-03T11:12:58Z","snapshot_observed_at":"2026-08-06T23:30:44.658782Z","submitted_at":"2026-03-11T11:09:16Z","title":"Less is More: Compact-Token Masked Feature Prediction for Skeleton Representation Learning","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T05:54:41.580242Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2603.10648"},"observation_digest":"sha256:9b4566336371ca11ff4d0f8db3554c38fd1384a32156ac132537485e6c1cd1d1","observation_id":"29b779e8-6344-415c-ae21-57024ec7644a","resolution":{"observed_at":"2026-08-04T05:54:41.580242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2603.22570","last_updated":"2026-05-16T19:21:49Z","snapshot_observed_at":"2026-08-02T22:04:13.851745Z","submitted_at":"2026-03-23T21:05:21Z","title":"CanViT: Toward Active-Vision Foundation Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-21T10:33:29.023955Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2603.22570"},"observation_digest":"sha256:3c8aca362a6d5b456accc6cf325c687a4d2512d643df8b38e893e8fbee8063f2","observation_id":"00ba1f73-13d2-461f-b443-2a7fec04d02b","resolution":{"observed_at":"2026-05-21T10:34:07.189268Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-07-13T17:15:51.142086Z","title":"arXiv preprint arXiv:2111.07832 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27048","last_updated":"2026-06-22T15:38:22Z","snapshot_observed_at":"2026-07-13T17:15:48.953605Z","submitted_at":"2026-03-27T23:33:33Z","title":"MOOZY: A Patient-First Foundation Model for Computational Pathology","version":3},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-07-13T17:15:51.142086Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2603.27048"},"observation_digest":"sha256:9363cd4eb6c17559561402495a42f7aaeca6d08cdade0cfb9522806bac392fd8","observation_id":"b8c45814-4d22-41be-a4b9-bc10a2098188","resolution":{"observed_at":"2026-07-13T17:15:51.142086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-02T17:16:49.979292Z","title":"ibot: Image bert pre-training with online tokenizer.arXiv preprint arXiv:2111.07832,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.27519","last_updated":"2026-07-29T04:05:35Z","snapshot_observed_at":"2026-08-02T21:40:50.954372Z","submitted_at":"2026-03-29T04:55:52Z","title":"SPROUT: A Scalable Diffusion Foundation Model for Agricultural Vision","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T17:16:49.979292Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2603.27519"},"observation_digest":"sha256:098957fe4dbf366bf33f66b5dd75d6b3dc29c0ee0c229cde78a9acde4ab54e66","observation_id":"239b8038-ec07-4a04-aac0-272b5f165e99","resolution":{"observed_at":"2026-08-02T17:16:49.979292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.02509","last_updated":"2026-04-02T21:07:17Z","snapshot_observed_at":"2026-08-02T19:41:06.034769Z","submitted_at":"2026-04-02T21:07:17Z","title":"Rapidly deploying on-device eye tracking by distilling visual foundation models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T21:38:55.454229Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.02509"},"observation_digest":"sha256:e0b8f6801423bfcb2556817b573e5dee4d137018d400f084c9bc1ffb9c024c02","observation_id":"10896cfe-f83b-489d-b78a-050c07167f74","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.02627","last_updated":"2026-04-03T01:35:52Z","snapshot_observed_at":"2026-08-02T10:28:58.964874Z","submitted_at":"2026-04-03T01:35:52Z","title":"Smart Transfer: Leveraging Vision Foundation Model for Rapid Building Damage Mapping with Post-Earthquake VHR Imagery","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T19:59:38.334025Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.02627"},"observation_digest":"sha256:fd957774f23c3221d0cd8bcbef559a8f5129342e4d64c2447537d086d2155841","observation_id":"a29390fb-d794-4094-a258-eaf96ecd8959","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.07340","last_updated":"2026-04-08T17:53:52Z","snapshot_observed_at":"2026-08-02T15:43:17.100110Z","submitted_at":"2026-04-08T17:53:52Z","title":"TC-AE: Unlocking Token Capacity for Deep Compression Autoencoders","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:14.636654Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.07340"},"observation_digest":"sha256:015ec34d0830329f16b04db0ce6a95f0fdc2caa5fed8704f0deb34793a7a347e","observation_id":"f13400c4-50a1-4d64-9e7a-25c1da3a35c8","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.08147","last_updated":"2026-04-09T12:08:40Z","snapshot_observed_at":"2026-07-06T22:57:18.202215Z","submitted_at":"2026-04-09T12:08:40Z","title":"Semantic Noise Reduction via Teacher-Guided Dual-Path Audio-Visual Representation Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T17:46:43.584943Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.08147"},"observation_digest":"sha256:4f63a0ebd81bfd21e1dc100c6324ee3e51cf3eed75aed2c49038484da14b0199","observation_id":"3dc504b1-db63-4752-9b5f-bdfdfcef5b0a","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.08461","last_updated":"2026-04-09T16:57:11Z","snapshot_observed_at":"2026-08-01T02:05:37.324082Z","submitted_at":"2026-04-09T16:57:11Z","title":"OVS-DINO: Open-Vocabulary Segmentation via Structure-Aligned SAM-DINO with Language Guidance","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T17:04:52.871199Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.08461"},"observation_digest":"sha256:47a4d3b1ee37e31ebb4b44c8af99257e4f1e6fa0b8471d0ff3b424a847446b96","observation_id":"0796f272-2e37-4858-8127-3d4111958963","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.10609","last_updated":"2026-04-12T12:29:39Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T12:29:39Z","title":"Self-supervised Pretraining of Cell Segmentation Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T15:03:57.041938Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.10609"},"observation_digest":"sha256:08f02beb54c7f914f1720e3d4197ea6a26544c13677cce0d793f1b4b6fd20e35","observation_id":"86aa29ff-3829-4ec6-bcde-273104e81eea","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.10737","last_updated":"2026-04-12T17:17:54Z","snapshot_observed_at":"2026-07-31T16:24:32.108361Z","submitted_at":"2026-04-12T17:17:54Z","title":"Generative Data-engine Foundation Model for Universal Few-shot 2D Vascular Image Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:42:33.457946Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.10737"},"observation_digest":"sha256:7e47fe0dffb946bb17d84b5a30eaf405967992e99a51e58b3361d0ae8fe98c0c","observation_id":"97b8be4a-8486-41b4-bbd8-2d3bf7ad2135","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.11679","last_updated":"2026-05-22T07:14:18Z","snapshot_observed_at":"2026-07-06T23:00:03.762376Z","submitted_at":"2026-04-13T16:23:46Z","title":"Towards Brain MRI Foundation Models for the Clinic: Findings from the FOMO25 Challenge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T16:46:00.483336Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.11679"},"observation_digest":"sha256:41fba8a42c2f3958668228334e64bb6d0bdfbdd3b492c3d78fbde6f42f34b9eb","observation_id":"d316c8b3-6b13-46ee-a84e-0a19cb3ebd45","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.11679","last_updated":"2026-05-22T07:14:18Z","snapshot_observed_at":"2026-07-06T23:00:03.762376Z","submitted_at":"2026-04-13T16:23:46Z","title":"Towards Brain MRI Foundation Models for the Clinic: Findings from the FOMO25 Challenge","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-25T06:29:51.287422Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.11679"},"observation_digest":"sha256:3c7442d54423da53ce388fed9e6ef4870e96f6f4dcef66a0f51f858fb287d9f4","observation_id":"10a64009-3f7a-4795-ace1-2359f69d9086","resolution":{"observed_at":"2026-05-25T06:30:24.363490Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.15893","last_updated":"2026-04-17T09:45:04Z","snapshot_observed_at":"2026-07-06T23:03:21.422544Z","submitted_at":"2026-04-17T09:45:04Z","title":"PolarMAE: Efficient Fetal Ultrasound Pre-training via Semantic Screening and Polar-Guided Masking","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T09:03:03.727024Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.15893"},"observation_digest":"sha256:fb0fc693b5da649e1a30ce9d74ed8d33f584a4755854ea5716c0d054dbdc2907","observation_id":"6a99a994-0c8d-4f7a-9876-fa09b794c0b7","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.16726","last_updated":"2026-04-17T22:01:38Z","snapshot_observed_at":"2026-07-06T23:04:01.558812Z","submitted_at":"2026-04-17T22:01:38Z","title":"iDocV2: Leveraging Self-Supervision and Open-Set Detection for Improving Pattern Spotting in Historical Documents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T08:32:16.630181Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.16726"},"observation_digest":"sha256:515d07041c9cdc71d5470eeb6029957ea694701a79066caf68306257b338d4fa","observation_id":"4a8c9676-3312-4ef6-9e97-51dd47e26a30","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.17876","last_updated":"2026-04-20T06:38:01Z","snapshot_observed_at":"2026-07-06T23:04:50.935335Z","submitted_at":"2026-04-20T06:38:01Z","title":"OFlow: Injecting Object-Aware Temporal Flow Matching for Robust Robotic Manipulation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T04:50:33.134927Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.17876"},"observation_digest":"sha256:dd63931281a793341f066f2a95fb7e9b93d15a5f6c5f4c38c522190af4500a3c","observation_id":"68280412-3085-42b3-8a1f-d45ff79a5db0","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.20329","last_updated":"2026-06-03T18:02:24Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T08:23:48Z","title":"Image Generators are Generalist Vision Learners","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T01:14:05.034951Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.20329"},"observation_digest":"sha256:308f834f3ba5a376d5a2982c6226d31fbf64224a949293d3444270542b2e950d","observation_id":"e35b3d82-3dab-4bec-a84f-8931f89ffab6","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.20329","last_updated":"2026-06-03T18:02:24Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T08:23:48Z","title":"Image Generators are Generalist Vision Learners","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T07:40:46.090808Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.20329"},"observation_digest":"sha256:0c78de33f0a9cd5f00cd12952a2f34906d0ec63f852b2a318cede5f1161786cf","observation_id":"446b56a7-7dc7-4340-ae0f-56018c52fde6","resolution":{"observed_at":"2026-05-15T07:45:14.761375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.21502","last_updated":"2026-05-22T15:42:19Z","snapshot_observed_at":"2026-08-04T02:10:59.871292Z","submitted_at":"2026-04-23T10:04:36Z","title":"VFM$^{4}$SDG: Unveiling the Power of VFMs for Single-Domain Generalized Object Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-09T21:38:15.877684Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.21502"},"observation_digest":"sha256:c277b2c26f37000c683365afe4594ad328ed70e355381a44a5bf2fef021382e3","observation_id":"fe5a3d89-69f0-4d9a-bdf0-08a90f9ef485","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.21502","last_updated":"2026-05-22T15:42:19Z","snapshot_observed_at":"2026-08-04T02:10:59.871292Z","submitted_at":"2026-04-23T10:04:36Z","title":"VFM$^{4}$SDG: Unveiling the Power of VFMs for Single-Domain Generalized Object Detection","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-25T06:03:56.040612Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.21502"},"observation_digest":"sha256:fe83e915d93c623942a63a0184c228521185178fb401729ae23c0ecc5f0b23a7","observation_id":"1c12af70-34b7-442f-ba65-221220676c84","resolution":{"observed_at":"2026-05-25T06:05:26.260072Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.21681","last_updated":"2026-04-23T13:45:32Z","snapshot_observed_at":"2026-08-01T17:21:19.902700Z","submitted_at":"2026-04-23T13:45:32Z","title":"Sapiens2","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-09T21:59:43.755956Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.21681"},"observation_digest":"sha256:3dc19c927a0276d18456567d4ee8ea1edbb4cba816098d83077cae4a9c69ff2e","observation_id":"3038a04a-c3d5-4383-8c47-44ba34a4829f","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.23166","last_updated":"2026-04-25T06:37:51Z","snapshot_observed_at":"2026-08-02T13:34:58.125174Z","submitted_at":"2026-04-25T06:37:51Z","title":"A satellite foundation model for improved wealth monitoring","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T07:16:34.701718Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.23166"},"observation_digest":"sha256:02efe66362ce02a3ff8dc04b92e622de92180da2621343a88cbd41eb37a0a049","observation_id":"6b2d9af9-6f20-497e-9059-6d6111228d5f","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2604.27277","last_updated":"2026-06-11T15:15:37Z","snapshot_observed_at":"2026-07-06T23:12:47.745700Z","submitted_at":"2026-04-30T00:21:36Z","title":"BrainDINO: A Brain MRI Foundation Model for Generalizable Clinical Representation Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-07T08:49:23.121038Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2604.27277"},"observation_digest":"sha256:620982e4ff3fbe84dab80fbbd0a2715c5d2c8efad2a5d1b6912e6d951720b5eb","observation_id":"d8957ced-7af9-4abe-8775-2d462ec3920d","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.07915","last_updated":"2026-05-08T15:52:51Z","snapshot_observed_at":"2026-08-02T05:37:32.685801Z","submitted_at":"2026-05-08T15:52:51Z","title":"What Matters for Diffusion-Friendly Latent Manifold? Prior-Aligned Autoencoders for Latent Diffusion","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-05-11T01:57:24.033068Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.07915"},"observation_digest":"sha256:e9ef155f70b58a57b2d503de45be2bd6017c91e5842b5ad4da4e8548e3b6895a","observation_id":"4ee0b8bc-fd67-4534-87e5-9634cb50c4df","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.08276","last_updated":"2026-05-08T04:34:56Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T04:34:56Z","title":"Beyond ViT Tokens: Masked-Diffusion Pretrained Convolutional Pathology Foundation Model for Cell-Level Dense Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T00:58:28.390860Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.08276"},"observation_digest":"sha256:bdb8c18edf44b255c13bc83cc6c1696a1c8bc14ccbdd13607f9facd70e4f7767","observation_id":"652dab2b-3048-46ba-b6d2-3a579d3a5b86","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.12449","last_updated":"2026-05-12T17:40:38Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:40:38Z","title":"LychSim: A Controllable and Interactive Simulation Framework for Vision Research","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-13T06:26:14.825783Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.12449"},"observation_digest":"sha256:4a9f9fd7c74a569340193870a6dc9d9568567605745e1b67fe020c7277e4e1d5","observation_id":"480c336d-0c09-4075-8c35-00096f97f5d2","resolution":{"observed_at":"2026-05-14T02:10:27.691909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.19622","last_updated":"2026-05-19T10:00:14Z","snapshot_observed_at":"2026-07-06T23:30:21.283826Z","submitted_at":"2026-05-19T10:00:14Z","title":"UniRefiner: Teaching Pre-trained ViTs to Self-Dispose Dross via Contrastive Register","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T06:48:00.733211Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.19622"},"observation_digest":"sha256:e2e327245f550fa4f0b148004520500c18f0db36afd6ecc2560699b11df6ed85","observation_id":"a1621965-da22-486c-a80b-5853a0d182a9","resolution":{"observed_at":"2026-05-20T06:48:05.621539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.21906","last_updated":"2026-05-22T02:24:20Z","snapshot_observed_at":"2026-08-01T00:47:22.134393Z","submitted_at":"2026-05-21T02:28:05Z","title":"Universal CT Representations from Anatomy to Disease Phenotype through Agglomerative Pretraining","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T07:50:44.946594Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.21906"},"observation_digest":"sha256:1f7180f13dbe8d2ca8bccc682e7d9a6d3b9591df35a6c8fe1578e5892907cb49","observation_id":"c7d29dc8-6ed8-46b3-a090-b01f78e92129","resolution":{"observed_at":"2026-05-22T07:51:15.576029Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.21906","last_updated":"2026-05-22T02:24:20Z","snapshot_observed_at":"2026-08-01T00:47:22.134393Z","submitted_at":"2026-05-21T02:28:05Z","title":"Universal CT Representations from Anatomy to Disease Phenotype through Agglomerative Pretraining","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T06:16:48.755086Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.21906"},"observation_digest":"sha256:6c67286435f31a1c3c5a23b54ff58a8fbe49779f3be88ab849cbafce577cc9be","observation_id":"34a1d225-25a5-43d2-a016-95510a46e162","resolution":{"observed_at":"2026-05-25T06:20:24.441028Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.25012","last_updated":"2026-05-24T11:32:30Z","snapshot_observed_at":"2026-08-07T07:42:15.092770Z","submitted_at":"2026-05-24T11:32:30Z","title":"Learning from Semantic Dictionaries: Discriminative Codebook Contrastive Learning for Unified Visual Representation and Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-30T12:28:33.099835Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.25012"},"observation_digest":"sha256:5cbdff85976689a4934b07265c4f8106a127f7d9bc25e5176353b9f36cb712c5","observation_id":"3e382abb-a317-494d-ba23-dbc81f2f59ec","resolution":{"observed_at":"2026-06-30T12:34:38.775097Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.26026","last_updated":"2026-05-25T16:50:58Z","snapshot_observed_at":"2026-07-06T23:35:55.988443Z","submitted_at":"2026-05-25T16:50:58Z","title":"A Multimodal 3D Foundation Model for Light Sheet Fluorescence Microscopy Enables Few-Shot Segmentation, Classification, and Deblurring","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T23:00:19.051113Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.26026"},"observation_digest":"sha256:35be16c6063ccb1e93240a075ee2378bd18cf820d770950a1257d0f3e29c1cf3","observation_id":"d3ecd436-77fa-4a20-a6f5-e75eeeafac34","resolution":{"observed_at":"2026-06-29T23:04:01.078897Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.26460","last_updated":"2026-05-26T02:17:29Z","snapshot_observed_at":"2026-07-06T23:36:20.072253Z","submitted_at":"2026-05-26T02:17:29Z","title":"AnchorDiff: Training-Free Concept Grounding for MM-DiTs via Anchor-Based Graph Propagation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T18:48:47.286752Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.26460"},"observation_digest":"sha256:21767f02ad03aa24d50ac908e49c2cba99483d3239b5c412db55efcadaf881ba","observation_id":"05fca233-a413-4a1e-92da-c7db66a4c1ff","resolution":{"observed_at":"2026-06-29T18:53:51.477917Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.27893","last_updated":"2026-05-27T03:17:46Z","snapshot_observed_at":"2026-07-06T23:37:31.844094Z","submitted_at":"2026-05-27T03:17:46Z","title":"SIGMA: Bridging Structural and Distributional Gaps for Vision Foundation Model Adaptation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-29T13:44:13.305038Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.27893"},"observation_digest":"sha256:7e10d1e9945adf18b9d75a28a47584287a2000d3bcbce60d56e7d3c85234c781","observation_id":"d7257b77-ad33-4307-bbe5-e4c81abc805a","resolution":{"observed_at":"2026-06-29T13:53:28.967206Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.29691","last_updated":"2026-07-02T11:32:18Z","snapshot_observed_at":"2026-07-06T23:39:05.858969Z","submitted_at":"2026-05-28T09:52:52Z","title":"Unsupervised Semantic Segmentation Facilitates Model Understanding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T08:37:02.350175Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.29691"},"observation_digest":"sha256:0dc1f60e5e67515a7152e3f026ed7895a66fea371df0b81911fbc4d5fafaa70f","observation_id":"f6bfdb0b-1579-4b91-bbaa-43c9cf730f43","resolution":{"observed_at":"2026-06-29T08:43:15.478378Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.29691","last_updated":"2026-07-02T11:32:18Z","snapshot_observed_at":"2026-07-06T23:39:05.858969Z","submitted_at":"2026-05-28T09:52:52Z","title":"Unsupervised Semantic Segmentation Facilitates Model Understanding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-04T00:34:21.224797Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.29691"},"observation_digest":"sha256:94827c5abe424716e7449cc7c7a4e99be575df1030d9633943604115fbff43a6","observation_id":"c66245ad-73fc-42ae-affd-cc0d42ab8163","resolution":{"observed_at":"2026-07-04T00:39:16.424508Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2605.29980","last_updated":"2026-05-28T14:17:31Z","snapshot_observed_at":"2026-08-03T10:41:56.122371Z","submitted_at":"2026-05-28T14:17:31Z","title":"Genetically Aligned Patient Representations Improve Hematological Diagnosis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T08:21:41.320779Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2605.29980"},"observation_digest":"sha256:f065297003253b4ca4689e8c1eb5e28232323643691ad3031b4a60a050b04226","observation_id":"cc70a7a6-0936-4bc3-b66f-d39897c56fd7","resolution":{"observed_at":"2026-06-29T08:23:14.911395Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2606.03508","last_updated":"2026-06-02T11:26:07Z","snapshot_observed_at":"2026-07-06T23:43:46.458792Z","submitted_at":"2026-06-02T11:26:07Z","title":"Structure-Guided Mixed Masked Pretraining and Spatial Continuity Regularization for Printed Circuit Board Defect Detection","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:16.668107Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2606.03508"},"observation_digest":"sha256:0c72dff4690e45e3768d7877cc307f262c8796e1492bd4123d7caf223496bd51","observation_id":"411d3914-150c-4dac-a446-a184de044705","resolution":{"observed_at":"2026-07-02T03:06:30.179171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2606.03976","last_updated":"2026-06-02T17:56:24Z","snapshot_observed_at":"2026-08-06T11:51:16.540999Z","submitted_at":"2026-06-02T17:56:24Z","title":"Formalizing the Binding Problem","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-06-28T10:21:50.279366Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2606.03976"},"observation_digest":"sha256:849e4b693a042f5cfa30b00455a7cb1add8a343587ff0381e701fbbe893ccbbc","observation_id":"b0729988-793f-46b4-9504-cb77d9eb6c74","resolution":{"observed_at":"2026-07-02T03:06:29.823060Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":2},"reference_index":175,"source":"arxiv_source","source_observed_at":"2026-06-26T09:19:50.623741Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:36c04428710e4d12d0e4153cff2eb576d465db6043b02db003f63ec11442de82","observation_id":"55023d07-92d8-4d1c-94af-88e9428c6352","resolution":{"observed_at":"2026-07-04T09:59:44.970212Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":3},"reference_index":174,"source":"arxiv_source","source_observed_at":"2026-06-29T01:18:19.195007Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:9913bc0f12cc068ee739f4b513919951ab84a83e107643d31b78efbe40f2f4a0","observation_id":"0b307b98-1f1c-4742-ac5a-16ae890047d0","resolution":{"observed_at":"2026-07-01T18:55:59.692452Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2606.25713","last_updated":"2026-06-29T06:39:51Z","snapshot_observed_at":"2026-07-30T02:44:48.967696Z","submitted_at":"2026-06-24T11:26:38Z","title":"Frequency-Aware Self-Supervised Music Representation Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-25T19:25:54.322923Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2606.25713"},"observation_digest":"sha256:a4dc47e84068a21bcc6a545fcfd816b4642703d01a9754983ce63e7883ac65a1","observation_id":"fbfba207-3932-4943-a2e5-6c5aa6c135f9","resolution":{"observed_at":"2026-07-04T20:50:12.644457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2606.25713","last_updated":"2026-06-29T06:39:51Z","snapshot_observed_at":"2026-07-30T02:44:48.967696Z","submitted_at":"2026-06-24T11:26:38Z","title":"Frequency-Aware Self-Supervised Music Representation Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T10:04:11.233115Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2606.25713"},"observation_digest":"sha256:ce0f91fdca33506259d7ff8c7090284c29acf0da33e175a42bffcee86ed14111","observation_id":"f3f8d161-6f0b-4230-baa2-7a5b2868cc48","resolution":{"observed_at":"2026-06-30T10:04:35.632843Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2606.26398","last_updated":"2026-06-30T17:31:21Z","snapshot_observed_at":"2026-08-06T01:07:08.432058Z","submitted_at":"2026-06-24T21:31:13Z","title":"DinoLink: A Token-Centric Representation Compression Framework for Bandwidth-Constrained Collaborative V2X Perception","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T01:19:37.860746Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2606.26398"},"observation_digest":"sha256:605455cfcd3ff181ca43aaa0b9a505a130c771b08d1dcccdea4361b2a66c262f","observation_id":"b5546363-a173-41b5-9e85-53b555474ca6","resolution":{"observed_at":"2026-07-04T15:49:57.549143Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2606.26398","last_updated":"2026-06-30T17:31:21Z","snapshot_observed_at":"2026-08-06T01:07:08.432058Z","submitted_at":"2026-06-24T21:31:13Z","title":"DinoLink: A Token-Centric Representation Compression Framework for Bandwidth-Constrained Collaborative V2X Perception","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-01T06:24:11.726818Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2606.26398"},"observation_digest":"sha256:3fb74756389bc98f3cd8fd726a6c763ba1f106c95671991dcc26365a04e738a6","observation_id":"f93bee58-d436-45a6-977c-6c36696c9731","resolution":{"observed_at":"2026-07-01T09:35:40.916768Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2606.31626","last_updated":"2026-06-30T13:10:29Z","snapshot_observed_at":"2026-08-07T03:27:52.469134Z","submitted_at":"2026-06-30T13:10:29Z","title":"PrISM-IQA: Image Quality Assessment Made Practical for Smartphone Photography","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-01T06:16:54.016779Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2606.31626"},"observation_digest":"sha256:b6aaa4bb09b520275093f9d97df55e7fb0c313f0eb7df3da45861b8584be38fe","observation_id":"07269cae-bf1a-47d3-a281-3e88e82603fd","resolution":{"observed_at":"2026-07-01T09:45:39.959270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2607.00850","last_updated":"2026-07-01T12:16:36Z","snapshot_observed_at":"2026-08-04T20:03:22.546904Z","submitted_at":"2026-07-01T12:16:36Z","title":"Mirror-Fusion Attention for Reflection-Aware Self-Supervised Representation Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-02T14:28:10.184505Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.00850"},"observation_digest":"sha256:7baa156935538113d91665219af7c07fd5caaafc4eb8ad687580885232b57045","observation_id":"9a54210f-2663-4971-8861-1ff8f2c7908a","resolution":{"observed_at":"2026-07-02T14:37:03.195098Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2607.01987","last_updated":"2026-07-02T10:18:02Z","snapshot_observed_at":"2026-07-07T00:07:28.231599Z","submitted_at":"2026-07-02T10:18:02Z","title":"Understanding Geometric Representations in Self-Supervised Vision Transformers via Subspace Intervention","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-03T15:34:54.954593Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.01987"},"observation_digest":"sha256:8bd8f8455ab86056490ac0c764bc9c9bcec5e2c82e942d7fb5892b8ceb98cf91","observation_id":"e1188a85-fd8b-46cd-b7f5-f25712abe6e6","resolution":{"observed_at":"2026-07-03T15:38:33.094410Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2607.02447","last_updated":"2026-07-02T17:17:05Z","snapshot_observed_at":"2026-08-06T14:58:25.115208Z","submitted_at":"2026-07-02T17:17:05Z","title":"Understanding the Robustness of Distributed Self-Supervised Learning Frameworks Against Non-IID Data","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-03T16:29:09.303242Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.02447"},"observation_digest":"sha256:9577a933bf8ec610277bccc703b4a5f7236528185aaf076dbfaa31da13a49144","observation_id":"42823ef4-528c-4736-94fe-a0da930822a5","resolution":{"observed_at":"2026-07-03T16:38:39.826234Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":"2111.07832","doi":"10.48550/arxiv.2111.07832","metadata_source":"pith","pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","venue":"cs.CV","work_id":"ddf5ecec-b36e-4d27-96b7-5aefc236d17c","year":2021},"citing_paper":{"arxiv_id":"2607.06629","last_updated":"2026-07-09T11:36:51Z","snapshot_observed_at":"2026-08-07T01:17:33.686416Z","submitted_at":"2026-07-07T12:19:54Z","title":"STST-JEPA: Shallow-Target Spatio-Temporal Joint Embedding Prediction Architecture For EEG Self-Supervised Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T01:07:21.002787Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.06629"},"observation_digest":"sha256:aaa740036eb24e5fb6d5af265e05f5799781401e7e7bd6738f3606987b503df1","observation_id":"270106d0-8e71-43c1-8d5a-4f174f4379e0","resolution":{"observed_at":"2026-07-11T01:07:41.842281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:43.656481+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-07-14T14:38:08.037662Z","title":"& Kong, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09916","last_updated":"2026-07-10T19:07:48Z","snapshot_observed_at":"2026-07-16T23:18:05.821426Z","submitted_at":"2026-07-10T19:07:48Z","title":"Tomo-center: an AI-based rotation-axis center finder for synchrotron micro- and nano-tomography","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T14:38:08.037662Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.09916"},"observation_digest":"sha256:6c6207a9505f589ba6029302f284f3338e10a3e23b050660495be175294b4da9","observation_id":"34d5a025-be81-411f-a069-4d8298cbd5ae","resolution":{"observed_at":"2026-07-14T14:38:08.037662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-02T05:58:48.847518Z","title":"iBOT: Image BERT pre-training with online tokenizer.arXiv preprint arXiv:2111.07832, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13192","last_updated":"2026-07-14T18:45:04Z","snapshot_observed_at":"2026-08-06T10:43:13.531895Z","submitted_at":"2026-07-14T18:45:04Z","title":"Self-Supervised Visual Representation Learning: Pretrain-Finetuning or Joint Training?","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-02T05:58:48.847518Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.13192"},"observation_digest":"sha256:4040b98ba22daf837bbd534b7be203f11f83e9b66598a716453b07efa370311b","observation_id":"289fe9be-bd3d-4dc9-be26-5ecf85ed6acf","resolution":{"observed_at":"2026-08-02T05:58:48.847518Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-01T16:35:09.230173Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18361","last_updated":"2026-08-03T13:26:07Z","snapshot_observed_at":"2026-08-06T23:32:01.313190Z","submitted_at":"2026-07-20T14:01:10Z","title":"Physical Self-Supervised Learning: IMU Sensing without Manual Labels","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-01T16:35:09.230173Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.18361"},"observation_digest":"sha256:77350b9417d4565056bd608687fb133cfb213bada37b3ec23cd84d6c0953a5aa","observation_id":"494f932c-4a66-478b-be6b-12310cc82d2e","resolution":{"observed_at":"2026-08-01T16:35:09.230173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-04T04:13:43.176835Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18361","last_updated":"2026-08-03T13:26:07Z","snapshot_observed_at":"2026-08-06T23:32:01.313190Z","submitted_at":"2026-07-20T14:01:10Z","title":"Physical Self-Supervised Learning: IMU Sensing without Manual Labels","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-04T04:13:43.176835Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.18361"},"observation_digest":"sha256:c29dd17963cec6403d8ca313e42563dc1469cc8b6b1239aba2d5e23dd475c264","observation_id":"1a04b0e0-78c5-4c00-b7ba-9d92ee2f28cb","resolution":{"observed_at":"2026-08-04T04:13:43.176835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-01T07:40:23.235845Z","title":"arXiv preprint arXiv:2111.07832 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.21371","last_updated":"2026-07-23T14:37:27Z","snapshot_observed_at":"2026-08-06T13:05:38.891337Z","submitted_at":"2026-07-23T14:37:27Z","title":"DINOde: Continuous Vision-Text Alignment for Open-Vocabulary Semantic Segmentation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-01T07:40:23.235845Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.21371"},"observation_digest":"sha256:c496d5583004e7f4068a570d81fe053842fcaabe78b4c5e26ac3f034f89397c8","observation_id":"3ea9a268-e319-4b50-9b30-2124dad99346","resolution":{"observed_at":"2026-08-01T07:40:23.235845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-07-30T14:40:48.937282Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26993","last_updated":"2026-07-30T07:27:19Z","snapshot_observed_at":"2026-08-02T23:20:44.981952Z","submitted_at":"2026-07-29T14:52:25Z","title":"Foundation Models for Face Presentation Attack Detection: A Unified Linear-Probing Benchmark","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-30T14:40:48.937282Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.26993"},"observation_digest":"sha256:07f30291306317202319d1468f8c2d1c162646c00e76323bf508f6a9ba631ffb","observation_id":"2a9ca10e-d118-463d-bc20-d306596aa41e","resolution":{"observed_at":"2026-07-30T14:40:48.937282Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-01T10:23:01.499644Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.26993","last_updated":"2026-07-30T07:27:19Z","snapshot_observed_at":"2026-08-02T23:20:44.981952Z","submitted_at":"2026-07-29T14:52:25Z","title":"Foundation Models for Face Presentation Attack Detection: A Unified Linear-Probing Benchmark","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:01.499644Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2607.26993"},"observation_digest":"sha256:f31892e2d4724e297a95ca199728ba649b8c6a3e2eec34d15ec095aac691e2bd","observation_id":"59b10be3-2125-4cfe-add4-38b292f677fc","resolution":{"observed_at":"2026-08-01T10:23:01.499644Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-06T00:21:09.860336Z","title":"arXiv preprint arXiv:2111.07832 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01356","last_updated":"2026-08-02T16:19:16Z","snapshot_observed_at":"2026-08-06T23:26:18.354345Z","submitted_at":"2026-08-02T16:19:16Z","title":"Harnessing Adversarial Distillation to Customise Debiased, Disease-Specific Pathology Foundation Models for Breast Cancer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:21:09.860336Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2608.01356"},"observation_digest":"sha256:d8339e04e3c9c9615533a77208083a94915258d244e69d28183553113e1fbf2a","observation_id":"b864e253-3e15-4b29-ba0b-8b35dab9a3f5","resolution":{"observed_at":"2026-08-06T00:21:09.860336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2111.07832/citation-record","integrity":"/paper/2111.07832/integrity","json":"/paper/2111.07832/citation-record.json","paper":"/paper/2111.07832"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2103.10994","last_updated":"2022-07-12T14:25:52Z","snapshot_observed_at":"2026-07-06T10:51:35.833688Z","submitted_at":"2021-03-19T19:29:42Z","title":"Self-Supervised Classification Network","version":3},"cited_work":{"arxiv_id":"2103.10994","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.10994","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-supervised classiﬁcation network","venue":null,"work_id":"f0b10977-594c-4ab5-8f0d-d096f4f37bfa","year":null},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/2103.10994","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:a38b8ea7c4b723efc4325944e01afbb08ce38fa16eb9c8a2eea1803b2ff4ea58","observation_id":"0a6db69f-316d-4b27-b494-89d046642d67","resolution":{"observed_at":"2026-05-14T02:10:27.645124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03602","last_updated":"2022-12-26T19:42:50Z","snapshot_observed_at":"2026-07-06T10:57:34.353038Z","submitted_at":"2021-04-08T08:34:04Z","title":"SiT: Self-supervised vIsion Transformer","version":3},"cited_work":{"arxiv_id":"2104.03602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.03602","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SiT: Self-supervised vision transformer","venue":null,"work_id":"dfb6e938-6944-4a23-a4eb-bb29a3f1b178","year":2021},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/2104.03602","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:298608da5b1b2bb1ed0844cb7d149c1f467cd82bb1c6ed97828f30f6d630707a","observation_id":"dab44aef-1362-4631-98cb-7e3f6f4693dc","resolution":{"observed_at":"2026-05-14T02:10:27.640003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-07-06T11:19:34.705520Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":"2106.08254","doi":"10.48550/arxiv.2106.08254","metadata_source":"pith","pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BEiT: BERT Pre-Training of Image Transformers","venue":"cs.CV","work_id":"d74eda3c-bf7e-45f1-a8f1-a0137ecca3f4","year":2021},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:eecb66477338e05b0f179ba3cdd9006daf7f984ded3988bb1c20e6ae83c2df13","observation_id":"605ffed1-2dd2-4e68-ab44-4eee1a6a0a43","resolution":{"observed_at":"2026-05-14T02:10:27.634516Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mask R-CNN","venue":null,"work_id":"fdf1d992-c87e-49d9-bd0b-b1c5ae3e69d0","year":2022},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:f48d0c95e81f63db4a3d10a06b0158a286b10153bef76dc68bb3a9868aae4e0b","observation_id":"0599ab66-25fc-426b-8dd3-7428f4030f41","resolution":{"observed_at":"2026-05-14T02:10:27.664227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09785","last_updated":"2022-07-06T18:56:54Z","snapshot_observed_at":"2026-08-06T00:52:05.491862Z","submitted_at":"2021-06-17T19:57:33Z","title":"Efficient Self-supervised Vision Transformers for Representation Learning","version":2},"cited_work":{"arxiv_id":"2106.09785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.09785","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efﬁcient self-supervised vision transformers for representation learning","venue":null,"work_id":"e1917362-f7ab-4e00-8f21-57a21257f2d9","year":null},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/2106.09785","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:7913138a8c2f78cfb3afa977553bd33e0c3af7d797e4e177ede082c4c90fad8d","observation_id":"a20ae6eb-c455-4ef2-bc08-fd1e244be254","resolution":{"observed_at":"2026-05-14T02:10:27.595160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14030","last_updated":"2021-08-17T16:41:34Z","snapshot_observed_at":"2026-08-07T00:32:15.123562Z","submitted_at":"2021-03-25T17:59:31Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","version":2},"cited_work":{"arxiv_id":"2103.14030","doi":"10.48550/arxiv.2103.14030","metadata_source":"pith","pith_arxiv_id":"2103.14030","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows","venue":"cs.CV","work_id":"d6d2cf36-1b48-40c9-86e8-1d5666324ae1","year":2021},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/2103.14030","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:3c0b9c45f54a2aa8f1f208b527b8a96f69ee254783df1190737667245d30d47a","observation_id":"0d28db53-7b63-47f1-8eea-abde2140864a","resolution":{"observed_at":"2026-05-15T19:27:57.193556Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.10497","last_updated":"2021-11-25T18:36:22Z","snapshot_observed_at":"2026-07-06T11:11:42.215331Z","submitted_at":"2021-05-21T17:59:18Z","title":"Intriguing Properties of Vision Transformers","version":3},"cited_work":{"arxiv_id":"2105.10497","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.10497","snapshot_observed_at":"2026-07-03T21:18:58.635235Z","title":"Intriguing properties of vision transformers","venue":null,"work_id":"7c007b8e-cb8c-4f8c-bdb1-5f919b250c6c","year":2021},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/2105.10497","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:d03a1a48fd5b9abd65b1c25803813b7783a1ec247d82f618b095d31ba39be32d","observation_id":"18dbadf6-4285-48fb-8461-d83f0081ab39","resolution":{"observed_at":"2026-05-14T02:10:27.606729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11250","last_updated":"2021-06-21T16:48:19Z","snapshot_observed_at":"2026-08-06T20:27:48.357708Z","submitted_at":"2021-06-21T16:48:19Z","title":"VIMPAC: Video Pre-Training via Masked Token Prediction and Contrastive Learning","version":1},"cited_work":{"arxiv_id":"2106.11250","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.11250","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2106.11250 , year=","venue":null,"work_id":"027ef24d-32dc-4811-acb5-fbe62daaf143","year":2022},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/2106.11250","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:a81011dab03ecfa9e00190880e1bd77f6f8c4c018783f209b8b55c4ad481be18","observation_id":"2a4974bd-720c-4f37-a802-a66669be2dcf","resolution":{"observed_at":"2026-05-14T02:10:27.612571Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":"1609.08144","doi":"10.18653/v1/2021.eacl-main.163","metadata_source":"pith","pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","venue":"cs.CL","work_id":"e294e5a1-5dd2-44a0-b348-adbd62fe1916","year":2016},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:303979237db7527b96487c20e02f1ad904eac793c2fbf0d55b296fac518061e7","observation_id":"ef649c59-60be-46db-b48e-8a18f1721579","resolution":{"observed_at":"2026-05-14T02:10:27.618043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04553","last_updated":"2021-05-11T17:28:00Z","snapshot_observed_at":"2026-07-06T11:08:04.166334Z","submitted_at":"2021-05-10T17:59:45Z","title":"Self-Supervised Learning with Swin Transformers","version":2},"cited_work":{"arxiv_id":"2105.04553","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.04553","snapshot_observed_at":"2026-07-04T05:59:38.393255Z","title":"Self-supervised learning with swin transformers","venue":null,"work_id":"52c262a6-3fda-4f76-b239-69d013d2e0e4","year":2021},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/2105.04553","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:f3bcfbb6a1a6aaea9bf7eb62d2f3c5b4fcf881683778701e062270141e4703cf","observation_id":"07498bde-05d3-4cf3-9bbb-ee680aa2e17c","resolution":{"observed_at":"2026-05-14T02:10:27.623610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07954","last_updated":"2021-08-18T02:50:33Z","snapshot_observed_at":"2026-07-06T11:39:10.152464Z","submitted_at":"2021-08-18T02:50:33Z","title":"Self-Supervised Visual Representations Learning by Contrastive Mask Prediction","version":1},"cited_work":{"arxiv_id":"2108.07954","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2108.07954","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-supervised visual representations learning by contrastive mask prediction","venue":null,"work_id":"351c3876-d31a-4127-9a4a-2482c92da8fb","year":null},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"cited_paper":"/paper/2108.07954","citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:197b7bf117868ccf4ae544936c54ddc60a94fc7d8ec4ad81213bb22c5f7be07f","observation_id":"52aa06ab-4c35-4e75-8c14-ab09e9e5789e","resolution":{"observed_at":"2026-05-14T02:10:27.629457Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fb57896d-fc22-462b-9500-c2121c5d5e68","year":2022},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:217526ff5fec5e519ec16a792ce79c345152744e5da7e38dd2f6f45f3c805229","observation_id":"c697bf79-cb4e-45b5-8b10-5f922eddda8c","resolution":{"observed_at":"2026-05-14T02:10:27.667706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"𝑥!𝑥\" !𝑥!!𝑥","venue":null,"work_id":"1a65b8cd-e14c-47aa-a993-b3f80cae2435","year":2022},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:ccf0d2f71649d84acde35fb97e6d90d4c919f301f5a648c1a28b48bcbcf597b8","observation_id":"0fb1cda8-9375-4889-9744-dfaaab33b6a2","resolution":{"observed_at":"2026-05-14T02:10:27.670636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We observe the latter practice performs sightly better since it is more ﬂexible in task composition and data in a batch is mutually independent","venue":null,"work_id":"2224acc2-071e-4494-97a9-8f23e8ae78db","year":2021},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:1c051667f616a8160fb7ba4ca101e7802aa1de3568d3000bf993b71aa150b4b9","observation_id":"76a93f20-7df0-4c79-96b2-4e63cffc2172","resolution":{"observed_at":"2026-05-14T02:10:27.674170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"35164846-8fdc-4300-a3c8-bd9fcd4f0095","year":2020},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:20b5619018b0e884f809087e937b7d2cb3ad3537b925f7b955b41683bc0a4ac5","observation_id":"bd692f6a-cb9c-4b09-a62d-107774b8858b","resolution":{"observed_at":"2026-05-14T02:10:27.677771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"56db9674-772d-4fa8-ac5c-4ab8d9535f54","year":2022},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:2ac36dd5ef077e50aeba83316d6c24c819f5b36013a4ceaf0bb4bb130f01b8f4","observation_id":"842b0ef5-95f5-4a88-bf26-b253ab1246be","resolution":{"observed_at":"2026-05-14T02:10:27.680903Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"17 Published as a conference paper at ICLR 2022 0.0 0.1 0.2 0.3 0.4 0.5 0.6 0.7 0.8 0.9 1.0 Information Loss (%) 0.0 0.1 0.2 0.3 0.4 0.5 0.6 0.7 0.8 ImageNet Val Acc@1 R","venue":null,"work_id":"8fde10e6-10e0-4dde-a2ab-4d37dd0f5c1d","year":2022},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:674b4efc90aad4069d00ab7d4cccb38f657500d30a8f7077534d2b88a4723f1b","observation_id":"53b32346-0553-4cb3-b718-64ec085a8123","resolution":{"observed_at":"2026-05-14T02:10:27.684437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adding a variance upon the ﬁxed value can also consistently bring a performance gain, which can be explained as stronger data augmentation","venue":null,"work_id":"6740e58d-c20f-4e52-9d40-de02c865dc51","year":2022},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:83422acc4b38498df762594cb3418b22a30dce2f013979867de657dd19199e0c","observation_id":"79738871-3689-48ba-aeb2-dd196965c1a5","resolution":{"observed_at":"2026-05-14T02:10:27.687504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"iBOT pre-trained with 800 epochs brings a 0.9% improvement over previous state-of-the-art method","venue":null,"work_id":"65ae6353-5f45-4d30-9aa5-acb86b811c05","year":2021},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:e9cbf94bb6ff5f05669e90807a49162430daeec1491d06318beadf44405ec83b","observation_id":"0ced2795-e757-4f72-8203-be583fc91382","resolution":{"observed_at":"2026-05-14T02:10:27.690779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We ﬁnd patch clustering has slightly better performance in all three protocols compared to MPP, suggesting the beneﬁts brought by visual semantics","venue":null,"work_id":"bd726aec-09c9-49c3-b98c-976cd33e3af4","year":2021},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:cb9babc290b440183b5460c29e379fc0b0e9593604f9b7285360a9446659f2c6","observation_id":"ec90c1b0-e29b-4f5f-abb3-b5ea3c26f959","resolution":{"observed_at":"2026-05-14T02:10:27.649225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"For DINO, we directly use the projection head for [CLS] token and generate a 65536-d probability distribution for each patch token","venue":null,"work_id":"df1deefe-4e64-44a7-8991-2c240366985b","year":2020},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:499ac829434550514ea0d5be82a968b11c15426731bbfa61ef9ca59b30c7b304","observation_id":"9deb68e7-ff2d-4352-8c38-cecd36fe6b95","resolution":{"observed_at":"2026-05-14T02:10:27.653362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9174d0f3-9f91-4f48-a1b7-d736eec32e26","year":2022},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:4d6c2897220b3536b6cb7f44c94bb78b64227198471fad12d106ebb000c0b2fb","observation_id":"7ef2d59b-129a-4e32-b611-f856b8dad7ba","resolution":{"observed_at":"2026-05-14T02:10:27.656969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In the second column, iBOT can match different parts of two instances from the same class (e.g., tiles and windows of two cars) despite their huge differences in texture or color","venue":null,"work_id":"857379ec-0da5-4827-98c8-2ed7bc8e3239","year":2022},"citing_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T02:10:27.569787Z"},"links":{"citing_paper":"/paper/2111.07832"},"observation_digest":"sha256:7f73ab4a9b2dc08b3f4c553099e2944b72cfa988c105aebdb238644524eac26d","observation_id":"85e323b6-f927-4b3f-b67e-45d7e2a01614","resolution":{"observed_at":"2026-05-14T02:10:27.661017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":4,"verified_exact":8,"verified_fuzzy":9},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 88 inbound Pith citation observations for arXiv:2111.07832."}