{"as_of":"2026-08-13T02:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4b1a36d15e2118a28453d13c479b0fc0a26789852c61441286965a9b7057130","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:04:25.391939Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15746/citation-record","integrity":"/paper/2411.15746/integrity","json":"/paper/2411.15746/citation-record.json","paper":"/paper/2411.15746"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.060296Z","title":"Asano, Christian Rupprecht, and Andrea Vedaldi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.060296Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:9897b3738a9fa14f32b7d2b614aeac90e35d536959a167b6a0efd214988cd33c","observation_id":"2bccd7cc-8a6f-412d-b944-65154ae78664","resolution":{"observed_at":"2026-08-12T14:04:25.060296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.343276Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":"3f9e95bf-9878-40ac-a92c-34100529a21f","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.065171Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:d102dad9d20fcd9f645890aa9e2fc81130ba953c55b956748aea89c545a5ee8d","observation_id":"3e3efe8f-192f-4413-b5da-c9048eb83cfd","resolution":{"observed_at":"2026-08-12T14:04:26.347538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.325294Z","title":"BEit: BERT pre-training of image transformers","venue":null,"work_id":"11f44744-a77b-4b47-a8fa-6f726094d0db","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.069810Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:e7cbbdc8ee35284ffcb7bfc333cf2d4b2a251835a23787f228a0597a77691b67","observation_id":"c4106495-22bd-46a9-8f59-93c26e194aa9","resolution":{"observed_at":"2026-08-12T14:04:26.332029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.074337Z","title":"Unsupervised learn- ing of visual features by contrasting cluster assignments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.074337Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:3773d878d62a0107115d4649f1af993755b93f7f88c4046582a3255f82786fa2","observation_id":"7e9a66e3-3a6f-4d3e-bb15-687447495b88","resolution":{"observed_at":"2026-08-12T14:04:25.074337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.079390Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.079390Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:ac39751b84e8219415b42fe97b63ac8c203aa3a3d161b324d23507ccda29c6eb","observation_id":"44eb8de0-e690-4137-af4f-ead3c15ea580","resolution":{"observed_at":"2026-08-12T14:04:25.079390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.00790","last_updated":"2025-03-22T21:25:12Z","snapshot_observed_at":"2026-07-06T13:16:39.422853Z","submitted_at":"2022-06-01T22:46:34Z","title":"Efficient Self-supervised Vision Pretraining with Local Masked Reconstruction","version":3},"cited_work":{"arxiv_id":"2206.00790","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.00790","snapshot_observed_at":"2026-08-12T14:04:25.487535Z","title":"Efficient Self-supervised Vision Pretraining with Local Masked Reconstruction","venue":"cs.CV","work_id":"9163e492-87de-4a45-8eab-1fc931790641","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.084499Z"},"links":{"cited_paper":"/paper/2206.00790","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:8384b17d878abdebb92ee93f6929468da0a050a1d9b06aaed1ddaaeec9f4bc50","observation_id":"f3e9acc0-1c77-475c-8225-b1e9ba923b94","resolution":{"observed_at":"2026-08-12T14:04:25.491864Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.090265Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.090265Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:a9e4b72a615581fba42c7757560295f131c18e5d0221534398b24e89a28f4d9d","observation_id":"52dd3f71-bc1c-4bad-ab48-d073ead63718","resolution":{"observed_at":"2026-08-12T14:04:25.090265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.271817Z","title":"Exploring simple siamese rep- resentation learning","venue":null,"work_id":"dcc5dc26-32a2-446b-ab3d-a158dc3baa4a","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.095855Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:a76b0a670952e0f60411058859e32d3c2c27e6ddb991d2d26f9a0b1eb16ce7ed","observation_id":"a6d8a846-3fbf-4e45-b6c4-bf7821d0a028","resolution":{"observed_at":"2026-08-12T14:04:26.276654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.258859Z","title":"Context autoencoder for self- supervised representation learning","venue":null,"work_id":"5a344b84-c12f-4985-9173-5d08adc8b849","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.101755Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:33fd6db2bb6d44dbe723e14f1f3dc4f8de8d708f96d713857d80c9a185ae2630","observation_id":"9c47df7c-d3bb-4e64-9677-7a795859d84b","resolution":{"observed_at":"2026-08-12T14:04:26.263450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.243714Z","title":"Dalal and B","venue":null,"work_id":"d0373d52-7f15-417a-8826-988c3e40b025","year":2005},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.106527Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:f9c7d550baf0e0f30af62589a984187b012b4bceb74fb3fc3fd141efb80fca0a","observation_id":"9c1ed7c5-d8c6-4732-848d-2a78b13b7e77","resolution":{"observed_at":"2026-08-12T14:04:26.249408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.228484Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":"04ad9ed5-0e62-43f8-bc23-a9882629c3a8","year":2019},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.110594Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:c52fbf7c67db9d9bdfabcb03a4f35c4711d3db426238b3a5ac3d7b0543a9c326","observation_id":"e24ecf00-64e4-4c94-bbf3-a0b7e0647bad","resolution":{"observed_at":"2026-08-12T14:04:26.234776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.213626Z","title":null,"venue":null,"work_id":"016bd798-808f-48c9-a2ed-5ea6589c0b1b","year":2015},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.114640Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:4c4eebde81d20734b1e8d45b6c783b3fe4e8dad9d300d03c7f44c226dba3d5ec","observation_id":"d8d641b9-f394-4372-b32a-6817dac5c8d3","resolution":{"observed_at":"2026-08-12T14:04:26.218436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.193243Z","title":"Bootstrapped masked autoencoders for vision bert pretraining","venue":null,"work_id":"8057e319-f3fe-41ce-8df0-723a45f57432","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.119838Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:98c81299e14799054d564fff9aa1d7e427cb4640df0785a06461bba758251db6","observation_id":"90de3fc6-f1e2-4e96-adf2-38ea1ab5d3ac","resolution":{"observed_at":"2026-08-12T14:04:26.200563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.178113Z","title":"Peco: Perceptual codebook for bert pre-training of vision transformers","venue":null,"work_id":"cebabeb6-18a7-4bdd-8f68-679d61f92ad0","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.123842Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:e89d2d9731e552605b317761b903a188ae227e92607f0c1987e5da66a5f4fae3","observation_id":"f48001fc-ea14-48da-a36e-cdc4988c1874","resolution":{"observed_at":"2026-08-12T14:04:26.181675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.166365Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"51452c6c-96ba-42e1-843c-88ec6e7022ee","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.128233Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:bcddf2909ef2584354aa63294541da9239a7deff5916a12bd714b51ef8872e28","observation_id":"674ae8ea-eed7-4bb3-96e9-ffdeae51c13c","resolution":{"observed_at":"2026-08-12T14:04:26.169857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.155132Z","title":"With a little help from my friends: Nearest-neighbor contrastive learning of visual representations","venue":null,"work_id":"1197858e-1d3c-418f-9ae9-fc220c93d1c2","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.131947Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:7cd0676a82efe7a44e1830967f0b4f2b696b8c866d1d968098d43815ed0ab8bc","observation_id":"43d0a2e5-04de-4c66-9eab-9560b426cf6f","resolution":{"observed_at":"2026-08-12T14:04:26.159225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.136017Z","title":"Whitening for self-supervised representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.136017Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:f4c66531bba9661a27828ecb60ae89932845d147a498b716019588975d404026","observation_id":"16566af1-258d-4ede-bde8-e559fd64590d","resolution":{"observed_at":"2026-08-12T14:04:25.136017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11016","last_updated":"2022-10-20T04:49:56Z","snapshot_observed_at":"2026-08-12T01:26:48.000809Z","submitted_at":"2022-10-20T04:49:56Z","title":"Towards Sustainable Self-supervised Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11016","snapshot_observed_at":"2026-08-12T14:04:25.140960Z","title":"Towards sustainable self-supervised learn- ing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.140960Z"},"links":{"cited_paper":"/paper/2210.11016","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:98b08d7c3039eb864b72155f60d48e9b404c434c9afc2c08d81325c2e0ace8ad","observation_id":"5f91a77a-cdba-4d6e-94da-982044917bf4","resolution":{"observed_at":"2026-08-12T14:04:25.140960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.145392Z","title":"Un- supervised representation learning by predicting image rota- tions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.145392Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:ac9feaa21ae3f7b46beba83807992b4a46251a85f5bcf72eeabedf9d800fcddb","observation_id":"fcadd465-4ed8-4b68-bc9c-0abf29230c13","resolution":{"observed_at":"2026-08-12T14:04:25.145392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02677","last_updated":"2018-04-30T21:53:41Z","snapshot_observed_at":"2026-08-09T05:23:26.365677Z","submitted_at":"2017-06-08T16:51:53Z","title":"Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02677","snapshot_observed_at":"2026-08-12T14:04:25.150310Z","title":"Accurate, large mini- batch sgd: Training imagenet in 1 hour","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.150310Z"},"links":{"cited_paper":"/paper/1706.02677","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:589a1f2d4a147995691bf2549a1e38faf49d26e76428b9b2678718946d52ab80","observation_id":"617b3666-26f2-47ee-b98f-7d19622d2fd0","resolution":{"observed_at":"2026-08-12T14:04:25.150310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.128871Z","title":"Richemond, Elena Buchatskaya, Carl Doersch, Bernardo ´Avila Pires, Zhaohan Guo, Moham- mad Gheshlaghi Azar, Bilal Piot, Koray Kavukcuoglu, R´emi Munos, and Michal Valko","venue":null,"work_id":"8587b55f-7175-4c3b-8217-9d6026341202","year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.154476Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:67cf3c62948cf32d3c00658a0dfff54261dd065c8ddb139cc14d4827dc3f1d79","observation_id":"80b4f584-a28b-47d4-a434-1afe08d00001","resolution":{"observed_at":"2026-08-12T14:04:26.133073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.113608Z","title":"Mask r-cnn","venue":null,"work_id":"e9c4bf37-2b18-4e56-8d01-181d50fe1883","year":2017},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.158769Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:3ce509737a2c3a025d3d2dc074ae8cab25d78819821395b0ad48a5da939f4928","observation_id":"3ea07373-12c9-4988-9f0f-527e2328050b","resolution":{"observed_at":"2026-08-12T14:04:26.118694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.162530Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.162530Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:345665ad77937dca540a255a3c41555cb7d87adea05912eac4d0b1c526468208","observation_id":"633f1f6d-e520-48a9-822f-cf0bddbaf119","resolution":{"observed_at":"2026-08-12T14:04:25.162530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.087955Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"fb1fa663-76a1-4407-a06d-70aac5abea06","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.166996Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:cff0a52190dfa72a9d65a8c8c9612922bd26dfa43c4e594df8ad2fe329a6ae43","observation_id":"2f9db356-e5f8-4e0b-bea9-2312bfe85f38","resolution":{"observed_at":"2026-08-12T14:04:26.091979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.075588Z","title":"H ´enaff, Skanda Koppula, Jean-Baptiste Alayrac, Aaron van den Oord, Oriol Vinyals, and Jo˜ao Carreira","venue":null,"work_id":"0a9e6b96-0614-4419-a75f-196096d1d237","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.171011Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:00a3a382ca90390084c5b34ffba2dd84f63e19f26964b4d96e3b69749a9e1dd5","observation_id":"bb39384a-f3df-4cca-8a04-0a7571b77917","resolution":{"observed_at":"2026-08-12T14:04:26.079924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.063128Z","title":"Benchmarking neu- ral network robustness to common corruptions and perturba- tions","venue":null,"work_id":"fcddd6f9-041a-45dd-b946-b97703a4f2be","year":2019},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.178242Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:f4324045db71f6f50b251ba67421e043ab1fa2b5568bae0630bc8ac0b14b816b","observation_id":"61d26aa2-8ea3-4784-be9f-bc31dbd2d37d","resolution":{"observed_at":"2026-08-12T14:04:26.067797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.050839Z","title":"The many faces of robustness: A criti- cal analysis of out-of-distribution generalization","venue":null,"work_id":"a1844c02-3146-46e4-8bc4-5121f73f0cfd","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.183406Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:b7c54510771f2f82260ccc6f0d1f2a8b96b6fe653cd0cb36795fe91ea218580e","observation_id":"11e105f7-ffa0-4125-8736-91b3cb60c756","resolution":{"observed_at":"2026-08-12T14:04:26.055168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.036971Z","title":"Natural adversarial examples","venue":null,"work_id":"1ddacc87-44fe-4bf2-86b6-3b05bd061941","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.190406Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:b1ec70573f3242b5f431112b730b7a585a8fffc93658d60d215d97c9b5b960df","observation_id":"031ab2b9-15b1-4d15-a299-6bea818ec001","resolution":{"observed_at":"2026-08-12T14:04:26.042065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.019799Z","title":"Green hierarchical vision transformer for masked image modeling","venue":null,"work_id":"1ddba9a2-cf41-4364-bbf5-945899aa0ae4","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.195851Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:9d6339b5b9e466bc47678e2dfe4ec9f2e0996c8f0a5b4942790f8dc71f386548","observation_id":"f14ae98d-9f48-4e7d-b74a-d3a4fce01928","resolution":{"observed_at":"2026-08-12T14:04:26.024670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.006775Z","title":"Contrastive masked autoencoders are stronger vision learners","venue":null,"work_id":"82a9c668-8efd-4224-bf8e-7265331d1f15","year":2024},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.200995Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:59f05f63caff2485ab3b9fa74ba119fd660925c8ff15e524e32528d7a622267d","observation_id":"ad48ad89-1438-43c4-a95c-88a3a4421cb6","resolution":{"observed_at":"2026-08-12T14:04:26.011029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.994957Z","title":"Mean shift for self-supervised learning","venue":null,"work_id":"82bf6838-2a11-4ce4-8546-ffd00c455b69","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.204799Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:05229b1e4900763a3b778574c3870b50af6947fc1433a66f4e8623593e6c6d63","observation_id":"a7d578ce-a379-4122-b481-87567cf8df58","resolution":{"observed_at":"2026-08-12T14:04:25.999077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.982888Z","title":"Colorization as a proxy task for visual understanding","venue":null,"work_id":"7a652263-389a-4a3e-9df1-39f117dab62d","year":2017},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.209023Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:2ab6f9ab245651fb3a588fc34040da43e53f6de6f23024037e4677712782e55f","observation_id":"6b791629-2ce3-46cb-9fcc-7c99cef5a20b","resolution":{"observed_at":"2026-08-12T14:04:25.987025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.969979Z","title":"Semmae: Semantic-guided mask- ing for learning masked autoencoders","venue":null,"work_id":"7379b0db-9bf8-4131-8f82-2a58ed941e1f","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.214024Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:b9e2d0a939a6dc541f8afe94d1912f22a215e5943592887fc45993c6f61ac759","observation_id":"b3920c9a-f62f-42dc-966e-e10ef39197f1","resolution":{"observed_at":"2026-08-12T14:04:25.974848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.956911Z","title":"Exploring plain vision transformer backbones for object de- tection","venue":null,"work_id":"852539ba-5060-4dde-81d7-0be95b91ca86","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.219025Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:ff9527ce4d93eba0e406554e5b46d4b4404e4191b6b21d2a8198c45282dcefde","observation_id":"fab8c5f1-5960-4843-a0bd-4172c725e8a7","resolution":{"observed_at":"2026-08-12T14:04:25.961698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.944626Z","title":"Sere: Exploring feature self-relation for self-supervised trans- former","venue":null,"work_id":"010b5224-4807-424e-b379-32572cb6d062","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.223966Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:e2ae3990f17249afea0f0526083c9439acf27aaf7f0cf8447258301c1a57c470","observation_id":"f59492a7-ddf6-463a-aca7-ca0654328d68","resolution":{"observed_at":"2026-08-12T14:04:25.949093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.930572Z","title":"Improving pixel-based mim by reduc- ing wasted modeling capability","venue":null,"work_id":"21f4c809-a121-48ac-8379-4dfc16fc42aa","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.228781Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:d449f4a470fd79f63103c7cf911c7307ef4d6aca60b43c47d607ae7857a8e745","observation_id":"9be18984-6f44-46ec-b832-0e5fbea75dd0","resolution":{"observed_at":"2026-08-12T14:04:25.935382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.915503Z","title":"Swin trans- former: Hierarchical vision transformer using shifted win- dows","venue":null,"work_id":"b07323a5-dd51-42c6-a6f5-5308ed10e265","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.234845Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:68d87147fca2db1dc6ab56fd55713330c5f3734cc5a83229ad8acb33bddf69f6","observation_id":"b291b8fb-75aa-4f25-841e-a18a55273bf8","resolution":{"observed_at":"2026-08-12T14:04:25.919971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.901670Z","title":"Good helper is around you: attention-driven masked image modeling","venue":null,"work_id":"8f4dca6c-eb97-48a9-a770-bb8fc9bfdd94","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.243006Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:18ed9ed656feac99be2a616ffc1381a8c0b7a47b275fa19719d4ab3928f173c7","observation_id":"738b9f9c-328e-4437-aa13-7fcee33b9f67","resolution":{"observed_at":"2026-08-12T14:04:25.906531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05871","last_updated":"2023-05-10T03:39:24Z","snapshot_observed_at":"2026-08-11T00:07:58.681836Z","submitted_at":"2023-05-10T03:39:24Z","title":"Medical supervised masked autoencoders: Crafting a better masking strategy and efficient fine-tuning schedule for medical image classification","version":1},"cited_work":{"arxiv_id":"2305.05871","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.05871","snapshot_observed_at":"2026-08-12T14:04:25.438897Z","title":"Medical supervised masked autoencoders: Crafting a better masking strategy and efficient fine-tuning schedule for medical image classification","venue":"cs.CV","work_id":"63879bcc-8e9e-49ff-971c-0651b7c7bd5a","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.248429Z"},"links":{"cited_paper":"/paper/2305.05871","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:c01e00b6221780e0457248e92fbf4be347dd4c16c108b90a4c77226a6fca6ede","observation_id":"39d863d2-703e-4bbe-827d-089056567ab9","resolution":{"observed_at":"2026-08-12T14:04:25.445902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.889863Z","title":"Unsupervised learning of visual representions by solving jigsaw puzzles","venue":null,"work_id":"eb6e610e-82b3-4cdb-ac77-980d29bcef2a","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.253574Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:0131e7f4cb2cc2cf80f17faba4792d1c10b2302c128ed1526846e21bbc39fb39","observation_id":"6d04ffe2-d2ae-4b4c-b8d6-ca9d18e834a8","resolution":{"observed_at":"2026-08-12T14:04:25.893814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.877531Z","title":"Rep- resentation learning by learning to count","venue":null,"work_id":"0138f83b-3c8e-4757-95c3-9bb187eeaa95","year":2017},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.260598Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:85f1d8242f72aca0f9392bf7c008eb4a481c00a65659674048d47e9c8799ee85","observation_id":"e60217be-cb57-4352-8bb4-c83f3195f509","resolution":{"observed_at":"2026-08-12T14:04:25.881460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.865808Z","title":null,"venue":null,"work_id":"609c0d87-56f2-43ad-b9ba-894c2d783ed0","year":2016},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.264939Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:bb39ec993de51e2ec86d67d2559fe707a18af34aa4435c561f553c0f85702d1d","observation_id":"7d293d9c-fd60-4d5d-8820-0bfc8c8966c1","resolution":{"observed_at":"2026-08-12T14:04:25.869451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.853846Z","title":"Spatilly consistent representation learning","venue":null,"work_id":"c0e23e50-5cde-478d-a6ce-d902102b1e5a","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.269393Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:459365747c6e4e2cba355841d0d5b098cb5168ae8da7ede751c67bb9b2f7fced","observation_id":"36b2b755-3756-40c0-9719-929f9f1b7d48","resolution":{"observed_at":"2026-08-12T14:04:25.858390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.273384Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.273384Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:0a2f785bd94d9e4a0cae8b10cfd848512c7450f6636bc80cc2e517ecabf2a05e","observation_id":"cb806cc4-5b98-4ef4-b9bf-d147f6683a33","resolution":{"observed_at":"2026-08-12T14:04:25.273384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.825707Z","title":"Siamese image modeling for self-supervised vision represen- tation learning","venue":null,"work_id":"fa5f2a3c-0277-4f5d-a4c9-506edd29cfc6","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.277542Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:dfca122d2622f0f05cf1678b1a1d7b554bfa822ea7243f5f688d0e028140fa10","observation_id":"0c93578f-ec66-4034-a1dc-699683100f96","resolution":{"observed_at":"2026-08-12T14:04:25.830565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.812539Z","title":"Designing bert for convolutional net- works: Sparse and hierarchical masked modeling","venue":null,"work_id":"01c78768-4536-46a8-8810-ca23546a09f1","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.281332Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:f10d4d9ff5cac91b92cc17e66673b2b8fdee3c2ff721e28ee647b4a8983e6af6","observation_id":"c9d93243-e6b6-418f-921c-f0a248540a3c","resolution":{"observed_at":"2026-08-12T14:04:25.817189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.285136Z","title":"Un- derstanding self-supervised learning dynamics without con- trastive pairs","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.285136Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:1b95092ef6a6b0aa6eb8e54793c9e246879314805015f832a9d199b5b16fc0f6","observation_id":"6d50f181-2b0f-4804-a2b0-d4696453d775","resolution":{"observed_at":"2026-08-12T14:04:25.285136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.790416Z","title":"Integrally pre-trained transformer pyramid net- works","venue":null,"work_id":"9ee05e6a-b39b-41e6-a5bd-0554ba0409ed","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.289029Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:2cac2a34f91745eb12260a016592e4ac855a427df8bf16f0d8941528a89dd073","observation_id":"4f4f65ac-425c-4dc9-82e2-e4475e54be8f","resolution":{"observed_at":"2026-08-12T14:04:25.797021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.776961Z","title":"The inaturalist species classification and de- tection dataset","venue":null,"work_id":"c64602a4-7dba-49a1-ba97-55056b22820f","year":2018},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.292877Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:c32e5f50a2cd6ca956359845bbd8e82e643bc354396069030540bd95134d1c64","observation_id":"fb7d6a68-c627-4fdd-b932-2c3e7830624e","resolution":{"observed_at":"2026-08-12T14:04:25.781465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.296581Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.296581Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:b66359ef2915bb9cfecd9fb658903cbcaec15e7a4667d3b40a0ba8e2c6b1f7ea","observation_id":"a72511aa-a8b9-4454-b6bb-21ceb3d01316","resolution":{"observed_at":"2026-08-12T14:04:25.296581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.744903Z","title":"Hard patches mining for masked image modeling","venue":null,"work_id":"1e069944-6105-43eb-9e02-6aa98edc73ad","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.300435Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:83f997463cb2574bfe0df300a78490bcfe05fe8c298cbff8b3977f03f40ef8ce","observation_id":"dbfc8f51-aa6a-45b7-b4c0-177346278afe","resolution":{"observed_at":"2026-08-12T14:04:25.749887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.732069Z","title":"Masked image modeling with local multi-scale reconstruction","venue":null,"work_id":"d2f6e730-782a-44e4-956e-4c654c804d5d","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.305337Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:4bfcd00cc2fe0340201c4b2f122a48feb6887c6db5eeba92478b0e228a7dc0a1","observation_id":"1e2a2ea2-92d5-44eb-8219-92933d5e3d07","resolution":{"observed_at":"2026-08-12T14:04:25.736618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.718751Z","title":"Videomae v2: Scaling video masked autoencoders with dual masking","venue":null,"work_id":"1ce1537b-fb4d-4a1c-a905-c154d5708b09","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.309486Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:c2cac17dfe429cb0a2dbffee71617fe21dc786699bf78c4e6054447a5b9b1849","observation_id":"83fb4ee3-cda8-415a-8c54-4e29c5cb9615","resolution":{"observed_at":"2026-08-12T14:04:25.723029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.705207Z","title":"Image as a foreign language: BEiT pretraining for vision and vision-language tasks","venue":null,"work_id":"80e5e441-497a-4847-835e-6648bede471f","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.313865Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:d5b44b5208e0400dffc437c79706403d14833a48dd49257f96ad0a0319c68b94","observation_id":"1ed67277-4974-4c41-bb3d-969c5d729932","resolution":{"observed_at":"2026-08-12T14:04:25.709844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.318359Z","title":"Dense contrastive learning for self-supervised visual pre-training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.318359Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:405d5cb731d4e8076df4b6ba994bfa954363b1f33e0c48be79c8631e5da61d36","observation_id":"7412b265-c806-48ff-a1ae-24de520983a7","resolution":{"observed_at":"2026-08-12T14:04:25.318359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.686665Z","title":"Masked feature predic- tion for self-supervised visual pre-training","venue":null,"work_id":"176ec5bd-7f94-486b-8ef4-e50c62f6c380","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.322543Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:49d835628b79857d0d2b7a1962ef3643f741dbd2c71c52c190cab8173cf7e0b1","observation_id":"941597ec-cff8-4213-a946-b96e1ab3d26e","resolution":{"observed_at":"2026-08-12T14:04:25.690945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.672272Z","title":"Mvp: Multimodality-guided visual pre-training","venue":null,"work_id":"11a64e00-e3b0-4359-bbda-8001b29848d6","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.326918Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:09af00e98fbd3b16bffacc80660e6352f87af37edd76e9c2ee6ecaf0e2a7d482","observation_id":"1193d7e2-4761-4512-a50c-2556fe7a91fd","resolution":{"observed_at":"2026-08-12T14:04:25.676463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.332140Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.332140Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:7348b9149ea922216f23c9d5e86052799eddc5d3319013e8749b7bda431d219e","observation_id":"6d69a7ef-83ca-4447-bc48-e5b1016b7a19","resolution":{"observed_at":"2026-08-12T14:04:25.332140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.652562Z","title":"Yu, and Dahua Lin","venue":null,"work_id":"dc27c744-7666-493d-8f20-9933e106ce21","year":2018},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.337255Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:049d4d32cffd73f3736b68916832c7afdf518289eb4f4d22da242fcaaf37f503","observation_id":"90b19df7-f470-4e87-b5e5-19ee7ae10560","resolution":{"observed_at":"2026-08-12T14:04:25.657743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.639212Z","title":"Masked frequency modeling for self-supervised visual pre-training","venue":null,"work_id":"fa5e35b9-f416-4ba1-851c-3f74f9f33656","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.341598Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:834fb687eebda494acaeba65b9e192802ebde860b0acca2a874c744e3b301685","observation_id":"c2dc7739-a5e3-4f22-9316-52b851e3fc90","resolution":{"observed_at":"2026-08-12T14:04:25.643627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.346250Z","title":"Propagate yourself: Exploring pixel-level consistency for unsupervised visual representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.346250Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:ba42473621e14f009cd8a445857298c1cb644e2ad224f7963b998b0eb967e4dc","observation_id":"320adb59-c527-4179-a8cd-ac98cd6ca448","resolution":{"observed_at":"2026-08-12T14:04:25.346250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.612451Z","title":"Simmim: A simple framework for masked image modeling","venue":null,"work_id":"f6440763-07e4-484f-a955-86cd6cf3773a","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.350270Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:6a955d3c109389e96d9621cfb38ad4842ba42f11091756c4171d564a470ce111","observation_id":"8bd18fb5-db7c-486e-abed-ef1bf6132069","resolution":{"observed_at":"2026-08-12T14:04:25.616936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.355759Z","title":"Decoupled contrastive learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.355759Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:d8f6d19f86a62b2a8cbfa67b95a21ee0f3444cda0184a70b757d23e10f1c3fa1","observation_id":"3f32d29e-44b8-4289-b398-2adad61d0196","resolution":{"observed_at":"2026-08-12T14:04:25.355759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.593841Z","title":"Masked image modeling with denoising contrast","venue":null,"work_id":"68ea80be-d52a-405f-aa06-132a86f3d488","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.359221Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:10f484da30d745b5ada889fcf7998928d8ffa862f912b0fd009d3142fd4dfbd2","observation_id":"08c6b604-da5d-4403-bf85-2433b525c4ed","resolution":{"observed_at":"2026-08-12T14:04:25.597640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.582695Z","title":"Barlow twins: Self-supervised learning via redundancy reduction","venue":null,"work_id":"7f90c8cc-c677-48db-abc5-d15d25ccff9c","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.362262Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:63d170c1685700a6ea285426f44332663a3987d7db1c54d88b18289876d9e61e","observation_id":"a8cac60f-f6f9-4584-bfa2-d927175fc651","resolution":{"observed_at":"2026-08-12T14:04:25.586176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.365726Z","title":"Colorful image colorization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.365726Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:de51d48e93377b51ac38477f1fb31b3a7ea504e99494255f3ace11cffa7b4c3e","observation_id":"9d5a0101-932d-4f12-8a5f-e1261ace4b63","resolution":{"observed_at":"2026-08-12T14:04:25.365726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.556856Z","title":"Self-supervised visual representations learning by contrastive mask prediction","venue":null,"work_id":"dec65298-2cd9-448a-8b34-f1bc6d04a7c4","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.369349Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:d8d4bde86c3bc80ba8220f98cfba7a66f24167f71f02e5c74517a7f1bcd09abf","observation_id":"05c1ab6e-1719-47b0-8788-978f8577906f","resolution":{"observed_at":"2026-08-12T14:04:25.560677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.543963Z","title":"Scene parsing through ade20k dataset","venue":null,"work_id":"69927802-2945-44b9-8596-a900ee4e752e","year":2017},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.373702Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:c3c21e5108c95df4a5a85c91a50d341e25b4d507d4b994e82e8fef1783a5c5f4","observation_id":"f7f6fd94-fa99-485e-af32-3d2902071600","resolution":{"observed_at":"2026-08-12T14:04:25.548049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.529798Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":"1bcd92d4-cf93-461e-b6a5-5d67231274f9","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.378002Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:86d62acf66dbc379ad3f3def40e6fdefee7ea16cea7aa59ed4e5e9864695ddc5","observation_id":"12caf166-cbb3-43ba-81cf-b2de5941de28","resolution":{"observed_at":"2026-08-12T14:04:25.534334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14415","last_updated":"2022-03-27T23:42:05Z","snapshot_observed_at":"2026-08-12T07:17:17.539338Z","submitted_at":"2022-03-27T23:42:05Z","title":"Mugs: A Multi-Granular Self-Supervised Learning Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14415","snapshot_observed_at":"2026-08-12T14:04:25.383655Z","title":"Mugs: A multi- granular self-supervised learning framework","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.383655Z"},"links":{"cited_paper":"/paper/2203.14415","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:2e9d92bed7ee5eb84e47e24e978bddef31349cccc4c26bab71ddfdae6d530d7d","observation_id":"4e32713c-f7b5-49ff-b52d-df709da6d0af","resolution":{"observed_at":"2026-08-12T14:04:25.383655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.516574Z","title":"In implementation, we use a greedy strategy to find the approximate solution of Eq","venue":null,"work_id":"a5439236-c3c1-4ffa-abce-0169a3234d31","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.388265Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:514bdcd5a3eb55e2dcd352e1ccecda8ce6e909e9cb6eda7ef3ec410b45e98b2d","observation_id":"b1cbc46e-aa21-41cf-8606-0c6a506349c7","resolution":{"observed_at":"2026-08-12T14:04:25.521266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.501244Z","title":"13 and Tab","venue":null,"work_id":"7b7875b0-372e-479e-b98b-1efbac315cf5","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.391939Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:b8fdb33563045171117a4ea4955d9152c83aebbabc9c90f88fc49bdc98a0d53f","observation_id":"89cdec21-848d-46a1-ac1f-70dadeb3c42a","resolution":{"observed_at":"2026-08-12T14:04:25.505498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T13:54:27.929971Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":2,"verified_fuzzy":50},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2411.15746."}