{"as_of":"2026-08-23T07:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e4f5060401f90b8107e8860481b7a1e35912b90769377d6e67fccf39ddbb108","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:08:22.605320Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.05845/citation-record","integrity":"/paper/2602.05845/integrity","json":"/paper/2602.05845/citation-record.json","paper":"/paper/2602.05845"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:12.037836Z","title":"Masked siamese net- works for label-efficient learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:12.037836Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:5eacc4cc3d90600e461947cdf0ad2808bfeff4983b438b78238a21fd3d082ffb","observation_id":"af611839-4ef4-47e9-a6c1-21855da01451","resolution":{"observed_at":"2026-08-03T04:08:12.037836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:12.112771Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:12.112771Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:2a5012f08368728eaedaeb311f8698f4e44f377f3a0f1da5aa20b2441310c03a","observation_id":"ed67a835-be87-4932-b380-443c56664ab1","resolution":{"observed_at":"2026-08-03T04:08:12.112771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02860","last_updated":"2025-01-06T09:08:59Z","snapshot_observed_at":"2026-08-22T04:24:33.693234Z","submitted_at":"2025-01-06T09:08:59Z","title":"Seeing the Whole in the Parts in Self-Supervised Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02860","snapshot_observed_at":"2026-08-03T04:08:12.222057Z","title":"See- ing the whole in the parts in self-supervised representation learning.arXiv preprint arXiv:2501.02860, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:12.222057Z"},"links":{"cited_paper":"/paper/2501.02860","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:b8318f7e6365152c0d75bfa41d821aaffe6f73912353471e5bd48a31e584a2c2","observation_id":"cd0f9334-989b-47ef-86ef-13b5ca8fa5aa","resolution":{"observed_at":"2026-08-03T04:08:12.222057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:12.373837Z","title":"Multimae: Multi-modal multi-task masked autoen- coders","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:12.373837Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:9ee8707b6ff05ad917d8be5accef6261b1e2eab041d1382aa5b57897a2c9c4fe","observation_id":"47e42dd2-d1b7-43ee-bb52-b58aeea8895b","resolution":{"observed_at":"2026-08-03T04:08:12.373837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:12.479774Z","title":"Beit: Bert pre-training of image transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:12.479774Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:446dd6c6bbca5e2a6791bbcb13d7f5ae18304d424c37ba65dc8fb98099eb7f5f","observation_id":"a93d9d79-bcdb-4302-a9e9-615c68ca979a","resolution":{"observed_at":"2026-08-03T04:08:12.479774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:12.707342Z","title":"Vi- creg: Variance-invariance-covariance regularization for self- supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:12.707342Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:ef5346e6fbc451c94ca8d8b447bd54ae735d246a9c4dac6cb9ece0cb47c30490","observation_id":"caea8d1c-2bfc-4f35-b587-793bdc4f6dff","resolution":{"observed_at":"2026-08-03T04:08:12.707342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:12.905135Z","title":"Deep clustering for unsupervised learning of visual features","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:12.905135Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:005476f6c89a599eb3e9389410c6c81d8a625027026c5af5ea7a2dfbe30f2a9e","observation_id":"0c672f3e-073e-4e89-b1f9-3f82129e8067","resolution":{"observed_at":"2026-08-03T04:08:12.905135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:13.144729Z","title":"Unsupervised learn- ing of visual features by contrasting cluster assignments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:13.144729Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:5f1b3b6e495bed91639853cbaed0e3fbf059e109f43f4d21069760b114f2dcb1","observation_id":"4865159e-a34b-41bd-9157-b9d3cce6e433","resolution":{"observed_at":"2026-08-03T04:08:13.144729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:13.276289Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:13.276289Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:dec68c15a61a84b8b6974034db43d93679aa3290265fa02191957c6d4280c63f","observation_id":"8c54a016-c87b-4266-819b-7735cd0425da","resolution":{"observed_at":"2026-08-03T04:08:13.276289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:13.391038Z","title":"A simple framework for contrastive learn- ing of visual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:13.391038Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:7c31cf85a16b1f770831607312427638aaa04a4176f540b15e2303f8ba8e777e","observation_id":"3ec428f9-c199-4e08-84fa-cbec3f7144ae","resolution":{"observed_at":"2026-08-03T04:08:13.391038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:13.593250Z","title":"Exploring simple siamese rep- resentation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:13.593250Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:b9d0b807298588f3dae225d9bf41c449ce617a183a3c2b5569ccb601de992d84","observation_id":"bd4931d8-ebc4-413d-ab5d-99076646229d","resolution":{"observed_at":"2026-08-03T04:08:13.593250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-03T04:08:13.812011Z","title":"Improved baselines with momentum contrastive learning","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:13.812011Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:20c2e75f6d493456a273e2f05ec3e8077df8149cd748f5416b5a0bd5d4233df7","observation_id":"10e878a0-1195-40a3-86fe-d049edbc3598","resolution":{"observed_at":"2026-08-03T04:08:13.812011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:14.027327Z","title":"An empiri- cal study of training self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.027327Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:68d0eee8d2d0116d9ae0c53e532d504c39f27598c2aaca9e6312586444b46ccf","observation_id":"b3b2edb3-6596-49f2-a91a-ceaa0d84cf80","resolution":{"observed_at":"2026-08-03T04:08:14.027327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:14.130013Z","title":"Cluster and predict la- tent patches for improved masked image modeling.CoRR,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.130013Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:e25d7c3737210caac75b5688cd3ec7fdd2513c1e4f247a8a7190f339a4dad00d","observation_id":"cecee87c-3cbf-4317-a0e1-a0222fd136b9","resolution":{"observed_at":"2026-08-03T04:08:14.130013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03227","last_updated":"2026-06-18T12:13:53Z","snapshot_observed_at":"2026-08-18T12:17:16.373731Z","submitted_at":"2025-02-05T14:43:40Z","title":"Adversarial Dependence Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03227","snapshot_observed_at":"2026-08-03T04:08:14.195239Z","title":"Adversarial dependence minimiza- tion.arXiv preprint arXiv:2502.03227, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.195239Z"},"links":{"cited_paper":"/paper/2502.03227","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:7136b94f4c1a2e5142e0f8765200141c7014051dc042dde9d57606584739578d","observation_id":"cba0488d-25e4-4c44-b01c-09d1573b69fb","resolution":{"observed_at":"2026-08-03T04:08:14.195239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:14.271212Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.271212Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:599ff4eced4419469ed7b422cf80af4ce781c522e78c161386554897a08c0d31","observation_id":"cc398f9d-f1fa-492c-89b7-8f131a135705","resolution":{"observed_at":"2026-08-03T04:08:14.271212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04552","last_updated":"2017-11-29T14:51:40Z","snapshot_observed_at":"2026-08-13T11:54:46.030796Z","submitted_at":"2017-08-15T15:21:53Z","title":"Improved Regularization of Convolutional Neural Networks with Cutout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04552","snapshot_observed_at":"2026-08-03T04:08:14.312230Z","title":"Improved regular- ization of convolutional neural networks with cutout.arXiv preprint arXiv:1708.04552, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.312230Z"},"links":{"cited_paper":"/paper/1708.04552","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:27a9c027de68d89fcc5f8e2ac7272d5c63c2b6a3a79f4283357017140a8af7a5","observation_id":"36ff11e0-ffff-4842-a5e4-0ba4e3c7acd9","resolution":{"observed_at":"2026-08-03T04:08:14.312230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:14.494459Z","title":"Multi-task self- supervised visual learning","venue":null,"work_id":null,"year":2051},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.494459Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:62391791831a69fe17c5d5df3f791331d2cc3d0b1183eb05cb778e801aa20073","observation_id":"7bbc278e-1ccb-404f-ae40-38c7052b306f","resolution":{"observed_at":"2026-08-03T04:08:14.494459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:14.586740Z","title":"Unsuper- vised visual representation learning by context prediction","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.586740Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:b3e9abef875de145280181b3543c22796e26bf2b38be7d6fc8f1c468f8ae6cba","observation_id":"bea88949-8f93-402c-938c-6c81ba93c033","resolution":{"observed_at":"2026-08-03T04:08:14.586740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:14.652339Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.652339Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:5f24a501b14b4f14a75c6dfba6e90dbcec14c140e8e6c0d39410c9b44595cc90","observation_id":"a0a49ddb-cbde-426a-ada1-640cec093de7","resolution":{"observed_at":"2026-08-03T04:08:14.652339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:14.771105Z","title":"Whitening for self-supervised representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.771105Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:d922ebfe546c04fab4cf28ea7cc55a75ce0cd727439a7c5d04445ea020803c05","observation_id":"2013b4c9-7deb-4025-b648-79edcb2ab4ef","resolution":{"observed_at":"2026-08-03T04:08:14.771105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14204","last_updated":"2022-10-21T04:26:27Z","snapshot_observed_at":"2026-08-19T19:38:03.699027Z","submitted_at":"2022-05-27T19:09:42Z","title":"Multimodal Masked Autoencoders Learn Transferable Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14204","snapshot_observed_at":"2026-08-03T04:08:14.875356Z","title":"Multimodal masked autoen- coders learn transferable representations.arXiv preprint arXiv:2205.14204, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.875356Z"},"links":{"cited_paper":"/paper/2205.14204","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:1ca6e009279da404ea9e403700bcffcd005ddb13bef4efc666f9ee197843d3fa","observation_id":"fdc65874-e27c-4510-9d17-83f8c207b01d","resolution":{"observed_at":"2026-08-03T04:08:14.875356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:14.975031Z","title":"Un- supervised representation learning by predicting image rota- tions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:14.975031Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:0cbaa78423f5912e1d9f21b8020b6997f2280c8a1efabd4b9abbf51d1859ac20","observation_id":"95cef672-25c6-47d9-9733-c400aef03edf","resolution":{"observed_at":"2026-08-03T04:08:14.975031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02677","last_updated":"2018-04-30T21:53:41Z","snapshot_observed_at":"2026-08-09T05:23:26.365677Z","submitted_at":"2017-06-08T16:51:53Z","title":"Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02677","snapshot_observed_at":"2026-08-03T04:08:15.163646Z","title":"Accurate, large mini- batch sgd: Training imagenet in 1 hour.arXiv preprint arXiv:1706.02677, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:15.163646Z"},"links":{"cited_paper":"/paper/1706.02677","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:2847ba399393d57f55c4b4c065150f0e4c96674249c0ef3c13e5e95e5903f479","observation_id":"c760926a-001e-4d25-b655-ab51f66be988","resolution":{"observed_at":"2026-08-03T04:08:15.163646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:15.254844Z","title":"Bootstrap your own latent-a new ap- proach to self-supervised learning.NeurIPS, 33:21271– 21284, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:15.254844Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:1dc40b6a4ce58a65304b29e764a4d9a65b4735c2514b04209b5664e4f203d9ee","observation_id":"9a33d36d-a78c-48ab-bf6c-2161a25fd69d","resolution":{"observed_at":"2026-08-03T04:08:15.254844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:15.346549Z","title":"Unsupervised multi-task feature learning on point clouds","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:15.346549Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:4cf56313918c97e40d6ba228a18760b8aabf3a4b9e038fb1424a09b7eaee738e","observation_id":"9d75952e-0f84-48ca-acfa-03f36f641382","resolution":{"observed_at":"2026-08-03T04:08:15.346549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:15.442022Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:15.442022Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:7bfb6f7e9c1c4c807cdcc984737a263cf0e355598a3368242f40f6c3f63d9ada","observation_id":"b08ee0c8-eebe-4e63-9562-7b7dfa6bb402","resolution":{"observed_at":"2026-08-03T04:08:15.442022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:15.509479Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:15.509479Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:8a796f976c299609d3e49d86508bbed390925756c97dd06ce19799852bd7b7d5","observation_id":"58995d83-4784-4f0b-a0a8-e6553ceb3849","resolution":{"observed_at":"2026-08-03T04:08:15.509479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:15.667839Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:15.667839Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:f2ed9116028f479b58744f9222c879a1cadfda01e8ce78af7a87951781aeb412","observation_id":"b9b8c36f-0e4f-47d3-ba54-1b8cf1da8bf5","resolution":{"observed_at":"2026-08-03T04:08:15.667839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:15.762269Z","title":"Batch normalization: Accelerating deep network training by reducing internal co- variate shift","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:15.762269Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:da0b9942970ad90a3bebbcf06968e958be4e168f03aed5c740beb539d2baebae","observation_id":"d9e38dd5-255e-43f8-9b2e-a2644d9d9d6e","resolution":{"observed_at":"2026-08-03T04:08:15.762269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:15.860613Z","title":"Multi- modal contrastive masked autoencoders: A two-stage pro- gressive pre-training approach for rgbd datasets","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:15.860613Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:0e2c5530038a36d442cdb8f07f3752fa5d2c2bec26d87cac9b08ba772e6d4664","observation_id":"ab4956a4-b75c-4262-9fc3-472c09d31966","resolution":{"observed_at":"2026-08-03T04:08:15.860613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-03T04:08:15.959278Z","title":"Adam: A method for stochastic opti- mization.arXiv preprint arXiv:1412.6980, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:15.959278Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:10e82245515bdffd7ac66ebc0017dd41025343615107425f5233470e902a909a","observation_id":"89daa5fe-a322-4714-9eb6-23b9d67c3994","resolution":{"observed_at":"2026-08-03T04:08:15.959278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:16.093600Z","title":"Global-local self- distillation for visual representation learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:16.093600Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:ea5453e5556090e88dec83a984b113ff4a72a22e7f0d6999b1f6f8eb448c4684","observation_id":"f223f396-dc40-441a-8b55-16999915130d","resolution":{"observed_at":"2026-08-03T04:08:16.093600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:16.295182Z","title":"Compressive visual representations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:16.295182Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:a93d8c1a177f69f174fb1ee6e5620fef91a5ca34dd23b6feb041a7eb342e8d46","observation_id":"5da9c6df-6d17-4d57-9a87-95473c5cdf6c","resolution":{"observed_at":"2026-08-03T04:08:16.295182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-03T04:08:16.438034Z","title":"Continuous control with deep reinforcement learning.arXiv preprint arXiv:1509.02971, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:16.438034Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:dac48514454e27682638cdcd777bedfaf39fc663556f52a5570dd37784956017","observation_id":"a43acdeb-2b1f-4f77-943d-9ecbc3cfaee4","resolution":{"observed_at":"2026-08-03T04:08:16.438034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:16.713210Z","title":"Ms2l: Multi-task self-supervised learning for skeleton based action recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:16.713210Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:3d9c6979b5cb68051f9456094af37ee016a8697d6200eab36284b3c3453df057","observation_id":"e131c040-a030-42cd-8831-cc3d5df43a8b","resolution":{"observed_at":"2026-08-03T04:08:16.713210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:17.270921Z","title":"A closer look at benchmarking self-supervised pre- training with image classification.IJCV, pages 1–13, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:17.270921Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:9a9d6cc109b60fe539be4a0344a1d23593a96911bee11441c080215b28e8647d","observation_id":"2ec36a3d-a925-44cd-b328-3e92a3d59983","resolution":{"observed_at":"2026-08-03T04:08:17.270921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00319","last_updated":"2023-04-06T20:05:35Z","snapshot_observed_at":"2026-08-20T12:48:23.614039Z","submitted_at":"2021-12-01T07:23:37Z","title":"Object-Aware Cropping for Self-Supervised Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00319","snapshot_observed_at":"2026-08-03T04:08:17.430831Z","title":"Object-aware cropping for self- supervised learning.arXiv preprint arXiv:2112.00319, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:17.430831Z"},"links":{"cited_paper":"/paper/2112.00319","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:2583a949d87223a564d92f5b7f87dee08c1666c40cff245cb1afef3030337795","observation_id":"b1badd86-c66f-4e74-aebe-fb5b0eb1959d","resolution":{"observed_at":"2026-08-03T04:08:17.430831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:17.564574Z","title":"An embedding-dynamic approach to self-supervised learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:17.564574Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:f3f35306e1c85218b123fcdedf3ce3ff555ac915676b1779fd0fa4594816931c","observation_id":"a7f06c31-d825-4a5c-bdb8-1444afa4f736","resolution":{"observed_at":"2026-08-03T04:08:17.564574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05726","last_updated":"2024-03-08T23:42:06Z","snapshot_observed_at":"2026-08-19T21:59:41.597996Z","submitted_at":"2024-03-08T23:42:06Z","title":"Augmentations vs Algorithms: What Works in Self-Supervised Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05726","snapshot_observed_at":"2026-08-03T04:08:17.694267Z","title":"Augmentations vs algorithms: What works in self- supervised learning.arXiv preprint arXiv:2403.05726, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:17.694267Z"},"links":{"cited_paper":"/paper/2403.05726","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:b2129dfedee7e832e1cf5977878bf6db5418ac25e4ac5d3617bd3385c18a171f","observation_id":"85dcd6f6-9cf9-49e5-a2d1-25872dc4f16e","resolution":{"observed_at":"2026-08-03T04:08:17.694267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:17.876196Z","title":"You don’t need domain-specific data augmentations when scaling self- supervised learning.NeurIPS, 37:116106–116125, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:17.876196Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:5a9e3a497e1a680fcf37c8e8f2db60b5067ca19b2f91251a1abd12a3d0d38815","observation_id":"b04af936-3c23-40e9-acd2-9c5d0799daeb","resolution":{"observed_at":"2026-08-03T04:08:17.876196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:18.015666Z","title":"Unsupervised learning of visual representations by solving jigsaw puzzles","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:18.015666Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:5b077fc8c46e6f853e54fe1382c1b18eef62cb2947fa25b851a9a2f281111a33","observation_id":"56bfd40e-8c02-469d-b323-a344253869f7","resolution":{"observed_at":"2026-08-03T04:08:18.015666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-03T04:08:18.146521Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:18.146521Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:d03e288f3fe4792dee8df644c8d62964ecd2271ba8a9d52556205b3505e79fd6","observation_id":"b112386e-c9e1-4426-87d2-c8950549b7d1","resolution":{"observed_at":"2026-08-03T04:08:18.146521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:18.311139Z","title":"Context encoders: Feature learning by inpainting","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:18.311139Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:5f5c691ff9b4abb13796369b17675fada814b71b434cd44a1677dc931ed664fc","observation_id":"da4c1f45-40e5-4914-9892-eade9883fc86","resolution":{"observed_at":"2026-08-03T04:08:18.311139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-08-18T01:07:23.737664Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-03T04:08:18.513267Z","title":"Dinov3.arXiv preprint arXiv:2508.10104, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:18.513267Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:70862a0ab2f5d9cfd60cf38c5114a6e15562a0af2f0a642bef5ff57f40a8255a","observation_id":"45d74fc1-e692-4531-9bf6-9e0d09e40b28","resolution":{"observed_at":"2026-08-03T04:08:18.513267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:18.688168Z","title":"Branching out for better byol","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:18.688168Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:a7ff9310930f93bb0bd915b82896375b87cb89a16f22b7a7862de4dc88a54499","observation_id":"884712df-1b5e-41ff-a032-9e8e5c2e4ca6","resolution":{"observed_at":"2026-08-03T04:08:18.688168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:18.837635Z","title":"Un- derstanding self-supervised learning dynamics without con- trastive pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:18.837635Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:dc2eeda7e70956ee0f807945c11cf983e670142ac0a31e19ccc0ab63d0c09a9b","observation_id":"2a312144-2847-4198-859b-d060d4160fab","resolution":{"observed_at":"2026-08-03T04:08:18.837635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:19.022965Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:19.022965Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:75d1c99b3f462e80278ad788d62a8bd5371f6e6f0d2442ec027fd6e7d9fb8168","observation_id":"c55e718b-856c-41fe-89ce-bd215d1c1cb5","resolution":{"observed_at":"2026-08-03T04:08:19.022965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:19.180215Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:19.180215Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:5aa165fe199b08f20d191217154201c87d3e00c5b8a824f5b4a301e74b23d98b","observation_id":"6bf2b598-5114-4e3d-ac84-cad908f0c441","resolution":{"observed_at":"2026-08-03T04:08:19.180215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:19.371890Z","title":"How to train state-of-the-art mod- els using torchvision’s latest primitives.https : / / pytorch","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:19.371890Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:c2fffdda4bffe1ec51ae624d5513ea5ff29ebf9f4d5306952540528f915a5fa6","observation_id":"c4776db6-b9a7-4e87-852f-f40402a0be3a","resolution":{"observed_at":"2026-08-03T04:08:19.371890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:19.579389Z","title":"Adaptive multi-head contrastive learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:19.579389Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:f6237b7f131e6e5920d823b3f0f0de370a12e8b35bb338808872623c5a04b509","observation_id":"f55abdfd-c784-4856-bb2e-4efc3ff4751e","resolution":{"observed_at":"2026-08-03T04:08:19.579389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:19.714570Z","title":"Dense contrastive learning for self-supervised visual pre-training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:19.714570Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:29f2c7e159b7f7ba0d6c9c27305b8f5546df8dde504726983ebf54277e12f20d","observation_id":"bf4de393-9da0-4d09-8663-e09cf462e6f8","resolution":{"observed_at":"2026-08-03T04:08:19.714570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:19.878117Z","title":"On the importance of asymmetry for siamese representation learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:19.878117Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:1bbda836a4e352017d43e79ad6167da9838f1485bb6c4af9996efb57d7c79662","observation_id":"f349a331-668b-4557-9e65-ff9eaeb0407f","resolution":{"observed_at":"2026-08-03T04:08:19.878117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:20.046997Z","title":"Region similarity representation learn- ing","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:20.046997Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:8c28bbf071488a0fdac4ae8b28ce2fbf4ae0de78eaa54d04809f35a6e564e596","observation_id":"bfd407e5-d1a1-4832-9be6-a7073e87afe9","resolution":{"observed_at":"2026-08-03T04:08:20.046997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:20.244385Z","title":"Detco: Unsu- pervised contrastive learning for object detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:20.244385Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:2624a7d5e985abc1658c6ca6339196879162312c9809fa26ae20a35736ca818c","observation_id":"736fec50-b27f-47f0-b42b-06123621881b","resolution":{"observed_at":"2026-08-03T04:08:20.244385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:20.418684Z","title":"Simmim: A simple framework for masked image modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:20.418684Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:6e28df3de8d9ae96c603e01a9102a6994823190846f7016eca3a95a936db9488","observation_id":"a80c1cd7-77fb-4f4b-bebb-73cd1fe46b85","resolution":{"observed_at":"2026-08-03T04:08:20.418684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:20.588349Z","title":"Comae: Single model hybrid pre-training on small-scale rgb- d datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:20.588349Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:cd46b845f97a7e7f2ac0cc8743f54e70a1ff5ff99dc694a4418bf5a49d509d6f","observation_id":"fe27d41b-fefe-4822-9f35-46d066295ef8","resolution":{"observed_at":"2026-08-03T04:08:20.588349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.03888","last_updated":"2017-09-13T23:25:07Z","snapshot_observed_at":"2026-08-14T20:41:41.185318Z","submitted_at":"2017-08-13T11:01:57Z","title":"Large Batch Training of Convolutional Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.03888","snapshot_observed_at":"2026-08-03T04:08:20.720337Z","title":"Large batch training of convolutional networks.arXiv preprint arXiv:1708.03888, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:20.720337Z"},"links":{"cited_paper":"/paper/1708.03888","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:68e5b177fa09b6d003bcef0058bd4b67e46ea79ff905fcfdff1639a28bf160a6","observation_id":"458c65d6-4e3f-4e86-bf90-5147e89a4716","resolution":{"observed_at":"2026-08-03T04:08:20.720337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:20.848517Z","title":"Cutmix: Regu- larization strategy to train strong classifiers with localizable features","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:20.848517Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:9fe643cf562d30aa402aae76c86ffc266f98471ef4c6731651622eeda5bdb231","observation_id":"e2cd105a-6570-418f-9e15-88d7372489e9","resolution":{"observed_at":"2026-08-03T04:08:20.848517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:21.040673Z","title":"Barlow twins: Self-supervised learning via redundancy reduction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:21.040673Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:8e21768ace0426fa78fbcc3d9fcb8d76ded068f20905837f50c5b9df81bb83fe","observation_id":"d1ef2950-34aa-4a87-a1ad-374e5885cd60","resolution":{"observed_at":"2026-08-03T04:08:21.040673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:21.152762Z","title":"S4l: Self-supervised semi-supervised learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:21.152762Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:527cfe09c4e229ca4aeba90a987aae8ba9b2cd5ee5f44f6932c82164a914289c","observation_id":"92c54570-6819-411e-a437-07162ee533a1","resolution":{"observed_at":"2026-08-03T04:08:21.152762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-03T04:08:21.315673Z","title":"mixup: Beyond empirical risk minimiza- tion.arXiv preprint arXiv:1710.09412, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:21.315673Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:bb63cc1f488e0cf5806df08cc60263e906353df5871572806c43a98551fc8ab2","observation_id":"b246056c-b931-42dc-b94a-1c3f6cb1ad93","resolution":{"observed_at":"2026-08-03T04:08:21.315673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:21.459685Z","title":"Color- ful image colorization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:21.459685Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:9b5ab3ce6ed7e93f8b37104d80f07cbd1db35827ad7cf9de597f3d1304c0a750","observation_id":"0d7fe0f1-8e5d-451f-bacb-30472e11effb","resolution":{"observed_at":"2026-08-03T04:08:21.459685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:21.587500Z","title":"Leverage your local and global represen- tations: A new self-supervised learning strategy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:21.587500Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:cc15739153027f7d1688ebb2b39edbe82a899fe08937da8006fefff2de1f4ae0","observation_id":"90d405a1-bcb4-46a6-afa0-aa6837f444f2","resolution":{"observed_at":"2026-08-03T04:08:21.587500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:21.707265Z","title":"Random erasing data augmentation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:21.707265Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:8cedf793e12cfd7e2dc65d648683ccf17e0fca9c7a61928b3054e14bffa3dc5e","observation_id":"51eefda9-7d72-4b29-86e5-d3487d084912","resolution":{"observed_at":"2026-08-03T04:08:21.707265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:21.863945Z","title":"Image bert pre-training with online tokenizer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:21.863945Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:3496d8e5366ff419a08519e5fbd9567e809eb557e6b5b526782078545d2f0ce8","observation_id":"021c2c9e-5cfa-41c1-8564-1fb0d56cdc5b","resolution":{"observed_at":"2026-08-03T04:08:21.863945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:21.998598Z","title":"For SimSiam and MoCo v3, the minimum area is set to 20%","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:21.998598Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:f500508cb3ea7e0c3f63b029a24f5add0b0bab502765cf54e31070ec3a923c37","observation_id":"72ea700e-2957-402f-a43f-396276fc0e8f","resolution":{"observed_at":"2026-08-03T04:08:21.998598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:22.102333Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:22.102333Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:3ddd4cc0a0c1e1fc96259f6336c89d9729d196447053194d58427f9059382070","observation_id":"4cb6d31c-0425-4fc5-bbea-fab7161109bc","resolution":{"observed_at":"2026-08-03T04:08:22.102333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:22.176840Z","title":"BYOL and MoCo v3 use the ranges(0.4,0.4,0.2,0.1), while SimSiam uses (0.4,0.4,0.4,0.1)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:22.176840Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:7eaa4b880e7d680ae13fa20e1b303d6513522267eebeb401b833e3db14b7d50f","observation_id":"dc1faf3e-df39-4f85-9bca-90c02087833e","resolution":{"observed_at":"2026-08-03T04:08:22.176840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:22.260136Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:22.260136Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:31c617989c0abb17a34106621c2cb3b1f5a2b3224e5f3836e3863b2a5a88fdff","observation_id":"ef64215b-6f2f-44c2-850c-2e143a9c860f","resolution":{"observed_at":"2026-08-03T04:08:22.260136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:22.343376Z","title":"In BYOL and MoCo v3, the transformation is applied with 100% probability for the first view and 10% for the second; in SimSiam, both views use a 50% probability","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:22.343376Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:2fd9402c01f1819cdfb14661da498da6fb87b774d5d0cfd9d3a8c37865518b7a","observation_id":"de967187-4a60-4fb5-8532-256949db0278","resolution":{"observed_at":"2026-08-03T04:08:22.343376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:22.453088Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:22.453088Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:7d0001a534c1ecadfe8ae23e1408e0aa1f96c6c480f56cdcbcce6ca384a98650","observation_id":"525cf03a-a047-48e4-9f27-314dc087e418","resolution":{"observed_at":"2026-08-03T04:08:22.453088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:08:22.605320Z","title":"Multi-predictor multi-crop and multi-task strategies","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-03T04:08:22.605320Z"},"links":{"citing_paper":"/paper/2602.05845"},"observation_digest":"sha256:c13b9f97769c4c98304e6ee4cb3475824fd79f057272462dfb526ca1a9b1b197","observation_id":"bd664a81-1c4b-498f-a502-69a338a5715f","resolution":{"observed_at":"2026-08-03T04:08:22.605320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.05845","last_updated":"2026-06-08T11:16:24Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T20:24:29.735686Z","submitted_at":"2026-02-05T16:33:30Z","title":"Self-Supervised Learning with a Multi-Task Latent Space Objective"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":73,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 0 inbound Pith citation observations for arXiv:2602.05845."}