{"as_of":"2026-08-10T14:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2057f883a036a3ed727e3f03915752063edb17e13c2bb7db3cfc60e1cebd4289","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T11:59:16.070464Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.22220/citation-record","integrity":"/paper/2606.22220/integrity","json":"/paper/2606.22220/citation-record.json","paper":"/paper/2606.22220"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Conditioned and composed image retrieval combining and partially fine-tuning clip-based features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:ffb609f179d09da19287d8130e34178009e18276e2bb3e7011e769a87fe32352","observation_id":"874b6b50-1645-4cff-adb7-24d55a34dfbb","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Effective conditioned and composed image retrieval combining clip-based features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:35a0dc32acd1d981859210e2753c5979094fc925849131e01a0a90c7323c7dc3","observation_id":"28d82fbb-844c-47af-924a-96cea6bf77fa","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Benign overfitting in linear regression.Proceedings 10 of the National Academy of Sciences, 117(48):30063–30070,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:9becc6aa5e64116ad78edc14a52557e89d966efd5599e24d400103b5c21ebf1d","observation_id":"c5903131-7380-4944-b8a9-5d8ea0d7a1bb","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Reproducible scal- ing laws for contrastive language-image learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:4494b081101ac2677fcef9c583aa8956c4aaf485d26c7a9b1ac569b60252f019","observation_id":"e71d02e3-1686-4a7a-82f4-ed1f2f40d05b","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Does learning require memorization? a short tale about a long tail","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:8667ece4743258e8a7e22590ca020c7920066ac1aa5cb3d726b013e894962545","observation_id":"9417d13d-61d2-4269-ab66-d0638c85f260","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"What neural networks memorize and why: Discovering the long tail via influence estimation.Advances in Neural Information Processing Sys- tems, 33:2881–2891, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:e74c08842179387acdb339a570d750a0625592016cf92157119358988783eb48","observation_id":"be88dc48-8d5e-4b5b-abe3-c8af4700f32d","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Gemmeke, Daniel P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:f5bab975b92c903fa9dc8471119257db3e010362a570a3bd0ef0e5fcb6c6cf0f","observation_id":"14e7b2ff-a5a2-4121-8b54-ac47d09ac97b","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:3556e7347da7db111384842598d038f3463735b20c8c6eb0098b8104dabd29be","observation_id":"09e16746-d3db-4076-a2dc-fb8ab86b7d26","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Esresnet: Environmental sound classification based on visual domain models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:de043a41d48ee274006677e60374b65de665be098c6fe2346e4a5716b8c22124","observation_id":"635d6537-315e-46c5-9b1d-99fb4abb6aee","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Audioclip: Extending clip to image, text and audio","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:ee3c37acafd01a7fdc1d618a5f507fe338f74729d6a382f2390bb44e9c4d9728","observation_id":"c6febc83-b741-46af-b8d5-040bcf6e6975","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Scaling up vision- language pre-training for image captioning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:987efa136e1559b8c2f2d260bc5edc46b4cd2a3210e2c4a7437c94ba52fe782f","observation_id":"17a684f9-e4d6-43f9-a193-f3c7a8820521","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"D´ej`a vu memorization in vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:74c2540e2a79de767db8d598081995c79d225f7c8d3c4cc2a3afa7a0e022f1e1","observation_id":"7c4869c0-f274-483e-84da-d6c263366f29","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.17040","doi":"10.48550/arxiv.2411.17040","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal alignment and fusion: A survey","venue":"arXiv (Cornell University)","work_id":"d65685bf-40b6-4c71-a9f6-1f20fba52048","year":2024},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:71a25e2319a60ef042e817cbb2f460c3ac5b9c005b473b54506b37e463b519e7","observation_id":"d93bae27-ca79-4e28-aa55-b877af9098b0","resolution":{"observed_at":"2026-07-04T08:19:43.751628Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Foundations & trends in multimodal machine learning: Prin- ciples, challenges, and open questions.ACM Computing Surveys, 56(10):1–42, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:0dc64995491b9262eb3d628b9624eb2f567189f7141c370144799702b6d25c99","observation_id":"c926ab74-5025-4bac-a7a9-5e50a72d1538","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Mind the gap: Understanding the modality gap in multi-modal contrastive representation learning.Advances in Neural Information Processing Systems, 35:17612–17625, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:1f38283937aa33e9fb95b8bd985c425adb4c76aecfbdc1bd6f336d1fe69fef07","observation_id":"b4041d6b-1259-48ef-a0e9-43a1c1e819dd","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:5e54d316f12161443e71ef2803632b1ba52fd04fee221520e0a3e086c3467c44","observation_id":"1e5f1510-ac2e-4fb9-b3df-1a4b11e8f402","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.10804","last_updated":"2021-01-28T04:38:38Z","snapshot_observed_at":"2026-08-10T03:45:14.368810Z","submitted_at":"2021-01-26T14:29:52Z","title":"CPTR: Full Transformer Network for Image Captioning","version":3},"cited_work":{"arxiv_id":"2101.10804","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2101.10804","snapshot_observed_at":"2026-07-04T08:19:43.747592Z","title":"Cptr: Full transformer network for image captioning","venue":null,"work_id":"ad64c3a0-768f-4a10-af3e-0963c40f8c86","year":2021},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"cited_paper":"/paper/2101.10804","citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:8ba9c2ffa47493b93cca3a070bb79bea05b748b6c4f43977b1c3a139dbc7b6e7","observation_id":"2c6ade06-9ccd-4000-aaa6-b5c000e5c58b","resolution":{"observed_at":"2026-07-04T08:19:43.749040Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Do ssl models have d ´ej`a vu? a case of unintended memorization in self-supervised learn- ing.Advances in Neural Information Processing Systems, 36: 42775–42798, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:760875f2e730e57703d664b4c57cdda81764474cb0a7e41d56da730c1e8dbd15","observation_id":"aa0114ae-3690-4c30-8d34-2f0bdd8759d9","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Slip: Self-supervision meets language-image pre- training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:66f7649b13dd1340f38f3beb9bc7a93c89e5354ab7c34c95aaa5a9c25f514f9b","observation_id":"790a0bf2-c87d-48e5-a726-fd77a2251081","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":"1807.03748","doi":"10.1609/aaai.v36i10.21390","metadata_source":"pith","pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Learning with Contrastive Predictive Coding","venue":"cs.LG","work_id":"7b08a1d4-d565-424e-9c86-6ef244b7b90a","year":2018},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:ace6c8227cfa55bde79676b9d1bfeba1aac77514b3dc34e4961f63c52cdc79e3","observation_id":"d51b3e88-52f9-465e-9fcb-a82cfe33cd3f","resolution":{"observed_at":"2026-07-04T08:19:43.743617Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Balanced multimodal learning via on-the-fly gradient modulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:032f09b66e5f8ac2c36c3b67a45c4774aa17c4aa37814cf1e537ad4930406094","observation_id":"2cd21d26-2892-4ca0-8d7e-9e971fe62d0d","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:29ee42700f3e96d6d20db74f985e247cb4e1589ea0a789e07ca127b006329af0","observation_id":"78dadd8d-dec6-4f9c-92af-85369bfef5d9","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.10143","last_updated":"2021-07-21T15:21:58Z","snapshot_observed_at":"2026-08-07T14:19:05.821015Z","submitted_at":"2021-07-21T15:21:58Z","title":"On the Memorization Properties of Contrastive Learning","version":1},"cited_work":{"arxiv_id":"2107.10143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.10143","snapshot_observed_at":"2026-07-04T08:19:43.744835Z","title":"On the memorization properties of contrastive learning.arXiv preprint arXiv:2107.10143, 2021","venue":null,"work_id":"d922ba49-ffbf-45ff-a828-2edcbedd9fc8","year":2021},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"cited_paper":"/paper/2107.10143","citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:dca89a9c4173b09f2ab548e4a9aed946ffcb35443374e30d18542cdf12f08720","observation_id":"3c6131d2-2d78-4928-b28c-11ebaf47565e","resolution":{"observed_at":"2026-07-04T08:19:43.746370Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"A dataset and taxonomy for urban sound research","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:6d070ec980f520eb9741c373f36eb258f8f3b33d5f2ebc8fb8e79506cf228cc7","observation_id":"dee7eae6-ee50-409a-863d-af484dc416e4","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Clip models are few-shot learners: Empirical studies on vqa and visual entailment","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:20ef5e806a22a9b30a8c85219ab47c5b077e4764ca0acbba4930b3d58c0a1453","observation_id":"1f488f27-cc71-4bcf-803e-29cd776ba466","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Localizing memorization in ssl vision encoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:76b9cf323d0d5db0019f8f9690bdc03c52b7549247aea463c1bb637b00c16c01","observation_id":"58de9197-fdca-435a-9de3-08da3a9cdedb","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Memorization in self-supervised learning improves down- stream generalization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:22aa47d3f9de61556cd0c2a91761d476628503378cd261cdee713fef8156c7a8","observation_id":"e9577389-ceaa-40fa-9765-3b531c31e1c4","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Captured by captions: On memorization and its mitigation in clip models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:ae785eaa758db8784fe03f667eb1561efffca7cbe9b9bb24d5de5e98a10872c5","observation_id":"c571462b-ce2d-45b0-ad6d-99356d36969a","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:0fdf0d115502ca3b47324cce28eb0ecef6045fc3841438660593e3eec60d15bd","observation_id":"c6238950-4091-4ea6-a5c1-0a94bedb95a5","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Vqa-gnn: Reasoning with multi- modal knowledge via graph neural networks for visual ques- tion answering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:e43ee55b8ac9fc97f6d19d87a7a0c3b8e6bd5cbe1e0082369747b18f4a8f15ed","observation_id":"8528b358-36c1-46c8-88f0-e1d067969f5c","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Cookie: Contrastive cross-modal knowledge sharing pre-training for vision-language representation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:4e6131d2fae7aa90267927ab14956c91c777f0d6bdd984ae42173a3f0322ec07","observation_id":"7d7b8307-b741-4b66-93ad-e44bc7176811","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Videoclip: Contrastive pre-training for zero-shot video-text understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:504a27300276689c85d40d07681940bc8bc390ed333df6d6b58d1cfeeea6c9f1","observation_id":"87d7da45-f321-4942-9622-12e4527aea8d","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Msr-vtt: A large video description dataset for bridging video and language","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:5e4a128af62eb0a28f5c651033b0c2ed964994e4c3ae163a6aebbf302ab8a3bd","observation_id":"502a4642-e33a-436d-bdd1-87b0606f130a","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Zero-shot video question answering via frozen bidirectional language models.Advances in Neural Information Processing Systems, 35:124–141, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:b7e0503aa23fe277f3c3e6914bf703acc42bc184d07b2fdda081e60a0c4cd35e","observation_id":"8ede04b4-ed7d-4ba2-b8b8-8375487ba005","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Leave-one-out distinguishability in machine learn- ing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:b5ab2e7904da2f1629d2cacda75296473d12fb8daad41b9c854ed0860df4356b","observation_id":"187e9b80-c9f7-40af-a1ab-ad8e13f09ad9","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Openvna: A framework for analyzing the behavior of multimodal language understanding system under noisy scenarios","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:23294a9eb000d38c55e2b54753530363ae0a62de256a121807856fdf7acec2de","observation_id":"890bd88e-d0bc-4fa4-bf17-f292917e0409","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Tip- adapter: Training-free adaption of clip for few-shot classifi- cation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:9572f9f21491123799b5ba255396b324b50ffc1d8df3ce2e726f3b6a249a5f63","observation_id":"5f35cc77-8066-469c-8007-eeada1a5deca","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"Style-aware contrastive learning for multi-style image captioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:d3fc954d7994e318aa880cbf532103e8f6292eed006b70a09ca86b4d47527543","observation_id":"9762a055-aced-4980-93b3-76ada2130595","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"The results are shown in Figure 7, which aligns with the results for AudioCLIP in the main paper","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:cc003c417658a4f892bdb39f1ec0dd053f42c5c867fcbbb1a8c153035860144d","observation_id":"9a693ef4-7fc0-4e9c-b68b-699fd3d57e35","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:59:16.070464Z","title":"a man talking about hydroponic fluid pres- sure","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T11:59:16.070464Z"},"links":{"citing_paper":"/paper/2606.22220"},"observation_digest":"sha256:4b8c790b30e01e5dd8a16087905722c6c5416dcb8a7629b5d4f1015af3035297","observation_id":"72dd861f-4365-4776-825e-f8130e959989","resolution":{"observed_at":"2026-06-26T11:59:16.070464Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.22220","last_updated":"2026-06-23T14:03:33Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T12:18:51.021917Z","submitted_at":"2026-06-20T20:46:36Z","title":"MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":34,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2606.22220."}